无问芯穹与稀宇科技(MiniMax)签署战略合作,铺设四方向:共优模型推理效能体系、共建大模型Token服务与AI基础设施、联合创新应用范式、共拓行业智能化场景。双方优势互补,无问芯穹长于算力调度与推理基础设施,MiniMax手握自研大模型与海量应用流量,前者以底层算力支撑后者提升推理效率,打通从技术到落地的闭环。
谷歌正秘密研发专用芯片Frozen v2,应对AI算力压力。该芯片将Gemini大模型底层计算逻辑直接固化于硬件,性能功耗比预计可达现役自研芯片的6至10倍。这种软硬融合的设计从架构上重塑算力生态,意在显著提升运算效率。
谷歌正研发代号Frozen v2的AI芯片,将Gemini模型的架构直接固化在硅片中,以省去部分算力与数据搬运,提升推理效率。与最新通用TPU相比,该芯片有望实现更高的能效比,更经济地运行大模型。
蚂蚁集团副总裁周俊在AICon大会上强调,万亿参数模型算力成本惊人,每运行15分钟即消耗一辆特斯拉的费用,效率成为智能体时代核心挑战。他提出颠覆性策略,推动行业从盲目追求“更多”转向突破效率瓶颈。
智能算力即开即用,全面提升效率与竞争力。
Anthropic
$21
Input tokens/M
$105
Output tokens/M
200
Context Length
Google
$0.7
$2.8
1k
Iflytek
$2
-
Baichuan
4