無問芯穹與稀宇科技(MiniMax)簽署戰略合作,鋪設四方向:共優模型推理效能體系、共建大模型Token服務與AI基礎設施、聯合創新應用範式、共拓行業智能化場景。雙方優勢互補,無問芯穹長於算力調度與推理基礎設施,MiniMax手握自研大模型與海量應用流量,前者以底層算力支撐後者提升推理效率,打通從技術到落地的閉環。
谷歌正祕密研發專用芯片Frozen v2,應對AI算力壓力。該芯片將Gemini大模型底層計算邏輯直接固化於硬件,性能功耗比預計可達現役自研芯片的6至10倍。這種軟硬融合的設計從架構上重塑算力生態,意在顯著提升運算效率。
谷歌正研發代號Frozen v2的AI芯片,將Gemini模型的架構直接固化在硅片中,以省去部分算力與數據搬運,提升推理效率。與最新通用TPU相比,該芯片有望實現更高的能效比,更經濟地運行大模型。
螞蟻集團副總裁周俊在AICon大會上強調,萬億參數模型算力成本驚人,每運行15分鐘即消耗一輛特斯拉的費用,效率成爲智能體時代核心挑戰。他提出顛覆性策略,推動行業從盲目追求“更多”轉向突破效率瓶頸。
智能算力即開即用,全面提升效率與競爭力。
Openai
$7.7
輸入tokens/百萬
$30.8
輸出tokens/百萬
200
上下文長度
Anthropic
$21
$105
Google
$0.7
$2.8
1k
Iflytek
$2
-
Baichuan
4