下一代Gemini模型因內部分歧、算力緊張及審批流程繁瑣,發佈時間推遲兩個月。儘管有自研TPU,但模型訓練、雲業務及消費端、企業級AI需求疊加,算力仍不足。高層已啓動組織架構調整以緩解資源分配問題。
據臺媒鉅亨網援引分析報告,谷歌計劃2028年部署1200萬至1500萬顆自研TPU v9 AI加速芯片,同期英偉達AI GPU出貨約1240萬顆,谷歌有望在出貨量上超越。TPU是谷歌定製ASIC芯片,從不外售,此舉旨在降低對英偉達算力的依賴和成本。
據《華爾街日報》報道,英偉達已對前OpenAI首席科學家兼聯合創始人伊爾亞·蘇茨克維的保密實驗室SSI完成實質性投資,金額未公開。核心以大量旗艦GPU換取算力提升一個數量級,此前該實驗室主要依賴谷歌TPU。這標誌着英偉達罕見直接押注前沿AI安全研究。
谷歌正研發代號Frozen v2的AI芯片,將Gemini模型的架構直接固化在硅片中,以省去部分算力與數據搬運,提升推理效率。與最新通用TPU相比,該芯片有望實現更高的能效比,更經濟地運行大模型。
Gemma 3 是基於 Gemini 2.0 技術的輕量級、高性能開源模型,專為單 GPU 或 TPU 設備設計。
Google第六代張量處理單元,提供卓越的AI工作負載性能。
TPUv5e 上穩定擴散 XL 模型的應用
在瀏覽器中編寫和執行代碼
Openai
$0.63
輸入tokens/百萬
$3.15
輸出tokens/百萬
131
上下文長度
Chatglm
$8
$16
128
$2
Alibaba
-
Google
$0.14
$0.28
$0.7
$1.4
$0.35
Deepseek
$1
8
$1.05
$4.2
1k
camenduru
這是一個基於TPU訓練並轉換為PyTorch的穩定擴散模型,專注於文本生成圖像任務,特別適用於毛絨玩具類圖像的生成。
flax-community
一個針對斯瓦希里語新聞文本進行分類的RoBERTa模型,在Google Cloud TPUv3-8上訓練完成
基於因果語言建模目標預訓練的印尼語生成模型,使用Flax框架在TPUv3-8上訓練
基於Common Voice西班牙語數據預訓練的語音識別模型,使用Flax框架在TPU上訓練
monsoon-nlp
基於ELECTRA框架訓練的泰米爾語預訓練模型,第二版採用TPU訓練並擴大語料庫規模
NbAiLab
這是一個基於挪威語T5的模型,在挪威巨量語料庫(NCC)上使用TPU v3-8進行訓練。
Norod78
基於GPT2架構的微型希伯來文本生成模型,通過TPU和GPU訓練完成