OpenAI與開發平臺Kiro合作,將GPT-5.6模型家族(含Sol、Terra、Luna)嵌入軟件規劃、構建、審查、測試全流程。新模型每Token產出效率大幅提升,性能更強、性價比更高,並能按需處理複雜任務。
無問芯穹與稀宇科技(MiniMax)簽署戰略合作,鋪設四方向:共優模型推理效能體系、共建大模型Token服務與AI基礎設施、聯合創新應用範式、共拓行業智能化場景。雙方優勢互補,無問芯穹長於算力調度與推理基礎設施,MiniMax手握自研大模型與海量應用流量,前者以底層算力支撐後者提升推理效率,打通從技術到落地的閉環。
OpenAI 發佈 GPT-5.6 模型家族,包括旗艦 Sol、均衡 Terra 與高性價比 Luna。新一代通過底層技術棧深度優化,大幅提升每 token 智能效率,在降低 API 成本的同時增強性能。其中,旗艦 Sol 開啓最大推理能力後,在編碼智能體基準測試中表現超越競品。
7月21日,谷歌DeepMind發佈三款中輕量級AI模型。主力Gemini 3.6 Flash增強代碼、知識及多模態能力,Token用量減少17%以降低成本;3.5 Flash-Lite主打極致性價比;3.5 Flash Cyber專攻網絡安全。系列全面提升效率與應用落地。
Google
$0.49
輸入tokens/百萬
$2.1
輸出tokens/百萬
1k
上下文長度
Openai
$2.8
$11.2
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
Anthropic
$105
$525
$0.7
$7
$35
$17.5
Alibaba
$6
$24
256
-
$4
$16
$2
$20
Bytedance
$0.8
128
$0.15
$1.5
Baidu
32
$10.5
$8
nvidia
Llama-3.3-Nemotron-Super-49B-v1.5是基於Meta Llama-3.3-70B-Instruct的大語言模型,經過多階段後訓練增強了推理和非推理能力。支持128K token上下文長度,在準確性和效率之間取得了良好平衡,適用於推理、聊天和代理任務。
microsoft
微軟研究院開發的首個開源20億參數規模原生1比特大語言模型,在4萬億token語料上訓練完成,證明了原生1比特大語言模型在保持與同規模全精度開源模型相當性能的同時,能顯著提升計算效率。
由微軟研究院開發的開源原生1位大語言模型,參數規模達20億,在4萬億token的語料庫上訓練而成,顯著提升計算效率。
Llama-3.1-Nemotron-Ultra-253B-CPT-v1是基於Meta Llama-3.1-405B-Instruct的大型語言模型,支持128K tokens上下文長度,經過神經架構搜索優化,在準確性和效率之間取得良好平衡。
Notion MCP服務器是一箇中間件服務,通過Notion API實現LLM與Notion工作區的交互,支持Markdown轉換優化token使用效率。
OneMCP是一個通用的MCP協議聚合器,通過元工具架構將多個外部MCP服務器的工具統一管理,採用漸進式發現和語義搜索技術,顯著降低LLM的token消耗並提高工具發現效率。