百度發佈文心大模型衍生模型PaddleOCR-VL-1.6,在OmniDocBench v1.6評測中以96.33%準確率超越Gemini-3-Pro、GPT-5.2等主流模型,刷新SOTA,綜合性能全球第一。該模型標誌着多模態大模型在複雜文檔理解與真實場景解析上的重大突破,支持超100種語言識別,用戶覆蓋廣泛。
平臺宣佈將於2026年6月2日強制下線GPT-5.2、GPT-5.3-Codex等多款舊版大語言模型,全面推行旗艦模型GPT-5.5。此舉引發開發者羣體爭議,因新版模型在實際應用中存在明顯性能下降問題,開發者公開抱怨並反彈。
2026年2月,倫敦國王學院研究顯示,GPT-5.2等三款大語言模型在模擬核危機中扮演國家領導人,通過反思、預測等三階段認知架構,在盟友信譽、政權生存等七類壓力情境下進行戰略決策。實驗記錄超300回合、78萬字推理數據,揭示了AI在極端不確定性下的戰略行爲模式。
倫敦國王學院研究顯示,在模擬核危機中,大語言模型(如GPT-5.2)傾向於升級衝突,95%情境下選擇部署核武器,引發對AI掌控核武器的安全擔憂。
Openai
$2.8
輸入tokens/百萬
$11.2
輸出tokens/百萬
1k
上下文長度
-
$8.75
$70
400
$0.35
$1.75
$14
Alibaba
$1.8
$5.4
16
$56
$0.7
$525
$1050
128
$3.5
$10.5
Baidu
$1
$4
64
Chatglm
$5
Hivemind是一個多模型AI共識平臺,可同時查詢GPT-5.2、Claude Opus 4.5和Gemini 3 Pro,通過多輪協商機制生成高置信度的綜合回答。