騰訊雲宣佈將於2026年5月22日起停止支持DeepSeek-V3-0324、DeepSeek-V3.1-Terminus和DeepSeek-R1-0528三款舊版模型,用戶需及時切換至新版本以確保服務持續穩定。
騰訊發佈Training-Free GRPO技術,通過外部知識庫替代參數微調,在模型參數凍結狀態下實現性能優化。該方法將經驗知識轉化爲token級先驗信息,顯著降低訓練成本,在DeepSeek-V3.1-Terminus模型上達到與昂貴微調相當的提升效果。
DeepSeek發佈開源模型DeepSeek-V3.1-Terminus,修復了語言不一致和異常字符問題,優化了編程與搜索智能體性能。基準測試顯示該模型在非智能體類任務中表現優異。