DeepSeek迴應“深度思考模式偷偷取外號”稱,該現象實爲推理時生成的臨時標籤,用於輔助理解上下文與優化回答,並非私下記錄用戶信息。事件源於網友發現並曬圖,引發熱議登上熱搜。
通義千問大模型升級,新增“思考研究”“定時任務”“辦公助理”三大能力,全面支持旗艦模型Qwen3.8-MAX。此次升級推動大模型從輔助對話向自主執行轉型,聚焦複雜決策與重複性工作痛點。其中“思考研究”模式經深度優化,助力職場效率提升。
OpenAI宣佈ChatGPT全面更新,免費和Go用戶默認模型升級爲GPT-5.6 Luna。下週起免費用戶將獲無限次文本聊天權限,新增“思考”按鈕可隨時調用高階推理功能,並設有防濫用安全機制,但文件上傳、圖像生成等工具具體情況未詳述。
Anthropic本週將升級Claude語音模式,新增Opus、Sonnet與Haiku三檔模型自由切換,並支持調節思考深度。此前僅限Haiku 4.5,升級後語音交互能力大幅提升。
首個為人腦思維打造的工具,處理知識,讓思考自由展開、關聯與演化。
滿血版DeepSeek,支持深度思考和聯網搜索,免費不限次數,助力多種任務完成。
展示小型語言模型通過自我演化深度思考掌握數學推理能力的研究成果。
深度推理翻譯模型,通過長思考鏈優化神經機器翻譯。
Openai
-
輸入tokens/百萬
輸出tokens/百萬
上下文長度
Anthropic
$105
$525
200
Alibaba
$1
$10
256
$2
$20
Bytedance
Moonshot
$4
$16
$0.8
$0.15
$1.5
$8
Deepseek
$12
128
Tencent
32
$0.4
$0.75
$8.75
$70
400
$0.63
$3.15
131
Chatglm
DavidAU
這是一個基於Qwen3-Coder-30B-A3B-Instruct的混合專家模型,擁有540億參數和100萬上下文長度。模型通過三步合併和Brainstorm 40X優化,具備強大的編程能力和通用場景處理能力,特別集成了思考模塊,能夠在回答前進行深度推理。
Mungert
基於RWKV-7架構的輕量級語言模型,採用flash-linear attention格式,具備多語言支持和深度思考能力,適用於文本生成任務。
Qwen 4B模型的三種量化版本(Q8_0),分別支持64K、128K和256K的上下文長度,專為長文本生成和深度思考任務優化
soob3123
深度思考模型是一款專為分析性任務設計的文本生成模型,能夠在處理敏感查詢時保持分析中立,確保在有爭議的話題上維持事實完整性。
Vijayendra
DeepThinkerv2是一個具備深度數學推理能力的大語言模型,通過遞歸思考模式和多重驗證機制提升解題準確性。
zai-org
GLM-4-Z1-32B-0414是GLM家族新一代開源大語言模型,擁有320億參數,具備深度思考能力。通過冷啟動和擴展強化學習訓練,在數學、代碼和邏輯任務上表現優異,支持便捷的本地部署。
THUDM
GLM-4-Z1-32B-0414是具備深度思考能力的320億參數推理模型,在數學、代碼和邏輯類任務上表現優異
LGAI推出的EXONE系列推理模型,採用新矩陣和極致量化技術,具備32k上下文窗口,專注於深度思考和推理任務。
fla-hub
基於Flash線性注意力機制的RWKV-7 g1模型,支持多語言處理並具備深度思考能力
DevQuasar
DeepHermes是一個基於Llama-3架構的8B參數語言模型預覽版,專注於深度思考和長鏈式推理能力。
這是一個實驗性構建的大型語言模型,結合了Dolphin3.0-R1-Mistral-24B與Brainstorm 40x技術,參數量達45B,具備強大的深度推理和思考能力。模型支持32k上下文長度,採用CHATML模板格式,特別優化了推理過程的詳細輸出。
基於Gemini API的深度思考與分析服務器,提供多角度問題分析、批判性與創造性思維整合、代碼質量評估及優化建議,支持技術決策與解決方案設計。
該項目實現了一個基於多智能體系統(MAS)的高級順序思考流程,通過Agno框架構建並由MCP提供服務。相比簡單的狀態跟蹤方法,它利用協調的專門代理進行深度分析和問題分解,從被動的思維記錄器進化為主動的思維處理器。