國光量超人工智能團隊將前沿量子技術引入大語言模型決策與推理核心,推出面向科研學術領域的“玄冪”大模型家族。該模型在科研科普、任務路由、智能體決策等垂直任務中展現獨特競爭優勢,助力大語言模型突破純經典計算物理邊界。
OpenAI與開發平臺Kiro合作,將GPT-5.6模型家族(含Sol、Terra、Luna)嵌入軟件規劃、構建、審查、測試全流程。新模型每Token產出效率大幅提升,性能更強、性價比更高,並能按需處理複雜任務。
OpenAI 發佈 GPT-5.6 模型家族,包括旗艦 Sol、均衡 Terra 與高性價比 Luna。新一代通過底層技術棧深度優化,大幅提升每 token 智能效率,在降低 API 成本的同時增強性能。其中,旗艦 Sol 開啓最大推理能力後,在編碼智能體基準測試中表現超越競品。
思科開源小型AI模型家族Antares,專用於代碼庫漏洞精準定位。相比大型AI模型,Antares成本低、效率高,掃描500個代碼庫僅需15分鐘且花費不足1美元,同時注重本地隱私,能模擬黑客思路高效挖掘已知安全漏洞。
輕量級但功能強大的多模態模型家族。
Google
$0.49
輸入tokens/百萬
$2.1
輸出tokens/百萬
1k
上下文長度
Openai
$2.8
$11.2
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$1
$10
256
$6
$24
$2
$20
$4
$16
Baidu
128
Bytedance
$1.2
$3.6
4
Nanbeige
Nanbeige4-3B-Thinking是第四代Nanbeige大語言模型家族中的30億參數推理模型,通過提升數據質量和訓練方法實現了先進的推理能力。該模型在數學、科學、創意寫作、工具使用等多個領域表現出色,支持多階段課程學習和強化學習訓練。
inclusionAI
Ling 2.0是基於MoE架構的大語言模型家族,首個版本Ling-mini-2.0參數規模緊湊但功能強大,在複雜推理和指令遵循方面表現出色,採用1/32激活率的MoE架構,實現卓越性能與高效運行的完美結合。
OpenGVLab
InternVL3.5是開源多模態模型家族的新成員,顯著提升了InternVL系列的通用性、推理能力和推理效率,支持GUI交互等新功能,達到開源多模態大語言模型的先進水平。
utter-project
TowerVision是一個開源的多語言視覺語言模型家族,具備強大的多模態理解能力,在20種語言和方言中表現出色,特別擅長多模態多語言翻譯和文化感知任務。
unsloth
Gemma 3是谷歌推出的輕量級開源多模態模型家族,能夠處理文本和圖像輸入並生成文本輸出。具有128K大上下文窗口,支持140多種語言,適用於文本生成和圖像理解等多種任務。
google
Gemma 3是Google推出的輕量級、最先進的多模態開放模型家族,基於與Gemini模型相同的研究和技術構建。該模型能夠處理文本和圖像輸入並生成文本輸出,具有128K的大上下文窗口,支持超過140種語言,提供從270M到27B的多種尺寸選擇。
Gemma 3是谷歌推出的輕量級、最先進的多模態開放模型家族,能夠處理文本和圖像輸入並生成文本輸出。具有128K大上下文窗口,支持超過140種語言,提供從270M到27B多種規模選擇,適用於各種文本生成和圖像理解任務。
ibm-esa-geospatial
Llama3-MS-CLIP是CLIP家族中首個能夠理解多光譜圖像的視覺語言模型,基於SSL4EO-S12-v1.1數據集的一百萬個圖像-文本對以及生成的描述進行訓練,在大多數基準測試中表現優於其他基於RGB的模型。
T5Gemma是谷歌推出的輕量級且強大的編解碼器研究模型家族,通過將僅解碼器模型改編為編解碼器架構,實現了質量與效率的良好平衡。該模型適用於多種生成任務,可在資源有限的環境中部署。
T5Gemma是谷歌推出的輕量級且強大的編解碼器研究模型家族,通過將僅解碼器模型改編為編解碼器架構,繼承了基礎能力並在質量與效率間取得良好平衡。該模型適用於多種生成任務,編碼器也可用於判別任務,能在資源有限的環境中部署。
T5Gemma是谷歌推出的輕量級且強大的編碼器-解碼器研究模型家族,適用於多種生成和判別任務。
tiiuae
Falcon-H1是由阿聯酋技術創新研究所開發的新型大語言模型家族,採用結合Transformer注意力機制和狀態空間模型(SSMs)的混合架構,具備出色的長上下文記憶能力和計算效率。該系列模型提供從0.5B到34B參數的多種配置,在推理、數學、多語言任務等方面表現卓越。
Qwen2.5-VL-72B-Instruct是Qwen家族的最新視覺語言模型,具備強大的視覺理解和視頻分析能力,適用於金融、商業等多個領域。
Qwen2.5-VL是Qwen家族最新推出的視覺語言模型,具備強大的視覺理解和多模態處理能力,支持圖像、視頻分析和結構化輸出。
Qwen2.5-VL是Qwen家族的最新視覺語言模型,具備強大的視覺理解和多模態處理能力。
Gemma 3是谷歌推出的輕量級、最先進的開放模型家族,基於與Gemini模型相同的研究和技術構建。該27B版本採用量化感知訓練(QAT),能夠在顯著降低內存需求的同時保持與bfloat16相近的質量,具備多模態處理能力和128K大上下文窗口。
zai-org
GLM-4-Z1-32B-0414是GLM家族新一代開源大語言模型,擁有320億參數,具備深度思考能力。通過冷啟動和擴展強化學習訓練,在數學、代碼和邏輯任務上表現優異,支持便捷的本地部署。
GLM-4-32B-0414是GLM家族的新成員,擁有320億參數的高性能大語言模型。該模型在15T高質量數據上進行預訓練,包含大量推理型合成數據,在代碼生成、函數調用、搜索問答等多個任務場景中表現出色,性能可與GPT-4o和DeepSeek-V3等更大規模模型相媲美。
Alhdrawi
Qwen2.5-VL-32B-Instruct是Qwen家族的最新視覺語言模型,具備強大的視覺理解和智能代理能力,支持多模態任務處理。
christopherthompson81
Qwen2.5-VL-32B-Instruct 是 Qwen 家族的最新視覺語言模型,具備強大的多模態理解和生成能力,支持圖像、視頻和文本的交互。