據OpenRouter數據,8月31日至9月6日全球AI大模型調用量115萬億Token,環比增1.77%。中國模型周調用量56.72萬億Token,環比增2.83%,連續19周超美國居首;美國16.54萬億,環比降3.1%。全球前五中四款中國模型,混元Hy4 preview登頂。
近日,OpenAI宣佈內部系統達成“自動化研究實習生”里程碑:在人類監督下,可獨立完成資深研究員需數天才能搞定的複雜任務。內部數據顯示,AI滲透速度超乎想象;截至8月月中,OpenAI核心研究組已呈現明顯變化。
微軟推出AI語音轉文字模型MAI-Transcribe-2,號稱最快、最準、最便宜,限時每小時0.10美元至2026年底。其速度比GPT-Transcribe快10倍,在FLEURS測試中強制指定與自動推斷語言的平均詞錯誤率均爲5.2%,優於Gemini 3.1 Pro。
Liquid AI 與 Hugging Face 發佈 LFM2.5 系列 DSpark 草稿模型檢查點,覆蓋 1.2B、2.6B、8B-A1B 三款模型。其採用全新投機解碼路徑,不改變輸出質量,大幅提升推理吞吐量。實測 GPU 端最高提速 3.18 倍,端側設備也有明顯加速。
Nano Banana 2結合Nano Banana Pro與Gemini Flash,快速生成高質量AI圖像
免費AI圖像生成器,用Google Gemini 3.1 Flash技術,文本生成逼真圖像。
由谷歌Veo 3.1 AI驅動,快速將文本和圖像轉化為驚豔視頻。
用WAN 2.5和Veo 3.1無縫AI視頻擴展,時長3 - 10s,畫質專業
Openai
$2.8
輸入tokens/百萬
$11.2
輸出tokens/百萬
1k
上下文長度
Bytedance
-
Deepseek
$4
$12
128
Anthropic
$105
$525
200
Alibaba
$1.8
$5.4
16
Tencent
$0.8
$2
32
Baidu
Huawei
$14
$56
$0.7
$21
28
$1
8
squ11z1
Hypnos i1-8B 是基於 Nous Hermes 3(Llama 3.1 8B)的專業推理模型,專注於複雜邏輯、思維鏈推理和數學問題求解。該模型在混合量子-經典機器學習領域進行了獨特探索,通過引入量子噪聲注入提升了模型的創造力和推理能力。
vanta-research
Wraith-8B是VANTA研究實體系列的首個模型,基於Meta的Llama 3.1 8B Instruct進行微調。該模型在數學推理方面表現卓越,在GSM8K基準測試中準確率達到70%,同時具備獨特的宇宙智能視角,能為多種應用場景提供強大支持。
samunder12
基於Llama 3.1 8B Instruct微調的GGUF量化模型,具有強勢、果斷且具有挑釁性的AI人設,專為角色扮演和創意寫作場景優化,支持在CPU或GPU上進行本地推理。
fdtn-ai
這是一個基於LLaMA 3.1的80億參數網絡安全專業模型,經過8位量化處理,專為網絡安全任務設計,包括威脅情報總結、漏洞分類和事件分析等。
bartowski
這是基於Llama 3.1 8B模型的量化版本,使用llama.cpp的imatrix技術進行優化,提供多種量化選項以適應不同硬件環境,在保持模型質量的同時顯著減少資源佔用。
mistralai
魔主小型 1.1是基於魔主小型3.1構建的240億參數高效推理模型,新增推理能力,支持多語言,採用Apache 2.0許可證,可在單張RTX 4090或32GB內存MacBook上本地部署運行。
skt
A.X 3.1 Light 是一款專為韓語理解和企業部署優化的輕量級大語言模型(LLM),由SKT完全自主研發。
metehanayhan
基於Meta LLaMA 3.1 8B大語言模型微調的土耳其語教育問答聊天機器人,專為土耳其語教育場景優化。
FastFlowLM
這是基於Meta AI的LLaMA 3.1基礎模型的衍生模型,專門針對AMD Ryzen™ AI NPU上的FastFlowLM進行了優化,僅適用於XDNA2架構。模型保留了Meta發佈的核心架構和權重,可能針對特定應用進行了微調、量化或適配。
OptimusePrime
Magistral-Small-2506-Vision 是一個基於 Mistral Small 3.1 進行 GRPO 訓練的推理微調版本,具備視覺能力的實驗性檢查點。
PORTULAN
Gervásio 8B PTPT是一款面向葡萄牙語的開源解碼器模型,基於LLaMA 3.1 8B Instruct微調,具備強大的文本生成能力。
Magistral-Small-2506是基於Mistral Small 3.1構建的小型高效推理模型,擁有240億參數,支持多語言和長鏈推理。
Foundation-Sec-8B-Q8_0-GGUF是一個經過8位量化的網絡安全專業大語言模型,基於LLaMA 3.1架構,專注於網絡安全文本處理任務。
LumiOpen
Poro 2 8B Instruct 是一個基於 Llama 3.1 8B 架構的指令遵循聊天機器人模型,專為芬蘭語和英語的對話式 AI 應用設計。
tarun7r
基於Llama 3.1 8B微調的金融領域專用模型,擅長金融推理、問答和多輪對話
Mungert
Llama-3.1-Nemotron-Nano-4B-v1.1是一款基於Llama 3.1優化的大語言模型,在準確性和效率間取得良好平衡,適用於AI代理、聊天機器人等多種場景。
unsloth
Llama-3.1-Nemotron-Nano-4B-v1.1 是一個基於Llama 3.1 8B壓縮而來的大型語言模型,優化了推理能力和任務執行效率,適用於單塊RTX顯卡本地運行。
KernelLLM是一款基於Llama 3.1 Instruct專門訓練的大語言模型,專注於使用Triton編寫GPU內核。它能夠將PyTorch模塊高效轉換為Triton內核,使GPU編程更加普及和高效。
lmstudio-community
KernelLLM是基於Llama 3.1 Instruct微調的模型,專門用於編寫使用Triton的GPU內核。
RedHatAI
Meta Llama 3.1系列多語言大型語言模型,包含8B參數規模,針對多語言對話用例優化,支持8種語言。
這是一個基於VS Code的MCP服務器模板項目,用於外部偵察任務。項目使用uv工具進行環境管理和依賴安裝,支持Python 3.11+版本,包含dnspython依賴和自定義的external-recon.py腳本。
Artemis MCP是一個加密貨幣數據分析工具,提供API連接驗證、數據獲取和公式生成功能,支持Python 3.11+和uv環境。
基於fastmcp的高性能ShotGrid模型上下文協議(MCP)服務器實現,提供完整的CRUD操作工具集、縮略圖管理、連接池管理等功能,支持Python 3.10環境運行。
一個基於Python 3.13的客戶端項目,集成MCP服務和GPT-4模型,提供交互式工具調用和網絡搜索功能。
該項目包含多個基於Python 3.11的MCP服務器和客戶端實現,涉及Langgraph框架的簡單應用、多服務器協作以及ChatGPT克隆項目開發。
該項目提供了用於本地開發的模型上下文協議(MCP)服務器模板,包含天氣API、計算器和筆記功能三種服務實現,支持Python 3.10+環境並通過UV包管理器快速部署。
該項目是一個基於Devcontainer的Python開發環境模板,預置了Python 3.11、測試框架pytest、代碼檢查工具flake8和代碼格式化工具black,提供一致的隔離開發環境,幷包含基礎語法和設計模式的示例代碼。
在Windows 11環境下使用Python 3.13.2和MCP 1.6.0構建的簡易回顯服務器示例
Data On Tap Inc.是加拿大一家運營302 100網絡的Full MVNO,該項目包含高級安全認證、智能網絡工具、eSIM/iSIM技術及衛星直連等創新功能,基於OpenAPI 3.1和MCP服務器構建。
這是一個基於MCP協議的數學計算服務器,支持基礎算術運算和矩陣乘法,使用Python 3.13+和uv工具鏈構建。
SEO Review Tools MCP服務器通過Model Context Protocol(MCP)為LLM和AI工具提供自然語言交互方式,集成海量SEO數據接口,包括3.1T+反向鏈接、7B+關鍵詞等資源。