谷歌DeepMind推出多語言手語轉文本模型SL2T,並首次搭載於Pixel11手機,讓手語AI進入消費電子產品。該模型接入Gboard和Live Transcribe,用戶通過前置攝像頭打手語,即可編輯消息、網頁檢索及與Gemini對話,替代鍵盤輸入。SL2T基於50多種手語、10萬小時素材訓練,約四分之一來自美國手語數據集,跨語種聯合訓練提升識別效果。
Epoch AI研究顯示,主流AI文本檢測器能近乎完美識別普通AI生成內容,但當大語言模型刻意模仿特定作者寫作風格時,準確率明顯下降,科學寫作最難辨別。實驗測試了Pangram、GPTZero和Originality.ai三款工具,採用495篇涵蓋博客、小說、科學的人類原創文本(均創作於ChatGPT問世前),發現風格模仿可有效逃逸檢測。
法國Mistral AI發佈文檔識別模型OCR 4,支持10個語族170種語言,在權威測試獲93.07分,輸出質量經人類評審優於GPT-5.5 Pro等競品。該模型小巧全面,覆蓋多場景任務,專精文檔識別。
Google 推出AI Studio獨立移動應用,已在Google Play開放預註冊,將Gemini驅動的AI開發平臺從桌面端擴展至移動端。用戶可通過自然語言快速構建應用、工具和小遊戲,支持語音或文字輸入描述創意,AI自動生成原型、專業圖標並設計界面,無需編程基礎即可輕鬆製作。
百度旗下新搜索智能助手,提供AI搜索與創作服務。
Google
$0.49
輸入tokens/百萬
$2.1
輸出tokens/百萬
1k
上下文長度
Openai
$2.8
$11.2
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$1
$10
256
$6
$24
$2
$20
$4
$16
Baidu
128
Bytedance
$1.2
$3.6
4
Clemylia
梅爾塔是一款基於Discord機器人Melta27開發的獨特小型語言模型,具有可愛、迷人和充滿熱情的個性特點,專門用於生成原創、獨特且可愛的文本內容。
richardyoung
olmOCR-2-7B-1025是由AllenAI開發的高質量OCR視覺語言模型,專門用於處理文檔、圖像中的文字識別任務。本倉庫提供其GGUF量化版本,採用Q8_0量化方式,在減小模型大小的同時保持了出色的準確性。
rodrigomt
這是基於Qwen3-Coder-30B模型的量化版本,專門針對代碼生成任務優化的語言模型,提供了多種GGUF格式的量化文件,在保持模型質量的同時顯著減小文件大小並提升推理速度
NexVeridian
這是Qwen3-Next-80B-A3B-Instruct模型的3位量化版本,專為MLX框架優化。該模型基於Qwen團隊開發的下一代大語言模型,經過指令微調,支持高效的文本生成任務。量化後模型大小顯著減小,同時保持了較好的性能表現。
notmax123
Zonos-v0.1 是一款領先的開源文本轉語音(TTS)模型,基於超過20萬小時的多語言語音數據訓練,在表現力和質量上可與頂級TTS供應商相媲美。支持零樣本語音克隆、多語言合成和精細的音頻控制。
Derur
這是一個收集了多種小語種GGUF格式大語言模型的精選集合,支持俄語、英語、德語等多種語言,涵蓋了事實查詢、數學計算、文化幽默和道德過濾等多個測試維度。
lmstudio-community
基於Mistral架構的小型多語言視覺語言模型,專為圖像文本轉換任務優化,支持20多種語言,經過MLX量化針對蘋果芯片進行了性能優化。
Devstral-Small-2507是由mistralai開發的一個小型文本生成模型,支持多種語言,並針對蘋果芯片進行了優化。
cocktailpeanut
OpenAudio S1是一款領先的文本轉語音(TTS)模型,基於超過200萬小時的多語言音頻數據訓練,支持13種常見語言,提供高質量的語音合成服務,並支持豐富的情感、語調和特殊效果標記。
DevQuasar
Devstral-Small-2505是一個基於Mistral架構的小型語言模型,支持文本生成任務,並可通過兼容的mmproj文件實現基礎視覺功能。
Mungert
Qwen3-0.6B是通義千問系列的最新一代小型大語言模型,具有0.6B參數,支持思考和非思考兩種模式切換,適用於文本生成、推理和智能體任務。
Isotr0py
Ovis2-1B是多模態大語言模型(MLLM)Ovis系列的最新成員,專注於視覺與文本嵌入的結構對齊,具有小模型高性能、強化推理能力、視頻與多圖處理以及多語言OCR增強等特性。
yjoonjang
預排序器是一種基於交叉編碼器的文本排序模型,旨在優化大語言模型的函數調用流程,通過縮小可用工具的語料庫來提高效率。
shethjenil
IndicF5是一個接近人類水平的多語言文本轉語音(TTS)模型,支持11種印度語言,基於1417小時高質量語音數據訓練而成。
ai4bharat
IndicF5是一個基於1417小時高質量語音數據訓練的接近人類的多語言文本轉語音(TTS)模型,支持11種印度語言。
ModelsLab
魚語語音 V1.5 是一款領先的文本轉語音(TTS)模型,基於超過100萬小時的多語言音頻數據訓練而成。
Isi99999
Zonos-v0.1 是一款領先的開源權重文本轉語音模型,基於超過20萬小時的多語言語音數據訓練而成,其表現力和質量可與頂級TTS服務商媲美,甚至更勝一籌。
KomeijiForce
布穀鳥是一個小型(3億參數)信息抽取(IE)模型,模仿大語言模型的下一詞預測範式,通過標記給定上下文中的下一詞進行預測。
SmallDoge
Doge 160M 是一個採用動態掩碼注意力機制的小型語言模型,由 SmallDoge 社區訓練,支持文本生成任務。
thefrigidliquidation
針對輕小說及網絡小說進行日譯英微調的大語言模型,支持32K詞元的長文本翻譯