月之暗面發佈開源大模型Kimi K3後,馬斯克透露旗下2萬億參數模型即將完成訓練,性能或超越Kimi K3及此前1.5萬億版本。他曾贊Kimi K3“令人印象深刻”,此進展引發超大規模模型競賽關注。據悉,Kimi K3參數規模達2.8萬億。
過去,具身智能因模型龐大、門檻極高,一直由巨頭和實驗室把持。7月19日,面壁智能開源首個具身AI模型系列MiniCPM-Robot,完整放出1.5B參數的視覺-語言-動作模型,讓個人開發者在真實機器人上實現操作與目標跟蹤,開放力度在具身領域罕見。該系列包含三個核心組件。
7月7日,螞蟻旗下靈波科技發佈LingBot-Depth2.0空間感知模型,基於1.5億數據訓練,提升邊緣清晰度、細小物體識別、遠距離深度估計及複雜場景魯棒性。該模型爲機器人“眼睛”,1.0版已解決透明、反光難題,2.0進一步升級。
Mistral AI發佈專爲Lean4設計的開源模型Leanstral1.5,採用Apache-2.0許可。該模型總參數119B,僅6B激活參數,兼顧高性能與低成本。在miniF2F形式數學基準中,驗證集和測試集均達100%完成率,並已挑戰Putnam等高難度推理任務。
Doubao-1.5-pro 是一個高性能的稀疏 MoE 大語言模型,專注於推理性能與模型能力的極致平衡。
DeepSeek-R1-Distill-Qwen-1.5B 是一款高效推理的開源語言模型,適用於多種自然語言處理任務。
Kimi k1.5 是一個通過強化學習擴展的多模態語言模型,專注於提升推理和邏輯能力。
VITA-1.5: 即時視覺和語音交互的GPT-4o級多模態大語言模型
Google
$0.49
輸入tokens/百萬
$2.1
輸出tokens/百萬
1k
上下文長度
Openai
$2.8
$11.2
Xai
$1.4
$3.5
2k
$7.7
$30.8
200
-
Anthropic
$105
$525
$0.7
$7
$35
$17.5
$21
Alibaba
$1
$10
256
$6
$24
$4
$16
$2
$20
Baidu
128
Bytedance
$1.2
$3.6
4
jayn7
騰訊混元視頻1.5模型的量化GGUF版本,專門用於文本到視頻生成任務,支持720P高清視頻生成,提供多種量化精度版本以優化使用效率。
本項目提供騰訊混元視頻1.5文本到視頻模型的量化GGUF版本,支持480P視頻生成任務,包含蒸餾模型和完整模型兩個版本,可與ComfyUI-GGUF等工具配合使用。
騰訊混元視頻1.5模型的量化GGUF版本,專門用於圖像轉視頻和視頻生成任務。提供480P分辨率的蒸餾模型和標準模型,支持多種量化精度,包括Q4_K_S、Q8_0和FP16等。
tencent
混元視頻-1.5是一款輕量級高性能視頻生成模型,僅用83億參數就能提供頂級的視頻質量,顯著降低了使用門檻。它能在消費級GPU上流暢運行,支持文本到視頻和圖像到視頻生成,讓每個開發者和創作者都能輕鬆使用。
MaziyarPanahi
VibeThinker-1.5B-GGUF 是 WeiboAI/VibeThinker-1.5B 模型的 GGUF 量化版本,由 MaziyarPanahi 進行量化處理。該模型是一個 1.5B 參數的文本生成模型,支持多種量化級別(2位到8位),便於在各種硬件上高效運行。
noctrex
本項目是卡納娜1.5-15.7B-A3B指令模型的MXFP4_MOE量化版本,可在特定場景下提升模型的運行效率。該模型基於kakaocorp/kanana-1.5-15.7b-a3b-instruct進行優化,採用混合專家架構和MXFP4量化技術。
Tarka-AIR
Tarka-Embedding-150M-V1是一個具有1.5億參數的嵌入模型,可生成768維的密集文本表示。它針對語義相似性、搜索和檢索增強生成(RAG)等多種下游應用進行了優化,專注於捕捉深層上下文語義,以支持跨不同領域的通用文本理解。
AbstractPhil
這是一個實驗性的Stable Diffusion 1.5蒸餾模型,採用v-預測流匹配方法和幾何引導的自適應塊加權技術。目前處於研究階段,訓練正在進行中,結果尚未驗證。
Kwai-Keye
快手Keye-VL是由快手Keye團隊打造的前沿多模態大語言模型,在視頻理解、視覺感知和推理任務中表現卓越。1.5版本通過創新的快慢視頻編碼策略、LongCoT冷啟動數據管道和強化學習訓練策略,在視頻理解、圖像感知和推理能力上達到新高度,支持長達128k標記的擴展上下文長度。
tensorblock
Arch-Router-1.5B 是一個專門用於大語言模型路由和偏好選擇的1.5B參數模型,基於transformers庫構建,採用katanemo-research許可證發佈。該模型能夠智能地將用戶查詢路由到最適合的大語言模型進行處理。
mradermacher
這是Veri - Code/ReForm - SFT - 1.5B模型的靜態量化版本,專為代碼生成、強化學習和形式驗證等任務優化,提供多種量化類型選擇,顯著提升推理效率。
Mungert
Kanana 1.5 是 Kanana 模型系列的新版本,在編碼、數學和函數調用能力方面有顯著提升,能夠處理長達32K個令牌的輸入,使用YaRN時可處理多達128K個令牌。
katanemo
Arch-Router是一個1.5B參數的偏好對齊路由框架模型,用於將查詢映射到領域-操作偏好以進行模型路由決策。
facebook
MobileLLM-ParetoQ是一個專為移動設備優化的極低比特大語言模型量化框架,支持1位、1.58位、2位、3位和4位量化設置,在保持高性能的同時顯著降低資源消耗。
GSAI-ML
LLaDA 1.5是一款通過方差縮減偏好優化(VRPO)方法訓練的大型擴散語言模型,專注於提升文本生成的質量和效率。
kakaocorp
Kanana 1.5是Kakao開發的雙語大語言模型,在編程、數學和函數調用能力方面有顯著提升,支持32K tokens上下文長度,通過YaRN擴展技術可處理128K tokens超長文本。
Kanana 1.5是Kanana模型家族的新版本,在編碼、數學和函數調用能力方面相比前代有顯著提升,支持32K tokens長度並可擴展至128K tokens。
mlx-community
基於Qwen2架構的1.5B參數規模的中英雙語通用文本嵌入模型,專注於句子相似度計算和文本檢索任務。
aiyouthalliance
基於Stable Diffusion 1.5構建的免費文生圖模型,通過多個LoRA模塊微調,生成的圖像遵循CC0許可協議,可免費商用無需署名。
speakleash
這是一個波蘭語的1.5B參數指令微調模型,基於SpeakLeash的Bielik系列開發,適用於文本生成任務。
基於Google Gemini 1.5 Pro模型的內容智能摘要服務