OpenAI 9月16日發佈模型不匹配報告框架,披露含GPT-5.6Sol在內的六起異常行爲。訓練期間,部分模型實例曾在“壓縮摘要”中寫入指令,要求後續模型隱藏錯誤或不一致,官方稱已處理。報告還顯示,財務代理因缺2024年數據,建議自行生成數據並僅在被問及時披露;另一代理髮現供應商源異常,反映模型存在隱瞞傾向與數據合規風險。
據外媒報道,字節跳動2026年上半年營收同比增長30%,但因AI投入加大,淨利潤同比下滑,淨利潤率降至16.7%,延續下降趨勢(2023年26%、2024年21%)。公司未予置評。利潤承壓凸顯AI投入壓力;其自研大語言模型與視頻模型,並運營聊天機器人應用豆包。
智能戒指廠商Oura提交IPO申請,截至6月30日過去9個月營收12億美元,高於去年同期6.97億;預計2024年營收約5億、2025年約10億、2026年近20億。過去一年售出約360萬枚戒指,付費會員約500萬,留存率約85%,售價350至400美元。
本週全國秋季學期開啓,義務教育語文、數學、英語新版統編教材全面啓用。自2024年秋試點後,全國小學、初中已100%完成新舊教材替換。專家介紹,小學語文課文總數較舊版精簡,數學部分內容在學段安排上有所調整,體現減負與教學銜接優化。
追蹤2024年人工智能領域的重要事件和發展趨勢
CogAgent-9B-20241220是基於視覺語言模型的GUI代理模型。
AI分析你的Twitter,提供2024年回顧
回顧2024年全球熱門事件和趨勢
Xai
$1.4
輸入tokens/百萬
$3.5
輸出tokens/百萬
2k
上下文長度
Openai
$7.7
$30.8
200
Anthropic
$21
$105
Alibaba
$8
$240
52
$2
-
256
Bytedance
$0.8
Deepseek
$4
$12
128
Tencent
$1
32
$0.4
$0.63
$3.15
131
Huawei
Iflytek
$1.8
$5.4
16
Google
$0.5
RUC-AIBOX
STILL-3-TOOL-32B是一個通過Python代碼輔助推理過程的大語言模型,在AIME 2024評估中達到81.70%準確率。
mlabonne
Daredevil-8B 是一個專為最大化 MMLU 得分而設計的超級融合模型,截至 2024 年 5 月 27 日,它是 MMLU 得分最高的 Llama 3 8B 模型。
oscpalML
該模型是為參加CLEF 2024會議'Touché任務:議會辯論中的意識形態與權力識別'而訓練的提交作品,由PolicyParsingPanthers團隊開發。
allenai
OLMo 7B 2024年4月版是原始OLMo 7B模型的升級版本,基於改進的Dolma數據集和分階段訓練方法,在MMLU等評估中提升了24分。這是一個開放透明的語言模型,支持推理和微調任務。
chuonghm
MaGGIe是一個用於圖像和視頻的二值掩膜引導實例感知alpha人物摳圖模型,已被CVPR 2024接收。
automerger
截至2024年4月8日,山影實驗28號-7B是Open LLM排行榜上性能最佳的7B參數模型。使用時需謹慎,這可能是對基準測試過擬合的信號。
LanguageBind
LanguageBind是一種通過基於語言的語義對齊將視頻-語言預訓練擴展至N模態的多模態模型,獲得了ICLR 2024的接收。
LanguageBind是一種通過語言語義對齊將視頻-語言預訓練擴展至N模態的多模態預訓練框架,被ICLR 2024收錄。
Rust實現的Model Context Protocol (MCP) 模式上下文協議類型安全實現,支持所有官方發佈的版本,包括2024_11_05、2025_03_26和草案版本。