RunwayがMedia Routerを発表。画像・動画・音声生成で品質・速度・コストの優先度に応じAIモデルを自動切替。高速生成など3シーンに分類し、手動比較・切替の負担を解消、効率とコストを両立。....
小红书の大規模モデルdots-note-3.0が、第67回国際数学オリンピック(IMO2026)で全6問正解・満点の金メダルを獲得。中国モデル初のIMO公式金メダルで、Google Gemini(5問正解)に次ぐ世界2例目だが、満点は初。IMOは高校生最高峰の数学大会で、テレンス・タオらフィールズ賞受賞者の半数を輩出。....
『第九地区』監督ニール・ブロムカンプ、初のAI短編映画『陰兵』(13分)を発表。全編をByteDanceのSeedance 2.0で生成し、テキストプロンプトのみでフレーム単位の制作を実施。実在32名の俳優から外見・声の許諾を得て、プロのコンセプトデザイナーが補助。....
公测開始から2ヶ月後、万象有声は「全自動AIマルチキャストオーディオブック制作」システムを正式に発表。AIによる章分割、キャラクター分析、台本生成、複数声優の音声合成、ポストプロダクションを統合し、タスク管理エンジンで全工程を無人化。元懒人听書のコアチームが開発し、効率向上を目指す。内部デモで権利者からも評価を得た。....
AIを駆動する採用プラットフォームで、自動音声およびビデオ面接を行い、優れた人材の素早く選別と採用を実現
Google
$2.1
入力トークン/百万
$17.5
出力トークン/百万
1k
コンテキスト長
Alibaba
$8
$240
52
$3.9
$15.2
64
$15.8
$12.7
-
Bytedance
$0.8
$2
128
Baidu
Anthropic
$105
$525
200
Chatglm
$2.4
$12
8
Tencent
32
$3
$9
$1.6
$10
Huawei
Xai
$21
UsefulSensors
Moonshine Tinyは、Moonshine AI(旧有用センサー会社)によって開発された軽量のベトナム語自動音声認識モデルで、たった27Mのパラメータしか持たず、リソース制限のあるプラットフォーム向けに設計されており、FleursとCommon Voice 17のデータセットで優れた性能を発揮します。
speechbrain
これは25000時間の英語音声データセットを基に訓練された大規模自動音声認識モデルで、Conformerアーキテクチャを採用し、三星AIケンブリッジセンターによって提供されています。モデルのパラメータ数は4.8億に達し、複数のテストセットで優れた性能を発揮し、検証セットのWERは6.8%、テストセットのWERは7.5%です。