独Black Forest Labsがマルチモーダル基盤モデルFlux3を発表。Self-Flowアーキテクチャと専用コーデックで物理・デジタル環境の統合理解・生成を実現。LumaやRunwayを上回り、初のネイティブ音声生成で20秒の同期動画を出力可能。テキスト/画像/動画からの変換、キーフレーム遷移、多言語対話にも対応。....
AnthropicはClaudeの音声モードをアップグレードしており、英語に限らず中国語、広東語、日本語、ドイツ語など複数言語に対応し、多言語でのインタラクション体験を向上させています。
マスク氏のAI企業xAIは、多言語・音声対話技術の研究開発を加速し、最近、中国語AIトレーナーのグローバル募集を発表。リモートワーク対応で、主に大規模モデルGrokの音声対話と多言語処理能力の最適化を担当。米国での時給は35〜45ドルと競争力がある。....
マスク氏傘下のxAIが、中国語AIトレーナーを世界規模で募集開始。時給35~45ドル(約237~304元)、フルタイム・パート・リモート対応。大規模言語モデルGrokの多言語処理・音声対話能力向上が目的。....
リアルタイム字幕と音声入力。デスクトップ端末のあらゆる会話に対応し、翻訳と多言語をサポートします。
Trylli AIは、即時応答し、24時間体制で動作する、多言語対応のインテリジェントなエージェントプログラムで、音声通話を成果に変えます。
スマートAI音声エージェント。自然な対話、多言語対応。業務通話の自動化に使用します。
Myraは、多言語に対応したインテリジェントな音声AIアシスタントであり、さまざまな業界の会話をリアルタイムで処理し、サービス効率を向上させます。
Xai
$1.4
入力トークン/百万
$3.5
出力トークン/百万
2k
コンテキスト長
Anthropic
$105
$525
200
$7
$35
$21
Alibaba
-
$6
$24
256
$4
$16
1k
$8
$240
52
Bytedance
$1.2
$3.6
4
$3.9
$15.2
64
Moonshot
Baidu
32
Deepseek
$12
128
$0.75
Tencent
24
$0.8
Chatglm
ai-sage
GigaChat3-10B-A1.8BはGigaChatシリーズの対話モデルで、混合専門家(MoE)アーキテクチャに基づいており、合計100億のパラメータがあり、そのうち18億がアクティブなパラメータです。このモデルは、マルチヘッド潜在注意力と多トークン予測技術を採用しており、25.6万トークンの長文脈をサポートし、多言語対話と推論タスクで優れた性能を発揮します。
Guilherme34
Qwen3-32BはQwenシリーズの最新世代の大規模言語モデルで、強力な推論、命令遵守、エージェント間の相互作用、多言語処理能力を備えています。100種類以上の言語と方言をサポートし、思考モードと非思考モードをシームレスに切り替えることができ、ユーザーに自然でスムーズな対話体験を提供します。
Qwen2.5-14B-InstructはQwen2.5アーキテクチャに基づく多言語大規模言語モデルで、140億のパラメータを持ち、13種類の言語をサポートし、優れた指令追従と対話能力を備えています。このモデルは様々な言語タスクで優れた性能を発揮し、多言語シーンでのテキスト生成と理解に適しています。
lmstudio-community
KAT-DevはKwaipilotによって開発された多言語自然言語処理モデルで、複数の言語の対話タスクをサポートし、高効率かつ正確な言語処理能力を提供します。このバージョンはMLXチームによる8ビット量子化最適化を経ており、Appleシリコンチップに特化した性能最適化が行われています。
nineninesix
KaniTTSは高速で高忠実度のテキスト音声変換モデルで、リアルタイム対話型人工知能アプリケーション向けに最適化されています。このモデルは2段階の処理フローを採用し、大規模言語モデルと効率的なオーディオコーデックを組み合わせています。Nvidia RTX 5080で15秒の音声を生成する際の遅延は約1秒だけで、MOS自然度評価は4.3/5で、英語、中国語、日本語などの多言語をサポートしています。
geoffmunn
これはQwen/Qwen3-4B言語モデルのGGUF量子化バージョンで、アリババの通義シリーズによって開発された40億パラメータの大規模言語モデルです。消費者向けハードウェアに特化して設計され、強力な推論、インテリジェントエージェントワークフロー、多言語対話をサポートします。
NexaAI
NexaAI/Qwen3-0.6BはQwen3シリーズに基づく0.6Bパラメータの言語モデルで、推論、指令の遵守、多言語対応などの面で優れた性能を発揮します。思考モードと非思考モードのシームレスな切り替えをサポートし、複雑な論理推論と効率的な汎用対話に適しています。
tensorblock
Nile-Chat-4Bは、MBZUAI-Parisが開発した40億パラメータの多言語対話モデルで、先進的なTransformerアーキテクチャに基づいて構築され、対話シーンに特化して最適化されています。このモデルは複数の言語をサポートし、流暢な自然言語対話が可能で、高品質な応答生成能力を備えています。
maerong3
これはMistralアーキテクチャに基づく24Bパラメータの大規模言語モデルで、llama.cppを通じてGGUF形式に変換されました。モデルは多言語対話をサポートし、指令追従能力が特に最適化されており、様々なテキスト生成と理解タスクに適しています。
bartowski
HelpingAIのDhanishtha-2.0-previewモデルを定量化処理した多言語テキスト生成モデルで、推論や対話などの様々なシーンに対応しています。
King-Cane
Mistral-Small-3.1-24B-Base-2503に基づく多言語テキスト生成モデルで、10種類の言語をサポートし、ロールプレイングと対話シーンに適しています。
gamer-to
LLaMAアーキテクチャに基づいて微調整された多言語対話モデルで、アラビア語と英語をサポートし、対話タスクに最適化され、高品質な応答を提供します。
RedHatAI
Meta Llama 3.1シリーズの多言語大規模言語モデルで、8Bパラメータ規模を含み、多言語対話ユースケースに最適化され、8言語をサポートします。
radm
Qwen/Qwen3-4Bをファインチューニングした多言語哲学対話モデル、哲学と深遠なテーマに特化
JunHowie
Qwen3-8BはQwen3シリーズの大規模言語モデルで、因果言語モデルの特性を持ち、推論、多言語サポート、エージェント能力などの面で優れた性能を発揮し、ユーザーに自然でスムーズな対話体験を提供します。
Qwen3は通義千問シリーズの大規模言語モデルの最新8Bパラメータ版で、思考モード切り替え、多言語処理、ツール呼び出しをサポートし、強力な推論と対話能力を備えています。
unsloth
Qwen3-4B-FP8はQwenシリーズの大規模言語モデルの最新のFP8量子化バージョンで、40億のパラメータを持ち、32Kの文脈長をサポートしています。このモデルは推論、指令遵守、エージェント対話、多言語処理などの分野で優れた性能を発揮し、FP8量子化によって性能を維持しつつ推論効率を向上させています。
Qwen3-8B-BaseはQwenシリーズの最新世代の大規模言語モデルで、36兆トークンの多言語事前学習データに基づき、モデルアーキテクチャと学習技術を最適化し、効率的で正確な言語対話体験を提供します。
Qwen
Qwen3-1.7B-FP8はQwenシリーズの最新世代の大規模言語モデルのFP8バージョンで、強力な推論、指令遵守、エージェント対話、多言語サポート能力を備えています。
Qwen3-8BはQwenシリーズの最新の大規模言語モデルで、様々な先進的な特性を備え、多言語をサポートし、推論や命令追従などの面で優れた性能を発揮し、ユーザーによりインテリジェントで自然な対話体験を提供します。
AIアシスタントとGoogleカレンダーを組み合わせたスマートな待办事項アプリで、自然言語による対話と多言語操作をサポートし、タスク管理と日程同期機能を提供します。
Votars MCPは多言語実装をサポートするツールで、Votars AIプラットフォームとの統合に使用され、SSEとStdioの2つの対話モードを提供し、会議記録の取得などの機能をサポートします。
Speech MCPはGoose用に設計された音声対話拡張機能で、リアルタイムの音声認識、高品質のテキスト読み上げ、多言語サポート、および最新のオーディオビジュアライゼーションインターフェイスを提供し、多キャラクター対話生成と音声文字起こし機能をサポートします。
MCPプロトコルに基づくレストラン注文サービスのデモプロジェクトで、多言語対応の対話ができます