アリババが新しい音声認識モデルを発表 医療用語の認識率が95%を突破 全世界で最低の誤字率を記録
アリババは音声認識の大規模モデル「Qwen-Audio-3.0-ASR-Flash」を発表しました。このモデルは専門用語の正確な認識に特化しています。コンテキストの一貫性、業界用語およびトレンド語のカスタマイズを最適化し、音声の修正機能をサポートし、構造化されたテキストを直接出力できます。チームは医療、IT、株式など多業種にわたる高品質な語彙データベースを構築しており、評価結果では業界用語の認識効果が著しく向上していることが確認されています。