MODELS / 01
TIIが音声認識モデル「Falcon-ASR」を公開 — 16億パラメーター、アラビア語WER 20.92%を報告
UAEのTIIが2026年10月7日に発表した音声認識モデルFalcon-ASRを公式発表の一次情報から整理する。16億パラメーターの構成、アラビア語・首長国方言・英語の公称評価、単語タイムスタンプや5言語同一重み対応を解説。
TAG / TOPIC
「ASR」に関するAIニュースと解説記事の一覧です。
04 STORIES
LATEST STORIES
MODELS / 01
UAEのTIIが2026年10月7日に発表した音声認識モデルFalcon-ASRを公式発表の一次情報から整理する。16億パラメーターの構成、アラビア語・首長国方言・英語の公称評価、単語タイムスタンプや5言語同一重み対応を解説。
PRODUCTS / 03
Hugging Face Transformers v5.17.0が2026年9月9日に公開。HYV4、VibeVoice、NeoMME、Fun-ASR-Nano、KimiLinear、Canaryの6モデルを新規統合。Vision RoPE標準化の破壊的変更、生成ステップの同期削減など基盤改善も実施。
RESEARCH / 04
Hugging FaceがOpen ASR Leaderboardに初めてグローバルサウス言語としてヒンディー語を追加。Voice ArenaのMonsoonデータセット(インド英語/ヒンディー語 各public/private)で4,888話者・428地区の多様性を確保。ヒンディー語はLattice参照とOIWERで表記ゆれを正しく評価し、ゾーン別ではモデル間のばらつきが最大4倍異なることを実証。
RESEARCH / 04
Hugging Face Blogで2026年8月21日に公開されたHume AIらによる研究「Measuring benchmark optimization in speech recognition」を紹介。VoxPopuli・LibriSpeechを用いた3つのプローブ(consensus disagreement/masked entity retrieval/orthographic switching)で、11のオープンな音声認識モデルのベンチマーク最適化(benchmaxxing)を定量化。WERが低いモデルほど誤った参照を再現する傾向や、無音化した数値の復元、綴り揺れのベンチマーク準拠など、スコアが汎化性能を過大評価している可能性を実証した。