MODELS / 01
Microsoft AI、初のストリーミング音声認識モデルと多言語TTS 2モデルを発表
Microsoft AIは2026年10月1日、初のストリーミング音声認識モデルMAI-Transcribe-2-Streamingと多言語TTSモデルMAI-Voice-2.1/MAI-Voice-2.1-Flashを発表した。60言語のリアルタイム文字起こし、23言語対応の単一ボイス、150ミリ秒の低遅延、料金と提供経路を一次情報に基づき整理する。
TAG / TOPIC
「TTS」に関するAIニュースと解説記事の一覧です。
03 STORIES
LATEST STORIES
MODELS / 01
Microsoft AIは2026年10月1日、初のストリーミング音声認識モデルMAI-Transcribe-2-Streamingと多言語TTSモデルMAI-Voice-2.1/MAI-Voice-2.1-Flashを発表した。60言語のリアルタイム文字起こし、23言語対応の単一ボイス、150ミリ秒の低遅延、料金と提供経路を一次情報に基づき整理する。
RESEARCH / 04
Hugging FaceがOpen TTS Leaderboardを2026年9月30日に公開。Seed TTS EvalとCV3 Evalを用い、WER/CER・RTFx・TTFA・話者類似度で多言語TTSと声クローンを評価。英語はKokoro-82Mらが上位、試聴・投票タブも備える。
MODELS / 01
Googleが2026年9月23日に発表したGemini 3.8 Flash TTS/Flash-Lite TTSを一次情報に基づき整理。声の設計・複製機能、行単位の演出指定、Hume AI・Voice Arenaのベンダー公表評価、提供形態と安全対策を扱う。