TAG / TOPIC

音声認識

「音声認識」に関するAIニュースと解説記事の一覧です。

05 STORIES

LATEST STORIES

音声認識の新着記事

タグ一覧

MODELS / 01

Microsoft AI、初のストリーミング音声認識モデルと多言語TTS 2モデルを発表

Microsoft AIは2026年10月1日、初のストリーミング音声認識モデルMAI-Transcribe-2-Streamingと多言語TTSモデルMAI-Voice-2.1/MAI-Voice-2.1-Flashを発表した。60言語のリアルタイム文字起こし、23言語対応の単一ボイス、150ミリ秒の低遅延、料金と提供経路を一次情報に基づき整理する。

MODELS / 01

Google、Gemini 3.5 Transcribeを公開 — 高精度な音声文字起こしの専用モデル、Gemini APIでプレビュー提供

Googleは2026年8月26日、音声文字起こし専用モデル Gemini 3.5 Transcribe を発表した。最も高精度な speech-to-text モデルと位置づけ、既に自社プロダクトで稼働。Gemini API経由でGoogle AI StudioとGemini Enterpriseでパブリックプレビューとして提供され、リアルタイムと録音音声の両対応をうたう。