出典 · ITmedia NEWS
Microsoft、初のストリーミング文字起こしモデル「MAI-Transcribe-2-Streaming」公開 音声合成「MAI-Voice-2.1」と高速版も
JP
UNS-N サマリー
Microsoft AIは、ストリーミング文字起こしモデル「MAI-Transcribe-2-Streaming」と音声合成モデル群を発表した。低遅延な逐次認識や声のトーンを保った多言語合成に対応し、音声エージェント構築を想定する。Microsoft Foundryでプレビュー提供を始め、複合デモも公開した。
これは発見のための短い要約です。全文は配信元サイトでお読みください。
コメント
いいね・コメントにはログインしてください。 ログイン
まだコメントはありません。
ニュースへ戻る