Meta、初のリアルタイム音声認識モデル「Muse Voice Transcribe」 20人超の話者識別と多言語混在に対応

2026.09.02 13:18
Itmedia.co.jp

Metaは、リアルタイム音声認識モデル「Muse Voice Transcribe」を発表した。単一モデルで音声認識、話者分離、発話終了検知を処理し、20人以上の話者識別や日本語を含む多言語に対応する。「Meta Model API」で提供するほか、Mac版「Meta AI」」アプリや「Muse Code」でも利用可能だ。

検索

人気記事

2026.05.05 11:04
2026.08.27 22:48
2026.09.02 2:26
2026.09.02 8:13
2026.08.28 17:35

コメント一覧

まだコメントはありません。

コメント