#話者分離 の記事一覧(1)

AI
2026-09-06 ・ The Decoder

Muse Voice Transcribeとは?Metaの新音声認識が「1時間3円台」で市場を壊す理由

Meta Superintelligence Labsが、リアルタイム音声認識モデル「Muse Voice Transcribe」を公開しました。英語の単語誤り率3.1%・発話終了から0.16秒という精度と速度を、1時間あたり0.18ドル(音声1,000分で3ドル)という業界最安値で提供します。話者分離と文境界検出も同一モデルに内包しています。

← タグ一覧へ