Muse Voice Transcribeとは?Metaの新音声認識が「1時間3円台」で市場を壊す理由
Meta Superintelligence Labsが、リアルタイム音声認識モデル「Muse Voice Transcribe」を公開しました。英語の単語誤り率3.1%・発話終了から0.16秒という精度と速度を、1時間あたり0.18ドル(音声1,000分で3ドル)という業界最安値で提供します。話者分離と文境界検出も同一モデルに内包しています。
Meta Superintelligence Labsが、リアルタイム音声認識モデル「Muse Voice Transcribe」を公開しました。英語の単語誤り率3.1%・発話終了から0.16秒という精度と速度を、1時間あたり0.18ドル(音声1,000分で3ドル)という業界最安値で提供します。話者分離と文境界検出も同一モデルに内包しています。