#Gemini 3.5 Transcribe の記事一覧(3)

AI
2026-08-26 ・ Ars Technica

Gemini 3.5 Transcribeとは?「えーと」を消す音声入力AIが企業の議事録・カスタマーサポートに効く理由

Googleが音声認識モデル「Gemini 3.5 Transcribe」を投入しました。発話中の「えーと」や言い直しをその場で削除し、整形済みテキストを出力するもので、音声から最終テキストまで従来比約70%高速、ライブ音声のエラー率は5.5%(従来エンジンChirp 3はGoogle計測で7.32%)。85言語に対応し、Pixel 11のGboard「Rambler」機能で既に稼働しています。

AI
2026-08-26 ・ Engadget

Gemini 3.5 Transcribeとは?85言語対応の音声認識モデルが業務の「入力」を変える理由

Googleが新しい音声モデル「Gemini 3.5 Transcribe」を公開しました。85以上の言語を自動判別し、フィラー(えー、あのー)を除去した整形済みテキストを生成、最大3人までの話者を単語単位のタイムスタンプ付きで識別します。Pixel 11シリーズの「Rambler」やmacOS版Geminiアプリを動かし、APIでも提供されます。

← タグ一覧へ