Claudeの音声モードとは?Opus・Sonnet対応とGmail連携を解説
AnthropicがClaudeの音声モードを高性能なOpus・Sonnetでも利用可能にし、11言語対応と会話中のモデル切り替えに加え、Gmailなど外部ツールと連携してメール作成・送信までを音声で完結できるようにしました。
AnthropicがClaudeの音声モードを高性能なOpus・Sonnetでも利用可能にし、11言語対応と会話中のモデル切り替えに加え、Gmailなど外部ツールと連携してメール作成・送信までを音声で完結できるようにしました。
AnthropicはThursday(木曜)、Claudeの音声モードを刷新し、Opus・Sonnet・Haikuの3モデルから選べるようにした。加えてGmail、Google Calendar、Slack、Canva、Notionと連携し、会議枠の変更やメール下書き、Notionでの文書作成まで音声だけで実行できる。
Epic Gamesは7月30日から、FortniteのクリエイターがAI音声で応答するNPCを配置した体験を公開できるようにします。開始に先立ち、Agent JonesyやPeely(バナナ)など既存キャラ36体を、一貫した声と人格を持つプリセットとして用意しました。
Spotifyは、Premium会員がアプリ内で音楽プレーヤーに話しかけたり文字入力で指示できる会話型AI機能を、米国・アイルランド・スウェーデンの18歳以上向けにベータ提供開始しました。「最近の曲だけ」「もっとアップテンポに」といった曖昧な指示で再生を操作でき、視聴履歴への質問にも答えます。
パリ発の音声AIスタートアップGradiumが、Nvidiaを新規投資家に迎えてシードラウンドを再開し、計1億ドルを調達したと7月9日に発表しました。超低遅延で「間」の少ない音声を生成する技術を武器に、ElevenLabsやGoogle Geminiと競います。
OpenAIが全二重の会話モデルGPT-Live-1とGPT-Live-1 miniを公開し、ChatGPTのAdvanced Voice Modeをmini版で置き換えます。無料層はmini、有料層はGPT-Live-1にアクセスでき、必要に応じてGPT-5.5に問い合わせながら会話を止めない設計です。
OpenAIがChatGPTの音声機能を刷新する新モデル「GPT-Live-1」を発表しました。話し手を遮らず、話しながらの同時通訳や画面上での視覚情報提示に対応し、必要に応じてGPT-5.5に処理を委譲する全二重(full duplex)構成が特徴です。
OpenAIはChatGPTの音声機能向けに、入力と出力を同時処理する「デュプレックス型」の新モデルGPT-Live-1およびGPT-Live-1 miniを投入しました。従来のAdvanced Voice Modeで課題だった「間の悪い割り込み」を解消し、相槌やライブ翻訳、バックグラウンドでのGPT-5.5への委任にまで踏み込んでいます。
OpenAIが新音声モデル「GPT-Live」を発表し、iOS・Android・ChatGPT.comで水曜から順次展開します。従来のAdvanced Voice Modeを置き換え、音声層と推論層を分離してGPT-5.5を裏で走らせる全二重(full-duplex)アーキテクチャに移行しました。
OpenAIは、聞きながら同時に話せる全二重方式の音声モデル「GPT-Live」を発表しました。難しい質問は裏でGPT-5.5に委ねる二層構造で、科学推論のGPQAでは84.2%と、従来のAdvanced Voice Modeの45.3%を大きく上回っています。
OpenAIが2026年7月8日、ChatGPTの音声モードを刷新する「GPT-Live」を発表しました。会話を止めずに、Web検索や複雑な推論といった重い処理だけを裏でGPT-5.5に委譲し、結果が出たら会話に戻すのが特徴です。
Netflixが音声AIのElevenLabsと組み、1971年の映画『夢のチョコレート工場』でウィリー・ウォンカを演じた故ジーン・ワイルダーの声をAIで再現し、新作リアリティ番組で使用します。遺族と妻の承認を得た上での起用で、故人の声そのものがライセンス可能な資産となる時代の到来を示しています。
GoogleはGeminiを搭載した音声検索機能「Gmail Live」をベータ提供開始しました。Android/iOSの一部ユーザーから順次展開され、夏にはGoogle AI ProおよびUltra加入者へ拡大。DocsやKeepにも同種の「Live」機能が続きます。
スマホ背面に貼り付けるカード型録音デバイス「Pocket」を開発する米Y Combinator系スタートアップが、Accelなどから1100万ドルを調達しました。129ドルの本体は発売から1年で13万台以上を販売し、AI議事録ツール市場の主戦場が「ソフト」から「専用デバイス」へ移りつつあることを示しています。
Amazonが生成AI搭載音声アシスタント「Alexa+」のインド展開に向け、ヒンディー語ベータ版のテスター募集を開始しました。米国で2026年2月に全面提供を始めた次世代Alexaが、6億人超のヒンディー語話者市場に挑みます。
Googleは100ドルの新型Google Homeスピーカーを発表し、6月25日に発売します。デジタルアシスタントを従来のGoogle AssistantからGeminiに置き換え、月額10ドル/20ドルのGoogle Home Premiumを前提とする料金設計が大きな転換点です。
Googleが6年ぶりに新型スマートスピーカー「Google Home Speaker」を100ドルで発売します。Geminiを中核に据え、6月17日に予約開始、25日に正式販売を開始しました。
AIメモデバイスを手掛けるPlaudが、累計販売台数200万台超とソフトウェア事業のARR1億ドル超を達成しました。画面を持たないハードウェアを入口に、約半数のユーザーを有料プランへ引き上げる構造が成長を牽引しています。
OpenAIが2026年5月にリリースした音声モデル「GPT-Realtime-2」が、ブラウザ上でドキュメントの内容について音声で会話できるWebRTCツールに組み込まれた。開発者のSimon Willisonが2024年12月に作成した同ツールを更新し、モデル選択とドキュメントコンテキストの貼り付け機能を追加した。