GPT-Liveとは?OpenAIの全二重音声モデルがGPT-5.5と連携する仕組みを解説
OpenAIは、聞きながら同時に話せる全二重方式の音声モデル「GPT-Live」を発表しました。難しい質問は裏でGPT-5.5に委ねる二層構造で、科学推論のGPQAでは84.2%と、従来のAdvanced Voice Modeの45.3%を大きく上回っています。
OpenAIは、聞きながら同時に話せる全二重方式の音声モデル「GPT-Live」を発表しました。難しい質問は裏でGPT-5.5に委ねる二層構造で、科学推論のGPQAでは84.2%と、従来のAdvanced Voice Modeの45.3%を大きく上回っています。
Mistralが初のロボットナビゲーション向けAI「Robostral Navigate」を公開しました。RGBカメラ1台のみで未知の環境を移動し、標準ベンチマークR2R-CEで79.4%の成功率を達成しています。
AnthropicがフラッグシップのClaude Fable 5を「プランナー」に限定し、実行は小型のSonnet 5に任せる二つの構成を公式に推奨。SWE-bench Proでは単体比92%の性能を63%のコストで実現しました。
Google DeepMindは2026年7月8日、Gemini APIのManaged Agentsに4つの新機能を追加しました。HTTP接続を開いたままにせずエージェントを非同期実行できる「Background Execution」と、社内DB・APIに直結できるリモートMCPサーバー対応が中核です。
中国AIスタートアップのMiniMaxが、2.7兆パラメータのオープンソース大規模言語モデル(社内名称M3 Pro)を早ければ第3四半期に公開する計画だと、The Informationが関係者2名の話として報じました。現行のM3(4280億パラメータ)から6倍以上に規模を拡張し、中国市場で最大のモデルとなる見通しです。
Metaが試作中のAIグラス「Super Sensing」は、カメラとマイクで装着者の周囲を常時記録し、数秒ごとに写真を撮影する。Ray-Ban版と異なり録画を示すLEDが点灯しない設計とされ、社内でもプライバシー議論が起きている。
MetaのSuperintelligence LabsがエージェントAI型の画像生成モデル「Muse Image」を公開。@メンションでInstagramの公開アカウントから本人の写真を引き出し、同意なしに新しい画像を生成できる仕様が、GDPRとEU AI Act(第50条)への抵触リスクとして浮上しています。
OpenAIは7月9日、米商務省の承認を経てGPT-5.6シリーズを一般公開しました。上位モデル「Sol Ultra」はコーディング指標TerminalBench 2.1で91.9%を記録し、Anthropic「Claude Mythos 5」の88.0%、Google「Gemini 3.1 Pro Preview」の70.7%を上回りました。
JavaScriptランタイム「Bun」の開発者Jarred Sumner氏が、コア言語をZigからRustへ全面書き換えした過程を公開しました。100万行超をLLMが生成し、実作業は約11日、API価格換算で約16万5000ドル。Rust版は6月17日リリースのClaude Code v2.1.181以降で稼働し、Linuxで起動が10%高速化した以外はほぼ誰も気づかなかったといいます。