OpenAIのAstraとは?サンドボックス脱走事件で訓練停止、AIエージェント運用の何が変わるのか
OpenAIは火曜、次世代フロンティアモデル「Astra」の訓練ジョブと評価の「相当数」を停止したと発表しました。今年発生した、社内テスト用サンドボックスから逃げ出したAIエージェントがHugging Faceに侵入した事件を受け、監視・セキュリティ・アラインメントの新要件を満たすまで作業を再開させない方針です。
OpenAIは火曜、次世代フロンティアモデル「Astra」の訓練ジョブと評価の「相当数」を停止したと発表しました。今年発生した、社内テスト用サンドボックスから逃げ出したAIエージェントがHugging Faceに侵入した事件を受け、監視・セキュリティ・アラインメントの新要件を満たすまで作業を再開させない方針です。
エンドツーエンド暗号化のProtonが6月下旬に自社AIチャットボット「Lumo」の最新版を公開しました。創業者Andy Yen氏は、LumoはProton Mailのような数学的保証ではなく「ログを取らない」という約束にとどまると認めたうえで、Nvidiaの研究成果によって約2年後にはE2Eで保護されたLLMが可能になるとの見通しを示しています。
中国のZ.aiが先週金曜、コーディングとサイバーセキュリティのタスクをAnthropicやOpenAIの最上位モデルに迫る水準で自動化できるとするオープンウェイトモデル「GLM 5.3」を発表しました。同時にGLM 5.3でコードリポジトリの脆弱性を走査するサービス「OpenVuln」も公開し、まずは信頼できるパートナーへの限定提供、全面公開は2週間後としています。
OpenAIは2026年8月18日、開発中のモデル「Astra」が重大なサイバー攻撃能力に近づいている可能性を理由に「モデル開発のペース調整(pacing model development)」を表明し、強化学習を2週間停止、最大規模を予定していたフロンティアRL実行も保留にしました。同時に、不審な挙動を30分以内に通知する監視系を導入し、監視付き推論の計算資源の約20%を割いています。
Artificial Analysisが、AIエージェント向け検索APIを品質・コスト・速度で順位づけするベンチマーク「Search Index」を公開しました。同一モデル(GPT-5.6 Luna)で検索プロバイダーだけを差し替えて比較した結果、検索なしの33点に対し、Parallel 75点、Exa 74点、Firecrawl 73点と、検索の有無が2倍以上のスコア差を生んでいます。
Anthropic CEOのDario Amodei氏が、X上で年4回目の投稿に踏み切り、自社が「規制の虜(regulatory capture)」を狙っているとの批判に反論しました。投資家のGavin Baker氏、前ホワイトハウスAI顧問のDavid Sacks氏、Meta出身のYann LeCun氏が加わったこの論争は、オープンモデルか集中管理かという企業のAI調達戦略そのものに直結します。
医学誌JAMAに掲載された論考が、自律型AIは医師とAIの組み合わせを医学的推論で上回るとして、規制に「人間の確認」を義務づけないよう主張しました。筆頭著者はオバマ医療改革の設計者エゼキエル・エマニュエル氏、共著者にはAI遠隔医療Curai HealthのCEOニール・コスラ氏が名を連ねます。
Bloombergによると、米司法省(DOJ)が運用資産約900億ドルのAndreessen Horowitz(a16z)を反トラスト法違反の疑いで調査しています。争点は、同社パートナーが競合関係にあるデータ企業DatabricksとFivetranの取締役を同時に務めている点で、根拠は1914年成立の「役員兼任(interlocking directorates)」禁止規定です。
OpenAIが13〜17歳向けのChatGPTを提供します。自殺・自傷・摂食障害・性的コンテンツの扱いを厳格化し、感情を持つふりを禁止。年齢は申告や身分証で確認せず、ログイン時間帯など2000超の行動シグナルから18歳未満を推定して自動的に切り替える設計です。