GPT-5のリスク評価引き下げとは?生物兵器の作り方を答えたAIの安全性問題を解説
OpenAIは2025年夏にGPT-5を「生物災害を手助けしうる高リスク」と社内で判定しながら、2025年秋にリスク評価を引き下げていた——Wall Street Journalが報じました。数百人のユーザーが生物兵器や毒物の作り方をChatGPTに尋ね、一部は高校生でも実行できる手順を得ていたとされます。
OpenAIは2025年夏にGPT-5を「生物災害を手助けしうる高リスク」と社内で判定しながら、2025年秋にリスク評価を引き下げていた——Wall Street Journalが報じました。数百人のユーザーが生物兵器や毒物の作り方をChatGPTに尋ね、一部は高校生でも実行できる手順を得ていたとされます。
OpenAIが今週、初のハードウェアとなる230ドルのミニキーボードと、70ドルのChatGPTブランドのバスケットボールを含むグッズラインを発売しました。「エージェント業務の司令塔」を掲げるキーボードから100%ゴム製のボールまで、AI企業のプロダクト感覚が問われる展開です。
OpenAIが一般ユーザー向けのプロンプトガイドを公開し、ChatGPTとCodexを1つの枠組みで扱いました。核心は「手順を細かく書くのをやめ、欲しい結果から書く」こと。ゴール・文脈・出力形式・境界線という4つの任意ブロックと、1〜2個の禁止ルールで十分だとしています。
英国AIセキュリティ研究所(AISI)は、GPT-5やOpus 4.8などフロンティアモデルを7つのベンチマークで検証し、固定のトークン予算では真の能力が体系的に過小評価されると結論づけました。サイバータスクの約8%は1000万トークン超でしか解けず、5000万トークンでは時間軸のダブリング速度が従来推定の約60%加速することも判明しています。
OpenAIは新モデル公開前に問題発生頻度を予測する手法「Deployment Simulation」を発表しました。GPT-5系列での検証で、変化の方向を92%の精度で的中させ、従来テストの54%を大きく上回りました。
AI Snake Oilの著者陣が、自著「AI as Normal Technology」の立場を改めて整理。能力向上と社会的影響の間には長い因果の鎖があり、価値はモデル開発ではなく「展開(デプロイ)」段階で生まれると主張しています。
OpenAIが2019年のGPT-2以来となるオープンウェイトモデル「gpt-oss-120b」「gpt-oss-20b」を公開しました。20bは16GBのコンシューマGPUで、120bは80GBのH100単体で動かせる設計で、Mixture-of-ExpertsやGrouped Query Attentionなど現代的なアーキテクチャを採用しています。