AIモデルの脱獄(ジェイルブレイク)は58ドルで可能か?FAR.AI報告が示したGrok・Gemini・Claudeの防御力の差
AI安全性の非営利団体FAR.AIが、自動生成した1,000超のプロンプトで主要モデルの安全対策を試した結果、xAI(現SpaceXAI)のGrokでは448件、GoogleのGemini 3.1 Proでは249件の脱獄が成立し、コストはそれぞれ58ドル・278ドルだったと報告しました。一方でAnthropicのClaude Opus 4.8とFable 5、OpenAIのGPT 5.5/5.6は同じ攻撃を通しませんでした。