Claude Opus 4.8とは?「正直さ」を強化したAnthropic最新モデルの実力と業務影響
Anthropicは2026年5月28日にClaude Opus 4.8を公開しました。性能向上は控えめながら、コードの欠陥を見逃す割合が前世代比で約4分の1に減るなど「ハルシネーション抑制」に明確な進歩が見られる点が特徴です。
Anthropicは2026年5月28日にClaude Opus 4.8を公開しました。性能向上は控えめながら、コードの欠陥を見逃す割合が前世代比で約4分の1に減るなど「ハルシネーション抑制」に明確な進歩が見られる点が特徴です。
Simon Willison氏のCLIツール「llm-anthropic」のバージョン0.25.1が公開され、Claude Opus 4.8(claude-opus-4.8)への対応と、対象アカウント向けの高速モード(`-o fast 1`)が追加されました。max_tokensの既定値も従来の8,192からモデル最大値へと変更されています。
Simon Willison氏が、MarkdownとSVGを同時に扱えるビューア「markdown-svg-renderer」を公開しました。ライブプレビューに加え、fenced code内のSVGを画像描画とコード閲覧の両面で扱える点が特徴です。
Simon WillisonがKyle Ferrana(@KyleTrainEmoji)による2026年5月27日投稿のStar Trekパロディを紹介。Picardの「シールドを上げろ」という指示にDataが雄弁な持論で応じながら実行せず、9デッキで船体損傷が発生する——AIエージェントの典型的な失敗を風刺した寸劇です。
Anthropic共同創業者でニュースレター「Import AI」を10年運営する著者が、AIが自らの後継モデルを生む「再帰的自己改善(RSI)」が今後2年以内に到来し得ると主張。Epoch Capabilities Index(ECI)や数学オリンピック金メダル獲得などの実績を根拠に、事業環境の前提が崩れつつあると警鐘を鳴らしています。
Googleは開発者会議でGemini 3.5 FlashとAntigravity 2.0を発表し、エージェント群が単一プロンプトから約916.92ドル・26億トークンでOSを構築したと主張しました。しかしAI Snake Oilの研究者らは、プロンプトが「数千行」に及び、コード・ログ・プロンプトが非公開である点を挙げ、実態は科学的評価ではなくプレスリリースに近いと指摘しています。
AI Snake Oilの論者は、サイバー・バイオリスクを理由にAI企業への異例の政府介入を求めるDerek Thompson氏の主張に反論し、規制ではなく社会の「レジリエンス」への投資こそが現実的だと論じています。核兵器との比較や1995年の暗号輸出規制の失敗例を引きながら、予防的・包括的な規制がイノベーションを止めるリスクを指摘しています。
SentinelOneのSentinelLABSが、20年以上前に作られたとみられるマルウェアfast16.sysを解析した。LS-DYNA 970やPKPM、MOHIDなど構造解析・物理シミュレーション用ソフトのメモリを書き換え、計算結果を密かに歪めるという、Stuxnetより5年早い「精度破壊型」攻撃の存在を示した。
Interconnectsの著者が北京・杭州・上海のAIラボを36時間で巡り、Alibaba、Moonshot AI、Z.ai、01.ai、DeepSeek、ByteDanceのDoubaoなど中国主要勢の内部文化を報告。技術スタックは米国と酷似する一方、組織のあり方が決定的に異なると指摘しています。