#Opus 5 の記事一覧(8)

AI
2026-08-23 ・ Simon Willison

Ramp AI indexで見るAnthropicのモデル別支出:Opus 4.8が28.0%、Fable 5が8.0%にとどまる理由

Anthropicの年換算売上は7月に5月の470億ドルから650億ドルへ伸びた一方、法人カード7万社の決済データを集計したRamp AI indexでは、2026年7月のAnthropicモデル別支出シェアはOpus 4.8が28.0%で突出し、新しく高価なFable 5は8.0%、7月24日公開のOpus 5は3.5%にとどまりました。売上の急拡大と、現場での新モデル採用の遅さが同時に起きています。

AI
2026-08-17 ・ Import AI

DiG-benchとは?ルールを教えずにAIの「発見力」を測る70本のゲーム型ベンチマークを解説

Import AI 469号が紹介したDiG-bench(Discovery in Games)は、ルールも目的も隠したまま70本のテキストゲームをAIに解かせ、「対話しながら世界の法則を推測できるか」を測る新ベンチマークです。Opus 5とFable 5がClaude Code併用で最高成績ながら、最難関のTier 7は0.2しか突破できず、人間には全ゲームをクリアした個人がいます。

AI
2026-08-14 ・ Ars Technica

AIモデル価格はなぜ二極化するのか?GPT-5.6 Lunaの8割値下げとOpus 5の価格設計から読む

OpenAIはGPT-5.6 Lunaの入力価格を100万トークンあたり1ドルから0.20ドルへ、出力を6ドルから1.20ドルへ引き下げ、AnthropicはOpus 5を入力5ドル・出力25ドルと上位のFable 5の半額で投入しました。DeepSeekやMoonshotなど中国勢の追い上げを受け、米国ラボの値下げは中位モデルに集中しており、最上位の価格は据え置きか上昇傾向にあります。

AI
2026-08-04 ・ Simon Willison

llm-anthropic 0.26とは?Claude 5対応と「-T WebSearch」への破壊的変更を解説

CLIツールLLMのプラグイン「llm-anthropic」が0.26を公開し、claude-fable-5・claude-sonnet-5・claude-opus-5の3モデルに対応しました。同時にWeb検索は`-o web_search*`オプションを廃止して`-T WebSearch`へ統合され、拡張思考の設定も`thinking`と`thinking_effort`の2つに整理されています。

AI
2026-07-27 ・ The Decoder

expenditure horizonとは?METRが示す「AIと人間、どちらが安く成果を出すか」の測り方

研究機関METRは、同じ改善を得るのにAIと人間のどちらが安く済むかを比較する新指標「expenditure horizon(支出ホライズン)」を提案しました。NanoGPTスピードランで6つのAIモデルを検証したところ、各モデルの支出ホライズンは0〜3,300ドルにとどまり、人間の総投入額の推定25万ドルに遠く及びませんでした。

AI
2026-07-25 ・ Simon Willison

Opus 5はなぜ「最もプロンプトインジェクションされにくい」のか——Anthropicの新モデルとシステムカードの評価

AnthropicのBoris Chernyが、新モデル「Opus 5」を同社史上最もプロンプトインジェクション耐性が高いモデルと位置づけました。この評価はシステムカード73ページに記載され、PI(プロンプトインジェクション)評価とレッドチーミングの両方で確認されたと述べています(2026年7月25日、Simon Willisonが引用)。

← タグ一覧へ