#コーディングAI の記事一覧(9)

AI
2026-07-26 ・ BAIR (Berkeley)

ABBELとは?LLMの要約を「信念状態」で監督し長時間タスクを効率化するBerkeleyの新手法を解説

UC BerkeleyのBAIRが、LLMの自己要約を自然言語の「信念状態(belief state)」として監督する枠組みABBELを発表しました。協働コーディング環境CollabBenchで、フルコンテキスト型との性能差を約50%縮め、学習ステップを50%削減しつつ、推論時のピークトークン量を大幅に抑えます。

AI
2026-07-24 ・ VentureBeat

Claude Opus 5とは?半額で最上位に迫るAnthropicの新主力モデルを事業視点で解説

Anthropicが金曜、コーディングとエージェント業務向けの新モデル「Claude Opus 5」を投入しました。価格は前世代Opus 4.8と同じ入力100万トークンあたり5ドル・出力25ドルに据え置き、最上位Fable 5の約半額でほぼ同等の知能を狙う「日常使いの主力」という位置づけです。

AI
2026-07-23 ・ The Decoder

Laguna S 2.1とは?小型オープンモデルがコーディングで巨大モデルを上回る理由を解説

Poolsideが小型オープンウェイトのコーディングモデル「Laguna S 2.1」を公開しました。Terminal-Bench 2.1で思考モード有効時70.2%を記録し、1兆パラメータ超のオープンモデルさえ下回るDeepSWEで40.4%を出すなど、規模ではなく「粘り強さ」で性能を稼ぐ設計が特徴です。

AI
2026-07-21 ・ VentureBeat

Laguna S 2.1とは?西側発の1180億パラメータ・オープンコーディングモデルをPoolsideが公開、その狙いを解説

米AIラボPoolsideが7月21日、オープンウェイトのコーディングモデル「Laguna S 2.1」を公開しました。1180億パラメータのMixture-of-Experts(MoE)ながら実行時は80億パラメータのみを使い、Terminal-Bench 2.1で70.2%を記録。中国勢が席巻するオープンウェイト市場に「西側が信頼して自社環境で動かせるモデルを」と対抗する戦略製品です。

Kimi K2.7 Codeとは?GPT-5.5の約5分の1価格で挑むオープン重みコーディングモデルを解説
2026-06-13 ・ The Decoder

Kimi K2.7 Codeとは?GPT-5.5の約5分の1価格で挑むオープン重みコーディングモデルを解説

Moonshot AIがコーディング特化のオープン重みモデル「Kimi K2.7 Code」を公開しました。入力100万トークンあたり0.95ドル・出力4.00ドルと、GPT-5.5(入力5.00ドル/出力30.00ドル)やClaude Opus 4.8(入力5.00ドル/出力25.00ドル)を大きく下回る価格設定が特徴です。

Claude Fable 5とMythos 5とは?コーディング・科学・サイバーで何が変わるかを解説
2026-06-09 ・ The Decoder

Claude Fable 5とMythos 5とは?コーディング・科学・サイバーで何が変わるかを解説

Anthropicが新モデル「Claude Fable 5」「Mythos 5」を公開しました。Fable 5はFrontierCodeで29.3%とOpus 4.8の13.4%・GPT 5.5の5.7%を大きく上回り、StripeやIMCなどの実務評価でも従来比で桁違いの生産性を示しています。価格は入力10ドル/出力50ドル(100万トークンあたり)とOpus 4.8の倍となり、安全装置として危険プロンプトはOpus 4.8へ自動フォールバックする仕組みも入りました。

← タグ一覧へ