#コーディングAI の記事一覧(11)

AI
2026-09-01 ・ The Decoder

Gemini 3.5 Proはなぜ遅れているのか?DeepMindが認めた「フロンティアの少し下」の意味

Google DeepMindのKoray Kavukcuoglu氏が、Googleの現行モデルは「フロンティアの少し下」にあると認めたうえで、「フロンティアにいること以外に重要なことはない」「100%確信している」と語りました。数カ月遅れているとされるGemini 3.5 Proへの言及はなく、代わりに示されたのはFlash系列の進化でした。

AI
2026-08-14 ・ The Decoder

GLM-5.3とは?Zhipu AIが「最強のオープンウェイト・コーディングモデル」を名乗る根拠と、脆弱性2,436件発見の意味

中国のAIスタートアップZhipu AIがGLM-5.3を公開しました。ベースモデルはGLM-5.2と同一で、性能向上はすべて事後学習の延長によるもの。中国のセキュリティチームと組んで269プロジェクトから2,436件の脆弱性を検出したとし、重みは約2週間後にオープンソース化される予定です。

AI
2026-07-26 ・ BAIR (Berkeley)

ABBELとは?LLMの要約を「信念状態」で監督し長時間タスクを効率化するBerkeleyの新手法を解説

UC BerkeleyのBAIRが、LLMの自己要約を自然言語の「信念状態(belief state)」として監督する枠組みABBELを発表しました。協働コーディング環境CollabBenchで、フルコンテキスト型との性能差を約50%縮め、学習ステップを50%削減しつつ、推論時のピークトークン量を大幅に抑えます。

AI
2026-07-24 ・ VentureBeat

Claude Opus 5とは?半額で最上位に迫るAnthropicの新主力モデルを事業視点で解説

Anthropicが金曜、コーディングとエージェント業務向けの新モデル「Claude Opus 5」を投入しました。価格は前世代Opus 4.8と同じ入力100万トークンあたり5ドル・出力25ドルに据え置き、最上位Fable 5の約半額でほぼ同等の知能を狙う「日常使いの主力」という位置づけです。

AI
2026-07-23 ・ The Decoder

Laguna S 2.1とは?小型オープンモデルがコーディングで巨大モデルを上回る理由を解説

Poolsideが小型オープンウェイトのコーディングモデル「Laguna S 2.1」を公開しました。Terminal-Bench 2.1で思考モード有効時70.2%を記録し、1兆パラメータ超のオープンモデルさえ下回るDeepSWEで40.4%を出すなど、規模ではなく「粘り強さ」で性能を稼ぐ設計が特徴です。

AI
2026-07-21 ・ VentureBeat

Laguna S 2.1とは?西側発の1180億パラメータ・オープンコーディングモデルをPoolsideが公開、その狙いを解説

米AIラボPoolsideが7月21日、オープンウェイトのコーディングモデル「Laguna S 2.1」を公開しました。1180億パラメータのMixture-of-Experts(MoE)ながら実行時は80億パラメータのみを使い、Terminal-Bench 2.1で70.2%を記録。中国勢が席巻するオープンウェイト市場に「西側が信頼して自社環境で動かせるモデルを」と対抗する戦略製品です。

Kimi K2.7 Codeとは?GPT-5.5の約5分の1価格で挑むオープン重みコーディングモデルを解説
2026-06-13 ・ The Decoder

Kimi K2.7 Codeとは?GPT-5.5の約5分の1価格で挑むオープン重みコーディングモデルを解説

Moonshot AIがコーディング特化のオープン重みモデル「Kimi K2.7 Code」を公開しました。入力100万トークンあたり0.95ドル・出力4.00ドルと、GPT-5.5(入力5.00ドル/出力30.00ドル)やClaude Opus 4.8(入力5.00ドル/出力25.00ドル)を大きく下回る価格設定が特徴です。

Claude Fable 5とMythos 5とは?コーディング・科学・サイバーで何が変わるかを解説
2026-06-09 ・ The Decoder

Claude Fable 5とMythos 5とは?コーディング・科学・サイバーで何が変わるかを解説

Anthropicが新モデル「Claude Fable 5」「Mythos 5」を公開しました。Fable 5はFrontierCodeで29.3%とOpus 4.8の13.4%・GPT 5.5の5.7%を大きく上回り、StripeやIMCなどの実務評価でも従来比で桁違いの生産性を示しています。価格は入力10ドル/出力50ドル(100万トークンあたり)とOpus 4.8の倍となり、安全装置として危険プロンプトはOpus 4.8へ自動フォールバックする仕組みも入りました。

← タグ一覧へ