Moonshot AIがKimi K2.7-Codeを公開――思考トークン30%削減を主張するも、独立ベンチマークでは疑問符
Moonshot AIはコーディング特化モデル「Kimi K2.7-Code」をオープンソースで公開し、前世代K2.6比で思考トークンを30%削減したと発表したが、独自ベンチマークでの好成績に対し研究者からは「自社テストでの改善は誰でも示せる」との批判が上がっている。
Moonshot AIはコーディング特化モデル「Kimi K2.7-Code」をオープンソースで公開し、前世代K2.6比で思考トークンを30%削減したと発表したが、独自ベンチマークでの好成績に対し研究者からは「自社テストでの改善は誰でも示せる」との批判が上がっている。
GoogleのGal Yona氏らの研究チームは、大規模言語モデル(LLM)のハルシネーション問題を「確信度と言語表現のずれ」と捉え直す「誠実な不確実性(Faithful Uncertainty)」という技術概念を発表した。誤り率を25%から5%に抑えようとすると正しい回答の52%が失われるという従来のトレードオフを、回答拒否ではなく確信度に応じた表現で応答することにより解消しようとするものだ。
NanoCo AIとJFrogは、自律型AIエージェントが悪意あるパッケージを自動インストールするリスクに対処するセキュリティ統合を発表した。NanoClawエージェントのパッケージ取得経路をJFrogの審査済みレジストリに限定し、改ざんパッケージへのアクセスを403エラーでブロックする仕組みを提供する。
UC Berkeley・Princeton・EPFL・Databricksの研究者チームが開発した「PixelRAG」は、Webページをスクリーンショットとして処理することでテキストベースRAGを6つのベンチマークすべてで上回り、AIエージェントが必要とするプロンプトトークン数を37.5百万から3.6百万へと約10分の1に削減した。
Metaが2026年3月に設立したApplied AIチームの約6,500人のエンジニアとプロダクトマネージャーのあいだで、AIモデルの学習データ生成という単純作業への不満が広がっており、社内ライブ配信中に怒りを露わにした社員が出るなど、士気の低下が深刻な問題となっている。
Appleは世界開発者会議(WWDC)でiOS 27を発表し、写真アプリに生成AI機能「Extend」「Spatial Reframe」「Clean Up」の強化版を追加する。ただし画像を最大25%拡張できるExtendは1枚につき1回のみ使用可能とするなど、記憶としての写真の真正性を保つ独自の制限を設けている。
Johnのプロパンガス会社が2026年6月12日、JennyのKrematorium(火葬場)事業に200億ドルを投じて5%の株式を取得したが、その資金の大半は同社へのプロパン代として還流しており、Forbesの担当記者が両者と婚姻関係を結んだことで取材の独立性にも疑問符がついている。
AnthropicがYouGovに委託し2025年11〜12月に実施した5万1993人規模の調査で、米国人の64%がAIによる雇用喪失を懸念していることが判明した。同時に56%は「AIへの認知依存」、すなわち自力で考える力を失うことへの不安を抱えており、職の喪失に次ぐ第2位の懸念事項となっている。
OpenAIは2026年6月12日、コーディングエージェントCodexのレート制限リセット方式を変更し、Go・Plus・Pro・Business全プランのユーザーに1回分の無料リセット権を付与する「バンク制」を導入した。CEOのSam Altmanがコスト問題を深刻な課題と認める中、Anthropicとの顧客争奪を見据えた動きとも重なる。