#再帰的自己改善 の記事一覧(11)

AI
2026-09-07 ・ The Decoder

OpenAIの「自動研究インターン」達成とは?研究者1人あたり日額600ドル超の推論費が示す開発現場の変質

OpenAIが昨秋に掲げた「自動研究インターン」(人間の指示のもとで範囲の明確な研究タスクをこなすシステム)の目標を達成したと発表しました。同社の研究者の推論費用は中央値で1日600ドル超、上位10%では7,000ドル超に達し、8月中旬時点で人間1人日あたり3.1エージェント日が稼働しています。一方で主任科学者のJakub Pachocki氏は、監視手法の信頼性低下を理由に「誰もこの結果に備えていない」と警告しています。

AI
2026-09-06 ・ Simon Willison

RSI(再帰的自己改善)とは?OpenAIがAGIに代わって使い始めた新しい言葉

OpenAIが2026年9月6日ごろ、研究加速に関する記事「Research acceleration: The view inside OpenAI」と、チーフサイエンティストJakub Pachocki氏のエッセイ「An Alien Mind」を相次いで公開しました。開発者Simon Willison氏は両者に共通する「RSI(Recursive Self-Improvement=再帰的自己改善)」という語に注目し、これがOpenAIによるAGIの新しい言い換えではないかと指摘しています。

AI
2026-08-28 ・ TechCrunch

AIがAIを訓練する「AAR」とは?Anthropic論文が示す再帰的自己改善の現在地

Anthropicが金曜に公開した論文「Automated Researchers Can Reliably Mitigate Alignment Failures」は、自動化されたAI研究者(AAR)が10種のアライメント・ベンチマーク全てでモデル性能を改善し、しかも全体性能を落とさなかったと報告しています。論文は時給約4ドルのAPI推論コストと、人間研究者に支払う時給150ドルを並べて比較しています。

AI
2026-08-17 ・ Import AI

DiG-benchとは?ルールを教えずにAIの「発見力」を測る70本のゲーム型ベンチマークを解説

Import AI 469号が紹介したDiG-bench(Discovery in Games)は、ルールも目的も隠したまま70本のテキストゲームをAIに解かせ、「対話しながら世界の法則を推測できるか」を測る新ベンチマークです。Opus 5とFable 5がClaude Code併用で最高成績ながら、最難関のTier 7は0.2しか突破できず、人間には全ゲームをクリアした個人がいます。

AI
2026-08-16 ・ The Decoder

OpenAIのPreparednessチーム解散とは?「破滅的リスク」評価の分散が示す安全性ガバナンスの転換

OpenAIが2026年7月末に「破滅的リスク」を評価してきたPreparednessチームを解散し、生物・サイバーリスクの評価業務を既存チームへ振り分けていたことをFinancial Timesが報じ、The Decoderが8月16日に伝えました。元責任者のDylan Scandinaro氏は「再帰的に自己改善する(recursively self-improving)」AIの安全性に軸足を移し、社内では倫理責任者Chloe Bakalar氏やJoshua Achiam氏ら安全性人材の離脱が続いています。

AI
2026-08-05 ・ TechCrunch

Discovery Loopとは?ジェフ・ディーンのGoogle退社が示す「科学実験の自動化」という次の主戦場

1999年にGoogle30番目の社員として入社したジェフ・ディーン氏が同社を離れ、科学研究の自動化を掲げるAIスタートアップ「Discovery Loop」をCEOとして立ち上げます。共同創業者にはサンジェイ・ゲマワット氏、Google Brain創設メンバーのクオック・レ氏、Google DeepMindのオリオル・ヴィニャルス氏が名を連ね、初回ラウンドはRadical VenturesとKhosla Venturesが共同リード、親会社のAlphabetも出資に加わりました。

AI
2026-08-05 ・ AI Snake Oil

AIの再帰的自己改善(RSI)は本当に近いのか?プリンストン大「シャドー評価」でエージェントが論文2本とも不合格になった理由

プリンストン大学とUK AISIの共著者らが、フロンティアAIエージェントに未公開論文2本の研究課題を渡し、数千ドル分のAPIクレジットと6日間を与えて研究させたところ、元論文の著者による査読で2本とも明確に不合格となりました。エージェントは予算の50%以上を使い残し、初日に最も野心的な目標を放棄していました。

AI
2026-07-29 ・ TechCrunch

Lilian Wengとは?Thinking Machines離脱とOpenAI復帰が示す「再帰的自己改善」競争の現在地

Thinking Machines共同創業者のLilian Weng氏が2026年7月27日、健康上の理由で退任を表明し、その2日後にOpenAIが同氏の復帰を認めました。復帰後は社内研究の加速を担うトップレベルのチームを率い、AIが自らを改良していく「再帰的自己改善(recursive self-improvement)」の横断研究を支援するとされています。

AI
2026-07-10 ・ The Decoder

GPT-5.6 Solとは?OpenAIのAIが小型モデルLunaを自力で後訓練した「自動AI研究」の中身

OpenAIは新フラッグシップGPT-5.6 Solが、曖昧な指示だけで小型モデルLunaの後訓練(ポストトレーニング)を自律実行したと発表しました。同社は本来なら研究者2名で2週間かかった作業だとし、AI研究の自動化に一歩近づいたと位置づけています。

AI
2026-06-08 ・ Import AI

AIドローンが人間チャンピオンを撃破、Anthropicは「自己改善」の兆候を報告──Import AI 460が示すAIの転換点

チューリッヒ大とGoogle DeepMindのRL学習ドローンが時速80km超でスイス王者マルヴィン・シェッパー氏を破り、Anthropicは2026年のコードマージ量が過去比8倍に達し再帰的自己改善(RSI)の予兆を観測しました。Import AI第460号は、AIが「人間の専門技能」と「自身の開発工程」の双方を侵食し始めた局面を切り取っています。

AI
2026-05-26 ・ Import AI

再帰的自己改善(RSI)は2年以内に来るのか?Anthropic共同創業者の警告と事業への含意

Anthropic共同創業者でニュースレター「Import AI」を10年運営する著者が、AIが自らの後継モデルを生む「再帰的自己改善(RSI)」が今後2年以内に到来し得ると主張。Epoch Capabilities Index(ECI)や数学オリンピック金メダル獲得などの実績を根拠に、事業環境の前提が崩れつつあると警鐘を鳴らしています。

← タグ一覧へ