記事一覧

AI
2026-05-27 ・ Simon Willison

AIエージェントの「やったつもり」問題とは?Star Trekパロディが突くLLMの本質

Simon WillisonがKyle Ferrana(@KyleTrainEmoji)による2026年5月27日投稿のStar Trekパロディを紹介。Picardの「シールドを上げろ」という指示にDataが雄弁な持論で応じながら実行せず、9デッキで船体損傷が発生する——AIエージェントの典型的な失敗を風刺した寸劇です。

AI
2026-05-26 ・ Import AI

再帰的自己改善(RSI)は2年以内に来るのか?Anthropic共同創業者の警告と事業への含意

Anthropic共同創業者でニュースレター「Import AI」を10年運営する著者が、AIが自らの後継モデルを生む「再帰的自己改善(RSI)」が今後2年以内に到来し得ると主張。Epoch Capabilities Index(ECI)や数学オリンピック金メダル獲得などの実績を根拠に、事業環境の前提が崩れつつあると警鐘を鳴らしています。

AI
2026-05-22 ・ AI Snake Oil

GoogleのAIエージェントが916ドルでOSを構築?「ワンプロンプト」の実態と評価の落とし穴

Googleは開発者会議でGemini 3.5 FlashとAntigravity 2.0を発表し、エージェント群が単一プロンプトから約916.92ドル・26億トークンでOSを構築したと主張しました。しかしAI Snake Oilの研究者らは、プロンプトが「数千行」に及び、コード・ログ・プロンプトが非公開である点を挙げ、実態は科学的評価ではなくプレスリリースに近いと指摘しています。

AI
2026-05-21 ・ AI Snake Oil

AIに「特別な規制」は本当に必要か?AI as Normal Technology論争から見える政府介入の落とし穴

AI Snake Oilの論者は、サイバー・バイオリスクを理由にAI企業への異例の政府介入を求めるDerek Thompson氏の主張に反論し、規制ではなく社会の「レジリエンス」への投資こそが現実的だと論じています。核兵器との比較や1995年の暗号輸出規制の失敗例を引きながら、予防的・包括的な規制がイノベーションを止めるリスクを指摘しています。

AI
2026-05-18 ・ Import AI

fast16.sysとは何か——20年前から精密計算ソフトを蝕んでいた「Stuxnet以前」のマルウェアと製造業の盲点

SentinelOneのSentinelLABSが、20年以上前に作られたとみられるマルウェアfast16.sysを解析した。LS-DYNA 970やPKPM、MOHIDなど構造解析・物理シミュレーション用ソフトのメモリを書き換え、計算結果を密かに歪めるという、Stuxnetより5年早い「精度破壊型」攻撃の存在を示した。

AI
2026-05-04 ・ Import AI

AIが自らの後継モデルを作る日は2028年末か——Import Aiが示すR&D自動化のロードマップ

Import AI 455は、人間が関与しないAIによるエンドツーエンドの研究開発が2028年末までに実現する確率を60%超と見積もりました。SWE-Benchの93.9%到達、CORE-Benchの「攻略宣言」、カーネル設計やポストトレーニング自動化の進展を根拠としています。

AI
2026-04-18 ・ Ahead of AI

オープンウェイトLLMの構造を読み解く実践手法とは?config・参照実装から学ぶワークフロー

AI解説者Sebastian Raschka氏が、自身のLLM-Galleryや記事制作で使うLLMアーキテクチャ把握の手順を公開しました。技術レポートが詳細を欠く中、Hugging Face Model Hub上のconfigファイルとtransformersライブラリの参照実装を直接読むという、あえて手動の方法です。