#学習データ の記事一覧(5)

AI
2026-07-30 ・ The Decoder

LLMのスケーリング限界説は本当か?元OpenAI研究者が語る「10兆円のデータ収集競争」の中身

OpenAIを8カ月で退社した研究者Andrew Ho氏が、LLMの汎化性能の低さは計算資源ではなく学習データの欠落に起因すると主張し、今後AI各社が1000億ドル超を「狙い撃ちのデータ収集」に投じると予測しました。バイオインフォマティクスではGPT-5.6 Solでも成功率は約30%にとどまるといいます。

AI
2026-07-27 ・ TechCrunch

ロボット学習データはどこから来るのか?Encordが倉庫でJengaと脳波で「物理データ」を製造する理由

AI学習データ企業Encordが、カリフォルニア州San Leandroの倉庫で人間の「パイロット」約12名にロボットの訓練データを生成させています。ドイツのZander Labsの脳波ヘッドセットを使い、Jenga崩しの最中の脳活動まで記録する試みは、ヒューマノイド・倉庫ロボットの次のボトルネックが「現実世界の物理データの枯渇」だという賭けを象徴しています。

AI
2026-07-10 ・ Wired

Dataland(データランド)とは?Refik Anadolが開いた世界初「AIアート美術館」の中身と狙いを解説

アーティストRefik Anadolが2026年6月20日、ロサンゼルス中心部に「世界初のAIアート美術館」Datalandを開館し、最初の2週間で1万人超が来場しました。目玉は来場者の動きと生体データに反応する没入型作品「Machine Dreams: Rainforest」で、Smithsonianなどの自然科学アーカイブから自前で構築したAI「Large Nature Model」を基盤にしています。

AI
2026-06-20 ・ The Verge

AI音楽学習データセットとは?The Atlanticが暴いた2,100万曲超の無断利用と検索可能DBの衝撃

米The Atlanticが、AIモデルの学習に使われた音楽データセット4種類(最大1,200万曲・900万曲規模)を検索可能な形で公開しました。GoogleとStabilityも論文内で利用を認めており、YouTubeやSpotifyの利用規約違反となる取得手段が常態化している実態が浮き彫りになっています。

AI
2026-06-17 ・ TechCrunch

XDOFとは?フィジカルAIの「データ不足」を解く70億円スタートアップを解説

ロボット学習用データのパイプラインを構築する米XDOFがステルスを脱し、Thrive CapitalやSpark Capital、a16zなどから7,000万ドルを調達しました。OpenAIが2021年に閉じたロボティクス部門を2週間前に再始動させた直後のタイミングで、「フィジカルAI」の競争はモデルからデータ基盤へと舞台を移しつつあります。

← タグ一覧へ