GEN-1.5とは?ロボットが3〜12秒のお手本1回で新作業を覚える「フィジカルプロンプト」を解説
ロボティクス企業Generalist AIが、3〜12秒のデモ映像1回をコンテキストウィンドウに読み込ませるだけで新しい作業をこなすモデル「GEN-1.5」を公開しました。瓶の蓋開けや財布から紙幣を抜く動作など10種類のテストで平均成功率59%、5分ぶんのデータで10ステップ追加学習すると83%まで上がったと同社は報告しています。
ロボティクス企業Generalist AIが、3〜12秒のデモ映像1回をコンテキストウィンドウに読み込ませるだけで新しい作業をこなすモデル「GEN-1.5」を公開しました。瓶の蓋開けや財布から紙幣を抜く動作など10種類のテストで平均成功率59%、5分ぶんのデータで10ステップ追加学習すると83%まで上がったと同社は報告しています。
米ケンブリッジのスタートアップGeneralist AIのロボットアームが、短い手本動画を見ただけで、そのタスク専用の学習なしにコップ積みや財布のジッパー開けをこなす様子をWIREDのWill Knightが取材しました。ただし平均成功率は約59%で、実運用に必要とされる99%超には遠く届いていません。