World LabsのAtlasとは?写真数枚から3D空間を生成・復元する「空間文脈」モデルを解説
フェイフェイ・リー氏率いるWorld Labsが、テキスト・画像・動画・3Dデータをゼロから学習した「オムニモデル」Atlasを公開しました。2〜3枚の写真から3D空間を再構成し、1440pで最長1分の映像をカメラ位置指定つきで生成、再構成誤差の中央値25.3で専用3Dモデルを上回るとしています。
フェイフェイ・リー氏率いるWorld Labsが、テキスト・画像・動画・3Dデータをゼロから学習した「オムニモデル」Atlasを公開しました。2〜3枚の写真から3D空間を再構成し、1440pで最長1分の映像をカメラ位置指定つきで生成、再構成誤差の中央値25.3で専用3Dモデルを上回るとしています。
ラスベガスで先週開かれたAi4カンファレンスで、ノーベル賞受賞者のジェフリー・ヒントン氏、World Labs CEOのフェイフェイ・リー氏、Coursera共同創業者のアンドリュー・ング氏の3人が、AIの「開放」をめぐって同じ結論と異なる処方箋を示しました。3人が共通して警戒したのは、少数の巨大AI企業が進歩のペースを握る構図です。