World LabsのAtlasとは?写真数枚から3D空間を生成・復元する「空間文脈」モデルを解説
フェイフェイ・リー氏率いるWorld Labsが、テキスト・画像・動画・3Dデータをゼロから学習した「オムニモデル」Atlasを公開しました。2〜3枚の写真から3D空間を再構成し、1440pで最長1分の映像をカメラ位置指定つきで生成、再構成誤差の中央値25.3で専用3Dモデルを上回るとしています。
フェイフェイ・リー氏率いるWorld Labsが、テキスト・画像・動画・3Dデータをゼロから学習した「オムニモデル」Atlasを公開しました。2〜3枚の写真から3D空間を再構成し、1440pで最長1分の映像をカメラ位置指定つきで生成、再構成誤差の中央値25.3で専用3Dモデルを上回るとしています。