FLUX 3とは?画像・音声付き動画20秒・ロボット行動まで生成するBFLの新モデルを解説
独Black Forest Labsが、画像・最大20秒の音声付き動画・ロボットの行動予測までを単一アーキテクチャで生成するマルチモーダル基盤モデル「FLUX 3」を発表しました。同社初の公開動画モデルですが、当面はAPI公開のない審査制の限定早期アクセスで、価格や画像ベンチマークは未公表です。
独Black Forest Labsが、画像・最大20秒の音声付き動画・ロボットの行動予測までを単一アーキテクチャで生成するマルチモーダル基盤モデル「FLUX 3」を発表しました。同社初の公開動画モデルですが、当面はAPI公開のない審査制の限定早期アクセスで、価格や画像ベンチマークは未公表です。
GoogleはGoogle Photosに、保存済みの動画をAIで編集・変換する新機能「Video Remix」を投入しました。新モデルGemini Omniを基盤とし、数秒で水彩フィルターや背景差し替えなどを実現します。
Googleは動画生成AI「Gemini Omni Flash」をAPI公開しました。720p・最大10秒の動画を1秒0.10ドル(10秒約1ドル)で生成でき、会話形式でリライティングや衣装変更などを重ねられる点が特徴です。
Googleが画像生成の「Nano Banana 2 Lite」と動画生成の「Gemini Omni Flash」をAPI公開。1枚0.034ドル・4秒生成、動画は1秒0.10ドルで、コスト重視のAI活用が現実的な段階に入りました。
ByteDanceが7月初旬投入予定の動画生成AI「Seedance 2.5」を発表しました。後からの繋ぎ合わせなしで、シーン転換やテンポ変化を含む最長30秒のクリップを単一生成できる点が最大の特徴です。
Avataar AIが、インドの祭事・料理・衣装・建築などの文化的要素を認識するAI動画生成モデル「Varya」を発表した。VeoやKlingなど海外競合の1秒あたり0.10ドル超に対し、Varyaは₹0.48(約0.005ドル)と約20分の1の価格を実現し、インド国内での大規模普及を目指す。