Black Forest LabsのFLUX 3が画像・映像・音声・ロボット制御を単一モデルに統合 — 映像生成で培った世界モデルはロボット制御に応用できるか
DRANK

7月24日、latent.spaceが「AINews: Black Forest Labs FLUX 3」と題した記事を公開した。Black Forest Labsが発表したマルチモーダル統合モデル「FLUX 3」は、画像・映像・音声・ロボット制御を単一アーキテクチャで扱う設計であり、映像生成モデルが物理的な行動予測へと発展する可能性を具体的なパートナーシップで示した点で注目に値する。

by @tf_official
Related Topics: AI Deep Learning Robotics