画像生成モデルFLUX 3がロボット制御に転用され、Audiの工場で稼働中 — 動画を「理解」するモデルは物理世界も制御できるのか
DRANK

7月24日、Black Forest Labsが「FLUX 3 x mimic: The Next Generation of Video-Action Models」と題した記事を公開した。画像・動画生成モデルFLUX 3の基盤をロボット制御に転用した「FLUX-mimic」がAudiの生産ラインに実導入されたという。学習コストの95%超を動画予測に費やしたモデルが、エンドツーエンド101msのレイテンシでリアルタイム制御をこなしている——研究デモではなく、工場の現場での話だ。

by @tf_official
Related Topics: AI Robotics Deep Learning