Black Forest LabsがFlux 3を公開 — 映像・音声を1モデルで同時学習し、Luma比93%の選好率でLuma・Runwayを上回る動画生成品質を主張
DRANK

7月24日、The Decoderが「Flux 3 generates videos with native audio up to 20 seconds long, a first for Black Forest Labs」と題した記事を公開した。ドイツのAI企業Black Forest Labsが画像・動画・音声を同時に学習するマルチモーダル基盤モデル「Flux 3」を発表し、同社初となるネイティブ音声付き動画生成を実現した。なかでも注目すべきは競合比較の数字で、Luma Ray 3.2に対して**ユーザー選好率93%、Runway Gen-4.5に対して77%**という初期評価を報告している点だ。

by @tf_official
Related Topics: AI Machine Learning AI Image Generator