AlibabaのQwen-Image-3.0が10ピクセルの文字とLaTeX数式を画像内に描画 — 3×3の9パネルグリッドのインフォグラフィックも1回の生成で出力可能に
DRANK

7月22日、The Decoderが「Alibaba's Qwen-Image-3.0 renders full infographic grids and readable ten-pixel text in a single pass」と題した記事を公開した。AlibabaのQwen-Image-3.0が1回の生成パスで複雑なレイアウトを出力し、10ピクセルの可読テキストを描画できる画像生成モデルとして登場した。前バージョンのQwen-Image-2.0がリリースされたのはわずか今年5月のことであり、そのわずか数か月で次世代モデルへと更新されたことになる。

by @tf_official
Related Topics: AI AI Image Generator Deep Learning