2026年7月22日 00:55
Alibaba新画像AI、10px文字も鮮明に生成
Alibaba's Qwen-Image-3.0 renders full infographic grids and readable ten-pixel text in a single pass
3行まとめ
- •AlibabaがQwen-Image-3.0公開
- •10px文字や図表を一発生成
- •12言語対応も編集は不可
詳細
概要
AlibabaのQwenチームが新しい画像生成モデル「Qwen-Image-3.0」を発表した。最大4500トークンという長いプロンプトを受け付け、10ピクセルというごく小さいサイズでも判読できる文字を生成できる点が特徴で、12言語のテキストにネイティブで対応する。
機能
インフォグラフィックのような複雑な図表構成、LaTeX形式の論文レイアウト、新聞紙面のような組版まで、1回の生成処理だけで作り出せることが示された。従来の画像生成AIでは細かい文字や複雑な図版のレイアウトが崩れやすい弱点があったが、今回のモデルはその弱点を大きく改善した形になる。
今後の課題
一方で、生成される出力はあくまで1枚のピクセル画像であり、文字や図形の要素を個別に編集できる形式ではない。インフォグラフィックや論文のような用途では後からの編集可能性が重要になる場面も多く、実用面での価値には限界があるとの指摘も記事内でなされている。
なぜ重要か
10pxの微小文字や複雑な図表レイアウトを1回の生成で再現でき、資料・広告制作での活用可能性を示した。
元記事を読む — The Decoder