Alibaba「Qwen-Image-3.0」公開、4500トークンの超長文プロンプトに対応
Alibabaが、画像生成モデル「Qwen-Image」シリーズの第3世代「Qwen-Image-3.0」を公開しました。「見た目が良いだけでなく、実務で使える画像」を目指すというコンセプトのもと、超長文プロンプト対応や高精度なテキストレンダリングを打ち出しています。
詳細
- 超長文プロンプト対応: 最大4500トークンの指示文を受け付け、前世代Qwen-Image-2.0(上限1000トークン)の約4.5倍。新聞レイアウトやショートドラマの絵コンテ、密度の高いインフォグラフィックなどを一度の生成で仕上げられる
- 高精度なテキストレンダリング: 10ピクセル相当の小さな文字でも可読性を維持し、写真のような肌・髪の質感を再現。12言語・20種類以上のフォントでのネイティブな文字描画に対応
- 世界知識の反映: Webページやライブ配信画面のようなインターフェースを再現できるほか、インターネット上の最新情報を画像生成に反映する機能を謳う
- 想定用途: 新聞レイアウト、ショートドラマの絵コンテ、UIモックアップ、ECサイト向け画像など、コンテンツ制作の実務利用を想定
- 公開範囲の後退: 前作Qwen-Image 1.0がApache 2.0ライセンスでオープンウェイト・技術レポート同時公開だったのに対し、今回はベンチマーク・モデルの重み・技術レポートのいずれも非公開
使ってみるには
- chat.qwen.aiで利用可能。API料金は現時点で未公表です