アリババの千問AIプラットフォーム、Qwen-Image-3.0画像生成モデルを一般公開

アリババの千問画像生成モデル Qwen-Image-3.0 が正式に千問 AI プラットフォームに登場し、すべてのユーザーに全面開放されました。フラッグシップ版 Qwen-Image-3.0-Pro と標準版 Qwen-Image-3.0-Standard は同時に API を開放し、テキストから画像への生成は 0.18 元/枚から始まります。API は千問 AI プラットフォームで利用可能で、海外ユーザーは Qwen Cloud を通じて接続できます。

国際評価プラットフォーム Arena.ai の最新のテキストから画像への生成ランキングで、Qwen-Image-3.0 は中国で第1位にランクインしました。

Qwen-Image-3.0 モデルの三大コアアップグレード

千問科技は、Qwen-Image-3.0 モデルが三つのコアアップグレードを実現したことに注目しています。まず、コンテンツが豊富で、最大 4.5k トークンの超長入力をサポートし、前世代と比較して 4.5 倍の向上を果たしました。ユーザーは要求を一言に圧縮する必要がなく、デザイナーに要求文書を書くように、画面構造、テキスト内容、視覚スタイル、レイアウトの詳細を完全に説明できます。新聞のレイアウト、映像のストーリーボード、数学の試験用紙、PPT など、モデルは一度に正確に生成できます。

次に、詳細がリアルで、10px の小文字を正確にレンダリングし、毛穴や髪の毛などの微細な質感をリアルに再現します。ポートレート写真や古碑の拓本などのシーンで強力な詳細再現能力を持っています。実測では、モデルはテキストの整列、画面の詳細再現、複数の画像の物語の一貫性、複雑な構図のレンダリングなどのコア次元で大幅なアップグレードを実現しました。

最後に、知識が豊富で、12 の言語と 20 種類以上のフォントレンダリングをネイティブにサポートし、提示詞に中国語、英語、韓国語などの多言語テキストが含まれていても、正確に出力され、欠字、乱碼、位置ずれの変形が発生しません。モデルは、数式記号、幾何学的図形、論理的推論ステップなどの多要素を融合した知識図解や複雑な UI インターフェースを簡単に生成できます。

Qwen-Image-3.0 が AI 画像生成を新たな高みへ

Qwen-Image-3.0 は AI 画像生成を「見た目が良い」から「使いやすい」へと推進しました。映像の短編劇のストーリーボードシーンでは、モデルは一度に 20 のストーリーボードを縦型の短編漫画として生成し、前後のストーリーがスムーズに接続され、対話バブル内のテキストが明確で流暢です。コンテンツ制作のシーンでは、ユーザーは 9 つの異なる分野をカバーする 9 宮格の知識図解を一度に生成でき、正確な中英文のテキスト、数式、図表、漫画キャラクターを含みます。ビジネスデザインのシーンでは、モデルは多言語の製品ポスター、ウェブプロトタイプ、ゲームおよびライブインターフェースのシミュレーションをサポートします。

フラッグシップ版 Qwen-Image-3.0-Pro と標準版 Qwen-Image-3.0-Standard は同時に API を開放しました。モデルは千問 AI プラットフォームとアリババクラウド百煉に登場し、Qwen Studio と千問 APP も無料体験のためにまもなく登場します。海外ユーザーは Qwen Cloud を通じて接続できます。

Nakumura
Nakumura
関連サイト:中文版 / TechRitualThe Base Principle