ネイティブ 2K 解像度と統合生成・編集によるプロテキストレンダリング。
卓越したタイポグラフィでインフォグラフィック、ポスター、コミック、写真的シーンを作成できます。
Qwen Image 2.0 は Alibaba 次世代の画像生成・編集モデルです。生成と編集をプロテキストレンダリング機能を持つ単一統合モデルに融合しています。最大 1,000 トークンのプロンプトで極めて詳細なレイアウト指示に対応し、アップスケールなしでネイティブ 2K 解像度(2048×2048)の画像を生成します。機能を増やしながらパラメータ数を 20B から 7B に削減 — 約 3 倍小型・高速化を実現しました。
中国語と英語で正確な文字レベルレンダリング。大量テキストを適切な余白と配置で知的に構成。テキストが正しい遠近法で表面に適応します。
アップスケールではなく最大 2048×2048 ピクセルをネイティブ生成。肌の毛穴、生地の織り、建築テクスチャなど微細ディテールを生成時に直接精密レンダリングします。
生成と編集の両方に対応する単一モデル。テキストオーバーレイ追加、マルチ画像合成、クロスドメイン編集に対応。テキストレンダリング品質が両方に等しく恩恵をもたらします。
20B から 7B パラメータに削減 — 約 3 倍小型。8B Qwen3-VL エンコーダーが 7B 拡散デコーダーに供給。品質を維持しながら推論を高速化します。
Qwen Image 2.0 は卓越したタイポグラフィと写真的リアリズムで、プロ向けテキスト豊富コンテンツ作成に優れています。
正確な文字レベルレンダリング、大量テキスト処理、適切な余白を持つ美しい構成、リアルな表面適応(ガラス、生地、紙)、構造化レイアウトでの自動配置。
最大 1,000 トークンのプロンプトで極めて詳細なレイアウト指示に対応。複雑仕様の完全インフォグラフィック、PPT スライド、ポスター、コミックを 1 パスで生成できます。
中国語と英語テキストの卓越したレンダリング。適切な文字間隔、配置、ビジュアル構成への統合。複数の中国書道スタイルに対応します。
カートゥーンキャラクターを実写に配置、書道オーバーレイ追加、マルチ画像合成。統合モデルが一貫品質で多様な編集タスクを処理します。
ネイティブ 2K 生成で細かいテクスチャを捉えます:髪の毛、生地の織り、ひび割れた大地、森の葉、建築ディテール。アップスケールアーティファクトなし。
AI Arena のブラインドテストで、同一統合モデルを用いたテキストから画像・画像から画像ベンチマークの両方で優れた性能を示します。
Qwen Image 2.0 はプロ向けテキスト豊富コンテンツと写真的シーンに優れています。
プロ向けテキスト豊富コンテンツと写真的画像を作成できます:
最大 1,000 トークンのレイアウト仕様付き詳細プロンプトを提供。プロタイポグラフィでインフォグラフィック、ポスター、コミック、写真的シーンを生成できます。
テキスト指示で既存画像を編集。書道を含むテキストオーバーレイ追加、マルチ画像合成、クロスドメイン編集タスクに対応します。
PPT スライド、カレンダー、データチャート、自動テキスト配置の構造化レイアウトを作成。モデルが余白エリアに知的にテキストを配置します。
中国語と英語テキストのコンテンツを生成。文字レベルレンダリング、適切な間隔、両言語の文化的タイポグラフィ慣習に対応します。
Qwen Image 2.0 AI 画像生成モデルに関するよくある質問です。