目次 / 自然文スタイル
生成画面で Qwen-Image 2.1(自然文スタイル)
いつもの生成画面の出力スタイルに 「Qwen-Image 2.1(自然文)」が増えました。選ぶと ② が作るものがタグの列から英語の文章に変わります。文章で描くモデル向けのプロンプトです。画風で「写実」を選べば実写も出せます。
タグのプロンプトと、何が違うか
これまでの出力スタイル(Standard / Pony / Anima)は、英単語をカンマで並べた形でプロンプトを作っていました。Qwen-Image 2.1 は文章を読むモデルなので、同じ内容を「どんな絵なのか」を説明する英語の段落にして渡します。
向き不向きがあります。
- 向いているもの — 場所や光や位置関係を細かく決めたいとき。絵の中に文字を入れたいとき。実写風にしたいとき。
- 向いていないもの — 特定のキャラの顔を似せたいとき。その用途はリファレンス生成のほうが確実です。
使う前に(ComfyUI 側の準備)
こちらも Qwen-Image 2.1 を使うので、ComfyUI に用意されている必要があります。リファレンス生成と同じモデルなので、そちらが動いていれば追加で入れるものはありません。入れ方は はじめにの「参照を読む画像生成モデル」 にまとめています。
- ワークフローは同梱しています —
comfyui/api/qwen_image_21_t2i_pixubus.api.jsonです。③ のワークフロー欄に出てきます。 - モデル本体は同梱しません — Qwen-Image 2.1 は非商用の研究ライセンスで公開されているモデルです。条件は提供元の記載をご確認ください。
- 拡散モデルはセットで切り替わります — タグ用のワークフローと行き来したときは、③ のモデル欄がそのワークフローの既定に寄ります。Qwen-Image 2.1 はテキストエンコーダや VAE とセットなので、Anima のモデルを差すと成立しないためです。
使い方
手順はいつもの生成画面と同じです。変わるのは出力スタイルを選ぶところだけです。
- 出力スタイルで「Qwen-Image 2.1(自然文)」を選ぶ → ③ のワークフローが自然文用に切り替わります。
- タグのスタイルに戻すと、ワークフローも前に使っていたタグ用のものに戻ります。
- ③ のワークフロー欄には、② の結果に合うものだけが出ます。タグで作ったプロンプトが残っているあいだは自然文用は出ませんし、その逆も出ません。出力スタイルだけを変えたときは、② の欄に 1 行お知らせが出ます。② を作り直すと、新しいスタイルの結果になります。
① のキャラクター抽出はこれまでどおりです。抽出したタグは「材料」として ② に渡り、文章に書き直されます。タグをそのまま書き写すことはしません。
画風で媒体を決める — 「写実」を足しました
画風パネルの画調に「写実」が増えました。自然文のときは、画調が「どんな絵なのか」の 1 文になって文章の先頭に入ります。アニメ塗りならアニメ絵、写実なら写真のような絵になります。
画風を選ばなければ、要望の内容に合わせてモデルが決めます。モディファイア(併用できる味付け)は、自然文では使いません — 画面にもそう出ます。
ネガティブプロンプトはありません
自然文のときはネガティブの欄が消えます。このワークフローではネガティブが効かないので、欄を置いても意味がないためです。「品質タグを外す」のトグルも出ません。
入れたくないものは、入れたいことを書いて避けます。「背景に人を入れない」ではなく「誰もいない教室」と書く、という書き方です。
サイズ
自然文のときは32 の倍数で入力します(タグ用のワークフローは 8 の倍数です)。プリセットが 9 つあり、既定は 1088 × 1472 です。リファレンス生成と同じプリセットなので、note の表紙(1280 × 672)や X 投稿(1600 × 896)もそのまま選べます。
ワークフローを切り替えたときは、いまの数値を新しい刻みに合わせて丸め直します。
覚えておくと早いこと
- ② の文章は直接書き換えられます — これまでどおり、右の欄を直すとそのまま生成に使われて保存もされます。
- 履歴・お気に入り・復元はこれまでと同じです。復元すると出力スタイルも、それに合うワークフローも一緒に戻ります。
- この出力スタイルは、キャラクター生成(ヒロイン / 男性 / モンスター)とパーティ作成でも選べます(v3.5)。イベント CG 作成はこれまでどおりタグで動きます。
- お手元で用意した Qwen-Image 2.1 系のワークフローも、置けば自然文用として生成画面に出ます。
- キャラを似せたいときはリファレンス生成へ — 顔を保つのは、文章ではなく画像を渡すほうが確実です。