目次 / リファレンス生成

リファレンス生成

画像そのものを材料にして 1 枚を描く画面です。手持ちの絵を 1〜10 枚並べ、それぞれに「これはキャラ」「これは衣装」といった役割を付けて、どんな絵にしたいかを日本語で書くと、その組み合わせの 1 枚になります。外見をタグで説明する必要はありません — 見た目は画像がそのまま伝えます。

🔑 この画面は v3.1 で追加され、v3.5 で選択編集(印・切り抜き)と画風が入りました。表情差分は v3.5 で専用の画面(立ち絵差分)に移りました。

なにができるか

ほかの画面は「日本語 → タグ → 絵」でしたが、この画面は「絵 → 絵」です。次のような使い方をします。

入口はサイドメニューの「参照から作る」です。「リファレンス生成」と「リファレンス生成履歴」が並び、その下に立ち絵差分の 3 画面があります。

使う前に(ComfyUI 側の準備)

この画面は、画像と英語の文章を読める画像生成モデルで描きます。同梱のワークフローは、動作を確認した Qwen-Image 2.1 用です。ほかの画面で使う Anima 系とは別のモデルなので、ComfyUI に用意されていないと ③ が動きません(① と ② のプロンプト作りだけなら、つながっていなくてもできます)。入れ方は はじめにの「参照を読む画像生成モデル」 にまとめています。

Ollama と ComfyUI を同じ PC で動かしている方へ。Qwen-Image 2.1 はそれなりに大きいので、Ollama がグラフィックボードを使っていると入り切らないことがあります。設定の ComfyUI タブにある「VRAM の譲り合い」を入れておくと、生成の前に Ollama 側のモデルをいったん降ろします。

作る順

ほかの画面と同じく ① → ② → ③ の 3 段です。

アプリの中から選べるのは生成画像 / キャラ生成 / イベント CG / パーティ / 保存済みキャラ / リファレンス生成です。一覧は種別(ヒロイン / 男性 / モンスター)でも絞れますし、タイルの 🔍 で拡大して確かめられます。

1 枚目の画像が出力の縦横比の基準になります。縦長の立ち絵を 1 枚目に置けば縦長、横長の背景を 1 枚目に置けば横長が出やすくなります(③ でサイズを指定すればそちらが優先です)。

役割とひとこと

参照 1 枚ごとに、キャラ / 衣装 / ポーズ / 背景 / 小物 / 画風の 6 つから役割を選び、「だれ・なに」をひとこと添えます(「美咲」「学校の制服」など)。見た目の説明は要りません — そこは画像が受け持ちます。

役割を付けておくと、② の文が「この画像からは服を、この画像からは顔を」という形で書かれます。ひとことは短い名前で構いません。

衣装の参照は「服だけ」の絵が向いています。服だけを写した絵か、✂ で服のところだけ切り抜いた絵を使うと、狙いどおりに着せ替わります。

背景を透過して出す

② に「透過で出す」のトグルがあります。入れると被写体だけを切り抜いた PNG になるので、ゲームの立ち絵や素材にそのまま使えます。透過した画像は、画面では市松模様の上に表示されます(「◩ 透過を確認」で切り替えられます)。

透過にするための言い回しはアプリが自動で足します。要望欄に「背景を透明に」と書く必要はありません。

選択編集(印を付ける・切り抜く)

参照の行の右端にある「編集」から、絵の上に印を付けたり、要るところだけを切り抜いたりできます。どちらも保存すると参照がその画像に差し替わり、あとから「元に戻す」で最初の画像に戻せます。

印を付ける — 絵の上に色で場所を指す

「編集」を開くと、その絵の上に赤・青・緑の丸や線や塗りを描けます。そのうえで「赤の丸: 髪を黒に」のように書くと、印の場所だけが変わります。

左の 2 枚は、髪に赤い丸・スカートに青い丸を描いた入力と、髪が黒・スカートが赤になった出力。右の 2 枚は、左手のあたりを緑で塗った入力と、そこに花束が出た出力。
左 = 赤の丸で髪、青の丸でスカートを指定。右 = 緑の塗りで「ここに花束を」(クリックで拡大)。印そのものは出力に残りません。

✂ 切り抜く — 参照の一部だけを使う

同じモーダルの道具に「✂ 切り抜く」があります。ドラッグで四角を選ぶと、保存ボタンが「切り抜いて差し替える」に変わり、その範囲だけを元の大きさのまま切り出して参照に差し替えます。

表情差分・衣装変更

表情差分は v3.5 で専用の画面になり、衣装変更も加わりました。使い方は 立ち絵差分 をご覧ください。

ブログ・SNS 用の 1 枚画像

リファレンス生成履歴の各行にある「1 枚にする」で、参照画像 → 日本語の要望 → 出力を 1 枚の PNG にまとめられます。note や X に「こう指示したらこうなりました」を貼るための機能です。

think(考える)の切り替え

モデル欄の右の ⚙ から、コンテキスト長と一緒に think を「既定 / ON / OFF」で選べます。

選んだ値は覚えているので、毎回選び直す必要はありません。Ollama ジョブのベンチマークは think の設定ごとに分けて集計します — 思考ありとなしでは速さが大きく変わるので、混ぜると平均が意味を失うためです。

なお、think を選べるのはこの画面だけです。ほかの画面はこれまでどおりモデルの既定に従います。

履歴と「生成画像」

作ったものはリファレンス生成履歴に全部残ります。行には RF-12 のような番号が付き、画像は RF-12-3 のように枝番まで付くので、「あの絵」を番号で指せます。♥ 画像ありで絞り込むこともできます。

できた画像は生成画像の一覧には並びません(v3.5 から)。リファレンス生成履歴から開いてください。作品パックには、「画像を探す」の「リファレンス生成」タブから収録できます。

履歴から復元すると、参照画像・要望・プロンプト・画風・透過・サイズ・ワークフローまで戻ります。

枚数と時間の目安

参照の枚数で時間がはっきり変わります。下は RTX 5070 Ti 16GB での実測です。

参照の枚数1 枚あたりの目安
1〜3 枚およそ 30 秒
5 枚およそ 2 分
10 枚およそ 5 分

3 枚と 5 枚のあいだで急に伸びます。4 枚以上を選ぶと画面が目安を出すので、そこで一度考えてみてください。必要な絵だけに絞るほうが、速いうえに狙いどおりになりやすいです。

得意なこと・苦手なこと

このモデルは、ほかの画面で使うモデルとは得意分野が違います。

🎲 ここでも「1 枚目で決めない」のは同じです。絵を描いているのはお手元の ComfyUI とモデルなので、同じ設定でも出てくる絵は毎回変わります。何枚か出して選んでください。