目次 / バージョン特集 / v3.0

v3.0 — 短時間で、狙いの 1 枚まで

v3.0 は、狙いの 1 枚にたどり着くまでの時間を削るという一点でまとめた版です。大きいものが 2 つあります。作ったキャラクターを 2 人並べて「何をしているか」の 1 枚を作れるようになったこと(イベント CG 作成)。そして、キャラクター抽出が画像を大きいまま読むようになったことです。

変更点の一覧は 変更履歴 にあります。このページは 何がうれしいのかとどう使うのかをまとめたものです。

01 v3.0 が目指していること

v2.8 キャラクターを作る 絵を持っていなくても始められる v2.9 仲間をまとめて作る 世界観からパーティを一括で v3.0 2 人の場面を作る 立ち絵から「作品の 1 枚」へ どの版にも共通するゴール 短時間で、狙いの 1 枚まで 探す手間・迷う時間を、できるだけ削る 作れる範囲を、1 人から場面へ広げる
v2.8 でキャラクターを、v2.9 で仲間を作れるようにしました。v3.0 では、そのキャラクターたちを並べて場面を作れるようにします。

Pixubus の出発点は「手元のキャラ画像から、絵のプロンプトを作る」ことでした。そこからキャラクターそのものを作るところまで広がり、v3.0 でそのキャラクターを使って場面を作るところまで来ます。

一貫しているのは、狙いの 1 枚にたどり着くまでの時間を削ることです。プルダウンを延々と選ぶのではなく、やりたいことを日本語で 1 行書けば絵になる——v3.0 の作りはこの考え方に寄せてあります。

02 イベント CG 作成 — 2 人が何をしているかの 1 枚

左のメニューに「作品づくり」というグループが増え、「イベント CG 作成」が入ります。手順は 3 つです。

① キャラを 2 人選ぶ 保存済み / 生成履歴 / パーティ ② 状況を日本語で書く ボタンで挿入 / AI に 10 案出させる ③ 生成する 履歴に EV-12 の番号が付く
キャラを選び、状況を日本語で書き、生成する。プルダウンで選べる範囲には限りがあるので、言葉で書けることは全部書ける作りにしました。

実際に作った 1 枚で追う

2 人ともキャラクター生成の画面で作ったキャラです。片方は自由記述、もう片方は項目を選ぶだけ。そこからイベント CG までを、実際の入力そのままで並べます。

イベント CG ができるまで。① ヒロイン生成(自由記述)と男性キャラ生成(項目から選ぶ)で 2 人の立ち絵を作る → ② 2 人の状況を日本語で 1 行「夕暮れの屋上で、2 人の顔が近づき、キスする直前で止まっている。」と書く → Ollama が英語のプロンプトに変換 → ③ ComfyUI で 1 枚が生成される。
日本語で書いた設定と状況が、そのまま 1 枚になるまで(クリックで拡大)。プロンプトはキャラクター由来の部分だけを載せ、年齢や容姿にふれる語は伏せています。

絵を決めるのは「2 人の状況」の欄です

ここに書いた 1 行が、そのまま絵の中身になります。どちらが何をしているかを書くのがコツです。

左の忍者が右の騎士を背後から抱きしめている

のように書くと、そのとおりに描かれます。よく使う状況はボタンで挿入できます(23 種)。思いつかないときは 💡 提案で、選んだ 2 人の見た目に合わせて AI が場面を 10 案出します。

何が絵に入るのかは画面に出ます。提案まわりの選択は提案を作るための補助で、絵そのものには入りません。実際に絵になるのは「2 人の状況」「背景」「画風」の 3 つだけで、生成ボタンの手前に何を送るかの 1 行サマリが出ます。

パーティ作成で出てきた 2 人でも

相手役は、男性やモンスターでなくてもかまいません。パーティ作成で出てきたメンバーも、保存済みのキャラも、そのまま並べられます。

パーティ作成でできた 5 人(ジュニアバレリーナ教室)のうち 2 人、遥と結愛を選び、「後ろから抱きしめている」と書いて 1 枚にした例。衣装も髪色も入れ替わっていない。
パーティ作成でできた 5 人から 2 人を選ぶだけ(クリックで拡大)。背後から / 組み敷く / 膝の上 のような重なり方は、2 人が同じ絵の中にいることを支える柱でもあります。

画面ごとの操作は イベント CG 作成 にまとめています。

03 キャラクター抽出が、画像を大きいまま読むようになりました

地味ですが、すべての入口に効く変更です。

これまで Pixubus は、画像を 長辺 1024px に縮めてからモデルへ渡していました。当時使っていた Gemma 4 はどのみち内部で縮めて読むため差が出なかったのですが、調べたところ Qwen 系のモデルはもっと大きいまま読めることが分かりました。いまは縮めずにそのまま渡します。

同じイラスト(4088 × 5931)を渡すとモデルが実際に見ている大きさ
Qwen3.8(qwen3.8:27b)1696 × 2464
Gemma 4(gemma4:31b-it-qat)624 × 960

柄・小物・髪飾りといった細かいところが、以前より拾えます。あわせて、画面に出ていた説明が誤っていたので直しました。「大きい画像でも解析の精度は上がりません」という 1 行は、Gemma 4 だけに当てはまる話でした。

細かく読めるほど、そのキャラに戻る

同じ立ち絵を Qwen3.8 と Gemma 4 に渡して、出てきたタグを並べたものです。どちらも縮めずに原寸で渡していて、ちがうのはモデルだけです。

同じ魔法少女の立ち絵を渡したときに出たタグの比較。Qwen3.8 は 33 語、Gemma 4 は 19 語。Qwen3.8 だけが拾った 14 語には色が付いている(袖口の白いフリル、コルセットの胴、杖の頭の金の細工、リボンの先のひし形、きらめき など)。下は、その Qwen3.8 のタグに「寝そべってこちらに顔を向けるグラビアポスター」と足して生成した 1 枚。
拾えた語が 33 語 と 19 語。色の付いた 14 語は Qwen3.8 だけが拾ったもので、その細部がそのまま生成結果に出ています(クリックで拡大)。

袖口のフリル、コルセットの胴、杖の頭の金の細工、手首のピンクの石——言葉にできた分だけ、絵に戻ってきます。逆に言えば、抽出で落ちた特徴は絵にも出ません。抽出の精度がそのまま再現度になるので、v3.0 ではここに手を入れました。

どのモデルを選ぶかは 抽出モデルの選び方 にまとめました。ふだんは Qwen3.8、R18 の絵は Gemma 4 という使い分けです。

04 使い方のフロー

上の 1 枚ができるまでを、実際の画面で追います。キャラクターを作る → 2 人選ぶ → 状況を書く → 生成するの 4 手です。

1. キャラクターを作る

2 人ともキャラクター生成で作りました。片方は自由記述で日本語をそのまま書き、もう片方は項目を選ぶだけ。どちらでも同じように立ち絵まで進みます。手元の画像から抽出しても、パーティ作成で出てきた仲間を使ってもかまいません。

ヒロイン生成の画面。自由記述モードがオンで、日本語の設定が数行書かれている。右にできた外見タグと、下に立ち絵を生成する設定。
ヒロイン生成(自由記述) — 思いついたことを日本語で並べるだけです(クリックで拡大。年齢にふれる語は伏せています)。
男性キャラ生成の画面。世界観 → 役割 → 衣装 → 人物の設定 の順に選ぶ形で、選んでいない役割は伏せてある。右にできた外見タグ。
男性キャラ生成(項目から選ぶ) — 世界観 → 役割 → 衣装 → 人物の設定 の順です(クリックで拡大。選んでいない役割とネガティブは伏せています)。

2. 左メニューの「作品づくり」から開いて、2 人選ぶ

タブでソース(すべて / 保存済みキャラ / キャラ生成履歴 / パーティ)を切り替えて、サムネイルをクリックするだけです。スロットにはどの画面で作ったキャラかが出るので、あとから見ても分かります。

ステップ 1 キャラクターを選ぶ。左のスロットにヒロイン生成で作ったキャラ、右のスロットに男性キャラ生成で作ったキャラが入っている。下にソースのタブと種別の絞り込みが並ぶ。
左右のスロットに 1 人ずつ。並びはそのまま絵の並びになります(クリックで拡大)。

3. 状況を書く

ここが本体です。ボタンで挿入するか、💡 AI に提案から選ぶか、自分で書きます。この欄の文だけが絵に入ります——上の提案まわりの選択は、提案を作るための補助です。

ステップ 2 2 人の状況と背景。「2 人の状況(日本語)= 最終解答」の欄に「夕暮れの屋上で、2 人の顔が近づき、キスする直前で止まっている。」と書かれている。下に背景と画風の選択。
書いた 1 行がそのまま絵の中身になります。下の背景と画風も一緒に絵へ入ります(クリックで拡大)。

4. 生成する

プロンプトができたら、そのまま ComfyUI へ。ワークフローとモデル、枚数、シード、画像サイズをここで決めます。サイズの既定は 832 × 1216。密着した場面はこのあたりがいちばん安定するので、基本はいじらなくて大丈夫です。

B 画像を生成(ComfyUI)。ワークフローは Anima 標準(30 steps)、モデルは anima-base-v1.0、枚数は 2、シードは空欄、画像サイズは 832 × 1216。下に生成ボタンと、できた絵のサムネイル(モデル名バッジと seed 1001 付き)。
できた絵にはどのモデルで出したかとシードが残ります(クリックで拡大)。

結果はイベント CG 履歴に自動保存され、EV-126 のような番号が付きます。あとから「あの絵」を番号で指せますし、復元を押せばそのときの 2 人と状況がそのまま戻ります。

イベント CG 履歴の 1 行。左に EV-126 の番号、日時、使ったモデル、ラベル。右に ☆ コピー 復元 削除。下にできた絵のサムネイル。プロンプトの行はぼかしてあります。
履歴の 1 行。復元でそのときの 2 人と状況が戻ります(クリックで拡大。プロンプトの行はぼかしています)。

画面ごとの細かい話は イベント CG 作成 にまとめています。

05 画像を出したあと、プロンプト生成が急に遅くなるときは

v3.0 は「狙いの 1 枚までの時間を削る」版です。ところが、その時間をいちばん大きく食っていたのは プロンプトの書き方でも、モデルの大きさでもありませんでした。Ollama と ComfyUI が、同じ GPU のメモリを取り合っていたことです。

こういう症状です

設定を変えた覚えもないのに速度だけが変わるので、原因を掴みにくい種類の遅さです。

なぜ起きるのか

Ollama も ComfyUI も、モデルをグラフィックボードのメモリ(VRAM)に置いて動きます。 両方のモデルが同時に載りきらないと、あとから読み込んだほうがはみ出して、 はみ出した分は PC のメインメモリを使いながら動くことになります。ここで速度が何倍も落ちます。

やっかいなのは、はみ出していることがどこにも表示されないことです。 Ollama 自身も「VRAM に置いた」と言い続けるので、画面を見ても分かりません。分かるのは待ち時間だけです。

💡 効くのはモデルの大きさです。ボードの容量に対してちょうど収まるかどうかの大きさのモデルが、いちばん不安定になります。 余裕で収まる小さいモデルも、最初から明らかに大きすぎるモデルも、速度は安定します(遅いなら、ずっと遅いままです)。

手元の実測です。16GB のボードで、同じ日・同じ設定・同じ画面での比較です。

モデルの大きさいちばん速いとき ÷ いちばん遅いとき
6.1GB1.4 倍
7.2GB2.0 倍
15.6GB(ボードとほぼ同じ)9.4 倍
18.9GB(最初から入らない)1.5 倍

実際に、同じ画面のプロンプト生成が 61 秒 → 509 秒 になったところまで記録できました。 間に挟まっていたのは、画像を数枚出したことだけです。

設定 → ComfyUI →「VRAM の譲り合い」

この症状が出る方のために、画像生成が終わったら ComfyUI のモデルを降ろす設定を入れました。 空いたメモリが Ollama に渡るので、次のプロンプト生成が本来の速さに戻ります。

⚠ 効かない構成もあります。ComfyUI を --highvram で起動している場合、 降ろし先が VRAM 自身になるため、この設定を入れてもメモリは空きません。

先に試せること

設定を触る前に、プロンプト生成に使うモデルを小さいものに替えるだけで解決することがあります。 ボードの容量に対して余裕のある大きさなら、そもそも取り合いになりません。 抽出・生成それぞれのモデルの選び方は 抽出モデルの選び方 と 速度の目安 にまとめてあります。

06 そのほかの変更

詳細は 変更履歴 をご覧ください。

07 入手について

v3.0 は note で配布しています。すでにお使いの方は、アップデートの手順どおり今のフォルダに上書きしてください。履歴・キャラクター・設定はそのまま残ります。