ちち生化実験【GPT生成画像からタグ抽出】
使用したAI
ちちぷい生成機能
長文が嫌いという人もどこかで見かけたのですが、技術的な話も好きという人もいたので。
今回はめんどくさい話なわりに実がないブログ記事なので、長文が苦手な方は読み飛ばしてください。
これは技術的な話なのか?
-----------------------------------------------
●専用ツールで画像をタグ化してみた 【意外とGPTでやるのはコツがいる】
うちのコ「グレース・ハンニバル」さんをWindowsタグツールでDanbooru化してみました
一発出しでは、GPTよりは雰囲気が出ているように思います。
特徴を細かく追い込むには潤沢にPuiを使わないといけませんが、ざっくりだったらこれでいけるのかも。
・一枚目 比較画像
・二枚目 タグ化にWD14使用/生成:LILY
・三枚目 タグ化にWD14使用➡若干タグ修正/生成:LILY
・四枚目 タグ化にGPT使用/生成:LILY
・五枚目 おまけ:デフォルメ画像/タグ化にWD14使用/生成:LILY
今回、ちちぷい生成モデルには、生成結果を見ながらLILYを選びました。
他方、画像を見るとGPT-images2.0によるdanbooru化が意外とうまくいっていないのがわかります。
GPTによるdanbooruタグ化も、きちんとしたプロンプトを書けばうまく行くのかもしれません。しかし、
キャラクターによって特徴を指示に入れ込んでいたら、danbooruタグを組んでいるのに近くなってしまいます。
話は変わりますが、デフォルメ画像スタイル(Chibi)の方が「元絵からの差異の印象」を圧縮・制御ことができて、
「こういうスタイル」という定義にすれば扱いやすそうです。「元絵の再現」をやっているとPuiがいくつあっても
足りんし……。
●余談
現在のうちのコにはテキストプロンプトはなく、すべてキャラクターデザインリファレンス画像からのi2iです。
ラグランちゃんはちちぷい生成で元絵をつくって、GPTでキャラクターデザインリファレンス画像を生成しています。
・生成「添付の画像をもとに、キャラクターデザインリファレンス画像を生成して。三面図、表情差分、アイテム……」
・i2i「添付の画像をキャラクターデザインリファレンス画像として固定する。指定スタイルに沿って整合性のある……」
いや、GPT4系列のころはある程度、日本語テキストでもプロンプトがあったんですが、image1.5あたりから
生成が怪しくなってi2iに全面移行したときにどっかいってしまった。
●使用ツール
WD14 Tagger Studio|画像からタグを自動抽出【最新版】
https://x.com/munou_ac/status/2080596270142705948
ローカルだけで完結するというのうたっていて今回、試してみました
今回はめんどくさい話なわりに実がないブログ記事なので、長文が苦手な方は読み飛ばしてください。
これは技術的な話なのか?
-----------------------------------------------
●専用ツールで画像をタグ化してみた 【意外とGPTでやるのはコツがいる】
うちのコ「グレース・ハンニバル」さんをWindowsタグツールでDanbooru化してみました
一発出しでは、GPTよりは雰囲気が出ているように思います。
特徴を細かく追い込むには潤沢にPuiを使わないといけませんが、ざっくりだったらこれでいけるのかも。
・一枚目 比較画像
・二枚目 タグ化にWD14使用/生成:LILY
・三枚目 タグ化にWD14使用➡若干タグ修正/生成:LILY
・四枚目 タグ化にGPT使用/生成:LILY
・五枚目 おまけ:デフォルメ画像/タグ化にWD14使用/生成:LILY
今回、ちちぷい生成モデルには、生成結果を見ながらLILYを選びました。
他方、画像を見るとGPT-images2.0によるdanbooru化が意外とうまくいっていないのがわかります。
GPTによるdanbooruタグ化も、きちんとしたプロンプトを書けばうまく行くのかもしれません。しかし、
キャラクターによって特徴を指示に入れ込んでいたら、danbooruタグを組んでいるのに近くなってしまいます。
話は変わりますが、デフォルメ画像スタイル(Chibi)の方が「元絵からの差異の印象」を圧縮・制御ことができて、
「こういうスタイル」という定義にすれば扱いやすそうです。「元絵の再現」をやっているとPuiがいくつあっても
足りんし……。
●余談
現在のうちのコにはテキストプロンプトはなく、すべてキャラクターデザインリファレンス画像からのi2iです。
ラグランちゃんはちちぷい生成で元絵をつくって、GPTでキャラクターデザインリファレンス画像を生成しています。
・生成「添付の画像をもとに、キャラクターデザインリファレンス画像を生成して。三面図、表情差分、アイテム……」
・i2i「添付の画像をキャラクターデザインリファレンス画像として固定する。指定スタイルに沿って整合性のある……」
いや、GPT4系列のころはある程度、日本語テキストでもプロンプトがあったんですが、image1.5あたりから
生成が怪しくなってi2iに全面移行したときにどっかいってしまった。
●使用ツール
WD14 Tagger Studio|画像からタグを自動抽出【最新版】
https://x.com/munou_ac/status/2080596270142705948
ローカルだけで完結するというのうたっていて今回、試してみました
呪文
呪文を見るにはログイン・会員登録が必須です。
イラストの呪文(プロンプト)
jacket partially removed, heart in eye, burnt clothes, holding fishing rod, kanji, doujin cover, pentagram, tape gag, adjusting headwear, red socks, friends, cloud print, coke-bottle glasses, oral invitation, competition school swimsuit, barbell piercing, gradient legwear, prisoner, blood on breasts, wind chime, carrying over shoulder, tape measure, flaming weapon
イラストの呪文(ネガティブプロンプト)
jacket partially removed, heart in eye, burnt clothes, holding fishing rod, kanji, doujin cover, pentagram, tape gag, adjusting headwear, red socks, friends, cloud print, coke-bottle glasses, oral invitation, competition school swimsuit, barbell piercing, gradient legwear, prisoner, blood on breasts, wind chime, carrying over shoulder, tape measure, flaming weapon
- Steps 30
- Scale 7
- Seed 1421195106
- Sampler Euler a
- Strength 0
- Noise 1
- Steps 30
- Scale 7
- Seed 1421195106
- Sampler Euler a
- Strength 0
- Noise 1