画像生成AIの情報を纏めるWikiです。

×

配布場所

概要

韓国Onoma AIがkohaku-xl-beta5をファインチューンしたSDXLベースのアニメモデル。
データセット「Danbooru2023」で学習しており、生成できるキャラやシチュエーションの種類が非常に多い。
ちなみに、Danbooru2023で学習したと書いたが、2024年2月頃までに登場した一部のキャラも生成できる。

プロンプトの書き方

Animagine-XLに似た独特のプロンプトルールあり

プロンプトは以下の並びで学習されているが、これに従う必要はない。
人数, キャラクター名, レーティング, 一般タグ, アーティスト, 品質タグ, 年代

品質タグ

worst quality(~8%)、bad quality(~20%)、average quality(~60%)、good quality(~82%)、best quality(~92%)、masterpiece(~100%)
の六つがある。
NoobAI-XLの場合
worst quality(30%以下)、normal quality(30%超過60%以下)、good quality(60%超過85%以下)、best quality(85%超過95%以下)、masterpiece(95%超過)
美的タグ(NoobAI-XL v-pred)
  • very awa(waifu-scorerによるスコアの上位5%)
  • worst aesthetic(waifu-scorerとaesthetic-shadow-v2によるスコアの下位5%)

年代タグ

oldest(~2017年)、old(~2019年)、modern(~2020年)、recent(~2022年)、newest(~2023年)
NoobAI-XLの場合
old(2005-2010)、early(2011-2014)、mid(2014-2017)、recent(2018-2020)、newest(2021-2024)

レーティング

general(健全)
sensitive(露出度高めの衣装、下着が見える状態など)
questionable(乳首の露出、露出度が高い衣装など)
explicit(性行為、性器の露出、グロ、スカなど)
詳しくはdanbooru wikiのhowto:rateを参照。

記入例

ポジティブ
(masterpiece), (best quality), (ultra-detailed), very aesthetic, newest,
ネガティブ
cartoon, graphic, text, painting, crayon, graphite, abstract, glitch, deformed, mutated, ugly, disfigured, longbody, lowres, bad anatomy, bad hands, missing fingers, extra digit, fewer digits, cropped, worst quality, low quality, very displeasing,

推奨事項

CFG Scaleは5〜7.5、Euler aで20-28ステップ。
VAEは内蔵してるのか指定しなくても(1111だとNone)動く。未指定ならNo-half VAEは不要。SD1.5用のVAEを適用すると露骨に絵が崩れるので使用するならSDXL用を。

注意点

JPEG圧縮されたような画質の粗い画像が出る

v0.1はテスト用のモデルのため仕様である。
気になるのであれば派生モデルを使用した方が良い。

意図しない絵柄の変化

ベースモデルとして開発されたため画風は多様である。
年代タグ、品質タグやアーティスト名で変化を抑えられる。

苦手な題材

背景は具体的に指示しないと地味になりがち。背景指定が面倒ならNegative Promptにsimple backgroundを入れるとマシにできる。
適当な画像でファインチューンするだけで多少改善するので多様性の弊害?

トラブルシューティング

SDXL共通のトラブルシューティングについてはこちらを参照

抽象画になる

プロンプトのトークン数が76以上で以下のようになる。
Settings->Optimizations->「Pad prompt/negative prompt」をオフにすると解消する。


派生モデル

人気なものをいくつかをピックアップ。

NoobAI-XL (NAI-XL)

Civitai: https://civitai.com/models/833294
Hugging Face(eps v1.1): https://huggingface.co/Laxhar/noobai-XL-1.1
Hugging Face(vpred v1.0): https://huggingface.co/Laxhar/noobai-XL-Vpred-1.0
ベースモデルにDanbooruとe621のデータセットで大規模なファインチューニングをしたもの。派生だが、もはやこちらが本家といえるほど開発が進められている。
データセットの拡張によりIllustrious-XL V0.1の特徴「キャラやシチュエーションの幅は広いが制御が難しい」が純粋強化されたじゃじゃ馬で、こちらも主に使用感向上を目的とした派生モデルが複数存在する。
predictionの種類
ε-prediction版とv-prediction版が公開されておりそれぞれ癖が違う。v-prediction版は明暗の表現が良いがZero Terminal SNRの影響でかなりピーキーな挙動を示す。
v-predictonについてはModelsを参照。

RouWei

https://huggingface.co/Minthy/RouWei-0.8
プロンプトの応答性や知識を改善するために開発された。データセットも拡張(カットオフ2025年04月)された。
しかし、プロンプトを無視してエロ画像を生成する傾向がある上、多くのMetaタグが使用できず、Noob以上の曲者である。

Illustrious-XL SmoothFT(SmoothFT-SPO)

https://civitai.com/models/811067/illustrious-xl-s...
通称SPO。画質を向上させるために最低限の変更を加えたもの。

copycat-illustrious

https://civitai.com/models/823763/copycat-illustri...
本スレ産。画風や構図の多様性が著しく落ちる代わりに、安定して高品質のマスピ絵を出せる。

Obsession (Illustrious-XL)

https://civitai.com/models/820208/obsession-illust...
画質が向上し、純正モデルとほぼ同じような感覚で使える。
1.0はベースモデル、以降はNoobAIを元にマージされており、こちらもバージョンごとに使用感が違う。
さらにデータセットが拡張され新しいキャラクターが生成できる。

このページへのコメント

金の亡者と判明して一気に罵倒対象になったな

2
Posted by 名無し(ID:wvfOoFEgtg) 2025年02月14日(金) 15:09:25 返信数(1) 返信

学習費用はバカみたいにかかってるみたいだけどね
ただ説明と政治がド下手なのは否定しようがない

4
Posted by 名無し(ID:+cY0519rzg) 2025年03月20日(木) 05:02:01

トークンが多いとバグる事があるから設定確認が必要だとか最近のv-predモデルはアプリ側が対応してないとダメとか

0
Posted by 名無し(ID:sgw+pRoMOg) 2024年11月21日(木) 10:51:50 返信

急にまともな絵が出なくなったけど規制されたの?

0
Posted by 名無し(ID:cUX3oI5eAg) 2024年11月21日(木) 02:29:18 返信

プロンプトの効きが良すぎるので派生モデルそれぞれにまたネガティブの癖があったりする。
派生モデルを使う際はモデルごとの推奨ネガティブもちゃんと見た方が良いね

0
Posted by 名無し(ID:+cY0519rzg) 2024年10月28日(月) 03:23:14 返信

続報が全く来ないけど公開されるのだろうか

7
Posted by 名無し(ID:TqRZ0SUKOA) 2024年10月17日(木) 14:34:46 返信

コメントをかく


「http://」を含む投稿は禁止されています。

利用規約をご確認のうえご記入下さい

Menu

table拡張js

どなたでも編集できます

広告募集中

メンバー募集!