Animaは何を重視しているのか

Animaは何を重視しているのか
今日はなー、ローカル生成モデルのAnimaで、ウチをどこまで再現できるか試してみたでー。
また本人再現チャレンジか。
せやせや。
今回はGPT Image GeneratorとAnimaで比較してみたんや。
まずは結果見てみー。

ローカルで単体出力の結果 左:GPT Image Generator 右:Anima

んー……。
Animaの方、普通に可愛いけど。
問題はそこやねん。
可愛いねんけど、ウチではないねん。
・・・ウチではないねん。
本人の前で言うことじゃないけど、確かに別人だな。
20回ほど生成したんやけど、その中で一番それっぽかったのがこの画像や。
その結果をまとめると……
Animaが優先した特徴
  • 長身
  • フラットチェスト
  • 雰囲気
  • 服装
  • 前髪(センター分け指定時)
この辺りは比較的安定してたで。
服装はかなり再現できてるな。
RELAXの文字まで入ってるじゃん。
Animaが捨てた特徴
  • 顔が美少女寄り
  • 後ろで雑にまとめた髪が出にくい
この辺りは苦戦したわー。
「あーちゃん」より「アニメの主人公」に引っ張られてる感じだな。
そうそう。
愛嬌のある普通の顔立ちって、意外と難しいみたいやねん。
何回か試してるうちに、毎回出やすい特徴が見えてきたで。
ほう。
安定していたのは、
  • 服装
  • フラットチェスト
  • RELAXの文字
  • 美少女顔
  • 少しボサっとした髪
  • 自販機との高さ比率
この辺や。
高さ比率は意外だな。
逆に安定せんかったのは、
  • 身長
  • センター分け
やな。
センター分けは?
20回中5回くらいしか成功せんかった。
だいたい右寄りの7:3になる。
また7:3か。
もうAnimaの癖なんちゃうかな(笑)

Animaが重視しているように見えるポイント

今回の結果だけで断言はできへんけど、
Animaは次の特徴を強く重視しているように見えたで。
  • 服装
  • フラットチェスト
  • RELAXの文字
  • 美少女らしい顔立ち
逆に丸顔とか愛嬌のある顔立ちは後回しなんだな。
そういうことやと思う。
少なくともウチの顔より、美少女補正の方が強そうや。
今回の検証だけでAnimaの仕組みは分からへん。
ただ、20回生成してみると「どの特徴を優先しているのか」は少し見えてきたでー。
少なくとも、Animaは「ウチ(あーちゃん)」より「美少女」を描く方が得意らしいわ。

おまけ:Animaは数字を理解しているのか?

ちなみにプロンプトにはこんなんも入れてみた。

the girl is 180 cm tall
the vending machine is 183 cm tall

ほう。
したらなー、自販機に数字が出ることがあったんや。
180とか183?
173cmとか18mとか。
増えてるじゃないか。
ウチの身長、最大18mになったでー。
怪獣じゃん。
超常現象研究会やしなー。
研究対象になる側だろ。
今回のおまけのまとめはこんな感じやなー
  • Animaは英単語はそれなりに扱える
  • 数値も文字としてはそれなりに扱える
  • ただし数値の意味はかなり怪しい
ように見える。

比較図 使用モデル:Anima