生成AI実験室(16) 人物LoRAあり・なしの15秒を並べて見る——仕草と、視線の違い

生成AI実験室 第16回 人物LoRAあり・なしの15秒を並べて見る 仕草と、視線の違い

第7回で、人物LoRA「Realism People」は、20ステップで焼き直したら効いた、と書きました。ただ、そのときは実物を並べてお見せしていませんでした。

手元に、同じ文章・同じ参照画像で生成した15秒が、LoRAなしとLoRAありで1本ずつあります。今回は、その2本を左右に並べます。

先に、分かったことを書きます。

  • 当方の目には、LoRAありのほうが、仕草がずっと自然に見えました。
  • コマで確かめると、LoRAなしは15秒のあいだカメラを見たままでした。LoRAありは、しゃがむ途中で2回、目を伏せて戻していました。
  • しゃがむ速さも違いました。LoRAなしは約2秒、LoRAありは約3.5秒です。
  • ただし、2本はseed(乱数の種)が違います。1組だけの見比べなので、「LoRAの効果」とまでは言い切れません。
目次

並べた動画

左がLoRAなし、右がLoRAあり(Realism People・強度0.6)。同じ文章・同じ参照画像の15秒(音なし)。人物はAI生成

左がLoRAなし、右がLoRAありです。音は外してあります。人物はAI生成です。

2本の条件

2本とも、M5 Mac(メモリ32GB)で、量子化なしのモデルを使って生成しました。

項目LoRAなしLoRAあり
文章(プロンプト)同じ同じ
参照画像同じ2枚(人物の設定画と、白い背景)同じ2枚
大きさ・長さ800×1056(0.8MP)・15秒・24fps・362コマ同じ
ステップ数2020
LoRAなしRealism People・強度0.6(トリガー語は入れていません)
seed別の値別の値
補間・拡大なしなし

違うのは、LoRAとseedの2つです。seedが違うと、同じ条件でも動きは変わります。そのため、この2本の違いには、LoRAによる分と、seedによる分が混ざっています。

LoRAなしの1本は、生成に9時間23分かかりました。LoRAありの所要時間は、記録を確かめていません。

当方の目に見えた違い

2本を見比べた当方の感想は、こうです。

  • しゃがむ仕草、視線の送り方が、まったく違う。
  • LoRAありのほうが、仕草が圧倒的に自然。
  • LoRAなしのほうは、ロボットのように見える。

感想だけでは伝わらないので、コマを並べて確かめました。

コマで確かめた(1): 視線

同じ時刻の顔を並べた比較。LoRAなしは0秒から15秒までカメラを見たまま。LoRAありは7.5秒と8.0秒、11.0秒と12.0秒で目を伏せている
同じ時刻の顔。上がLoRAなし、下がLoRAあり

2本の全362コマについて、顔のあたりを切り出して確かめました。

LoRAなしLoRAあり
カメラを見ている最初から最後まで立っている間、しゃがむ途中の一時、最後のアップ
目を伏せる0回2回(約7.0〜8.4秒、約10.4〜12.3秒)

LoRAなしは、立っているときも、しゃがんでいる最中も、カメラを見たままです。15秒のあいだ、視線が一度も外れません。「ロボットのよう」に見えた理由の1つは、ここだと考えています。

LoRAありは、しゃがみ始めると目を伏せ、いったんカメラに戻し、もう一度目を伏せます。最後に顔を上げて、カメラに微笑みます。人がしゃがむときに足元へ目をやる動きに、近く見えます。

なお、一瞬閉じてすぐ開く短い瞬きは、どちらの動画にも見つかりませんでした。

コマで確かめた(2): しゃがむ速さ

同じ時刻の全身を並べた比較。LoRAなしは7.5秒でしゃがみ終わっている。LoRAありは7.5秒でしゃがみ始め、10.5秒でしゃがみ終わる
同じ時刻の全身。上がLoRAなし、下がLoRAあり

頭の高さの変化から、しゃがむ動きの時刻を拾いました(目安です)。

LoRAなしLoRAあり
しゃがみ始め約6.0秒約7.0秒
しゃがみ終わり約8.3秒約10.5秒
かかった時間約2秒約3.5秒

文章では、「5秒から10秒にかけて、ゆっくりしゃがむ」「10秒から12秒で、視線をカメラへ上げて微笑む」と指示していました。

LoRAありは、しゃがみ終わりが約10.5秒、視線を上げるのが約12.3秒で、指示に近い進み方です。LoRAなしは、約8.3秒でしゃがみ終わり、残りは同じ姿勢でカメラを見ています。視線を下げていないので、「上げる」動きも起きていません。

言えること、言えないこと

この見比べで言えるのは、ここまでです。

  • この2本では、LoRAありのほうが、視線の動きがあり、しゃがむ動きがゆっくりで、文章の指示に近かった。
  • 20ステップ・強度0.6・トリガー語なしで、第7回に書いた帽子やモヤは出なかった。

言えないことも、はっきりさせておきます。

  • 「LoRAの効果だ」とは言い切れません。 seedが違う1組だけの見比べです。seedをそろえた比較は、まだしていません。
  • ほかの条件で同じになるかは分かりません。 試したのは、20ステップ・強度0.6・この人物・この動きだけです。少ないステップ数では崩れたことを、第7回に書いています。
  • 成功率と呼べる数字はありません。 作例を重ねていないためです。

それでも、当方の目に見えた「自然さ」の中身が、視線の動きと、しゃがむ速さとして数えられたことは、収穫でした。次にLoRAを評価するときは、感想に加えて、この2つを数えます。

まとめ

  • 同じ文章・同じ参照画像の15秒を、人物LoRAあり・なしで並べた。
  • LoRAなしは、15秒のあいだカメラを見たまま。LoRAありは、2回、目を伏せて戻した。
  • しゃがむ時間は、LoRAなしが約2秒、LoRAありが約3.5秒。文章の指示(5秒かけてゆっくり)に近いのは、LoRAありだった。
  • seedが違う1組だけなので、LoRAの効果とは断定しない。seedをそろえた比較が、次の宿題。

このLoRAの配布元や強度の目安はLoRA一覧表に、連載の全体は記事マップにまとめています。


本記事の動画と画像の人物はAI生成です。数値は2026年9月の当方環境(MacBook Pro M5・メモリ32GB)での生成物を、2026年10月に確かめたものです。時刻は、コマを並べて拾った目安です。

よかったらシェアしてね!
  • URLをコピーしました!
  • URLをコピーしました!

この記事を書いた人

コメント

コメントする

目次