第7回で、人物LoRA「Realism People」は、20ステップで焼き直したら効いた、と書きました。ただ、そのときは実物を並べてお見せしていませんでした。
手元に、同じ文章・同じ参照画像で生成した15秒が、LoRAなしとLoRAありで1本ずつあります。今回は、その2本を左右に並べます。
先に、分かったことを書きます。
- 当方の目には、LoRAありのほうが、仕草がずっと自然に見えました。
- コマで確かめると、LoRAなしは15秒のあいだカメラを見たままでした。LoRAありは、しゃがむ途中で2回、目を伏せて戻していました。
- しゃがむ速さも違いました。LoRAなしは約2秒、LoRAありは約3.5秒です。
- ただし、2本はseed(乱数の種)が違います。1組だけの見比べなので、「LoRAの効果」とまでは言い切れません。
並べた動画
左がLoRAなし、右がLoRAありです。音は外してあります。人物はAI生成です。
2本の条件
2本とも、M5 Mac(メモリ32GB)で、量子化なしのモデルを使って生成しました。
| 項目 | LoRAなし | LoRAあり |
|---|---|---|
| 文章(プロンプト) | 同じ | 同じ |
| 参照画像 | 同じ2枚(人物の設定画と、白い背景) | 同じ2枚 |
| 大きさ・長さ | 800×1056(0.8MP)・15秒・24fps・362コマ | 同じ |
| ステップ数 | 20 | 20 |
| LoRA | なし | Realism People・強度0.6(トリガー語は入れていません) |
| seed | 別の値 | 別の値 |
| 補間・拡大 | なし | なし |
違うのは、LoRAとseedの2つです。seedが違うと、同じ条件でも動きは変わります。そのため、この2本の違いには、LoRAによる分と、seedによる分が混ざっています。
LoRAなしの1本は、生成に9時間23分かかりました。LoRAありの所要時間は、記録を確かめていません。
当方の目に見えた違い
2本を見比べた当方の感想は、こうです。
- しゃがむ仕草、視線の送り方が、まったく違う。
- LoRAありのほうが、仕草が圧倒的に自然。
- LoRAなしのほうは、ロボットのように見える。
感想だけでは伝わらないので、コマを並べて確かめました。
コマで確かめた(1): 視線

2本の全362コマについて、顔のあたりを切り出して確かめました。
| LoRAなし | LoRAあり | |
|---|---|---|
| カメラを見ている | 最初から最後まで | 立っている間、しゃがむ途中の一時、最後のアップ |
| 目を伏せる | 0回 | 2回(約7.0〜8.4秒、約10.4〜12.3秒) |
LoRAなしは、立っているときも、しゃがんでいる最中も、カメラを見たままです。15秒のあいだ、視線が一度も外れません。「ロボットのよう」に見えた理由の1つは、ここだと考えています。
LoRAありは、しゃがみ始めると目を伏せ、いったんカメラに戻し、もう一度目を伏せます。最後に顔を上げて、カメラに微笑みます。人がしゃがむときに足元へ目をやる動きに、近く見えます。
なお、一瞬閉じてすぐ開く短い瞬きは、どちらの動画にも見つかりませんでした。
コマで確かめた(2): しゃがむ速さ

頭の高さの変化から、しゃがむ動きの時刻を拾いました(目安です)。
| LoRAなし | LoRAあり | |
|---|---|---|
| しゃがみ始め | 約6.0秒 | 約7.0秒 |
| しゃがみ終わり | 約8.3秒 | 約10.5秒 |
| かかった時間 | 約2秒 | 約3.5秒 |
文章では、「5秒から10秒にかけて、ゆっくりしゃがむ」「10秒から12秒で、視線をカメラへ上げて微笑む」と指示していました。
LoRAありは、しゃがみ終わりが約10.5秒、視線を上げるのが約12.3秒で、指示に近い進み方です。LoRAなしは、約8.3秒でしゃがみ終わり、残りは同じ姿勢でカメラを見ています。視線を下げていないので、「上げる」動きも起きていません。
言えること、言えないこと
この見比べで言えるのは、ここまでです。
- この2本では、LoRAありのほうが、視線の動きがあり、しゃがむ動きがゆっくりで、文章の指示に近かった。
- 20ステップ・強度0.6・トリガー語なしで、第7回に書いた帽子やモヤは出なかった。
言えないことも、はっきりさせておきます。
- 「LoRAの効果だ」とは言い切れません。 seedが違う1組だけの見比べです。seedをそろえた比較は、まだしていません。
- ほかの条件で同じになるかは分かりません。 試したのは、20ステップ・強度0.6・この人物・この動きだけです。少ないステップ数では崩れたことを、第7回に書いています。
- 成功率と呼べる数字はありません。 作例を重ねていないためです。
それでも、当方の目に見えた「自然さ」の中身が、視線の動きと、しゃがむ速さとして数えられたことは、収穫でした。次にLoRAを評価するときは、感想に加えて、この2つを数えます。
まとめ
- 同じ文章・同じ参照画像の15秒を、人物LoRAあり・なしで並べた。
- LoRAなしは、15秒のあいだカメラを見たまま。LoRAありは、2回、目を伏せて戻した。
- しゃがむ時間は、LoRAなしが約2秒、LoRAありが約3.5秒。文章の指示(5秒かけてゆっくり)に近いのは、LoRAありだった。
- seedが違う1組だけなので、LoRAの効果とは断定しない。seedをそろえた比較が、次の宿題。
このLoRAの配布元や強度の目安はLoRA一覧表に、連載の全体は記事マップにまとめています。
本記事の動画と画像の人物はAI生成です。数値は2026年9月の当方環境(MacBook Pro M5・メモリ32GB)での生成物を、2026年10月に確かめたものです。時刻は、コマを並べて拾った目安です。

コメント