生成AI実験室(7) 「このLoRA、ダメだ」を保留にしたら、主力になった——不採用寸前からの再評価記

前回の記事で、15秒動画に人物LoRA「Realism People」を併用したと書きました。じつはこのLoRA、一度は「ダメだ」と不採用に傾いた道具です。今回は、それが主力に返り咲くまでの検証記を書きます。先に要点を言うと、ダメだったのはLoRAではなく、当方の評価のやり方でした。

発端: 彼女の映像に「生きている感じ」が足りない

連載で育ててきた彼女の動画は、15秒を破綻なく完走するところまで来ました。次の不満は品質の階層が1つ上がって、「止まっている時間が死んでいる」——瞬きが少ない、仕草が硬い、人形っぽい。これを補う定番の手段が人物表現系のLoRAです(LoRAが何かは前回書いたとおり、既存モデルに小さな追加重みを足す仕組みです)。

候補を4つ選び、合計約826MBを取得。ComfyUIのワークフローに、候補の選択とオン/オフ・強度調整ができるスイッチを追加しました。導入自体は半日仕事です。問題はここからの「評価」でした。

最初の評価は「ダメ」——帽子・モヤ・破綻

さっそく試したところ、結果は散々でした。途中から人物が勝手に帽子をかぶる。画面に薄いモヤ状の霧がかかる。映像が破綻する。「効果として望めない」というのがその時の素直な評価で、品質優先でLoRAオフに戻す判断に傾きました。ここで「このLoRAは不採用」と記録して終わっていたら、話はそこまででした。

LoRA試用時の失敗例。指示していない白い帽子を途中からかぶってしまった動画のスクリーンショット
失敗例の実物——指示していない白い帽子が途中から出現。※AIによる生成物です

救ったのは、記録の「分け方」

このサイトで繰り返し書いてきたとおり、当方は結論に測定条件を添えて記録します。この時も「LoRAはダメ」ではなく、どの使い方でダメだったかを分けて残しました。すると妙なことに気づきます。参照画像から生成する方式ではダメなのに、別の方式(先頭・末尾の画像から生成するもの)では効いている。全部ダメなのではなく、ダメな条件と効く条件がある。そこで結論を「不採用」ではなく「使える時に使う」という保留に変えました。

いま振り返ると、この保留が分水嶺でした。「ダメ」という一言の記録は、未来の自分からその道具を永久に取り上げます。条件付きの「ダメ」は、再評価の扉を開けたまま残します。

見落としていたのは、評価の条件

もうひとつ、見落としに気づきます。当方の運用は二段構え——当たり取りは低解像度・少ないステップ数で数を打ち、本番だけ高品質設定で焼く、というものです。そしてLoRAの評価は、全部「当たり取り用の軽い設定」でやっていたのです。

ステップ数は生成の丁寧さです。6〜8ステップの試写は構図の当たりを見るには十分でも、瞬きや仕草のような繊細な効果を評価するには粗すぎる可能性がある。そこで本番と同じ20ステップでLoRAありを焼き直したところ——効果OK。拡大して48fps化した完成版でも、瞬きと自然な仕草が適度に加わり、懸念していたモヤ状のノイズや余分な手足も見当たりませんでした。この結果を受けて、前回の15秒本番にもこのLoRAを併用しています。

LoRA再評価の経路図。試写設定で評価して散々な結果になった後、「ダメ」と断定する行き止まりの道と、条件を分けて記録して保留し本番条件で再評価して主力採用に至った実際の道の分岐を示す
再評価の経路——「ダメ」と断定していたら行き止まりだった

犯人はステップ数だった

結論を書きます。原因はステップ数です。6〜8ステップの試写では帽子やモヤが繰り返し現れ、本番の20ステップでは姿を消した——出る条件と出ない条件が、ステップ数できれいに割れました。考えてみれば筋も通っています。ステップ数は生成の描き込みの深さで、少ないステップでは絵の細部が最後まで詰まりきらない。そこにLoRAの追加の重みが乗ると、詰まりきらなかった部分が帽子やモヤという形で表に出てくる。本番の深さで描けば、同じ重みは瞬きや仕草という本来の効果として現れる。道具は最初から正しく働いていて、浅い設定で見ていた当方が、その働きを化け物と見間違えていたわけです。

なお、作例の数はこれから積み増す段階で、成功率と呼べる数字はまだありません。効果と副作用の有無は本番条件で確認済み——現在地はそこまでです。

教訓は3つ

第一に、道具の評価を「試写用の軽い設定」でやらない。当たり取りの設定は速さと引き換えに描き込みを捨てています。その捨てた部分にこそ効く道具を、捨てた状態で評価すれば「効かない」どころか「壊れている」ように見える。評価だけは本番条件で行う。

第二に、「ダメ」は必ず条件付きで記録する。「このLoRAはダメ」と「この方式・この設定ではダメ」は、記録としての価値がまるで違います。前者は選択肢を消し、後者は再評価の手がかりを残す。今回、原因をステップ数と特定できたのも、ダメだった時の条件が記録に残っていたからです。

第三に、結論を急がず、いったん保留する。最初の散々な結果の時点で不採用と断定していたら、今の品質はありません。前々回の「15秒は破綻する」の訂正と、構図はまったく同じ——ダメに見えた時こそ、道具の性質と自分の条件設定を切り分けてから結論を出す。

まとめ

人物LoRAは一度「ダメ」に傾き、条件を分けた記録のおかげで保留に踏みとどまり、本番条件での再評価を経て主力になりました。犯人はステップ数——試写用の浅い設定が、正しく働く道具を壊れて見せていた。道具は変わっていないのに、評価のやり方を変えただけで結論が反転した。検証で一番壊れやすいのは道具ではなく、評価する側の条件設定なのだと思います。

次回は、この連載の本線に戻ります。彼女の「かなり無茶なこと」まで、あと少しです。


本記事の数値は2026年9月時点の当方環境(MacBook Pro M5・ユニファイドメモリ32GB)での実測・観察に基づきます。本記事中の人物の画像はすべてAIによる生成物です。

よかったらシェアしてね!
  • URLをコピーしました!
  • URLをコピーしました!

この記事を書いた人

コメント

コメントする

目次