生成AI実験室(17) M5 Mac・RTX 5060 Ti・クラウドGPU——MiniMax H3の15秒に、それぞれ何時間かかったか

生成AI実験室 第17回 MiniMax H3の15秒に、それぞれ何時間かかったか 3つの機材の実測

動画生成AIの MiniMax H3 を、当方は3つの環境で動かしてきました。M5 の MacBook Pro、RTX 5060 Ti を載せたデスクトップ、そして時間で借りるクラウドのGPUです。

これから機材を選ぶ方や、手元の機材でうまくいかずに試行錯誤している方に向けて、3つの環境の実測を1本にまとめます。当方は商社勤務の会社員で、エンジニアではありません。先に試した者の記録として読んでください。

目次

先に、数字を並べる

15秒の動画1本にかかった時間です。条件がそれぞれ違うので、「何倍速い」という比べ方はできません。「この機材では、この条件で、この時間だった」という記録です。

環境条件15秒の所要時間
M5 Mac(メモリ32GB)量子化なしの原本・0.8MP・20ステップ約10時間
M5 Mac(メモリ32GB)量子化なしの原本・0.6MP・8ステップ2時間19分38秒
RTX 5060 Ti(16GB)量子化と蒸留・0.8MP・8ステップ11分40秒〜約14分
RTX 5060 Ti(16GB)量子化と蒸留・0.6MP・8ステップ・フルHDの参照動画つき約23時間で未完成
クラウドのRTX PRO 6000(96GB)量子化なしの原本・0.6MP・20ステップ・参照動画つき25分07秒
クラウドのRTX PRO 6000(96GB)量子化なしの原本・1216×672・20ステップ・フルHDの参照動画つき1時間15分04秒

言葉を2つだけ説明します。量子化は、モデルの数字を粗くして、小さく軽くすることです。蒸留は、少ないステップ数で絵が出るように、モデルを作り直すことです。どちらも速くなる代わりに、細部の描き込みが落ちることがあります。

なぜ、この3つなのか

ローカルで動画を自由に生成するなら、RTX 5090 級のGPUが欲しくなります。ただ、当方が2026年10月に確認した掲載価格は、GPU単体で約110万円、搭載したパソコンで約130万円でした。

MiniMax H3 は、それより手の届く機材に、ぎりぎり載る位置にあります。メモリ32GBの M5 Mac と、VRAM 16GBの RTX 5060 Ti です。当方が人柱として測ってきたのも、この2台です。そして、手元の2台で終わらないときの逃げ道が、クラウドのGPUでした。

M5 Mac(32GB): 遅いが、量子化なしの原本で15秒まで届く

解像度長さステップ数所要時間
0.6MP(672×928)5秒826分04秒
0.6MP(672×928)10秒81時間13分08秒
0.6MP(672×928)15秒82時間19分38秒
0.8MP(800×1056)15秒209時間23分〜10時間14分

Macの強みは、61.7GBあるモデルの原本を、量子化も蒸留もせずに回せることです。仕上げの1本を、時間をかけて焼く使い方に向いています。0.8MP・20ステップの15秒は、寝る前に始めて、朝に受け取る長さです。

誤解のないように、条件を書いておきます。

  • ComfyUIの標準の経路では、この原本は32GBのMacに載りません。 当方は、Mac専用のオープンソースの推論エンジン(h3.c)を使っています。モデルをSSDから流しながら計算する仕組みです。
  • 15秒の本番は、エンジンの不具合を2点直した版で焼いています。 入れてすぐ同じ結果になる、という話ではありません。
  • ComfyUIで量子化版を回す経路は、遅くなりました。 合計約40GBのモデルが32GBのメモリに載り切らず、SSDへの退避が常に起きるためです。0.6MP・5秒・4ステップで48分47秒でした。

経緯は第4回と第6回に書いています。

RTX 5060 Ti(16GB): 量子化と蒸留で、15秒が十数分

作り方解像度長さ所要時間
文章から(8ステップの蒸留モデル)0.6MP(608×1056)5秒2分25秒
文章から(同上)0.6MP(608×1056)15秒8分21秒
文章から(同上)0.8MP(672×1216)15秒11分40秒
画像2枚から(同上)0.8MP(800×1056)15秒13分31秒〜14分05秒
参照素材から(量子化+8ステップ用LoRA)0.6MP(672×928)5秒5分04秒
参照素材から(同上・小さい参照動画と音声つき)0.6MP(608×1056)15秒37分55秒

デスクトップの強みは、速さです。1本が十数分なら、文章を直しては生成する、を1日に何度も回せます。試行と量産は、こちらが向いています。

同じ条件(量子化・4ステップ・5秒・0.6MP)で比べた実測では、MacのComfyUI経路が48分47秒、デスクトップが4分41秒でした。約10倍の差です。

こちらも、条件を書いておきます。

  • 速いのは、量子化と蒸留を使っているからです。 量子化なしの原本(61.7GB)は、VRAM 16GBには収まらないので、当方のデスクトップでは使っていません。
  • 少ないステップ数では、手の指が崩れることがありました。 同じ解像度・同じseedで、4ステップ(高速化LoRAあり)では指が癒着し、20ステップ(LoRAなし)では正常でした。ステップ数とLoRAの有無が同時に違うので、どちらの影響かは分けられていません。
  • 重い参照動画を渡すと、終わらないことがあります。 フルHD・15秒の参照動画を渡した生成は、約23時間たっても完成せず、止めました(第15回)。小さくした参照動画(288×512)なら、上の表のとおり37分55秒で完走しています。
  • VRAMのほかに、メインメモリも要ります。 15秒の動画を拡大する工程では、メインメモリを最大57.6GB使いました(搭載は64GB)。

当方のデスクトップは、もともと RTX 2080 Ti(11GB)でした。GPUだけを RTX 5060 Ti に替えたところ、同じ条件の生成が626秒から218秒になりました(第5回)。

クラウドGPU: 借りるGPUで、単価も、動かせる条件も変わる

クラウドのGPUは、1種類ではありません。借りるGPUを選べます。VRAMの大きさによって、動かせるモデルの形と、1時間の単価が変わります。

当方が RunPod で実際に借りて測ったのは、A40(48GB)と RTX PRO 6000(96GB)の2種類です。RTX 5090(32GB)も借りられますが、当方はまだ測っていません。

借りるGPUVRAM1時間の単価量子化なしの原本(61.7GB)当方の実測
RTX 509032GB約1.2ドル入らない大きさですありません
A4048GB0.44〜0.49ドル載りませんあります(量子化版)
RTX PRO 600096GB1.89〜2.09ドル載りますあります

A40 と RTX PRO 6000 の単価は、当方が借りたとき、または借りる画面で見たときの値です(2026年8月〜10月)。RTX 5090 は、2026年10月11日に公式の料金ページで見た値です。

A40(48GB): 安く借りて、量子化版で試す

条件(すべて量子化版)所要時間
864×480・約5秒・4ステップ(高速化LoRAあり)1分56秒
0.6MP(608×1056)・約5秒・12ステップ6分10秒
約1MP(1344×768)・約5秒・12ステップ10分46秒
0.6MP(640×960)・約4.5秒・6ステップ・参照動画つき10分47秒

借りたときの単価は、1時間0.44ドルでした。上の4本は、どれも1本あたり0.1ドルに届かない計算です。手元にGPUがなくても、文章を直しては生成する、という試行を安く回せます。

条件は次のとおりです。

  • 量子化なしの原本は、48GBには載りません。 量子化版を使います。
  • 15秒は、ぎりぎりでした。 約1MP・15秒・20ステップでは、VRAMの約97%を使い、1ステップに約254秒かかりました。20ステップなら約1時間25分の計算です。この1本は途中で止めたので、完走した記録はありません。
  • 48GBのGPUは、ほかにもあります。 借りる画面には、RTX A6000 や L40S なども並んでいました。当方が測ったのは、A40 だけです。

RTX PRO 6000(96GB): 量子化なしの原本を、重い条件で回す

条件(すべて量子化なしの原本)所要時間単価(測定日)
約1MP(1344×768)・15秒・20ステップ・参照は画像だけ22分22秒1時間2.09ドル(8月23日)
0.6MP・15秒・8ステップ・参照動画つき11分20秒1時間1.89ドル(8月30日)
0.6MP・15秒・20ステップ・参照動画つき25分07秒同上
1216×672・15秒・20ステップ・画像3枚とフルHDの参照動画1時間15分04秒1時間2.12ドル(10月8日・保存領域を含む)

96GBの強みは、手元の機材では時間が合わない条件を、現実的な時間で回せることです。量子化なしの原本を、20ステップで、参照動画つきで、という重い組み合わせでも、15秒が20分台から1時間あまりで終わります。

  • 96GBでも、余裕とは限りません。 10月8日の重い条件では、重みを全部はGPUに置けず、一部を必要なときに送る形になりました。
  • 80GBのGPU(A100など)は、当方は試していません。 約1MP・15秒・20ステップを回したとき、96GBのうち約84%を使いました。80GBのGPUの容量を、少し超える量です。

RTX 5090(32GB): 当方はまだ測っていません

書けるのは、数字から分かる範囲だけです。

  • 量子化なしの原本(61.7GB)は、32GBには入りません。 使うのは、量子化版になります。
  • 当方の RTX 5060 Ti は、16GBで、量子化と蒸留の15秒を十数分で回しています。 同じ作り方は、32GBでも動く見込みです。どれだけ速くなるかは、測っていません。
  • 買う前に、借りて確かめる使い道があります。 RTX 5090 は、買うと単体で約110万円でした。借りるなら、1時間約1.2ドルの表示です。当方は、まだ試していません。

どのGPUを借りるか、当方の見方

  • 量子化版で試行を回すなら、48GB。 単価が安く、5秒前後の動画は2分から11分ほどで終わりました。
  • 量子化なしの原本を使うなら、96GB。 当方の記録では、48GBには載らず、80GBでも足りない見込みです。
  • 単価が安いGPUのほうが、1本が安いとは限りません。 約1MP・15秒・20ステップの1本を計算すると、A40(量子化版・約1時間25分の見込み)は約0.62ドル、RTX PRO 6000(量子化なし・22分22秒)は約0.78ドルでした。GPUもモデルの形も違う2本なので、目安として見てください。

どのGPUでも共通すること

  • 借りるたびに、環境づくりから始まります。 10月8日は、借りてから生成を始めるまでに約1時間20分かかりました(うち環境づくりが約35分)。その間も料金は進みます。
  • 破棄すると、中身は全部消えます。 できた動画は、破棄の前に手元へ落とします。

10月8日の1回は、借りていた約2時間43分で約5.75ドル(計算値)でした。生成の1時間15分だけなら、約2.65ドルです。

費用を並べる

当方が2026年10月10日ごろに確認した、掲載価格の目安です。価格は大きく動くので、購入の前に必ず確かめてください。

機材価格の目安備考
RTX 5060 Ti(16GB)約13万円からGPU単体。パソコン本体は別です
MacBook Pro 14インチ(M5・メモリ32GB・SSD 1TB)約41万円から本体一式
RTX 5090単体で約110万円、搭載パソコンで約130万円当方は持っていません
クラウドのA40(48GB)1時間0.44〜0.49ドル借りた時間だけ
クラウドのRTX 5090(32GB)1時間約1.2ドル借りた時間だけ。当方は未測定です
クラウドのRTX PRO 6000(96GB)1時間1.89〜2.09ドル借りた時間だけ。GPU自体の国内の掲載価格は約343万円でした

RTX 5060 Ti の約13万円は、GPUだけの値段です。当方は、手持ちのデスクトップ(Core i9-10900K・メモリ64GB)のGPUを差し替えました。パソコンごとそろえる場合は、その分が加わります。

クラウドの単価は、RunPod での値で、日によって動きます。2026年10月11日に公式の料金ページを見ると、A40 は0.59ドル、RTX PRO 6000 は2.49ドルと、当方が借りたときより高い表示でした。借りる前に、借りる画面で確かめてください。

当方の使い分け

いまは、次のように分けています。

  • 試行と量産は、デスクトップ。 1本が数分から十数分なので、文章や構図を直しながら数を打てます。
  • 仕上げの1本は、Mac。 当たりが決まったら、量子化なしの原本で、一晩かけて焼きます。
  • 手元で終わらない重い条件は、クラウド。 ふだんは使わず、最後の拠り所として、借り方だけ押さえてあります。

読む方の状況ごとに、当方ならこう考える、という見方も書いておきます。

  • すでにメモリ32GB以上のMacがある場合。 買い足さずに、量子化なしの15秒まで届く可能性があります。ただし、時間はかかります。5秒・0.6MP・8ステップで約26分、が1つの目安です。
  • これからGPUを買う場合。 VRAM 16GBの RTX 5060 Ti は、量子化と蒸留を前提にすれば、15秒を十数分で回せました。原本をそのまま回す用途には足りません。
  • まず買わずに試したい場合。 クラウドなら、量子化版の試行は48GBのGPUで1時間0.5ドル前後、量子化なしの重い条件は96GBのGPUで1時間約2ドルでした。環境づくりの手間と、借りている間じゅう料金が進む点が、引き換えです。

この記事の数字の限界

  • すべて、当方の環境で1台ずつ測った値です。お手元での所要時間を保証するものではありません。
  • 表の行ごとに、モデルの形式・ステップ数・参照素材が違います。行どうしを割り算して「何倍」と読むことはできません。
  • モデルやツールの更新で、数字は変わります。「ぎりぎり載る」という状況も、機種とモデルの世代で変わります。
  • RTX 5060 Ti を2枚にしたときの数字は、まだありません。当方はこれから増設して測ります。
  • クラウドの RTX 5090 は、当方は測っていません。書いたのは、VRAMの大きさから分かる範囲だけです。

条件ごとの細かい数字は実測早見表に、症状と対処はトラブル早見表に、連載の全体は記事マップにまとめています。


本記事の所要時間は、2026年8月〜10月の当方環境での実測です。価格は2026年10月10日ごろに当方が確認した掲載価格の目安で、変動します。クラウドの単価は、2026年8月〜10月に当方が借りたとき・見たときの値です。クラウドの費用は計算値で、請求の確定額ではありません。

よかったらシェアしてね!
  • URLをコピーしました!
  • URLをコピーしました!

この記事を書いた人

コメント

コメントする

目次