Minimax H3でギギ・アンダルシアの動画をFL2VAで生成してみた。後ろ向きの画像はインプットしてないんだけど見事に再現しててそのすごさを実感。日本語の発音よくするにはTurbo Loraは使用せず20STEPで生成した方が良さげですね。
Minimax H3でギギ・アンダルシアの動画をFL2VAで生成してみた。後ろ向きの画像はインプットしてないんだけど見事に再現しててそのすごさを実感。日本語の発音よくするにはTurbo Loraは使用せず20STEPで生成した方が良さげですね。#GigiAndalsia pic.twitter.com/c5DaXo0i4p
— romfuku (@romfuku) August 14, 2026
▌MiniMax H3について
「MiniMax H3」は、文章や画像などをもとに映像だけでなく音声まで同時に生成できる動画生成AI。最大15秒、最大2K解像度の動画生成に対応しており、人物の動きやカメラワークだけでなく、セリフや効果音などもまとめて作ることができる。
日本語を含む複数の言語でセリフを生成することもでき、映像を作ったあとに別のAIで声を付けるのではなく、映像と音声をまとめて生成できるのも特徴となっている。
また、文章だけから動画を作る「Text-to-Video」のほか、1枚の画像から動画を作ったり、最初と最後の画像を指定してその間の動きをAIに作らせたり、別の画像・動画・音声を参考資料として与えて動画を生成することもできる。
▌FL2VAとは?
投稿にある「FL2VA」は、「First/Last-Frame-to-Video-and-Audio」の略。
簡単に言えば、最初や最後の画像をAIに見せ、そこへ至るまでの動きと音声を生成させる機能となる。
最初と最後の両方の画像を指定することもでき、その間で人物がどのように動くのか、どのように姿勢が変化するのかといった部分はAIが考えて補完し、ひとつの動画として生成してくれる。
今回の投稿で特に驚かれているのが、ギギ・アンダルシアの「後ろ向きの画像」を資料として与えていないにもかかわらず、人物が振り向いた際の後ろ姿まで違和感の少ない形で生成できていること。
つまり、入力された画像に写っている部分だけをそのまま動かすのではなく、画像には写っていない部分についてもAIが推測しながら映像を作っていることが分かる。
▌Turbo LoRAとは?
「Turbo LoRA」は、MiniMax H3の動画生成を高速化するために利用できる追加データのようなもの。
動画生成AIは、最初から完成した映像を一発で作っているわけではなく、何度も処理を繰り返しながら少しずつ完成形へ近づけていく。
Turbo LoRAを利用すると、この処理回数を大幅に減らし、通常よりも短時間で動画を生成できる。
投稿に出てくる「4STEP」「8STEP」といった数字も、この処理を何回行うのかを表している。
▌20STEPとは?
「STEP」は、ざっくり言えばAIが映像や音声を完成形へ近づけていく処理の回数。
たとえば「20STEP」であれば、生成途中の映像に対して処理を繰り返しながら、20段階かけて完成形へ近づけていくイメージとなる。
STEP数を少なくすれば、それだけ動画を短時間で生成できるようになる。
一方、今回の投稿者が実際に試した範囲では、日本語のセリフについては、高速化用のTurbo LoRAを利用して少ないSTEP数で生成するよりも、Turbo LoRAを使わず20STEPで生成した方が日本語の発音が良かったとのこと。
これは「20STEPにすれば必ず日本語の発音が良くなる」という意味ではなく、あくまで投稿者が今回生成した動画で感じた結果となる。
▌低スペックPCでも使える?
結論から言うと、Web版を利用するのであれば、PCの性能はそれほど気にしなくても利用できる。
ブラウザから利用する場合、実際に動画を作る重い処理はサービス側のサーバーで行われるため、自分のPCに高性能なグラフィックボードを搭載している必要はない。
そのため、一般的なPCからでも動画生成AIを試すことができる。
一方、MiniMax H3を自分のPCにダウンロードし、インターネット上のサーバーを使わず「ローカル環境」で動かす場合は話が変わる。
動画生成AIは非常に処理が重いため、基本的には高性能なGPUを搭載したPCが必要となる。
モデルを軽量化したり、使用するメモリを節約したりする方法を利用すれば、比較的少ないVRAMでも動かせる場合はあるものの、PC性能が低ければ動画1本を生成するまでにかなり時間がかかる可能性もある。
AIに詳しくない人であれば、
「普通のPC → Web版を利用」
「高性能GPUを搭載したPC → 自分のPCでのローカル生成も可能」
くらいの認識で問題ない。
この記事への反応
ソシャゲとかならいけそう
こういうゲームやりたい
これくらいのはゴロゴロあるな
思ってたより凄かった
汁感が欲しい
その内同人エロゲーがこういうので埋め尽くされたりしてな
ふーんエッチじゃん
巨乳しか作れんのか
エロコンテンツが捗るな
素晴らしい👍
撮影できそうなカットじゃなくてバリバリ作画しなきゃできないシーンを描いてよ
アンチAIの俺も流石にこれはシコリティ感じたわ
3D丸出しだからまだまだだな
プリキュアもAI使えば全部EDダンス動画クオリティに出来るのにな
こういうのでいいんだよ
暑いわねーとか言いつつ全く暑そうじゃないし砂浜でハイヒール履いてるし風も吹いてないし環境音ゼロというか靴音が聞こえてくる
つまりAIってパット見すごそうに見えて生成した奴のレベルの低さを丸出しにしてしまうツールなんだよ
はやくvrでセ◯クスさせろよ
ギルティギアみたい
まぁヌルヌルしすぎだけど
vtuberがこのクオリティでトラッキングできたら涙流して喜ぶ女vtuber達で溢れかえるんだろうな
seeDance?
凄いな
水着のパーツが突然消えたり復活したり変幻自在すぎる
まあ今のAIの方式だとこうなるよな、って逆に安心感がある
なんか嬉しくない
こういうのならエロサイトにある原神の3Dアニメのほうが好き
脱衣しないと意味ないよ
あと5年もしたらマジで声優とかはいらなくなりそうだな
自然な陰毛表現のアニメは無理なのか
相変わらず短時間の動画しか作れないのか?
現実のモデルの動きそのまま適用してるみたいでヌルヌルがキモい
つよつよPC必要なんでしょ
人間のリアル動画を2次元化する技術として人間はAIにはもう絶対に勝てないすごさを感じる
だが、まったく面白くないしちんピクもしない
何もしないなら帰れ!
こういうことはちゃんとエロいことに使え
砂浜ではビーサンを履きなよ
これが最近出たローカルで作れるやつ?
マジでやばいレベルになってるな
AIとエッチできるようになればいいのにね
お気に入りのAVシーンをそのままキャラに変えられる
もっとデカパイにして太ももムチムチにしてお腹周りをだらしなくてほしい😭
作画崩壊アニメ見れなくなると思うと寂しいよ















この調子ならAIで好物にエチチな事させ放題やな(●´ϖ`●)グヒヒ
次は何かのパロディでなく、完全オリジナルで勝負だ!
明日の新海誠はAI勢から生まれる(生まれない)
AIモデルの性能次第でしかないものなのに
通報しろよ
AIをまともに触った事もない
ド素人丸出しだぞ
そもそも画像インプットすんな著作権意識どうなってんだ
学習はセーフ(著作権法30条の4)
文化庁:AIと著作権について
AI開発のための情報解析のように、著作物に表現された思想又は感 情の享受を目的としない利用行為は、 原則として著作権者の許諾なく 行うことが可能 です(権利制限規定)
技術の進歩が早すぎる
これAIやったのか( ´◡‿ゝ◡`)
自分に刺さればいい
逆に世界的に受けてるキャラって
魅力のない陳腐なゴミだらけだろ
セーフじゃない
こいつはAIサービスにアニメキャラの画像を読み込ませている
ストーリーもしっかりあって普通に見られるできなんよね
親が泣くぞ、ちゃんと働けおっさん(笑)
いや、やっぱ死んでいいよAI祈祷師
安い動画編集変換ツール、説明ではプレミアとかAEみたいな凄いこと簡単に事出来ますみたいにいってるけど、実際触ると結構大雑把で細かい調整まったく出来ないんだよね
AIに仕事奪われた雑魚いつものそのコピペしてるよなw
AI憎い?w
ゲーミングPCを買ったら個人でも
生成AI作れるのか詳しく知りたい
いいPCあれば素人でもここまでの作れるのか
貧乳の女の子が
挟んでる時だけ巨乳なる
生成とかもあったな
自分は
電脳戯画とサーモンライダーって
サークルのだけは買い続けてる
同人なのにクオリティが商業を超えてる
お前の思いつくダメポイントなんて速攻で学習して修正されるんだよカス
AIの進化は止まらないぜ
これ出てきた時マジでビビった
でもこれもまたすぐに追い抜くのが出るんだろうな
PCスペックどんだけ要求されんのかわからんし、恐ろしくて考えたくないけど
自分で生成できたらめちゃめちゃ楽しいだろうなー
しかもガチャで望んだ通りのが出てくるとは限らない
画像だけならサクサクなんだけどなぁ
どしたどした?
親でもAIに◯されたのか?
さらに進化したらどうなってしまうんだろうか