DomoAIはt2vとi2vどっちがいい?同じシーンを両方で作って比較【テキスト→動画 vs 画像→動画】

DomoAIで動画を作るとき、『テキストから直接(t2v)』と『いったん画像を作ってから動かす(i2v)』の2つのやり方があります。

同じシーンをどちらでも作れるけど、どっちがいいの?

と多くの方が疑問に思っていると思います。

モデル(DomoAI 2.4 Fast)で両方作って比べたところ、見た目のコントロールのしやすさが決定的に違うと分かりました。作例つきで解説します。

検証日: 2026-07-04。同じシーン(銀髪の少女が光る花畑を歩く)を、t2v(テキスト→動画)とi2v(画像→動画)で生成。動画モデルは両方ともDomoAI 2.4 Fastに統一して、やり方(ワークフロー)だけを比較しました。作例はAI生成(実在人物ではありません)。

t2vとi2vの違いとは?

同じ動画でも、DomoAIでは作り方が2通りあります。

  • t2v(テキスト→動画):作りたい映像を文章で書くと、いきなり動画が出てくる。1ステップで手軽。
  • i2v(画像→動画):先に画像を作って(または用意して)から、それを動かす。2ステップだが、動かす前に見た目を決められる。

この『見た目を先に決められるか』が、実は大きな差になります。

やり方【手順】:2つのワークフロー

  •  t2vのやり方

①「テキスト→動画生成」を開く →② 作りたい映像を文章で入力 →③「生成」。1回で完成。

やり方【手順】:2つのワークフロー

  • i2vのやり方

①「テキスト→画像生成」で、まず画像を作る(1回4枚出るので好みを選ぶ) →②「画像→動画(i2v)」でその画像をアップ →③ 動きの指示を入れて「生成」。i2vは、気に入った見た目の画像を選んでから動かせるのがポイントです。

やり方【手順】:2つのワークフロー

比較結果:見た目の制御のしやすが決定的に違う

同じ『銀髪の少女が光る花畑』というシーンを、同じDomoAI 2.4 Fastで両方作った結果が下です。

t2v(左):出てきたのは、AIが決めた豪華な青い衣装の少女。綺麗ですが、見た目は完全にAI任せであり、狙った通りの姿になるとは限りません。

i2v(右):先に『白いドレス+月の光輪』の画像を選んでから動かしたので、動画も選んだ画像そのままの見た目になっており、イメージを正確に反映できています。

つまり『こういう見た目にしたい』が明確なら、i2vのほうが圧倒的に狙い通りになります。

比較結果:見た目の『制御性』が決定的に違う

作例①:t2v(テキスト→動画・直接)

テキストだけから直接生成した動画です(7クレジット・1ステップ)。手軽で、素材も要りません。ただし見た目はAI任せであり、狙いと違う衣装・雰囲気になることもあります。

t2v(テキスト→動画・DomoAI 2.4 Fast・実在人物ではありません)

作例②:i2v(画像→動画)

先に作った画像を動かした動画です(画像4+動画7=11クレジット・2ステップ)。選んだ画像の見た目そのままに動くので、狙ったビジュアルを正確に動画化できます。

i2v(画像→動画・DomoAI 2.4 Fast・実在人物ではありません)

コスト・手間・反復のしやすさ

コストや手間、試行錯誤のしやすさについて以下にまとめておきます。

項目 t2v(直接) i2v(画像→動画)
ステップ数 1(手軽) 2(画像→動画)
消費クレジット 7 11(画像4+動画7)
見た目の制御 ×(AI任せ) ◎(画像で確定)
作り直しのしやすさ 毎回フル動画生成 画像だけ安く作り直せる

ポイントは『作り直し』のしやすさです。

i2vなら、見た目が気に入るまで安い画像生成(4クレジット)だけを繰り返し、決まってから動画にできます。t2vは毎回フルの動画生成なので、見た目を追い込むと割高になりがちです。

また、表には載せませんでしたが、どうしても動画生成は生成に数分かかるため、動画生成の場合は待ち時間が長くなってしまいます。

コスト・手間・反復のしやすさ

使い分けの結論

実測をふまえた使い分けについて以下にまとめておきます。

  • t2v(テキスト→動画)が向く:とりあえず動くものが欲しい/素材がない/見た目はおまかせでOK/手軽さ最優先。
  • i2v(画像→動画)が向く狙った見た目がある/キャラや構図を正確に出したい/見た目を追い込みたい(画像で安く反復)/既にある画像を動かしたい。

おすすめとしては、『まずt2vでイメージ探し、本番はi2vで見た目を確定して動かす』の合わせ技です。

高品質な狙った動画を作りたい時は、基本的には、t2iで狙った画像を生成して、さらに狙った画像を用いてi2vするのがおすすめです。

よくある質問(FAQ)

t2v(テキスト→動画)とi2v(画像→動画)の比較についてよくある質問をいかにまとめます。

t2vとi2vはどちらが綺麗ですか?

同じモデルなら画質の差は大きくありません。決定的に違うのは『見た目の制御性』で、i2vは先に画像で見た目を確定できるため、狙ったビジュアルを正確に動画化できます。

コストはどちらが安いですか?

1本だけならt2vが安い(7クレジット)です。ただし見た目を追い込む場合、i2vは安い画像生成(4クレジット)だけを繰り返して決めてから動画にできるので、結果的に無駄が少なくなります。

狙った見た目の動画を作りたいときは?

i2vがおすすめです。先にテキスト→画像で理想の見た目を作り(4枚から選べる)、それを画像→動画で動かせば、イメージ通りの動画になります。

おすすめの使い分けは?

手軽に試すならt2v、狙った見た目を正確に出すならi2v。まずt2vでイメージを探し、本番はi2vで見た目を確定して動かす、という流れが効率的です。

まとめ

DomoAIのt2vとi2vは、同じシーンでも『見た目の制御性』が決定的に違いました。手軽さのt2v、見た目を確定できるi2vというような役割の違いがライます。

もし、狙ったビジュアルがあるなら、安く画像を追い込めるi2vが有利です。まずt2vでイメージ探し、本番はi2vを利用するという使い分けがおすすめです。

アニメ変換なら、DomoAIが手軽です

実写からアニメへの変換は仕上がりが安定しています。管理人もスタンダードプラン(月額$27.99)で検証しました。

無料でDomoAIを試す →

※広告リンクです。ここから登録いただくと管理人のお財布が少しあたたまり、次の検証の課金代になります。もちろんみなさんの料金は変わりません。

関連記事

コメント

タイトルとURLをコピーしました