DomoAIで動画を作るとき、『テキストから直接(t2v)』と『いったん画像を作ってから動かす(i2v)』の2つのやり方があります。
と多くの方が疑問に思っていると思います。
モデル(DomoAI 2.4 Fast)で両方作って比べたところ、見た目のコントロールのしやすさが決定的に違うと分かりました。作例つきで解説します。
DomoAI全体の料金や評判をまとめて知りたい方は、DomoAIとは?料金・評判・使い方を実際に課金して検証もあわせてご覧ください。
t2vとi2vの違いとは?
同じ動画でも、DomoAIでは作り方が2通りあります。
- t2v(テキスト→動画):作りたい映像を文章で書くと、いきなり動画が出てくる。1ステップで手軽。
- i2v(画像→動画):先に画像を作って(または用意して)から、それを動かす。2ステップだが、動かす前に見た目を決められる。
この『見た目を先に決められるか』が、実は大きな差になります。
やり方【手順】:2つのワークフロー
- t2vのやり方
①「テキスト→動画生成」を開く →② 作りたい映像を文章で入力 →③「生成」。1回で完成。

- i2vのやり方
①「テキスト→画像生成」で、まず画像を作る(1回4枚出るので好みを選ぶ) →②「画像→動画(i2v)」でその画像をアップ →③ 動きの指示を入れて「生成」。i2vは、気に入った見た目の画像を選んでから動かせるのがポイントです。

比較結果:見た目の制御のしやすが決定的に違う
同じ『銀髪の少女が光る花畑』というシーンを、同じDomoAI 2.4 Fastで両方作った結果が下です。
・t2v(左):出てきたのは、AIが決めた豪華な青い衣装の少女。綺麗ですが、見た目は完全にAI任せであり、狙った通りの姿になるとは限りません。
・i2v(右):先に『白いドレス+月の光輪』の画像を選んでから動かしたので、動画も選んだ画像そのままの見た目になっており、イメージを正確に反映できています。
つまり『こういう見た目にしたい』が明確なら、i2vのほうが圧倒的に狙い通りになります。

作例①:t2v(テキスト→動画・直接)
テキストだけから直接生成した動画です(7クレジット・1ステップ)。手軽で、素材も要りません。ただし見た目はAI任せであり、狙いと違う衣装・雰囲気になることもあります。
作例②:i2v(画像→動画)
先に作った画像を動かした動画です(画像4+動画7=11クレジット・2ステップ)。選んだ画像の見た目そのままに動くので、狙ったビジュアルを正確に動画化できます。
コスト・手間・反復のしやすさ
コストや手間、試行錯誤のしやすさについて以下にまとめておきます。
| 項目 | t2v(直接) | i2v(画像→動画) |
|---|---|---|
| ステップ数 | 1(手軽) | 2(画像→動画) |
| 消費クレジット | 7 | 11(画像4+動画7) |
| 見た目の制御 | ×(AI任せ) | ◎(画像で確定) |
| 作り直しのしやすさ | 毎回フル動画生成 | 画像だけ安く作り直せる |
ポイントは『作り直し』のしやすさです。
i2vなら、見た目が気に入るまで安い画像生成(4クレジット)だけを繰り返し、決まってから動画にできます。t2vは毎回フルの動画生成なので、見た目を追い込むと割高になりがちです。
また、表には載せませんでしたが、どうしても動画生成は生成に数分かかるため、動画生成の場合は待ち時間が長くなってしまいます。

使い分けの結論
実測をふまえた使い分けについて以下にまとめておきます。
- t2v(テキスト→動画)が向く:とりあえず動くものが欲しい/素材がない/見た目はおまかせでOK/手軽さ最優先。
- i2v(画像→動画)が向く:狙った見た目がある/キャラや構図を正確に出したい/見た目を追い込みたい(画像で安く反復)/既にある画像を動かしたい。
おすすめとしては、『まずt2vでイメージ探し、本番はi2vで見た目を確定して動かす』の合わせ技です。
高品質な狙った動画を作りたい時は、基本的には、t2iで狙った画像を生成して、さらに狙った画像を用いてi2vするのがおすすめです。
よくある質問(FAQ)
t2v(テキスト→動画)とi2v(画像→動画)の比較についてよくある質問をいかにまとめます。
t2vとi2vはどちらが綺麗ですか?
同じモデルなら画質の差は大きくありません。決定的に違うのは『見た目の制御性』で、i2vは先に画像で見た目を確定できるため、狙ったビジュアルを正確に動画化できます。
コストはどちらが安いですか?
1本だけならt2vが安い(7クレジット)です。ただし見た目を追い込む場合、i2vは安い画像生成(4クレジット)だけを繰り返して決めてから動画にできるので、結果的に無駄が少なくなります。
狙った見た目の動画を作りたいときは?
i2vがおすすめです。先にテキスト→画像で理想の見た目を作り(4枚から選べる)、それを画像→動画で動かせば、イメージ通りの動画になります。
おすすめの使い分けは?
手軽に試すならt2v、狙った見た目を正確に出すならi2v。まずt2vでイメージを探し、本番はi2vで見た目を確定して動かす、という流れが効率的です。
まとめ
DomoAIのt2vとi2vは、同じシーンでも『見た目の制御性』が決定的に違いました。手軽さのt2v、見た目を確定できるi2vというような役割の違いがライます。
もし、狙ったビジュアルがあるなら、安く画像を追い込めるi2vが有利です。まずt2vでイメージ探し、本番はi2vを利用するという使い分けがおすすめです。
アニメ変換なら、DomoAIが手軽です
実写からアニメへの変換は仕上がりが安定しています。管理人もスタンダードプラン(月額$27.99)で検証しました。
※広告リンクです。ここから登録いただくと管理人のお財布が少しあたたまり、次の検証の課金代になります。もちろんみなさんの料金は変わりません。


コメント