Gemini Omni 1.1 Flashの動画生成コストを最適化する方法
Gemini Omni 1.1 Flashの720p動画生成コストは、1秒あたり約$0.10です。これは計画時の基準となる数値で、Googleの料金ページにも記載されています。無料枠はないため、最初のクリップから課金されます。
重要なのは、動画も時間ではなくトークン単位で課金される点です。この仕組みを理解すると、コスト削減のポイントが見えてきます。特に、360pで下書きを作成してから720pで最終出力する方法は、反復コストを大幅に削減できます。
料金表
| 項目 | 料金 |
|---|---|
| 入力(テキスト、画像、動画、音声) | 100万トークンあたり$1.50 |
| テキスト出力 | 100万トークンあたり$9.00 |
| 動画出力 | 100万トークンあたり$17.50 |
| 無料枠 | なし |
この料金は、2026年8月27日にリリースされたGAモデルgemini-omni-1.1-flashと、廃止予定のgemini-omni-flash-previewエンドポイントに適用されます。機能の詳細は、GAリリースで提供された内容を確認してください。
動画出力がトークンに換算される仕組み
Googleは動画もテキストと同じく、出力トークンで課金します。720p動画1秒は5,792出力トークンです。
5,792 tokens x ($17.50 / 1,000,000) = $0.1014 per second
したがって、10秒の720pクリップは約$1.01です。4回の拡張呼び出しで40秒のシーンを作る場合、出力だけで約$4.06かかります。さらに、各ターンで読み込まれる以前のコンテキストの入力トークンも加算されます。
入力料金は比較的安価です。100万入力トークンあたり$1.50なので、参照画像や動画のコストは出力に比べて小さくなります。最適化すべきなのは、プロンプトの文字数よりも、生成する動画の秒数と解像度です。
360pで下書きする
Googleは360pのプレビューを、720pの約3分の1のコストで、最大60%高速に生成します。10秒の下書きなら、約$1.01ではなく約$0.34です。
動画生成では、最初の試行で狙いどおりのショットが得られるとは限りません。失敗した試行にも料金が発生するため、反復方法がコストを大きく左右します。
たとえば、1つの成功ショットに12回の試行が必要な場合、次のような差が出ます。
| ワークフロー | 12回のドラフト | 1回の最終レンダリング | 合計 |
|---|---|---|---|
| すべて720p | $12.17 | $1.01 | $13.18 |
| 360pでドラフト、720pで最終出力 | $4.06 | $1.01 | $5.07 |
同じ最終出力でも、コストを62%削減できます。下書きの生成も速くなるため、より多くの試行を短時間で実行できます。
実装時は、反復中のresponse_formatでresolutionを360pに設定し、プロンプトが固まった段階で720pに切り替えてください。リクエスト形式はAPIガイドで確認できます。
1080pと4Kは、ネイティブレンダリングではなく生成フレームのアップスケールです。720pより高額になるため、4Kパイプラインを予算化する前に、Googleの料金ページで最新の1秒あたりの料金を確認してください。
シーン拡張のコストを管理する
40秒の動画は1回のリクエストではありません。通常は、1回の生成と3回の拡張呼び出しで構成されます。それぞれの呼び出しで、独自の10秒出力と、入力として読み込む以前のコンテキストに対して課金されます。
720pで40秒のシーンを作る場合、出力コストは約$4.06です。ストーリーから逸脱した場合は、問題のあるセグメントから再生成する必要があります。
まず360pで全体の流れを約$1.35で下書きし、4つのセグメントすべてで一貫性を確認してください。その後、720pで再レンダリングします。シーン拡張ガイドでは、拡張が失敗しやすいポイントを解説しています。
Veo 3.1との比較
両モデルは同じGemini APIキーの背後にあるため、価格差を見落としやすくなります。
| モデル | 720p 1秒あたり | 4K 1秒あたり | 無料枠 |
|---|---|---|---|
| Gemini Omni 1.1 Flash | 約$0.10 | アップスケールティア、料金ページ参照 | なし |
| Veo 3.1 | $0.40 | $0.60 | なし |
| Veo 3.1 Fast | $0.10 | $0.30 | なし |
| Veo 3.1 Lite | $0.05 | 利用不可 | なし |
標準のVeo 3.1は、720pではOmniの約4倍のコストです。一方、Veo 3.1 LiteはOmniより安価です。
ただし、秒単価だけで判断するべきではありません。Veoはネイティブオーディオに対応し、1回あたり7秒、最大148秒まで拡張できます。Omniは、Veoにはない対話型の編集ループを提供します。用途ごとの選び方は完全な比較を確認してください。Veoをすでに運用している場合は、Veo 3.1の統合ガイドも利用できます。
チームが過剰に支出する3つのパターン
1. 小さな変更でもフル解像度で再レンダリングする
プロンプトの一節を変更しただけなら、まず360pで効果を確認します。720pは出荷するバージョンのみに使用してください。
2. キャッシュできる動画を毎回生成する
動画出力は再利用できるほど決定論的です。1秒あたり約$0.10かかるため、キャッシュはすぐにコストを回収できます。
生成ファイルを保存し、プロンプトとパラメータをキーとして管理しましょう。同じクリップを2回生成するのは、そのまま無駄な支出になります。
3. タイムアウトだけを理由に再試行する
動画生成には時間がかかるため、クライアント側のタイムアウトは生成失敗を意味しません。タイムアウトで再試行すると、同じクリップに2回分の料金が発生する可能性があります。
タイムアウトを十分に長く設定し、再試行前に処理が完了していないか確認してください。Apidogに現実的なタイムアウトを設定したリクエストを保存し、レスポンス形式を確認してから本番に組み込みましょう。
Google Cloudの課金アラートも設定しておくと、予期しない支出を早期に検知できます。
月額料金を見積もる
まず完成動画の秒数を求め、ドラフトの秒数を加算します。
monthly cost = finished_seconds x $0.10
+ draft_seconds x $0.034
月に5分の720p動画を完成させ、360pでドラフト対最終の比率が10:1の場合は次のとおりです。
300 finished seconds x $0.10 = $30.00
3,000 draft seconds x $0.034 = $102.00
-------
$132.00
ドラフトは最終出力の3分の1の価格ですが、完成量の10倍を生成するため、総額ではドラフトが支配的です。
コストを下げるには、最終レンダリングを安くするよりも、成功するまでの試行回数を減らす方が効果的です。プロンプトを改善し、出力を制限するキーフレーム制御などを活用してください。
よくある質問
Gemini Omni 1.1 Flashは無料ですか?
API経由では無料ではありません。Omniに無料枠はありません。ただし、YouTube ShortsやYouTube Createでは無料で利用できます。詳しくは無料アクセス概要をご覧ください。
Googleのテキストモデルでは、Gemini 3.6 Flashなど、AI Studioを通じたレート制限付きの無料利用枠が引き続き提供されています。
10秒の動画はいくらですか?
720pで約$1.01、360pで約$0.34です。
なぜ動画はトークンで課金されるのですか?
Googleは一貫性を保つため、すべてのモデル出力をトークン単位で価格設定しています。720p動画は1秒あたり5,792トークンに換算され、100万動画出力トークンあたり$17.50で課金されます。
入力画像や参照クリップには追加費用がかかりますか?
はい。100万入力トークンあたり$1.50かかります。ただし、動画出力に比べれば小さなコストです。優先して最適化すべき対象ではありません。
4Kは価値がありますか?
最終成果物に必要な場合に限って使用してください。1080pと4Kはアップスケールであり、モデルが生成していない詳細を追加するわけではありません。解像度を上げるとファイルサイズとコストが増加します。
生成が失敗しても請求されますか?
動画を返す生成には請求が発生します。コンテンツフィルターによる拒否や、出力が生成されないエラーは請求されないはずですが、推測だけで判断しないでください。新しいパイプラインを導入した最初の1週間は、課金ダッシュボードを監視しましょう。
Gemini Omni 1.1 Flashのコスト管理では、複雑な工夫より運用上の規律が重要です。360pで安く下書きし、生成結果を積極的にキャッシュし、タイムアウトと再試行を適切に制御してください。タスクタイプごとに保存済みリクエストを用意しておくと、モデル更新による料金や挙動の変化にも気付きやすくなります。
本番投入前に実際のリクエストとレスポンスを確認するには、Apidogをダウンロードしてください。
Top comments (1)
The approach of using 360p drafts before finalizing in 720p is a smart way to optimize costs, especially considering how many iterations video generation can require. This tactic not only saves money but can also speed up the feedback loop, allowing for more creative experimentation. I’ve found that implementing caching strategies for generated outputs can further enhance efficiency, as it prevents redundant costs. If you’re looking for support in refining the API integration or optimizing workflows, I’d be glad to discuss a paid collaboration. Have you considered any specific metrics to measure cost-effectiveness in your projects?