Gemini 3.8 Flashは2026年9月2日にリリースされました。Google AI Studioで無料チャットを利用できるほか、約1分で作成できるAPIキーを使えば、Gemini APIの無料枠からも呼び出せます。Googleの発表記事では「当社の最もインテリジェントなFlashモデル」と説明されています。無料枠でも、有料顧客と同じモデルID(gemini-3.8-flash)を利用でき、機能削減版ではありません。
ただし、注意点が3つあります。無料枠にはレート制限があり、無料枠のデータは製品改善に使用されます。また、Geminiアプリの無料プランには3.8 Flashが含まれず、Google AI ProまたはUltraが必要です。詳しい仕様はGemini 3.8 Flashとは何かで確認できます。今すぐリクエストを実行する場合は、次の手順に進んでください。
無料アクセスの概要
| サービス | 費用 | Gemini 3.8 Flashは含まれますか? | 注意事項 |
|---|---|---|---|
| Google AI Studio(ウェブプレイグラウンド) | $0 | はい | レート制限あり。データは製品改善に使用されます。 |
| Gemini API 無料枠 | $0 | はい | AI Studioのレート制限ページに表示される制限と同じです。 |
| Geminiアプリ、無料プラン | $0 | いいえ | 3.8 FlashにはGoogle AI ProまたはUltraが必要です。 |
| Google検索のAIモード | $0 | はい(一般ユーザー向け) | APIなし。思考レベルの制御なし。 |
| GoogleスプレッドシートのGemini | プランによる | はい(一般ユーザー向け) | APIなし。 |
| Google検索グラウンディング | 月5,000リクエスト無料 | Gemini 3.x全体で共有 | 以降は1,000リクエストあたり14ドル。 |
| バッチAPI | 有料料金の50%オフ | はい | 無料ではありませんが、最も安価な有料経路です。 |
| Gemini 3.8 Flash Cyber | 非売品 | いいえ | Fairwindプログラム限定。公開APIはありません。 |
ステップ1: AI Studioでモデルを選択する
Google AI Studioにアクセスし、Googleアカウントでサインインします。請求アカウントやクレジットカードは不要です。
モデルピッカーでgemini-3.8-flashを選択してください。これはプレビューサフィックスのない安定版IDです。実行設定では、思考レベルとしてlow、medium、highを選択できます。デフォルトはmediumです。minimalはサポートされておらず、APIから送信すると暗黙的にフォールバックせず、バリデーションエラーになります。
各レベルのトークン消費量と時間あたりのコストは、思考レベルガイドで確認できます。
無料利用では、次の2つの設定が重要です。
-
temperatureはデフォルトの1.0のままにする。GoogleはGemini 3モデルでこの値を推奨しており、下げるとループや出力品質の低下を招く可能性があります。 - 探索時は
lowから始める。3.8 Flashは複雑なタスクでより多くの推論ステップやツール呼び出しを実行する設計で、3.7 Flashよりも早くクォータを消費する可能性があります。
ステップ2: 無料APIキーを取得する
AI StudioのAPIキーページを開き、新規または既存のプロジェクトでキーを作成します。キーは無料枠ですぐに利用できます。料金ページでは、3.8 Flashの入力・出力が無料枠で「無料」と記載され、有料料金も確認できます。
キーの作成方法は、Gemini APIキーのチュートリアルのスクリーンショット付き手順も参照してください。
APIキーは環境変数に保存し、コードやシェル履歴に残さないようにします。
export GEMINI_API_KEY="paste-your-key-here"
キーはパスワードと同じように扱ってください。無料枠には請求が関連付けられていないため、漏洩しても高額請求には直結しません。しかし、第三者に日次クォータを使い切られる可能性があります。
ステップ3: 初めての無料呼び出しを実行する
Gemini 3.xは現在、主にInteractions APIで実行できます。SDKなしで、次のリクエストを送信してください。
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-[REDACTED CREDENTIAL] -H 'Content-Type: application/json' \
-d '{"model":"gemini-3.8-flash","input":"Explain HTTP caching in 3 sentences.","generation_config":{"thinking_level":"low"}}'
レスポンスは、モデルの思考やツール呼び出しなどの実行ステップのリストです。最後のmodel_outputステップにテキストが含まれます。
既存のgenerateContentコードも引き続き利用できます。Googleはこの方式をレガシーと呼んでいますが、サポート終了日はなく、「完全にサポートされている」と説明しています。このエンドポイントでは、generationConfig.thinkingConfig.thinkingLevelで思考レベルを指定します。
Interactions API、generateContent、Pythonでの実装、previous_interaction_idを使ったマルチターン処理は、Gemini 3.8 Flash APIガイドで確認できます。
429エラーが返った場合は、無料枠のレート制限に達しています。しばらく待つか、Tier 1への移行を検討してください。
無料枠の制限
金銭的なコストはありませんが、次の3点に注意が必要です。
レート制限
無料枠では、モデルごとに次の制限があります。
- 1分あたりのリクエスト数
- 1分あたりのトークン数
- 1日あたりのリクエスト数
Googleは正確な数値をドキュメント本文ではなく、AI Studioのレート制限ページで公開しています。数値は変更履歴なしに変わる可能性があるため、ブログ記事の記載値ではなく、実際のプロジェクトのページを確認してください。制限の仕組みはレート制限ドキュメントで説明されています。
データ利用
Googleは、無料枠のプロンプトと出力を製品改善に使用すると説明しています。ベンチマークや試作には適していますが、顧客記録、未公開ソースコード、NDA対象の情報には不向きです。
機密データを送信する場合は、先に請求アカウントをリンクし、有料層の条件を確認してください。
トークン消費量
Artificial Analysisの測定では、3.8 Flashをhighモードで使うと、インデックス上のタスクあたり約48kの出力トークンを消費します。これは3.7 Flashより30%多い値です。
思考トークンも、表示される出力と同じ1分あたりのトークン制限にカウントされます。無料クォータを長く使うには、まずlowまたはmediumをデフォルトにするのが実用的です。
Geminiアプリは無料経路ではない
「Gemini 3.8 Flash 無料」という検索結果には注意が必要です。一般ユーザー向けに3.8 Flashを利用できるGeminiアプリのプランは、Google AI ProおよびUltraです。サブスクリプションなしでFlashモデルが表示されても、それが3.8 Flashとは限りません。
追加料金なしで3.8 Flashを利用できる一般向けサービスは、次の2つです。
- Google検索のAIモード
- GoogleスプレッドシートのGemini
ただし、どちらも思考レベル、トークン数、APIを制御できません。開発用途では、AI StudioとGemini API無料枠が実質的な無料経路です。
無料グラウンディング: 月5,000回のGoogle検索リクエスト
Google検索グラウンディングを使うと、モデルが現在のウェブ検索結果を回答に組み込めます。無料リクエストは、すべてのGemini 3.xモデルで共有される月5,000件です。超過後は1,000リクエストあたり14ドルかかります。
クォータはモデルごとではなく月単位のプールです。グラウンディングを使う3 Proと3.8 Flashは、同じ5,000件を消費します。最新データを必要とするプロトタイプには十分ですが、本番機能では超過料金を予算に含めてください。
無料枠を使い切ったときの選択肢
デモ中の429エラーや、午後3時の日次制限は珍しくありません。有料経路は安い順に次のとおりです。
1. 請求アカウントをリンクする(Tier 1)
AI Studioでプロジェクトに請求アカウントを関連付けると、Tier 1に移行し、レート制限が引き上げられます。支出上限は250ドルです。Tier 1への移行に支払いは必要ありません。
- Tier 2: 100ドルの支出と3日後に2,000ドルの上限で開放
- Tier 3: 1,000ドルの支出と30日後に開放
2. 通常料金で利用する
2026年12月31日までは、次の料金です。
- 入力: 100万トークンあたり0.75ドル
- 出力: 100万トークンあたり3.75ドル
思考トークンは出力として請求されます。2027年1月1日からは、入力1.50ドル、出力7.50ドルに倍増します。
入力2,000トークン、出力500トークンのリクエストを1,000回実行すると、導入料金では約3.38ドルです。タスク単位の計算方法や、トークン単価が安くてもタスク料金が安くならない理由は、Gemini 3.8 Flashの料金内訳で確認できます。
3. バッチ処理を利用する
待てる処理にはバッチAPIを使うと、料金を半額にできます。2026年末までは次の料金です。
- 入力: 100万トークンあたり0.375ドル
- 出力: 100万トークンあたり1.875ドル
同じ1,000件のリクエストなら約1.69ドルです。Tier 1アカウントでは、一度に最大300万トークンをキューに入れられます。評価、バックフィル、夜間ジョブに適しています。
リクエスト形式は、Geminiバッチモードガイドを参照してください。
4. 安定したプレフィックスをキャッシュする
コンテキストキャッシュでは、キャッシュ済みトークン100万件あたり0.075ドルです。これは新規入力の10分の1にあたります。
長いシステムプロンプトや、毎ターン再送信するドキュメントがある場合は、キャッシュを最初に検討してください。
無料枠では利用できないもの
- Geminiアプリ: 3.8 FlashはGoogle AI ProまたはUltraのみ。
- プライバシー設定: 無料枠のデータはGoogleの製品改善に使用され、オプトアウト設定はありません。
- 余裕のあるクォータ: 無料枠は評価や小規模ツール向けで、本番運用向けではありません。
- Gemini 3.8 Flash Cyber: 政府、インフラ事業者、ソフトウェア保守者向けのFairwindプログラム限定です。公開API、価格、セルフホスティングは提供されておらず、プログラム外では無料・有料を問わず利用できません。
- ライブAPI、画像生成、音声生成: 3.8 Flashはどの層でもサポートしていません。入力はテキスト、画像、動画、音声、PDFに対応しますが、出力はテキストです。
- 無制限プラン: 「無制限」をうたうサービスは、第三者のキーをプロキシしているか、別モデルを提供している可能性があります。無料Gemini APIアクセスガイドで見分け方を確認してください。Gemini 3.6 Flashで利用できた無料枠の方法も、ここで適用できます。
Apidogで無料クォータを管理する
無料枠では、手動入力、不要な429エラー、高レベル思考の過剰利用がそのまま失われるクォータになります。Apidogを使えば、次の運用を自動化できます。
-
GEMINI_API_KEYをApidog環境の環境変数に保存する。 - Interactions APIとレガシーの
generateContentを、プロンプト、モデル、thinking_level付きの名前付きリクエストとして保存する。 - JSONを直接編集せず、変数で思考レベルを切り替える。
- ステータスコードにアサーションを追加し、
429を空レスポンスではなくテスト失敗として検出する。 - レガシーエンドポイントの
usageMetadata.thoughtsTokenCountにもアサーションを追加し、思考に消費したクォータを確認する。
さらに、1日1回のlowリクエストによるスモークテストをスケジュールしましょう。モデルの挙動や無料制限が変わった場合に、ユーザーが気づく前に通知できます。
Apidogをダウンロードし、スケジュール設定はApidogでAPIテストをスケジュールする方法で確認してください。
よくある質問
Gemini 3.8 Flashは無料ですか?
はい。Google AI StudioとGemini APIの無料枠で利用できます。ただし、レート制限があり、データはGoogleの製品改善に使用されます。モデルIDは有料層と同じgemini-3.8-flashです。
GeminiアプリでGemini 3.8 Flashを無料利用できますか?
いいえ。Geminiアプリで3.8 Flashを利用できるのは、Google AI ProおよびUltraのサブスクライバーです。サブスクリプションなしで利用できる一般向けサービスは、Google検索のAIモードとGoogleスプレッドシートのGeminiです。
無料枠のレート制限はいくつですか?
Googleは、モデルごとの制限をAI Studioのレート制限ページで公開しています。数値は変更される可能性があるため、ご自身のプロジェクトで確認してください。より多く必要な場合は、請求アカウントをリンクすれば、支出なしでTier 1に移行できます。
無料枠には思考機能が含まれますか?
はい。low、medium、highの3レベルを利用でき、mediumがデフォルトです。minimalはエラーになります。思考トークンも制限にカウントされるため、無料枠を長く使うにはlowが適しています。各レベルの測定コストは、思考レベルの比較で確認できます。
Gemini 3.8 Flash Cyberは無料ですか?
Fairwindプログラム外では利用できません。通常の開発者は3.8 Flashを利用し、自分のAPIセキュリティテストを実行できます。
まずは無料で始める
無料枠は、Gemini 3.8 Flashを試すだけでなく、本格的に評価するための環境です。
- APIキーを作成する
- 思考レベルを
lowから始める - 機密データを送信しない
- 推測せず、AI Studioのレート制限ページを確認する
429エラーで作業が止まるようになったら、Tier 1のために請求アカウントをリンクし、非同期処理にはバッチAPIを使いましょう。2026年12月末までは入力100万トークンあたり0.375ドルなので、最初の有料月は無料枠のリセットを待つ間のコーヒー代より安くなる可能性もあります。

Top comments (0)