Gemini APIの料金 無料枠・モデル別単価・コストの抑え方を解説【2026年】

Gemini APIの料金 無料枠・モデル別単価・コストの抑え方を解説【2026年】

「Gemini APIを使ってみたいが、料金がよく分からない」「無料でどこまで使えるのか」「OpenAI APIとどちらがコスト面で有利なのか」。AIのAPI活用を検討する開発者や企業の担当者から、こうした声を頻繁に聞きます。特に、複数のAI APIが乱立する中で、自社のユースケースにとって最もコスト効率の良い選択肢がどれなのかを判断するのは、容易ではありません。

Gemini APIの料金は従量課金制で、利用したトークン量に応じて費用が発生します。月額固定のプランはなく、使った分だけ課金される仕組みです。最大の特徴は、無料枠が設けられている点と、モデルの選び方によって単価が数十倍変わる点です。軽い検証であれば無料枠で十分に試せますが、本番運用ではモデル選定とコスト管理の仕組みづくりが成否を大きく分けます。

本記事では、2026年時点のGemini APIの料金体系を、無料枠の範囲、モデル別の単価比較、コストを抑えるための実践的な方法、そしてOpenAI APIとの料金比較まで、網羅的に整理しています。API導入を検討している方が、コストの見通しを立てるための参考としてご活用ください。なお、Gemini APIの料金体系は頻繁に更新されるため、本記事に記載した金額は2026年9月時点のものである点にご留意ください。契約前には必ず公式の料金ページで最新の単価をご確認ください。

確認したいポイント結論詳細
Gemini APIの料金はいくらか?従量課金制。入力・出力トークン量で決まる月額固定ではなく使った分だけ課金。モデルによって100万トークンあたり$0.25〜$18と幅があります
無料でどこまで使えるか?無料枠あり。個人検証には十分な量Google AI Studioから無料で利用でき、レート制限はあるものの料金はかかりません
モデルはどう選ぶか?Flash系が低コスト、Pro系が高精度まずFlashで要件を満たすか検証し、品質が不足する場合にProへ切り替えるのが合理的です
OpenAI APIと比べてどうか?Flash系はOpenAIより大幅に安い同等性能帯で比較するとGemini Flashの単価はGPT-4oの半額以下になるケースがあります

この記事でわかること

・Gemini APIの料金の仕組み(従量課金・トークンの考え方)

・無料枠の範囲と制限事項

・Pro / Flashなどモデル別の単価比較表

・コンテキストキャッシュやバッチAPIによるコスト削減方法

・OpenAI API・Claude APIとの料金比較

Gemini APIを活用したシステム開発やAI導入にお悩みの方は、まずは無料相談をご利用ください。
貴社の用途に合ったモデル選定からコスト設計までサポートいたします。
> 相談予約はこちら
目次

Gemini APIの料金の仕組み

Gemini APIの料金体系の基本構造と、費用を理解するうえで必要な「トークン」の概念を解説します。

従量課金の基本構造

Gemini APIの料金は、入力トークンと出力トークンの量に応じた従量課金です。APIにテキストや画像を送信するときに「入力トークン」が、AIからの応答を受け取るときに「出力トークン」がそれぞれカウントされ、その量に単価を掛けた金額が請求されます。

月額固定のサブスクリプションプランはありません。使った分だけ課金される仕組みのため、利用量が少なければコストも低く抑えられます。一方で、大量にリクエストを送ると予想以上の費用が発生する可能性もあるため、支出上限の設定が重要です。

料金はモデルごとに異なり、高性能なProモデルは単価が高く、軽量なFlashモデルは単価が安い設計になっています。また、出力トークンの単価は入力トークンの数倍に設定されていることが多いため、長い応答を生成するタスクではコストが膨らみやすい点に注意してください。

たとえば、社内の問い合わせチャットボットでは、ユーザーの質問(入力)は短いものの、AIの回答(出力)が長くなる傾向があります。このようなケースでは出力トークンの消費量が支配的になるため、出力単価の安いFlashモデルを選ぶことでコストを大幅に抑えられます。逆に、大量のドキュメントを入力して短い要約を出力するタスクでは、入力単価の方が重要です。自社のユースケースにおいて、入力と出力のどちらが多くなるかを把握しておくことが、正確なコスト試算の前提になります。

トークンとは何か

トークンとは、AIが文章を処理するときの最小単位です。英語では1単語が約1トークン、日本語では1文字が約1〜2トークンに相当します。たとえば「こんにちは」は約3〜5トークンになります。

Gemini APIの料金は「100万トークンあたり○ドル」で表記されます。日本語の場合、1,000文字程度のテキストは約1,500〜2,000トークンに相当するため、100万トークンは日本語で約50万〜70万文字分の処理量に当たります。日常的なチャットボットの運用であれば、月間数百万トークン程度の消費量が一つの目安です。

正確なトークン数はGoogleが提供するトークナイザーで事前に計測できます。コストの見積もりを行う際には、実際のプロンプトとレスポンスを使ってトークン数を算出し、モデルの単価を掛けて月間コストをシミュレーションしてください。たとえば、1回のリクエストで入力が2,000トークン、出力が500トークンだとした場合、Gemini 2.5 Flashであれば1回あたりの費用は約0.0019ドルです。これを月間1万回実行しても約19ドル程度に収まります。このように、Flash系モデルであれば中小規模のプロジェクトでも非常に低コストで運用できるのが、Gemini APIの大きな魅力です。料金の詳細は公式ドキュメントで確認できます(参考:Google Gemini API 料金ページ)。

Gemini APIの無料枠

Gemini APIには無料で利用できる枠が用意されています。個人開発や検証目的であれば、無料枠だけで十分に試すことが可能です。

無料枠の範囲と制限

Gemini APIの無料枠は、Google AI Studio経由で利用できる「Free Tier」として提供されています。無料枠ではトークン量に対する課金は発生しませんが、1分あたり・1日あたりのリクエスト数に上限が設けられています。

無料枠の制限はモデルごとに異なり、具体的な上限値はGoogle AI Studioのレート制限ページで確認できます。この範囲内であれば料金は一切かかりません。

個人の学習やプロトタイプ開発であれば、この無料枠で操作感やモデルの性能を十分に検証できます。ただし、無料枠のデータはGoogleのサービス改善に使用される可能性がある点には注意が必要です。機密データを扱う場合は、有料プランまたはVertex AI経由での利用を検討してください。

無料枠と有料プランの最も大きな違いはレート制限です。無料枠では1分あたりのリクエスト数が制限されるため、大量のリクエストを短時間で処理する用途には向きません。しかし、チャットボットのプロトタイプを社内でテストする、AIの出力品質を評価するといった目的であれば、無料枠のレート制限に引っかかることは少ないでしょう。

また、無料枠で使えるのはFlash系を中心とした一部のモデルで、Gemini 3.1 Pro Previewのように有料枠でしか使えないモデルもあります。利用前に公式の料金ページで、使いたいモデルが無料枠の対象かを確認してください。

無料枠から有料への移行タイミング

無料枠では対応しきれなくなるタイミングの目安は、以下のケースです。

・レート制限(リクエスト数の上限)に頻繁に引っかかるようになった場合

・本番環境でのサービス提供を開始し、安定した応答速度が必要になった場合

・機密情報や個人情報を含むデータをAPIに送信する必要がある場合

・Vertex AI経由でのエンタープライズ向けセキュリティ機能が必要になった場合

有料プランに移行する際は、Google AI Studioのダッシュボードから課金設定を行います。支出上限を設定する機能があり、設定した金額を超えるとリクエストが自動的に制限されるため、想定外の高額請求を防ぐことができます。初めて有料プランに移行する場合は、まず数十ドル程度の低い上限を設定し、1〜2週間の実績を確認してから上限を引き上げるステップを踏むのが安全です。

なお、Gemini APIの有料プランにはTier(段階)制度があります。Tier 1は月額支出上限が250ドル、Tier 2は2,000ドル、Tier 3は20,000〜100,000ドルです。支払い実績が蓄積されると自動的に上位のTierに昇格し、1分あたりに処理できるリクエスト数やトークン数の上限が引き上げられます。大規模なサービスを運用する場合は、本格稼働の数ヶ月前からTierの昇格計画を立てておく必要があります。

関連記事:AIツール比較|法人利用で見るべき7つの軸と主要ツールの違い

モデル別の料金比較

Gemini APIには複数のモデルが用意されており、モデルの選択がコストに直結します。ここでは主要モデルの単価を比較表で整理します。

主要モデルの料金一覧(100万トークンあたり)

以下は2026年10月時点の主要モデルの料金(標準の有料枠)です。Gemini 3.7 Flashの単価は2026年12月31日までの価格で、2027年1月1日からは入力$1.50・出力$7.50になると案内されています。価格は変更される可能性があるため、利用前に公式料金ページで最新の単価を確認してください。

モデル名入力単価出力単価特徴
Gemini 2.5 Flash$0.30$2.50高速・低コスト。日常的なタスクに最適
Gemini 3.7 Flash$0.75$3.75Flash系の上位。コーディングに強い
Gemini 3.1 Pro(〜200K)$2.00$12.00高精度。長文・複雑な推論向き
Gemini 3.1 Pro(200K超)$4.00$18.00長コンテキスト時は単価が上がる
Gemini 3.1 Flash-Lite$0.25$1.50最も安価。分類やルーティング用途

上記の表から分かるとおり、Flash-LiteとProでは入出力の単価に10倍以上の差があります。すべてのタスクにProを使うと月額が桁違いに膨らむため、モデルの使い分けがコスト管理の最重要ポイントです。

モデル選定の基本方針

モデル選定の基本的な考え方は、まずFlash系で要件を満たすか検証し、品質が不足する場合にのみPro系に切り替えるというアプローチです。最初から最上位モデルを選んでしまうと、月額コストが桁違いに膨らみます。多くのタスクではFlash系の品質で実用上十分なため、不必要に高価なモデルを使い続けるのは避けるべきです。

Gemini 3.1 Flash-Liteは、入力の分類やルーティング(リクエストの振り分け)のような単純なタスクに適しています。問い合わせの内容を「技術的な質問」「営業に関する質問」「その他」に振り分けるといったタスクであれば、最も安価なFlash Liteで十分に対応できます。

Gemini 2.5 Flashは、チャットボットの応答生成や要約、翻訳といった日常的なタスクに十分な品質を発揮します。社内向けのAIアシスタントやカスタマーサポートの自動応答には、このモデルがコストと品質のバランスに優れた選択肢です。Gemini 3.7 Flashはコーディングタスクに特に強く、コード生成やデバッグの用途に向いています。開発チームがコーディングの効率化を目的にAPIを導入する場合は、このモデルを検討してください。

Gemini 3.1 Proは、長文の分析、複雑な推論、高精度な文書生成など、品質が最優先のタスクに使います。法務文書のレビュー、契約書のリスク分析、学術論文の要約など、誤りが許されない高精度なタスクにはPro系が適しています。ただし、200Kトークンを超える長コンテキストでは単価が上がる(入力は2倍、出力は1.5倍)ため、大量のドキュメントを一度に処理する場合はコストを事前に試算しておきましょう。ドキュメントを複数回に分割して処理する方法も、コスト削減の有効な手段です。

AI開発やDX推進に関するサービス資料をご用意しています。
導入検討の参考に、まずは資料をご確認ください。
> 資料請求はこちら

Gemini APIのコストを抑える方法

本番運用でGemini APIを活用する場合、コスト管理を怠ると月額が想定を大きく超えてしまうリスクがあります。以下の3つの手法を組み合わせることで、品質を維持しながらコストを大幅に削減できます。

コンテキストキャッシュの活用

コンテキストキャッシュは、頻繁に使うプロンプトやドキュメントをキャッシュしておき、2回目以降のリクエストで入力トークンの課金を削減する仕組みです。たとえば、社内マニュアルの全文をキャッシュしておけば、同じマニュアルに関する質問を繰り返しても、毎回全文分の入力トークンが課金されることを防げます。

キャッシュの保存にはモデル別の保管料がかかりますが、同じコンテキストを何十回も送るケースでは、キャッシュを使う方がトータルコストは大幅に安くなります。長い社内資料やFAQデータを基にしたチャットボットの運用では、効果的なコスト削減手段です。キャッシュの有効期限は自分で設定でき、使わなくなったキャッシュは自動で消えるため、不要な保管料が発生し続けることもありません。導入の手間も小さく、APIリクエスト時にキャッシュIDを指定するだけで利用できます。

バッチAPIの活用(50%割引)

リアルタイムの応答が不要なタスク(大量のテキスト分析、データの一括分類など)には、バッチAPIを使うことで通常料金の50%割引で処理を実行できます。

バッチAPIではリクエストをまとめて送信し、一定時間後にまとめて結果を受け取ります。応答のリアルタイム性は失われますが、大量処理が必要な業務では費用を半額に抑えられるため、コスト削減効果は非常に大きいです。夜間に翌日分のデータをバッチ処理するような運用パターンに適しています。たとえば、ECサイトの商品レビューを毎晩まとめて感情分析する、大量の問い合わせメールをカテゴリ別に自動分類するといったタスクは、バッチAPIとの相性が良い典型例です。リアルタイム性が不要なタスクをバッチに回すだけで、月間のAPI費用を3割〜5割削減できるケースも珍しくありません。

支出上限設定によるコスト管理

支出上限設定機能を使えば、月間の支出額に上限を設定し、超過した時点で自動的にリクエストを制限できます。Google AI Studioのダッシュボードから設定可能です。

過去にはGemini APIで想定外の高額請求が発生した事例が報告されており、支出上限の設定は本番運用で必須のリスク管理策です。開発環境と本番環境でそれぞれ別の上限を設定しておくと、テスト中の暴走による予期せぬコスト発生も防げます。初めてAPIを使う場合は、まず月額50ドル程度の低い上限から始め、実際の消費量を確認しながら段階的に引き上げていくのが安全な進め方です。上限に達した場合はリクエストがエラーになるだけで、追加課金は発生しないため、安心して運用できます。

OpenAI API・Claude APIとの料金比較

Gemini APIのコスト感を把握するために、主要な競合APIとの料金を比較します。

比較項目Gemini 2.5 Flash-LiteGPT-4o miniClaude 3.5 Haiku
入力単価(/100万トークン)$0.10$0.15$0.80
出力単価(/100万トークン)$0.40$0.60$4.00
コンテキスト長100万トークン12.8万トークン20万トークン
無料枠ありなしなし
画像・動画入力対応画像のみ画像のみ

上記の比較から、同等の性能帯(軽量・高速モデル)ではGemini 2.5 Flash-Liteが最もコスト効率が高いことが分かります。特に入力単価はGPT-4o miniの約3分の2、Claude 3.5 Haikuの8分の1で、大量のテキストを入力するタスクではコスト差が顕著に表れます。たとえば、社内の文書を毎月1,000万トークン分入力する場合、Gemini 2.5 Flash-Liteなら月額約1ドル、GPT-4o miniなら約1.5ドル、Claude 3.5 Haikuなら約8ドルと、選ぶモデルによって8倍の差が生じます。

また、Gemini APIは100万トークンという業界最大級のコンテキスト長を持ち、長大なドキュメントを一度に処理できる点でも優位に立ちます。動画や音声の入力にもネイティブで対応しているため、マルチモーダルな処理を必要とするプロジェクトではGeminiが有力な選択肢になります。

ただし、モデルの性能は単純に料金だけで比較できるものではありません。タスクの種類(文章生成、コード生成、データ分析、対話など)によって最適なモデルは異なるため、無料枠やトライアルを使って実際のタスクで品質を比較してから選定することを推奨します。特に日本語のタスクでは、各モデルの日本語処理精度に差が出る場合があります。プロンプトの日本語理解力や応答の自然さは、ベンチマークの数値だけでは測れない部分があるため、自社の業務で使う実際のプロンプトを使って比較検証するのが確実です。

なお、複数のAI APIを併用する運用も現実的な選択肢です。たとえば、大量の単純分類処理にはGemini Flashを使い、高品質な文章生成にはClaude APIを使うといった使い分けにより、品質とコストのバランスを最適化できます。1つのAPIに統一する必要はなく、タスクごとに最もコスト効率の良いモデルを選ぶのがベストプラクティスです。

関連記事:LLM一覧【2026年最新】主要モデルの特徴・違い・選び方を比較して解説

Gemini APIの始め方と注意点

Gemini APIを使い始めるまでの手順と、導入前に確認しておくべき注意点を整理します。

Google AI Studioから始める

Gemini APIを最も手軽に試す方法は、Google AI Studioを使うことです。Googleアカウントがあればすぐにアクセスでき、ブラウザ上でプロンプトの実行やAPIキーの取得が可能です。プログラミングの知識がなくても、画面上でテキストを入力してGeminiの応答を確認できます。

APIキーを取得したら、Python、JavaScript、Go、Dartなどの言語でAPIを呼び出すコードを実装します。Google公式のSDKが提供されているため、数行のコードでAPI連携を実現できます。初めてLLM APIを使う開発者でも、公式のクイックスタートガイドに従えば30分程度で最初の呼び出しが完了します。

なお、Gemini APIにはGoogle AI Studio経由のルートと、Google Cloud Platform上のVertex AI経由のルートの2つの入口があります。個人開発や小規模なプロジェクトにはGoogle AI Studioが手軽ですが、企業の本番システムに組み込む場合はVertex AI経由が推奨されます。Vertex AI経由であれば、データがモデルの学習に使用されない保証や、VPCサービスコントロールによるネットワークセキュリティ、IAMによるアクセス制御などのエンタープライズ向け機能が利用可能です。

本番運用時の注意点

本番環境でGemini APIを運用する際は、以下の点に注意してください。

データの取り扱い:無料枠(Free Tier)で送信したデータは、Googleのサービス改善に利用される可能性があります。機密情報や個人情報を扱う場合は、有料プランのVertex AI経由で利用し、データがモデルの学習に使用されない設定を確認してください。Vertex AI経由のAPIでは、送信したプロンプトや応答データがGoogleのモデル学習には使用されないことが公式に保証されています。この違いは法人での導入判断において非常に重要なポイントです。社内のセキュリティポリシーや取り扱うデータの種類に応じて、適切なルートを選択してください。顧客情報や財務データなど、社外に流出してはならないデータを扱う場合は、必ずVertex AI経由での利用をご検討ください。

レート制限の管理:各モデルにはリクエスト数とトークン数のレート制限が設定されています。利用実績に応じてTier(段階)が上がり、上限が引き上げられる仕組みです。支出上限は、課金が発生しない無料枠には設定がなく、有料ではTier 1が月額250ドル、Tier 2が月額2,000ドル、Tier 3が月額20,000〜100,000ドルと段階が上がります。支払い実績が蓄積されると自動的に上位のTierに昇格し、より多くのリクエストを処理できるようになります。本番サービスの規模に応じて、必要なTierを事前に確認しておきましょう。

料金の変動リスク:Googleはモデルの追加・廃止や料金改定を頻繁に行っています。2026年のGoogle I/Oでは個人向けプランの大幅な値下げが発表されるなど、数ヶ月単位で価格が変わる可能性があります。年間契約を結ぶ前に、最新の公式料金ページで現在の単価を確認してください。また、旧モデルが非推奨(deprecated)になった場合、新モデルへの移行が必要になるため、モデルの廃止スケジュールにも注意を払っておく必要があります。

関連記事:システム開発の外注とは|費用相場、選び方、失敗しない進め方を解説

Gemini APIを活用したシステム開発やAI導入にお悩みの方は、まずは無料相談をご利用ください。
貴社の用途に合ったモデル選定からコスト設計までサポートいたします。
> 相談予約はこちら

まとめ

Gemini APIの料金は従量課金制で、モデルの選び方によってコストが大きく変わります。本記事では、無料枠の範囲、Pro / Flashなどモデル別の単価比較、コンテキストキャッシュやバッチAPIによるコスト削減方法、そしてOpenAI API・Claude APIとの料金比較を整理しました。

コスト管理のポイントは3つです。まず、Flash系モデルで要件を満たすかを検証し、必要な場合のみPro系に切り替えること。次に、コンテキストキャッシュとバッチAPIを活用して実効単価を下げること。最後に、支出上限設定を必ず有効にして想定外の請求を防ぐことです。この3つを実践するだけで、同じ処理内容でも月間コストを半分以下に抑えられるケースが多いです。

まずはGoogle AI Studioの無料枠から試し、実際のタスクでトークン消費量を計測してください。その数値をもとに月間コストをシミュレーションすれば、有料プランへの移行判断やモデル選定を根拠をもって行えます。Gemini APIは頻繁にアップデートされるため、導入後も公式の料金ページを定期的に確認し、最適なコスト構造を維持してください。モデルの追加や料金改定は予告なく行われることもあるため、運用中のモデルが非推奨にならないかも含めて、最新情報のキャッチアップを継続することが安定運用の鍵になります。

AIコンサル・AX伴走支援サービスご紹介資料

社外AI役員サービスご紹介資料
  • サービス資料のページ例:社外AI役員とは
  • サービス資料のページ例:AI活用による企業変革の支援内容

この資料でこんなことがわかります!

  • 社外AI役員とは
  • 支援内容
  • 導入の進め方
  • 導入実績・効果

\3ステップで簡単入力/

この記事の監修者

石丸真平

石丸真平

株式会社ネクストスケール 代表取締役

株式会社ネクストスケールの代表。「AI時代に勝てる企業組織を共に創る」を掲げ、法人向けの生成AI研修とAX(AIによる企業変革)の伴走支援を手がける。経営課題の整理からAI活用領域の設計、ツール選定、業務への組み込み、社内定着、ROI測定までを一気通貫で支援。単なる効率化ではなく、経営戦略としてAIを活かす視点での支援を得意とする。Xでは「本当に仕事で使えるAI」をテーマに、実務で使えるノウハウを発信している。
この記事をシェアする
  • URLをコピーしました!

関連事例

他の成功事例を見る
目次

AI活用を経営成果につなげる
実践ヒントがわかる資料

社外AI役員の支援内容や導入の進め方を、わかりやすくご紹介します。

  1. 資料表紙

必要事項をご入力ください

フォームを読み込んでいます…