ChatGPT(OpenAI)・Claude(Anthropic)・Gemini(Google)のAPI料金を、同じ基準で比較しました。
単価だけで見ると、どの価格帯でもGeminiが最も安価です。
ただし3社でトークンの算出方法が異なるため、単価の比較だけでは実際の請求額を見誤る恐れがあります。
記事の後半では、同一条件の処理を実行させた場合の試算額も算出しています。
価格帯ごとの料金比較
各社の主力モデルを、性能帯の近いモデルごとに整理しました。
金額はすべて100万トークンあたりのUSDです。
最上位モデル
| モデル | 入力 | 出力 | キャッシュ読み出し |
|---|---|---|---|
| Claude Fable 5.1 | $10 | $50 | $0.25 |
| GPT-6 astra | $10 | $50 | $1.00 |
| Gemini 3.1 Pro Preview | $2 | $12 | $0.20 |
Gemini 3.1 Proは20万トークンを超えると、入力$4・出力$18に上がります。
Claude Fable 5.1のキャッシュ読み出しは入力の2.5%であり、3社の中で最も安価に設定されています。
主力モデル
| モデル | 入力 | 出力 | キャッシュ読み出し |
|---|---|---|---|
| Claude Opus 5 | $5 | $25 | $0.50 |
| GPT-5.6 sol | $4 | $20 | $0.40 |
| Gemini 3.8 Flash | $0.75 | $3.75 | $0.075 |
この価格帯ではGeminiが際立って安価です。
中位モデル
| モデル | 入力 | 出力 | キャッシュ読み出し |
|---|---|---|---|
| Claude Sonnet 5 | $2 | $10 | $0.20 |
| GPT-5.6 terra | $2 | $12 | $0.20 |
| Gemini 3.5 Flash | $1.50 | $9 | $0.15 |
この帯域では3社が近い価格水準に設定されています。
軽量モデル
| モデル | 入力 | 出力 | キャッシュ読み出し |
|---|---|---|---|
| Claude Haiku 4.5 | $1 | $5 | $0.10 |
| GPT-5.6 luna | $0.20 | $1.20 | $0.02 |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.01 |
テキスト分類や要約などの定型処理を大量に実行する場合は、この軽量帯のモデルで十分な性能を満たすケースが多く見られます。
Claude Haiku 4.5はGemini 2.5 Flash-Liteの10倍以上の単価です。
同一条件における試算額
問い合わせ対応のチャットボット運用を想定して試算します。
月間1万件、1件あたり入力3,000トークン・出力500トークンと仮定します。
月間の合計トークン数は、入力3,000万トークン、出力500万トークンとなります。
| モデル | 入力の費用 | 出力の費用 | 月額 |
|---|---|---|---|
| Claude Sonnet 5 | $60.00 | $50.00 | $110.00 |
| GPT-5.6 terra | $60.00 | $60.00 | $120.00 |
| Gemini 3.8 Flash | $22.50 | $18.75 | $41.25 |
軽量モデルを採用することで、運用費用をさらに抑えられます。
| モデル | 月額 |
|---|---|
| Claude Haiku 4.5 | $55.00 |
| GPT-5.6 luna | $12.00 |
| Gemini 2.5 Flash-Lite | $5.00 |
同一の処理内容でも、選定するモデルによって費用に20倍以上の開きが生じます。
あらかじめモデルを固定せず、要件として必要な精度から逆算して選定することで運用費用の最適化が可能です。
単価だけで比較してはいけない理由
3社でトークンの算出ロジックが異なります。
同一の日本語テキストを入力した場合でも、課金対象となるトークン数は一致しません。
特に差異が大きいのがClaudeです。
公式ドキュメントにおいて「Claude 4.7以降のモデルは新しいトークナイザを使っており、同じ文章でおよそ30%多くのトークンになる」と明記されています。
例えばClaude Opus 5とGPT-5.6 solの入力単価は$5と$4で接近していますが、同一の文章を処理させた場合の実質的な請求差額は単価の比率以上に拡大します。
正確に比較する場合は、公表単価だけでなく実際の運用データを用いて課金額を計測してください。
各社のAPIレスポンスには、処理ごとに消費されたトークン実数が返却されます。
少量のデータで事前検証を行ったうえで、本番環境の総量を見積もる運用が確実です。
費用を抑える3つのアプローチ
1. プロンプトキャッシュを活用する
システムプロンプトや長文ドキュメントなど共通のコンテキストを繰り返し送信する場合、2回目以降の読み出しは通常入力の1割前後の料金に抑えられます。
| 書き込み | 読み出し | |
|---|---|---|
| Claude | 入力の1.25倍(5分)/2倍(1時間) | 入力の10%(Fable 5.1は2.5%) |
| OpenAI | 記載なし | 入力の10%(GPT-4oなど旧世代は50%) |
| Gemini | 保管料が別途かかる | 入力の10% |
Geminiはキャッシュの保管時間に応じた維持費用が別途発生します。
Gemini 3.8 Flashの場合、100万トークンあたり1時間$0.50が加算されます。
頻繁に再利用しないデータを保持し続けた場合、かえって総コストが増加するケースがあるため注意が必要です。
2. バッチ処理APIを活用する
3社ともに、即時レスポンスを求めない非同期処理は50%割引が適用されます。
夜間に実行する一括分類や、蓄積されたログの要約など、リアルタイム性を伴わないバッチ用途に適しています。
前述の月額$110の試算ケースであれば、バッチ処理を利用することで月額$55まで圧縮できます。
結果返却まで時間を要するため、即時対話型のアプリケーションには適用できません。
3. 無料枠を活用する
Geminiには常設の無料利用枠が用意されています。
Gemini 3.8 Flash、3.5 Flash、Flash-Lite、2.5 Flashなどが無料枠の対象となっています。
プロトタイプ開発や個人用途の開発規模であれば、無料枠の範囲内で運用を完結できる場合もあります。
ClaudeおよびOpenAIは、初回アカウント登録時に少額のトライアルクレジットが付与される仕様となっています。
継続的に利用可能な常設の無料枠ではない点に留意してください。
用途別モデル選定の目安
| 用途・要件 | 推奨モデル |
|---|---|
| とにかく安く大量に処理したい | Gemini(無料枠 → Flash-Lite) |
| 分類・要約・抽出を大量に | Gemini 2.5 Flash-Lite または GPT-5.6 luna |
| 対話アプリを実用的な費用で | Gemini 3.8 Flash |
| 長い文脈を何度も読ませる | Claude(キャッシュが安く、100万トークンが標準料金) |
| コードを書かせる・複雑な推論 | Claude Opus 5 または GPT-5.6 sol |
| とりあえず無料で試す | Gemini |
API単価の低さを最重視する場合、大半の用途においてGeminiが有力な選択肢となります。
ただしAPI利用料は、システム全体の運用コストにおける一部分に過ぎません。
プロンプトの試行回数、意図しない出力による再実行、要件を満たすための追加実装工数まで含めると、トータルコストの優劣が逆転する場合があります。
安価だが精度の劣るモデルで複数回再試行するよりも、高価格帯の高性能モデルで1回で処理を完了させるほうが経済的な場合もあります。
コーディング支援エージェント(Codex・Antigravity・Claude Code)の機能比較については、以下の記事を参照してください。

まとめ
- 公表単価はどの価格帯においてもGeminiが最安水準
- 主力帯ではGemini 3.8 Flashが入力$0.75・出力$3.75となっており、Claude Opus 5($5/$25)と大きな価格差がある
- Gemini 3.8 Flashは2027年1月1日に約2倍への料金改定が予告されている
- Claude 4.7以降は同一テキストでも約30%多くのトークンを消費するため、単価の比較のみでは実質費用を見誤る
- 3社ともに非同期バッチ処理で50%割引が適用される
- プロンプトキャッシュの読み出し費用は通常入力の1割前後となる一方、Geminiはキャッシュ保管料が別途発生する
- 恒常的な無料枠を提供しているのはGeminiのみ
各社の料金体系は予告なく改定される場合があります。
本記事は2026年9月12日時点で確認された各社公式ドキュメントの情報に基づいています。
導入を検討される際は、最新の公式料金ページを併せてご確認ください。
生成AIに関するその他の解説記事は、まとめ一覧より確認できます。

