AI トークン コスト計算機
OpenAI GPT-5、Claude Opus/Sonnet/Haiku、DeepSeek、Gemini など主要 AI モデルの API 利用料金をすばやく見積もります。1 回・1 日・1 か月・1 年単位のコスト計算に対応し、モデル比較とコスト最適化の提案も備えています。
AI プラットフォーム
モデル
Token 使用量
使用頻度
簡単な使用例
context をクリックすると、推奨 Token と call count が自動入力されます。
コスト見積もり結果
--
--
--
--
$ --
-- トークン
$ --
-- トークン
モデルを選択すると価格を確認できます
コスト最適化の提案
モデルコスト比較
月額コスト比較
取引1件あたりコスト比較
一般的な利用シーン別コスト目安
| 使用コンテキスト | 入力トークン | Output Token | 推奨モデル | 月額コスト見積もり |
|---|---|---|---|---|
| チャットボット | 2,000 | 500 | Claude Haiku | -- |
| RAG 検索 Q&A | 4,000 | 300 | GPT-5 Mini | -- |
| カスタマーサービスシステム | 1,500 | 300 | DeepSeek Chat | -- |
| コードエージェント | 3,000 | 2,000 | Claude Sonnet | -- |
| 翻訳 | 1,000 | 1,000 | Gemini Flash | -- |
| 概要 | 5,000 | 500 | GPT-5 Nano | -- |
| AI コーディング支援 | 4,000 | 3,000 | Claude Opus | -- |
AI Tokens と API コストの完全ガイド
Token、API の課金方式、cost を抑える方法を詳しく学ぶ
Token とは何ですか?
Token は大規模言語モデル(LLM)がテキストを処理する基本単位です。モデルが文章を読み書きするときは「文字」や「単語」をそのまま単位にするのではなく、テキストを個々の Token に分割します。1 Token は完全な単語、単語の一部(subword)、あるいは 1 文字の場合もあります。
英語では 1 Token はおよそ 0.75 語、中国語では漢字の特性上、1 Token はおよそ 1~2 文字に相当します。たとえば「Hello, how are you?」は約 5 Tokens、「The weather is really nice today」は約 6~8 Tokens です。
AI モデルの API 料金は基本的に Token 数に基づくため、API 利用コストを管理するには Token の基本概念を理解することが重要です。
Input Token と Output Token の違い
AI API の課金では Token を2種類に分け、それぞれ異なる価格が設定されることがあります。
- 入力トークン:ユーザーからモデルへ与える内容で、プロンプト、システム命令、会話履歴などが含まれます。Input Token はモデルがテキストを「読む」処理のため、通常は Output Token より単価が低く設定されます。
- Output Token:モデルが生成する回答内容です。テキストを「生成」する処理にはより多くの計算資源が必要なため、Output Token の単価は一般に Input Token より高く設定されます。
OpenAI GPT-5 を例にすると、Input は $10/M tokens、Output は $40/M tokens で、Output の単価は Input の 4 倍です。そのため API コストを下げる場合、Input Token を減らすより Output Token を減らす方が効果的なことが多くあります。
API の料金体系は?
AI API の billing は通常、次の formula に従います:
価格は「100万 Token あたり」(per 1M tokens)で表します。たとえば Input 価格が $10/M で 1,000 Input Tokens を使用した場合、Input コストは $10 × 1,000 ÷ 1,000,000 = $0.01 です。
API プロバイダーごとに料金単位や計算方法は多少異なりますが、基本原則は共通しています。総コスト = Input コスト + Output コスト。多くのプロバイダーは段階的なボリューム割引(利用量が多いほど単価が低下)や Batch API の割引(即時処理が不要な場合に 50% 割引など)も提供しています。
API コストを削減するには?
実績のある AI API コスト最適化戦略:
- 適切なモデルを選択: すべての task に最上位 model が必要なわけではありません。単純な customer support や classification なら GPT-5 Nano や Gemini Flash などを使い、flagship model の約 1/30 の cost に抑えられる場合があります。
- プロンプトの単語長を最適化: システムプロンプトを簡潔にし、不要な会話履歴を削り、より短い指示を使います。Input が短いほどコストも下がります。
- 出力長を制限:設定
max_tokensParameter は生成される長さを制限します。Output のコストは Input の3〜5倍になることが多いため、出力量を抑えることがコスト管理で特に有効です。 - キャッシュを使用:OpenAI と Claude は Prompt Caching を提供しており、同じ system prompt を繰り返す場合 50〜90% の割引を受けられます。
- Batch API を使用: 即時性が不要な task(offline data processing など)は Batch API を使うことで 50% 割引になる場合があります。
- merge request: 小さな request をまとめて 1 つの大きな request にし、system prompt の反復 overhead を減らします。
- 使用状況を定期的に確認:API usage statistics を毎月確認し、異常に消費量の高い scenario を見つけて最適化します。
GPT、Claude、Gemini、DeepSeek のコスト比較
以下は主要 AI モデルの最新 API 価格比較です(100万 Token あたり、単位:USD)。
| プラットフォーム | モデル | 入力($/1M) | 出力 ($/1M) |
|---|---|---|---|
| OpenAI | GPT-5 | $10.00 | $40.00 |
| OpenAI | GPT-5 Mini | $1.25 | $5.00 |
| OpenAI | GPT-5 Nano | $0.35 | $1.40 |
| Claude | Claude Opus | $15.00 | $75.00 |
| Claude | Claude Sonnet | $3.00 | $15.00 |
| Claude | Claude Haiku | $0.25 | $1.25 |
| DeepSeek | DeepSeek Chat | $0.14 | $0.28 |
| DeepSeek | DeepSeek Reasoner | $0.55 | $2.19 |
| Gemini | Gemini 2.5 Pro | $1.25 | $10.00 |
| Gemini | Gemini 2.5 Flash | $0.10 | $0.40 |
AI トークンコスト FAQ
Q1:Token と単語数にはどのような関係がありますか?Token 数はどう見積もればよいですか?
Token 数は単語数と同じではありません。英語では 1 Token はおよそ 0.75 語(約 4 文字)、中国語ではおよそ 1〜2 文字に相当します。一般的には 1,000 Tokens で英語約 750 語、または中国語約 500〜800 文字が目安です。OpenAI や Claude など多くの AI プラットフォームは Tokenizer ツールを提供しており、実際の Token 数を正確に確認できます。
Q2:Output Token の価格が Input より高いのはなぜですか?
Output Token の生成は Input Token の処理よりも多くの計算を必要とするためです。Input 段階では既存テキストを理解・エンコードする処理(「読む」ことに近い)が中心ですが、Output 段階では Token を 1 つずつ予測してデコードする必要があり、生成のたびにモデル全体の推論処理が走ります。そのため Output Token の計算コストは通常 Input の約 3~5 倍になります。
Q3:最も安価な AI モデルはどれですか?
現在市場で最も安価な選択肢は DeepSeek Chat(入力 $0.14/M、出力 $0.28/M)、次に Gemini 2.5 Flash(Input $0.10/M、Output $0.40/M)。cost performance と quality の balance が必要なら、Claude Sonnet($3/$15) と GPT-5 Mini($1.25/$5)はバランスの良い選択肢です。Claude Opus($15/$75)のような top model は最も高価ですが、複雑な inference task では高い性能を発揮します。
Q4: AI API の月額利用費はどの程度が一般的ですか?
利用状況によって異なります。個人開発者が 1 日 100~500 回程度、中~低価格帯モデルを利用する場合は月額およそ $20~$100、小規模チームやプロジェクトで 1 日 1,000~5,000 回程度なら月額およそ $100~$1,000 が目安です。1 日数万回規模の企業用途では月額 $1,000~$10,000 を超える場合もあります。このツールを使えば想定利用量に基づいてより正確に見積もれます。
Q5: AI API に無料枠はありますか?
多くのプラットフォームには無料クレジットや無料枠があります。OpenAI は新規アカウント向けに $5 の無料クレジット(3 か月有効)を提供しており、Claude の API にも類似の試用枠があります。Gemini はレート制限付きの Free Tier を用意しており、開発やテストに適しています。DeepSeek は比較的低価格で、大きな前払いなしでも利用できます。まず無料枠で試し、モデルが要件を満たすことを確認してから本番利用へ進むのがおすすめです。
Q6:Token Caching とは何ですか? どの程度節約できますか?
Token caching は、OpenAI や Claude が提供するコスト最適化機能です。システムプロンプトや会話履歴が短時間に再利用される場合、プロバイダーが重複する Input Token を自動的にキャッシュし、通常より 50~90% 低い料金で計算します。同じナレッジベースやシステム指示を頻繁に使うアプリケーション(カスタマーサービス Bot や RAG システムなど)では、キャッシュを有効にすることで API コストを 30~60% 程度削減できる場合があります。