GPT-5.6 SolのAPI・クレジット価格を20%以上引き下げClaude SecurityがMythos 5でGitHubリポジトリをスキャンZero Data Retention継続とPrivate Safety Processingプレビューで安全性を強化ClaudeがGmailでメールを送信しGoogle Driveのファイルを管理できます高リスク訓練の監視を強化しRL訓練を一時停止できます承認済み防御者がGPT-5.6-Cyberで高度な脆弱性調査を進めやすくなりますサイクロン予測で1日以上の余裕を持った対策が可能になります声で話しながら推論やツールを使っても会話が途切れませんAIが長年の数学難問10件に新結果、証明書を公開GPT-5.6 LunaとTerraの価格が80%・20%下がり、高速オプションも追加されますOpus 5が全有料プランとAPIで即利用可能に健康記録を安全に連携し、症状変化や検査結果を文脈で把握できますノートにコードを入れて調べ物と分析を一つにできますGPT-Redでプロンプトインジェクション耐性が大幅向上授業準備をAIで短くしやすくなります会話から資料作成まで、仕事をひと通り速く進めやすくなりますブラウザだけでAI推論を動かして待ち時間を減らせますClaudeの使い方を振り返って無駄を減らせます長い作業を下書きから資料化まで一気に進めやすくなります大きくなるモデルの安全確認ルールを最新版で追えますGPT-5.6 SolのAPI・クレジット価格を20%以上引き下げClaude SecurityがMythos 5でGitHubリポジトリをスキャンZero Data Retention継続とPrivate Safety Processingプレビューで安全性を強化ClaudeがGmailでメールを送信しGoogle Driveのファイルを管理できます高リスク訓練の監視を強化しRL訓練を一時停止できます承認済み防御者がGPT-5.6-Cyberで高度な脆弱性調査を進めやすくなりますサイクロン予測で1日以上の余裕を持った対策が可能になります声で話しながら推論やツールを使っても会話が途切れませんAIが長年の数学難問10件に新結果、証明書を公開GPT-5.6 LunaとTerraの価格が80%・20%下がり、高速オプションも追加されますOpus 5が全有料プランとAPIで即利用可能に健康記録を安全に連携し、症状変化や検査結果を文脈で把握できますノートにコードを入れて調べ物と分析を一つにできますGPT-Redでプロンプトインジェクション耐性が大幅向上授業準備をAIで短くしやすくなります会話から資料作成まで、仕事をひと通り速く進めやすくなりますブラウザだけでAI推論を動かして待ち時間を減らせますClaudeの使い方を振り返って無駄を減らせます長い作業を下書きから資料化まで一気に進めやすくなります大きくなるモデルの安全確認ルールを最新版で追えます
公式発表のみ掲載。噂・リーク・情報商材は除外します。
← 用語集に戻る
用語集AI用語

トークン課金

Token-Based Pricing

とおくんかきん

解説

トークン課金とは、入力と出力のトークン数に応じて料金が決まる従量課金方式です。料金見積もりの基本になります。入力と出力を意識すると節約につながります。

ChatGPTに長い文書を要約してもらったとき、「思ったより料金がかかった」と感じたことはないでしょうか。その原因を理解するカギが、トークン課金の仕組みです。トークン課金(Token-Based Pricing)とは、AIモデルのAPI利用料を、入力と出力のトークン数に基づいて計算する料金体系です。

トークンとは何か

トークンはAIが処理するテキストの最小単位です。英語では1単語がおよそ1〜1.3トークン、日本語ではひらがな1文字が1トークン、漢字1文字が1〜3トークンになることが一般的です。つまり、同じ内容でも日本語は英語より多くのトークンを消費する傾向があります。OpenAIのtiktokenなどのツールで事前にトークン数を確認できます。

入力と出力で異なる単価

ほとんどのAPIプロバイダーは、入力トークン(プロンプト)と出力トークン(モデルの回答)で異なる単価を設定しています。一般的に出力トークンの単価は入力の2〜5倍です。たとえば、GPT-4oの場合、入力が100万トークンあたり$2.50、出力が$10.00です。長いドキュメントを入力に含めるよりも、長い回答を生成させるほうがコストが高くなるという点は重要です。

コストを見積もるには

API利用のコストを事前に見積もるには、いくつかの要素を把握する必要があります。システムプロンプトのトークン数、ユーザー入力の平均トークン数、期待する出力の平均トークン数、そして1日あたりのリクエスト数です。たとえば、1リクエストあたり入力1,000トークン・出力500トークンで1日1,000リクエストの場合、月間のトークン消費量は入力3,000万・出力1,500万トークンになります。

コスト最適化のテクニック

トークン課金を抑えるための実践的な方法はいくつもあります。プロンプトを簡潔に保つこと、不要なコンテキストを省くこと、`max_tokens`パラメータで出力長を制限することが基本です。さらに、プロンプトキャッシュを活用すれば同じシステムプロンプトの再送信コストを大幅に削減できます。タスクの難易度に応じてGPT-4oとGPT-4o-miniを使い分けるモデルルーティングも効果的です。

最新の価格競争

2024年以降、主要プロバイダー間の価格競争が激化しています。Claude 3.5 Sonnet、GPT-4o、Gemini 1.5 Proなど、高性能モデルの価格は1年前の数分の1にまで下がりました。DeepSeekのような低価格モデルの登場も価格破壊を加速させています。コスト最適化を考える際は、最新の料金表を必ず確認することをお勧めします。