一言で
AI の会社は、自社のモデルを、プログラムから呼び出して使える窓口(API)でも提供しています。API の料金は多くの場合、使ったトークンの数をもとに、入力と出力で別々の値段で数えられます。
このページで分かること
- API が何で、料金がどんな単位で書かれているか
- 同じモデルでも料金が変わる場面(まとめて送る・同じ入力を使い回す・入力が長い・速さを上げる)
- 見えないところで数えられるトークン(道具の説明・考える途中)
先に知っておく言葉
- API:プログラムから機能を呼び出すための窓口。ここでは、AI のモデルを自分のアプリなどから使う入り口
- トークン:AI が文章を区切って数える単位(→ 別ページ「トークン」)
- コンテキストウィンドウ:モデルが一度に見られる量(→ 別ページ「コンテキストウィンドウ」)
- 考えてから答えるモデル:答えの前に途中の筋道を作るモデル(→ 別ページ「考えてから答えるモデル(推論モデル・思考の連鎖)」)
API で提供されること
総務省の情報通信白書(令和6年版)は、生成AI が広まった背景の1つに、使いやすい画面や API での提供が進み、AI とのやり取りが身近になったことを挙げています。このページでは、この API で使うときの料金の数え方を扱います。
基本の単位は「100万トークンあたり」
- Anthropic(Claude の会社):料金表は米ドルで、「MTok」(100万トークン)あたりの値段で書かれている。入力(基本の入力)と出力は別の列で、たとえば Claude Haiku 4.5 は入力が1ドル、出力が5ドル
- OpenAI(ChatGPT の会社):料金表は「1M(100万)トークンあたり」の値段で、入力と出力が別の列になっている。たとえば gpt-6.1-sol の標準の値段は、入力が27万2千トークン以下なら、入力2ドル・出力10ドル
例に挙げたモデルを含め、両社の表の多くのモデルで、出力の値段は入力より高く付けられています。また Anthropic は、Claude 4.7 以降のモデル(と Claude Mythos Preview)は新しい区切り方を使っていて、同じ文章でトークンがおよそ3割多くなる、としています。増え方は中身によって変わります。同じ文章でも、モデルによって数えられるトークンが違うことがある、ということです。
同じモデルでも料金が変わる場面
- まとめて送って、あとで受け取る(Batch API):Anthropic は、大量の処理を非同期で受け付ける Batch API を、入力・出力とも50%引きにしている。OpenAI も、すぐに返事が要らない処理向けに、同期の API より50%安く、24時間以内に終わる(多くはもっと早い)と説明している
- 同じ入力の頭の部分を使い回す(プロンプトキャッシュ):Anthropic では、最初に保存するときは通常の入力より高く(5分の保存で1.25倍、1時間で2倍)、2回目からの読み出しは通常の入力の10%(Claude Opus 5.5 は5%、Claude Fable 5.1 と Claude Mythos 5.1 は2.5%)。OpenAI では、GPT-5.6 以降で保存が1.25倍、読み出しは多くのモデルで0.1倍、GPT-6.1 Sol では0.05倍
- 入力が長い:ここは2社で扱いが違う。Anthropic は、Claude 4.6 以降のモデル(と Claude Mythos Preview)では100万トークンのコンテキストウィンドウ全体を通常の値段のまま使える、としている。OpenAI の最新のモデルの料金表は、入力が27万2千トークン以下(短い)と、それを超える場合(長い)で別の値段を載せていて、長いほうが高い
- 速さを選ぶ:OpenAI の料金表は Standard・Batch・Flex・Fast・Ultrafast の段に分かれている。Flex は、返事が遅くなったり、ときどき使えなかったりする代わりに、Batch API と同じ値段になる。Anthropic にも、一部のモデルで出力を速くする Fast mode があり、通常より高い値段が付く(→ 別ページ「速さ(返事までの時間・1秒あたりのトークン)」)
- 処理する地域を指定する:Anthropic では、Claude の API などで、Claude 4.6 以降のモデルに米国の中だけで処理する指定をすると、すべての種類のトークンが1.1倍になる。OpenAI は、2026年3月5日以降に出たモデルで、地域を指定する窓口を使うと10%上乗せとしている(→ 別ページ「クラウドと処理する地域」)
見えないところで数えられるトークン
- 道具を使うとき:Anthropic は、道具(ツール)の名前・説明・形式の定め、道具の呼び出しと結果の分もトークンとして料金に数え、道具を使えるようにするための決まった指示文も自動で足される、としている。Claude の API のウェブ検索は、トークンとは別に1,000回あたり10ドルかかり、検索で取ってきた結果は入力のトークンに数えられる
- 考える途中:OpenAI は、推論モデル(考えてから答えるモデル)が答えの前に使う「reasoning tokens」は API では見えないが、コンテキストウィンドウの場所を取り、出力のトークンとして料金に数えられる、としている。Anthropic も、返事の使用量の欄で、料金に数えた出力のうち中の考えに使った分を知らせている
ニュースでの出方
AIログのニュースでは、API の値段が「100万トークンあたり入力◯ドル・出力◯ドル」の形で出てきました。
- Anthropic の Sonnet 5.5 は、前の Sonnet 5 と同じ、入力2ドル・出力10ドルでした
- Anthropic の新しい中位モデル「Sonnet 5.5」。値段は据え置きで、速く・少ない手数に
- OpenAI の GPT-6.1 Sol は入力2ドル・出力10ドルで、上位の Astra(入力10ドル・出力50ドル)の5分の1でした
- OpenAI「GPT-6.1 Sol」。上位の Astra に近い力を、5分の1の料金で
- OpenAI の GPT-6 Astra の Ultrafast は、API の値段が通常の6倍(入力60ドル・出力300ドル)でした
- ChatGPT に月500ドルの「Pro 500」。速さを上げる「Ultrafast」は、使える量を8倍の速さで減らす
関連する言葉
- トークン・コンテキストウィンドウ・考えてから答えるモデル・エージェントとツールの使用・速さ・クラウドと処理する地域(→ この欄の別ページ)
出典
- 総務省「令和6年版 情報通信白書」第Ⅰ部 第3章 第1節 2(1)生成AIの急速な進化と普及 2024年7月 soumu.go.jp ↗
- Anthropic「Pricing」 platform.claude.com ↗
- Anthropic「Extended thinking」 platform.claude.com ↗
- OpenAI「Pricing」 developers.openai.com ↗
- OpenAI「Batch API」 developers.openai.com ↗
- OpenAI「Prompt caching」 developers.openai.com ↗
- OpenAI「Reasoning models」 developers.openai.com ↗
- OpenAI「Flex processing」 developers.openai.com ↗
確認メモ:2026年10月1日に、上の出典を開いて確かめました。情報通信白書は、生成AI が広まった理由を述べた段落を読みました。Anthropic の料金のページは、モデルの料金表・プロンプトキャッシュ・地域の指定・Fast mode・Batch・長い入力・道具の使用・ウェブ検索の項を読みました。OpenAI は、料金のページ(最新のモデルの表と注記)と、Batch・プロンプトキャッシュ・推論モデル・Flex の説明のページを読みました。2社で扱いがはっきり違ったのは、長い入力の値段(Anthropic は通常のまま、OpenAI は27万2千トークンを境に別の値段)です。「多くのモデルで出力のほうが高い」は、両社の料金表の数字から読んだものです(入力と出力が同じ値段のモデルもあります)。Anthropic の「考えた分」の欄は、Extended thinking の説明のページで確かめました。値段はよく変わるため、例に挙げたモデル以外の値段の一覧は載せていません。月額のプラン(チャットの画面で使う料金)は、この欄の範囲の外として扱っていません。日本円での値段と、日本語の文章でのトークンの数は、確かめた出典に書かれていなかったため載せていません。「API」の言い換えは、ふつうの意味を一言で添えたものです。国の文書は公共データ利用規約にもとづき、内容を言い換えて使っています(出典:総務省「令和6年版 情報通信白書」を加工して作成)。