生成AI APIレートカード。料金をくらべて選ぶ。いくらかかるか、まとめると安くなるか、いつ変わったか。単価・割引・ドルと円・変更履歴をまとめています。
Rate Card / 2026.09.24

生成AI APIレートカード

テキスト・画像・動画・音声・音楽の主要APIについて、単価とスペック、Batch割引とキャッシュの仕様をまとめたもの。列見出しをクリックすると並び替わる。値動きは末尾の変更履歴に残している。

調査日 2026-09-24 前回 2026-09-14 為替 1 USD = 159.33 円(既定値・2026-08-28) 掲載 13提供元 / 95項目

直近の主な動き — 9/22の1日で、OpenAI と Anthropic が同時に値を下げた。 ① GPT-6 Sol(9/22)は $2/$10。GPT-5.6 Sol の販売中の価格($4/$20)のちょうど半額で、期間限定ではなく恒久価格。同時に出た GPT-6 Luna は $0.10/$0.50。 ② Claude Opus 5.5(9/22)は $4/$20(Opus 5 は $5/$25)。キャッシュ読み取りも $0.50→$0.20 に下がった。コーディング系の指標では、2.5倍の値段の Fable 5.1 を上回ると Anthropic は示している。 ③ Grok 4.7(9/21)は 4.6 と同額の $2/$6 のまま、土台のモデルを大きくした。 ④ Gemini 3.8 Live(9/15)が出た。音声の入出力が1分あたり $0.005 / $0.018で、GPT-Live-1($0.05/分)と比べるとかなり安い。ただし比べ方には注意が要る(音声の欄を参照)。 ⑤ Sora 2 のAPIは本日 9/24 で終了。前回までのページは「3/24に終了」と書いていたが、3/24 は終了の告知日で、アプリの終了は4/26、APIの終了が9/24だった。誤りだったので訂正した。 ⑥ Alibaba が Qwen 4 Max を発表(9/22)。ただし発表だけで、価格も提供日もないので表には入れていない。

最上位帯は「$10/$50 の高い段」と「$2〜$4 台の実用段」に分かれてきた。GPT-6 Astra と Fable 5.1 が $10/$50 で並ぶ一方、GPT-6 Sol・Opus 5.5・Grok 4.7・Sonnet 5 が $2〜$4 帯にひしめく。 9月前半は「上が上がる」動きだったが、下旬は中位の値下げが主役になった。なお Anthropic は Sonnet 5.5 と Haiku 5.5 も「数週間のうちに」出すと予告しているので、中位・軽量帯はもう一段動く可能性が高い。

DeepSeekのピーク時間は日本の日中と重なる。 ピークは 平日(月〜金)の UTC 01:00–04:00 と 06:00–10:00 = 日本時間 10:00–13:00 と 15:00–19:00(中国の祝日は除く)。 つまり普通に仕事をしている時間帯が倍額で、夜間バッチ(JST 20:00〜翌10:00)はまるごとオフピークに収まる。 まとめて処理するものは夜に回すと、そのまま半額になる。

テキスト生成 単価は 100万トークンあたり / 列見出しで並び替え

出力トークンは入力の4〜6倍が相場。総額は出力量でほぼ決まるので、モデル選びの前に「どれだけ書かせるか」を見積もったほうが効く。ティアで並べると、各社の同格モデルが横並びになる。

提供元 モデル ティア Input Output メモ
OpenAIGPT-6 Astra最上位$10.00$50.009/3 最新新フラッグシップ。コンテキスト1M、キャッシュ入力$1.00、キャッシュ書き込み$12.50。Batch/Flexは半額、Fastモードは倍額。GPT-5.6 Solの上に乗る段で、入力2倍・出力1.7倍
OpenAIGPT-6 Sol中位$2.00$10.009/22 最新恒久価格Astra の下の段。GPT-5.6 Sol と全体的な賢さは同等で、値段は半分(5.6 Sol は $4/$20)。キャッシュ入力$0.20、書き込み$2.50。コンテキスト1.05M・出力128K、272K超は入力2倍・出力1.5倍。Batch/Flexは半額、Fastは倍額。effortは none〜max の6段階。ただし DeepSWE と OSWorld ではGPT-5.6 Sol のほうが最高点は上で、そのぶん1タスクあたりは高くつく。同額帯の Terra($2/$12)より出力が安く、Terra を選ぶ理由は薄くなった
OpenAIGPT-6 Luna軽量$0.10$0.509/22 最新恒久価格GPT-5.6 Luna($0.20/$1.20)から入力半額・出力6割減。キャッシュ入力$0.01。通常提供のテキストモデルでは入力単価が最安クラス。コンテキスト1.05M。ChatGPT では Free と Go のユーザーがデスクトップアプリで使える
AnthropicClaude Fable 5.1最上位$10.00$50.009/1 最新本体は据え置き。キャッシュ読み取りが$1.00→$0.25へ75%引き下げ(入力の0.025倍。他のClaudeは0.1倍なのでこの機種だけ別扱い)。書き込みは5分$12.50/1時間$20。Batchで$5/$25
AnthropicClaude Mythos 5.1最上位$10.00$50.00限定公開Fable 5.1の制限付きアクセス版。審査プログラム経由
AnthropicClaude Fable 5最上位(旧)$10.00$50.005.1の一世代前。キャッシュ読み取りは$1.00のまま
Sakana AIFugu Ultra v2.0最上位$5.00 / $10.00$30.00 / $45.009/11 最新★日本の会社(Sakana AI)。右は272Kトークン超過時。単体のモデルではなく、仕事を他社モデルへ振り分けて、返ってきた答えをまとめ直す「オーケストレーター」。手数の多い難問向け。コンテキスト1M
Sakana AIFugu Max中位$2.00$6.009/11 最新Ultra と同じ仕組みで、かけた金額あたりの結果を狙う側。Sakana は Sonnet 5 と Kimi K3 の出力単価を40〜60%下回ると説明している
OpenAIGPT-5.6 Sol / GPT-5.5上位(旧)$5.00 / 促販$4.00$30.00 / 促販$20.00コンテキスト1M。廃止の予定は出ていない。促販価格($4/$20)は少なくとも 11/21 まで。GPT-6 Sol が半額で同等の賢さなので、新規に選ぶ理由は薄い
AnthropicClaude Opus 5.5最上位$4.00$20.009/22 最新5.5世代の第1弾。Opus 5 から20%値下げ、キャッシュ読み取り$0.50→$0.20、書き込み$6.25→$5。Batchで$2/$10。1Mコンテキスト・出力128K(Batch beta は300K)、モデルID claude-opus-5-5。Fable 5.1($10/$50)より安いのに、Terminal-Bench 4.0 で 66.4 対 55.8 と上回ると Anthropic は示す一方、GPT-6 Astra には一部の指標で及ばない。「実質40%減」は medium と high の比較を含んだ数字で、モデル差だけなら20%。移行注意思考をオフにできない/forced tool use がエラー/旧 computer-use ツールは拒否、とOpus 5 のコードがそのまま動かない箇所がある。Sonnet 5.5・Haiku 5.5 は「数週間以内」と予告
AnthropicClaude Opus 5最上位(旧)$5.00$25.001Mコンテキスト、5段階のeffortダイヤル。Opus 4.5から5世代連続で同額。8/12に推論速度を改善
MoonshotKimi K3最上位$3.00 / $0.30$15.00右はキャッシュヒット時。コンテキスト1M。Batch非対応
GoogleGemini 3.1 Pro最上位$2.00 / $4.00$12.00 / $18.00右は200Kトークン超過時。3.5 Proは3回延期され未リリースのため、これが現行Pro
xAIGrok 4.7最上位$2.00 / $4.00$6.00 / $12.009/21 最新4.6 と同額。土台のモデルを大きくし、数時間かかる作業向けの強化学習を長く回した版。右は200K超のとき。キャッシュ入力$0.50(200K超$1)、コンテキスト500K、推論は low〜xhigh の4段階、モデルID grok-4.7。倍額の Fast 版は Cursor と Grok Build 経由のみで、公開APIにはない。xAI 自己測定の CursorBench 4.0 は 46.3 で Fable 5.1(51.8)に届かない。OpenRouter では9/22時点で$1.60/$4.80と定価より約2割安い
xAIGrok 4.6最上位(旧)$2.00 / $4.00$6.00 / $12.008/124.5と同額。コンテキスト500K、キャッシュ入力$0.50、知識は2026/2まで。推論の深さを4段階(low/medium/high/xhigh)から選べる。Artificial Analysis指数61でGPT-5.6 Solと同点、Fable 5の1点差
xAIGrok 4.5上位$2.00 / $4.00$6.00 / $12.00Opus級。200K超で倍。キャッシュ入力$0.50。Batch割引の対象外
ZhipuGLM-5.2最上位$0.40 〜 $1.40$1.26 〜 $4.40価格情報が割れている744B MoE、コンテキスト1M、キャッシュ入力$0.26。Z.ai一次情報系は $1.40/$4.40、OpenRouter等の集約系は $0.40/$1.26 と3倍以上の開きがある。実際に使う経路で要確認
DeepSeekDeepSeek V4 Pro最上位$0.66 / $1.32$1.98 / $3.968/16 値上げ左がオフピーク、右がピーク。旧: $0.435/$0.87 固定。5月の75%値下げぶんを一部戻した形。それでも最上位帯では安い部類。9/14に予定されていた提供終了は撤回され、単価も据え置きのまま継続
OpenAIGPT-5.6 Terra中位$2.00$12.007/30に20%値下げ($2.50/$15.00から)
AnthropicClaude Sonnet 5中位$2.00$10.00値上げ中止9/1に$3/$15へ上がる予定だったが、8/10に$2/$10が恒久価格になった
GoogleGemini 3.6 Flash中位$1.50$7.507/21リリース。3.7 Flashの導入価格が切れる2027/1/1に同額へ並ぶ
MetaMuse Spark 1.3中位約$0.10 混合約$0.10 混合9/2 最新入出力を分けた単価が未公表で、混合単価のみ公開。1.2($1.25/$4.25)から大幅に下げてきた
MetaMuse Spark 1.2中位(旧)$1.25$4.251Mコンテキスト。学習利用を許可する契約者向けにさらに安い枠あり
xAIGrok 4.3中位$1.25$2.50長文コスパ枠。コンテキスト500K〜1M。Batchで20%オフ
GoogleGemini 3.8 Flash中位$0.75$3.759/2 最新2027/1/1に倍3.7 Flashと同額のまま全ベンチマークで上回った。導入価格は2026/12/31まで、以降$1.50/$7.50。Batch/Flexは半額、Priorityは1.8倍。審査制のCyber版もあり
GoogleGemini 3.7 Flash中位(旧)$0.75$3.758/13リリース。3.8と同額なので、選ぶ理由は薄い
ZhipuGLM-5.3-Flash軽量$0.15$0.509/9 促販終了促販: $0.075 / $0.2550%引きの導入価格は2026-09-09 24:00(シンガポール時間)で終了し、定価に戻った。Intelligence Index 57
ZhipuGLM-5-Turbo中位$1.20$4.002026/3/15リリース。GLM-5.2 とは別系統の速度重視版
ZhipuGLM-4.6中位$0.43$1.74旧世代。200Kコンテキスト
MiniMaxMiniMax-M3中位$0.30$1.20「Permanent 50% off」適用後。入力512Kまで、キャッシュ読み取り$0.12
AnthropicClaude Haiku 4.5軽量$1.00$5.00軽量帯では割高な部類
GoogleGemini 3.5 Flash-Lite軽量$0.30$2.50高スループット・低遅延向け
OpenAIGPT-5.6 Luna軽量(旧)$0.20$1.207/30に80%値下げ($1.00/$6.00から)。9/22に GPT-6 Luna($0.10/$0.50)が出て、入力の最安はそちらへ移った。こちらも廃止予定はないが、新規に選ぶ理由は薄い
DeepSeekDeepSeek V4.1-Flash軽量$0.15 / $0.30$0.60 / $1.209/10 最新左がオフピーク、右がピーク。モデルID deepseek-flash。552B MoE(実働は入力8B・出力16B)、画像入力に対応、ウェイトはMITライセンスで公開。キャッシュヒットは$0.003(ピーク$0.006)と極端に安い。旧名 deepseek-v4-flash と deepseek-v4-flash-vision-exp 宛のリクエストは、このモデルが処理してFlash単価で課金される(旧モデル自体は提供終了)
DeepSeekDeepSeek V4 Flash軽量$0.22 / $0.44$0.66 / $1.328/16 値上げ左がオフピーク、右がピーク。旧: $0.14/$0.28 固定。自動キャッシュでInput $0.007(ピーク$0.014)まで下がる
DeepSeekDeepSeek V4 Flash Vision軽量・実験$0.22 / $0.44$0.66 / $1.328/21Experimental扱い。画像入力に対応してV4 Flashと同額。コンテキスト1M、出力上限384,000トークン
DeepSeekDeepSeek R1推論特化$0.55$2.19キャッシュヒットでInput $0.14
該当なし

画像生成 単価は 1枚あたり

日本語テキストを画像内に入れるなら GPT Image 2 か Nano Banana Pro。この2つは漢字が崩れにくいという評価が定着している。量が要るだけなら Nano Banana 2 が Pro の1/3。

提供元 モデル ティア 料金 メモ
OpenAIGPT Image 2.5
(Flare / Sunburst)
最上位$0.25 1K
$0.30 2K
$0.60 4K
9/8 最新2本立てで、Flare は速さ重視の量産向け、Sunburst は編集の精度重視。単価は2本とも同じ。公式はトークン課金(テキスト入力$5.00 / 画像入力$8.00 / 画像出力$30.00 per 100万トークン、キャッシュは各$1.25・$2.00)で、左の1枚あたりは再販経路の実売。生成と参照画像の編集の両対応
OpenAIGPT Image 2最上位$0.006 低
$0.053 中
$0.211 高
Batch 50%1024×1024の場合。3840×2160の高品質は$0.401。横長・縦長は中〜高でやや安い($0.041/$0.165)。日本語の再現度が高い
GoogleNano Banana Pro
(Gemini 3 Pro Image)
最上位$0.039 標準
$0.134 2K
$0.24 4K
Batch 50%日本語テキストが崩れにくい。人物の写実性と文字レイヤリングが強い。画像生成系はキャッシュ非対応
ByteDanceSeedream 5.0 Pro中位$0.045 〜2.36MP
$0.09 超過
8/12生成と編集の両対応、マルチ参照フュージョン。参照画像は1枚目が無料、追加$0.003/枚。BytePlus ModelArk のほか fal.ai・Replicate 等でも。Lite版もあり
GoogleNano Banana 2中位$0.067 1KPro級の品質をFlash級の速度で。出力3〜5秒、4Kネイティブ。Nano Banana Proの1/3
xAIgrok-imagine-image-quality中位$0.05 1K / $0.07 2KBatch 50%
xAIgrok-imagine-image軽量$0.02Batch 50%1K。$0.01まで下がる
MiniMaximage-01軽量$0.0035最安。品質より量が要るとき
OpenAIGPT Image 1廃止予定$0.02 〜 $0.192026/10/23 廃止新規採用は避ける
該当なし

動画生成 単価は 1秒あたり

同じ会社でもティアで単価が10倍以上違う分野。ティア列で並べ替えると、Veo Lite / Fast / Standard のように散らばったものが各社の同格どうしで揃う。入れ替わりも速く、半年前の型番はもう無いことが多い。

提供元 モデル ティア 解像度 料金 メモ
ByteDanceSeedance 2.5高品質1080p(リセラー)約 $0.577/31・API 8/7BytePlusで5秒1080pが$2.843。公式APIのネイティブ出力は480p/720pまでで、1080p・4Kはリセラー側のアップスケール。最長30秒を音声込みで一発生成、参照は画像30枚・動画10本・音声10本、タイムスタンプ単位の編集が可能
GoogleVeo 3.1 Standard高品質音声込み$0.40Vertex AI経由では$0.75/秒との情報もあり、提供経路で差が大きい
AlibabaWan 3.0高品質1080p$0.208/2430秒1080pで$6。失敗した生成は課金されない
MiniMaxH3 (Hailuo 3.0)高品質2K(1440p) 24fps$0.137/31omni-modal。5〜15秒、ステレオ音声を同時生成。入力に画像9枚・動画3本・音声3本まで参照可。1080pティアは存在しない。1分$7.80
ByteDanceSeedance 2.0高品質公式約 $0.14品質1位46元/100万トークン課金。15秒 ≒ 308,880トークン。動画入力(編集)は28元/100万
Luma AIRay 3 / Ray 3.2高品質1080p約 $0.21 〜 $0.2480クレジット/秒。60秒で約$12.60
KuaishouKling 3.0標準720p / 1080p$0.075 〜 $0.144K・60fps・15秒・多言語リップシンク。公式はクレジット制(音声なし6〜8、音声込み9〜12/秒)。6月中旬にTurbo版が追加
RunwayGen-4.5標準標準$0.1212クレジット/秒。10秒で約$1.20
MiniMaxH3(サードパーティ)標準2K / 768p$0.124 / $0.077AIHubMix等。公式よりやや安い。Segmindは逆に2K $0.1625と割高
AlibabaWan 3.0標準720p$0.108/24★Omni-Reference — テキスト・画像・音声・動画に加えてドキュメント・表計算・スライド・PDF・Webページを入力にして動画を作れる。2〜30秒、t2v/i2v/参照生成。8/6にパブリックβ、8/24に正式版。短編ドラマ・広告・観光PR・MVで実運用実績あり
AlibabaWan 2.7標準text-to-video$0.10旧世代。Together AI等で提供
GoogleVeo 3.1 Fast標準標準$0.10 〜 $0.15
ByteDanceSeedance 2.0 Fast標準1080p$0.09「production品質で最安」との評価
MiniMaxH3 (Hailuo 3.0)標準768p$0.08 〜 $0.09実質使えない価格表にはあるがクローズドβの申込制。APIのresolutionは2Kしか受け付けず、指定しても2K料金で課金される
ByteDanceSeedance 2.0軽量サードパーティ$0.04 〜 $0.067OpenRouter $0.067、PoYo $0.04〜。公式APIの提供が限定的で実運用はここ経由が中心
Luma AIRay 3 / Ray 3.2軽量720p約 $0.0620クレジット/秒(Plusプラン換算)
xAIGrok Imagine Video軽量標準$0.05Batch 50%$0.025/秒。動画でBatch割引が明示されている唯一の例
AlibabaWan 3.0軽量480p$0.058/24Alibaba Cloud Model Studio。中国国内(北京)は0.30元/秒、シンガポールは0.37471元/秒
GoogleVeo 3.1 Lite軽量720p 音声なし$0.03 〜 $0.08動画では最安クラス。音声が要らないなら第一候補
GoogleGemini Omni / Omni Flash不明―未公表料金待ち5/19のI/Oで発表、Omni Flashは6/30リリース。8/25時点でも公式pricingの動画欄はVeo 3.1系のみで、従量APIの単価が出ていない
OpenAISora 2終了―提供終了API 9/24 終了アプリ・Web は4/26に終了済み。API は 2026-09-24 で終了(3/24は開発者への告知日)。OpenAI は後継を示していない
該当なし

音声・TTS

リアルタイム対話(話しかけて、返してもらう)

この分野は「分あたり」と「トークンあたり」が混在していて、そのままでは比べられない。 さらに GPT-Live-1 は音声の層だけの値段で、考える部分は別モデルへ渡してその分が別料金になる。表示された単価だけで見積もると足が出る。

提供元 モデル 料金 メモ
OpenAIGPT-Live-1$0.05 / 分9/10 API公開聞きながら話せる(全二重)のが売り。秒単位で課金され、沈黙している時間も、裏で考えている時間も、同じ単価で課金される。別料金ありこれは音声の層だけで、推論は GPT-6 Astra や GPT-5.6 Luna など別モデルへ渡す。10分の通話で Luna なら約$0.51、Astra なら約$0.86。エンドポイントは v1/live/sessions、コンテキスト128K、知識は2025/7まで。音声は12種だが公開された一覧は英語圏とブラジルポルトガル語・フィリピン系で、日本語の記載はない。APIに mini はない(miniはChatGPT無料プラン向け)
OpenAIgpt-realtime-2.1音声入力 $32 / 出力 $64 per 100万トークンGPT-Live-1 の登場後も据え置きで併売。キャッシュ入力$0.40。実測でおよそ$0.05/分。会話が長くなるほど入力が積み上がるので、10〜15分を超えると分あたりの実額は上がる
OpenAIgpt-realtime-2.1-mini音声入力 $10 / 出力 $20 per 100万トークン実測でおよそ$0.016/分。同じ用途で3分の1近くまで落ちる
GoogleGemini 3.8 Live音声入力 $0.005 / 分
音声出力 $0.018 / 分
9/15 最新音声を入れて音声で返すネイティブの音声対話モデル(文字起こしを挟まない)。モデルID gemini-3.8-live と、複数段の推論をする gemini-3.8-live-extended-thinking の2本。97言語に対応し、日本語も含むと紹介されている(二次情報。Google の一次資料では未確認)。最初の音声まで約1.18秒、映像もほぼリアルタイムで受けられ、生成音声すべてに SynthID の透かしが入る。要確認公開されている単価は通常版のもので、extended-thinking 版の単価は確認できていない。3.1 Flash Live と数字が同じなのは偶然か流用か未確認
GoogleGemini 3.1 Flash Live音声入力 $0.005 / 分
音声出力 $0.018 / 分
リアルタイム対話ではもっとも安い部類。同じ「音声出力100万トークン」で OpenAI が$64、Google は$12。ただし GPT-Live-1 の $0.05/分は「聞いて話す層」だけの値段で、考える部分は別料金。こちら(Google)は音声モデルの中で推論まで行う設計なので、表の数字どうしをそのまま並べて安い高いと言えない

読み上げ(TTS)

提供元 モデル 1,000文字あたり メモ
ElevenLabsFlash / Turbo$0.050.5クレジット/文字換算で実質さらに割安
MiniMaxSpeech Turbo$0.06 ($60/100万字)
ElevenLabsMultilingual v2 / v3$0.10高品質
MiniMaxSpeech HD$0.10 ($100/100万字)
OpenAIgpt-4o-mini-tts約 $0.015 / 分判明文字数ではなくトークン課金(テキスト入力$0.60 / 音声出力$12.00 per 100万トークン)なので、1,000文字あたりに直すと文章によって振れる。分あたりではこの表でいちばん安い部類
GoogleCloud TTS(Standard / WaveNet)$0.004判明$4.00 / 100万文字。月400万文字まで無料枠。声の質は価格なり
GoogleCloud TTS(Neural2)$0.016$16.00 / 100万文字
GoogleCloud TTS(Chirp 3: HD)$0.03$30.00 / 100万文字。Google側の高品質枠
GoogleCloud TTS(Studio)$0.16$160.00 / 100万文字。Standard の40倍。ナレーション用途の最上位
GoogleGemini 3.1 Flash TTSトークン課金テキスト入力 $1.00 / 音声出力 $20.00 per 100万トークン。無料枠あり、Batchで半額。文字数課金の Cloud TTS とは別系統なので、単純には比べられない
該当なし

音楽生成

この分野は従量APIを公式提供していない会社が多い。Sunoは公式APIがなくサードパーティ経由、UdioとStable Audioはサブスクのみ。

提供元 モデル 料金 メモ
Sunov4系$0.014 〜 $0.111 / 曲公式APIなし。サードパーティ経由の実売。直販サブスクはPro $10/月〜
GoogleLyria 3 Pro$0.05 〜 $0.15 / 曲MusicAPI経由、10クレジット/タスク。RealTime版はWebSocketストリーミング
MiniMaxMusic 3.0 / 2.6$0.15 / 5分まで8/20 新規受付停止いま新規には申し込めない。既存の有料利用者のみ継続可。無料枠(music-3.0-free等)は廃止。新規はMiniMax AudioアプリかHugging Faceのオープンウェイトへ誘導される。歌詞生成APIも同様。Music 3.0自体は8/13にウェイト公開済み
ElevenLabsMusic$0.80 / 分
UdioStandard / Pro$10 〜 $30 / 月従量課金APIなし
Stability AIStable Audio$5.99 〜 $89.99 / 月従量APIは要調査
該当なし

Batch API と キャッシュの割引

Batch APIは大量のリクエストをまとめて非同期で投げ、24時間以内に結果を回収するかわりに安くなる仕組み。即時応答が要らない一括処理向け。プロンプトキャッシュは同じ長い前提部分を使い回して入力コストを削る仕組みで、両者は併用できる。

提供元 Batch Batch割引率 キャッシュ メモ
Anthropic対応50%オフ90%オフ全アクティブモデルで対応。Batchとキャッシュを併用可
OpenAI対応50%オフ最大90%GPT-4o以降。GPT-5.6以降はキャッシュ書き込みに1.25倍の追加料金。o3/o4-mini等はBatch側キャッシュ非対応
Google対応50%オフ暗黙キャッシュ標準Gemini 2.5以降は暗黙キャッシュが自動適用。画像生成系はキャッシュ非対応。Batch内でもキャッシュ参照可
Zhipu対応50%オフ対応GLMラインナップ全般で両方対応
DeepSeek対応約50%オフ自動BatchはSiliconCloud等のホスティング経由が中心。キャッシュは自動適用でオプトアウト不要
xAIモデル限定テキスト20% / 画像・動画50%対応テキストのBatch割引は Grok 4.3・4.20系のみで、Grok 4.5 は対象外。4.6・4.7 も割引の記載を確認できていない。画像・動画は別枠で一律50%オフ。1リクエスト最大25MB
Moonshot旧モデルのみ通常の60%の価格対応BatchはK2.7 Code / K2.6 / K2.5が対象。最新のK3はBatch非対応
MiniMax情報限定非公開自動キャッシュは設定不要で自動適用。Batchは存在が示唆されるが公式ドキュメントに割引率の記載なし
Meta要調査未確認要調査Model APIが7/9にパブリックプレビュー開始したばかりで、割引の枠組みが未整備とみられる
該当なし

キャッシュの有効期限と起点

ほぼ全社が「最後にキャッシュを使った時点」からの無操作時間で計る。ヒットするたびタイマーがリセットされるので、エージェントがリクエストを投げ続けている限り5分TTLでも切れない。危ないのは、1回のツール実行が長引く・人の判断待ちで放置される・数十分おきに1回だけ叩く、といったリクエストの間隔がTTLを超える場面。

Geminiの明示キャッシュだけ仕様が違う。作成時点からの固定60分で、使い続けても延長されない。長時間セッションではTTLを長めに設定するか、更新APIで明示的に延ばす必要がある。

提供元 種別 標準TTL 起点 ヒットで延長 メモ
Anthropicプロンプトキャッシュ5分最終利用時点リセットttl:"1h"で1時間に延長可。ただし書き込みコストが2倍(通常1.25倍)になるので3回以上読まないと元が取れない。2026/3/6に既定値が1時間→5分へ変更された
OpenAIGPT-5.5以前無操作 5〜10分最終利用時点リセット「5〜10分の無操作で消える」+「最終利用から1時間が上限」の二段構え。GPT-5系/4.1はextended retentionで最大24時間
OpenAIGPT-5.6以降30分最終利用時点リセット最低30分は保持。旧世代より大幅に緩和された
Google暗黙(implicit)非公開自動判定自動Gemini 2.5以降で既定ON。設定不要
Google明示(explicit)60分作成時点延長されない他社と仕様が異なる唯一の例。ttl/expire_timeで任意指定でき、上限下限なし。作成後にTTLを更新するAPIあり
MiniMax自動キャッシュ5分最終利用時点無料で延長「設定不要」と明記されている
DeepSeekコンテキストキャッシュTTLなし――ディスクにキャッシュし、未使用分を数時間〜数日で削除。期限を意識しなくていい代わりに、保持を保証する手段もない
Moonshotコンテキストキャッシュ自動管理――システム側が自動最適化。TTL指定パラメータ自体が存在しない
Zhipuキャッシュ未確認――要調査キャッシュ入力の単価($0.26/1M)は公開されているが、期限の仕様が見つからない
該当なし

変更履歴 新しい順 / 詳細は docs/API料金_変更履歴.md

「昔いくらだったか」「いつからこの値段か」を残すための記録。値下げ方向が基本だが、導入価格は据え置かれることも倍になることもあるので、期限のあるものは控えておく。

2027-01-01
Google | Gemini 3.7 Flash が導入価格終了(予定)
$0.75 / $3.75 → $1.50 / $7.50 単価が倍になり、3.6 Flash と同額に並ぶ。
2026-11-21
OpenAI | GPT-5.6 Sol の促販が終了(予定)
$4.00 / $20.00 → $5.00 / $30.00 通常単価へ戻る。
2026-10-23
OpenAI | GPT Image 1 廃止(予定)
新規プロジェクトでの採用は避ける。GPT Image 2 へ移行する。
2026-09-24
OpenAI | Sora 2 のAPIが終了 — 前回までの「3/24に終了」は誤り
Sora 2 の API が本日 2026-09-24 で終了する。アプリ・Web は4/26に終了済みで、3/24 は開発者への告知日だった。前回までは3/24を終了日として載せていたので訂正した。
OpenAI は後継を示していない。動画の乗り換え先としては Veo 3.1(音声込み)、Kling、Hailuo、Seedance が挙がっている。データの書き出し期限は「条件付き」とされ、猶予は当てにしないほうがよい。
2026-09-22
OpenAI | GPT-6 Sol / GPT-6 Luna リリース — 半額の恒久価格
GPT-6 Sol (GPT-5.6 Sol $4 / $20) → $2.00 / $10.00(キャッシュ入力$0.20、書き込み$2.50)。
GPT-6 Luna (GPT-5.6 Luna $0.20 / $1.20) → $0.10 / $0.50(キャッシュ入力$0.01)。
どちらも促販ではなく恒久価格。モデルIDは gpt-6-sol と gpt-6-luna、コンテキスト1.05M・出力128K、272K超は入力2倍・出力1.5倍。Batch/Flexは半額、Fastは倍額。effortは none / low / medium / high / xhigh / max の6段階。
GPT-6 Astra は $10 / $50 のまま据え置き。GPT-5.6 系(Sol / Terra / Luna)は廃止の予定が出ていないので併売が続く。
性能は「賢さは同等、コストが半分」という位置づけで、DeepSWE と OSWorld では GPT-5.6 Sol のほうが最高点は上。AutomationBench では GPT-6 Sol(xhigh)が33.2%を1タスク約$0.27で出している。ChatGPT では Plus / Pro / Business / Enterprise / Education に順次、Free と Go は Luna をデスクトップアプリで使える。
公開日について:大半の報道は 9/22 だが、9/23 とする記事も1件あった。複数の一次寄りの報道(VentureBeat、MarkTechPost、digitalapplied)に合わせて 9/22 とした。
2026-09-22
Anthropic | Claude Opus 5.5 リリース — 20%値下げ、キャッシュは60%減
Opus 5 $5 / $25 → $4.00 / $20.00(-20%)。キャッシュ読み取り $0.50 → $0.20(-60%)、キャッシュ書き込み $6.25 → $5(-20%)。Batchで $2 / $10。
モデルID claude-opus-5-5、1Mコンテキスト、出力128K(Message Batches の beta では300K)、知識は2026/6まで。Fast モード(Claude API のみ・研究プレビュー)は約2.5倍の出力速度で価格は2倍。AWS・Google Cloud・Microsoft でも利用可。
Anthropic は「典型的な作業で約40%安い」と説明するが、この数字は Opus 5 の high と Opus 5.5 の medium(新しい既定)の比較で、モデルを替えるだけなら単価の20%減。
Terminal-Bench 4.0 は 66.4(Fable 5.1 は 55.8)、FrontierCode v1.1 Main は 54.4(同50.3)。一方 GPT-6 Astra には AutomationBench と Terminal-Bench-Science で及ばない。
移行時の注意(Opus 5 のコードがエラーになる箇所):思考をオフにできない(adaptive thinking が常時オン、effort で調整)/forced tool use がエラーになる/思考ブロックがモデルと会話の状態に紐づく/旧 computer-use ツールは拒否される。
Sonnet 5.5 と Haiku 5.5 は「数週間のうちに」出ると予告されている。
2026-09-22
Alibaba | Qwen 4 を発表(Yunqi 2026)— 価格・提供日はまだない
Qwen 4 Max(旗艦)、Qwen 4 Plus(中位)、Qwen 4 Flash(高スループット)、Qwen 4 27B(オープンウェイトの手元用)の4段構えがステージ上で予告された。
ただしモデルカード・APIの識別子・価格・提供日・スコアはいずれも未公表で、まだ学習中とされる。27B の重みは公開が約束されているのみ。表には入れていない。いま実際に使えるのは Qwen3.8-Max(8/3・$2/$6)と Qwen3.8 Flash(8/26・$0.14/$0.42)。
2026-09-21
xAI(SpaceXAI) | Grok 4.7 リリース — 4.6 と同額
$2 / $6(200K超は $4 / $12、キャッシュ入力$0.50 / $1)。4.6 から価格据え置き。コンテキスト500K、入力はテキストと画像・出力はテキスト、モデルID grok-4.7、推論は low〜xhigh の4段階。
新しい大きな基礎モデルで、数時間かかる作業向けの強化学習を長く回している。xAI 自己測定では DeepSWE v1.1 が71.0%、CursorBench 4.0 は46.3%(Fable 5.1 の51.8%に届かない)。
倍額の Fast 版(4.7 Fast)は Cursor と Grok Build 経由のみで、公開APIでは使えない。200Kを超えるとその時点で単価が倍になるため、長く続くコーディング作業では実額が大きく振れる。
2026-09-15
Google | Gemini 3.8 Live リリース — 音声対話がもう一段安く
モデルは gemini-3.8-live(大量の会話向け)と gemini-3.8-live-extended-thinking(複数段の推論つき)の2本。音声入力 $0.005 / 分・音声出力 $0.018 / 分で、1会話分あたり約2.3セント。
97言語に対応し会話の途中で切り替えられる、日本語も含む、とされる(二次情報)。最初の音声まで約1.18秒、視覚入力もほぼリアルタイム、バックグラウンドでツール呼び出しを回しながら会話を続けられる。全出力に SynthID の透かし。
未確認:extended-thinking 版の単価。また3.1 Flash Live と数字が完全に同じで、値上げ・値下げなしの世代交代なのか、二次情報が旧世代の数字を書いているのかは切り分けられていない。
2026-09-14
DeepSeek | V4 Pro の提供終了は撤回された — 前回の記載を訂正
9/10に告知されていた「9/14正午(北京時間)で V4 Pro を終了し、deepseek-v4-pro 宛のリクエストは V4.1-Flash が処理する」という措置は、実施前に撤回された。
DeepSeek は変更ログで「利用者の要望を受け、2026-09-14 以降も V4 Pro のAPI提供を継続する。課金方法も変更しない」と述べている。V4 Pro の単価は $0.66 / $1.98(オフピーク $0.66/$1.32・ピーク $1.98/$3.96)のまま据え置き。
前回9/13の更新時点では、撤回前の告知にもとづく記述を載せていた。今回それを訂正した。
なお別枠で廃止されたものがある。旧名 deepseek-v4-flash と deepseek-v4-flash-vision-exp は提供終了となり、これらへのリクエストは V4.1-Flash が処理してFlash単価で課金される。V4 Pro とは別の話なので混同しないこと。
2026-09-11
Sakana AI | Fugu Max / Fugu Ultra v2.0 リリース — 日本の会社が単価表に入った
Fugu Max $2.00 / $6.00、Fugu Ultra v2.0 $5.00 / $30.00(272Kトークンを超えると $10 / $45)。
この2つはひとつのモデルではなく、仕事を他社のモデルへ振り分けて、返ってきた答えをまとめ直す「オーケストレーター」。Max は払った金額あたりの結果を、Ultra v2.0 は手数の多い難問での正答を狙う。
Sakana は Fugu Max について、Sonnet 5 と Kimi K3 の出力単価を40〜60%下回ると説明している。
2026-09-10
OpenAI | GPT-Live-1 がAPIで使えるようになった — 表示は $0.05/分、実額はそれだけでは終わらない
$0.05 / 分(秒単位の課金、切り上げなし)。7/8にChatGPTアプリ側で先に公開されていたものが、9/10にAPIへ降りてきた。
中身は聞きながら話せる(全二重)方式で、途中で割り込んでも会話が続く。GPT-Realtime-2.1 比で Full Duplex Bench が30ポイント改善、応答の間合いは1.41秒→0.798秒、Tau3 Voice Intelligence のタスク成功率は45.7%→86.2%。
注意すべきは課金の範囲。① $0.05/分は「聞いて話す層」だけで、考える部分は GPT-6 Astra や GPT-5.6 Luna など別のモデルへ渡され、そのトークンが別料金になる。10分の通話でLunaなら約$0.51、Astraなら約$0.86。② 利用者が黙っている時間も、裏で処理している時間も、同じ単価で課金される。
エンドポイントは v1/live/sessions、コンテキスト128K(9割に達すると8,192トークンぶんの要約へ引き継ぐ)、指示文は16,384トークンまで、知識は2025-07-31まで。音声は12種だが、公開された一覧は英語圏(豪・英・愛・北米・米南部)とブラジルポルトガル語・フィリピン系で、日本語の記載はない。
mini はChatGPT無料プラン向けで、APIには mini がない。従来の gpt-realtime-2.1 は据え置きで併売(音声入力$32 / キャッシュ$0.40 / 出力$64 per 100万トークン)。
2026-09-10
DeepSeek | V4.1-Flash リリース
オフピーク $0.15 / $0.60、ピークはその倍の $0.30 / $1.20。キャッシュヒットは$0.003(ピーク$0.006)。
552B MoE で実働は入力8B・出力16B、画像入力に対応、ウェイトはMITライセンスで公開。
リリース時は「9/14からV4 Pro宛もこのモデルが処理する」と告知されたが、この措置は実施前に撤回された(下の9/14の項)。
2026-09-09
Zhipu | GLM-5.3-Flash の50%促販が終了 — 定価に戻った
$0.075 / $0.25 → $0.15 / $0.50 シンガポール時間 9/9 24:00 で終了。Z.ai の価格ページも定価表示に戻っている。
2026-09-08
OpenAI | GPT Image 2.5 リリース — Flare と Sunburst の2本立て
モデルIDは gpt-image-2.5-flare と gpt-image-2.5-sunburst。Flare は速さ重視の量産向け、Sunburst は編集の精度重視。単価は2本とも同じ。
公式はトークン課金で、テキスト入力$5.00 / 画像入力$8.00 / 画像出力$30.00(per 100万トークン)。キャッシュはテキスト$1.25、画像$2.00。
1枚あたりに直すと、再販経路の実売で 1K $0.25 / 2K $0.30 / 4K $0.60 あたり。生成と、参照画像の編集の両方に対応する。
2026-09-03
OpenAI | GPT-6 Astra リリース — 新しい最上位の段
$10.00 / $50.00(キャッシュ入力$1.00、書き込み$12.50)。コンテキスト1M、モデルID gpt-6-astra。Batch と Flex は半額、Fast モードは倍額。従来の最上位 GPT-5.6 Sol($5 / $30)の上に乗る形で、入力2倍・出力1.7倍。提供はサイバーセキュリティ企業向けの Daybreak から順次。
2026-09-02
Google | Gemini 3.8 Flash リリース — 同額で性能だけ上げた
$0.75 / $3.75。3.7 Flash と同額のまま、公開されたベンチマークすべてで上回った。導入価格は2026-12-31まで、2027-01-01に倍($1.50/$7.50)。Batch と Flex は半額、Priority は1.8倍。審査制の Cyber 版(Fairwind Program)も同日。
2026-09-02
Meta | Muse Spark 1.3 リリース
混合単価でおよそ $0.10。1.2 の $1.25 / $4.25 から大幅に下げてきた。入出力を分けた単価は未公表。
2026-09-01
Anthropic | Fable 5.1 / Mythos 5.1 — キャッシュを75%引き下げ
本体は $10 / $50 で据え置き。動いたのはキャッシュで、
読み取り $1.00 → $0.25(-75%)。書き込みは5分$12.50 / 1時間$20。Batchで$5/$25。
Fable 5.1 のキャッシュ読み取りは入力単価の 0.025倍。他のClaudeは一律0.1倍なので、この機種だけ別扱いになっている。
Terminal-Bench-Science は 52.6(Fable 5 は 24.7)。Mythos 5.1 は審査プログラム経由の限定公開。
2026-08-26
Zhipu | GLM-5.3-Flash リリース
定価 $0.15 / $0.50。2026-09-09 まで50%引きの $0.075 / $0.25。Intelligence Index 57、促販価格だと1タスク約$0.045。
2026-08-20
MiniMax | 音楽・歌詞APIの新規受付を停止
新規は申し込めなくなった。既存の有料利用者のみ継続可。無料API(music-3.0-free ほか)は廃止。新規は MiniMax Audio アプリか、Hugging Face のオープンウェイトへ誘導される。
直前の 8/13 に Music 3.0 をリリースし、ウェイトを公開したうえでの措置。
2026-08-24
Alibaba | Wan 3.0 リリース — 資料から動画を作る
$0.05 / $0.10 / $0.20 per秒(480p / 720p / 1080p)。2〜30秒。30秒1080pで$6、失敗した生成は課金されない。
Omni-Reference がこのモデルの目玉で、テキスト・画像・音声・動画に加えてドキュメント、表計算、スライド、PDF、Webページを入力として受け取り、そこから動画を組み立てる。8/6のパブリックβ以降、短編ドラマ・広告・観光PR・MV制作で実運用されている。
2026-08-21
DeepSeek | V4 Flash Vision(Experimental)リリース
画像入力に対応。料金は V4 Flash と同額(オフピーク $0.22 / $0.66)。コンテキスト1M、出力上限384,000トークン。
2026-08-16
DeepSeek | 値上げして時間帯別課金へ移行
16:00 UTC より、固定単価をやめてピーク/オフピークの2本立てに。
V4-Pro $0.435 / $0.87 → オフピーク $0.66 / $1.98、ピーク $1.32 / $3.96
V4-Flash $0.14 / $0.28 → オフピーク $0.22 / $0.66、ピーク $0.44 / $1.32
ピークは UTC 01:00–04:00 と 06:00–10:00(=日本時間 10:00–13:00 と 15:00–19:00)の計7時間。残り17時間がオフピークで、ピークの半額。
5月の75%値下げぶんを一部戻した形。これにより入力単価の最安は GPT-5.6 Luna($0.20)に移った。
2026-08-12
xAI | Grok 4.6 リリース
$2 / $6(200K超で $4/$12、キャッシュ入力$0.50)。4.5から価格据え置き。コンテキスト500K、知識は2026/2まで。推論の深さを4段階(low / medium / high / xhigh)から選べるようになった。Artificial Analysis指数61で、GPT-5.6 Sol と同点、Claude Fable 5 の1点差につけている。
2026-08-13
Google | Gemini 3.7 Flash リリース
導入価格 $0.75 / $3.75(2026-12-31まで)。1Mコンテキスト、出力上限64,000トークン、キャッシュ入力$0.075。3.6 Flash のわずか23日後の投入。
2026-08-12
Anthropic | Claude Opus 5 アップデート
推論速度と科学研究能力の改善。価格変更なし($5/$25)。
2026-08-12
ByteDance | Seedream 5.0 Pro リリース
画像生成+編集。$0.045(2.36MPまで)/ $0.09(超過)。参照画像は1枚目が無料、追加$0.003/枚。マルチ参照フュージョン対応。Lite版もあり。
2026-08-07
ByteDance | Seedance 2.5 の開発者API公開
モデル自体は7/31リリース。最長30秒を音声込みで一発生成、参照は画像30枚・動画10本・音声10本、タイムスタンプ単位の編集。BytePlusで5秒1080pが$2.843(約$0.57/秒)。公式APIのネイティブ出力は480p/720pまでで、リセラーの1080p・4Kはアップスケール。
2026-08-10
Anthropic | Claude Sonnet 5 の値上げが中止に
9/1から $3 / $15 へ50%値上げの予定だったが取り消され、$2 / $10 が恒久価格になった。これで中位帯は Terra・Sonnet 5・Gemini 3.1 Pro が入力$2で並んだ。
2026-07-31
MiniMax | H3(Hailuo 3.0)リリース
$0.13/秒(2K・1440p・24fps)。omni-modalで音声を同時生成。768pティアは価格表にあるがクローズドβ。
2026-07-30
OpenAI | 下位2ティアを値下げ
Luna $1.00 / $6.00 → $0.20 / $1.20(-80%)
Terra $2.50 / $15.00 → $2.00 / $12.00(-20%)
フラッグシップの Sol は据え置き。これで主流LLMの入力単価の下限が $0.20 になった。
2026-07-24
Anthropic | Claude Opus 5 リリース
$5 / $25。Opus 4.5 から5世代連続で同額据え置き。1Mコンテキスト、5段階の effort ダイヤル。
2026-07-21
Google | Gemini 3.6 Flash ほか3モデル同時リリース
3.6 Flash $1.50 / $7.50(3.5 Flash の出力 $9.00 から値下げ、出力トークンも17%削減)、3.5 Flash-Lite $0.30 / $2.50。このときも 3.5 Pro は出なかった。
2026-07-09
Meta | Muse Spark 1.1 リリース — 初の有料開発者API
$1.25 / $4.25、1Mコンテキスト、$20の無料クレジット。Meta Model API が米国開発者向けにパブリックプレビュー開始。「OpenAI/Anthropicの約25%」と説明されている。
2026-07-09
xAI | Grok 4.5 リリース
$2 / $6(200K超で $4/$12)。500Kコンテキスト。Opus級だが Batch割引の対象外。
2026-06-30
Google | Gemini Omni Flash リリース
テキスト・画像・動画を統合する world model 型。従量APIの単価は2026-08-25時点でも未公表。
2026-06-16
Zhipu | GLM-5.2 リリース
$1.40 / $4.40。744B MoE、1Mコンテキスト、キャッシュ入力$0.26。
2026-06-09
Anthropic | Claude Mythos 5 リリース — 半額以下へ
Mythos Preview $25 / $125 → Mythos 5 $10 / $50。公開版の Fable 5 も同額。
2026-05-22
DeepSeek | V4 Pro を約75%値下げ
$1.74 / $3.48 → $0.435 / $0.87、キャッシュ入力も1/10へ。「恒久的」とされたが、3ヶ月後の8/16に時間帯別課金へ移行して実質的に一部戻された。(値下げ日を5/31とする情報もある)
2026-03-15
Zhipu | GLM-5-Turbo リリース
$1.20 / $4.00。GLM-5.2 とは別系統の速度重視版。
2026-05
xAI | Grok 4 / Grok 3 系をまとめて退役
リクエストは現行モデルへリダイレクト。Grok 4($3/$15)、Grok 4.1 Fast($0.20/$0.50)はこの時点で消えた。以降の現行は 4.5 と 4.3。
2026-05-19
Google | I/O で Gemini Omni と 3.5 Pro を発表
Omni は6/30に Flash 版がリリースされたが、3.5 Pro は8/25時点でも未リリース。6月・7月中旬・8月初旬と3回目標を逃しており、モデルID・価格・日付いずれも未定。
2026-04-21
OpenAI | GPT Image 2 リリース
日本語テキストの再現度が高く、まとめ画像・インフォグラフィック用途で評価されている。
2026-03-24
OpenAI | Sora 2 の終了を告知(二段階で終了)
開発者へ告知。アプリ・Web は4/26に終了、API は9/24に終了という二段構え。動画生成の勢力図が Seedance・Veo・Kling へ移る契機になった。
訂正:この項目は以前「3/24 提供終了」と書いていた。3/24 は告知日で、終了日ではなかった。
2026-03-06
Anthropic | プロンプトキャッシュの既定TTLを短縮
1時間 → 5分。告知が目立たなかったため、これ以前の記事は1時間と書いてある。
2026-02-26
Google | Nano Banana 2 リリース
$0.067/1K画像。Nano Banana Pro の1/3の価格でPro級の品質、出力3〜5秒、4Kネイティブ。
2026-02-04
Kuaishou | Kling 3.0 リリース
ネイティブ4K・60fps・15秒・多言語リップシンク。6月中旬に Turbo 版を追加。
2026-02
ByteDance | Seedance 2.0 リリース
3/5に価格公表、約$0.14/秒。Artificial Analysis の動画ランキング首位に立った。