テキスト・画像・動画・音声・音楽の主要APIについて、単価とスペック、Batch割引とキャッシュの仕様をまとめたもの。列見出しをクリックすると並び替わる。値動きは末尾の変更履歴に残している。
直近の主な動き — 9/22の1日で、OpenAI と Anthropic が同時に値を下げた。 ① GPT-6 Sol(9/22)は $2/$10。GPT-5.6 Sol の販売中の価格($4/$20)のちょうど半額で、期間限定ではなく恒久価格。同時に出た GPT-6 Luna は $0.10/$0.50。 ② Claude Opus 5.5(9/22)は $4/$20(Opus 5 は $5/$25)。キャッシュ読み取りも $0.50→$0.20 に下がった。コーディング系の指標では、2.5倍の値段の Fable 5.1 を上回ると Anthropic は示している。 ③ Grok 4.7(9/21)は 4.6 と同額の $2/$6 のまま、土台のモデルを大きくした。 ④ Gemini 3.8 Live(9/15)が出た。音声の入出力が1分あたり $0.005 / $0.018で、GPT-Live-1($0.05/分)と比べるとかなり安い。ただし比べ方には注意が要る(音声の欄を参照)。 ⑤ Sora 2 のAPIは本日 9/24 で終了。前回までのページは「3/24に終了」と書いていたが、3/24 は終了の告知日で、アプリの終了は4/26、APIの終了が9/24だった。誤りだったので訂正した。 ⑥ Alibaba が Qwen 4 Max を発表(9/22)。ただし発表だけで、価格も提供日もないので表には入れていない。
最上位帯は「$10/$50 の高い段」と「$2〜$4 台の実用段」に分かれてきた。GPT-6 Astra と Fable 5.1 が $10/$50 で並ぶ一方、GPT-6 Sol・Opus 5.5・Grok 4.7・Sonnet 5 が $2〜$4 帯にひしめく。 9月前半は「上が上がる」動きだったが、下旬は中位の値下げが主役になった。なお Anthropic は Sonnet 5.5 と Haiku 5.5 も「数週間のうちに」出すと予告しているので、中位・軽量帯はもう一段動く可能性が高い。
DeepSeekのピーク時間は日本の日中と重なる。 ピークは 平日(月〜金)の UTC 01:00–04:00 と 06:00–10:00 = 日本時間 10:00–13:00 と 15:00–19:00(中国の祝日は除く)。 つまり普通に仕事をしている時間帯が倍額で、夜間バッチ(JST 20:00〜翌10:00)はまるごとオフピークに収まる。 まとめて処理するものは夜に回すと、そのまま半額になる。
出力トークンは入力の4〜6倍が相場。総額は出力量でほぼ決まるので、モデル選びの前に「どれだけ書かせるか」を見積もったほうが効く。ティアで並べると、各社の同格モデルが横並びになる。
| 提供元 | モデル | ティア | Input | Output | メモ |
|---|---|---|---|---|---|
| OpenAI | GPT-6 Astra | 最上位 | $10.00 | $50.00 | 9/3 最新新フラッグシップ。コンテキスト1M、キャッシュ入力$1.00、キャッシュ書き込み$12.50。Batch/Flexは半額、Fastモードは倍額。GPT-5.6 Solの上に乗る段で、入力2倍・出力1.7倍 |
| OpenAI | GPT-6 Sol | 中位 | $2.00 | $10.00 | 9/22 最新恒久価格Astra の下の段。GPT-5.6 Sol と全体的な賢さは同等で、値段は半分(5.6 Sol は $4/$20)。キャッシュ入力$0.20、書き込み$2.50。コンテキスト1.05M・出力128K、272K超は入力2倍・出力1.5倍。Batch/Flexは半額、Fastは倍額。effortは none〜max の6段階。ただし DeepSWE と OSWorld ではGPT-5.6 Sol のほうが最高点は上で、そのぶん1タスクあたりは高くつく。同額帯の Terra($2/$12)より出力が安く、Terra を選ぶ理由は薄くなった |
| OpenAI | GPT-6 Luna | 軽量 | $0.10 | $0.50 | 9/22 最新恒久価格GPT-5.6 Luna($0.20/$1.20)から入力半額・出力6割減。キャッシュ入力$0.01。通常提供のテキストモデルでは入力単価が最安クラス。コンテキスト1.05M。ChatGPT では Free と Go のユーザーがデスクトップアプリで使える |
| Anthropic | Claude Fable 5.1 | 最上位 | $10.00 | $50.00 | 9/1 最新本体は据え置き。キャッシュ読み取りが$1.00→$0.25へ75%引き下げ(入力の0.025倍。他のClaudeは0.1倍なのでこの機種だけ別扱い)。書き込みは5分$12.50/1時間$20。Batchで$5/$25 |
| Anthropic | Claude Mythos 5.1 | 最上位 | $10.00 | $50.00 | 限定公開Fable 5.1の制限付きアクセス版。審査プログラム経由 |
| Anthropic | Claude Fable 5 | 最上位(旧) | $10.00 | $50.00 | 5.1の一世代前。キャッシュ読み取りは$1.00のまま |
| Sakana AI | Fugu Ultra v2.0 | 最上位 | $5.00 / $10.00 | $30.00 / $45.00 | 9/11 最新★日本の会社(Sakana AI)。右は272Kトークン超過時。単体のモデルではなく、仕事を他社モデルへ振り分けて、返ってきた答えをまとめ直す「オーケストレーター」。手数の多い難問向け。コンテキスト1M |
| Sakana AI | Fugu Max | 中位 | $2.00 | $6.00 | 9/11 最新Ultra と同じ仕組みで、かけた金額あたりの結果を狙う側。Sakana は Sonnet 5 と Kimi K3 の出力単価を40〜60%下回ると説明している |
| OpenAI | GPT-5.6 Sol / GPT-5.5 | 上位(旧) | $5.00 / 促販$4.00 | $30.00 / 促販$20.00 | コンテキスト1M。廃止の予定は出ていない。促販価格($4/$20)は少なくとも 11/21 まで。GPT-6 Sol が半額で同等の賢さなので、新規に選ぶ理由は薄い |
| Anthropic | Claude Opus 5.5 | 最上位 | $4.00 | $20.00 | 9/22 最新5.5世代の第1弾。Opus 5 から20%値下げ、キャッシュ読み取り$0.50→$0.20、書き込み$6.25→$5。Batchで$2/$10。1Mコンテキスト・出力128K(Batch beta は300K)、モデルID claude-opus-5-5。Fable 5.1($10/$50)より安いのに、Terminal-Bench 4.0 で 66.4 対 55.8 と上回ると Anthropic は示す一方、GPT-6 Astra には一部の指標で及ばない。「実質40%減」は medium と high の比較を含んだ数字で、モデル差だけなら20%。移行注意思考をオフにできない/forced tool use がエラー/旧 computer-use ツールは拒否、とOpus 5 のコードがそのまま動かない箇所がある。Sonnet 5.5・Haiku 5.5 は「数週間以内」と予告 |
| Anthropic | Claude Opus 5 | 最上位(旧) | $5.00 | $25.00 | 1Mコンテキスト、5段階のeffortダイヤル。Opus 4.5から5世代連続で同額。8/12に推論速度を改善 |
| Moonshot | Kimi K3 | 最上位 | $3.00 / $0.30 | $15.00 | 右はキャッシュヒット時。コンテキスト1M。Batch非対応 |
| Gemini 3.1 Pro | 最上位 | $2.00 / $4.00 | $12.00 / $18.00 | 右は200Kトークン超過時。3.5 Proは3回延期され未リリースのため、これが現行Pro | |
| xAI | Grok 4.7 | 最上位 | $2.00 / $4.00 | $6.00 / $12.00 | 9/21 最新4.6 と同額。土台のモデルを大きくし、数時間かかる作業向けの強化学習を長く回した版。右は200K超のとき。キャッシュ入力$0.50(200K超$1)、コンテキスト500K、推論は low〜xhigh の4段階、モデルID grok-4.7。倍額の Fast 版は Cursor と Grok Build 経由のみで、公開APIにはない。xAI 自己測定の CursorBench 4.0 は 46.3 で Fable 5.1(51.8)に届かない。OpenRouter では9/22時点で$1.60/$4.80と定価より約2割安い |
| xAI | Grok 4.6 | 最上位(旧) | $2.00 / $4.00 | $6.00 / $12.00 | 8/124.5と同額。コンテキスト500K、キャッシュ入力$0.50、知識は2026/2まで。推論の深さを4段階(low/medium/high/xhigh)から選べる。Artificial Analysis指数61でGPT-5.6 Solと同点、Fable 5の1点差 |
| xAI | Grok 4.5 | 上位 | $2.00 / $4.00 | $6.00 / $12.00 | Opus級。200K超で倍。キャッシュ入力$0.50。Batch割引の対象外 |
| Zhipu | GLM-5.2 | 最上位 | $0.40 〜 $1.40 | $1.26 〜 $4.40 | 価格情報が割れている744B MoE、コンテキスト1M、キャッシュ入力$0.26。Z.ai一次情報系は $1.40/$4.40、OpenRouter等の集約系は $0.40/$1.26 と3倍以上の開きがある。実際に使う経路で要確認 |
| DeepSeek | DeepSeek V4 Pro | 最上位 | $0.66 / $1.32 | $1.98 / $3.96 | 8/16 値上げ左がオフピーク、右がピーク。旧: $0.435/$0.87 固定。5月の75%値下げぶんを一部戻した形。それでも最上位帯では安い部類。9/14に予定されていた提供終了は撤回され、単価も据え置きのまま継続 |
| OpenAI | GPT-5.6 Terra | 中位 | $2.00 | $12.00 | 7/30に20%値下げ($2.50/$15.00から) |
| Anthropic | Claude Sonnet 5 | 中位 | $2.00 | $10.00 | 値上げ中止9/1に$3/$15へ上がる予定だったが、8/10に$2/$10が恒久価格になった |
| Gemini 3.6 Flash | 中位 | $1.50 | $7.50 | 7/21リリース。3.7 Flashの導入価格が切れる2027/1/1に同額へ並ぶ | |
| Meta | Muse Spark 1.3 | 中位 | 約$0.10 混合 | 約$0.10 混合 | 9/2 最新入出力を分けた単価が未公表で、混合単価のみ公開。1.2($1.25/$4.25)から大幅に下げてきた |
| Meta | Muse Spark 1.2 | 中位(旧) | $1.25 | $4.25 | 1Mコンテキスト。学習利用を許可する契約者向けにさらに安い枠あり |
| xAI | Grok 4.3 | 中位 | $1.25 | $2.50 | 長文コスパ枠。コンテキスト500K〜1M。Batchで20%オフ |
| Gemini 3.8 Flash | 中位 | $0.75 | $3.75 | 9/2 最新2027/1/1に倍3.7 Flashと同額のまま全ベンチマークで上回った。導入価格は2026/12/31まで、以降$1.50/$7.50。Batch/Flexは半額、Priorityは1.8倍。審査制のCyber版もあり | |
| Gemini 3.7 Flash | 中位(旧) | $0.75 | $3.75 | 8/13リリース。3.8と同額なので、選ぶ理由は薄い | |
| Zhipu | GLM-5.3-Flash | 軽量 | $0.15 | $0.50 | 9/9 促販終了促販: $0.075 / $0.2550%引きの導入価格は2026-09-09 24:00(シンガポール時間)で終了し、定価に戻った。Intelligence Index 57 |
| Zhipu | GLM-5-Turbo | 中位 | $1.20 | $4.00 | 2026/3/15リリース。GLM-5.2 とは別系統の速度重視版 |
| Zhipu | GLM-4.6 | 中位 | $0.43 | $1.74 | 旧世代。200Kコンテキスト |
| MiniMax | MiniMax-M3 | 中位 | $0.30 | $1.20 | 「Permanent 50% off」適用後。入力512Kまで、キャッシュ読み取り$0.12 |
| Anthropic | Claude Haiku 4.5 | 軽量 | $1.00 | $5.00 | 軽量帯では割高な部類 |
| Gemini 3.5 Flash-Lite | 軽量 | $0.30 | $2.50 | 高スループット・低遅延向け | |
| OpenAI | GPT-5.6 Luna | 軽量(旧) | $0.20 | $1.20 | 7/30に80%値下げ($1.00/$6.00から)。9/22に GPT-6 Luna($0.10/$0.50)が出て、入力の最安はそちらへ移った。こちらも廃止予定はないが、新規に選ぶ理由は薄い |
| DeepSeek | DeepSeek V4.1-Flash | 軽量 | $0.15 / $0.30 | $0.60 / $1.20 | 9/10 最新左がオフピーク、右がピーク。モデルID deepseek-flash。552B MoE(実働は入力8B・出力16B)、画像入力に対応、ウェイトはMITライセンスで公開。キャッシュヒットは$0.003(ピーク$0.006)と極端に安い。旧名 deepseek-v4-flash と deepseek-v4-flash-vision-exp 宛のリクエストは、このモデルが処理してFlash単価で課金される(旧モデル自体は提供終了) |
| DeepSeek | DeepSeek V4 Flash | 軽量 | $0.22 / $0.44 | $0.66 / $1.32 | 8/16 値上げ左がオフピーク、右がピーク。旧: $0.14/$0.28 固定。自動キャッシュでInput $0.007(ピーク$0.014)まで下がる |
| DeepSeek | DeepSeek V4 Flash Vision | 軽量・実験 | $0.22 / $0.44 | $0.66 / $1.32 | 8/21Experimental扱い。画像入力に対応してV4 Flashと同額。コンテキスト1M、出力上限384,000トークン |
| DeepSeek | DeepSeek R1 | 推論特化 | $0.55 | $2.19 | キャッシュヒットでInput $0.14 |
日本語テキストを画像内に入れるなら GPT Image 2 か Nano Banana Pro。この2つは漢字が崩れにくいという評価が定着している。量が要るだけなら Nano Banana 2 が Pro の1/3。
| 提供元 | モデル | ティア | 料金 | メモ |
|---|---|---|---|---|
| OpenAI | GPT Image 2.5 (Flare / Sunburst) | 最上位 | $0.25 1K $0.30 2K $0.60 4K | 9/8 最新2本立てで、Flare は速さ重視の量産向け、Sunburst は編集の精度重視。単価は2本とも同じ。公式はトークン課金(テキスト入力$5.00 / 画像入力$8.00 / 画像出力$30.00 per 100万トークン、キャッシュは各$1.25・$2.00)で、左の1枚あたりは再販経路の実売。生成と参照画像の編集の両対応 |
| OpenAI | GPT Image 2 | 最上位 | $0.006 低 $0.053 中 $0.211 高 | Batch 50%1024×1024の場合。3840×2160の高品質は$0.401。横長・縦長は中〜高でやや安い($0.041/$0.165)。日本語の再現度が高い |
| Nano Banana Pro (Gemini 3 Pro Image) | 最上位 | $0.039 標準 $0.134 2K $0.24 4K | Batch 50%日本語テキストが崩れにくい。人物の写実性と文字レイヤリングが強い。画像生成系はキャッシュ非対応 | |
| ByteDance | Seedream 5.0 Pro | 中位 | $0.045 〜2.36MP $0.09 超過 | 8/12生成と編集の両対応、マルチ参照フュージョン。参照画像は1枚目が無料、追加$0.003/枚。BytePlus ModelArk のほか fal.ai・Replicate 等でも。Lite版もあり |
| Nano Banana 2 | 中位 | $0.067 1K | Pro級の品質をFlash級の速度で。出力3〜5秒、4Kネイティブ。Nano Banana Proの1/3 | |
| xAI | grok-imagine-image-quality | 中位 | $0.05 1K / $0.07 2K | Batch 50% |
| xAI | grok-imagine-image | 軽量 | $0.02 | Batch 50%1K。$0.01まで下がる |
| MiniMax | image-01 | 軽量 | $0.0035 | 最安。品質より量が要るとき |
| OpenAI | GPT Image 1 | 廃止予定 | $0.02 〜 $0.19 | 2026/10/23 廃止新規採用は避ける |
同じ会社でもティアで単価が10倍以上違う分野。ティア列で並べ替えると、Veo Lite / Fast / Standard のように散らばったものが各社の同格どうしで揃う。入れ替わりも速く、半年前の型番はもう無いことが多い。
| 提供元 | モデル | ティア | 解像度 | 料金 | メモ |
|---|---|---|---|---|---|
| ByteDance | Seedance 2.5 | 高品質 | 1080p(リセラー) | 約 $0.57 | 7/31・API 8/7BytePlusで5秒1080pが$2.843。公式APIのネイティブ出力は480p/720pまでで、1080p・4Kはリセラー側のアップスケール。最長30秒を音声込みで一発生成、参照は画像30枚・動画10本・音声10本、タイムスタンプ単位の編集が可能 |
| Veo 3.1 Standard | 高品質 | 音声込み | $0.40 | Vertex AI経由では$0.75/秒との情報もあり、提供経路で差が大きい | |
| Alibaba | Wan 3.0 | 高品質 | 1080p | $0.20 | 8/2430秒1080pで$6。失敗した生成は課金されない |
| MiniMax | H3 (Hailuo 3.0) | 高品質 | 2K(1440p) 24fps | $0.13 | 7/31omni-modal。5〜15秒、ステレオ音声を同時生成。入力に画像9枚・動画3本・音声3本まで参照可。1080pティアは存在しない。1分$7.80 |
| ByteDance | Seedance 2.0 | 高品質 | 公式 | 約 $0.14 | 品質1位46元/100万トークン課金。15秒 ≒ 308,880トークン。動画入力(編集)は28元/100万 |
| Luma AI | Ray 3 / Ray 3.2 | 高品質 | 1080p | 約 $0.21 〜 $0.24 | 80クレジット/秒。60秒で約$12.60 |
| Kuaishou | Kling 3.0 | 標準 | 720p / 1080p | $0.075 〜 $0.14 | 4K・60fps・15秒・多言語リップシンク。公式はクレジット制(音声なし6〜8、音声込み9〜12/秒)。6月中旬にTurbo版が追加 |
| Runway | Gen-4.5 | 標準 | 標準 | $0.12 | 12クレジット/秒。10秒で約$1.20 |
| MiniMax | H3(サードパーティ) | 標準 | 2K / 768p | $0.124 / $0.077 | AIHubMix等。公式よりやや安い。Segmindは逆に2K $0.1625と割高 |
| Alibaba | Wan 3.0 | 標準 | 720p | $0.10 | 8/24★Omni-Reference — テキスト・画像・音声・動画に加えてドキュメント・表計算・スライド・PDF・Webページを入力にして動画を作れる。2〜30秒、t2v/i2v/参照生成。8/6にパブリックβ、8/24に正式版。短編ドラマ・広告・観光PR・MVで実運用実績あり |
| Alibaba | Wan 2.7 | 標準 | text-to-video | $0.10 | 旧世代。Together AI等で提供 |
| Veo 3.1 Fast | 標準 | 標準 | $0.10 〜 $0.15 | ||
| ByteDance | Seedance 2.0 Fast | 標準 | 1080p | $0.09 | 「production品質で最安」との評価 |
| MiniMax | H3 (Hailuo 3.0) | 標準 | 768p | $0.08 〜 $0.09 | 実質使えない価格表にはあるがクローズドβの申込制。APIのresolutionは2Kしか受け付けず、指定しても2K料金で課金される |
| ByteDance | Seedance 2.0 | 軽量 | サードパーティ | $0.04 〜 $0.067 | OpenRouter $0.067、PoYo $0.04〜。公式APIの提供が限定的で実運用はここ経由が中心 |
| Luma AI | Ray 3 / Ray 3.2 | 軽量 | 720p | 約 $0.06 | 20クレジット/秒(Plusプラン換算) |
| xAI | Grok Imagine Video | 軽量 | 標準 | $0.05 | Batch 50%$0.025/秒。動画でBatch割引が明示されている唯一の例 |
| Alibaba | Wan 3.0 | 軽量 | 480p | $0.05 | 8/24Alibaba Cloud Model Studio。中国国内(北京)は0.30元/秒、シンガポールは0.37471元/秒 |
| Veo 3.1 Lite | 軽量 | 720p 音声なし | $0.03 〜 $0.08 | 動画では最安クラス。音声が要らないなら第一候補 | |
| Gemini Omni / Omni Flash | 不明 | ― | 未公表 | 料金待ち5/19のI/Oで発表、Omni Flashは6/30リリース。8/25時点でも公式pricingの動画欄はVeo 3.1系のみで、従量APIの単価が出ていない | |
| OpenAI | Sora 2 | 終了 | ― | 提供終了 | API 9/24 終了アプリ・Web は4/26に終了済み。API は 2026-09-24 で終了(3/24は開発者への告知日)。OpenAI は後継を示していない |
この分野は「分あたり」と「トークンあたり」が混在していて、そのままでは比べられない。 さらに GPT-Live-1 は音声の層だけの値段で、考える部分は別モデルへ渡してその分が別料金になる。表示された単価だけで見積もると足が出る。
| 提供元 | モデル | 料金 | メモ |
|---|---|---|---|
| OpenAI | GPT-Live-1 | $0.05 / 分 | 9/10 API公開聞きながら話せる(全二重)のが売り。秒単位で課金され、沈黙している時間も、裏で考えている時間も、同じ単価で課金される。別料金ありこれは音声の層だけで、推論は GPT-6 Astra や GPT-5.6 Luna など別モデルへ渡す。10分の通話で Luna なら約$0.51、Astra なら約$0.86。エンドポイントは v1/live/sessions、コンテキスト128K、知識は2025/7まで。音声は12種だが公開された一覧は英語圏とブラジルポルトガル語・フィリピン系で、日本語の記載はない。APIに mini はない(miniはChatGPT無料プラン向け) |
| OpenAI | gpt-realtime-2.1 | 音声入力 $32 / 出力 $64 per 100万トークン | GPT-Live-1 の登場後も据え置きで併売。キャッシュ入力$0.40。実測でおよそ$0.05/分。会話が長くなるほど入力が積み上がるので、10〜15分を超えると分あたりの実額は上がる |
| OpenAI | gpt-realtime-2.1-mini | 音声入力 $10 / 出力 $20 per 100万トークン | 実測でおよそ$0.016/分。同じ用途で3分の1近くまで落ちる |
| Gemini 3.8 Live | 音声入力 $0.005 / 分 音声出力 $0.018 / 分 | 9/15 最新音声を入れて音声で返すネイティブの音声対話モデル(文字起こしを挟まない)。モデルID gemini-3.8-live と、複数段の推論をする gemini-3.8-live-extended-thinking の2本。97言語に対応し、日本語も含むと紹介されている(二次情報。Google の一次資料では未確認)。最初の音声まで約1.18秒、映像もほぼリアルタイムで受けられ、生成音声すべてに SynthID の透かしが入る。要確認公開されている単価は通常版のもので、extended-thinking 版の単価は確認できていない。3.1 Flash Live と数字が同じなのは偶然か流用か未確認 | |
| Gemini 3.1 Flash Live | 音声入力 $0.005 / 分 音声出力 $0.018 / 分 | リアルタイム対話ではもっとも安い部類。同じ「音声出力100万トークン」で OpenAI が$64、Google は$12。ただし GPT-Live-1 の $0.05/分は「聞いて話す層」だけの値段で、考える部分は別料金。こちら(Google)は音声モデルの中で推論まで行う設計なので、表の数字どうしをそのまま並べて安い高いと言えない |
| 提供元 | モデル | 1,000文字あたり | メモ |
|---|---|---|---|
| ElevenLabs | Flash / Turbo | $0.05 | 0.5クレジット/文字換算で実質さらに割安 |
| MiniMax | Speech Turbo | $0.06 ($60/100万字) | |
| ElevenLabs | Multilingual v2 / v3 | $0.10 | 高品質 |
| MiniMax | Speech HD | $0.10 ($100/100万字) | |
| OpenAI | gpt-4o-mini-tts | 約 $0.015 / 分 | 判明文字数ではなくトークン課金(テキスト入力$0.60 / 音声出力$12.00 per 100万トークン)なので、1,000文字あたりに直すと文章によって振れる。分あたりではこの表でいちばん安い部類 |
| Cloud TTS(Standard / WaveNet) | $0.004 | 判明$4.00 / 100万文字。月400万文字まで無料枠。声の質は価格なり | |
| Cloud TTS(Neural2) | $0.016 | $16.00 / 100万文字 | |
| Cloud TTS(Chirp 3: HD) | $0.03 | $30.00 / 100万文字。Google側の高品質枠 | |
| Cloud TTS(Studio) | $0.16 | $160.00 / 100万文字。Standard の40倍。ナレーション用途の最上位 | |
| Gemini 3.1 Flash TTS | トークン課金 | テキスト入力 $1.00 / 音声出力 $20.00 per 100万トークン。無料枠あり、Batchで半額。文字数課金の Cloud TTS とは別系統なので、単純には比べられない |
この分野は従量APIを公式提供していない会社が多い。Sunoは公式APIがなくサードパーティ経由、UdioとStable Audioはサブスクのみ。
| 提供元 | モデル | 料金 | メモ |
|---|---|---|---|
| Suno | v4系 | $0.014 〜 $0.111 / 曲 | 公式APIなし。サードパーティ経由の実売。直販サブスクはPro $10/月〜 |
| Lyria 3 Pro | $0.05 〜 $0.15 / 曲 | MusicAPI経由、10クレジット/タスク。RealTime版はWebSocketストリーミング | |
| MiniMax | Music 3.0 / 2.6 | $0.15 / 5分まで | 8/20 新規受付停止いま新規には申し込めない。既存の有料利用者のみ継続可。無料枠(music-3.0-free等)は廃止。新規はMiniMax AudioアプリかHugging Faceのオープンウェイトへ誘導される。歌詞生成APIも同様。Music 3.0自体は8/13にウェイト公開済み |
| ElevenLabs | Music | $0.80 / 分 | |
| Udio | Standard / Pro | $10 〜 $30 / 月 | 従量課金APIなし |
| Stability AI | Stable Audio | $5.99 〜 $89.99 / 月 | 従量APIは要調査 |
Batch APIは大量のリクエストをまとめて非同期で投げ、24時間以内に結果を回収するかわりに安くなる仕組み。即時応答が要らない一括処理向け。プロンプトキャッシュは同じ長い前提部分を使い回して入力コストを削る仕組みで、両者は併用できる。
| 提供元 | Batch | Batch割引率 | キャッシュ | メモ |
|---|---|---|---|---|
| Anthropic | 対応 | 50%オフ | 90%オフ | 全アクティブモデルで対応。Batchとキャッシュを併用可 |
| OpenAI | 対応 | 50%オフ | 最大90% | GPT-4o以降。GPT-5.6以降はキャッシュ書き込みに1.25倍の追加料金。o3/o4-mini等はBatch側キャッシュ非対応 |
| 対応 | 50%オフ | 暗黙キャッシュ標準 | Gemini 2.5以降は暗黙キャッシュが自動適用。画像生成系はキャッシュ非対応。Batch内でもキャッシュ参照可 | |
| Zhipu | 対応 | 50%オフ | 対応 | GLMラインナップ全般で両方対応 |
| DeepSeek | 対応 | 約50%オフ | 自動 | BatchはSiliconCloud等のホスティング経由が中心。キャッシュは自動適用でオプトアウト不要 |
| xAI | モデル限定 | テキスト20% / 画像・動画50% | 対応 | テキストのBatch割引は Grok 4.3・4.20系のみで、Grok 4.5 は対象外。4.6・4.7 も割引の記載を確認できていない。画像・動画は別枠で一律50%オフ。1リクエスト最大25MB |
| Moonshot | 旧モデルのみ | 通常の60%の価格 | 対応 | BatchはK2.7 Code / K2.6 / K2.5が対象。最新のK3はBatch非対応 |
| MiniMax | 情報限定 | 非公開 | 自動 | キャッシュは設定不要で自動適用。Batchは存在が示唆されるが公式ドキュメントに割引率の記載なし |
| Meta | 要調査 | 未確認 | 要調査 | Model APIが7/9にパブリックプレビュー開始したばかりで、割引の枠組みが未整備とみられる |
ほぼ全社が「最後にキャッシュを使った時点」からの無操作時間で計る。ヒットするたびタイマーがリセットされるので、エージェントがリクエストを投げ続けている限り5分TTLでも切れない。危ないのは、1回のツール実行が長引く・人の判断待ちで放置される・数十分おきに1回だけ叩く、といったリクエストの間隔がTTLを超える場面。
Geminiの明示キャッシュだけ仕様が違う。作成時点からの固定60分で、使い続けても延長されない。長時間セッションではTTLを長めに設定するか、更新APIで明示的に延ばす必要がある。
| 提供元 | 種別 | 標準TTL | 起点 | ヒットで延長 | メモ |
|---|---|---|---|---|---|
| Anthropic | プロンプトキャッシュ | 5分 | 最終利用時点 | リセット | ttl:"1h"で1時間に延長可。ただし書き込みコストが2倍(通常1.25倍)になるので3回以上読まないと元が取れない。2026/3/6に既定値が1時間→5分へ変更された |
| OpenAI | GPT-5.5以前 | 無操作 5〜10分 | 最終利用時点 | リセット | 「5〜10分の無操作で消える」+「最終利用から1時間が上限」の二段構え。GPT-5系/4.1はextended retentionで最大24時間 |
| OpenAI | GPT-5.6以降 | 30分 | 最終利用時点 | リセット | 最低30分は保持。旧世代より大幅に緩和された |
| 暗黙(implicit) | 非公開 | 自動判定 | 自動 | Gemini 2.5以降で既定ON。設定不要 | |
| 明示(explicit) | 60分 | 作成時点 | 延長されない | 他社と仕様が異なる唯一の例。ttl/expire_timeで任意指定でき、上限下限なし。作成後にTTLを更新するAPIあり | |
| MiniMax | 自動キャッシュ | 5分 | 最終利用時点 | 無料で延長 | 「設定不要」と明記されている |
| DeepSeek | コンテキストキャッシュ | TTLなし | ― | ― | ディスクにキャッシュし、未使用分を数時間〜数日で削除。期限を意識しなくていい代わりに、保持を保証する手段もない |
| Moonshot | コンテキストキャッシュ | 自動管理 | ― | ― | システム側が自動最適化。TTL指定パラメータ自体が存在しない |
| Zhipu | キャッシュ | 未確認 | ― | ― | 要調査キャッシュ入力の単価($0.26/1M)は公開されているが、期限の仕様が見つからない |
「昔いくらだったか」「いつからこの値段か」を残すための記録。値下げ方向が基本だが、導入価格は据え置かれることも倍になることもあるので、期限のあるものは控えておく。
gpt-6-sol と gpt-6-luna、コンテキスト1.05M・出力128K、272K超は入力2倍・出力1.5倍。Batch/Flexは半額、Fastは倍額。effortは none / low / medium / high / xhigh / max の6段階。claude-opus-5-5、1Mコンテキスト、出力128K(Message Batches の beta では300K)、知識は2026/6まで。Fast モード(Claude API のみ・研究プレビュー)は約2.5倍の出力速度で価格は2倍。AWS・Google Cloud・Microsoft でも利用可。grok-4.7、推論は low〜xhigh の4段階。gemini-3.8-live(大量の会話向け)と gemini-3.8-live-extended-thinking(複数段の推論つき)の2本。音声入力 $0.005 / 分・音声出力 $0.018 / 分で、1会話分あたり約2.3セント。deepseek-v4-pro 宛のリクエストは V4.1-Flash が処理する」という措置は、実施前に撤回された。deepseek-v4-flash と deepseek-v4-flash-vision-exp は提供終了となり、これらへのリクエストは V4.1-Flash が処理してFlash単価で課金される。V4 Pro とは別の話なので混同しないこと。v1/live/sessions、コンテキスト128K(9割に達すると8,192トークンぶんの要約へ引き継ぐ)、指示文は16,384トークンまで、知識は2025-07-31まで。音声は12種だが、公開された一覧は英語圏(豪・英・愛・北米・米南部)とブラジルポルトガル語・フィリピン系で、日本語の記載はない。gpt-image-2.5-flare と gpt-image-2.5-sunburst。Flare は速さ重視の量産向け、Sunburst は編集の精度重視。単価は2本とも同じ。gpt-6-astra。Batch と Flex は半額、Fast モードは倍額。従来の最上位 GPT-5.6 Sol($5 / $30)の上に乗る形で、入力2倍・出力1.7倍。提供はサイバーセキュリティ企業向けの Daybreak から順次。music-3.0-free ほか)は廃止。新規は MiniMax Audio アプリか、Hugging Face のオープンウェイトへ誘導される。