大模型 API 价格与按量计费对照表

Claude / GPT / Gemini 等主流模型中转报价,按每百万 tokens 计费,含输入、输出与缓存读写单价。

按 token 计费,实际扣费 =(输入×单价 + 输出×单价 + 缓存读×单价 + 缓存写×单价)× 倍率。
模型单价为人民币(元 / 百万 tokens),缓存统一按 1 小时计价。

Gemini

Google 系列,长上下文

5 个模型

gemini-3.5-flash-lite

均衡流式长上下文
聚合/反代上下文 1 m
输入¥ 1.4
输出¥ 10
缓存读¥ 0
命中缓存¥ 0.15
缓存写(1h)¥ 0
缓存写(5m)
倍率1.00x
查看详情 →

gemini-3.6-flash

均衡流式
聚合/反代上下文 1 M
输入¥ 3
输出¥ 11
缓存读¥ 0
命中缓存¥ 1.3
缓存写(1h)¥ 0
缓存写(5m)
倍率1.00x
查看详情 →
Gemini 3.7 Flash特价限时特价

gemini-3.7-flash

均衡流式
聚合/反代上下文 1M
输入¥ 3.5
输出¥ 12
缓存读¥ 0
命中缓存¥ 0.9
缓存写(1h)¥ 0
缓存写(5m)
倍率1.00x
查看详情 →

gemini-3.5-flash

均衡流式
聚合/反代上下文 1 M
输入¥ 5.76
输出¥ 32
缓存读¥ 0
命中缓存¥ 1.2
缓存写(1h)¥ 0
缓存写(5m)
倍率1.00x
查看详情 →

gemini-3.1-pro-preview

长上下文流式
谷歌官方上下文 1000000
输入¥ 20
输出¥ 120
缓存读¥ 0
命中缓存¥ 3
缓存写(1h)¥ 200
缓存写(5m)¥ 60
倍率1.00x
查看详情 →