尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

2026 GPT、Claude、DeepSeek最新官方价格对比:100万Token多少钱?

2026 GPT、Claude、DeepSeek最新官方价格对比:100万Token多少钱? 调用 GPT、Claude、DeepSeek API 时一个很常见的问题就是100万 Token 到底多少钱这个问题不能只看一个数字因为大模型 API 通常会分别计算输入 Token、输出 Token 和缓存 Token同一个模型的输入和输出价格可能相差几倍不同模型之间的价格差距更大。本文根据2026 年 8 月 17 日 OpenAI、Anthropic、DeepSeek 官方 API 定价整理目前主要模型的 Token 价格并用一个实际场景算一下调用成本。本文只比较标准文本 API 的 Token 费用不包含 Web Search、图像、语音、区域处理等额外费用。一、GPT API价格100万Token多少钱OpenAI 当前 GPT-5.6 系列主要包括 GPT-5.6 Sol、Terra 和 Luna。在 Standard 模式、短上下文情况下官方价格如下模型100万输入Token100万缓存输入Token100万输出TokenGPT-5.6 Sol$5.00$0.50$30.00GPT-5.6 Terra$2.00$0.20$12.00GPT-5.6 Luna$0.20$0.02$1.20以上价格均以每百万 Token 计费。OpenAI 当前将 Sol 定位于复杂专业任务Terra 强调能力和成本之间的平衡Luna 则面向成本敏感和高调用量场景。如果只看普通输入模型100万输入TokenGPT-5.6 Sol$5.00GPT-5.6 Terra$2.00GPT-5.6 Luna$0.20如果看输出模型100万输出TokenGPT-5.6 Sol$30.00GPT-5.6 Terra$12.00GPT-5.6 Luna$1.20可以看到GPT-5.6 系列当前的输出价格都是普通输入价格的 6 倍。所以实际计算 API 成本时输出长度往往比很多人想象中更重要。二、Claude API价格100万Token多少钱Anthropic 当前主要 Claude 模型包括 Fable 5、Opus 5、Sonnet 5 和 Haiku 4.5。标准 API 价格如下模型100万输入Token100万缓存命中Token100万输出TokenClaude Fable 5$10.00$1.00$50.00Claude Opus 5$5.00$0.50$25.00Claude Sonnet 5$2.00$0.20$10.00Claude Haiku 4.5$1.00$0.10$5.00以上均为 Claude 官方第一方 API 标准价格。如果只看100万普通输入 Token模型费用Claude Fable 5$10.00Claude Opus 5$5.00Claude Sonnet 5$2.00Claude Haiku 4.5$1.00100万输出 Token则分别为模型费用Claude Fable 5$50.00Claude Opus 5$25.00Claude Sonnet 5$10.00Claude Haiku 4.5$5.00其中 Claude Sonnet 5 的$2 / $10原本属于阶段性价格但 Anthropic 已在 2026 年 8 月确认将其改为标准价格此前计划于 9 月上涨到$3 / $15的方案已经取消。三、DeepSeek API价格100万Token多少钱DeepSeek 当前主要 API 模型为deepseek-v4-flash deepseek-v4-pro截至 2026 年 8 月 17 日DeepSeek 官方已经采用峰谷定价。当前价格如下模型时段100万缓存命中输入100万缓存未命中输入100万输出DeepSeek V4 Flash空闲$0.007$0.22$0.66DeepSeek V4 Flash高峰$0.014$0.44$1.32DeepSeek V4 Pro空闲$0.022$0.66$1.98DeepSeek V4 Pro高峰$0.044$1.32$3.96DeepSeek 官方规定的高峰时间是 UTC01:00-04:00和06:00-10:00换算成北京时间就是9:00-12:00 和 14:00-18:00其他时间使用空闲价格。空闲价格为高峰价格的一半。因此只计算100万普通、未命中缓存的输入 Token模型空闲时段高峰时段DeepSeek V4 Flash$0.22$0.44DeepSeek V4 Pro$0.66$1.32100万输出 Token模型空闲时段高峰时段DeepSeek V4 Flash$0.66$1.32DeepSeek V4 Pro$1.98$3.96DeepSeek 官方当前还显示V4 Flash 和 V4 Pro 都支持 1M 上下文并支持 Responses API、Anthropic API 等接口。四、GPT、Claude、DeepSeek API价格放一起对比为了方便直接比较下面先不考虑缓存只看普通输入和输出 Token。模型100万输入Token100万输出TokenGPT-5.6 Sol$5.00$30.00GPT-5.6 Terra$2.00$12.00GPT-5.6 Luna$0.20$1.20Claude Fable 5$10.00$50.00Claude Opus 5$5.00$25.00Claude Sonnet 5$2.00$10.00Claude Haiku 4.5$1.00$5.00DeepSeek V4 Flash 空闲$0.22$0.66DeepSeek V4 Flash 高峰$0.44$1.32DeepSeek V4 Pro 空闲$0.66$1.98DeepSeek V4 Pro 高峰$1.32$3.96GPT 价格来自 OpenAI 官方价格页Claude 来自 Anthropic 官方价格页DeepSeek 则按照当前峰谷价格计算。如果只比较每百万 Token 的标价GPT-5.6 Luna 和 DeepSeek V4 Flash 都处于当前较低的价格区间。但这里需要注意价格表只能说明相同数量的计费Token分别多少钱不能直接说明完成同一个任务谁一定更便宜。五、100万输入 20万输出实际多少钱单纯比较100万输入或者100万输出并不是特别符合实际使用。假设某个业务累计产生Token类型数量输入Token100万输出Token20万暂时不考虑缓存、工具调用等额外费用。按照当前标准价格计算模型100万输入20万输出合计GPT-5.6 Sol$5.00$6.00$11.00GPT-5.6 Terra$2.00$2.40$4.40GPT-5.6 Luna$0.20$0.24$0.44Claude Fable 5$10.00$10.00$20.00Claude Opus 5$5.00$5.00$10.00Claude Sonnet 5$2.00$2.00$4.00Claude Haiku 4.5$1.00$1.00$2.00DeepSeek V4 Flash 空闲$0.22$0.132$0.352DeepSeek V4 Flash 高峰$0.44$0.264$0.704DeepSeek V4 Pro 空闲$0.66$0.396$1.056DeepSeek V4 Pro 高峰$1.32$0.792$2.112计算方式就是总费用 输入Token数量 × 输入单价 输出Token数量 × 输出单价这张表更适合回答如果我的业务已经知道输入、输出Token规模大概需要准备多少API预算但它仍然只是理论成本。六、同样一段文本不一定产生同样数量的Token这一点在跨模型比价时很容易忽略。“100万 Token”是统一的计费数量单位但并不意味着把完全相同的一批文本分别提交给不同模型最后一定都会得到完全相同的 Token 数。Anthropic 例如明确说明Claude 4.7 及之后的模型采用了新的 Tokenizer同样文本大约会产生更多 Token具体差距根据内容和任务而变化。因此GPT$2 / 百万输入Token Claude$2 / 百万输入Token只能说明两者的每百万Token标价相同。不能直接推导成同一份文档调用一次一定花一样多的钱真实业务最好直接读取不同模型 API 返回的实际 Token Usage再计算成本。七、缓存价格也不能只看“Cache Hit”长对话、RAG、代码仓库分析和 Agent 场景中很多请求会重复发送 System Prompt、工具定义或者大段上下文。这时候缓存可能明显降低成本。例如模型普通输入缓存命中输入GPT-5.6 Sol$5.00$0.50GPT-5.6 Terra$2.00$0.20GPT-5.6 Luna$0.20$0.02Claude Sonnet 5$2.00$0.20Claude Haiku 4.5$1.00$0.10DeepSeek V4 Flash 空闲$0.22$0.007DeepSeek V4 Pro 空闲$0.66$0.022不过这里不能简单理解成打开缓存以后所有输入都会自动按照缓存命中价收费。OpenAI GPT-5.6 当前缓存写入按照普通输入价格的 1.25 倍收费例如 Terra 短上下文普通输入为$2 / MTokCache Write 为$2.50 / MTok。Claude 同样区分缓存写入和缓存命中。以 Claude Sonnet 5 为例类型100万Token价格普通输入$2.005分钟缓存写入$2.501小时缓存写入$4.00缓存命中$0.20所以判断缓存到底能不能省钱需要看缓存写入成本 后续命中次数 每次命中的Token数量同一段长上下文复用次数越多缓存的价值通常越明显。八、长上下文也可能改变API价格GPT-5.6 还有一项容易漏掉的价格规则。当单次请求的输入超过272K Token时GPT-5.6 Sol、Terra、Luna 会对整个请求按照长上下文价格收费输入价格变为普通价格的2倍输出价格变为1.5倍。对应价格如下模型短上下文输入长上下文输入短上下文输出长上下文输出GPT-5.6 Sol$5$10$30$45GPT-5.6 Terra$2$4$12$18GPT-5.6 Luna$0.20$0.40$1.20$1.80Claude 当前的规则不同。Anthropic 官方说明Claude 4.6 及之后的模型在完整 1M 上下文范围内仍然使用标准 Token 单价不额外收取长上下文溢价。所以如果业务涉及几十万 Token 的长文档、代码仓库或者大型 RAG 上下文不能只看首页展示的普通 Token 单价。九、为什么最便宜的模型不一定让业务成本最低假设模型 A单次调用成本$0.01 平均完成任务需要5次那么完成一次任务需要$0.05模型 B单次调用成本$0.03 平均完成任务需要1次最终只需要$0.03模型 A 每次调用明明更便宜实际完成任务却更贵。因此在生产环境里最终应该比较的不是每调用一次多少钱而是成功完成一次业务任务多少钱这也是为什么不能只根据价格表判断一个模型是不是“更省钱”。十、实际做API成本测试建议记录哪些数据如果只是刚开始调用 API看官方价格表基本够用。当调用规模增加以后建议至少记录指标主要用途平均输入Token判断Prompt和上下文成本平均输出Token判断生成成本缓存命中Token判断缓存收益平均调用次数判断一个任务需要请求多少次重试率判断失败请求浪费多少成本任务成功率判断模型输出是否真正可用单任务成本判断最终业务成本其中最值得关注的是单任务成本 这一类任务产生的全部API费用 ÷ 成功完成的任务数量例如客服业务可以看“成功解决一次用户问题花多少钱”代码 Agent 可以看“成功完成一次开发任务花多少钱”。这通常比“100万 Token 单价”更接近真实业务价值。十一、GPT、Claude、DeepSeek怎么比较更合理如果只是做第一轮模型筛选可以先通过官方 Token 价格确定一个自己能够接受的成本范围。但真正上线之前不建议直接根据“最便宜”或者“最贵”决定模型。更合理的方法是准备同一批真实业务样本让几个候选模型完成相同任务然后统一比较维度需要观察什么任务质量结果能不能直接使用成功率一次完成任务的比例Token消耗实际输入和输出多少响应速度是否满足线上需求重试次数是否频繁需要重新调用单任务成本最终完成一次任务多少钱这样得到的结果才是真正属于自己业务的 API 成本对比。总结截至2026 年 8 月 17 日GPT、Claude、DeepSeek 的官方 API Token 价格差异比较明显。如果只想知道100万 Token 多少钱首先至少需要区分类型为什么要区分输入Token每个模型基础输入价格不同输出Token通常明显贵于输入缓存Token命中后价格可能明显下降Cache Write部分服务写入缓存也会收费长上下文部分模型会使用更高单价所以“100万 Token”本身并不是一个完整的 API 成本答案。价格表能告诉我们100万计费Token理论上需要多少钱。真正决定生产环境账单的则是一个真实任务到底消耗多少Token、需要调用几次以及最终能不能成功完成。如果调用量已经比较大比单纯追求“每百万 Token 最低价”更值得做的是记录实际 Token Usage、缓存命中率、失败重试率和单任务成本再根据自己的业务数据决定最终使用哪个模型。
返回列表