尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

深度 | DeepSeek 宣布大幅涨价:「超廉价 AI 时代」的第一道裂缝 — 深度分析

深度 | DeepSeek 宣布大幅涨价:「超廉价 AI 时代」的第一道裂缝 — 深度分析 # DeepSeek 宣布大幅涨价「超廉价 AI 时代」的第一道裂缝 — 深度分析这是一篇深度研究不是新闻简报。基于 40 个来源的交叉验证。一、价格战最锋利的那把刀自己要收手了2026 年 8 月 6 日DeepSeek 在开发者平台贴出一则不到 30 字的公告「计划近期整体上调 DeepSeek API 服务的定价预计涨幅较大具体方案以正式通知为准。」[A] 没有幅度、没有时间表、没有分模型价格。但这条公告的价值恰恰在于它什么都没说——它是过去两年全球 AI 价格战里最昂贵的一个信号。过去一年DeepSeek 就是「超廉价」这个词本身。V4-Flash 把 API 打到每百万 token 输入 0.14 美元、输出 0.28 美元缓存命中输入只要 0.0028 美元按任务折算一个标准基准任务成本约 0.03 美元只有 Claude Fable 5 的约 1/105。[B] 这个价格不只是便宜它是整个市场的价格地基OpenRouter 周榜上 V4-Flash 连续两周登顶中国模型合计占全球调用量的 63.5%全球每天数以万亿计的 token 流过 DeepSeek 的服务器。现在这把最锋利的刀要自己收手。媒体用「超廉价 AI 时代出现裂痕」「告别价格屠夫」定调券商把它写成利好。这件事在四个维度同时反转了我们熟悉的叙事对开发者它是账单对同行它是「斩杀线」上移对资本市场它是 IPO 前奏对中美 AI 竞争它是「death zone」叙事的第一次松动。本文想回答三个问题DeepSeek 凭什么便宜、为什么偏偏是现在涨价、以及这一刀下去价格战是真的要结束了还是换了一种打法继续。二、技术拆解便宜不是靠亏损是靠工程2.1 把 1.6T 参数的推理成本压到极限DeepSeek 的便宜建立在两代 V4 架构上。V4-Pro 是 1.6T 总参/49B 激活的 MoE61 层、384 个 routed expert 1 个 shared expertV4-Flash 是 284B 总参/13B 激活。[A] 稀疏激活意味着每次前向只计算几十亿参数这是成本的天花板。真正拉开差距的是注意力与量化设计混合注意力CSA HCACSA 以 4:1 压缩 滑动窗口 Lightning Indexer 维护全局索引HCA 做 128:1 稠密压缩。相比 V3.21M 上下文下 Flash 只需 10% 的 FLOPs、7% 的 KV cachePro 只需 27% FLOPs、10% KV。KV cache 效率V4 全 1M 上下文约 5.48GB HBM同期竞品普遍超过 60GB。FP4 专家权重量化 FP8 其余权重直接以 4-bit 存储serve 时免反量化。DSpark 推测解码北大与 DeepSeek 2026-06-27 开源MIT半自回归并行 draft 置信度调度验证长度单用户生成速度 60%~85%120 tok/s 的 SLA 下吞吐 661%。这些不是实验室指标而是已经在 V4-Flash/Pro 预览 serving 里跑了一个多月的东西。换句话说DeepSeek 的「超廉价」是算法工程把 token 成本砍出来的不是母公司掏钱补贴出来的。2.2 定价史一部主动降价史上图DeepSeek 2024-2026 定价节点——连续降价两年后2026 年 5 月还逆市永久降价 75%8 月转向看这张时间线就知道这则公告有多反常。2026 年 5 月 22 日DeepSeek 还把 V4-Pro 原价 $1.74/$3.48 永久砍掉 75% 到 $0.435/$0.877 月中旬给 API 加上峰谷定价高峰时段翻倍7 月 31 日把 V4-Flash 正式版连同 MIT 权重一起开源8 月 3 日上线国家超算互联网。[A] 每一步都在「更便宜、更开放」的方向上加码直到 8 月 4 日官方 API 出现大面积 503 之后风向突然变了。这里补一个容易误导读者的注脚所谓「硅基流动缓存价上调 10 倍」实际是 6 月 30 日 V4-Pro 限时折扣到期、缓存价从促销期约 1/20 恢复到 ¥0.1/M机制是「折扣到期」而非 8 月 3 日的单日动作。2.3 「斩杀线」一张图杀死 70% 的模型业界对 DeepSeek 价格的通用分析框架是「斩杀线」以单任务成本为横轴、能力指数为纵轴V4-Flash 的成本曲线把约 70% 的在榜模型划进了「斩杀区」若把低推理强度的旗舰也计入这个比例接近 90%。[B] 36氪与 LA Times 先后用这个框架论证OpenAI 在 V4-Flash 发布前夜紧急给 GPT-5.6 Luna 降价 80%正是为了不被这条线杀死。所以 DeepSeek 涨价不只是自己的事。它移动的是整个价格体系的锚点——锚点一上移锚在它身上的所有定价都要跟着松动。三、为什么是现在涨价的三重逻辑上图涨价的三重逻辑——需求挤兑是触发点毛利是基本面1GW 基建与 IPO 是结构动因3.1 需求海啸单日 8 万亿 token涨价前夜的供需关系已经绷到极限。OpenCode 披露 8 月 1 日单日消耗 V4-Flash 约 8 万亿 token5 万亿免费额度 3 万亿付费超过 OpenRouter 全平台日均约 6.6 万亿Vercel 周处理量约 5.3 万亿为其平台单模型峰值。[B] 6 月 10 日到 8 月 4 日累计 90 万亿 token总账单却只有约 92 万美元——平均 1 亿美元 token 只产生约 1 美元的账单96% 输入走缓存命中。8 月 4 日官方 API 出现 503DeepSeek 建议用户临时改用别家。需求的放大器是编码 Agent单会话数千万 token 的 Agent 负载是对话场景的几十到上百倍。3.2 毛利现实理论 545%实际可能是负数2025 年 3 月 DeepSeek 官方披露 V3/R1 的理论成本利润率高达 545%但这个数字饱含免费网页与 App 流量、夜间折扣独立分析估算其实际混合 API 毛利率只有约 12%。到 2026 年多家分析认为 V4-Flash 现行价已低于真实成本。创始人梁文锋在 7 月的投资人会上给出过一个更直白的定价模型按「买服务器约 10 个月收回设备成本」定价对应约 6 倍利润、年化约 120%同时他自述「当前价格区间需求几乎无弹性价格翻倍 token 消耗量变化不大」。[B]这句话是理解整件事的钥匙。如果需求真的无弹性那么涨价不丢量纯粹是利润——这在商业上太诱人了几乎注定会发生。智谱已经验证过这条路2026 年一季度提价 83%调用量不降反增 400%。3.3 结构动因1GW 数据中心与科创板 IPO需求是导火索但真正的扳机是资本开支。彭博报道 DeepSeek 拟在乌兰察布建设约 1GW 算力自建 租赁并行首批 2027 年底至 2028 年初上线尚未经公司官方确认黄仁勋估算 1GW AI 数据中心需约 500 亿美元。[B] 乌兰察布地处蒙西电网全国唯一的省级独立电网绿电直连电价可低至 0.28 元/度1GW 项目每年省约 5 亿元电费当地已出台「Token 之都」三年行动计划。这是几十亿美元级别的重资产故事需要真金白银。资金结构也在同步铺开。首轮融资 2026 年 6 月交割约 500-510 亿元梁文锋个人约 200 亿、腾讯约 100 亿、宁德时代约 50 亿网易/京东/IDG 各约 30 亿国家人工智能产业投资基金约 10 亿投后约 3500 亿元二轮融资 8 月 5 日重启拟募约 500 亿元、投前约 5000 亿元约 660-740 亿美元较首轮投后上涨约 43%。[B] IPO 目标明确为 A 股科创板走 6 月 17 日新发布的第五套标准免盈利要求2026 年底至 2027 年初申报、2027 年挂牌。一家年化收入约 5 亿美元的公司在上市前需要的不只是收入是健康的现金流曲线——「涨价把调用量转为收入」是这盘棋的明牌。四、竞争格局价格战见顶了吗4.1 美国巨头沉默但早就开始防守截至 8 月 7 日OpenAI、Anthropic、Google 均未对 DeepSeek 涨价发表任何官方回应。[A] 可查的只有涨价前一周的防御动作OpenAI 7 月 30 日把 GPT-5.6 Luna 砍价 80% 到 $0.20/$1.20、Terra 降 20%Anthropic 走「同价加能力」路线Claude 5.0 维持 Opus 4.8 定价。编辑评论说「DeepSeek 每涨一分都是竞品可以低一分的空间」但这只是单来源推测。更深一层看美国旗舰的定价结构并未被 DeepSeek 的涨价撼动。Fable 5$10/$50、Sol$5/$30与 V4-Flash 之间依然隔着 20-105 倍的价差这个「死亡区」的锚点即使上移也远够不到美国旗舰——它们死在地板上不是死在 DeepSeek 的报价单里。4.2 中国同行DeepSeek 是最后一个涨价的把镜头拉回国内会发现一个反直觉的事实DeepSeek 是 2026 年国产大模型里最后一个宣布涨价的。智谱年内三次提价、GLM-5.2 输入 $1.4/输出 $4.4月之暗面 Kimi K3 定价较前代 K2.6 输入涨约 3 倍、输出涨约 4 倍上线 48 小时暂停 C 端订阅腾讯云两次提价阿里云、百度、MiniMax 上半年都上调过算力价格。[B] 大摩把 K3 定价定性为「国内定价回归的正面信号」高盛称之为「中国模型走向定价权新节点」。更值得注意的信号是开源收费阿里宣布将对 Qwen3.8-Max 的大规模商用用户收取收入分成——这是阿里首次向开源用户收费月之暗面 Kimi K3 的商用协议也设了「年销售额超 2000 万美元后最高 30% 分成」的门槛。[B] 开源权重不再是纯免费获客工具而是商业化漏斗的入口。4.3 一张表看价格-能力结构模型输入/输出$/M token单任务成本关键基准定位DeepSeek V4-Flash0.14 / 0.28~0.03SWE-bench Verified 79.0斩杀线锚点DeepSeek V4-Pro0.435 / 0.87—SWE-bench Verified 80.6近旗舰性价比GPT-5.6 Luna0.20 / 1.20—AA 指数 51OpenAI 快/廉档GPT-5.6 Sol5 / 301.86SWE-bench Pro ~64.6美国旗舰推理Claude Fable 510 / 503.15SWE-bench Verified 95.0超高端旗舰Claude Sonnet 52 / 10——企业中端8/31 后 3/15Gemini 3.6 Flash1.50 / 7.50—SWE-Bench Pro 58.7Google 预算档Qwen3.8-Max2 / 6—AA Agentic 指数 56开源旗舰权重 8/10Kimi K33 / 150.86FrontierSWE 81.2开源前沿2.8T MoE注基准均为厂商或 Artificial Analysis 自报口径未经独立审计价格截至 2026-08-07。4.4 券商与分析师价格战进入尾声高盛 7 月研报已预判DeepSeek 高峰涨价标志「价格战进入尾声」主因是需求旺盛、算力趋紧而非需求走弱——竞争正从价格转向成本控制、算力效率与商业化。[B] 摩根大通则下调智谱目标价 33%认为「单一模型的 SOTA 领先不再支撑估值」前沿模型的 SOTA 窗口已缩短到 1-2 周。国内开源证券直接把 DeepSeek 涨价写成《国产 Token 链核心受益》的看多逻辑。市场共识正在从「谁的 token 便宜」转向「谁的生意能持续」。五、生态影响谁在裸泳5.1 编码 Agent依赖最深的用户群DeepSeek 的需求主力是编码 Agent而非聊天。OpenClaw 把 V4-Flash 设成了默认模型Cline 给 V4-Flash 免费额度后看账单便宜直接翻了 3 倍Nous Portal 做过一周 90% 折扣促销。[B] 这些免费额度业务建立在「DeepSeek 永远便宜」的假设上涨价直接威胁它们的商业模式——LINUX DO 上已经有帖子在问 OpenCode Go 会不会把涨幅转嫁给用户。从「吸引」到「收割」社区对这段情绪转折的概括很直接。5.2 开源对冲真实存在但不是免费午餐很多人会说「权重都 MIT 开源了涨价就自部署」。这话对了一半。V4-Flash-0731 权重确实 MIT 开源约 160GBFP4/FP8vLLM ≥0.9 与 SGLang ≥0.4 均官方支持最小可跑 1×H100 80GB INT4约 5% 质量损失。但自托管的盈亏平衡点是残酷的相对官方 API单张 H100 需要约每月 57 亿 token 才打平且要求 60%-70% 以上的 GPU 利用率、外加一名推理工程师隐性成本是裸算力的 3-5 倍。[B] 结论很清晰开源是合规与战略对冲不是大多数团队的省钱通道。真正接得住这块需求的是头部云厂商与第三方托管商——同一个 V4-Flash 权重在不同平台的价格差异可达 4.8 倍。上图涨价的传导路径——免费额度与第三方最先承压企业自部署对冲但总 token 量大概率受影响有限5.3 数字背后的两个澄清报道里流传最广的两个数字需要校准。其一「中国模型占全球 63.5% 调用量」是 OpenRouter 单一平台的份额截至 7/26 前 28 天不是全球全量口径其二「DeepSeek 日调用 8 万亿 token」是 OpenCode 单平台 8 月 1 日的数字不是 DeepSeek 的全球总量。[B] 两个数字的方向都对——中国模型的 token 份额确实领先、DeepSeek 确实是单模型顶流——但精度不足会让读者高估垄断程度进而高估涨价的杀伤力。还有一个反直觉的消费者数据DeepSeek App 的 MAU 约 1.3 亿但同比下滑 20.3%是头部 AI 应用里唯一下滑的一家。也就是说消费端早已饱和增长引擎在 API 与 Agent 侧——这次涨价瞄准的恰恰是还在增长的半边。5.4 社区情绪理解但焦虑知乎与开发社区的共识是「理解但焦虑」。知名博主「数字生命卡兹克」的话很有代表性「理智告诉我训练贵推理也贵涨价完全合理。但是感情告诉我你小子浓眉大眼的怎么也叛变了。」涨幅敏感度明显分化个人用户阈值低——「翻一倍可以接受超过一倍我就走了」Agent 开发者相对宽容——「翻倍都能接受毕竟比别家还是骨折价」企业级客户多用私有部署对 API 涨价基本不敏感。[B] 主流建议不是迁出而是「多模型路由 留 fallback」简单任务走 V4-Flash复杂推理走 V4-Pro 或 Kimi K3特定场景用 GPT/Claude。5.5 涨价叠在一场「算力自主」运动上这场涨价还有一层多数英文报道看不到的背景。DeepSeek-V4 的推理端据称 100% 跑在华为昇腾 950PR 上底层代码从 CUDA 全面迁移到华为 CANN被称为「全球首个脱离 CUDA 生态的顶级大模型」V4-Flash 正式版 8 月 3 日上线国家超算互联网依托「万卡国产异构超集群」平台已有约 120 万注册用户、210 万 CPU 核、21 万张 GPU 卡、30 多个接入中心。[B] 中央政治局专题学习敦促科技企业改用国产芯片北京/上海/贵安设了 2027 年芯片自给率硬目标北京 100%、上海 70%、贵安 90%美国实体清单则已拖延约 8 个月未公布。[B]这意味着 DeepSeek 的涨价不只是商业决策它发生在「国产算力替代」的政策窗口上。涨价把推理成本从「算法工程降本」推向「算力与电价的物理层决定」——而物理层的电力和芯片恰好是政策最想扶持、也最有定价权的两个环节。对国内企业来说国家超算互联网提供了官方 API 之外一个「便宜算力」出口这层缓冲是全球开发者没有的。[D]六、我的评估先下结论这不是价格战的终结而是价格战换了一个锚点继续打。DeepSeek 的涨价移动的是「斩杀线」的位置不是「10 倍级价差」这个结构。V4-Flash 就算涨 100%-200%仍比美国旗舰便宜 10 倍以上涨 400%价差才收窄到「2 倍级」那才是美国厂商真正松一口气的时候。我判断未来 12 个月有三个观察点。第一涨幅落到多少——100%-200% 是温和洗流量300% 让毛利回到 30%-40% 并清理低价值流量超过 400% 则把「超廉价」的王座让给别人Qwen 和 Kimi 早就想抢这张椅子。第二开源权重的对冲会不会被「商用收费」抵消——如果开源收费阿里的收入分成、Kimi 的分成门槛成为行业惯例自部署的吸引力会打折扣这是比 API 涨价更深的商业转向。第三DeepSeek 会不会用 V4-Pro 正式版做一个「能力 价格」双新台阶——把涨价包装成旗舰升级是这次转向里风险较小的路径。我原以为这轮价格战的终点是「模型厂商相互挤死对方」研究完才发现真正被算清楚的账只有一笔当需求几乎无弹性、成本又在快速下降SemiAnalysis 测算 Blackwell 一代硬件就把单 token 成本砍掉 57%时涨价的本质不是成本上涨而是稀缺定价与价格发现。硬件和软件成本都在跌但 Agent 驱动的需求涨得更快国产昇腾 950PR 2026 年规划产能只能覆盖当时推理需求的约 37%。[B] 供需缺口而不是亏损才是这则公告的底层语言。被打脸的风险同样真实。如果涨价后调用量明显下滑「需求无弹性」被证伪或者 Qwen3.8-Max 权重 8 月 10 日如期放出后以更低价格抢走开发者路由那么 DeepSeek 这步棋就从「价格发现」变成「让出王座」。目前唯一确定的是「超廉价」三个字从 DeepSeek 的官方词典里消失的那天整个 AI 商业模式的钟摆开始往回摆——从补贴换规模摆向算账换生存。这对依赖免费 token 的开发者、依赖低价模型的创业公司以及所有把「AI 越来越便宜」当作默认前提的规划都是一次重新定价。参考来源DeepSeek 官方公告证券时报转载DeepSeek V4 技术报告arXiv:2606.19348DeepSeek 官方定价页LA TimesChina’s AI blitz puts OpenAI and Anthropic in ‘death zone’ on price36氪成本拉低 100 倍梁文锋把 Claude 拉进「斩杀线」联合早报DeepSeek 内蒙古巨型数据中心Business StandardDeepSeek seeks fresh funding at $74bn valuation机器之心DeepSeek 官宣即将大幅涨价TechNodeV4-Flash tops OpenRouter weekly rankingdigitalappliedSelf-host frontier models TCO analysis 2026界面新闻DeepSeek 也扛不住了高盛观点每日经济新闻WccftechDeepSeek demand tsunami outruns 20,000-GPU stash东方财富告别「价格屠夫」PandailyDeepSeek kill-line price-performance economicsAI 辅助深度研究人工视角解读。每日更新。
返回列表