尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

把token卖成白菜价的DeepSeek,8月17日这天把高峰时段价格上调了4.5倍:先把全行业卷到地板,再从天花板收费

把token卖成白菜价的DeepSeek,8月17日这天把高峰时段价格上调了4.5倍:先把全行业卷到地板,再从天花板收费 把token卖成白菜价的DeepSeek8月17日这天把高峰时段价格上调了4.5倍先把全行业卷到地板再从天花板收费把输入 token 卖成 1 元 / 百万 tokens 起步的那家白菜价模型公司2026 年 8 月 17 日这天对自己最贵那一档的输出收费上调到原价的 4.5 倍。不是涨价通知漏写了小数点也不是 API 抖动被错误定价。这条改动写在 8 月 13 日公布、8 月 17 日正式生效的新版价目表上DeepSeek API 高峰时段输出价格定在 27 元 / 百万 tokens。一年前DeepSeek 是把整个中文大模型行业的 token 价格砍到地板的那家公司。如今它亲手把自己高端那档的输出按回了天花板的膝盖高度。这件事拆开看比涨价两个字复杂得多。新闻锚点8 月 17 日生效的全新价目表根据 DeepSeek 在 8 月 13 日发布的 API 价目表8 月 17 日零时生效的这次调整包含两层结构变化——一是单价大幅上调二是首次引入高峰 / 空闲分时机制。V4-Pro 价目8月13日公布17日生效原价8月17日之前新高峰时段价新空闲时段价高峰倍数输出 token每百万 tokens6 元27 元13.5 元4.5 倍输入 token缓存未命中3 元9 元4.5 元3 倍输入 token缓存命中0.025 元0.30 元0.15 元12 倍倍数对比看着刺激但真正要看的不是倍数是绝对值。高峰时段 27 元 / 百万 tokens 这个数字本身怎么理解先看跟自己的过去相比27 元是 DeepSeek V4-Pro 过去一年多来 6 元输出价的 4.5 倍——这件事构成了涨价叙事。再看跟别人比对照目前全球主流模型的官方 API 定价- SpaceX 旗下 xAI 的 Grok 4.6 输出价 6 美元 / 百万 tokens按汇率折算约 43 元- OpenAI、Anthropic 等美国头部产品的输出价多在十几美元到几十美元 / 百万 tokens 区间- DeepSeek 高峰时段的 27 元依然只有 Grok 4.6 的六成多也就是说哪怕在自己最贵的时段DeepSeek 仍然比美国同行便宜出几倍。这次调整的真实含义是把绝对便宜调整为分时便宜。分时定价把电力公司的逻辑搬到了算力上这次调价第二个值得注意的关键词是高峰二字。DeepSeek 没有一刀切涨到 27 元。它把一天切成两段高峰时段按 27 元收空闲时段按一半也就是 13.5 元收。V4-Flash 的输入缓存命中价格空闲时段只有 0.05 元几乎等于白送。这不是普通的涨价。这是把电力行业尖峰平谷那套分时电价机制原样搬到了大模型 API 上。为什么要这么做要理解这个问题需要先理解一件事DeepSeek 这种大模型公司卖的是什么。表面上看卖的是 token实际卖的是算力。算力的成本主要是两块——电费和 GPU 折旧。电费跟着电网跑电网跟着高峰跑GPU 折旧跟着利用率跑利用率跟着用户跑。当所有开发者都在白天上线所有客服机器人都在中午回答问题所有自动批改都在晚高峰时挤进来——算力的高峰时段就和电网一样会堵。这时候的边际成本远高于深夜空闲时段的边际成本。分时定价的本质是用价格信号把一部分用户从高峰挤到空闲。这在云计算圈本来就是常见的——AWS、Azure、Google Cloud 都有预留实例和 Spot 实例的价差。只是这次 DeepSeek 把它做到了通用 API 的颗粒度做到连 prompt 缓存命中都分时段计价。0.30 元的缓存命中暴涨 12 倍却依然便宜涨幅最猛的一项是输入 token 缓存命中价格从 0.025 元 / 百万 tokens涨到 0.30 元 / 百万 tokens倍数是 12 倍。看到12 倍这个数字下意识反应是涨疯了。但要看绝对值。0.30 元 / 百万 tokens 是什么概念意味着每输入一万字大约花 0.0006 元。一本《红楼梦》全文约 73 万字哪怕来回聊完整本内容缓存命中部分也只花不到 5 分钱。对照 SpaceX 旗下 xAI 的 Grok 4.6其输入 cache hit 价格大约在零点几美元 / 百万 tokens 区间。DeepSeek 的 0.30 元在绝对值上仍然只是对方的零头。所以缓存命中涨幅最大这件事本质不是涨价是过去定得太便宜。这一档价格一开始就没打算覆盖算力成本更多是鼓励大家用缓存——DeepSeek 自己甚至可能是亏损做缓存命中。这次的调整是把这条隐性补贴重新纳入定价体系。一次 1 万字对话成本粗算V4-Pro输入输出总计约 2 万 token原价新高峰价输入缓存命中 输出约 0.20 元约 0.85 元输入缓存未命中 输出约 0.65 元约 2.45 元V4-Pro 一次完整对话三倍于 V4-Flash三倍绝对值用表格摆出来仍然是白菜价。23 元的涨价是相对量不是绝对量。把 token 卷到地板的人按下反向开关的逻辑把 token 价格打到白菜价的这家公司按理应该担心别人抢市场。DeepSeek 8 月 13 日刚把 V4-Pro 从预览版转正同时开源了智能体软件 DeepSeek HarnessDeepSWE 智能体分数从 12.8 跃升到 62.7机构评估指数从 45 升至 53与 GLM-5.2 持平。产品上 DeepSeek 在强势出击市场地位反而稳。涨价这件事放在这个背景下更像是对未来 token 永远白菜的预言的反向操作——是它已经强大到不必再靠价格战维持优势才敢按这个反向开关。对调用 DeepSeek API 的开发者来说这次调整需要重新对照自己业务的三件事对超长上下文应用缓存命中率决定账单。那些 prompt 里有大量重复 system prompt、长文档 QA、代码库的检索增强类应用缓存命中价格从 0.025 涨到 0.30倍数 12 倍会让精打细算的开发者重新优化命中率。对实时响应应用高峰时段成本是空闲的 2 倍。24 小时不间断跑的客服、监控、日志分析建议把非关键批量任务挪到空闲时段对照分时价重新设计排程。对智能体多步骤调用80% 成本由输出承担。V4-Pro 输出价格高峰 27 元已经是 V4-Flash 的 3 倍。多步智能体每一步都吃输出 token这部分的成本会最先体现在账上。不平静的分时定价信号把电力行业的分时电价直接搬进大模型 API在中国头部模型公司里是第一次。分时定价能成立的前提是真的有高峰和空闲两段。如果全天高负荷、再怎么分时也做不到引导迁移那么 27 元就只是 27 元的简单涨价。这件事真正传递的信号是 DeepSeek 相信自家有空闲产能可以卖。这从另一面证明DeepSeek 的算力底座已经扩到了足以做出分时这件事的体量。而把 token 卷到地板的事做尽再按回天花板的事也敢做。这一上一下之间8 月 17 日生效的这版定价表不再只是一张价目表——它是国内大模型公司第一次把 token 从流量生意做成电力生意。给读者的两点建议即便你是 DeepSeek 的重度用户也可以花十分钟重新算一遍账高峰与空闲的差能让你看到自己过去哪些时段在烧钱、把哪些任务挪到夜里能省下多少。看一家大模型公司的产品力过去看开源、现在看分时定价是不是敢做。从卷价格到卷时段意味着这条赛道的竞争维度再加一项。能分时是因为有空可分敢分时是用户规模撑得起时段结构。
返回列表