尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

DeepSeek API 峰谷定价落地:最高涨1100%,一个研究生的 token 省钱记录

DeepSeek API 峰谷定价落地:最高涨1100%,一个研究生的 token 省钱记录 昨晚十一点我在实验室跑完最后一批文献筛选顺手看了一眼 API 账单愣了一下。8月17号 DeepSeek 调价正式生效我白天在高峰时段跑的那几个批量任务费用直接翻倍。作为把 DeepSeek 当主力 API 用了大半年的穷研究生这波价格屠夫收刀我是实实在在挨了一刀。写这篇文章一是记录这次调价的关键事实网上信息太碎二是分享我踩坑之后整理出来的省钱方案给同样用 agent 写科研脚本的同学参考。先看事实这次调价是怎么落地的时间线其实很紧凑8月6日DeepSeek 在开发者平台发公告全文很短“计划近期整体上调 DeepSeek API 服务的定价预计涨幅较大”。没有幅度、没有时间表但开发者圈直接炸了——毕竟 DeepSeek 是过去两年的行业价格地板。8月13日具体方案公布改用峰谷定价。8月17日 0时新价格正式生效同时 V4-Pro 结束测试、转为正式版商用。新价格表元/百万 tokens高峰时段为北京时间 9:00-12:00 和 14:00-18:00空闲时段是高峰价的一半模型场景空闲时段高峰时段V4-Flash输入缓存命中0.050.10V4-Flash输入缓存未命中1.53.0V4-Flash输出4.59.0V4-Pro输入缓存命中0.150.30V4-Pro输入缓存未命中4.59.0V4-Pro输出13.527.0对比调价前 V4-Pro 的 0.025 / 3 / 6缓存命中输入这项从 0.025 涨到高峰 0.30涨幅高达 1100%。注意缓存未命中的输入和输出其实涨得没有缓存命中那么夸张但输出价 6 → 13.5高峰 27也够肉疼的。为什么涨单日 8 万亿 token 的甜蜜的负担涨价的直接导火索是需求海啸。据 OpenCode 披露8月1日单日 V4-Flash 在其平台处理了 8 万亿 token——其中 5 万亿还是免费额度。8月4日V4-Flash 因为前所未有的访问量出现容量不足官方 API 上午几乎不可用。OpenRouter 周榜上V4-Flash 在 7月27日-8月2日以 7.22 万亿 token 登顶全球第一之后两周又分别以 8.83 万亿、11.2 万亿连庄。深层原因是算力硬约束业内信息称 DeepSeek 持有约两万张 H 系等效芯片且训练与推理共用。中国发展高层论坛 2026 年年会披露今年3月国内日均 token 调用量已突破 140 万亿比 2024 年初的约 1000 亿涨了千倍以上信通院数据显示一季度算力需求同比增长 417%供给只涨了 128%。需求端涨千倍、供给端跟不上涨价成了最直接的算力再分配手段。这也不是孤例智谱年内已经三次提价一季度提价 83%调用量反而涨了 400%月之暗面 Kimi K3 发布后输入价涨超 3 倍、输出价涨近 4 倍。摩根士丹利 8月9日研报显示2026 年二季度国内大模型平均 API 输入价 4.9 元、输出价 21.9 元/百万 token比 2025 年一季度分别上涨约 48% 和 80%。白菜价时代确实在收尾。有意思的是海外这波是反向操作OpenAI 把 GPT-5.6 Luna 的价格下调 80%Anthropic 的 Claude Fable 5 干脆取消了订阅制、纯按量计费$10/$50 每百万 token。一涨一降背后是算力自有度和商业模式的差别——OpenAI 靠订阅收入补贴 API 获客DeepSeek 几乎是纯 API 变现涨价就是它的损益表本身。Artificial Analysis 的实测数据很能说明问题V4-Flash 跑完一次基准任务成本约 $0.03Kimi K3 约 $0.86Claude Fable 5 要 $3.15——便宜超过 100 倍。所以DeepSeek 斩杀线性价比散点图上把又贵又菜的模型全部划进斩杀区的那条线能上热搜是因为这条线本身太夸张了也正因如此它迟早要动一动。对研究生来说最痛的是什么个人聊天的同学基本无感——网页版和 App 不按 API 计费。最痛的是我们这种把 agent 当苦力跑批量任务的人。我的典型场景是让 agent 读几十篇 PFAS 文献做筛选、写 PMF 输入文件的预处理脚本、跑 SHAP 特征贡献分析。一个任务动辄几十轮工具调用上下文反复膨胀token 消耗是聊天场景的几十上百倍。我踩的第一个坑不知道峰谷定价已经生效白天照常跑批量任务。我 8月17日上午十点启动了一轮文献筛选四小时后看账单发现同一批任务如果挪到晚上跑能省一半。第二个坑上下文缓存命中率低。之前为了省事每次任务都把同一份方法学文档重新塞进 prompt缓存全 miss等于按最贵的输入价计费。我现在的省钱四件套1. 错峰调度。把重活挪到高峰时段之外。我在服务器上加了 cron凌晨 2 点自动跑批量任务# 每天凌晨 2:00 跑文献筛选批处理空闲时段输出价减半02* * *cd/home/lixna/pfas_screenuv run python batch_screen.pylogs/screen.log212. 提高缓存命中率。缓存命中输入只要 0.05 元Flash和 miss 的 1.5 元差 30 倍。做法把 system prompt、方法学文档固定下来不换多轮对话里不重复贴大段上下文能用同一个 session 就别开新的。3. 模型路由。简单任务格式转换、正则提取用 V4-Flash复杂推理写 PMF 脚本、解释模型结果才用 V4-Pro。我写了个小函数做成本估算跑之前先算一笔账defest_cost(n_input,n_output,cache_hit0.5,peakFalse,modelflash):估算一次 API 调用的成本元。price{flash:(0.05,1.5,4.5),pro:(0.15,4.5,13.5)}[model]hit,miss,outpriceifpeak:# 高峰时段价格翻倍hit,miss,outhit*2,miss*2,out*2in_costn_input*(cache_hit*hit(1-cache_hit)*miss)/1e6returnin_costn_output*out/1e6# 例一次 20 万输入 5 万输出、缓存命中 50% 的 Flash 调用print(est_cost(2e5,5e4,cache_hit0.5,peakFalse))# 约 0.38 元print(est_cost(2e5,5e4,cache_hit0.5,peakTrue))# 约 0.75 元4. 本地部署开源权重。V4 系列是 MIT 开源处理涉及原始监测数据我们组的 PFAS 浓度数据还没发表不适合走外部 API的活我直接跑本地量化版贵是贵在电费但数据安全、没有计价波动。一点心态说句公道话即便翻倍DeepSeek 依然是全球最便宜的一档。国盛证券测算 V4-Pro 高峰输出价也只有 Claude 旗舰的约 1/13闲时约 1/25。这次调价真正改变的是计价方式从一口价变成按资源紧张程度定价对用量大的 agent 用户来说省钱的本质变成把算力需求从高峰挪走、把缓存用满。这不是坏事至少让我这种穷学生学会了对 token 用量有概念——以后毕业了做任何跟模型调用相关的事这都是基本功。参考来源网易/新快报DeepSeek 预告 API 价格大幅上调AI 大模型行业定价逻辑生变2026-08-08雷达财经DeepSeek涨价“价格屠夫梁文锋收刀”2026-08-18快科技DeepSeek-V4系列今日起价格上涨峰谷定价 高峰期贵一倍2026-08-17虎嗅DeepSeek调价方案公布8月17日生效2026-08-13Caixin GlobalDeepSeek Launches V4-Pro and Raises API Prices by as Much as 1,100%2026-08-14AI工具宝箱DeepSeek 预告 API「大幅涨价」单日 8 万亿 Token 压垮价格屠夫2026-08-07
返回列表