尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

DeepSeek V4 Pro 2026-08-17峰谷计费实账:Cache Hit、Miss与Output Token成本拆解

DeepSeek V4 Pro 2026-08-17峰谷计费实账:Cache Hit、Miss与Output Token成本拆解 适用范围本文分析 2026 年 8 月 17 日deepseek-v4-pro的两段实际 API 账单08:00–09:00空闲时段09:00–10:00高峰时段。目标是验证新峰谷价格是否进入实际计费并说明为什么“高峰单价翻倍”不等于“任意两小时账单总额翻倍”。本文只分析计费不比较模型能力、响应质量或延迟。1. 账单字段与价格原始amount账单按小时、模型和计费类型拆分包含input_cache_hit_tokensinput_cache_miss_tokensoutput_tokensrequest_count。价格字段单位为人民币/Token换算为人民币/百万 Token 后如下类型空闲单价高峰单价倍率input_cache_hit_tokens0.150.302×input_cache_miss_tokens4.592×output_tokens13.5272×高峰时段为每天 9:00–12:00、14:00–18:00其余为空闲时段。账单在 09:00 边界后准确切换到高峰单价。2. 08:00–09:00空闲账单类型Token 数单价元/Token费用缓存命中输入9,509,1200.000000151.426368 元未缓存输入15,1960.00000450.068382 元输出22,7640.00001350.307314 元合计9,547,080—1.802064 元请求数为 47。费用复算9,509,120 × 0.00000015 1.426368 15,196 × 0.0000045 0.068382 22,764 × 0.0000135 0.307314 ──────── 1.802064 元复算结果与cost账单一致。3. 09:00–10:00高峰账单类型Token 数单价元/Token费用缓存命中输入2,487,2960.00000030.7461888 元未缓存输入54,9130.0000090.494217 元输出27,7400.0000270.74898 元合计2,569,949—1.9893858 元请求数为 16。费用复算2,487,296 × 0.0000003 0.7461888 54,913 × 0.000009 0.494217 27,740 × 0.000027 0.74898 ───────── 1.9893858 元复算结果同样与cost账单一致。4. 为什么不能直接比较两小时总额空闲时段费用为 1.802064 元高峰时段为 1.9893858 元后者只高 10.39%。这不代表峰谷价差是 10.39%因为两个时段的请求量和 Token 构成不同请求数从 47 降至 16缓存命中 Token 从 9,509,120 降至 2,487,296未缓存输入从 15,196 增至 54,913输出从 22,764 增至 27,740。总账单是“Token 数 × 对应单价”的加总。只有保持 Token 数与类型不变才能比较峰谷价格带来的纯计费差异。5. 对高峰工作量做反事实计算保持 09:00–10:00 的 Token 数不变改用空闲单价cache_hit 2,487,296 × 0.00000015 0.3730944 cache_miss 54,913 × 0.0000045 0.2471085 output 27,740 × 0.0000135 0.37449 ───────── 0.9946929 元计费方式费用高峰实际费用1.9893858 元相同 Token 按空闲价0.9946929 元高峰额外费用0.9946929 元由于三类价格均翻倍相同 Token 构成在空闲时段可节省 50%。这是基于实际 Token 数的反事实费用不是另一次同任务 A/B 测试。6. Cache Hit、Miss与Output的成本关系新价格保持了三类 Token 之间的固定倍率cache_miss / cache_hit 30 output / cache_hit 90 output / cache_miss 3高峰时段中2,487,296 个缓存命中 Token 费用为 0.7461888 元27,740 个输出 Token 费用为 0.74898 元。输出 Token 数只有缓存命中的约 1.12%费用却略高。这说明长程 Agent 的成本优化不能只关注输入总长度还应控制输出冗余并尽量保持可复用前缀稳定以提高缓存命中。7. 调度建议与边界适合错峰的任务仓库索引、批量测试生成、文档生成、静态审查、多 Agent 探索、可排队的重构与迁移。不适合强制错峰的任务线上故障、交互式调试、需要人工连续反馈的任务以及有明确完成时限的发布操作。本文没有进行相同提示词、相同项目快照的峰谷性能测试因此不讨论响应速度和模型输出是否一致。账单只证明价格切换和实际成本不证明模型能力变化。官方来源DeepSeek V4 Pro 与峰谷定价公告https://api-docs.deepseek.com/zh-cn/news/news260813DeepSeek API 模型与价格https://api-docs.deepseek.com/zh-cn/quick_start/pricing#DeepSeek #API计费 #Token成本 #Agent #AI编程
返回列表