经常关注AI模型价格的话会发现大模型常用“百万Token”计价那百万Token到底是什么概念能支撑多少使用场景以Deepseek为例100万Token约等于100万汉字。辅助写稿或开发小工具100万Token大概用1小时日常聊天查资料能用三四天重度使用的话10分钟就可能用完。价格方面Deepseek V4 Pro每百万Token输出约0.87美元人民币6元左右若一天用三四个小时每月大概600元而Claude最新模型同样输出100万Token要50元左右差距很大。模型计费主要在输入、输出、命中缓存三部分输入发给模型的所有内容文字、图片、文件都算输入且大模型没记忆每次新消息都要把历史对话重新打包发送对话越长输入花费越高。省钱技巧是精简每次自动带上的规则文件如Claude Code的claude.md等砍掉废话重复内容。输出模型回复的内容后台思考过程都计费输出单价比输入高是账单中最贵的部分。省钱可让模型少输出问题简洁避免长篇大论、调低思考档简单问题不用最高思考模式但要平衡质量。命中缓存模型会把重复的历史对话计算结果存起来下轮复用可省算力但调取缓存也要收费。节省方法是把长任务拆成小任务新开对话保持上下文占用不高。总花费新增输入未命中历史按输入价输出按输出价命中缓存按缓存价。最后提醒1.活要分级零碎活整理资料、改格式用免费模型复杂任务用主力模型。2. 别迷信省Token工具如headroom、RTK等插件虽宣传能省很多但原理是压缩中间记录压缩占比小还易丢信息导致bug。​