你好,我是蔚公子,毕业ALL in AI,专注于 AI 提效/企业赋能/教育
点击关注我,
分享真正能落地的AI方案,让企业和个人把AI用好
今天,DeepSeek 降价了!
这回不是继续涨,而是把周末直接变成了全天谷价。
从今天 8 月 23 日 0 点开始,周六周日全天不再分峰谷,统一按低谷价格算。工作日还是原来那套,上午 9 点到 12 点、下午 2 点到 6 点是峰时,其他时候都算谷时。同样的模型同样的活儿,谷时价钱正好是峰时的一半。
所以最近网上也玩起了一个梗,峰时叫梁文峰,谷时叫梁文谷
刚好前两天有人问我,你天天把 Harness 挂在那儿狠狠干,一个月得烧多少钱?
我当时一愣,还真是。这几天光顾着测插件跑 Agent、做各种任务,账我确实一次都没认真算过。
那就翻出来看看。
我把本地记录全拉了出来,从 8 月 15 号到 23 号,中间 17 号那天恰好一次调用都没有,实际有活儿的是 8 天。
这 8 天,我一共烧掉 230,546,114 个 Token。
2.3 亿。
而且九成以上都跑在 Pro 上。
数字摆出来我自己也愣了一下。但真正让我分析的不是这个数,是我把它拆开以后看到的三件事,每一件都跟我原来想的不太一样🤔
一、涨价这刀,比我以为的深得多
先说清楚一个前提。
这 8 天正好横跨了 8 月 17 号那次调价,所以直接拿整段账单去判断新价格,其实没什么意义。为了算清楚新规则到底贵不贵,后面的成本分析我只看 17 号之后的数据。
但也正因为横跨,我手上多了一个别人不太容易有的东西。
有人可能会问,会不会是你前后干的活儿本来就不一样。
我也担心过这个。所以我干脆把涨价之后那批调用原样搬回旧价格,重新算了一遍。同一批任务,一个 Token 都没动,只换价格。
结果是,旧价二十来块,新价八十多。
贵了差不多四倍。
而且这次调价最狠的一刀,正好砍在我身上。
我这 8 天九成以上的 Token 都跑在 Pro 上,输入里又有 98% 以上都命中了缓存。偏偏V4 Pro 的缓存命中输入,就是这轮涨得最凶的一档之一,从原来的两分多,变成现在谷时一毛五、峰时三毛,直接是原来的 6 到 12 倍。
所以那句“DeepSeek 随便用也花不了几个钱”,至少对我这种重度用法来说,从 17 号开始得重新算了🤔
不过真正把账单顶起来的,还不是这些海量输入。
而是输出。
二、贵的不是它读了多少,是它写了多少
拆开之前,我一直以为 Harness 最烧钱的地方是它疯狂读上下文。
一个 Agent 干活的时候,会不停带着前面的指令、工具说明和已有内容往后跑,读进去的量非常吓人。我这 8 天 2.3 亿 Token,绝大部分就是这么来的。
但拆完之后,我的判断整个反过来了。
17 号之后这批调用里,Pro 写出来的部分连 2% 都不到,却吃掉了一半以上的钱。
原因也不复杂。读进去的那些老内容基本都走了便宜价,而写出来的每一个字都按最贵那一档算,峰时的输出价钱正好是谷时的两倍。
所以至少在我这种缓存命中率极高的用法里,真正值得盯的已经不是它读进去多少,而是它往外写了多少。
以后再看到有人说,我今天在 DeepSeek 上烧了三千万 Token,我第一反应已经不是卧槽这得多少钱。
而是先问一句,这里面它自己写出来的有多少。
那才是真正花钱的地方。
长代码、长文章、长报告、一次性生成一大堆文件,还有那种 Agent 自己跑几十轮不断往外吐结果的活儿,这些才是账单上的刀刃。
三、真按时间挑着用,能省三分之一
这是我最想知道的。
我把 17 号之后的调用重新算了一遍,假如全部挪到谷时跑,账单会怎么样。
答案是少三分之一。
这个数当然不是人人都能复制,它是按我自己的任务结构和调用时间算出来的。但已经很说明问题了。
因为我有相当一部分调用是在工作日峰时跑出去的,而这里面有大量任务,根本不要求现在立刻马上给我结果。
长文档、长代码、批量研究、文件处理、后台任务、多轮自动执行,这些东西下午三点跑和晚上七点跑,对我有什么区别?
绝大多数时候没有任何区别。
但价钱差一倍,那我干嘛不扔到后面去。
不过话也说回来,这三分之一不是凭空省出来的钱。同一批活儿本来就已经贵了差不多四倍,错峰只是把其中一部分捡回来。
说白了不是赚,是少花。
四、新规则真正利好的不是聊天,是Agent
这次周末全天谷价,我一开始觉得也就那样。直到翻自己的数据才发现,17 号之后的调用里有接近一半是周末跑的。
这就很明显了。
如果只是普通聊天用户,一天问几十个问题,我觉得根本没必要为了省那点钱专门看表,你的时间比那几毛钱值钱多了。
但 Agent 完全不一样。
一个人不可能说今晚便宜,我凌晨两点爬起来跑五百个文件。但 Agent 可以,而且它压根不在乎几点。
所以我看到有人在讨论,以后是不是程序员为了省钱都得开始上夜班。
我的感觉恰恰相反。
要是最后变成人跟着价格表上夜班,那就是把 Agent 用反了。正确的姿势应该是,人正常上班,让 Agent 上夜班
五、我以后怎么给它排班
算到这儿,我自己的规矩已经很简单了,就四条。
1.急活直接跑。客户在等、文章要发,Bug 也等着修,别为了省那几块钱在那儿死等谷时,人的时间永远比这点钱贵得多。
2.简单活别全上 Pro。我这轮九成以上都挂在 Pro 上,这反过来说明我后面还有优化空间。那些确定性高、Flash 就能搞定的活儿,没必要为了心理上那点更强的感觉一直挂着最贵的。
3.长输出、长代码、长循环,尽量往谷时挪。这是我账单上最值得动的地方,工作日的晚上、早上和午间都行。
4.批量后台任务,晚上或者周末跑。现在周末全天谷价,可以让它慢慢干。
六、蔚公子的洞察
以前咱们选模型,关心的是谁更聪明、谁更快、谁更便宜。
现在居然又多了一句,几点了。
乍一看有点离谱,但我这 2.3 亿 Token 真烧下来以后,反而越来越觉得峰谷定价挺符合 Agent 时代的。
因为Agent 和人最大的区别之一,本来就是它可以在你不工作的时候继续工作。
以前我觉得 Agent 最大的价值是我不用一直守着电脑,现在又多了一层,我甚至不用在最贵的时候让它干活。
白天急活正常跑,不急的大活留到谷时再启动,能接调度的后台流程就让机器自己去错峰,批量任务更多放到周末。
人不用为了 Token 改作息,让机器去迁就价格表就行。
这么看的话,以后真正会用 AI 的人,可能不只是会写提示词、会选模型、会搭 Agent。
还得学另外一门手艺,叫给模型排班