公司动态

账单涨了,不是你用多了

📅 2026/8/23 19:07:01
账单涨了,不是你用多了
摘要8 月以来国内大模型集体涨价DeepSeek V4-Pro 高峰输出价从 6 元涨到 27 元。很多人看到账单第一反应是我是不是用多了——其实用量没变是单价涨了。本文拆开账单用量×单价这三本账并聊聊额度收紧后简单任务该怎么省着花。你月底看 AI 编程工具的账单比上月贵了一截。第一反应多半是这月是不是手滑用多了这个直觉很可能是错的。三本账你以为的用多了和真实的涨了价把账单拆开看其实是三本独立的账账一厂家的标价list price在涨。摩根士丹利 8 月 9 日的研报《告别价格战打响智力战》统计了字节、阿里、百度、腾讯、MiniMax、智谱、月之暗面、DeepSeek 八家的官方报价2026 年第二季度中国大模型平均 API 输入价已升到每百万 Token 4.9 元、输出价 21.9 元相比 2025 年第一季度的 3.3 元和 12.2 元分别涨了约 48% 和 80%[1]。账二你的用量其实没怎么变。写代码、改 bug、跑生成节奏和上月一样。但账单的算法很简单账单 用量 × 单价单价翻一倍账单就翻一倍——跟你用多用少没关系。账三所以账单涨我用多了是个错觉。你正常用钱就多了因为单价上去了。这不是你的问题是定价的问题。图账单用量×单价。标价上去了、用量没变、账单自然上去——错不在你。单价涨的实锤不是一家是一波先看最刺眼的一例。DeepSeek 8 月 17 日零点起启用峰谷定价旗舰 V4-Pro 在业务高峰时段9:00–12:00、14:00–18:00的输出价从 6 元/百万 Token 涨到 27 元涨幅 350%缓存命中输入价从 0.025 元飙到 0.30 元涨幅 1100%平均下来约 3.5 倍[2]。它甚至引入了闲时半价、高峰翻倍的机制——直接用价格杠杆逼你错峰。这不是孤例是 2026 年全行业的集体涨价潮腾讯混元核心模型部分涨幅达 463%[3]智谱年内三次上调 API 价格一季度累计涨幅 83%涨价后调用量不降反升[3]月之暗面 Kimi K3 输入价涨幅超 3 倍、输出价近 4 倍[3]阿里、百度的 AI 算力产品集体上调 5%–34%[3]。海外也在动但方向是分层双轨旗舰档往上走——Claude Fable 5 输出定价每百万 Token 50 美元是同期 Opus 系列的 2 倍GPT-5.5 输入价 5 美元8 个月涨了约 8 倍。但入门档在反向打地板GPT-5.6 Luna 输入砍到 0.20 美元降 80%。所以海外在降也是个错觉真相是贵的更贵、便宜的更便宜。为什么涨不是厂家变贪根因就一个字缺。DeepSeek 今年 5 月连续崩溃直接原因是用户量暴涨 66.7% 而算力储备只增长 8.3%供需严重失衡[2]。中国日均 Token 调用量已突破 140 万亿较两年前增长超 1000 倍[3]——需求是真旺算力是真不够。更深一层是商业模式的换轨从租机器的 IaaS转向按 Token 结算的 MaaS。计价尺度从卡时变成任务成功率厂家开始为能力而非便宜收溢价。这就是为什么它敢涨——你不是为了便宜的 token 付费是为了这活它能不能干成付费。一个很多人不愿明说的现实我赌还有不少公司压根没给员工配 token 额度。走企业采购、统一结算的团队涨价是财务部门的事个人体感弱。但大量个人开发者、小团队、没走集采的项目组用的是自己的账号、自己的钱包。这部分人对涨价的敏感度最高——因为每一分钱都从自己腰包或项目组小账上出。也正是这部分人最容易在涨价后产生那个幻觉。幻觉你以为消耗变多了其实只是涨价了涨价之后明明还是照常写代码、照常让 AI 改 bug却明显感觉 token 消耗变多了。把这两句话分开看“感觉消耗变多了”——是真的因为同样的对话、同样的代码生成这月比上月花得多“真的消耗变多了”——未必。你的用量可能一点没变是单价把同样的消耗标了更高的价。这是个会计错觉你盯的是这次生成花了多少但分母单价已经被悄悄改写了。你没多用是世界变贵了。没有富余额度时简单任务切文档模式那额度紧了怎么办我的建议是对简单任务把 AI 从执行者退回参谋我管这叫文档模式。现在多数人的习惯是把整个 agent loop 全交给 AI——它自己读代码、改、跑测试、迭代、最后提交。每一步都烧 token一次帮我把这个改动提交一下背后可能是几万 token 的上下文搬运。文档模式反过来让 AI 只产出一份文字方案——一段说明、一个伪 diff、一份步骤清单——然后你本人去编辑器里手改、自己跑测试、自己提交。AI 只想不干token 消耗从全程托管降到一次性咨询往往能砍掉一大半。哪些活适合这么干让 AI提交一次代码写 commit message、git add、git push 全包——这种事你十秒就能做改一个简单 bug明显的空指针、拼错变量名、漏了个 import加一个小函数、补一段样板代码。这类任务你闭眼都能搞定让 agent 全跑一遍纯属浪费额度。代价要说清文档模式省的是 token占的是你自己的时间也考验你自己的工程能力。真遇到复杂重构、跨文件改动、你不熟的领域该交给 agent 还是交给 agent——这时候省下的时间远大于多花的 token。别把简单活硬扛也别把重活硬省。收尾涨价不是末日是把无脑托管的成本逼出来了三件套对冲本地模型跑日常我本机 Ollama 跑 qwen2.5-coder:14b/32bAPI 涨价跟我半毛钱关系没有数据还不出口云端走模型路由轻任务走便宜档重任务才上旗舰别一刀切简单任务切文档模式AI 出文档你手搓修复、自己跑测试。涨价潮不会停。但换个角度它逼着我们把反正有额度、随便造的心态收回来——哪些活该 AI 干哪些活该自己干本来就该算清楚。参考资料[1] 摩根士丹利《告别价格战打响智力战》2026-08-09转引自新浪财经https://finance.sina.cn/2026-08-13/detail-inineuqm9874550.d.html[2] DeepSeek API 8 月 17 日起峰谷调价V4-Pro 高峰输出 27 元/百万 Token转引自界面新闻/网易科技https://www.163.com/dy/article/L4IAUQU305118O92.html[3] 2026 年国产大模型集体涨价潮腾讯混元 463%、智谱 83%、Kimi K3 输入输出近 4 倍、阿里百度 5%–34%综合自钛媒体、凤凰网https://www.tmtpost.com/7983681.html 、https://i.ifeng.com/c/8s4tFiQWD8n作者唐悦玮 | 从后端出发用 AI 拓展到全栈的工程师。