你现在打开 Cursor 的账单页,看到的是这个:

「2,847,391 tokens」

多少钱?不知道。它不告诉你了。

7 月 31 日下午,没有公告、没有更新日志,用量页里所有的美元金额被换成了 token 数量,API 返回的成本字段直接归零。有人去论坛问这是不是 bug,Cursor 的员工回了一句:

「这是刻意设计。」

Cursor 账单透明度


一、发生了什么:一行 API 字段的消失

7月31日,Cursor 用量 API 端点 https://cursor.com/api/dashboard/get-filtered-usage-events 的返回值里,以下字段全部归零:

chargedCents: 0
usageBasedCosts: "$0.00"
tokenUsage.totalCents: (omitted)

这不是 bug。Cursor 官方员工 Kevin Neilson 在论坛里亲口说:

「这是刻意设计。」(原文:This is deliberate design.)

同时删除的还有:

  • 用量页的美元折线图(只保留 token 数)
  • CSV 导出里的 Cost 列(全部清零)
  • 单次请求级别的成本字段(对 Teams 自服务计划完全关闭)

一位 Teams 管理员 Kris_Gunnars 说:本月团队 API 用量已经花了 3万美元,现在他没有任何方式按用户、按模型细分看成本明细。

官方的解释是:个人计划的美元数字经常显示「高于订阅费用」的金额(因为包含了套餐内的额度折算),造成了「混淆」,所以决定删除。


二、这个解释站不住脚

「混淆」的问题有 100 种解法。加一行说明文字;用不同颜色区分「已包含额度」和「实际扣费」;加一个切换开关。

但 Cursor 选择的是:直接删除。

更关键的是,被删除的不只是"混淆"的部分,而是全部。包括:

  • 历史数据:此前显示真实金额的历史记录,全部被追溯清零。你去看一个月前的某次对话花了多少,chargedCents 显示 0
  • Teams 计划:这类用户没有「套餐内额度折算」问题,全都是真实的 API 计费,他们的明细同样被删。
  • CSV 导出:这是工程团队做成本分析的主要工具,现在 Cost 列全部是 0.0

一个工程师在帖子里写道:

我看这个数字,不是为了跟 Cursor 对账、盯着它有没有多收我钱。而是比如说:我用 Grok 4.5 发一条消息,刷新用量页,看到涨了大约 0.32 美元;切到 Opus 5 干一段活,再刷新,涨了 2.56 美元。这样我才能判断每个模型的成本配得上它的表现吗。

这才是这个功能的真实用途:帮工程师理解「这个模型配这个任务,值不值」

这个用途消失了。


三、同时发生的事:token 消耗相差 30 倍

这次事件爆发的同时,HN 评论区里一位叫 @tosh 的工程师贴出了一张测试数据表。他用同一个模型(GPT 5.6 Sol)、在 Ubuntu 26.04 虚拟机里跑了 10 个 agentic 任务,在不同 Agent harness 上对比 token 用量:

Harness       | API total tokens
--------------+------------------
smol          |       172,807
Pi            |       427,211
OpenCode      |     1,564,429
Codex         |     3,005,744
Hermes        |     3,856,611
Claude Code   |     5,073,137

所有 harness 都完成了任务。但 Claude Code 用的 token 是 smol 的 29 倍。

这意味着什么?

如果你在用 Claude Code 的 Opus 5,每次任务的成本大约是用 smol 的 29 倍。即使你在订阅制下不直接感受到按量计费,这个差距也直接决定了你的「月度额度能用多久」。

有意思的是,tosh 在后面的评论里补充说:

通常那个用更少 token 的 harness,不只跑得更快,结果还更好。

更少的 token,更好的结果。这打破了一个隐性假设:大量 context injection 并不总是帮助 AI,有时候它只是在干扰模型。

另一位工程师 @yojo 解释了 Claude Code 高消耗的原因:

Claude Code 往 system prompt 里注入了一大堆工具,包括那套「记忆系统」,光这块就一万多 token。取决于你的任务形态,这很容易让单次任务的成本翻倍。

所以:Cursor 在你不知情的情况下删除了你的成本数据,而与此同时,不同工具之间的真实成本差距可以达到 30 倍。

这两件事放在一起,就是一个完整的问题:没有透明度,你就不知道自己在用最贵的方式做原本可以便宜的事。


四、$60 亿收购之后的第一步棋

Cursor 在今年被 SpaceX/xAI 以约 60 亿美元收购。收购完成后,Grok 4.5 成为 Cursor 的默认主力模型之一,Composer 2.5 是 Cursor 自研的编码模型。

一位叫 @jjice 的工程师在 HN 说:

干出「把服务成本从界面上删掉」这种对用户如此不友好的事,简直是疯了。这件事无论怎么包装,都只能是对用户不利、对公司有利。毕竟,天价收购一个 IDE,总得给这个价格找个说法。

另一位前 Cursor 忠实用户 @aroman 写道:

我是 Cursor 最早、最热情的那批用户和付费客户(从 2023 年就开始了!),但我大概有半年没打开过它。现在我用 Claude Code 和 Codex「写」代码,然后在 GitHub 上读和 review。

一位叫 @sergiotapia 的用户:

Cursor,你本来有一个特别漂亮的翻身故事……到底为什么要这样挥霍这个机会?你几乎是从死里爬回来的,现在又要把它全丢掉——为了什么?

Cursor 的处境很微妙:它被大钱收购,但收购方是一个对「敏感度」有自己考量的主体;它的用户是开发者,是这个星球上最不能容忍不透明的一类人。

开发者可以用 curl 自己验证一个 API 字段是不是被清零了。


五、这不是 Cursor 独有的问题

AWS 账单有多复杂,做过云架构的人都知道。一张月结单里,哪行是真实成本、哪行是预留实例的折算、哪行是免费额度的抵扣,需要专门的人花专门的时间去解析。

大量 AI 工具正在走同一条路:

  • 把计费单位从「美元/次」改成「credits/tokens/points」
  • 让包含额度的部分和超出计费的部分混在一起
  • 每次升级套餐都改一次定价逻辑,让历史数据失去参照价值

这背后的商业逻辑很清晰:当用户感知不到边际成本,他们的使用行为就不会受到成本约束,付费意愿就更容易通过高额套餐来套取。

@xp84 在 HN 里说得非常直白:

我认为这些公司就是想让 token 用量变得不透明,和大多数公司里的 AWS 账单没什么区别。我猜他们是故意让你很难分辨:一个工程师到底是在浪费额度乱用 AI,还是真的把每个 token 都用出了价值。


六、作为工程师,你现在可以做的事

第一:不要依赖任何 AI 工具的内建用量页。

Cursor 这次证明了一件事:内建用量页的数据可以被追溯修改,历史记录不可信。

如果你的团队有 API 用量成本的管理需求,唯一可靠的做法是在自己的基础设施里记录每次 API 调用的 prompt_tokenscompletion_tokens 和时间戳,自己换算成美元。

第二:认真评估 token 效率,而不只是「哪个工具好用」。

上面那张对比表说明,harness 的选择比模型的选择对成本的影响更大。smol 用了 17 万 token,Claude Code 用了 507 万,但结果质量相当。

在你的具体任务场景上,测一下。

第三:把不透明当成产品选择标准。

当一个工具开始系统性地模糊成本信息,这是一个信号:它的商业利益已经开始和你的工程决策利益产生偏离。

这不是说你要立刻换工具。但这应该是你下次续费前认真思考的问题。


总结

行为Cursor 的官方解释工程视角
删除美元数字「避免混淆」让用户无法做成本决策
追溯清零历史数据API 读取层改动消除历史对比参照
Teams 计划同样删除统一 UX最有成本意识的用户群失去数据
只保留 token 数「更准确的计量」token 跨模型不可比,失去意义

订阅制 AI 工具的商业利益和用户成本透明度,天然是对立的。 这不是哪家公司的道德问题,是商业结构的必然张力。理解这一点,比骂某家公司更有用。


🛠 如果你在评估 AI coding 工具的团队成本管理——

  • 你的团队现在有没有独立于工具之外的 token 用量追踪?
  • 你用的 harness 是 Claude Code 还是 smol/Pi?成本差多少你测过吗?
  • 当一个工具开始模糊计费信息,你的决策树是什么?

📬 关注梦兽编程,获取更多 AI 工程工具的深度分析。


参考来源: