看看你的订阅到底值多少钱。
SubWorth 是一个开放 Benchmark,测量 AI 编程订阅真正能兑现多少价值——换算成等价 API 用量的美元金额,依据是真实使用数据,而不是营销页面。
最近读数 2026-09-25 16:00 UTC+8。跟进这场实验 →
核心问题
什么是 Worth Multiple(订阅价值倍数)?
provider 公布的只有倍率——「5× Pro」「20× Pro」——从不公布金额。SubWorth 用两件任何人在本地都能观测到的事实补上这个金额:一段用量按官方 API 价目表折算成多少美元,以及它把额度窗口推进了多少。
Binding Window(绑定窗口)是各额度窗口中最先耗尽的那一个——Claude 套餐上是周窗口,只有它允许外推。一个月按儒略年取 30.4375 天(365.25/12),周窗口每月再生 30.4375/7 ≈ 4.35 次,不是 4 次。每个公布数字的口径固定为:理论月度上限,weekly 封顶。
排行榜
将来会公布什么,以及什么时候
表格先于数字存在。每一行列出套餐、它被测量所依据的信号,以及它现实中能达到的 Confidence(置信度)等级。
| 套餐 | 定位 | 额度信号 | 周价值 | Worth Multiple | Confidence |
|---|---|---|---|---|---|
| Claude Max 20x | 主力 | statusline rate_limits,整数 % | 测量中 | 测量中 | High(目标) |
| Codex Pro 20x | 辅助 | /wham/usage 接口 hook 采集,整数 % | 测量中 | 测量中 | Low → Medium |
| Kimi Allegro | 辅助 | 官方 /usages 接口 hook 采集,整数 % | 采集中 | 采集中 | Medium(上限) |
| Grok Heavy | 辅助 | unified.jsonl 计费事件导入,整数 % | 采集中 | 采集中 | Low |
Confidence 一列写的是每个套餐现实中能达到的等级,不是它已经挣到的等级。Grok Heavy 带着一条会随它任何数字一起发布的说明:套餐独占的 Heavy 模型只在 web 端可用、没有 API 定价,CLI 采不到,所以可测的是这个账号下的 CLI coding 用量,不含 web 端 Heavy 模型的消耗。
管线
一个数字会怎么被算出来
1 · 采集
一个 statusline hook 把每次额度读数——窗口、已用百分比、重置时刻——追加写进本地的 JSONL 文件。什么都不上传;除这几个字段之外,什么都不写。
2 · 计价
同一区间的本地 token 日志,按当天生效的 provider 官方 API 价目表逐项计价。价目表在仓库里版本化保存,所以一次降价不会被读成一次降额。
3 · 聚合
每一对读数在每个窗口上产生一条增量,各自按自己的标准评分,先按贡献者归约,再跨贡献者取中位数——绝不用平均值,那会被一个重度用户拉偏。
承诺
这个项目对自己的约束
- 原始对话永远不离开你的设备。采集默认只在本地,上传是一条独立的、显式的命令。看看到底会发送什么 →
- 每个数字都带着自己的来源。Measured(实测)、Community measured(社区实测)、Derived(推导)还是 Estimated(估算)——外加一个 Confidence 等级。估算值绝不会被包装成官方额度。
- 判据没过,什么都不发布。验证实验有一张通过/不通过表,写在数据到来之前。判据 →