看看你的订阅到底值多少钱。

SubWorth 是一个开放 Benchmark,测量 AI 编程订阅真正能兑现多少价值——换算成等价 API 用量的美元金额,依据是真实使用数据,而不是营销页面。

本站尚未发布任何 Worth Multiple。测量方法要先在公开状态下验证 14 天。今天能读到的,是方法本身、这场实验的原始进展,以及一份随时可能被 Day 14 判据作废的滚动估算。
30 / 14
实验天数
390,714
额度快照
133
已观测会话
2
已跟踪额度窗口

最近读数 2026-09-25 16:00 UTC+8。跟进这场实验 →

核心问题

什么是 Worth Multiple(订阅价值倍数)?

provider 公布的只有倍率——「5× Pro」「20× Pro」——从不公布金额。SubWorth 用两件任何人在本地都能观测到的事实补上这个金额:一段用量按官方 API 价目表折算成多少美元,以及它把额度窗口推进了多少。

AEV(w)=按 API 价目表折算的消耗 ($)窗口已用百分比月度上限=AEV(wbinding)×30.43757Worth Multiple=月度上限订阅月费\begin{aligned} \mathrm{AEV}(w) &= \frac{\text{按 API 价目表折算的消耗}\ (\$)}{\text{窗口已用百分比}} \\[8pt] \text{月度上限} &= \mathrm{AEV}(w_{\text{binding}}) \times \frac{30.4375}{7} \\[8pt] \text{Worth Multiple} &= \frac{\text{月度上限}}{\text{订阅月费}} \end{aligned}

Binding Window(绑定窗口)是各额度窗口中最先耗尽的那一个——Claude 套餐上是周窗口,只有它允许外推。一个月按儒略年取 30.4375 天(365.25/12),周窗口每月再生 30.4375/7 ≈ 4.35 次,不是 4 次。每个公布数字的口径固定为:理论月度上限,weekly 封顶。

阅读完整方法论 →

排行榜

将来会公布什么,以及什么时候

表格先于数字存在。每一行列出套餐、它被测量所依据的信号,以及它现实中能达到的 Confidence(置信度)等级。

套餐定位额度信号周价值Worth MultipleConfidence
Claude Max 20x主力statusline rate_limits,整数 %测量中测量中High(目标)
Codex Pro 20x辅助/wham/usage 接口 hook 采集,整数 %测量中测量中Low → Medium
Kimi Allegro辅助官方 /usages 接口 hook 采集,整数 %采集中采集中Medium(上限)
Grok Heavy辅助unified.jsonl 计费事件导入,整数 %采集中采集中Low

Confidence 一列写的是每个套餐现实中能达到的等级,不是它已经挣到的等级。Grok Heavy 带着一条会随它任何数字一起发布的说明:套餐独占的 Heavy 模型只在 web 端可用、没有 API 定价,CLI 采不到,所以可测的是这个账号下的 CLI coding 用量,不含 web 端 Heavy 模型的消耗。

管线

一个数字会怎么被算出来

1 · 采集

一个 statusline hook 把每次额度读数——窗口、已用百分比、重置时刻——追加写进本地的 JSONL 文件。什么都不上传;除这几个字段之外,什么都不写。

2 · 计价

同一区间的本地 token 日志,按当天生效的 provider 官方 API 价目表逐项计价。价目表在仓库里版本化保存,所以一次降价不会被读成一次降额。

3 · 聚合

每一对读数在每个窗口上产生一条增量,各自按自己的标准评分,先按贡献者归约,再跨贡献者取中位数——绝不用平均值,那会被一个重度用户拉偏。

承诺

这个项目对自己的约束