200 美元的 AI 订阅,他们硬是榨出了 8000 美元的用量
事情是这样的。
前两天刷到 SemiAnalysis 在 X 上发的一组测算,我盯着那个数字看了几秒,没绷住,笑了一下。
他们说,月费 200 美元的 Claude Max 20x,如果你把里面的用量按官方 API 的价格一个 token 一个 token 折算回去,能值到大概 8000 美元。ChatGPT Pro 那档更夸张,能折出 14000 美元。
换算成人民币,200 美元差不多 1355 块,8000 美元就是六七万。也就是说,你交了一台 iPhone 的钱,理论上能薅走一辆车的料。
好家伙。70 倍。
我第一反应不是兴奋,是有点心虚。那种感觉就像你在自助餐厅,本来想着吃回本就行,结果发现旁边那桌已经把整条三文鱼端走了,而老板还在笑眯眯地给你续果汁。你会忍不住想,这生意,他到底图啥?
这篇就想顺着这个数字往下唠唠。不是来教你怎么薅羊毛的,是我自己作为一个天天跟这些模型 API 打交道的人,看完之后真的愣了一下,想把这背后的账算给你看看。算明白了你会发现,这事比单纯的便宜要有意思得多。
先说 SemiAnalysis 是谁,免得你以为是哪个营销号瞎咧咧。这家是做半导体和算力供应链研究的咨询机构,Dylan Patel 那帮人,平时扒英伟达产能、扒数据中心电费、扒各家大模型训练成本的硬核选手,业内引用率很高(他们官网在 semianalysis.com)。这次他们干了件挺笨但很实在的事,把 Anthropic 和 OpenAI 的全部订阅档位都买了一遍,然后模拟一个高强度专业用户,疯狂跑编码任务,一直跑到撞上每周用量上限为止。
撞上限之后,他们把这一周吞掉的 token 量记下来,再拿去乘以官方 API 的单价。结果就是开头那两个数字。
这个测法我是服气的。它不是去猜、去脑补,是真金白银买回来硬跑,撞墙了才停。这种笨办法得出来的数,可信度比那些拍脑袋的估算高一个量级。
那问题来了,为啥会差出 70 倍这么离谱?
你得先搞清楚这两种买法到底是两个东西。
一种是订阅,就是 Claude Max、ChatGPT Pro 这种,每月固定一笔钱,给你一个用量额度,通常按 5 小时一个滚动窗口、外加一个每周总上限来卡你。Anthropic 自己把这套写在 定价页 和 Claude Code 的用量文档 里,Max 分 5x 和 20x 两档,数字是相对 Pro 基础档的倍数。
另一种是 API,按 token 实打实计费,进多少 token 出多少 token,明码标价挂在 Anthropic API 定价 和 OpenAI 的 API 价格页 上。你调一次付一次,童叟无欺,跑多少烧多少。
SemiAnalysis 干的事,就是拿订阅档里实际能跑出来的 token 量,去套 API 那一侧的牌价。这本来就是两个定价逻辑硬掰到一起比,掰出来的差价天然就大。但即便知道这是两套体系,70 倍这个落差还是把我整得有点懵。
为啥订阅能给到这么狠?
我自己的理解是这样的。订阅这门生意,平台赌的从来不是单个用户,是一整个池子的平均数。
这套逻辑健身房玩了几十年了。健身房敢卖你年卡 365 天随便练,是因为它心里门儿清,办了卡的人里头,绝大多数办完三周就再也不来了。真要是每个会员都天天来、还都掐着点上私教器械,这健身房当月就得关门。它卖的不是健身服务,是你那份三分钟热度的概率。
AI 订阅一模一样。Anthropic 敢标 200 美元随便用,是因为它后台看得到,掏这钱的人里头,绝大多数也就偶尔写写邮件、改改文案、问几个代码问题,离那个每周上限远得很。IT 之家那篇报道底下有个评论我觉得特别真实,有位老哥说他的 Max 5x,5 小时窗口配额大概在 50M token 左右,一周满打满算能跑 1B,但大部分时候根本用不满,也就 500M 上下。
你看,连一个会上论坛专门聊配额的重度玩家,实际用量都只到理论上限的一半。那些买了 Max 装在电脑里、一周打开两次的人呢?他们贡献的利润,正好拿去补贴 SemiAnalysis 这种把上限往死里撞的狠人。
所以那个 8000 美元,不是 Anthropic 真在你身上亏了 7800。是因为隔壁九十九个温和用户每人都没用够,匀出来的空间,刚好够你这一个狠人造。

听着挺像庞氏的对吧?其实不是。它就是个再朴素不过的保险精算模型,大数定律。平台不怕个别人薅穿,怕的是所有人一起薅穿。只要平均用量稳在一个安全线下面,这账就永远是赚的。
理解了这层,你再回头看那个 70 倍,心态就稳了。它不是漏洞,是设计。平台故意把单档价格定在一个让重度用户觉得划算到离谱、让轻度用户又懒得算账的位置,用价格差把两拨人圈进同一个池子里互相平衡。
聊到这我得插一句我自己的体感。我平时的活儿就是给大模型搭那层让它真能干活的工程脚手架,agent 的工具链、调度、还有最让人头秃的 token 预算管理,都得我来盯。所以对这个数字我有种职业性的敏感。
在 API 那一侧,token 是会呼吸的钱。你写的每一个 prompt、每一次让 agent 多跑一轮工具调用、每一段塞进上下文窗口的历史记录,后台都在哗哗跳数。我们做 agent 的人有个长期的紧箍咒,叫 context 越长越烧钱,而 agent 干活又偏偏离不开长 context。它得记着前面几十轮在干嘛,得把相关文件读进来,得保留报错信息好下一步重试。这一圈下来,一个稍微复杂点的编码任务,烧掉几百万 token 太正常了。
正因为天天在 API 这边按 token 抠成本,我看到订阅那侧能 70 倍地放开供应,才会有种荒诞的割裂感。同样一桶水,一边按毫升收费、我得拧着龙头省着用,另一边直接给你接根消防水管说随便冲。

那是不是意味着,所有人都该立刻退了 API、全员冲订阅?
先别急。这里有个特别关键、但很多人会忽略的点,订阅的便宜是有形状的。
它便宜,但它把你框在一个固定的笼子里。你只能用平台给你的那个客户端、那个网页、那个官方 CLI,撞了 5 小时窗口就得歇着等回血,撞了周上限就得干等下一周。你没法把这份额度拆出来喂给自己写的程序,没法在凌晨三点让一个无人值守的脚本连轴转,没法把它接进你自己搭的那套自动化流水线里。
而 API 贵,贵在它是自由的。它是一段可以被任意调用的能力,你想拿它干嘛都行,半夜定时跑批、接到自己的服务里、给一百个并发请求同时供能。SemiAnalysis 那个 14000 美元的折算,恰恰说明了一件事,真要在生产环境里把模型当水电一样稳定供应,那个成本是真实存在的,跑不掉。订阅之所以能压到 1/70,是用使用方式的自由度换来的。
这俩压根不是同一种商品。订阅卖的是一个人坐在电脑前的劳动时间,你的手速、你的脑子就是天然的限流器,一个人一天能跟 AI 来回扯的轮次是有上限的,平台赌的就是这个生理上限。API 卖的是脱离了人的、可以无限并发的纯算力,机器不知疲倦,能 7 乘 24 地榨,所以它必须按量收费,否则真会被人用脚本榨穿。
所以那个 70 倍的差价,拆到底,就是人肉限流和机器无限之间的鸿沟。你一个人用 Claude Code 写代码,再勤快也快不过自己敲键盘和读屏的速度,平台拿你没风险,干脆给你个看着吓人的额度让你爽。但你要是想把这份能力变成一个能自己跑的服务,对不起,请走 API,按桶结账。
想通这点,我那点心虚也就没了。我不是在占平台便宜,我只是在用一个被精心设计过的、专门留给人肉重度用户的甜价位而已。
那最后一个问题,也是 SemiAnalysis 和评论区都在担心的,这价能撑多久?
实话讲,我也判断不准,谁也判断不准。但有几个力在那儿拽着,方向能看个大概。
往下拽的那股力很硬。模型推理是真烧钱,烧的是英伟达的卡、是数据中心的电、是越来越紧张的算力供给。SemiAnalysis 自己就是扒这条供应链起家的,他们比谁都清楚那笔账有多重。当越来越多的人学会了把订阅往死里榨,当 agent、自动化编程这些天生吃 token 的玩法变成主流,那个温和用户的安全垫会越来越薄。垫子一薄,平台要么涨价,要么收紧上限,要么把最肥的那档默默砍掉。这种事我们已经见过苗头了,各家时不时调一次限额,调的时候往往还不发公告。
往上托的那股力也不弱。推理成本在掉,掉得还挺快,厉害了,模型蒸馏、量化、专用推理芯片,每一项都在把单位 token 的成本往下压。蒸馏(distillation,简单说就是拿一个大模型当老师,训出一个小而快、能力却差不太多的学生模型)这两年进步飞快,今天跑同样的活,单位成本比一年前低了不止一个档。再加上各家抢市场抢得头破血流,谁也不敢在这个节骨眼上先涨价把用户推给对手。
这两股力拧在一起,我猜短期内价格不会崩,但那个 70 倍的甜头,大概率会慢慢被磨平。今天你撞墙能折出 8000 美元,明年同样的钱可能就只折得出 3000 了。不是因为它变贵,是因为上限被悄悄勒紧,温和用户的补贴池被这帮越来越精的重度玩家给抽干了。
所以如果你现在真是个重度编码用户,我的态度很简单,这碗饭趁热吃。该上 Max 20x 就上,把它当成一段限时的算力红利,别等。这种平台用真金白银补贴用户养习惯的窗口,历史上从来没有长开过的。网约车补贴、外卖大战、视频会员一块钱包月,哪个不是先撒钱养你、养熟了再慢慢收。
但同时,别把你的核心业务、那些必须 7 乘 24 跑的自动化流程,整个架在订阅这根随时会被勒紧的绳子上。那种活,老老实实走 API,按桶结账,账算得清,心里也踏实。订阅是给你这个人爽的,API 才是给你的程序用的。这两件事别混。
写到这我突然想起万青那句,是谁来自山川湖海,却囿于昼夜厨房与爱。这帮模型何尝不是。它们被训出来的时候,吞过整个互联网的山川湖海,能写诗能证明定理能跟你聊到天亮。结果落到我们手里,最后绝大多数的算力,都囿于改 bug、写周报、和一个又一个等回血的 5 小时窗口里。
70 倍的差价,量的是技术的慷慨。而那个被悄悄勒紧的上限,量的是生意的清醒。
我们这些坐在中间的人,能做的就是趁慷慨还在的时候,多航行一段,同时心里清楚,潮水总会退的。退潮那天,留在沙滩上的,是那些早就把自己的活儿算明白了的人。
至于今晚,我还是会打开 Claude Code,接着跑我那个老是超时的 agent。配额还在,礁石也还在。航行嘛,本来就是这么回事。