文章摘要
专业测试团队对多家主流AI大模型订阅套餐开展极限压力测试,测算实际Token价值后得出:同价位订阅中,Anthropic提供的实际API等价Token价值约为OpenAI的5倍,推翻了此前OpenAI更大方的认知。面对订阅业务亏损两家采取不同调整策略,国内高阶套餐中MiniMax性价比突出,目前Anthropic订阅性价比断层领先。

专业分析机构的最新实测显示,花费相同金额订阅AI大模型服务,Anthropic提供的Token实际价值是OpenAI的5倍以上,这一结果打破了不少开发者此前的认知。

很多人可能不知道,当前全球主流AI厂商的会员订阅业务,本质上都依靠厂商高额补贴维持运营。以Anthropic为例,其订阅用户仅贡献了10%的整体收入,却消耗了整整41.7%的推理算力,这直接将每兆瓦算力的综合收入拉低了3600万美元。如果用户完全打满200美元Claude套餐的Opus 5.5额度,该订单的毛利率甚至会达到负369%。

为了准确测算各家厂商的实际补贴力度和隐藏的用量限制,专业测试团队对多家主流厂商的订阅套餐开展了全面的极限压力测试,最终得到了详实的对比数据。

海外头部厂商的订阅格局变化

上个月,OpenAI对其订阅体系进行了大幅调整,直接将200美元ChatGPT Pro套餐的Token额度砍掉了一半,同时推出了定价更高的500美元档位。这一调整让OpenAI和Anthropic之间的订阅价值差距被进一步拉开。

我们先来看两家的顶级旗舰模型对比:GPT-6 Astra与Claude Fable 5.1。在200美元月费档位下,ChatGPT Pro可兑换价值2897美元的API等价Token,而Claude Max的这一数值为2485美元。不过Anthropic对旗舰模型设置了50%的额度上限,也就是说用户用完2485美元的Fable额度后,账户中仍有一半额度可以用于调用其他模型;而OpenAI的套餐在消耗完2897美元的额度后,整个账户就彻底没有可用资源了。

真正的差距体现在日常编程和生产力场景最常用的中端主力模型上,也就是Opus 5.5与GPT-6.1 Sol的对比。在200美元月费档位下,Claude Max可调用286亿个Token,折合API价值11726美元,达到月费的58.6倍;而ChatGPT Pro仅能调用102亿个Token,折合API价值2084美元,仅为月费的10.4倍。

在100美元月费档位,Claude Max 5x可调用140亿个Token,API价值5725美元;ChatGPT Pro 100则仅能调用51亿个Token,API价值1055美元。在20美元的入门档位,Claude Pro可调用29亿个Token,价值1178美元;ChatGPT Plus仅能调用10亿个Token,价值211美元。

无论在哪一个价位段,Anthropic给到用户的实际API等价价值都达到了OpenAI的5倍左右,Token总量也接近OpenAI的3倍。此前独立开发者圈子里流传的“OpenAI比Anthropic更大方”的说法,已经被这次实测数据彻底推翻。

如何揭开厂商隐藏的用量规则

大多数AI订阅平台的界面只会展示从0%到100%的用量进度条,并不会直接显示用户消耗的Token具体数量。为了将进度条百分比换算为真实的Token数量和美元价值,测试团队设计了一套严谨的逆向工程测试方案。

团队将Token分为四类分别进行测试:未缓存输入、缓存写入、缓存读取以及生成输出。针对输入和缓存的测试,团队使用了《战争与和平》的完整文本:普通输入测试会每次添加随机标记,避免被系统缓存;缓存写入测试会强制创建新的缓存条目;缓存读取测试则使用固定标记,反复读取同一段已经缓存好的文本。而针对输出Token的测试,团队则使用长篇技术论文作为提示词,强制模型生成超长回复内容。

每次调用后,团队都会记录系统消耗的Token数量和进度条移动的百分比。由于进度条并非平滑移动,而是按照固定步长跳跃,测试人员通过累计多次请求的数据,计算出进度条每跳动一个刻度所需的Token数量,最终将测试误差严格控制在5%以内。

在测试过程中,团队还意外捕捉到了厂商的灰度测试行为。三个配置完全相同的账号中,其中一个老账号的额度比另外两个低了20%。在联系厂商后,对方承认确实在极小范围内通过A/B测试悄悄调整用量上限。这也侧面证明,AI厂商可以随时在后台修改用户的订阅额度限制。

面对亏损,两大厂商的不同应对策略

订阅用户的使用量越高,AI厂商的亏损就越严重。面对这块失血严重的业务,OpenAI和Anthropic选择了完全不同的应对路径。

Anthropic的策略是温和调整,也就是所谓的“温水煮青蛙”:他们保留了低阶和中阶模型的超高额度,但对最新最贵的旗舰模型进行严格限制。比如Sonnet 5.5和Opus 5.5依然保持了近60倍的高价值倍数,而最贵的Fable 5.1的价值倍数则骤降到12倍,同时还锁定了50%的用量上限。只要用户主要使用Fable这类高端旗舰模型,Anthropic就能将订阅业务的毛利率拉回到80%的正常软件行业水平。

而OpenAI则选择了更为直接的调整方式:他们没有对不同模型进行精细化区分,而是直接将200美元套餐的所有模型Token额度一刀切砍掉了50%。此前,200美元的Pro套餐中,每1美元可以买到的Token数量是100美元档位的两倍;但经过这次调整后,100美元、200美元和500美元三个档位,每1美元买到的Token数量已经完全没有区别。新推出的500美元套餐,可调用的Astra模型Token仅比老款200美元套餐多了21%,其主要卖点只剩下了每秒300 Token的超高速推理能力。

国内大模型订阅的表现如何

在算力资源相对紧张的背景下,国内多家厂商的编程订阅套餐也提供了不错的补贴力度。整体来看,国内的订阅套餐呈现出一个清晰的规律:购买的套餐价位越高,每1美元能够兑换的Token价值也就越高。

具体数据来看,MiniMax的Token Ultra套餐售价132美元,可兑换价值3088美元的API等价Token,价值倍数达到23.4倍;智谱的GLM Coding Max套餐售价168美元,可兑换1942美元的API价值,倍数为11.6倍;月之暗面的Kimi Code Ultra套餐售价199美元,可兑换1343美元的API价值,倍数为6.7倍。

在每1美元换取的实际价值上,MiniMax的高阶套餐表现尤为突出,甚至超过了OpenAI的GPT-6 Astra,仅落后于Anthropic的主力模型。

综合所有测试数据来看,如果追求极致的性价比和单次订阅能够获得的最大算力池,目前Anthropic的官方订阅依然是断层领先的选择。需要说明的是,本次分析仅为基于实测数据的客观呈现,仅供用户参考。

以上内容不代表本平台立场,仅供读者参考