AI包月真的能多用五倍吗?先看懂那只“用量表”
API换算价值(API换算价值)
把包月服务能用的量换成按量付费价格的估计。
令牌(令牌)
人工智能处理文字时使用的小片段。
A/B测试(A/B测试)
只给一小部分用户换条件的比较试验。
发生了什么
2026年10月5日,SemiAnalysis(研究人工智能费用的分析媒体)发布了一篇比较AI包月服务的文章。文章比较了Anthropic(制作Claude的人工智能公司)和OpenAI(制作ChatGPT的人工智能公司)等公司的服务。原文
标题说,Anthropic的包月服务比OpenAI提供了五倍以上的价值。这里的“价值”不是回答有多聪明,而是把包月服务能用多少,换算成按量付费时要花多少钱。文章在中档模型上比较了Opus 5.5和GPT 6.1 Sol,并报告说,在指定条件下,Anthropic一边的API换算价值约为五倍。
这并不表示Claude聪明五倍,也不表示每个人都能完成五倍的工作。它只表示,在这次测量使用的模型、任务和价格条件下,包月服务看起来更划算。
它怎样计算
包月服务通常只显示一只用量表。用量表可能按五小时、七天,或者某个模型单独计算。它不会直接告诉用户还剩多少令牌。令牌是人工智能处理文字时使用的小片段。
SemiAnalysis反复发送要求,尽量分开测量输入、缓存写入、缓存读取和输出。每次发送后,研究人员观察用量表移动了多少,再估算多少令牌会消耗多少额度。他们把不同时间段的结果合并,直到误差范围约为正负5%,再换算成公开API价格。
API换算价值的意思是:如果用同样数量的文字,通过按量收费的API购买,大概要付多少钱。它不是实际退款,也不是回答质量分数。模型完成同一件事时,可能需要不同数量的令牌,所以这个数字不能单独代表真正的工作效率。
背景和重要性
包月价格很容易理解,但服务方的成本会随使用量增加。文章的概算认为,Anthropic的包月收入约占总收入10%,却可能消耗40%以上的推理计算资源。这说明包月服务既能吸引用户,也可能增加计算成本。
文章还追踪了OpenAI的计划变化。它报告说,OpenAI把200美元计划的API换算价值降低了一半,并增加了500美元计划。变化前购买的200美元计划,据文章说会保留较高上限到10月29日。这说明月费不变时,能用的量也可能改变。
能确认什么,以及为什么受关注
测试中,同一家服务商的三个相似账户里,有一个账户的上限低了约20%。服务商解释说,这是一个极小规模的A/B测试。这个结果说明,连续观察用量表,可能发现服务条件的变化。但它不能说明所有用户都会得到相同上限。
这篇文章在Hacker News上获得79分和90条评论。讨论页面说明它受到了社区关注。分数和评论数量只表示关注度,不能证明原文结论正确。
还不能确认什么
这是一张特定时间的快照。结果依赖所选模型、任务形式、包月规则和当时的API价格。文章没有完整回答:哪个模型能用更少令牌完成同一项真实工作,也没有单独证明哪个模型对每位用户更有用。
详细表格和实时数据面板并不是全部公开的。模型发布、价格下降或用量规则变化后,结果都可能改变。因此,“五倍”必须和测量条件一起阅读。
接下来关注什么
更好的比较应该使用同一个任务、同一份输入和同一个完成标准,同时记录令牌数量、完成时间、答案质量和用量重置。还要看服务商是否公开准确上限,以及API降价后包月上限是否同步增加。只有这样,读者才能知道“五倍”在哪些条件下成立,什么时候不成立。
Claude的包月服务,真的多五倍吗?
📰 完整报道: AI包月真的能多用五倍吗?先看懂那只“用量表”
AI包月服务的价格相同,能用的量却可能不同。
用量表(用量表)
显示服务还剩多少可用量的表。
API换算价值(API换算价值)
把包月用量换成按量收费价格的数字。
A/B测试(A/B测试)
只改变一小部分人的条件来比较。
💡 一句话总结
- SemiAnalysis比较了Claude和OpenAI的包月服务。
- 在一种测试条件下,Claude的API换算价值约高五倍。
- Hacker News有79分和90条评论,但这不等于结论正确。
2026年10月5日,SemiAnalysis(研究人工智能费用的分析媒体)发布了这项比较。Anthropic(制作Claude的人工智能公司)和OpenAI(制作ChatGPT的人工智能公司)都提供包月服务。
包月服务让用户每月付一次钱。可是,用户能用多少,常常只由一只用量表显示。用量表可能按五小时或七天计算。它不一定告诉用户还有多少令牌。令牌是人工智能处理文字时的小片段。
研究人员反复发送要求,然后观察用量表减少多少。他们分别测试输入、缓存文字和输出。这样可以估计一项服务能提供多少文字。
API换算价值,是把包月能用的量换成按量付费的价格。测试比较了Opus 5.5和GPT 6.1 Sol。文章说,指定条件下,Claude一边约为五倍。
但是,五倍不是聪明五倍。它也不是每个人都能多做五倍工作。不同任务会使用不同数量的令牌。模型的回答质量,也不能只看这个数字。
文章还说,OpenAI改变了200美元计划的上限,并增加了500美元计划。同样的月费,后来可能买到不同的使用量。
测试中,三个相似账户有一个少了约20%的额度。服务商说,这是极小规模的A/B测试。由此可见,用户条件有时可能不同。
Hacker News的分数说明这篇文章受关注。它不是事实检验。接下来应该用同一个任务比较价格、用量、速度和答案质量。
💬 易懂版:5倍这个数字,还不能决定谁更划算
文章把订阅能使用的AI量换成API价格,得出 Anthropic 比 OpenAI 划算5倍以上。评论者说,还要看AI能不能做好工作、速度够不够快,以及用量上限是否稳定。下面都是用户经历和粗略计算,不是统一实验。
- Token可以理解成AI处理文字的小片段,但不同AI的切分方法不同。一位评论者以未验证的自述称,Claude用了约5倍token,而且更慢。
- 另一位评论者把每周重置也算进去,个人粗算出Astra/Fable为1.2到1.7倍,Sol/Opus为0.7到1.04倍。不过,这只是粗略计算。
- 用户自述显示,用量上限可能不同:有人说三个类似账户中有一个少了约20%;另一个人说两天用了6.2万积分中的约4000,并觉得重置难以预测。
- 另一位用户自述,6.1仍会碰到上限,而且很慢。所以,套餐写出的token数量不等于每个人能完成的工作量。
- 有人认为本地AI已经足够应付自己的需求;也有人说它还不等于最强的云端模型,是否够用要看任务。
这是评论数为90时的初期(修订1)。获取90条,并从整体抽取90条总结。内容属于HN用户自述,并非编辑部核实的事实。
AI的包月小盒子,里面有多少?
📰 完整报道: AI包月真的能多用五倍吗?先看懂那只“用量表”
同样每月付钱,AI能做的事情可能不一样。
Anthropic(Anthropic)
制作Claude的人工智能公司。
OpenAI(OpenAI)
制作ChatGPT的人工智能公司。
令牌(令牌)
人工智能数的文字小片段。
Anthropic(做Claude的人工智能公司)和OpenAI(做ChatGPT的人工智能公司)都有包月服务。
SemiAnalysis(查人工智能花费的团队)想看看这些服务能用多少。
人工智能会把话分成小字块。 这些小字块叫令牌。
研究人员让人工智能做了很多次事情。 他们看着一只用量表。 用量表会告诉他们快用完没有。
文章说,在一种条件下,Claude的服务约有五倍价值。 这是按买字块的价格算出来的。 它不是说Claude聪明五倍。 它也不是说每个人能做五倍事情。
Hacker News上有79分和90条评论。 这表示很多人看到了这篇文章。 这不表示文章一定正确。
我们还要看看同一个工作谁做得好。 还要看看谁用的字块更少。
💬 5岁版:只数AI的小碎片,还不知道谁做得更好
文章说,Anthropic的月费AI可能比OpenAI多给5倍的使用量。评论者说,还要看AI能不能把事情做好。这些只是一些人的体验,不是给所有人的公平测试。
- 不同AI数文字的方法不一样。一位用户自述,Claude用了大约5倍的小片段,而且很慢;另一份大概的计算把重置也算进去后,结果只差不多是一倍多。
- 用户自述,有的相似账户少了约五分之一,有人两天用了6.2万积分里的约4000,重置看起来很奇怪,还有人说6.1很慢并碰到了上限。所以,每个人看到的情况可能不同。
- 有人觉得家里的AI已经够用,也有人说它没有最强的在线AI厉害。哪一个最好,要看你要做什么。
这是评论数为90时的初期(修订1)。获取90条,并从整体抽取90条总结。内容属于HN用户自述,并非编辑部核实的事实。
💬 HN评论要点:5倍是API价格换算,不等于5倍的实际工作价值
评论区没有证明 Anthropic 一定比 OpenAI 划算5倍。争议集中在:API价格换算能否代表真实工作量、不同模型的token能否直接比较、用量上限和重置是否可预测,以及本地模型能否替代云端模型。下面的数字、性能和故障都来自评论者自述或个人粗算,不是总体测量。
这是评论数为90时的初期(修订1)。获取90条,并从整体抽取90条总结。内容属于HN用户自述,并非编辑部核实的事实。