🔥 HN 热议

AI包月真的能多用五倍吗?先看懂那只“用量表”

约3分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
API换算价值(API换算价值)

把包月服务能用的量换成按量付费价格的估计。

令牌(令牌)

人工智能处理文字时使用的小片段。

A/B测试(A/B测试)

只给一小部分用户换条件的比较试验。

发生了什么

2026年10月5日,SemiAnalysis(研究人工智能费用的分析媒体)发布了一篇比较AI包月服务的文章。文章比较了Anthropic(制作Claude的人工智能公司)和OpenAI(制作ChatGPT的人工智能公司)等公司的服务。原文

标题说,Anthropic的包月服务比OpenAI提供了五倍以上的价值。这里的“价值”不是回答有多聪明,而是把包月服务能用多少,换算成按量付费时要花多少钱。文章在中档模型上比较了Opus 5.5和GPT 6.1 Sol,并报告说,在指定条件下,Anthropic一边的API换算价值约为五倍。

这并不表示Claude聪明五倍,也不表示每个人都能完成五倍的工作。它只表示,在这次测量使用的模型、任务和价格条件下,包月服务看起来更划算。

它怎样计算

包月服务通常只显示一只用量表。用量表可能按五小时、七天,或者某个模型单独计算。它不会直接告诉用户还剩多少令牌。令牌是人工智能处理文字时使用的小片段。

SemiAnalysis反复发送要求,尽量分开测量输入、缓存写入、缓存读取和输出。每次发送后,研究人员观察用量表移动了多少,再估算多少令牌会消耗多少额度。他们把不同时间段的结果合并,直到误差范围约为正负5%,再换算成公开API价格。

API换算价值的意思是:如果用同样数量的文字,通过按量收费的API购买,大概要付多少钱。它不是实际退款,也不是回答质量分数。模型完成同一件事时,可能需要不同数量的令牌,所以这个数字不能单独代表真正的工作效率。

背景和重要性

包月价格很容易理解,但服务方的成本会随使用量增加。文章的概算认为,Anthropic的包月收入约占总收入10%,却可能消耗40%以上的推理计算资源。这说明包月服务既能吸引用户,也可能增加计算成本。

文章还追踪了OpenAI的计划变化。它报告说,OpenAI把200美元计划的API换算价值降低了一半,并增加了500美元计划。变化前购买的200美元计划,据文章说会保留较高上限到10月29日。这说明月费不变时,能用的量也可能改变。

能确认什么,以及为什么受关注

测试中,同一家服务商的三个相似账户里,有一个账户的上限低了约20%。服务商解释说,这是一个极小规模的A/B测试。这个结果说明,连续观察用量表,可能发现服务条件的变化。但它不能说明所有用户都会得到相同上限。

这篇文章在Hacker News上获得79分和90条评论。讨论页面说明它受到了社区关注。分数和评论数量只表示关注度,不能证明原文结论正确。

还不能确认什么

这是一张特定时间的快照。结果依赖所选模型、任务形式、包月规则和当时的API价格。文章没有完整回答:哪个模型能用更少令牌完成同一项真实工作,也没有单独证明哪个模型对每位用户更有用。

详细表格和实时数据面板并不是全部公开的。模型发布、价格下降或用量规则变化后,结果都可能改变。因此,“五倍”必须和测量条件一起阅读。

接下来关注什么

更好的比较应该使用同一个任务、同一份输入和同一个完成标准,同时记录令牌数量、完成时间、答案质量和用量重置。还要看服务商是否公开准确上限,以及API降价后包月上限是否同步增加。只有这样,读者才能知道“五倍”在哪些条件下成立,什么时候不成立。

💬 HN评论要点:5倍是API价格换算,不等于5倍的实际工作价值

评论区没有证明 Anthropic 一定比 OpenAI 划算5倍。争议集中在:API价格换算能否代表真实工作量、不同模型的token能否直接比较、用量上限和重置是否可预测,以及本地模型能否替代云端模型。下面的数字、性能和故障都来自评论者自述或个人粗算,不是总体测量。

  • 文章把订阅能获得的使用量按API按量计费价格换算,再得出超过5倍的价值。评论者指出,这只是在估算按API价格计算的token量,没有直接测量回答质量、速度和完成同一任务所需的token数。
  • 不同服务使用不同的tokenizer,同一段文字不一定会得到相同的token数量。一位评论者以未验证的个人观察称,Claude完成类似工作似乎用了约5倍token,而且更慢。
  • 另一位评论者把每周一到两次的重置计入自己的粗略计算,称Astra/Fable比较为1.2到1.7倍,Sol/Opus比较为0.7到1.04倍。这只是个人概算,不是独立测量。
  • 一位评论者自述,三个条件相同的账户中有一个的上限低了约20%,得到的解释是一次很小的A/B测试。这是个例,不能证明所有用户都如此。
  • 另一位评论者自述,ChatGPT Pro有6.2万积分,两天用了约4000,并觉得重置像是随机发生的。这说明有人认为规则难以预测,但不能证明平台故意操纵。
  • 另一位使用者自述,6.1会碰到上限,而且运行很慢。因此,看起来更省token,可能只是因为速度慢,而不一定代表效率更高。
  • 关于本地AI,一位用户自述并主张,花2,000到4,000美元买设备,就能在家里把Opus 4.8跑得比Anthropic更快。另一位评论者反驳说,本地模型并不等于当前最强的云端模型,只是在某些用途上够用。

这是评论数为90时的初期(修订1)。获取90条,并从整体抽取90条总结。内容属于HN用户自述,并非编辑部核实的事实。

🔥 HN 热议

Claude的包月服务,真的多五倍吗?

📰 完整报道: AI包月真的能多用五倍吗?先看懂那只“用量表”

AI包月服务的价格相同,能用的量却可能不同。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
用量表(用量表)

显示服务还剩多少可用量的表。

API换算价值(API换算价值)

把包月用量换成按量收费价格的数字。

A/B测试(A/B测试)

只改变一小部分人的条件来比较。

💡 一句话总结

  • SemiAnalysis比较了Claude和OpenAI的包月服务。
  • 在一种测试条件下,Claude的API换算价值约高五倍。
  • Hacker News有79分和90条评论,但这不等于结论正确。

2026年10月5日,SemiAnalysis(研究人工智能费用的分析媒体)发布了这项比较。Anthropic(制作Claude的人工智能公司)和OpenAI(制作ChatGPT的人工智能公司)都提供包月服务。

包月服务让用户每月付一次钱。可是,用户能用多少,常常只由一只用量表显示。用量表可能按五小时或七天计算。它不一定告诉用户还有多少令牌。令牌是人工智能处理文字时的小片段。

研究人员反复发送要求,然后观察用量表减少多少。他们分别测试输入、缓存文字和输出。这样可以估计一项服务能提供多少文字。

API换算价值,是把包月能用的量换成按量付费的价格。测试比较了Opus 5.5和GPT 6.1 Sol。文章说,指定条件下,Claude一边约为五倍。

但是,五倍不是聪明五倍。它也不是每个人都能多做五倍工作。不同任务会使用不同数量的令牌。模型的回答质量,也不能只看这个数字。

文章还说,OpenAI改变了200美元计划的上限,并增加了500美元计划。同样的月费,后来可能买到不同的使用量。

测试中,三个相似账户有一个少了约20%的额度。服务商说,这是极小规模的A/B测试。由此可见,用户条件有时可能不同。

Hacker News的分数说明这篇文章受关注。它不是事实检验。接下来应该用同一个任务比较价格、用量、速度和答案质量。

💬 易懂版:5倍这个数字,还不能决定谁更划算

文章把订阅能使用的AI量换成API价格,得出 Anthropic 比 OpenAI 划算5倍以上。评论者说,还要看AI能不能做好工作、速度够不够快,以及用量上限是否稳定。下面都是用户经历和粗略计算,不是统一实验。

  • Token可以理解成AI处理文字的小片段,但不同AI的切分方法不同。一位评论者以未验证的自述称,Claude用了约5倍token,而且更慢。
  • 另一位评论者把每周重置也算进去,个人粗算出Astra/Fable为1.2到1.7倍,Sol/Opus为0.7到1.04倍。不过,这只是粗略计算。
  • 用户自述显示,用量上限可能不同:有人说三个类似账户中有一个少了约20%;另一个人说两天用了6.2万积分中的约4000,并觉得重置难以预测。
  • 另一位用户自述,6.1仍会碰到上限,而且很慢。所以,套餐写出的token数量不等于每个人能完成的工作量。
  • 有人认为本地AI已经足够应付自己的需求;也有人说它还不等于最强的云端模型,是否够用要看任务。

这是评论数为90时的初期(修订1)。获取90条,并从整体抽取90条总结。内容属于HN用户自述,并非编辑部核实的事实。

🔥 HN 热议

AI的包月小盒子,里面有多少?

📰 完整报道: AI包月真的能多用五倍吗?先看懂那只“用量表”

同样每月付钱,AI能做的事情可能不一样。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Anthropic(Anthropic)

制作Claude的人工智能公司。

OpenAI(OpenAI)

制作ChatGPT的人工智能公司。

令牌(令牌)

人工智能数的文字小片段。

Anthropic(做Claude的人工智能公司)和OpenAI(做ChatGPT的人工智能公司)都有包月服务。

SemiAnalysis(查人工智能花费的团队)想看看这些服务能用多少。

人工智能会把话分成小字块。 这些小字块叫令牌。

研究人员让人工智能做了很多次事情。 他们看着一只用量表。 用量表会告诉他们快用完没有。

文章说,在一种条件下,Claude的服务约有五倍价值。 这是按买字块的价格算出来的。 它不是说Claude聪明五倍。 它也不是说每个人能做五倍事情。

Hacker News上有79分和90条评论。 这表示很多人看到了这篇文章。 这不表示文章一定正确。

我们还要看看同一个工作谁做得好。 还要看看谁用的字块更少。

💬 5岁版:只数AI的小碎片,还不知道谁做得更好

文章说,Anthropic的月费AI可能比OpenAI多给5倍的使用量。评论者说,还要看AI能不能把事情做好。这些只是一些人的体验,不是给所有人的公平测试。

  • 不同AI数文字的方法不一样。一位用户自述,Claude用了大约5倍的小片段,而且很慢;另一份大概的计算把重置也算进去后,结果只差不多是一倍多。
  • 用户自述,有的相似账户少了约五分之一,有人两天用了6.2万积分里的约4000,重置看起来很奇怪,还有人说6.1很慢并碰到了上限。所以,每个人看到的情况可能不同。
  • 有人觉得家里的AI已经够用,也有人说它没有最强的在线AI厉害。哪一个最好,要看你要做什么。

这是评论数为90时的初期(修订1)。获取90条,并从整体抽取90条总结。内容属于HN用户自述,并非编辑部核实的事实。

来源