🔥 HN 热议

Claude Haiku 5.5主打快与省:把大量小任务交给小模型

约3分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
token

AI处理文字时使用的小片段。

基准测试

用来比较不同AI能力的测试。

子代理

替更大模型完成小步骤的AI。

发生了什么

2026年10月7日,Anthropic(制作 Claude 的人工智能公司)发布了 Claude Haiku 5.5。官方公告说,它面向大量重复、重视成本的工作。例子包括摘要、整理长对话、查询数据库、分类、实时客服、浏览器操作,以及为更大模型处理小任务。Anthropic称,这是自己发布过的最便宜、最快、能力最强的小型模型。

AI处理文字时,会把文字分成一个个 token。一次请求不超过10万个 token时,Haiku 5.5每100万个输入token收费0.10美元,输出收费0.50美元。超过这个长度,价格分别是0.50美元和2.50美元。Anthropic说,平均运行成本约低75%。公告脚注说明,较短请求的价格低90%,较长请求低50%。

背景:让大小模型分工

Anthropic把 Haiku 5.5 放在 Sonnet 5.5 和 Opus 5.5 旁边使用。较大的模型可以处理整体任务。Haiku 5.5可以接手其中较小的步骤。这种角色叫作子代理。Haiku 5.5还是Haiku系列中第一个可以调节工作力度的模型。用户可以选择更重视价格,还是更重视能力。

为什么重要

如果一个服务反复处理同一种小任务,单次费用和等待时间都会累积。Anthropic公布的基准测试显示,Haiku 5.5在OSWorld 2.1离线部分得到72.4%,Haiku 4.5为15.7%。在Terminal-Bench 4.0中,两者分别为39.2%和0.0%。这些测试涉及电脑操作和命令行编程。Sonnet 5.5仍然更高,分别为83.9%和70.6%。因此,公告并没有说小模型能取代所有大模型。

Anthropic还引用了客户的早期测试。Asana称,任务等待时间减少了30%以上,每次代理处理速度最多提高到2.5倍。HubSpot称,Haiku 5.5在自己的客户管理测试中平均得到92.8%。这些是客户和早期测试给出的结果,不代表每个产品都会得到相同成绩。

已确认的范围

Haiku 5.5可以在 Claude 平台使用,也可以通过 Amazon Web Services、Google Cloud 和 Microsoft Azure 使用。Anthropic称,它在减少不当行为和拒绝滥用请求方面比 Haiku 4.5有所改善。它的网络安全防护也更严格,但仍然允许部分防御性工作,并会阻止渗透测试等更容易被攻击者利用的技术。

仍然不知道什么

这些测试结果能否稳定出现在普通工作中,还没有答案。公告没有说明长期错误率、混合使用大小模型时的真实费用,也没有说明团队怎样管理多个模型。客户案例属于早期测试,不是长期运行研究。

下一步看什么

接下来要看真实用户是否会把 Haiku 5.5用于摘要、分类和范围较小的任务。同时还要看,复杂的代理编程是否仍主要交给 Sonnet 或 Opus。真正重要的问题,不只是小模型是否便宜,而是整个系统能否在保持有用准确度的同时降低成本。

Hacker News的数字说明什么

这条消息在Hacker News上获得734分和373条评论。这些数字表示社区关注度,不表示Anthropic的性能和价格说法已经得到证明。

💬 Haiku 5.5:速度快、能力强,但总成本取决于任务

Hacker News 的讨论认为,Haiku 5.5适合短小、明确的工作和子代理;但也有人指出,长时间的代理任务可能让它在价格和单任务成本上失去优势。这里的性能和速度数字来自文章、评论者的自测,或评论者转述的第三方数据,并不是已经确定的全面结论。

  • 一位评论者认为,Haiku 5.5比GPT-6 Luna更聪明,并且在一些编程基准测试中超过了Sonnet 5。这是评论者转述的结果,不能直接推广到所有任务。
  • 在一次图片转HTML的实际测试中,用户报告说Haiku 5.5做不好复杂UI,并把工作交给了Opus 5.5。但同一报告认为它反应很快,适合范围很窄的任务或小型子代理。
  • 讨论中展示的价格表是:提示词不超过10万token时,输入每百万token 0.10美元、输出0.50美元;超过10万后,分别变为0.50美元和2.50美元。超过门槛后,单价提高到5倍。
  • 一条评论转述发布公告称,Haiku 4.5有90%的请求不超过10万token。这说明Anthropic可能把较低价格档视为常见场景,但这个数字来自公告,不代表所有当前用户。
  • 反对者指出,长代理流程很容易超过10万token,因此只看较低价格档,可能会高估Haiku 5.5的竞争力。
  • 单个任务的完成成本也出现相反说法。一位评论者说文章中的基准测试显示Haiku比Luna便宜;另一位引用Artificial Analysis的评论者则说,在不同推理强度下,Haiku大约是Luna的3倍成本。
  • 速度方面,评论者转述的数据包括OpenRouter平均每秒93个token,以及Artificial Analysis每项测试至少每秒137个token。因此它可能适合快速分类、摘要、RAG辅助和问题分流,但复杂任务或总成本上不一定总是最佳。

这是评论数为373时的增长中(修订1)。获取300条,并从整体抽取120条总结。内容属于HN用户自述,并非编辑部核实的事实。

🔥 HN 热议

Claude Haiku 5.5能快速完成许多小任务

📰 完整报道: Claude Haiku 5.5主打快与省:把大量小任务交给小模型

Anthropic(制作 Claude 的人工智能公司)发布了一个更快、更便宜的新模型。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
token

AI处理文字时使用的小片段。

基准测试

比较模型能力的测试。

子代理

替大模型完成小任务的AI。

💡 一句话总结

  • Claude Haiku 5.5适合处理许多小任务。
  • 它想用更低的价格快速工作。
  • Hacker News关注它,但关注不等于证明正确。

Anthropic在2026年10月7日发布了 Claude Haiku 5.5。它可以总结文字。它可以查询数据库。它也可以把消息分成不同类别。这些工作单次不大,却可能每天重复很多次。

AI处理文字时,会使用 token。token是文字中的小片段。Anthropic说,10万个 token以内的请求,价格比 Haiku 4.5低90%。更大的请求,价格低50%。所以,使用的文字量会影响省下的钱。

Claude Haiku 5.5不是要替代所有模型。Sonnet 5.5和Opus 5.5适合更复杂的工作。Haiku 5.5可以接手其中的小步骤。这种小步骤助手叫作子代理。这样,系统可能不用每一步都调用更大的模型。

Anthropic还公布了基准测试。基准测试是比较模型能力的测试。在电脑操作测试中,Haiku 5.5得分72.4%。Haiku 4.5得分15.7%。在编程测试中,两个数字是39.2%和0.0%。不过,这些是公告中的结果。日常工作是否一样,还要继续观察。

这个模型也有安全规则。遇到一些危险请求时,它会拒绝回答。它可以通过 Claude、Amazon Web Services、Google Cloud 和 Microsoft Azure 使用。

Hacker News上有734分和373条评论。这说明它受到关注。不说明所有说法一定正确。

💬 Haiku 5.5很快,但长任务可能更贵

评论者分成两派:一派认为Haiku 5.5适合快速处理小任务,另一派认为复杂任务中,大模型或其他价格方案可能更划算。下面的数字来自评论者的测试或其转述的第三方数据。

  • 有用户报告说Haiku 5.5比Luna更强,并在部分编程测试中超过Sonnet 5。但这些是用户转述的结果。
  • 在图片转HTML的测试中,它做不好复杂页面,把任务交给Opus 5.5;不过用户认为它很快,适合明确而小范围的工作。
  • 价格是:10万token以内,输入每百万token 0.10美元、输出0.50美元;超过后变成0.50美元和2.50美元。转述公告的评论说,旧Haiku 4.5有90%的请求在10万token以内。
  • 长代理任务可能超过10万token。关于单任务成本,评论中有两种相反说法:一方说比Luna便宜,另一方引用Artificial Analysis说大约贵3倍。
  • 评论者转述的速度是每秒93个token左右,另一组测试至少每秒137个token。因此它适合快速分类和摘要,但复杂工作不一定最划算。

这是评论数为373时的增长中(修订1)。获取300条,并从整体抽取120条总结。内容属于HN用户自述,并非编辑部核实的事实。

🔥 HN 热议

Claude Haiku 5.5:会做小任务的AI

📰 完整报道: Claude Haiku 5.5主打快与省:把大量小任务交给小模型

Anthropic(制作 Claude 的公司)发布了一个新的 AI。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Anthropic

制作 Claude 的公司。

Claude Haiku 5.5

Anthropic制作的新AI名称。

Hacker News

人们讨论技术的网站。

AI是可以帮人处理文字的电脑工具。Claude Haiku 5.5可以把一段话变短。它可以找文字。它也可以给消息分类。

这些小任务常常会一遍又一遍地做。Anthropic说,这个AI做得快,花的钱也更少。难一点的任务,可以交给更大的 Claude 模型。

它还有安全规则。遇到一些危险的请求,它可以不回答。

Hacker News是讨论技术的网站。这个消息得到734分和373条评论。这个数字说明很多人注意它。不说明这个消息一定正确。

💬 Haiku 5.5又小又快,但长长的请求会更贵

Haiku 5.5像一个做短工作很快的小助手。遇到很难或很长的工作,大一点的AI可能更好。

  • 有人说它在一些测试里比Luna聪明。但做复杂画面时,它据报道请更大的Opus来帮忙。
  • 短请求比较便宜:10万token以内,输入0.10美元、输出0.50美元;更长时变成0.50美元和2.50美元。有评论者说,旧Haiku的请求大约十个里有九个很短。
  • 完成一件工作的价格没有统一答案:一个结果说它比Luna便宜,另一个结果说它贵约3倍。所以它可能很适合快速分类和摘要,但不一定适合每一种难题。

这是评论数为373时的增长中(修订1)。获取300条,并从整体抽取120条总结。内容属于HN用户自述,并非编辑部核实的事实。

来源