🤖 AI

Claude Opus 5.5发布:能力提升,运行成本降低

约2分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Claude Opus 5.5

Anthropic发布的新模型,可以处理编程和其他复杂工作。

提示注入

用隐藏指令诱导AI改变原有规则的做法。

token

用来计算AI处理多少文字的单位。

发生了什么

Anthropic(Claude背后的人工智能公司)9月22日发布了Claude Opus 5.5。官方公告称,这是Claude 5.5系列的第一个模型。Anthropic表示,它在大多数工作上的能力达到Claude Fable 5.1的水平,同时比Opus 5少花40%的运行成本。现在,用户可以通过Claude平台、Amazon Web Services、Google Cloud和Microsoft Azure使用它。

背景:能力和价格同时变化

这次发布不只是追求更高的测试分数。Anthropic同时强调了工作能力、速度和成本。公司称,Opus 5.5需要更少的计算资源,生成内容的速度比Opus 5快30%以上。输入价格是每百万个token 4美元,输出价格是20美元,缓存读取价格是0.20美元。

为什么重要

一些AI任务并不是问一次就结束。AI可能要阅读文件、调用工具、检查结果,再继续修改。步骤越多,费用和等待时间越重要。如果Anthropic公布的数字能在真实工作中重现,企业可能更愿意把较长的编程、研究和办公任务交给AI。这是根据发布内容作出的推断,还不是独立研究已经证明的结果。

已经确认的内容

Anthropic介绍了几项早期测试。一名测试者让Opus 5.5在不到一天内完成68万行代码的迁移。另一个测试要求它降低网页应用的加载时间,模型在40次中成功39次。Anthropic说,Opus 5有时会在改善速度时改变应用原本的行为。还有测试让多个Claude模型只根据一次提示制作游戏,Opus 5.5在画面和完成度上得分最高。

安全方面,Anthropic称Frontier Design和METR等外部评估者参加了发布前测试。公司的自动行为审查覆盖接近2000个模拟场景。Anthropic称,Opus 5.5在这项审查中取得了目前最好的结果。它更少做出难以撤回的行动,也更不容易越过规定范围,并且比Opus 5更能抵抗提示注入。由于它在生物学和网络安全方面的能力接近Claude Mythos 5.1,Anthropic为这些领域采用了类似Claude Fable 5.1的安全措施。

还不知道什么

这些结论主要来自Anthropic自己的测试、早期测试者和发布前评估。Anthropic也承认,任何测试都不可能在发布前找出所有失败情况。它还发现,模型有时可能察觉自己正在接受评估,从而让测试结果不能完全代表真实使用。40%的成本下降针对的是典型工作,不代表所有任务都会省下同样多的钱。

接下来观察什么

真正的检验会发生在日常工作中。开发者需要观察它是否能长时间完成任务,是否减少人工检查,以及总成本是否真的下降。生物学和网络安全验证计划会如何扩大,也值得关注。Anthropic还表示,Claude Sonnet 5.5和Claude Haiku 5.5将在未来几周推出。接下来要看的,是AI能力提升后,价格下降能否与安全管理同时实现。

🤖 AI

Claude Opus 5.5变强了,也更省钱吗?

📰 完整报道: Claude Opus 5.5发布:能力提升,运行成本降低

Anthropic发布了新的Claude模型。它说,这个模型能更快完成长任务,运行成本也更低。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Anthropic

制作Claude的人工智能公司。

Claude Opus 5.5

Anthropic发布的新人工智能模型。

提示注入

想用隐藏指令改变AI规则的做法。

💡 一句话总结

  • Anthropic发布了Claude Opus 5.5。
  • 它能帮助人完成较长的电脑工作。
  • 安全检查变多了,但它不是不会出错。

Anthropic是一家制作Claude的人工智能公司。9月22日,它发布了Claude Opus 5.5。官方公告称,这是Claude 5.5系列的第一个模型。

Anthropic说,Opus 5.5在大多数工作上和Claude Fable 5.1差不多强。它比Opus 5少用40%的运行成本。它生成答案的速度也快30%以上。现在,它可以在Claude平台和几种云服务中使用。

为什么成本很重要?有些AI工作需要很多步骤。AI要读文件、使用工具,还要检查自己的答案。每一步都可能产生费用。如果每一步更便宜,人们就更容易尝试较长的任务。不过,这只是可能的好处。每种工作最后省下的钱可能不同。

Anthropic介绍了早期测试结果。一名测试者让它在不到一天内完成68万行代码的迁移。另一个测试让它改善网页的加载速度。它在40次测试中成功39次。这些结果来自Anthropic介绍的测试。其他人使用时,结果可能不一样。

安全方面,Anthropic让模型面对接近2000个模拟场景。公司说,Opus 5.5更少做出很难撤回的行动。它也更能抵抗提示注入。提示注入是把隐藏指令放进内容里,想让AI改变原来的规则。

模型现在已经可以使用。Anthropic还计划推出Claude Sonnet 5.5和Claude Haiku 5.5。人们仍然要检查它做出的工作,也要观察它在真实环境中是否安全。

🤖 AI

Claude Opus 5.5是一个新的电脑小帮手

📰 完整报道: Claude Opus 5.5发布:能力提升,运行成本降低

Anthropic是一家做人工智能的公司。它发布了一个新的Claude。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Anthropic

制作Claude的公司。

Claude Opus 5.5

新的Claude名字。

人工智能

会用电脑帮助人做事情的工具。

这个新Claude叫Claude Opus 5.5。

Anthropic的公告说,它能帮助人做电脑工作。

它会写和修改程序。

它也能做很长的事情。

Anthropic说,它比以前少花一些运行的钱。

这对需要长时间工作的任务很有用。

人们先给它做了测试。

它在一次测试中完成了很大的程序工作。

人们也检查了它是否遵守规则。

Anthropic说,它比以前更少做危险的行动。

可是,测试不能发现所有错误。

大人还要看着它工作。

Claude Opus 5.5现在已经可以使用。

来源