🔥 HN 热议

Claude公开“开场指示”:同一个AI为何会有不同表现

约2分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Anthropic(安思洛普)

开发Claude的人工智能公司。

系统提示词

服务在用户提问前交给AI的指示。

Claude API

开发者在自己软件中使用Claude的接口。

发生了什么

Anthropic(开发Claude的人工智能公司)在官方文档中说明,Claude网页端和手机应用会在每次对话开始时使用“系统提示词”。它是用户提问前,服务先交给AI的一段指示。文档举例说,它可以提供当天日期,也可以引导Claude用Markdown格式展示代码示例。

这份页面在Hacker News上获得587个积分和241条评论。数字只表示该技术社区的关注程度,不证明原页面内容正确。本文关于产品的事实,以Anthropic官方文档为依据。

背景:提问之前还有一层指示

用户会对AI说“帮我解释”或“帮我整理”。但在这之前,服务本身也能先给AI一组说明,用来放入当前环境的信息,或规定回答的表达方式。这组说明就是系统提示词。

Anthropic说,网页端和手机应用所用的系统提示词会定期更新,以改善回答。这里要分清两个概念。模型是生成语言的核心;系统提示词则是一次产品使用中的开场说明。说明改变后,即使模型名称不变,日期处理、代码排版或回答呈现方式也可能不同。

为什么重要

公开这类指示,能让用户更容易理解AI回答的来处。回答不只受用户问题影响,也可能受服务在对话前加入的说明影响。

它也提醒开发者,不要把不同入口当作完全一样。官方文档明确说,这些系统提示词的更新不适用于Claude API。Claude API是开发者把Claude接入自己软件的方式。因此,网页端看到的表现,不能直接当作自建应用中的表现。

已能确认的内容

官方文档确认,Claude网页端、iOS应用和Android应用会在每次对话开始时使用系统提示词。文档列出日期信息和代码格式习惯作为用途示例,并称这类提示词会不定期更新。

文档还说,从Claude 4.6这一代开始,每个模型ID对应一个固定快照。因此,这些模型ID在该页面各有一条记录。

还不知道什么

这份文档没有量化每次更新会让日常回答改变多少。它也没有说明所有使用场景都会有相同的显示或行为。要比较具体差异,仍需在明确条件下分别测试网页、应用和API。

接下来该看什么

以后值得关注的是,更新内容是否持续容易查找和比较。用户在比较回答前,也可以先确认自己使用的是哪个Claude入口。AI的表现不只由模型名称决定;对话开始前放入的指示,同样可能产生影响。

💬 关于 Claude 系统提示词的讨论

评论围绕公开提示词变长、它对质量和成本的可能影响、安全措施应放在哪里,以及为何仍要让提示词可修改展开。许多说法是用户观察或推断,尚不能证明因果关系。

  • 一位评论者的比较称,早期系统提示词略多于300词,近期版本超过3,000词。读者认为,模型路由、最新事件和儿童安全等运行说明推动了增长。
  • 有人把这种增长比作建筑规范或合同:事故与漏洞出现后,规则会不断累积。一个重要反驳是,冗长且互相矛盾的指令,可能连在无关场景中也降低回答质量。
  • 性能影响尚无定论。有用户自述,数千个提示词 token 占用了宝贵的上下文,可能伤害结果;也有人指出,“performant”可能指回答质量更高而非更快,并且 Transformer 的每 token 计算成本并不恒定。
  • 有人介绍了用 Git 历史追踪公开提示词改动的项目。其中的比较突出了一些新增说明:让模型正确处理训练数据截止日期之后发生的模型可用性变化和当前政治事件。
  • 评论者认为,不应把这些规则完全写死在模型权重中,因为文字提示词更容易更新,也能按产品或任务调整。前缀缓存被视为降低重复成本的办法;微调则被说明为并不等同于提供输入指令,不能轻易替代。
  • 一种解释称,公开的这些提示词用于消费者聊天产品,并不直接作用于 API。相关的补充是,Claude Code 另有未公开提示词,其缓存 token 成本由用户承担。
  • 大家较一致地认为,系统提示词不能是唯一的安全机制。建议把训练、较快的输入/输出分类器及其他带外匹配或路由结合起来;提示词则用于纵深防御,并帮助给出更自然的拒绝。

这是评论数为241时的初期(修订1)。获取100条,并从整体抽取100条总结。内容属于HN用户自述,并非编辑部核实的事实。

🔥 HN 热议

Claude在回答前会先读一段说明

📰 完整报道: Claude公开“开场指示”:同一个AI为何会有不同表现

网页和手机里的Claude,会先收到服务给它的说明。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
系统提示词

AI聊天开始前读到的说明。

Claude API

让软件使用Claude的工具。

💡 一句话总结

  • Claude在聊天前会读系统提示词。
  • 网页端和手机应用会使用它。
  • Claude API不会自动得到这些更新。

Anthropic是开发Claude的公司。 用户输入问题前,Claude可以先读一段说明。 这段说明叫系统提示词。

它不是用户写的问题。 它由服务先交给AI。 它可以告诉Claude当天日期。 它也可以提醒Claude怎样展示代码。

模型和系统提示词不是一回事。 模型负责生成语言。 系统提示词负责说明这次聊天的规则。 所以,说明更新以后,回答的样子可能改变。 模型名称却不一定改变。

Anthropic说,网页端和手机应用的说明会定期更新。 目的是改善回答。 但这些更新不会自动用在Claude API上。

API让开发者能在自己的软件里使用Claude。 因此,自己软件中的Claude,可能和网页里的Claude不同。 这不一定表示其中一个出了问题。 它们开始时收到的说明可能不同。

这份官方页面也在Hacker News受到关注。 它有587个积分和241条评论。 这表示那里有很多人注意到它。 它不表示页面中的话因此一定正确。 确认产品事实时,还是要看Anthropic的官方说明。

这份页面没有告诉我们,每次更新会改变回答多少。 不过它提醒我们:AI的回答不只来自问题,也会受开场说明影响。

💬 很长的 AI 规则有用吗?

Claude 在回答前会先得到一组规则。大家在讨论这些规则为什么变长,以及这是不是好事。

  • 一项用户比较称,规则从约300词变成了3,000多词。新增内容看来与安全和较新的信息有关。
  • 一种看法认为,规则会像建筑安全规范一样,发现问题后不断增加。另一种看法担心,规则太多或互相冲突会让回答变差。
  • 长规则会不会影响性能,还没有结论。有用户自述它会占用上下文;也有人说“性能”可能是回答更好,不一定是更快,技术成本也更复杂。
  • 把规则保留为文字,能更容易地为不同产品和任务修改。缓存重复的开头内容,可能减少重复计算。
  • 安全不能只靠这些文字规则。评论者还提到训练,以及在主模型前后使用的独立检查。

这是评论数为241时的初期(修订1)。获取100条,并从整体抽取100条总结。内容属于HN用户自述,并非编辑部核实的事实。

🔥 HN 热议

Claude先读小纸条

📰 完整报道: Claude公开“开场指示”:同一个AI为何会有不同表现

Claude说话前,会先读一张小纸条。

约1分钟读完 Tiny Why编辑部 · 文:特派员 好奇

词语
Anthropic(安思洛普)

做Claude的公司。

系统提示词

Claude先读的小纸条。

Anthropic是做Claude的公司。

Claude先读小纸条。 然后才读你的问题。

这张纸叫系统提示词。

纸上可以写今天的日期。 纸上也能写回答的方法。

网页里的Claude会读它。 手机里的Claude也会读它。

这张纸有时会换新。

Claude API不会自动换这张纸。 API能让别的应用使用Claude。

Hacker News也在谈这张纸。 很多人看了这个页面。

很多人看,不等于一定是真的。 要看Anthropic的说明。

💬 AI 的规则本

AI 说话前,会先看一本规则本。

  • 有人说,这本规则本变长了。里面多了安全提醒。
  • 长一点可能有帮助。可是有人担心,太长会让 AI 糊涂。
  • 规则本不是唯一的安全帮手。还有别的检查员可以一起帮忙。

这是评论数为241时的初期(修订1)。获取100条,并从整体抽取100条总结。内容属于HN用户自述,并非编辑部核实的事实。

来源