Anthropic 删减了其 80% 的系统提示词指令,并推出了 Opus 5。这是一款全新的 Claude Code 模型,能够自主运行数天甚至数周,并在 Arc AGI 基准测试中获得了 30% 的评分。这种被称为“按下删除键”(press-delete)的重新设计,被该公司称为“解缚”(unhobbling)策略,旨在让 AI 的原生能力得以释放,摆脱通常将大型语言模型限制在“仅限聊天”模式下的软件枷锁。

为什么这一变化至关重要

Anthropic 的工程师过去习惯于为 Claude 添加密集的防护栏——即通过明确的提示词告知模型该说什么、不该说什么以及如何保持任务目标。这些提示词就像一条皮带,防止模型陷入未经测试的行为,但也限制了它的能力上限。当 Opus 5 发布时,团队删除了整个提示词堆栈,然后逐一重新添加指令,并测量每条指令的影响。由于新模型的能力更强,他们舍弃了大部分原始措辞,却依然能获得可靠的结果。现在,系统能够理解高层级目标,并生成完整的代码文件和功能。

技术收益

  • 基准测试飞跃 – Opus 5 在 Arc AGI 基准测试中达到了 30% 的分数,该指标衡量模型解决新颖问题的能力。早期的 Claude 版本得分远低于此,这表明其原生推理能力有了实质性的飞跃。
  • 更长的自主性 – “Auto Mode”功能允许模型长时间运行,维持自身的上下文并在无需人类不断干预的情况下取得进展。在实践中,开发者可以向模型交付一份规格说明书,让其迭代数日,仅在达到里程碑时进行检查。
  • 增强针对提示词注入的防御能力 – 提示词注入通过在用户输入中嵌入恶意指令,诱导模型忽略其安全规则。Anthropic 表示,得益于内部研究和能够标记可疑模式的专用分类器,Opus 5 比其前代产品能更好地抵御此类攻击。他们还建议在启动前定义退出标准和防护栏。

对开发者和企业的意义

对于构建 AI 驱动工具的初创公司而言,这一变化扩大了“产品悬置”(product overhang)——即模型能力与周边软件允许其发挥的能力之间的差距。通过消除这种悬置,Claude Code 可以将简单的聊天界面转变为全栈开发助手,能够自主编写、测试和重构代码。采用该模型的企业可以减少在重复性编码任务上花费的时间,从而让工程师腾出精力从事更高层级的设计工作。

“解缚”(unhobbling)的真正含义

Cherny 创造了“unhobbling”一词,用来描述将强大的模型从人为约束中解放出来。在许多 AI 产品中,开发者会刻意限制模型的尝试范围,因为 UI 或政策框架尚未准备好承载模型的全部能力。其结果就是出现了“产品悬置”现象,即 AI 处于一种“空有潜力却无法施展”的状态。Claude Code 将这种潜力带到了现实层面,让模型成为软件的共同作者,而不仅仅是一个问答机器人。

给创始人与学生的建议

  • 识别悬置点 – 寻找那些现有 AI 工具在接近其当前极限时会遇到困难的任务。这些都是“低垂的果实”,采用“解缚”方法可以带来超额回报。
  • 挑战模型极限 – 给 AI 分配一些略微超出其宣传能力的任务。通过减少提示词摩擦,模型的内部推理能力可能会令你感到惊喜。
  • 定义明确的防护栏 – 在让模型在无人监管的情况下运行之前,请设定退出条件(例如最大运行时间、资源上限)和安全检查。这可以让 AI 在风险可控的情况下进行探索。

学生应当将理论与实践相结合。掌握算法固然重要,但将这些知识与产品思维和数据驱动的实验相结合,才能成为下一波“AI 原生”建设者。

后续关注点

核心要点: 通过删除大部分系统提示词,Anthropic 让更智能的模型在极少人工干预的情况下运行,将 Claude Code 转变为能够处理长达数周项目的自主编程助手。