OpenAI 在九个月后关闭了 Atlas。该项目曾是一个雄心勃勃的尝试,旨在构建一个专门为 AI Agent 设计的浏览器——一个软件可以登录网站、填写表单并执行网络任务,而无需等待人类输入的地方。现在,这些功能正在迁移到 OpenAI 的桌面应用和 Chrome 扩展程序中。实验结束了,但教训是深刻的:用户并不想要另一个应用程序。他们希望自己已经在使用的应用程序变得更加智能。
独立浏览器的陷阱
Atlas 不是为人类设计的浏览器,而是为 Agent 设计的。从理论上讲,这种分离是有意义的。一个干净的环境可以让 AI 完全控制视口,而不会受到现有扩展程序、杂乱的书签或冲突脚本的干扰。Agent 可以自由导航、处理身份验证并操作网页,而不会被人类的浏览习惯所绊倒。
但用户并不生活在干净的环境中。他们的密码、会话 Cookie、双重身份验证流程和肌肉记忆都存在于 Chrome、Edge 或 Safari 中。要求某人打开一个单独的浏览器以便让 AI 代表其工作,会制造即时的障碍。上下文切换的成本很高。当你已经在为研究、电子邮件和项目管理同时处理二十个标签页时,你最不想做的就是为了让 Agent 处理任务,而将任务复制到一个陌生的沙盒中。流程被打断了,耐心也耗尽了。
以报销这类常规工作为例。一名典型的员工需要从 Gmail 中提取收据,对照日历条目进行核对,然后将总额粘贴到公司门户网站中。在 Atlas 中,这意味着要将凭据交给一个陌生的浏览器,并寄希望于 Agent 能正确处理所有这三个服务。而在 Chrome 中,扩展程序可以读取已经打开的 Gmail 标签页,参考旁边的日历标签页,并在用户观察每一项输入时协助填写门户表单。用户无需离开座位,更不用离开他们的主浏览器。这种日常摩擦力的差异,正是“人们可以忍受的工具”与“人们会放弃的工具”之间的区别。
信任需要可见性
Atlas 还凸显了一个更深层次的问题。完全自主的 Agent 目前还不够可靠,人们也深知这一点。当一个 AI 使用你的身份登录银行、提交税务表单或预订航班时,你会希望看到它正在做什么。Atlas 将 Agent 隔离在自己的容器中。眼不见,心不烦,但在这种情况下,这削弱了信心而非建立信心。
Agent 仍会误读按钮、幻觉出表单字段,并被 CAPTCHA 难住。当这些问题发生在一个你平时从不使用的“黑盒”浏览器中时,这种失败感会显得陌生且不可信。通过将功能移至 Chrome 扩展程序,OpenAI 将 Agent 带入了用户的常规视野中。扩展程序可以在购买前暂停并请求确认,可以高亮显示它不确定的字段,也可以在任务变得敏感时让用户接管控制权。信任不是一次性授予的;它是通过人类保持主导地位的重复交互建立起来的。
安全团队也有同感。公司管理浏览器策略、将扩展程序列入白名单,并审计 Chrome 或 Edge 内工具的权限。像 Atlas 这样的独立浏览器处于该生态系统之外。IT 部门无法轻易对其应用标准的安全策略。通过转向 Chrome 扩展程序,OpenAI 顺应了一个合规框架和权限模型已经存在的环境。如果该工具希望在实际企业中获得采用,这一点至关重要。
三个重要的产品准则
Atlas 在仅九个月后便宣告终结,这为目前任何构建 AI 工具的人强化了三条硬性准则。
平台熟悉度胜过新奇感。 不要再要求用户切换环境了。看看 GitHub Copilot。它没有要求开发者离开他们的 IDE;它出现在 VS Code、IntelliJ 和 NeoVim 中。这就是它能够留存的原因。Atlas 忽视了这一点。开发者应该在用户每天工作的地方与他们汇合。如果受众生活在 Slack 中,就构建一个 Slack 集成。如果他们在 Chrome 中浏览,就构建一个扩展程序。目标应该是零学习曲线,而不是让用户去掌握一个新的界面。
低摩擦是不可逾越的底线。 每增加一次下载、注册或迁移步骤,都会扼杀用户采用率。安装一个 Chrome 扩展只需两次点击和十秒钟。而下载新浏览器、迁移书签、更改默认设置以及调整工作流,则需要多出好几个数量级的精力和注意力。最好的 AI 功能感觉像是对用户已经习惯使用的软件进行的升级,而不是需要去管理的全新软件。
信任需要明确的控制点。 用户需要的是护栏,而不仅仅是自主权。想想 Grammarly 是如何标出问题并等待你接受或忽略它的。想想 1Password 是如何仅在你刻意点击图标时才填充密码字段的。成功的工具会展示其推理逻辑并提供检查点。智能体应当辅助工作流,而不是劫持它。Atlas 通过将新环境与高风险的自主权结合在一起,过快地索求了过多的信任。它要求用户完成一次大多数人尚未准备好跨越的双重飞跃。
市场仍在校准中
更广泛的行业一直在追求一个能够取代整个应用程序的全自动智能体的梦想。初创公司经常推销“AI 员工”的概念,声称在人类退场的同时,它们可以处理整个工作职能。Atlas 证明了时机尚未成熟。人们还没有准备好将敏感的工作流委托给在隔离状态下运行的、不可见的进程。他们希望助手能嵌入到现有的工具栈中,并在他们的监督下执行特定任务。
这在计算历史上并不罕见。电子表格并没有在一夜之间取代会计师;它们只是将现有的账本数字化了。Slack 也没有立即杀死电子邮件;它吸收并重定向了电子邮件。新技术只有在依附于旧习惯时才能取得成功,而不是在要求重写这些习惯时。Atlas 试图取代浏览器本身,而浏览器赢了。
下一步是什么
OpenAI 现在正专注于更紧密的集成和更多的人工监督。这种说法听起来很官僚,但实际意义很简单:智能体将存在于你的常规工作流中,而你将掌握控制权。Chrome 扩展将让智能体看到你所看到的。桌面应用将在不让你离开当前屏幕的情况下提供帮助。这种转变承认了:最终胜出的智能体不会是那个在隔离状态下工作最努力的,而是那个能最自然地融入现有的、复杂的人类工作流中的智能体。
在不久的将来,成功的 AI 智能体将是垂直领域的,而非通用的。它们会在 Gmail 内部整理邮件,在现有的阅读器中总结 PDF,并在当前的浏览器标签页中填写表单。它们会在点击之前询问。它们会显眼且优雅地出错,就在你可以纠正它们的地方,而不是在一个隐藏的沙盒中。
Atlas 的终结是
