OpenAI 发布 GPT-5.6 和 ChatGPT Work,旨在实现复杂工作流的自动化

随着 GPT-5.6 的正式推出和 ChatGPT Work 的引入,OpenAI 已正式迈入自主智能体(autonomous agents)时代。这一举措将 ChatGPT 从一个对话式聊天机器人转型为一名主动的工作者,能够跨多个软件环境管理完整的端到端项目。

从聊天机器人到自主智能体的演进

本次发布的核心是 ChatGPT Work,这是一款适用于移动端、网页端和桌面端的全新产品,它将 Codex 技术直接集成到了 ChatGPT 生态系统中。与需要逐步提示的标准 LLM 交互不同,ChatGPT Work 旨在跨各种应用程序和文件进行长时间运行。它只需接收单个提示词,即可交付完成的专业输出——例如填写完整的 Excel 表格或 Word 文档——而无需人类持续干预。

这一进展表明 ChatGPT 和 Codex 正在战略性地合并为一个统一的“超级应用”。通过将 Codex 的专业能力带给通用知识工作者,OpenAI 正致力于直接竞争 Anthropic 最近推出的 “Cowork”,这标志着 AI 智能体领域正爆发一场大规模军备竞赛。

统一插件与第三方集成

2023 年 OpenAI 之前的插件生态系统面临的一个主要障碍是模型成熟度不足。随着 GPT-5.6 的部署,OpenAI 正试图通过全新的 “Unified Plugins Directory” 来解决这一问题。该目录为第三方集成提供了一个中心化枢纽,允许智能体访问以下数据:

  • 生产力与沟通: Google Drive, SharePoint, Slack, Microsoft Teams, Gmail, Outlook, and Zoom.
  • CRM 与专业工具: Salesforce, LinkedIn, and GitHub.
  • 创意与存储: Adobe, Canva, and Dropbox.

用户可以使用 “@” 提及来显式触发这些工具,或者允许 GPT-5.6 模型自主判断完成任务需要哪些数据源,例如将原始的客户研究资料转化为完整的营销活动简报。

安全、部署与基于用量的计费

随着这些智能体获得了执行操作和访问敏感公司数据的能力,安全性变得至关重要。OpenAI 引入了 “Auto-Review” 功能,由高级模型充当第二层防御,在执行关键操作之前对其进行审核。在对抗性红队测试(red-teaming)期间,OpenAI 报告称该功能拦截了 100% 的试图提取受保护数据的尝试。

此次发布将分阶段进行,优先向网页端和移动端的 Pro、Enterprise 和 Edu 用户开放,而适用于 Mac 和 Windows 的 ChatGPT 桌面应用将立即面向所有层级的用户开放,包括免费用户。

ChatGPT Work 的计费方式不同于标准的聊天订阅。它采用了一种基于智能体的消耗池,并与 Codex 和 Workspace Agents 共享。任务成本是动态的,根据其复杂程度、规模以及所使用的特定模型进行缩放。企业管理员可以使用 “Spend Controls” 在工作区或个人用户层面管理这些成本。

核心要点

  • 智能体工作流 (Agentic Workflow): ChatGPT Work 利用 GPT-5.6 和 Codex 超越了简单的聊天,实现了长期、多步骤专业项目的自主执行。
  • 深度集成: Unified Plugins Directory 将智能体连接到 Salesforce、Slack 和 Google Drive 等核心企业工具,实现无缝的数据处理。
  • 新经济模式: OpenAI 正在摆脱固定费率的聊天模式,转而实施一种基于用量的消耗模型,以适应自主任务的计算强度。