AI News字数 2817阅读时长8 分钟

OpenAI 为 ChatGPT Work 添加安全网站登录功能

ChatGPT Work 现可通过安全表单在网站上进行身份验证,并在不向模型暴露密码的情况下继续执行委托的浏览器任务。

文章目录 · 12
  1. 一、ChatGPT Work 现在可在登录页面之后执行操作
  2. 二、凭据与 AI 模型隔离
  3. 三、这改变了云端浏览器发布时的限制
  4. 四、权限与确认仍限制操作
  5. 五、网站可以识别并控制 ChatGPT 流量
  6. 常见问题
  7. ChatGPT 能看到我的网站密码吗?
  8. ChatGPT Work 会使用我手机或电脑上已经登录的账户吗?
  9. 我每次执行任务都需要登录吗?
  10. 登录后,ChatGPT 能完成每一项预订或交易吗?
  11. 哪些方案可获得已验证身份的云端浏览功能?
  12. 参考来源

OpenAI 已为 ChatGPT Work 的云端浏览器添加已验证身份的网站访问能力,取消了此前将远程智能体限制在公开页面的约束。现在,当委托任务进入支持的登录页面时,用户可以完成登录,随后 ChatGPT 即可在已验证身份的会话中继续工作。

关键在于凭据的处理方式。用户通过安全登录表单输入用户名、密码以及任何双重身份验证代码。OpenAI 表示,这些凭据会直接发送到远程浏览器:模型无法看到这些信息,ChatGPT 也不会存储它们。

这将云端浏览器从研究和公开表单工具扩展为能够与个人和企业账户交互的智能体。OpenAI 举例包括查看公用事业套餐、查找政府预约、保存公寓房源、核对发票,以及更新会计记录。

一、ChatGPT Work 现在可在登录页面之后执行操作

ChatGPT Work 的云端浏览器运行在 OpenAI 云基础设施中的一台独立计算机上。它可以读取页面、点击控件、输入信息,并在支持的网站上执行多步骤任务。用户可通过 ChatGPT 网站或移动应用中的 Work 发起任务;无需另行选择云端浏览器模式。

当网站要求身份验证时,任务会暂停。ChatGPT 会向用户展示安全登录流程,而非在对话中索取凭据。用户完成身份验证后,ChatGPT 会在由此产生的账户会话中恢复原任务。

这改变了委托浏览的实际适用范围。公开访问足以比较航班、查看产品可用性或收集信息,但许多行政工作流依赖账户专属数据和需验证身份的表单。保险门户、公用事业账户、政府预约系统、供应商仪表板、会计服务和房产平台,通常都会将工作流中有用的部分置于登录页面之后。

OpenAI 的公告通过查看保险报销费用、准备车辆登记材料、预约网络内医生、提交医疗报销表、安排包裹取件,以及将电子邮件中的发票转入会计软件等任务,说明了这一更广泛的适用范围。任何单项任务能否成功,仍取决于网站、用户权限以及所需执行的操作。

即使用户关闭 ChatGPT 或关闭设备,云端浏览器也能继续运行。当需要信息、身份验证或批准时,它会再次暂停,让在移动端发起的任务能够在远程计算机上继续进行,而非在手机本身上执行。

二、凭据与 AI 模型隔离

安全表单是这一新设计的核心安全边界。OpenAI 表示,在其中输入的用户名和密码会直接发送到远程浏览器,不会展示给模型。ChatGPT 也不会存储这些凭据。

这一区别的范围,比“ChatGPT 无法访问账户”的说法更窄。身份验证完成后,智能体可以使用已登录的浏览器会话查看页面,并执行用户请求的任务。它从这些页面读取的信息,将按照用户的 ChatGPT 数据控制设置处理。

在 ChatGPT 展示登录请求之前,额外的审查模型会检查该请求及预定的凭据接收目标是否存在网络钓鱼或欺骗迹象。用户可在继续前查看网站地址、预览登录表单,并查看实时页面。

双重身份验证仍是需要用户交互的步骤。如果网站请求验证码或安全代码,用户应通过安全流程提供,而非将其输入对话。OpenAI 明确告知用户,绝不要将密码、安全代码或支付信息粘贴到聊天中。

身份验证可以在任务结束后持续有效。云端浏览器会保留自己的 Cookie 和已登录会话,因此用户可能无需再次进行身份验证,直至会话过期或浏览器数据被清除。用户可在 ChatGPT 设置中删除所有云端浏览器数据,或清除单个网站的数据;清除某网站的数据会使浏览器退出该服务。

三、这改变了云端浏览器发布时的限制

在发布时,OpenAI 的文档称,云端浏览器无法接收凭据、使用自动填充或密码管理器、登录网站,或完成支付。当任务遇到身份验证时,它会停止。

新的安全流程专门移除了登录障碍。这并不意味着所有交易或网站都受支持。OpenAI 表示,网站可能会阻止自动化访问,某个登录或交易步骤可能仍不受支持,或者 ChatGPT 本身可能会限制某项操作。用户可能需要接管远程浏览器,或手动完成最后一步。

已验证身份的云端浏览也不同于 ChatGPT 桌面应用内置的浏览器。桌面浏览器在 macOS 或 Windows 应用中可见,并支持自己的登录、密码管理、扩展程序、下载和多个标签页。云端浏览器则在远程运行,旨在用于可在后台继续执行的委托 Work 任务。

远程浏览器不会继承用户个人浏览器的状态。它无法使用用户设备浏览器中现有的标签页、历史记录、扩展程序、保存的密码、Cookie 或活跃会话。因此,当 ChatGPT Work 首次遇到每个账户时,都必须分别完成身份验证。

四、权限与确认仍限制操作

云端浏览器访问可通过受支持地区付费方案中的 ChatGPT Work 使用,不包括 Free 和 Go。OpenAI 表示,在推广期间,可用性可能有所不同,也可能取决于工作区权限。Work 本身正逐步向符合资格的账户推出。

用户可以控制云端浏览器访问网站的方式。默认行为是在访问新网站前请求许可。设置还提供自动审查选项,在 URL 看似不安全时暂停;以及 OpenAI 不建议使用的“始终允许”选项。针对特定网站的单独允许或阻止规则,可以覆盖默认设置。

允许打开某个网站,与允许执行具有后果的操作是两回事。ChatGPT 被设计为在可能难以撤销,或会产生财务、法律、账户或其他现实世界承诺的步骤之前请求确认。OpenAI 举例包括确认预订和进行支付。

用户还可以要求直接接管云端浏览器。ChatGPT 会提供一个链接,可在手机或计算机上打开实时远程会话;当智能体遇到不受支持的控件,或用户希望亲自检查页面时,这很有用。

这些保障措施降低了凭据暴露和意外操作的风险,但 OpenAI 并未声称它们能够消除风险。其文档建议用户核实地址、登录预览、截图和确认请求;如果浏览器进入错误的网站或账户,则应停止任务。

五、网站可以识别并控制 ChatGPT 流量

目标网站的支持仍是一项实际限制。自动化智能体检测、机器人管理系统、异常登录检查以及不受支持的界面元素,都可能导致任务无法完成,即使同一网站在常规浏览器中可以正常使用。

OpenAI 使用 Web Bot Auth 为发出的云端浏览器请求签名。该实现遵循 RFC 9421 定义的 HTTP Message Signatures 标准,并包含 SignatureSignature-InputSignature-Agent 标头。Signature-Agent 的值用于识别 ChatGPT,而公开可用的密钥允许网站或网络提供商验证该请求确实来自 OpenAI 的浏览器智能体。

大型基础设施提供商可以在其机器人控制中使用这些签名。OpenAI 为 Akamai、Cloudflare、HUMAN 和 Vercel 记录了具体的识别路径。其他运营方可以获取 OpenAI 的公钥、验证签名标头,并决定是否允许该流量。

因此,已验证身份的浏览并不会让 ChatGPT 获得对任意账户的无限制访问。它为用户提供了一种将凭据隔离的方式,以授权远程浏览器,同时保留网站阻止该智能体的能力,并保留用户对具有后果操作的确认权。

常见问题

ChatGPT 能看到我的网站密码吗?

OpenAI 表示,通过安全登录表单输入的用户名和密码会直接发送到远程浏览器。模型无法看到这些信息,ChatGPT 也不会存储它们。

ChatGPT Work 会使用我手机或电脑上已经登录的账户吗?

不会。云端浏览器拥有独立的 Cookie 和会话,不会继承用户个人浏览器的登录状态、密码、历史记录或标签页。

我每次执行任务都需要登录吗?

不一定。已验证身份的云端浏览器会话可以持续有效,直至其过期,或用户清除该网站的浏览器数据。

登录后,ChatGPT 能完成每一项预订或交易吗?

不能。网站限制、不受支持的步骤、产品安全规则和确认要求,都可能阻止任务完成,或要求用户接管操作。

哪些方案可获得已验证身份的云端浏览功能?

OpenAI 记录了面向受支持地区付费方案中 ChatGPT Work 的云端浏览器访问能力,不包括 Free 和 Go。可用性可能因推广进度和工作区设置而有所不同。

参考来源

Share

分享这篇文章