配套视频

浏览器智能体与计算机使用——配套视频

文章将浏览器智能体定位为一种真实但适用范围有限的能力:适合重复、边界明确的Web任务,但凡涉及判断或实时登录就容易出问题。下面的视频会让你看到实际过程——先看Anthropic展示Claude如何从桌面端驱动一个涉及多个应用的小任务,再看OpenAI在真实网站上演示Operator发布时的表现,包括出错、请求确认和交还控制权。

首选视频

02:04
Claude|通过计算机使用功能编排任务

Anthropic

Anthropic用两分钟演示Claude如何通过直接操控桌面来规划一项涉及多个应用的小任务——搜索Web、查看Maps、添加日历邀请。它与下方Operator演示中仅使用云端浏览器的模式形成鲜明对比,也能帮助你直观验证文章的观点:计算机使用智能体最适合短小、边界清晰的事务,而不是开放式工作。

您应该从中获得什么: 比较桌面端计算机使用行为与仅使用浏览器的智能体。

先观看或了解: 先阅读配套文章中的安全章节;下方的Operator演示将补充浏览器端视角。

AI Expert 注释: 这是一段简短的能力演示,不是部署指南。若没有沙箱隔离、账户隔离、日志记录,以及用户对会改变状态的操作给予明确批准,请勿将其照搬到生产环境。

打开视频页面

也值得关注

23:51
Operator与智能体简介

OpenAI

这是Operator的实际发布演示。团队用它预订餐厅、购买杂货和活动门票,也展示了Operator如何因重定向而停滞,或遇到登录时将控制权交还给用户。这是了解浏览器智能体实际使用体验最清晰的材料:截屏与点击的循环、执行“有状态”操作前的确认,以及防范提示词注入的护栏——这些细节正是文章希望帮助你建立的合理预期。

您应该从中获得什么: 识别浏览器智能体的操作循环,了解它适合哪些场景,以及哪些环节仍需人工确认。

先观看或了解: 基本了解智能体,以及为什么实时Web任务比文本生成更困难。

AI Expert 注释: 产品名称和可用性可能会变化。Operator作为独立产品已于2025年并入ChatGPT的智能体模式——观看本视频是为了理解交互模式,而不是了解该产品。长期有效的经验在于控制模型:任务范围要窄、状态要可见、操作要确认、提供接管路径,并防范提示词注入。

打开视频页面