《Cursor文档》-Browser

智能体可以控制浏览器来测试应用、审计无障碍、将设计转化为代码等。智能体可完全访问控制台日志和网络流量,从而调试问题并自动化完整的测试工作流。

对于企业版客户,浏览器控制受 MCP 允许列表或拒绝列表管控。

原生集成

智能体会在聊天中显示屏幕截图等浏览器操作,并在独立窗口或内联窗格中显示浏览器窗口本身。

我们已优化浏览器工具,以提升效率并减少使用量,具体包括:

  • 高效处理日志:浏览器日志会写入文件,智能体可通过 grep 选择性读取。智能体不会在每次操作后汇总冗长输出,而是只读取所需的相关行。这样既能保留完整上下文,又能最大限度地减少使用量。
  • 基于图像的视觉反馈:屏幕截图直接集成到文件读取工具中,因此智能体会以图像形式查看浏览器状态,而非依赖文本描述。这有助于更好地理解视觉布局和 UI 元素。
  • 智能提示编写:智能体会获得有关浏览器日志的额外上下文,包括总行数和预览片段,帮助其判断需要检查的内容。
  • 感知开发服务器:系统会提示智能体检测正在运行的开发服务器,并使用正确的端口,而非启动重复的服务器或猜测端口号。

无需安装或配置任何外部工具,即可使用 Browser。

浏览器功能

智能体可使用以下浏览器工具:

导航

访问 URL 并浏览网页。智能体可通过访问 URL、跟随链接、前进或后退浏览历史记录以及刷新页面,在网页上自由导航。

点击

与按钮、链接和表单元素交互。智能体可识别页面元素并与之交互,对任何可见元素执行单击、双击、右键单击和悬停操作。

输入

在输入框和表单中输入文本。智能体可填写表单、提交数据,并与表单字段、搜索框和文本区域交互。

滚动

浏览较长的页面和内容。智能体可通过滚动显示更多内容、查找特定元素并浏览长篇文档。

屏幕截图

捕获网页的可视化呈现。屏幕截图可帮助智能体理解页面布局、验证视觉元素,并向您确认浏览器操作已完成。

控制台输出

读取浏览器控制台消息、错误和日志。智能体可监控 JavaScript 错误、调试输出和网络警告,以排查问题并验证页面行为。

网络流量

监控网页发出的 HTTP 请求和响应。智能体可跟踪 API 调用、分析请求负载、检查响应状态码,并诊断网络相关问题。目前此功能仅在智能体面板中可用,即将支持布局视图。

会话持久化

浏览器状态会按工作区在智能体会话之间保留。这意味着:

  • Cookie:身份验证 Cookie 和会话数据会在不同浏览器会话之间保留
  • 本地存储:存储在 localStoragesessionStorage 中的数据会持续保留
  • IndexedDB:数据库内容会在不同会话之间保留

浏览器上下文按工作区隔离,确保不同项目各自保持独立的存储和 Cookie 状态。

使用场景

网页开发工作流

Browser 可集成到网页开发工作流中,与 Figma、Linear 等工具协同使用。有关如何将 Browser 与设计系统、项目管理工具和组件库配合使用的完整指南,请参阅 Web Development cookbook

无障碍改进

智能体可以审计并改进网页的无障碍,使其符合 WCAG 标准。

@browser 检查颜色对比度,验证语义化 HTML 和 ARIA 标签,测试键盘导航,并找出缺失的替代文本

自动化测试

智能体可以运行全面的测试套件,并截取屏幕截图进行视觉回归测试。

@browser 使用测试数据填写表单,点击浏览各个工作流,测试响应式设计,验证错误消息,并监控控制台中的 JavaScript 错误

设计转代码

智能体可将设计稿转换为带响应式布局的可运行代码。

@browser 分析此设计稿,提取颜色和字体样式,并生成像素级还原的 HTML 和 CSS 代码

根据屏幕截图调整 UI 设计

智能体可以识别视觉差异,并通过更新组件样式优化现有界面。

@browser 将当前 UI 与此设计屏幕截图对比,调整间距、颜色和排版以与其保持一致

安全

Browser 以安全网页视图的形式运行,并由作为扩展运行的 MCP 服务器控制。多重防护机制可防止未经授权的访问和恶意操作。
Cursor 的 Browser 集成也经过多家外部安全审计机构的评审。

身份验证与隔离

浏览器采用了多项安全措施:

  • 令牌身份验证:Agent layout 会在每次浏览器会话开始前生成随机身份验证令牌
  • 标签页隔离:每个浏览器标签页都会获得唯一的随机 ID,以防止标签页之间相互干扰
  • 基于会话的安全机制:每次开启新的浏览器会话时,都会重新生成令牌

工具批准

默认情况下,浏览器工具需要您批准。请在智能体执行前检查每项操作。这可防止意外跳转、数据提交或脚本执行。

您可以在智能体设置中配置批准设置。可用模式:

模式 描述
手动批准 逐一检查并批准每个浏览器操作 (推荐)
允许列表操作 与您的允许列表匹配的操作会自动运行;其他操作需要批准
自动运行 所有浏览器操作都会立即执行,无需批准 (请谨慎使用)

允许列表和阻止列表

浏览器工具与 Cursor 的安全防护措施集成。您可以配置哪些浏览器操作可自动运行:

  • 允许列表:指定可跳过批准提示的可信操作
  • 阻止列表:指定应始终阻止的操作
  • 通过以下路径访问设置:Cursor 设置 > Agents > 自动运行

允许/阻止列表只能提供尽力而为的保护。由于提示词注入和其他问题,AI 的行为可能难以预测。请定期检查已自动批准的操作。

切勿对不受信任的代码或不熟悉的网站使用自动运行模式。智能体可能会在您不知情的情况下执行恶意脚本或提交敏感数据。

浏览器上下文

浏览器会作为 Cursor 中的窗格打开,智能体可通过 MCP 工具完全控制浏览器。

推荐模型

建议使用 Sonnet 4.5、GPT-5 和 Auto,以获得最佳性能。

企业版用量

企业版客户可在 MCP 控制中切换可用性,以管理浏览器功能。管理员可对各个 MCP 服务器和浏览器访问权限进行精细化控制。

为企业版启用浏览器

要为您的企业版团队启用浏览器功能:

  1. 前往您的设置仪表盘
  2. 进入 MCP 配置
  3. 打开“浏览器功能”开关

配置完成后,您组织中的用户将根据 MCP 允许列表或拒绝列表设置使用浏览器工具。

来源允许列表

企业版管理员可以配置来源允许列表,限制智能体可自动访问的网站,以及 MCP 工具可运行的位置。这样可精细控制浏览器访问权限,满足安全与合规要求。

必须先为您的组织启用 浏览器来源允许列表 功能,该功能才会显示在仪表盘中。请联系您的 Cursor 账户团队申请访问权限。

配置

配置来源允许列表:

  1. 前往 管理员仪表盘
  2. 进入 MCP 配置
  3. 确保已启用 启用 Browser 自动化功能 (v2.0+)
  4. Browser 来源允许列表 (v2.1+) 中,点击 添加来源
  5. 输入要允许的来源 (例如:*http://localhost:3000https://internal.example.com)

将允许列表留空即可允许所有来源。请使用“添加来源”按钮逐个添加来源。

MCP 配置中显示 Browser 来源允许列表设置和“添加来源”按钮

行为

配置来源允许列表后:

  • 自动导航:智能体只能使用 browser_navigate 工具访问来源与允许列表匹配的 URL
  • MCP 工具执行:MCP 工具只能在允许列表中的来源上运行
  • 手动导航:用户仍可手动将浏览器导航至任意 URL,包括允许列表之外的来源 (可用于查看文档或检查外部网站)
  • 工具限制:浏览器一旦访问不在允许列表中的来源,浏览器工具 (点击、输入、导航) 将被阻止,即使该来源是用户手动导航至的

边界情况

来源允许列表只能提供尽力而为的保护。请注意以下行为:

  • 链接跳转:如果智能体点击允许域名上的链接,而该链接跳转到不在允许列表中的来源,跳转仍会成功
  • 重定向:如果智能体跳转到允许的来源后,该来源又重定向到不在允许列表中的来源,重定向仍会被允许
  • JavaScript 跳转:从允许的来源通过客户端跳转 (使用 window.location 或类似方式) 到不在允许列表中的来源,仍会成功

来源允许列表会限制智能体自动跳转,但无法阻止所有跳转路径。请定期评审您的允许列表,并考虑允许访问可能重定向到外部网站或包含外部网站链接的域名所带来的安全影响。

相关内容

羽毛球分组比赛记分
小程序二维码

欢迎使用《羽毛球分组比赛记分》微信小程序

小夜