40 · 操作 Chrome 浏览器指南
连接并操作 Chrome 的安装条件、页面交互、权限确认、调试场景和安全边界,说明浏览器能力适合解决哪些任务。
Claude Code 除了写代码,还能「操作浏览器」。这一篇讲这个能力能干什么、怎么用、边界在哪。
「连接 Chrome」需要一些前置条件:通常是让它连上一个 Chrome 实例(可能需要启动一个带特定参数的 Chrome)。
「页面交互」:连上之后,它能打开网页、点击、填表、抓取内容——替你做那些重复的界面操作。
「权限确认」很重要:它访问哪些网站、做什么操作,往往需要你批准。这是防止它访问不该访问的页面。
「调试场景」是浏览器能力最典型的用途:打开页面看渲染结果、复现一个前端 bug、抓取页面上的报错信息。
「安全边界」是必须强调的:浏览器能力意味着它能看到网页内容、可能接触到你的登录状态。用的时候,注意别让它碰到敏感账户、支付信息。
「适合解决的任务」:前端调试、网页信息抓取、重复的表单操作。判断标准是「这件事本身是在浏览器里做的、且机械可重复」。
「不适合」的场景:涉及敏感账户、支付、隐私数据的操作,别交给它,或者全程盯着。
浏览器能力是一把「双刃剑」,能力越强越要谨慎。先理解风险和启用门槛,再决定用不用。
常见误区:很多新手会把这一篇讲的「基本规则」当成「教条」——什么都严格遵守。其实这些规则的核心是「降低风险、提高效率」,理解了动机,规则就自然内化了,不用死记硬背。
动手试一下:你可以花 5 分钟做一个最小验证——找一个真实的代码任务,让 Codex 跑一遍,看它的行为是不是和这一篇描述的一致。理论与实践对照,才知道「懂」和「会用」是两件事。
延伸阅读:学完这一篇,你可以看本组里的下一篇,把相邻的概念连起来读;也可以跳到更后面的组学 MCP、子代理、Skills 这些更深的能力。知识是网状的,多跳几篇会理解更深。
判断决策树:用三个问题判断该不该用——① 这件事值不值得用 Codex 做?② 用的话该用哪个入口?③ 风险高不高需不需要审批?三个问题的答案一出来,怎么做就清楚了。