07 · 第一次使用:从启动到完成任务
首次进入项目、授权信任、发送任务、检查修改和验证结果的完整流程,用一个最小示例跑通第一次代理任务。
看了再多,不如亲手跑一次。这一篇用一个最小例子,走完 Claude Code 的第一次完整任务。
第一步「进入项目」:Claude Code 要在一个工作目录里运行,因为它要读这个目录的文件、把改动写回这个目录。先找一个不重要的项目目录(或新建一个空目录),在里面启动它。
第二步「授权信任」:首次在一个目录里跑,它会问你是否信任这个目录、允许它读写。这是安全机制,确认无误后放行。
第三步「发送任务」:这是最关键的一步。别只说「帮我改一下」,要讲清三件事——你想达成什么目标、它该关注哪些文件、做完你希望看到什么结果。说得越具体,返工越少。
第四步「检查修改」:它做完先别急着收工,用 diff 之类的工具逐条看它改了啥。这是「它干、你审」里的「审」。
第五步「验证结果」:真正跑起来看——跑测试、跑构建、或手动点一遍。只有验证通过,任务才算完成。
这五步「进目录—授权—说任务—审差异—跑验证」就是后面所有工作流的母版。现在跑的是最小版本,但每一步都在。
如果它中途停下来问你,别烦,那通常是它在做有风险的动作前要你拍板。这说明安全机制在正常运转,不是坏事。
跑通这一次,你对「代理式编程」就有了最直观的感觉,后面的内容都是在给这个感觉加深度。
一个自查清单:当你读完这一篇时,可以问自己三个问题——它解决的是什么具体问题?我当前的工作/学习里有没有这个场景?下一步我该学哪一篇?把这三个问题答清楚,你就知道自己有没有真正吃透。
动手试一下:你可以花 5 分钟做一个最小验证——找一个真实的代码任务,让 Codex 跑一遍,看它的行为是不是和这一篇描述的一致。理论与实践对照,才知道「懂」和「会用」是两件事。
延伸阅读:学完这一篇,你可以看本组里的下一篇,把相邻的概念连起来读;也可以跳到更后面的组学 MCP、子代理、Skills 这些更深的能力。知识是网状的,多跳几篇会理解更深。
判断决策树:用三个问题判断该不该用——① 这件事值不值得用 Codex 做?② 用的话该用哪个入口?③ 风险高不高需不需要审批?三个问题的答案一出来,怎么做就清楚了。