01 · Claude Code 简介
是什么、能做什么、和 ChatGPT / Copilot / Cursor 到底差在哪
兄弟们,今天聊 Claude Code。
我猜你点进来,大概率是这么个状态:身边总有人念叨「Claude Code 多猛多猛」,X(推特)上隔三差五刷到「一句话让它把项目重构了」的截图,可你打开它的官网,看半天还是没搞懂——它跟我天天用的 ChatGPT 到底差在哪?跟编辑器里那个自动补全的 Copilot 又差在哪?
说白了,名字里带个 Code,很容易让人以为它就是「会写代码的聊天框」。但真上手用过你会发现,这个理解差得有点远。
这一篇不教你装、不教你敲命令(那是下一篇的事)。这一篇只干一件事:把「Claude Code 到底是个啥」给你彻底讲明白,让你心里有个整体地图——知道它能干什么、不能干什么、什么场景该用它而不是别的工具。地图有了,后面每一步才不会走迷糊。
看完这一篇,你会拿到:
- 一句话能跟人解释清楚「Claude Code 是什么」
- 一张「能做 / 不能做」清单,知道它的天花板在哪
- 一张对比表,再也不会把它和 ChatGPT / Copilot / Cursor 搞混
- 一个判断标准:什么活儿该交给它,什么活儿别指望它
01 Claude Code 到底是个啥
先给结论:Claude Code 是 Anthropic 官方出的「命令行版 AI 编程搭档」——它能读你的整个项目、直接改文件、跑命令,而不只是在聊天框里给你回一段代码。
Anthropic 就是做出 Claude 这个大模型的公司(你可以把它理解成 ChatGPT 背后那家 OpenAI 的同行竞品)。Claude Code 就是这家公司专门为「写代码」这个场景做的工具。
这里有个关键区别,新手最容易栽在这:
类比:顾问 vs 坐你旁边的搭档。 网页版的 Claude(或者 ChatGPT)像个顾问——你把代码截图、复制粘贴给他,他看一眼给你出主意,但改代码这事还得你自己回去手动干。Claude Code 不一样,它像个真坐在你工位旁边的搭档:你的整个项目摊在他面前,他能直接翻文件、动手改、改完还能跑一遍看对不对。
这个差别,落到实际就是体验上的天壤之别。
举个例子。用网页版 Claude 改一个 Python 小项目时,流程是这样的:复制报错信息粘进对话框 → 它告诉你可能是哪个文件的问题 → 你切回编辑器找到那个文件 → 复制相关代码再粘回去 → 它给修改建议 → 你再手动抄回编辑器。一个小 bug 来回切五六次窗口,半小时就这么没了。 换成 Claude Code,同样的活儿,你就一句「这个报错你帮我查一下根因然后修了」,它自己翻遍相关文件、定位、改完,喝口水的功夫就好了。
这一下就能体会到「代理(Agent)」这个词的分量——它不是给你建议,是替你动手。
💡 一句话总结:Claude Code = 能读你整个项目、能直接动手改的 AI 编程搭档,不是「会写代码的聊天框」。
02 它在哪儿运行:不止是个黑乎乎的终端
提到「命令行」「终端」,很多新手脑子里立马浮现一个黑乎乎的窗口,瞬间劝退。别慌,这是个常见误解。
终端(Terminal,就是你电脑里那个敲命令的窗口)确实是 Claude Code 最核心、功能最全的形态,但它早就不只活在终端里了。按官方文档,Claude Code 现在有这么几个「身份」:
| 你在哪用 | 形态 | 适合谁 / 什么场景 |
|---|---|---|
| 终端 | 功能最全的 CLI(命令行界面) | 想用全部能力、写脚本、做自动化的人 |
| VS Code / Cursor | 编辑器插件,内联看改动 | 平时就在 VS Code 里写代码的人 |
| JetBrains | IntelliJ / PyCharm 等插件 | Java / Python 重度用户 |
| 桌面 App | 独立应用,可视化看 diff、并行多会话 | 不想碰命令行、喜欢点界面的人 |
| 网页 / 手机 | 浏览器或 Claude iOS App 里跑 | 临时起个长任务、出门用手机盯进度 |
这里有个特别关键、官方反复强调的点,我单独拎出来加粗:
所有这些形态,底层是同一个 Claude Code 引擎。 也就是说,你写的 CLAUDE.md(项目说明文件)、你的配置、你接的 MCP(Model Context Protocol)服务——在终端配好了,换到 VS Code、换到手机上照样生效。配一次,处处能用。
很多人主力用终端(习惯了,最顺手),但出门在外时可以用网页版起一个「跑测试 + 修失败用例」的长任务,路上打开手机瞄一眼进度。这种「换个地方接着干」的体验,是网页聊天框给不了的。
友情提示: 本系列默认从终端讲起,因为它功能最全、最能讲透原理。等你摸熟了,再换到 VS Code 或桌面 App 都是水到渠成的事。
💡 一句话总结:Claude Code 有终端、编辑器插件、桌面 App、网页/手机五种形态,但底层同一个引擎,配置全平台通用。
03 它能干什么:一张「能 / 不能」清单
这部分最实在。先看它能干的活儿——我按官方文档梳理,挑几类新手最有体感的:
- 读懂你的代码:「这个函数干嘛的?」「这块为啥报错?」它结合整个项目上下文回答,不是孤立看一段。
- 跨文件改代码:「把所有用
var的地方改成let」「把这个大函数拆成三个小的」——它真的去改,不是只给建议。 - 修 bug:把报错甩给它,它顺着代码库追根因、定位、动手修。
- 干那些你一直拖着的杂活:给没测试的代码补测试、清 lint 报错、解合并冲突、升级依赖、写 release notes。
- 跟 Git 打交道:暂存改动、写 commit 信息、建分支、开 PR(拉取请求)一条龙。
- 连接外部工具:通过 MCP(一个开放标准,后面有专篇讲)读 Google Drive 的文档、更新 Jira 工单、从 Slack 拉数据。
光说不够直观,给你一条官方文档里的真实命令感受一下「一句话指挥」是什么样:
claude "write tests for the auth module, run them, and fix any failures"
翻译过来就是:「给 auth 模块写测试,跑一遍,挂了的你自己修。」——一句话,它把写测试、跑测试、修失败三步全包了。这就是「代理」和「补全」的本质区别。
但是,比「能做什么」更重要的,是认清它不能做什么。这点很关键,我也补充一下我的体会:
| ❌ 不该指望的 | 为什么 |
|---|---|
| 替你拍板技术决策 | 选 A 方案还是 B 方案、值不值得重构——判断和取舍是你的活 |
| 保证代码 100% 没 bug | 它给的是高质量候选,不是绝对正确答案,必须你来 review |
| 猜中你没说清的业务逻辑 | 你没讲明白的需求,它只能瞎猜 |
| 你完全看不懂的情况下全自动托管项目 | 你看不懂,就没法判断它改得对不对,等于盲开 |
最容易踩的一个坑,就是第二条。太信它了,让它批量给一个项目加错误处理,它刷刷改了十几个文件,看都没细看就提交了。结果有两处它「自作主张」改了逻辑,上线后才发现。所以最好立一条铁规矩:它改的每一行,至少扫一遍 diff 再提交。
用好 Claude Code 的心态基石,就一句话:
让 Claude Code 提供高质量候选方案,而不是绝对正确答案。
说白了就一句话——人定方向、把关、做判断;AI 负责执行、分析、干重复劳动。这是它的设计哲学:协作,不是替代。
💡 一句话总结:它能读项目、改文件、跑命令、干杂活,但拍板和把关永远是你的事——它是搭档,不是甩手掌柜的接盘侠。
04 和 ChatGPT / Copilot / Cursor 到底差在哪
这是新手问得最多的问题,咱们一次说清。先上一张总表:
| 维度 | ChatGPT(网页聊天) | Copilot / Cursor(编辑器内) | Claude Code |
|---|---|---|---|
| 形态 | 网页 / App 聊天框 | 编辑器里的插件 | 命令行 / 插件 / 桌面 / 网页都有 |
| 怎么干活 | 你问它答 | 你写一半,它补后半 | 你下指令,它自己动手干 |
| 看不看得到你项目 | 看不到,得手动粘 | 看得到当前文件 / 部分上下文 | 自动读整个项目 |
| 能不能改文件 | 不能,给你建议你自己改 | 主要是补全、建议 | 能直接改、能跑命令 |
| 最适合 | 问概念、查资料、写零散代码 | 写代码时实时提速 | 真实项目里的理解、重构、修 bug、自动化 |
再用三句大白话给你刻进脑子里:
- ChatGPT 像个顾问——啥都能聊两句,但你的项目它两眼一抹黑,干活得你自己来。
- Copilot / Cursor 像个智能输入法——你敲代码它猜你下一句想写啥,帮你打字快一点,主体还是你在写。
- Claude Code 像个能独立干活的搭档——你说清要什么,剩下的翻文件、改代码、跑测试它包圆,干完你来验收。
注意: 这里的 Cursor / Copilot 指的是它们最经典的「编辑器内自动补全」定位。它们这两年也在做更「代理化」的功能(比如 Cursor 的 Agent 模式),边界在变模糊。但作为入门理解,记住上面这三句的核心定位就够了。(产品功能迭代快,细节以各家官方为准。)
那 Claude Code 强在哪、弱在哪?实测下来:
它的强项——对整个项目的理解能力是真的强,尤其接手一个看不懂的旧项目,让它「先给我讲讲这项目架构」,比自己啃半天文档快得多;大规模重构、跨文件改动也是它的主场。再加上能用 CLAUDE.md、Skill 这些把它「调教」成符合你习惯的样子(后面专篇细讲)。
它的短板——不如 Copilot 那样「无感」。Copilot 是你写着写着它就帮你补了,零操作成本;Claude Code 得你主动开口下指令,学习曲线也稍陡一点。所以它俩不是替代关系,是配合关系——一种顺手的搭配是写代码时开着 Copilot 补全,遇到「要动一大片」的活儿就切给 Claude Code。
💡 一句话总结:ChatGPT 是顾问、Copilot 是智能输入法、Claude Code 是能动手的搭档——别二选一,按活儿派工。
05 动手:30 秒确认你的电脑认不认识它
说好这篇不教安装,但给你留个零成本的小动作,确认下你的环境(装与不装,这条命令都能跑,不会报错搞坏东西)。
打开你的终端(Mac 用「终端 / Terminal」App,Windows 用 PowerShell),敲这一行回车:
claude --version
两种预期结果,都正常:
- 情况一:蹦出一串版本号,类似
2.x.x (Claude Code)——恭喜,你之前装过,下一篇可以直接跳到「用起来」。 - 情况二:报错
command not found: claude(Windows 上可能是'claude' 不是内部或外部命令)——也完全正常,说明还没装,这正是下一篇要解决的第一件事。
提前剧透一下下一篇会用到的安装命令(现在别急着敲,先混个眼熟),官方原版是这样的:
# macOS / Linux / WSL
curl -fsSL https://claude.ai/install.sh | bash
# Windows PowerShell
irm https://claude.ai/install.ps1 | iex

这张图想表达的是:把「能不能自动读懂你整个项目」和「能不能直接动手改文件」当成两个轴,四个工具一摆——只有 Claude Code 稳稳站在「既懂全局又能动手」那个角,ChatGPT 两样都靠手动,Copilot/Cursor 懂局部、主要靠补全。看不到图也不影响,记住上一节那三句话就够了。
一句提醒:国内用户安装和登录 Claude Code 通常需要「魔法上网」,具体怎么搞、账号怎么登,下一篇专门讲,这里先不展开。
💡 一句话总结:一条
claude --version就能确认你的电脑认不认识它——报错也别慌,那是下一篇的开场任务。
06 小结
这一篇咱们没敲几行命令,但把最该想明白的事捋清了:
- 它是什么:Anthropic 官方的命令行版 AI 编程搭档,能读整个项目、直接改文件、跑命令——不是「会写代码的聊天框」。
- 在哪用:终端、VS Code/JetBrains 插件、桌面 App、网页/手机,五种形态同一个引擎、配置通用。
- 能 / 不能:能读代码、改文件、修 bug、干杂活、连外部工具;但拍板、把关、补业务逻辑这些永远是你的活。
- 和别人的区别:ChatGPT 是顾问、Copilot 是智能输入法、它是能独立干活的搭档,按活儿派工,不必二选一。
你现在应该能:跟同事一句话讲清 Claude Code 是什么,也能判断「这个活儿该不该交给它」。这就是入门最该先有的「地图感」——后面所有功能,都是在这张地图上添砖加瓦。
下一篇 02「安装与使用」:咱们正式动手,把它装到你的电脑上(Mac / Windows / Linux / WSL 分开讲,一步不漏),跑通第一次登录,让 claude 这个命令真正在你终端里活起来。先去把上面那条 claude --version 敲一下,看看你属于「情况一」还是「情况二」——下一篇正好对症下药。
03 · Claude Code 如何工作
第一次用 Claude Code,常会撞见这么一段对话——
你:「这个测试为啥挂了?」 Claude:「我先跑一下测试套件看看。」(开始跑命令) Claude:「报错说
validateEmail返回了 undefined,我去看看这个函数。」(读了文件) Claude:「找到了,这里少了一个 return。我改一下,然后重新跑测试确认。」(改完,又跑了一次) Claude:「测试过了。」
看到这儿容易有点懵:只问了一句话,它怎么自己跑命令、自己读文件、自己改、还自己验证了?
说白了,这就是 Claude Code 和普通 AI 聊天框最大的区别。聊天框只会「回你一段文字」,而 Claude Code 会自己动手做事。这背后是一套固定的工作机制,今天讲透。
看完这一篇,你会拿到:
- 一张图看懂 Claude Code 的「代理循环」——它每做一件事都在重复的三个动作
- 搞清楚它手里那 5 类「工具」分别能干啥,以及它怎么决定用哪个
- 知道它到底能看到你电脑上的什么、看不到什么(关系到安全)
- 一个能照着跑的小实验,亲眼看它走完一整个循环
01 代理循环:想 → 做 → 看
先说结论:Claude Code 干任何活,都在重复三个动作——收集上下文、采取行动、验证结果。官方把这套机制叫「代理循环(agentic loop)」。
换个更土的说法:想 → 做 → 看。
- 想(收集上下文):先搞清楚状况——读相关文件、看报错、查 git 状态
- 做(采取行动):动手——改代码、跑命令、新建文件
- 看(验证结果):检查刚才做的对不对——跑测试、看输出,不对就再来一轮
类比:一个靠谱的修车师傅。 你把车开进店说「方向盘抖」,师傅不会立刻拆。他先看一圈、试开两步(想),再动扳手(做),修完开一段确认不抖了(看)。还抖就回第一步重查。Claude Code 就是这么个师傅,只不过修的是你的代码。
回到开头那段对话,对照一下你就懂了:
| Claude 说的话 | 对应循环里的哪一步 |
|---|---|
| 「我先跑一下测试套件」 | 想(收集上下文) |
| 「报错说 undefined,我去看看这个函数」 | 想(继续收集) |
| 「这里少了 return,我改一下」 | 做(采取行动) |
| 「然后重新跑测试确认」 | 看(验证结果) |
| 「测试过了」 | 循环结束 |
它把这三步串成一条链,一步的结果决定下一步干什么。修个 bug 可能循环好几轮,问个「这段代码啥意思」可能只要「想」这一步就够。循环几轮,由任务复杂度决定,不是写死的。

上面这张图就是 Claude Code 每次干活转的圈:从「想」到「做」到「看」,不满意就从「看」拐回「想」再来一轮——你随时能按 Esc 把它叫停。
这里有个关键点,很多人没意识到:你也是这个循环的一部分。它走偏了,你随时能插话纠正——这点下一节细说。
驱动这个循环的是两样东西:模型负责「想」,工具负责「做」和「看」。
模型就是 Claude 的大脑——Sonnet 应付日常编程够用,Opus 推理更强、适合复杂架构。会话里输入 /model 随时切,或者启动时 claude --model sonnet。
💡 一句话总结:Claude Code 不是「回你一段话」,而是「想→做→看」转圈直到把事办完,这才是它和聊天框的本质区别。
02 你也在循环里:随时能打断
上一节结尾说了:你也是这个循环的一部分。展开聊聊。普通 AI 聊天是「你问一句、它答一段、回合结束」。Claude Code 不一样——它在循环里自己跑的时候,你不用干等着,随时能插手。
比如让它重构一个模块,看它跑偏了、正要大改一堆文件,直接按 Esc,它立刻停下,正在跑的命令也取消了。再补一句「别动那个文件,只改这个函数」,它就顺着新指示继续。
两种打断方式,区别要分清:
| 操作 | 效果 | 什么时候用 |
|---|---|---|
按 Esc | 立刻停,正在跑的工具调用被取消,等你下一条指令 | 它跑偏了、要做的事不对,赶紧拦住 |
打字 + Enter | 不打断当前操作,发一句补充,它做完手头的就读 | 只是想补个上下文、提个醒,不急着叫停 |
你不需要憋一个「完美的提示」。先说个大概,看它做,不对再纠正——这是对话,不是一次性命令。
这话是官方文档原话,特别值得记住。刚上手时总想「一句话把需求说全」,憋半天。其实没必要:丢个大方向,它做错了再喊停,迭代比憋大招快得多。
💡 一句话总结:它自主干活,但永远听你指挥——
Esc急停、打字补充,方向盘随时在你手里。
03 工具:它能真正动手的原因
上一节说模型负责「想」。那「做」和「看」靠什么?工具。
这是 Claude Code 最该记住的一句话:没有工具,Claude 只能回你文字;有了工具,它能真的读你的代码、改你的文件、跑你的命令。
类比:一个戴了智能手环的助理。 光会说话的助理只能出主意;给他配上能开门、打字、查资料的设备,他才能真正替你把事办了。工具就是 Claude Code 的「手」。
官方把内置工具分成 5 大类。我用大白话给你列一遍——
| 工具类别 | 它能干什么 | 对应你平时的什么操作 |
|---|---|---|
| 文件操作 | 读文件、改代码、新建文件、重命名、重组 | 你在编辑器里打开、敲字、保存 |
| 搜索 | 按文件名找文件、用正则在内容里搜、翻整个代码库 | 你按 Ctrl+F 或 grep |
| 执行 | 跑 shell 命令、起服务器、跑测试、用 git | 你在终端里敲命令回车 |
| 网络 | 搜网页、抓文档、查报错信息 | 你打开浏览器搜一段错误 |
| 代码智能 | 看类型错误和警告、跳转定义、查引用 | IDE 的「转到定义」「找引用」 |
⚠️ 注意:第 5 类「代码智能」需要额外装代码智能插件才有,前 4 类是开箱即用的。以官方文档为准。
那它怎么决定用哪个工具?不是你指定的,是模型自己根据你的话和当前进展挑。
举个官方的例子,你说一句「修复失败的测试」,它内部大概会这么走:
- 跑测试套件,看哪个挂了 —— 用了 执行
- 读报错输出 —— 执行
- 搜相关源文件 —— 搜索
- 读这些文件理解逻辑 —— 文件操作
- 改文件修 bug —— 文件操作
- 再跑一次测试验证 —— 执行
看出来没?这 6 步就是「想→做→看」循环在工具层面的展开。每用一次工具,就拿回一点新信息,喂给模型决定下一步——循环就是这么转起来的。
有个很典型的场景:让它给一个没文档的老项目「理一下目录结构」。它不用你喂任何文件,自己 ls、自己 grep 关键字、读了七八个文件,最后画出一张结构图。全程没指定任何一个文件——这就是官方说的「委派,不要指示」:给方向,细节它自己抠。
至于 Skill、MCP、Hook、Subagent 这些——它们是架在这 5 类内置工具之上的扩展层,能让 Claude 知道更多、连更多外部服务。本系列后面一篇篇讲,先知道有这么回事就行。
💡 一句话总结:工具是 Claude Code 的「手」,5 类各管一摊;用哪个、用几次,它自己决定,你只管说目标。
04 它能看到你电脑上的什么
这一节关系到安全,得说清楚。很多人第一次用会犯嘀咕:它是不是把我整个硬盘都翻了一遍传走了? 不是。
先记一句话:Claude Code 的「视野」基本等于你在那个目录下的终端能摸到的东西。你在哪个文件夹敲的 claude,它的活动范围就以那儿为中心。
按官方文档,当你在某个目录运行 claude,它能访问:
- 你的项目:当前目录和子目录里的文件(其他地方的文件需要你给权限才碰)
- 你的终端:你能跑的任何命令——构建工具、git、包管理器、脚本。命令行能干的,它就能干
- 你的 git 状态:当前分支、未提交的改动、最近的提交历史
- 你的
CLAUDE.md:你写的项目专属说明书,每次会话它都会读(这文件后面有专篇讲) - 你配置的扩展:MCP、Skill、Subagent 这些
正因为它能看到整个项目,而不只是你当前打开的那一个文件,所以它能跨文件协调——你说「修登录 bug」,它能搜出相关的好几个文件、一起改、再跑测试验证。这和只看当前文件的内联补全插件,根本不是一回事。
那安全怎么保证?两道闸——
第一道:检查点(checkpoint),相当于游戏存档。 它改任何文件之前,会先给当前内容拍个快照。改坏了,在输入框空着时连按两次 Esc(或输入 /rewind),会弹出一个「回溯菜单」,选「恢复代码」就把文件退回改之前;也可以直接说「撤销刚才的修改」。
检查点只管 Claude 用编辑工具改的文件——bash 命令改的、以及外部副作用都不在内。 数据库、API、线上部署这类「泼出去收不回」的操作没法存档——所以 Claude 在跑这类有外部影响的命令前会先问你。
这里有个常踩的坑:有时它改了五六个文件,你看完觉得方向全错。搁以前得手动一个个 git checkout 回滚,现在按两下 Esc、在弹出的菜单里选「恢复代码」——五个文件齐刷刷回到改之前,干净利落。有了这一手,放手让它改代码就没那么怵了。
第二道:权限模式,相当于实习生动手前问不问你。 按 Shift+Tab 循环切换:
| 权限模式 | 状态栏显示 | Claude 的行为 |
|---|---|---|
| 默认 | (不显示提示) | 改文件、跑命令前都会询问你 |
| 自动接受编辑 | ⏵⏵ accept edits on | 改文件和常见文件命令(如 mkdir、mv)不问,其他命令仍问 |
| Plan Mode(计划模式) | ⏸ plan mode on | 可读文件和运行探索性命令,但不编辑源代码;先给你一份计划,你批准了才动手 |
| 自动模式 | ⏵⏵ auto mode on | 用后台安全检查评估所有操作(实验性,目前是研究预览,可能变化) |
最值得养成的习惯是用 Plan Mode:复杂任务先按两下 Shift+Tab 进去,让它「只分析、出方案、别动手」,方案过一遍、改改,确认了再放它执行。这能躲过好几次「方向错了改一半」的返工——先看图纸再施工,比边干边改省事太多。
嫌每次都问烦?可以在项目的 .claude/settings.json 里把信任的命令(比如 npm test、git status)加白名单,以后不问。配置细节后面专篇讲。
💡 一句话总结:它的视野≈你在那个目录的终端权限;检查点管「改坏了能撤」,权限模式管「动手前问不问」——两道闸下,放手用也踏实。
05 动手:亲眼看它走一个完整循环
光看原理记不住,跑一个最小实验,亲眼看它「想→做→看」转一圈。这个实验不依赖任何现成项目,新建个空文件夹就能做。
第一步:建个空目录,进去启动 Claude Code。
在终端里跑(Mac / Linux;Windows 用 PowerShell 把 mkdir -p 换成 mkdir 即可):
mkdir -p ~/cc-demo && cd ~/cc-demo
claude
第二步:进去之后,先切到计划模式看它怎么「想」。
按两下 Shift+Tab,界面底部会提示进入了 Plan Mode(计划模式)。然后丢这么一句给它:
帮我写一个 Python 脚本 add.py,里面一个函数 add(a, b) 返回两数之和,
再写几个测试用例验证它,最后跑一遍测试。先给我计划,别直接动手。
预期看到:它不会立刻建文件,而是先回你一份计划,大致是——
计划:
1. 创建 add.py,实现 add(a, b)
2. 创建测试(用 assert 或 pytest)
3. 运行测试,确认全部通过
需要我开始吗?
这就是「想」——它在动手前先理清了思路。注意它停下来等你批准了,这是计划模式的特征。
第三步:批准,看它「做」+「看」。
回复「可以,开始吧」。接着你会看到它依次:
- 建文件(文件操作工具)——可能先弹一下权限确认,你按同意
- 写完后跑测试(执行工具),比如执行
python add.py或pytest - 把测试输出贴给你,预期是类似:
测试通过:add(2, 3) == 5 ✓ add(-1, 1) == 0 ✓ add(0, 0) == 0 ✓
到这儿,你就完整看了一遍循环:想(出计划)→ 做(建文件、写代码)→ 看(跑测试报告结果)。
第四步(可选):故意制造一次「再循环」。
跟它说:「把 add 改成减法,但函数名别变,然后重新跑测试。」
你会看到它改完代码、再跑测试——如果测试断言还是加法,测试会挂,它会自己发现挂了、回头再改。这就是循环的精髓:看到不对,自动再来一轮。
新手都值得跑一遍这个实验。比起读十遍「代理循环」四个字,亲眼看它停下来出计划、再动手、再验证,理解得快得多。
💡 一句话总结:跑一遍这个最小实验,你会亲眼看到「想→做→看」转圈——尤其是它会自己发现错、自动再来一轮那一下。
06 小结
这一篇就讲清了一件事:Claude Code 凭什么能自己干活。
回顾一下核心:
| 要点 | 一句话记住 |
|---|---|
| 代理循环 | 想→做→看,转圈直到办完;这是它和聊天框的本质区别 |
| 模型 + 工具 | 模型负责想,工具负责做和看 |
| 5 类工具 | 文件 / 搜索 / 执行 / 网络 / 代码智能,用哪个它自己挑 |
| 能看到什么 | ≈你在那个目录的终端权限,能跨文件协调 |
| 两道安全闸 | 检查点(改坏能撤)+ 权限模式(动手前问不问) |
你现在应该能看懂 Claude Code 跑任务时屏幕上在发生什么——它每读一个文件、每跑一条命令,都是循环里的一步;也知道了怎么用 Esc 急停、用计划模式先看方案、靠检查点放心让它改。
理解了这套机制,你用起来的心态会完全不同:它不是许愿池,而是个会自己想、动手、检查的搭档——你的活儿是给方向、定验收标准、跑偏时拉一把。
下一篇 04 · API 配置:Claude Code 装好了、原理也懂了,但它得连上模型才能真正干活。下一篇带你把 API 配通——这一步搞定,前面学的循环和工具才能跑起来。
16 小时 Claude Code