一、什么是 Claude Code?

Claude Code 是 Anthropic 发布的一款智能体编码工具(Agentic Coding Tool),它有一个"智能体循环"(Agentic Loop)——可以规划并执行动作以完成目标,能调用工具、评估结果并持续运行直到任务完成。[1]

它是一个能读取代码库、跨文件修改代码、运行测试并提交代码的自主编码系统。对于没有工程背景的构建者来说,它是一个此前从未有过的软件开发入口。[3]

传统 AI 编程助手(如 GitHub Copilot)只在 IDE 中提供自动补全建议,而 Claude Code 采用了根本不同的方式——它运行在终端中,直接与文件系统和命令行工具交互。[7]

Anthropic 于 2025 年 2 月将 Claude Code 作为有限研究预览版推出,三个月后的 2025 年 5 月正式面向公众开放。[7]


二、整体架构设计

Claude Code 的架构设计有一个极具颠覆性的特点:

整个代码库中只有 1.6% 是 AI 决策逻辑,其余 98.4% 是确定性的基础设施——权限门控、上下文管理、工具路由和恢复逻辑。[4]

系统的核心是一个简单的 while 循环(调用模型、运行工具、重复),但大部分代码分布在这个循环周围的系统中:一个具有七种模式和基于 ML 分类器的权限系统、用于上下文管理的五层压缩流水线等。[8]

核心循环被描述为一种 ReAct 风格(Reasoning and Acting)的响应模式,模型提议动作,工具执行它们,而周围的系统则强制执行安全性和连续性。[2]

整个架构的设计出发点是五个核心人类价值观:人类决策权威、安全与保障、可靠执行、能力扩展,以及情境适应性,并通过 13 个设计原则落实到具体实现中。[8]


三、整体分为几个主要部分?

根据对 Claude Code TypeScript 源码的深度分析,系统拥有一个七组件的基础设施架构,将所有接口交互汇聚到一个统一的智能体循环中,严格将底层语言模型的推理能力与操作安全、上下文、内存管理三者分离。[10]

1. 智能体核心循环(Agentic Loop)

Claude Code 读取代码库、规划动作序列、使用真实开发工具执行、评估结果并调整方案。开发者设定目标并保留对提交内容的控制权,但执行循环独立运行。[3]

2. 权限系统(Permission System)

Claude Code 实现了四大设计原则:拒绝优先+人工升级、分级信任谱、纵深防御多层机制、以可逆性为权重的风险评估[1]

在 Claude Code 的拒绝/询问/允许规则中,拒绝匹配优先,因此即使存在更广泛的权限,被阻止的操作也会保持阻止状态,防止高风险操作在模糊时刻溜过。[2]

3. 上下文管理(Context Management)

该系统通过一个渐进式五层压缩管道来管理无限制的上下文压力。[10] 当会话消耗大量上下文后,系统会自动压缩历史对话,确保工作的连续性。

4. 扩展机制(Extension Layer)

系统使用四种不同的扩展机制,按上下文占用量严格分级:事件驱动的生命周期 Hooks(零默认上下文)、领域特定的 Skills(最小指令集)、可分发的插件(中等成本)以及 MCP 服务器(高 Token 预算)。通过将扩展映射到这些成本层级,架构可以防止第三方集成悄悄耗尽上下文窗口。[10]

5. 子智能体系统(Subagent System)

对于复杂的重构任务,主智能体可以生成子智能体(如"探索"或"规划"智能体)。为了保护主上下文窗口,这些子智能体在隔离的 Git 工作树和独立上下文循环中运行,只通过摘要报告与主智能体通信。[10]

6. 内存与持久化(Memory & Persistence)

CLAUDE.md 是你添加到项目根目录的 Markdown 文件,Claude Code 在每次会话开始时读取它,用于设置编码规范、架构决策、首选库和审查清单。[9]

Claude 还会在工作过程中自动建立记忆,在会话间保存构建命令和调试见解等内容,无需手动编写任何内容。[9]

7. 多接口层(Multi-Interface Layer)

Claude Code 是一款可读取代码库、编辑文件、运行命令并与开发工具集成的智能体编码工具,可在终端、IDE、桌面应用和浏览器中使用[9]

它为 VS Code(以及 Cursor、Windsurf)和 JetBrains IDE 提供原生扩展。[5]


四、常见指令大全

指令在会话内部控制 Claude Code,提供快速切换模型、管理权限、清除上下文、运行工作流等功能。[1]

🚀 会话管理类

指令 作用
/init 为仓库生成 CLAUDE.md(项目简报)
/clear 清除对话历史,开始新任务
/compact [说明] 压缩长对话历史,保留关键信息
/rewind 回滚对话和/或代码到某个检查点
/resume 恢复上次会话
/branch 创建当前对话的分支

/compact 是节省 Token 的利器。当长会话填满上下文窗口时,它会将对话历史压缩为密集摘要,还可以传入指令引导保留哪些内容,如 /compact 重点保留 auth 模块和当前测试失败信息[4]

🔍 规划与审查类

指令 作用
/plan 进入只读规划模式,Claude 只分析不修改文件
/diff 显示变更内容
/review 对代码进行深度只读审查
/security-review 专项安全漏洞审查
/simplify 三智能体流水线检查架构、重复逻辑和性能问题

/plan(也可通过 Shift+Tab 切换)让 Claude 进入只读模式,可以读取文件、分析代码库,但无法进行修改,所有提议的修改都以需要明确批准的计划形式呈现。适合用于生产关键文件、数据库迁移等敏感任务。[4]

💰 成本与状态监控类

指令 作用
/cost 查看本次会话花费(API 用户)
/stats 查看用量统计(Pro/Max 用户)
/context 查看当前上下文窗口使用情况
/status 查看版本、当前模型、账号连接状态

⚙️ 多智能体与并行任务类

指令 作用
/batch 分解大型任务,在独立工作树中并行执行
/agents 配置子智能体
/mcp 管理 MCP 服务器连接

/batch 可以将横跨代码库的大型变更分解为独立单元,并在各自的工作树中并行运行。[1]

🛠️ 诊断与调试类

指令 作用
/doctor 诊断安装和运行时问题
/debug 调试会话问题
/feedback 附带会话上下文提交 bug 报告

⌨️ 实用快捷键

Esc + Esc 打开回滚菜单(支持选择性地只回滚代码或只回滚对话);Alt+P 切换模型(保留当前输入内容);Alt+T 切换扩展思考(深度推理)模式。[4]


五、还有哪些可以优化和升级的方向?

✅ 已经在改进的问题

Anthropic 曾将近期的质量问题追溯到三项独立变更,并已全部修复(v2.1.116)。[3]为此,Anthropic 承诺确保更多内部员工使用与公众完全相同的构建版本,并为 Claude Code 的每次系统提示变更运行全面的评估套件,同时对提示变更加强了审查和审计工具。[3]

🔭 六大未来开放方向(来自学术研究)

架构研究指出,重量级基础设施虽然能提升短期速度,但有界的上下文窗口和孤立的子智能体架构,会带来全局代码库一致性退化和长期人类理解力下降的风险[10]

具体来说,有以下几个核心方向值得关注:

1. 跨会话持久记忆:目前权限在恢复时不会被恢复——信任是按会话重新建立的,设计倾向于可审计性而非查询能力。[4]未来可探索更智能的跨会话记忆与信任延续机制。

2. 更智能的上下文管理:随着代码库规模增长,如何在超长上下文中保持全局一致性是核心挑战。Opus 4.7 专门改善了长上下文可靠性,早期测试者报告称这是"我们测试过的所有模型中最稳定的长上下文表现"。[9]

3. 成本与额度压力:如果 Claude Code 是你的主要开发工具,且你在标准工作时段使用,仍然会触及额度限制。Pro 计划($20/月)在 Opus 4.7 之后尤为紧张,Max 5x($100/月)对大多数工作流勉强够用。[9]

4. 可观测性与评估体系:随着基础模型在基准推理能力上趋于收敛,自主系统可靠性的关键差异化因素变成了围绕模型的确定性工程框架。[10]如何建立更好的可观测性和评估体系是重要方向。

5. 多智能体协作:Claude Code 已支持生成多个并行工作的子智能体[9],但跨智能体的协调、状态共享和冲突解决仍有很大提升空间。

6. 移动端与异步工作流:Claude Code 正在逐渐摆脱对单一机器的依赖,Anthropic 开始将 Claude Code 更多地视为一个可以从手机查看的运行会话,而真实环境则锚定在用户的机器上。[4]这一方向将使 AI 编码助手真正成为 7×24 小时运转的后台服务。


总体而言,Claude Code 代表了从"代码补全工具"到"自主软件工程师"的范式转变。在 Anthropic 内部,目前大多数代码已由 Claude Code 编写,工程师则专注于架构、产品思考和持续编排——管理并行运行的多个智能体,给出方向,并做出决定什么被构建出来的决策。[3]


Memory(记忆)系统

Claude Code 有两套互补的记忆机制,都会在每次会话开始时被加载:CLAUDE.md 文件(由你手动编写,给 Claude 提供持久上下文)和 Auto Memory(Claude 根据你的纠正和偏好自动写入的笔记)。[1]

1. CLAUDE.md —— 手动指令层

CLAUDE.md 是 Markdown 格式的文件,为项目、个人工作流或整个组织提供持久指令,由你用纯文本编写,Claude 在每次会话开始时读取它。[1]

CLAUDE.md 存在三个作用域:项目级(放在仓库根目录)、个人级(~/.claude/CLAUDE.md)和组织级(企业配置)。[6]

Claude Code 从当前工作目录开始递归向上读取,一直到根目录 /,沿途读取所有 CLAUDE.md 和 CLAUDE.local.md 文件。位于子目录中的文件不会在启动时加载,只有当 Claude 读取了那个子目录下的文件时才会按需加载。[8]

2. Auto Memory —— 自动记忆层

Auto Memory 让 Claude 无需你手动写任何东西就能跨会话积累知识。Claude 在工作时自动保存笔记,内容包括:构建命令、调试洞察、架构说明、代码风格偏好和工作流习惯。[1]

存储位置在 ~/.claude/projects/<project>/memory/,包含一个 MEMORY.md 入口文件和可选的主题文件。每次会话启动时加载 MEMORY.md 的前 200 行,主题文件按需加载。作用域为机器本地,在同一 git repo 的所有 worktree 和子目录中共享。[8]

Auto Memory 捕获工作中浮现的内容。Claude 自行判断什么值得保留,并将其写入机器上的 memory 目录,按四类组织:user(角色与偏好)、feedback(你的纠正)、project(决策与上下文)和 reference(资源位置)。[6]

Claude 不会每次会话都写东西,它根据信息在未来对话中是否有用来判断是否值得记忆。[1]


/dream —— 记忆整合机制

为什么需要 Dream?

Auto Memory 记录的笔记,在数周使用后会逐渐"腐烂":写着"昨天的部署 bug"的条目过一周就失去意义;某条笔记说你用 PostgreSQL,更新的笔记说你迁移到了 MySQL;已删除的文件仍有对应的记忆条目;索引充满矛盾和过时引用。[6]

Auto Dream 与 /dream 的关系

/dream 命令是手动触发器,你可以在大改动(如框架迁移或模块重命名)之后运行它,让 Claude 立即整合而不必等待下一个空闲窗口。两者执行的是同样的工作,唯一区别是谁来决定何时启动。[7]

Auto Dream 在 Claude Code 空闲时自动运行,默认触发条件是距上次清理超过 24 小时,且累积了至少 5 个新会话。[7]

四阶段整合流程

/dream 触发后,会启动一个后台子 Agent,执行结构化的四阶段整合循环。[4]具体如下:

  • Phase 1 – Orient(定向): Claude 读取项目中的每一个记忆文件以及个人 MEMORY.md,不做任何修改,只是建立对当前状态的整体认知。[7]

  • Phase 2 – Gather Signal(采集信号): 扫描最近的会话记录(JSONL 文件),提取用户纠正、偏好变更、重要决策和反复出现的模式。使用定向 grep,而非全文读取。[6]

  • Phase 3 – Consolidate(整合): 每条条目被归入三类:仍然有用的(真实的约定、偏好、上下文);过时的(引用了不再存在的代码、已撤销的决策);重复或近似重复的(同一约定用不同措辞写了两次)。[7]

  • Phase 4 – Update Index(更新索引): 最后阶段聚焦于 MEMORY.md 索引文件,将其保持在 200 行以内(因为这是启动时加载的上限),更新索引以准确反映所有主题文件的当前状态。[1]

安全性设计

Dream 读取现有记忆存储和过往会话记录,然后生成一个新的、重新组织的记忆存储(重复项合并、过时或矛盾条目替换为最新值)。输入存储永远不会被修改,所以你可以审查输出,如果不满意可以丢弃。[2]

整合过程在后台子 Agent 中运行——就像真正的睡眠一样,不会打断你的主动工作。Dream Agent 的系统提示以这样一句话开头:“You are performing a dream — a reflective pass over your memory files.”[6]


理论来源

这个特性的理论依据可以追溯到 2025 年 4 月 UC Berkeley 与 Letta 联合发表的论文"Sleep-time Compute"(arXiv:2504.13171)。核心发现:在空闲时预计算的模型,在相同精度下可将测试时算力降低 5 倍,并带来最高 18% 的精度提升。[4]

总结一句话: Memory 是 Claude Code 的"笔记本",会随每次会话自动更新;/dream 则是定期对笔记本做"REM睡眠式整理"的机制,删旧去冗,保持记忆的准确与精炼。


  1. Dive into Claude Code: The Design Space of Today’s and Future AI Agent Systems
  2. Commands - Claude Code Docs
  3. Claude Code Updates 2026: New Features & Improvements | Get AI Perks
  4. Inside Claude Code Architecture: Why Today’s Most Advanced AI Coding Agents are Powered by Infrastructure, Not Just Intelligence
  5. Claude Code cheatsheet
  6. Anthropic explains Claude Code’s recent performance decline after weeks of user backlash | Fortune
  7. Claude Code | Anthropic’s agentic coding system
  8. How I use Claude Code (+ my best tips)
  9. An update on recent Claude Code quality reports
  10. GitHub - VILA-Lab/Dive-into-Claude-Code: A Systematic Analysis and Discussion of Claude Code for Designing Today’s and Future AI Agent Systems · GitHub
  11. The Complete Developer’s Guide to Claude Code Commands | Tim Dietrich
  12. Every Claude Code Update From March 2026, Explained
  13. Claude Code by Anthropic | AI Coding Agent, Terminal, IDE
  14. Shipyard | Claude Code CLI Cheatsheet: config, commands, prompts, + best practices
  15. Claude Code Q1 2026 Update Roundup: Every Feature That Actually Matters | MindStudio
  16. Claude Code — 2025 AI Agent Index
  17. How to Use Claude Code: A Guide to Slash Commands, Agents, Skills, and Plug-ins
  18. Effective Claude Code Workflows in 2026: What Changed and What Works Now | by Sean Moran | Data Science Collective | Apr, 2026 | Medium
  19. What Is Claude Code? AI Coding Tool Explained — Shawn Kanungo
  20. Claude Code, Real Workflows: Commands, Context & Tools. | by Naveed Ul Mustafa | Medium
  21. Claude Code Limits: Quotas & Rate Limits Guide
  22. [2604.14228] Dive into Claude Code: The Design Space of Today’s and Future AI Agent Systems
  23. Claude Code Commands: The Ultimate Reference
  24. What’s new - Claude Code Docs
  25. Overview - Claude Code Docs
  26. GitHub - Njengah/claude-code-cheat-sheet: Ultimate collection of Claude Code tips, tricks, hacks, and workflows that you can use to master Claude Code in minutes · GitHub
  27. Claude Code Opus 4.7 Review: The 3 Changes That Matter (2026) - AI Tool Analysis
  28. Dive into Claude Code: The Design Space of Today’s and Future AI Agent Systems
Logo

中国智能体开发者社区,聚焦智能体与大模型开发,提供前沿资讯、实用工具链、开源项目及行业案例。通过技术沙龙、开发者大赛等活动,促进经验交流与协作,助力开发者快速构建创新智能应用。

更多推荐