Claude Code 一周年回顾:从 Slack 两人点赞到绝对主流 Coding Agent,CC 到底做对了什么,未来要做什么?
公众号名称:AI 启蒙小伙伴
作者名称:邵猛
发布时间:2026-06-09 09:25
Claude Code 一周年回顾
Claude Code 负责人 Boris Cherny 和产品负责人 Cat Wu,回顾 Claude Code 上线一周年的演进与方法论。

Reflecting on a year of Claude Code
核心命题:从工具到组织中枢
视频主线回答了一个问题:AI 编程工具如何真正改变工作方式?
一年前,Claude Code 在 Slack 里只有两人点赞;今天 Boris 描述的是「成百上千个 agent 组成的树状网络」。变化不在界面,而在交互对象的迁移:
| 阶段 | 人主要与什么交互 |
|---|---|
| 传统 | 源代码 |
| 第一阶段 | Agent(人说话,agent 写代码) |
| 当前 | Loop / Routine(人设定规则,系统自动驱动 agent) |
这是团队对 Claude Code 最重要的结构性判断。
两条底层方法论
1. 错误即资产:写入规则,而非口头纠正
Boris 的核心习惯:每次 Claude 犯错,不直接说「下次别这样」,而是写入 CLAUDE.md、Skill 或类似持久化机制。
逻辑是:口头纠正只影响当前会话;规则沉淀后,agent 可长期、反复、自主执行。这是「让 agent 几乎无限运行」的前提。
2. Verification(验证)≠ 单元测试
多数人把 verification 理解成 lint、类型检查、单元测试——这些早已自动化,不是 agent 时代的重点。
真正的 verification 是:agent 能否亲自「跑起来」验证结果。
- 早期案例:让 Opus 4 写完功能后,在 bash 里启动另一个 Claude CLI 自测。
- 现在:iOS/Android 模拟器、桌面应用的 computer use 点击测试已成常态。
- Cat 的实践:桌面开发 Skill 教 Claude 启动本地 app、点 UI、测边界;若 staging 异常,先读 Slack 判断是否环境问题;修完后更新 Skill,形成闭环。
要点:验证能力往往需要针对具体产品定制,无法一键通用。
Routines:从「人用工具」到「系统替人值守」
Routines 被定位为 Agent SDK 之后第一个「显而易见」的规模化应用。
典型案例:
- 某工程师为 Voice Mode 设 routine:监听所有相关 GitHub issue/bug → 自动提 PR → 通知本人。
- 另一 routine:5 小时未响应的 bug 自动修复,易验证的直接 merge。
- Cat 遇到自己功能的 edge case bug,还没动手,Claude 提示「另一个 Claude 已修好」。
组织影响:
- 代码评审、CI 修复、rebase 等琐事,团队成员已很久没亲手做。
- 多个人的 Claude 并行工作,形成「隐形协作网」。
这不是辅助编码,而是把工程运维流程产品化、自动化。
Auto Mode:取代 Plan Mode 的默认选择
Boris 明确表示:Plan Mode 已基本不用,全面切到 Auto Mode。
原因:
- Opus 4 ~ 4.5 仍需显式规划;从 4.6、尤其 4.7 起,模型已能自主规划。
- Auto Mode 的价值是:启动 agent 后即可转向下一个任务,无需盯屏点确认。
安全设计的反直觉结论:
人工逐条审批 99% 都会点「是」的权限提示,反而更危险;Auto Mode 用独立分类模型筛风险,人只关注被拦截的少数异常,整体更安全。
上线前流程:
- 收集数千条 agent 轨迹 + 权限请求,训练分类器;
- 红队 prompt injection、渗透测试;
- 建 eval,确保已知攻击全部被拒;
- 内部团队继续攻击、迭代。
Boris 坦承:「把 prompt 路由给另一个模型做安全检查」——他最初认为行不通,实测却效果很好。这反映基于大模型构建产品时,许多旧工程直觉需要重写。
组织变革:AI 必须成为流程中心
Boris 引用 90 年代 HBR 案例:PC 普及初期生产力未显现,因为企业只是把电脑「放在旁边」,流程仍是纸笔+文件柜。
真正释放价值,需要把电脑置于业务流程中心,淘汰旧媒介。
类比到 AI:
- Anthropic onboarding 不问人,问 Claude;
- 提问、写代码、CR、安全审查、填表,均经 Claude/Co-Work;
- 领先企业正在把 AI 放到同样位置。
与 PC 转型需 10–15 年不同,AI 转型更快,因为:
- 工作已高度数字化;
- Claude 能操作电脑、写代码、跑代码。
角色融合:
- 产品、设计、DevRel 都在写代码、提 PR;
- 工程师端到端负责:构思 → 实现 → 对接法务/市场/安全 → 发布;
- 设计、PM、财务、数据科学等「邻接角色」广泛采用 Claude Code。
未来不是「人人 PM」或「人人工程师」,而是两者合一——好奇心、产品品味、端到端 ownership 成为关键能力。
多 Agent 时代的工具形态
从「6 个终端 tab + 6 份 git checkout」→ 单 tab + Agent View + Desktop App(自动 worktree)。
意外变化:Boris 约一半工程工作已在手机上完成——Remote Control、Voice Mode,边走边看 agent,现场聊出新想法即开 agent 实现,无需回电脑。
这说明:工程师的主战场正从 IDE 转向 agent 编排界面。
Context Minimalism(上下文极简主义)
技术话语的演进轨迹:
- Sonnet 3.5 时代 → Prompt Engineering
- Opus 4 时代 → Context Engineering
- 当前模型 → Context Minimalism
原则:
- 最小 system prompt、最少工具集;
- 只给模型「拉取上下文的能力」,不塞满上下文;
- 过多上下文 ≈ 微观管理,限制模型找更优路径;
- Harness 本身也在变瘦,把 token 空间留给用户意图。
这与一年前「精心构造 mega prompt」的做法形成鲜明对比。
对未来的判断(包含我自己的客观审视)
团队预判:
- Agent 运行更久、更自主;
- 很少只跑 1 个 agent,常见是数十、数百、数千;
- 一年后的产品形态很可能与今天完全不同;
- 创新将更多来自用户社区,而非官方闭门设计。
值得肯定的洞见:
- Verification 定义准确,切中 agent 工程要害;
- 「错误写入规则」是可复制的工程纪律;
- Auto Mode 安全思路有实证支撑,不是空喊;
- 组织变革类比有历史参照,不过于浪漫化。
需保持审慎之处:
- 发言者身处 Anthropic 内部,描述的是理想态实践,外部企业落地节奏未必相同;
- 「财务用 Claude Code 做预测」等案例缺少可验证细节;
- Routines 全自动 merge 依赖「易验证」边界,复杂系统风险需自行评估;
- 「角色融合」「手机写代码」更像前沿团队样本,非行业普遍现状。
一句话提炼
Claude Code 一周年的本质,是推动软件工作从「人写代码」转向「人定义验证与规则,由 agent / routine 持续执行」;竞争力正从编码速度转向产品判断、验证设计与组织流程重构。
对实践者的三条可操作建议
- 为关键路径建 Verification Skill:让 agent 能启动、操作、检测你的产品,而不只跑测试套件。
- 把重复纠错沉淀为
CLAUDE.md/ Skill,而非每次会话重新叮嘱。 - 从单 agent 同步协作,逐步试验 Routines + Auto Mode,把 CR/CI/已知 bug 类任务交给自动化值守。
相关资源推荐
Anthropic 团队内设计师们如何用 Claude Code 做产品、写代码、推 PR、浏览器验证、定时巡检…
Claude Code 工程实践揭秘:Anthropic 内部 Skills 设计的九类框架与编写最佳实践
视频章节索引
| 时间 | 主题 |
|---|---|
| 00:00 | Claude Code 的起源与演进 |
| 01:10 | 如何让 Claude 擅长 verification |
| 03:14 | 角色融合:工程师之外的采用 |
| 04:48 | Routines 用于 CI、代码评审等 |
| 06:43 | Boris 首选功能:Auto Mode |
| 08:10 | Auto Mode 安全:红队与 eval |
| 10:24 | 为何 Loop 是下一步跃迁 |
| 11:06 | 工程组织与职责如何变化 |
| 13:30 | 未来是产品还是工程? |
| 14:20 | 管理数百 agent:Agent View、语音、Remote Control |
| 16:05 | 从 context engineering 到 context minimalism |
| 17:17 | Claude Code 的下一步 |
内容效果不满意?点此反馈