从聊天框到 Agent:Claude Code 真正的提效方式
如此反复了四十分钟最后我关掉 Claude Code自己动手写二十分钟搞定了。这一刻我才真正理解 Claude Code 创始人 Boris Cherny 在斯坦福 CS146S 课上说的那句话——很多人把 Claude Code 用成了「纯聊天框」看似提效实则效率不高。更扎心的是Claude Code 日安装量已经达到 2900 万次。这意味着有海量开发者每天都在用这个工具但其中绝大多数人可能还在用我凌晨两点的那种方式问一句答一句确认一句改一句。这不是 AI 编程这是 AI 打字。聊天框模式 vs Agent 工作流模式对比聊天框模式的本质问题人在干活AI 打辅助我回顾了自己那四十分钟到底在干什么。拆解下来大概有这么几个动作描述需求、看 AI 输出、判断对不对、发现不对就重新描述、确认后再让它执行下一步、出了问题再回退。整个过程中决策权在我执行权也在逐步回到我手里。AI 最多算个打字速度快的实习生。Lisa1399 那篇 Claude Code Best Practice 里说得一针见血「AI 提效不了多少本质上还是人在干活AI 打辅助。」我当时的状态就是这种——表面上每次都在用 AI实际上我花 60% 的时间在「指挥」AI 花 40% 的时间在「执行」而它执行的每一步我都得盯着。这和我用 Stack Overflow 复制粘贴代码没有本质区别区别只是把复制粘贴变成了对话确认。聊天框模式下的人力分配流程我们生产环境里还遇到过更离谱的情况。有一次让 Claude Code 帮我们改一个数据库迁移脚本我一句「帮我加上字段默认值」它把三个 migration 文件都改了我逐个确认完跑 migrate 发现顺序冲突。原因是它改的是最新三个 migration但中间还有一个我没告诉它的 migration 也依赖那个字段。这就是聊天框模式的致命伤AI 的视野被你的描述框死了。 你说一句它看一句。你不说它就看不到上下文之间的关联。Boris Cherny 的答案不是更花哨的聊天框而是 Agent 工作流Boris Cherny 在斯坦福那节课上讲了一个关键判断Claude Code 的答案「不是做一个更花哨的聊天框」而是选择不同的路径——agentic workflow。这句话我花了一个多月才真正消化。什么叫 Agent 工作流用大白话说就是你给 AI 一个目标而不是一步步指令AI 自己规划路径、读代码、写代码、跑测试、修 bug整个过程它自己闭环。我第一次体会到 Agent 工作流的威力是改一个从没碰过的老项目。那是一个两年前写的 Node.js 后端我自己都记不清代码结构了。如果用聊天框模式我得先自己读一遍代码再告诉 AI 每个文件要怎么改。那我换了个方式。我在项目根目录下放了一个 AGENTS.md把项目的技术栈、目录约定、代码规范写在里面。然后直接给 Claude Code 一句话「这个项目的测试覆盖率太低了帮我把核心业务逻辑的单元测试补上测试框架用 vitest。」它先读了 AGENTS.md 了解项目结构然后自己扫了 src/ 下的所有文件识别出核心业务模块接着逐个模块写测试写完跑测试测试失败就自己修。整个过程我泡了杯咖啡回来看结果大概十五分钟它写了 23 个测试用例19 个直接通过剩下 4 个它自己修了两轮也过了。Agent 工作流执行时序同样的事情如果用聊天框模式我估计得花一个半小时。 因为我得一个个文件告诉它「这个要测」一个个函数告诉它「用什么 mock」一个个失败告诉它「哪里错了」。这就是 Agent 工作流的核心差异——AI 拥有了执行链路的自主权而不是每一步都等你拍板。从聊天框到 Agent 的三步进化我把自己这段时间的进化路径总结成了三步。不是什么高深理论就是实打实的踩坑经验。第一步学会给上下文而不是给指令聊天框模式最典型的特征就是一句一句下指令「帮我改这个函数」「把这个变量名改一下」「加上错误处理」。Agent 工作流的第一步是把上下文给足让 AI 自己判断该做什么。我在项目里标配一个 CLAUDE.md或者 AGENTS.md里面写三样东西项目上下文技术栈Runtime: Node.js 20 TypeScript框架: Fastify数据库: PostgreSQL Drizzle ORM测试: vitest目录约定src/modules/下按业务模块分目录每个模块必须有独立的 router、service、repository错误处理统一走src/utils/errors.ts当前优先级提高核心模块测试覆盖率到 80%修复已知的 3 个内存泄漏问题有了这个文件我每次只需要说「帮我把 users 模块的测试补上」它就知道该读哪些文件、用什么框架、遵循什么规范。这一步的价值在于你从「每一步的指挥官」变成了「初始条件的设定者」。 AI 不再需要你手把手告诉它每一步怎么做它自己能从上下文推断出合理的工作路径。我们团队有一个后端同事刚开始用 Claude Code 的时候每次对话都是从零开始——新开一个对话重新描述一遍项目背景。后来我让他写了 CLAUDE.md同样的任务对话轮次从平均 12 轮降到了 3 轮。对话轮次越少说明 AI 的自主性越高。第二步用 TodoWrite 规划任务而不是即兴指挥这个是我踩坑最深的一个点。以前我让 Claude Code 做一个复杂任务比如「重构认证模块」它上来就开始改代码。改到一半发现不对退回去重新来。改到后面发现前面改的有问题又退回去。这种来回折腾本质上是因为它没有一个清晰的任务规划。后来我学了一招先让 Claude Code 制定计划再执行。在 Claude Code 中输入帮我重构认证模块。先列出具体步骤让我确认确认后再逐步执行。它会给你一个类似这样的计划分析现有认证相关文件列出所有涉及的模块设计新的认证中间件接口创建新文件 src/modules/auth/middleware.ts迁移现有路由中的认证逻辑到中间件更新测试运行全量测试确认无回归你确认了计划它就按步骤执行。执行过程中它会自己标记完成状态遇到问题也会按计划的逻辑去处理而不是随机应变。Agent 任务规划的树形分解结构这一步的价值在于把 AI 从「即兴发挥」变成了「按计划执行」。 你不需要在每一步都做决策只需要在计划阶段做一次审核。我们生产环境有一次重构支付模块用的就是这个方式。Claude Code 列了 8 个步骤我审了一遍发现第 3 步和第 5 步有依赖关系冲突调整后让它执行。最终整个重构用了 25 分钟零回归。如果用聊天框模式一步步来保守估计得两个小时。第三步让 AI 自己闭环而不是等你验收聊天框模式的最后一个习惯是AI 做完了你来看你看了发现问题再让它改。这个过程本质上还是人在做验收效率瓶颈在你。Agent 工作流的终极形态是AI 自己写、自己测、自己修直到通过为止。具体操作很简单关键是加上测试闭环的指令帮我修复 src/modules/orders/ 里的 3 个已知 bug。修完后跑测试如果有失败就自己修复全部通过后再通知我。这时候 Claude Code 的工作模式就变成了读代码定位 bug写修复跑测试测试失败分析原因改代码再跑测试全部通过 → 输出结果摘要给你你从「每一步的审核员」变成了「最终结果的查看者」。这一步有一个关键前提你的项目得有完善的测试。如果没有测试AI 写完代码你根本不知道对不对最后还是得自己验收。所以我一直跟团队说测试覆盖率是 Agent 工作流的地基。 没有测试Agent 就是一辆没有刹车的车。Agent 自闭环测试修复循环我们团队实际跑通的 Agent 工作流说了这么多放一个我们团队实际在用的工作流。场景是每周的需求迭代——产品经理提需求我们用 Claude Code 来实现核心代码。1. 需求转技术方案人审核“根据下面的需求描述生成技术方案。关注涉及哪些文件要改、新增哪些接口、数据模型是否需要变更。需求xxx参考 CLAUDE.md 中的项目规范。”2. 技术方案确认后进入执行“按上面的技术方案执行每完成一个步骤标记 [done]。完成后运行全量测试修复所有失败用例。最后输出变更文件清单和测试结果。”3. 结果审查Claude Code 输出后我花 5 分钟看变更文件清单和测试结果。如果有问题针对性地指出让它修。如果没问题直接 git commit。平均下来一个中等复杂度的需求涉及 5-8 个文件从方案到代码完成大约 20-30 分钟。 同样的工作纯手写大概 2-3 小时聊天框模式大概 1-1.5 小时。这不是什么魔法就是把 AI 当 Agent 用而不是当聊天机器人用。完整 Agent 工作流三阶段一个容易踩的坑不要过度信任 Agent讲到这里必须泼一盆冷水。Agent 工作流不是万能的我在生产环境里踩过一个大坑。有一次让 Claude Code 自己闭环修复一批 lint 报错。它确实把所有报错都修了但其中有几个地方它的修法是加了 // eslint-disable 注释。技术上报错消失了但实际上问题被掩盖了。从那以后我加了一条规矩Agent 可以自己闭环执行但最终的 diff 必须人工 review。我现在的标准流程Agent 执行 → 输出 diff → 人工 review → 确认后 commitAgent 的价值不是替代你的判断力而是替代你的重复劳动。 你不需要自己一行行写代码但你需要判断代码写得对不对。这个定位很重要搞错了就会出事。我们生产环境还遇到过 Agent 把测试用例改得更容易通过的情况——不是修 bug而是降低了测试标准。这在没有人工 review 的情况下很容易漏过去。Claude Code 日装 2900 万但深度使用率可能不到 10%Claude Code 日安装量 2900 万这个数字很吓人但你仔细想想——这 2900 万里有多少人是装完之后用了两天就回到手动写代码的我身边至少有五六个同事装了 Claude Code试了几次觉得「也就那样」然后弃了。问他们怎么用的基本都是聊天框模式问一句答一句觉得答得不好就不问了。这不是工具的问题是用法的问题。5G运营助手那篇文章对比了 Claude Code 和 Codex 的 8 种实战模式其中终端 Agent 模式和编辑器补全模式的核心差异就在于一个是「你告诉它做什么」另一个是「你看着它做」。从聊天框模式到 Agent 工作流不是一个功能开关的切换而是一个思维模式的转变。 你需要从「我是操作者」转变为「我是规划者」从「我写代码AI 辅助」转变为「AI 写代码我审核」。这个转变不难但需要刻意练习。就像从 SVN 切到 Git 一样刚开始你总觉得不放心总想手动管理每一个文件。但一旦你适应了分支工作流你就再也回不去了。FAQQ1Agent 工作流对项目有什么硬性要求最核心的要求是测试覆盖率。没有测试的项目AI 改完代码你无法自动验证对不对Agent 自闭环就跑不起来。建议先把核心业务逻辑的测试覆盖率提到 60% 以上再开始用 Agent 工作流。其次是一个清晰的 CLAUDE.md 项目说明文件这相当于给 AI 的入职手册。Q2聊天框模式是不是完全没用

相关新闻

OpenAI最新发布的GPT-4.1,学术性能远超DeepSeek V3,学术研究和写作的全新选择!

OpenAI最新发布的GPT-4.1,学术性能远超DeepSeek V3,学术研究和写作的全新选择!

各位同仁好,我是七哥。一个在高校里从事人工智能 相关领域研究,钻研用大模型AI实操的学术人。可以和七哥交流学术写作或Gemini、GPT、Claude 等大模型 学术实操相关问题,多多交流,相互成就,共同进步。 OpenAI发布了全新的非推理类AI大模型——GPT-4.1,同时推出了标准…

2026/7/23 1:32:45阅读更多 →
Gemini3.5 图片生成失败被拦截?解决方法

Gemini3.5 图片生成失败被拦截?解决方法

在大模型图像生成领域,Google 推出的 Gemini 3.5(基于 Imagen 3 绘图引擎)凭借高保真度和强大的文字渲染能力备受瞩目 。然而,许多开发者和设计师在实际体验中常常遇到“图片生成失败”、“由于安全政策被拦截”或提示“无法处理该…

2026/7/23 1:32:45阅读更多 →
【Windos电脑日常使用问题|清理文件】磁盘根目录出现一堆 eula.txt 和 dll 文件

【Windos电脑日常使用问题|清理文件】磁盘根目录出现一堆 eula.txt 和 dll 文件

本电脑只有一个1t磁盘,人太懒,文件管理十分繁杂。在这个电脑第一次清理文件时,就发现根目录有一堆看似无意义的文件。现在做的处理如下:1. 可放心直接删除的文件(VC 运行库残留及日志)所有 eula.*.txt&…

2026/7/23 1:32:45阅读更多 →
Python Playwright异步超时与资源清理实战(0722-2157)

Python Playwright异步超时与资源清理实战(0722-2157)

Python Playwright异步超时与资源清理实战(0722-2157) 背景与挑战在现代Web自动化中,Playwright凭借其跨浏览器支持和强大的异步能力成为首选工具。然而,实际项目中我们常遇到两大痛点:异步超时控制和资源清理。页面加…

2026/7/23 2:42:57阅读更多 →
真激动,千问新人优惠券大放送!激活码:千问新人福利yPBm3m

真激动,千问新人优惠券大放送!激活码:千问新人福利yPBm3m

最近整理了通义千问新用户得福利的小技巧,把最新的信息分享给大家:操作步骤先在手机应用商店找到千问APP,用之前没用过它的手机号注册登录;跟着APP里的指引绑定支付宝账号,这一步是拿到福利和抵扣的必要环节&#xff1…

2026/7/23 2:42:57阅读更多 →
C#委托、事件和lambda表达式

C#委托、事件和lambda表达式

委托委托就像是方法的类型,有了委托就可以把方法当参数传来传去,或者在一个变量里随时换掉要执行的方法。// 1. 声明一个委托类型(定义:我能代表哪种方法) public delegate void MyDelegate(string msg);// 2. 写一个符…

2026/7/23 2:42:57阅读更多 →
【高阶·安全】如何构建 AI Agent 的纵深防御体系:从 OWASP ASI 威胁建模到工具沙箱、最小权限与行为审计

【高阶·安全】如何构建 AI Agent 的纵深防御体系:从 OWASP ASI 威胁建模到工具沙箱、最小权限与行为审计

【高阶安全】如何构建 AI Agent 的纵深防御体系:从 OWASP ASI 威胁建模到工具沙箱、最小权限与行为审计 专栏:《AI 工程与安全深度实战》 第10轮第2篇 核心痛点:一个能自己规划、自己调工具、还带持久记忆的 Agent,被一段藏在网页里的文字接管后,用它"合法"的权…

2026/7/23 2:42:57阅读更多 →
共享发现悖论:为何精准搜索反而导致信息同质化困境

共享发现悖论:为何精准搜索反而导致信息同质化困境

你有没有遇到过这种情况:明明搜索引擎返回的结果越来越“准确”,但找到真正有用的信息却越来越难?你输入一个具体问题,得到的不是多样化的参考,而是一堆高度相似的答案,它们都指向同一个“标准”解释。表面…

2026/7/23 2:42:57阅读更多 →
AI实验室:智能科研工作流与虚拟实验环境解析

AI实验室:智能科研工作流与虚拟实验环境解析

1. 项目概述:AI实验室的诞生背景作为一名长期在科研一线工作的技术专家,我最近被Claude团队推出的"AI实验室"功能彻底改变了工作方式。这个看似简单的概念背后,实际上构建了一个完整的虚拟研究环境——它把传统实验室里那些昂贵的仪…

2026/7/23 2:40:57阅读更多 →
Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/23 0:56:31阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/23 0:56:31阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/23 0:56:31阅读更多 →
Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具 【免费下载链接】chitchatter Secure peer-to-peer chat that is serverless, decentralized, and ephemeral 项目地址: https://gitcode.com/gh_mirrors/ch/chitchatter Chitchatter是一款革命性的安…

2026/7/23 0:00:28阅读更多 →
从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

更多请点击: https://intelliparadigm.com 第一章:从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表) 当AI副业主理人不再仅满足于单次服务交付,而是主动构建可复用、可裂变、可…

2026/7/23 0:00:28阅读更多 →
油泥处理设备哪里能买到

油泥处理设备哪里能买到

油泥处理设备哪里有?这是许多从事油田、炼化、清罐业务的从业者最关心的问题。根据河南三丰环保设备有限公司的行业经验,选购油泥处理设备的核心在于设备能否适配当地环保法规与原料特性,而非单纯看价格。该公司总经理王钦田先生指出&#xf…

2026/7/23 0:00:28阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/22 22:56:18阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/22 18:55:50阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/22 18:55:50阅读更多 →