滴滴 AI 研发岗一面:Agent 有几种设计模式?不能只背 5 个名字
最近互联网行业确实有点“风声鹤唳”。组里一位同事也“被广进”了出来看机会时面了滴滴的 AI 研发岗。一面面试官问了他一道 Agent 题Agent 的设计模式有几种分别适合什么业务场景这题看着像八股真正的坑却是分类口径Agent 的设计模式没有公认的固定数量。如果直接回答“有三种”或“有五种”再把 ReAct、Plan-and-Execute、Reflection、Multi-Agent 平铺在一起名词可能都对层次却乱了。更推荐的答法是按业务系统怎么推进任务来分。先给出五类常见方式再说它们分别适合什么场景。常见方式核心特点适合的业务场景Workflow确定性流程步骤、分支和规则提前写好审批、退款、批处理等路径稳定的任务ReAct根据工具刚返回的信息决定下一步异常定位、客服取证、开放式检索Plan-and-Execute先拆出主计划执行中允许调整多源分析、复杂报告、长周期任务Reflection生成后按标准检查不达标就重做代码、SQL、合规文案和分析报告质检Multi-Agent把任务交给不同专业角色需要不同工具、权限或专业背景的协作任务严格来说这五个名词不在同一层Workflow 不是自主 AgentReflection 是质检回路Multi-Agent 是组织方式。但面试官问的是“分别使用什么业务场景”把它们放在一张选型表里比纠结到底算三种还是五种更有用。真实系统也很少五选一。常见组合是Workflow 定住主干局部用 ReAct复杂任务加 Plan关键产物再用 Reflection 验收。只有分工确实带来收益时才增加多个 Agent。01Workflow路径能写清就不让 Agent 自由决定Workflow 的核心是确定性。先做什么、后做什么、什么条件走哪个分支都由开发者提前写进代码。模型可以参与其中某个节点但不拥有整条路径的控制权。例如退款处理系统依次检查订单状态、退款资格、金额上限和风险等级低风险请求自动执行超过阈值再进人工审批。模型可以帮忙识别用户意图、提取申请理由但资格判定、金额计算和真正打款仍由规则控制。这类场景要的是可预测、幂等和可审计不是模型临场发挥。审批流、批量任务、规则计算和关键状态写入默认都应从 Workflow 开始。02ReAct下一步取决于刚拿到的结果ReAct 把 Reasoning 和 Acting 交替起来模型判断下一步动作调用工具读取环境返回的 Observation再决定下一步。它不是一次把路线想完而是边取证边调整。ReAct 原始论文就是用这种交替方式把推理和外部行动接到了一起。判断一个业务是否适合 ReAct我主要看一句话没有上一步的查询结果现在就无法决定下一步。例如乘客反馈“这笔订单金额不对”。客服 Agent 可以先查订单明细如果里程和时长异常继续查计价明细如果计价正常但优惠未生效再查优惠资格和使用记录如果应付金额正确、实付金额异常转去查支付流水证据仍不完整就停止自动判断交给人工处理。这里不存在一条对所有投诉都适用的固定查询路径。每次工具返回的事实都会缩小下一步的选择范围。这就是 ReAct 的业务价值。它适合异常定位、开放式检索、动态问答和需要逐步取证的客服场景。代价也很直接调用轮数多容易兜圈子错误判断还会沿着后续步骤放大。PS不是每个 Tool-Calling Loop 都严格等同于 ReAct。现代 SDK 可以只暴露工具调用与返回结果不要求显式输出论文里的推理轨迹。这里借用的是“根据新观察选择下一步”这个核心结构。加分项ReAct 上生产还要主动限制它的行动范围。我至少会加四个限制只读工具优先、最大轮数、总成本预算、触发人工接管的条件。涉及退款、改价、封禁等写操作时模型可以给建议但不能凭一条推理链直接落库。03Plan-and-Execute任务很长要先做主计划Plan-and-Execute 先让 Planner 生成多步计划再由 Executor 逐项完成执行结果不符合预期时重新规划剩余步骤。LangChain 对这一架构的实现也包含 Planner、Executor 和 Replan而不是“计划生成后永远照着跑”。它和固定工作流的差别很关键。固定工作流的路径由开发者预先写进代码Plan-and-Execute 的计划由模型根据当前任务动态生成而且允许重排。两者也不能只按任务长短区分。ReAct 每轮决定的是下一次工具调用Plan-and-Execute 先排出一段可审查的任务计划。执行器内部仍然可以运行 ReAct只有计划失效时才回到 Planner 重排。因此“退款申请依次经过资格校验、金额计算、审批和打款”不是 Plan-and-Execute 的好例子。这些步骤明确、规则稳定直接写工作流更可靠。更合适的业务场景是生成一份城市运力异常分析报告。目标很清楚但每次分析的重点不同。Agent 可以先规划确认异常发生的城市、时段和指标拉取供需、天气、活动和交通数据找出变化最大的区域验证几个可能原因形成结论、证据和建议。执行到第三步时如果发现异常只集中在机场区域后续计划就应该收缩到航班、排队时长和机场运力而不是机械跑完原计划。适合 Plan-and-Execute 的不是“步骤固定”而是“目标稳定、任务较长、主路线可以先规划”。它常用于多源分析、复杂报告、跨系统资料整理和长周期研发任务。两三次工具调用能解决的事先生成一份长计划只会增加延迟。04Reflection要解决的是结果合不合规很多面试答案会把 Reflection 和前两种模式并列。我觉得这句话只对了一半。ReAct 和 Plan-and-Execute 解决“怎么推进任务”Reflection 解决“当前产物是否合格应该回到哪一步重做”。它可以放在最终结果之后也可以插在计划、查询或生成的中间节点但通常不单独完成业务目标。它适合什么业务得先有可检查的标准。例如 Agent 写完一份客诉处理建议后评估器检查引用的订单、计价和支付事实是否都有查询证据建议是否符合当前赔付规则有没有承诺系统无法执行的动作缺少关键证据时是否明确转人工。检查不通过再带着具体问题修改一次。这里的反馈来自证据和规则而不是让另一个模型泛泛地说“还可以写得更好”。代码生成、SQL 生成、合规文案、分析报告都适合加这一层因为测试、Schema、政策条款或事实清单能充当外部评分信号。反过来如果标准含糊、没有新证据、修改也无法验证Reflection 很容易变成两个模型互相提意见成本翻倍质量却没有稳定提升。PSReflexion 研究使用环境反馈形成可带入后续尝试的反思记忆Evaluator-Optimizer 则是“生成—评估—修改”的迭代回路。两者都处理质量问题但不是同一种实现。05Multi-Agent任务需要不同专业角色协作Multi-Agent 是把一个任务拆给多个专业 Agent分别使用它们的工具、权限或领域上下文再组合结果。每个子 Agent 内部仍然可以跑 ReAct也可以执行 Planner 分配的任务。例如一次复杂客诉同时涉及订单、计价、支付和风控证据。主 Agent 根据投诉内容决定调查项再把查询交给具备不同工具权限的专家 Agent最后统一汇总证据和结论。这就是 Multi-Agent 有收益的场景分工来自真实的专业和权限边界不是为了多创建几个 Agent。但如果查询项早就固定为订单、支付、优惠券三项普通并行工作流就够了不必创建三个会对话的 Agent。多 Agent 真正成立至少要满足一项子问题需要不同工具、权限或专业上下文子任务可以并行节省的时间大于协调成本需要多个独立视角交叉检查子任务无法在设计阶段预先写死要由编排者动态决定。PSMulti-Agent 还要说清任务所有权。主 Agent 保留最终责任、调用专家完成子任务常被称为Manager当前 Agent 把本轮后续处理交给专家 Agent常被称为Handoff。前者是“请专家帮忙”后者是“接下来由专家负责”。加分项多个 worker 可以并行查不能默认并行改。同一订单状态、同一赔付结论或同一业务对象存在共享写入时要么划清所有权要么回到单线程提交。06到底怎么选只看 5 个判断路径能提前写清吗能就用 Workflow。下一步是否依赖刚返回的信息是用 ReAct否则看是否需要先做计划。任务是否较长主路线能否提前拆出能用 Plan-and-Execute。结果有没有明确标准可检查有再加 Reflection。子任务是否需要不同工具、权限或专业背景需要才考虑 Multi-Agent。这道题真正想听的不是你能背出多少名词而是三件事能不能先说清分类口径能不能把设计模式映射到业务条件能不能知道什么时候不该让 Agent 做决定。只答 ReAct、Plan-and-Execute、Reflection是在回答“你听过什么”能讲清控制权、任务所有权和失败代价才是在回答“你能否把 Agent 放进真实业务场景里”。学AI大模型的正确顺序千万不要搞错了2026年AI风口已来各行各业的AI渗透肉眼可见超多公司要么转型做AI相关产品要么高薪挖AI技术人才机遇直接摆在眼前有往AI方向发展或者本身有后端编程基础的朋友直接冲AI大模型应用开发转岗超合适就算暂时不打算转岗了解大模型、RAG、Prompt、Agent这些热门概念能上手做简单项目也绝对是求职加分王给大家整理了超全最新的AI大模型应用开发学习清单和资料手把手帮你快速入门学习路线:✅大模型基础认知—大模型核心原理、发展历程、主流模型GPT、文心一言等特点解析✅核心技术模块—RAG检索增强生成、Prompt工程实战、Agent智能体开发逻辑✅开发基础能力—Python进阶、API接口调用、大模型开发框架LangChain等实操✅应用场景开发—智能问答系统、企业知识库、AIGC内容生成工具、行业定制化大模型应用✅项目落地流程—需求拆解、技术选型、模型调优、测试上线、运维迭代✅面试求职冲刺—岗位JD解析、简历AI项目包装、高频面试题汇总、模拟面经以上6大模块看似清晰好上手实则每个部分都有扎实的核心内容需要吃透我把大模型的学习全流程已经整理好了抓住AI时代风口轻松解锁职业新可能希望大家都能把握机遇实现薪资/职业跃迁这份完整版的大模型 AI 学习资料已经上传CSDN朋友们如果需要可以微信扫描下方CSDN官方认证二维码免费领取【保证100%免费】

相关新闻

HarmonyOS应用开发实战:猫猫大作战-Text 组件的多行排版能力

HarmonyOS应用开发实战:猫猫大作战-Text 组件的多行排版能力

前言 上一篇我们用 Text 组件把「猫猫大作战」主菜单的 Emoji 主标题 副标题三行渲染完成。但实战中副标题往往不是一句话能写完的——可能是多行规则说明、可能是带省略号溢出的长描述、可能是多段不同样式的混排。本篇继续以「猫猫大作战」主菜单的规则说明面板为锚点&…

2026/7/28 2:31:07阅读更多 →
Style2Paints V4:AI驱动的分图层自动上色技术深度解析

Style2Paints V4:AI驱动的分图层自动上色技术深度解析

Style2Paints V4:AI驱动的分图层自动上色技术深度解析 【免费下载链接】style2paints sketch style paints :art: (TOG2018/SIGGRAPH2018ASIA) 项目地址: https://gitcode.com/gh_mirrors/st/style2paints 在数字艺术创作领域,手动上色一直是耗…

2026/7/28 2:31:07阅读更多 →
波段舞者系统 同花顺期货通指标

波段舞者系统 同花顺期货通指标

今天给大家带来是一款同花顺期货通指标,并且已经上架到同花顺期货通的指标广场上了。喜欢的朋友可以去指标广场安装试用!!友情提示:(指标只是辅助,不作建议)拼多多店铺:指标公式编写…

2026/7/28 2:31:07阅读更多 →
在Windows 10/11上运行Android应用的终极方案:WSABuilds完整指南

在Windows 10/11上运行Android应用的终极方案:WSABuilds完整指南

在Windows 10/11上运行Android应用的终极方案:WSABuilds完整指南 【免费下载链接】WSABuilds Run Windows Subsystem For Android on your Windows 10 and Windows 11 PC using prebuilt binaries with Google Play Store (MindTheGapps) and/or Magisk or KernelSU…

2026/7/28 3:53:18阅读更多 →
如何构建企业级AI技能架构:Awesome Claude Skills的3大核心模块解析

如何构建企业级AI技能架构:Awesome Claude Skills的3大核心模块解析

如何构建企业级AI技能架构:Awesome Claude Skills的3大核心模块解析 【免费下载链接】awesome-claude-skills A curated list of awesome Claude Skills, resources, and tools for customizing Claude AI workflows 项目地址: https://gitcode.com/GitHub_Trendi…

2026/7/28 3:53:18阅读更多 →
Source 2资源解析终极指南:ValveResourceFormat专业工具详解

Source 2资源解析终极指南:ValveResourceFormat专业工具详解

Source 2资源解析终极指南:ValveResourceFormat专业工具详解 【免费下载链接】ValveResourceFormat Source 2 Viewer is an all-in-one tool to browse VPK archives, view, extract, and decompile Source 2 assets, including maps, models, materials, textures,…

2026/7/28 3:53:18阅读更多 →
基于ESP32与TensorFlow Lite Micro的轻量化物体识别系统实践

基于ESP32与TensorFlow Lite Micro的轻量化物体识别系统实践

1. 项目缘起:当掌控板遇上植物,一个“小方舟”的诞生最近在折腾掌控板,总想用它做点既有趣又有用的小玩意儿。手头正好有个百灵鸽扩展板,能接摄像头,就琢磨着能不能让这块小板子“长眼睛”,干点识别物体的活…

2026/7/28 3:53:18阅读更多 →
AList终极部署指南:5步搭建你的个人云盘聚合器

AList终极部署指南:5步搭建你的个人云盘聚合器

AList终极部署指南:5步搭建你的个人云盘聚合器 【免费下载链接】alist 🗂️A file list/WebDAV program that supports multiple storages, powered by Gin and Solidjs. / 一个支持多存储的文件列表/WebDAV程序,使用 Gin 和 Solidjs。 项目…

2026/7/28 3:53:18阅读更多 →
终极指南:如何在5分钟内用Oh My Posh打造高颜值终端界面

终极指南:如何在5分钟内用Oh My Posh打造高颜值终端界面

终极指南:如何在5分钟内用Oh My Posh打造高颜值终端界面 【免费下载链接】oh-my-posh The most customisable and low-latency cross platform/shell prompt renderer 项目地址: https://gitcode.com/GitHub_Trending/oh/oh-my-posh 你是否厌倦了单调的黑白命…

2026/7/28 3:51:18阅读更多 →
覆盖国产 + 海外 + 开源模型,OpenClaw 2.7.9 Windows/Mac 双端部署详解

覆盖国产 + 海外 + 开源模型,OpenClaw 2.7.9 Windows/Mac 双端部署详解

🔹 工具基础介绍 OpenClaw 是开源生态中一款实用性较强的本地智能工具,凭借本地离线运行、可视化图形操作和任务自动化三大核心特性,赢得了众多用户的青睐。与普通在线对话AI工具不同,它属于能够直接操控本机软硬件的智能数字员工…

2026/7/27 1:14:34阅读更多 →
伺服阀焊完微漏毁整机?精密激光焊接三关锁住高压

伺服阀焊完微漏毁整机?精密激光焊接三关锁住高压

所谓液压伺服阀体的精密激光焊接,是用激光束对阀座壳体(通常为不锈钢或铝合金)进行密封焊接,使阀体在21-35MPa的高压液压油或压缩气体中长期运行而不发生介质泄漏。液压伺服阀是高端液压系统的"大脑"。从航空航天飞行控…

2026/7/28 2:08:06阅读更多 →
D2DX:三步实现《暗黑破坏神2》高清宽屏体验的终极指南

D2DX:三步实现《暗黑破坏神2》高清宽屏体验的终极指南

D2DX:三步实现《暗黑破坏神2》高清宽屏体验的终极指南 【免费下载链接】d2dx D2DX is a complete solution to make Diablo II run well on modern PCs, with high fps and better resolutions. 项目地址: https://gitcode.com/gh_mirrors/d2/d2dx 你是否还在…

2026/7/28 1:38:28阅读更多 →
告别臃肿!3步让你的暗影精灵笔记本重获新生

告别臃肿!3步让你的暗影精灵笔记本重获新生

告别臃肿!3步让你的暗影精灵笔记本重获新生 【免费下载链接】OmenSuperHub Control Omen laptop performance, fan speeds, and keyboard lighting, and unlock power limits. 项目地址: https://gitcode.com/gh_mirrors/om/OmenSuperHub 你是否也曾为官方Om…

2026/7/28 0:00:29阅读更多 →
RAG必踩坑!财报法规检索不准?这款开源工具让答案浮出水面,准确率飙升98.7%!

RAG必踩坑!财报法规检索不准?这款开源工具让答案浮出水面,准确率飙升98.7%!

做 RAG 的人应该都踩过这个致命的坑:把几百页的财报、法规、技术手册扔给向量库,问一个具体问题,搜出来的全是沾边但没用的内容 —— 关键信息要么被硬切块拆碎了,要么藏在几十条结果的最下面。语义相似≠真正相关,这个…

2026/7/28 0:00:29阅读更多 →
抖音视频文案提取工具全指南:免费2026版、手机App、在线工具一网打尽

抖音视频文案提取工具全指南:免费2026版、手机App、在线工具一网打尽

2026年做短视频运营,从抖音上扒文案早就不是偷偷抄笔记的事了。我刚开始做内容的时候,每天刷半小时抖音,手动把爆款视频的口播敲进备忘录,一条2分钟的视频得花十来分钟,碰到语速快的还要反复回听。后来试了一圈工具&am…

2026/7/28 0:00:29阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/27 16:57:54阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/28 3:17:03阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/28 2:35:58阅读更多 →