AI工作流在企业审批场景的复盘:规则引擎+LLM混合判定的工程经验
AI工作流在企业审批场景的复盘规则引擎LLM混合判定的工程经验一、为什么审批场景需要AI传统企业审批流程纯粹靠规则引擎——金额5000需要部门经理审批、合同类型采购需要法务审核。规则覆盖了约75%的审批决策但剩下25%的灰色地带如外包人员出差费用是否合理、合同条款中的非标准风险无法用规则描述。2025年中实施了一个规则引擎LLM的混合审批系统。规则引擎处理确定性逻辑75%LLM处理需要语义理解的灰色地带25%。这个比例后来被验证为最优资源分配。二、混合判定的核心设计规则引擎部分 —— 处理75%的确定性场景规则引擎不是if-else。选用了DroolsJava规则引擎的Golang移植版本支持声明式规则定义rule 费用审批-金额阈值 when $req: ApprovalRequest( type expense, amount 5000, amount 10000 ) then $req.setAction(require_manager_approval); $req.setConfidence(1.0); end rule 费用审批-部门预算 when $req: ApprovalRequest(type expense) $dept: Department(name $req.department, budgetRemaining $req.amount) then $req.setAction(reject); $req.setReason(部门预算不足); $req.setConfidence(1.0); end规则引擎的确定性决策confidence1.0直接出结果不经过LLM。LLM部分 —— 处理25%的灰色地带当规则引擎无法匹配或匹配后confidence1.0时进入LLM流水线class HybridApprovalPipeline: def __init__(self, rule_engine, llm_client, human_queue): self.rule_engine rule_engine self.llm llm_client self.human_queue human_queue async def process(self, request: ApprovalRequest) - Decision: # 第一层规则引擎 rule_result await self.rule_engine.evaluate(request) if rule_result.confidence 1.0: return rule_result # 确定性返回 # 第二层上下文构建关键 context await self._build_context(request) # 第三层LLM判定 llm_result await self.llm.evaluate(request, context) # 第四层置信度阈值判断 if llm_result.confidence 0.85: decision llm_result.to_decision() self._log_llm_decision(request, decision, llm_result.reasoning) return decision else: # 低置信度升级到人工 return await self._escalate_to_human(request, llm_result) async def _build_context(self, request: ApprovalRequest) - dict: 构建LLM判定的上下文——信息越全准确率越高 return { request: request, historical_similar: await self._get_similar_approvals(request), department_budget: await self._get_budget(request.department_id), company_policy: await self._get_relevant_policy(request.type), applicant_history: await self._get_user_approval_history(request.user_id), }三、上下文构建的数据工程LLM判定准确率高度依赖输入的上下文质量。一个审批请求在进入LLM之前需要构建如下上下文数据申请人历史数据此员工过去12个月的审批通过率、异常审批次数、平均审批金额相似历史审批最近100条同类型审批的决策结果及理由部门预算当前预算剩余、已用比例、与去年同期对比公司政策与此审批类型相关的文字政策从公司Wiki检索这些上下文数据的构建涉及到多个数据源的聚合平均耗时约2秒——是整体延迟的主要贡献者。四、效果与风险管控运行数据6个月日均处理审批约800条规则引擎处理比例73%直接返回LLM处理比例22%人工审核比例5%LLM判定准确率与人工审核结果对比91%平均处理时间规则引擎100ms, LLM约3.2秒, 人工约4小时风险管控机制LLM决策必须附带推理过程Chain-of-Thought。审批日志中记录完整的为什么这样判定供人工抽查。异常检测规则——规则引擎永远不会被绕过。即使LLM给出了PASS决定如果触发金额部门月预算的30%仍强制升级到人工。A/B对照实验5%的LLM判定请求同时发送给人工审核计算一致率。月度一致率低于90%时触发LLM Prompt调整。回滚能力LLM的Prompt通过版本管理任何时候可以回滚到上一版本。一次Prompt更新导致差旅费用审批的拒绝率从8%跳到22%因过度严格15分钟回滚恢复。五、总结规则引擎LLM混合审批的核心经验75/25的分工比例是关键。确定性的事情用规则引擎零延迟、零幻觉非确定性的事情用LLM语义理解。不要让LLM做规则引擎能做的事——浪费算力且引入不必要的幻觉风险。上下文质量决定LLM准确率。投入在数据聚合上的工程时间约总工期的40%是系统正确性的基础。强制推理过程记录。LLM判定不可解释就无法在企业环境中落地。Chain-of-Thought推理链是审批审计的必要条件。永远的兜底规则引擎的安全红线。无论LLM判定什么违反安全规则的审批必须被拦截。最大的经验教训在审批场景中LLM不是替代规则引擎而是填补规则引擎的空白。试图用LLM替代所有审批逻辑会导致成本失控每条审批都调LLM月费上万美元和风险失控LLM幻觉导致的错误审批。混合方案把两者的优势结合——确定性交给规则模糊性交给AI。

相关新闻

计算机毕业设计之基于springboot的体检服务系统的设计与实现

计算机毕业设计之基于springboot的体检服务系统的设计与实现

随着经济的发展,互联网络时代也在飞速进步,每个行业都在努力发展现在先进技术,通过这些先进的技术来提高自己的水平和优势。本文将讲述设计开发一个体检服务系统的设计与实现,这个体检服务系统的设计与实现包括三个部分&#xff1…

2026/7/22 0:19:23阅读更多 →
Kimi    LeetCode 3677. 统计二进制回文数字的数目 Java实现

Kimi LeetCode 3677. 统计二进制回文数字的数目 Java实现

让我先搜索 LeetCode 3677 的题目详情。这是可以直接提交到 LeetCode 的完整 Java 实现:java class Solution {public int countBinaryPalindromes(long n) {if (n 0) {return 1;}int count 1; // 0 是回文数int m getBinaryLength(n); // n 的二进制位数// 1. 统…

2026/7/22 0:19:23阅读更多 →
DeepSeek    LeetCode 3671. 子序列美丽值求和 Java实现

DeepSeek LeetCode 3671. 子序列美丽值求和 Java实现

这道题需要计算所有“严格递增”且“GCD恰好为g”的子序列对答案的贡献。直接枚举所有子序列会超时,所以核心思路是容斥原理 树状数组优化DP。算法思路1. “至少”变“恰好”:先计算 cnt[g],表示子序列元素都是g的倍数(即GCD“至…

2026/7/23 4:09:38阅读更多 →
深入解析Tiva ADC中断与触发机制:从寄存器到多序列实战

深入解析Tiva ADC中断与触发机制:从寄存器到多序列实战

1. 从寄存器到实战:理解ADC中断与触发机制的核心在嵌入式系统里做数据采集,ADC(模数转换器)绝对是核心外设之一。但很多开发者,尤其是刚接触TI Tiva系列MCU的朋友,往往只停留在调用驱动库函数完成一次转换的…

2026/7/23 4:29:13阅读更多 →
C++实现模糊综合评价:从原理到工程实践

C++实现模糊综合评价:从原理到工程实践

1. 项目概述:当C遇上模糊综合评价最近在做一个决策支持相关的项目,里面涉及到对多个非量化因素进行综合评判。比如,要评估一个软件项目的风险等级,影响因素有“技术复杂度”、“团队经验”、“需求稳定性”等等,这些玩…

2026/7/23 4:29:13阅读更多 →
别再给 Coding Agent 手搓工具封装:用 QVeris 搭一个开发者自动化 Agent

别再给 Coding Agent 手搓工具封装:用 QVeris 搭一个开发者自动化 Agent

现在的 Coding Agent 已经很会写代码了,但一旦任务离开本地仓库,它的能力就会迅速缩水:查最新 API 文档、研究陌生报错、核对依赖兼容性、查询服务状态、整理 Issue 上下文……这些工作都需要访问真实的外部工具和数据。 问题在于&#xff0…

2026/7/23 4:29:13阅读更多 →
德钟壶稳坐茶席,红紫窑变自有分量

德钟壶稳坐茶席,红紫窑变自有分量

钟腹稳茶台, 红紫绕壶身。 火色虽浓重, 端坐自安然。 德钟壶讲究的是一个“稳”字。壶身饱满,重心落得低,壶嘴与壶把左右舒展,整把壶像稳稳坐在茶席上。 这份端正,正好承住了红紫窑变的浓厚。颜色再丰富&am…

2026/7/23 4:29:13阅读更多 →
TI DCAN寄存器深度解析:从错误计数到消息对象的高效管理

TI DCAN寄存器深度解析:从错误计数到消息对象的高效管理

1. DCAN控制寄存器:从错误计数到消息处理的核心枢纽在嵌入式系统,尤其是汽车电子和工业控制领域,控制器局域网(CAN)总线是连接各个电子控制单元(ECU)的神经系统。它的可靠性直接决定了整个系统的…

2026/7/23 4:29:13阅读更多 →
SolidWorks 2021许可证报错解决方案与验证机制解析

SolidWorks 2021许可证报错解决方案与验证机制解析

1. SolidWorks 2021许可证报错问题概述遇到SolidWorks 2021提示"无法获得许可证,无效的不一致的使用许可证号码"时,大多数用户的第一反应是重新安装软件。但根据我多年处理SolidWorks许可证问题的经验,90%的情况下根本不需要重装。…

2026/7/23 4:27:13阅读更多 →
Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/23 0:56:31阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/23 0:56:31阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/23 0:56:31阅读更多 →
Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具 【免费下载链接】chitchatter Secure peer-to-peer chat that is serverless, decentralized, and ephemeral 项目地址: https://gitcode.com/gh_mirrors/ch/chitchatter Chitchatter是一款革命性的安…

2026/7/23 0:00:28阅读更多 →
从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

更多请点击: https://intelliparadigm.com 第一章:从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表) 当AI副业主理人不再仅满足于单次服务交付,而是主动构建可复用、可裂变、可…

2026/7/23 0:00:28阅读更多 →
油泥处理设备哪里能买到

油泥处理设备哪里能买到

油泥处理设备哪里有?这是许多从事油田、炼化、清罐业务的从业者最关心的问题。根据河南三丰环保设备有限公司的行业经验,选购油泥处理设备的核心在于设备能否适配当地环保法规与原料特性,而非单纯看价格。该公司总经理王钦田先生指出&#xf…

2026/7/23 0:00:28阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/22 22:56:18阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/22 18:55:50阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/22 18:55:50阅读更多 →