Dify OpenAI-Compatible 插件报 model_not_found:校准 Base URL 与模型 ID
Dify 的 OpenAI-API-compatible 插件可以给兼容 OpenAI 接口的服务手动添加模型。真正容易出错的不是 Key而是界面 Model Name 与 API endpoint 中的模型名称 没有对齐保存或验证时就返回 model_not_found。适用环境Dify 官方 openai_api_compatible 插件 0.0.55 的可自定义聊天模型。先用这组最小配置与命令完成预检Model Name: 便于在 Dify 中识别的名称API Base URL: https://service.example/v1model name for API endpoint: /models 返回的精确 idCompletion mode: chatcurl -sS -H Authorization: Bearer YOUR_API_KEY \https://service.example/v1/models成功信号是模型目录 200再用精确 ID 发送最小 Chat Completions 请求也返回 200 和可读正文失败对照是错误模型的 404 model_not_found。先完成这三段信号再进入工作流排查。本文实际运行的是只监听 127.0.0.1 的脱敏协议夹具没有启动完整 Dify也没有请求线上模型。它验证的是当前官方插件字段对应的排错方法不是“任意第三方服务都已在 Dify 跑通”。先按这 5 步修正1. 记录插件版本和四个关键字段在 Dify 的模型供应商区域选择 OpenAI-API-compatible 并添加自定义模型。当前官方 schema 中与这次问题直接相关的完整字段是Model Name: Dify 界面中的模型名称API Key: 目标服务凭据API Base URL: 例如 https://service.example/v1model name for API endpoint: 目标端点真实识别的模型 ID可选Completion mode: 一般聊天模型选 chat先不要凭产品页展示名猜值。Model Name 可以是你在 Dify 里识别这条配置的名字但 endpoint model name 应与请求体中的 model 完全一致。当前官方实现会优先使用 endpoint_model_name只有它为空时才回退到界面 Model Name。2. 用 /models 确认 Base URL 和精确 ID如果目标服务提供 OpenAI 风格的模型目录先执行curl -sS \-H Authorization: Bearer YOUR_API_KEY \https://service.example/v1/models只记录脱敏后的 HTTP 状态、最终路径和 data[].id。成功结果应类似{object: list,data: [{id: your-exact-model-id, object: model}]}这里如果返回 401先处理 Key 或权限返回 404先检查 Base URL 是否少了或重复了 /v1返回 HTML 或登录页说明请求命中的不是 API 资源。不要在路径未确认时继续轮换模型名。并不是所有兼容服务都公开 /models。如果该接口未提供就从服务方当前控制台或官方 API 文档复制精确 ID但仍要把来源和观察时间记下来。3. 把精确 ID 填到 endpoint model name假设你希望在 Dify 中显示“团队代码模型”而 /models 返回的是 vendor-coder-2026-07可以这样区分Model Name: 团队代码模型model name for API endpoint: vendor-coder-2026-07不要把“团队代码模型”直接发给服务端也不要删除版本后缀、改大小写或把另一环境的模型名粘贴过来。model_not_found 只说明当前请求中的模型值不被当前端点接受它不等于 Key 失效也不等于 Base URL 一定正确。4. 用同一组值发送最小请求继续使用相同 Base URL、Key 和 endpoint model namecurl -sS \-H Authorization: Bearer YOUR_API_KEY \-H Content-Type: application/json \https://service.example/v1/chat/completions \-d {model: your-exact-model-id,messages: [{role: user, content: 只回复 DIFY_OK}],max_tokens: 16,stream: false}至少确认四项HTTP 是 200choices[0].message.content 可读取返回的 model 没有意外切到别的 ID响应不是 HTML、登录页或非 JSON 错误。如果 /models 是 200、错误模型是 404、正确模型是 200模型映射这一层才算闭合。5. 回到 Dify 保存并只测最小输入在 Dify 中保存自定义模型后先用最短提示验证不要直接运行包含知识库、工具调用和多节点的工作流。若最小验证仍失败保留以下脱敏信息插件版本API Base URL 的路径部分界面 Model Nameendpoint model nameHTTP 状态与错误 type服务端 request ID如有不要记录或截图完整 Key。确认模型层成功后再逐步加入流式、工具调用、图片和工作流节点否则新变量会掩盖原始问题。本地复现为什么只填界面模型名会失败我用标准库写了一个 loopback 服务目录中只开放 fixture-chat-model。第一次按“endpoint model name 为空时回退到界面 Model Name”的逻辑发送 dify-ui-alias服务返回 404第二次显式填写 fixture-chat-model返回 200 和 DIFY_PLUGIN_OK。执行命令python3 06-evidence/probe_dify_endpoint_model.py脱敏结果PLUGIN_VERSION0.0.55MODELS_HTTP200MODEL_IDSfixture-chat-modelWITHOUT_ENDPOINT_MODEL_HTTP404WITHOUT_ENDPOINT_MODEL_ERRORmodel_not_foundWITH_ENDPOINT_MODEL_HTTP200WITH_ENDPOINT_MODEL_TEXTDIFY_PLUGIN_OKONLINE_PROVIDER_REQUESTNOFULL_DIFY_RUNTIMENO这组结果证明排错顺序有效先确认目录再确认请求体里的模型值。它没有证明完整 Dify 界面、插件运行器或任何线上供应商已经执行成功因此不能把结果改写成“Dify 实测接入某服务成功”。三类常见失败不要混在一起Base URL 路径错误表现通常是 404、HTML 网关页或固定首页内容。检查最终请求是否落到 /v1/models 和 /v1/chat/completions尤其注意 Dify 中已填 /v1 后服务端文档是否又要求客户端拼一次。不要用增加斜杠的方式盲试一串地址。模型 ID 错误典型表现是 HTTP 404 或错误体中的 model_not_found。此时应对比当前端点的模型目录、endpoint model name 和请求日志里的 model而不是立刻更换 Key。响应协议不兼容模型请求可能返回 200但缺少 choices、message.content 或符合当前模式的字段。此时模型名已经不是首要问题应转向响应结构、Chat/Completion mode 和插件支持范围不要继续用 model_not_found 的办法处理协议错误。一张检查表收尾[ ] 插件版本已记录[ ] Base URL 来自同一服务环境[ ] /models 或官方目录给出精确模型 ID[ ] endpoint model name 与精确 ID 完全一致[ ] 错误模型能稳定复现 404/model_not_found[ ] 正确模型最小请求返回 200 和可读正文[ ] 完整 Key、账户信息和内部地址未进入日志或截图[ ] 完整 Dify 与线上服务未实测时正文已明确披露结论很简单Dify 里的显示名称和服务端真实模型 ID 可以不同。遇到 model_not_found 时先用当前 Base URL 查目录再把精确 ID 放进 endpoint model name并用同一组值发送最小请求。只有这条链路闭合后才值得继续排查工作流、流式和工具调用。

相关新闻

Python阶乘计算:递归与迭代实现及优化技巧

Python阶乘计算:递归与迭代实现及优化技巧

1. 阶乘计算的基础概念 第一次接触阶乘这个概念是在大学离散数学课上。老师用粉笔在黑板上写下"5!"这个符号时,全班同学都露出了困惑的表情。阶乘(factorial)是数学中一个看似简单却蕴含深意的运算,它表示从1到该数所有正整数的乘积。比如5! …

2026/7/28 15:43:38阅读更多 →
PG 日报|修复 JSON 反解析缺陷,彻底杜绝格式丢失问题

PG 日报|修复 JSON 反解析缺陷,彻底杜绝格式丢失问题

PostgreSQL 技术文章 WarehousePG on AWS:掌控分析业务,精控成本支出 WarehousePG 是一款基于 Greenplum 项目衍生而来的大规模并行处理(MPP)分析型数据库。Greenplum 停止开源后,EnterpriseDB 接手了该项目的维护工作…

2026/7/28 15:43:38阅读更多 →
Claude Code与Codex深度对比:AI编程助手选型与实战指南

Claude Code与Codex深度对比:AI编程助手选型与实战指南

在AI编程助手领域,Claude Code和Codex无疑是当前最受瞩目的两个顶级选择。许多开发者在决定将哪个工具纳入自己的日常开发流时,常常陷入纠结:一个以强大的上下文处理和长会话记忆著称,另一个则以稳定的表现、高效的云任务委托和更…

2026/7/28 15:41:37阅读更多 →
2026大模型API成本真相:企业为什么不能只看每百万Token单价

2026大模型API成本真相:企业为什么不能只看每百万Token单价

文章摘要 企业在选择OpenAI、Anthropic或Google模型时,最容易犯的错误是把“每百万Token价格”当作最终成本。真实生产成本还包括输出长度、思考Token、上下文重复、缓存写入、搜索、文件检索、代码执行、Agent循环、失败重试、并发、数据驻留、日志和人工审核。 …

2026/7/28 20:38:44阅读更多 →
Spring AI企业级应用实战(4):Chat Memory、会话隔离、持久化与上下文压缩

Spring AI企业级应用实战(4):Chat Memory、会话隔离、持久化与上下文压缩

文章摘要 前几篇已经完成Spring AI统一调用层和流式输出。本篇继续实现企业级多轮对话:使用MessageChatMemoryAdvisor管理近期消息,要求每次请求显式提供conversationId,通过PostgreSQL保存完整Chat History与持久化Memory,校验租…

2026/7/28 20:38:44阅读更多 →
Python异常嵌套日志处理与结构化日志实践

Python异常嵌套日志处理与结构化日志实践

1. 异常嵌套日志的痛点解析在Python项目开发中,异常嵌套场景几乎无处不在。当外层异常捕获内层异常时,传统的日志记录方式往往存在三个典型问题:信息割裂:内层异常被外层捕获后,原始堆栈信息可能被覆盖日志冗余&#x…

2026/7/28 20:38:44阅读更多 →
系统化调试方法论与高效工具链实践

系统化调试方法论与高效工具链实践

1. 为什么我们需要系统化的调试方法论在十五年的开发生涯中,我见过太多工程师把调试当成碰运气的过程——反复修改代码、盲目添加打印语句、甚至迷信地调整缩进格式。这种低效的调试方式不仅浪费时间,更会掩盖问题的本质。真正高效的调试应该像法医解剖一…

2026/7/28 20:38:44阅读更多 →
AI如何重塑企业工作流程:Anthropic的实践与架构解析

AI如何重塑企业工作流程:Anthropic的实践与架构解析

1. 项目概述:AI如何重塑Anthropic的工作流程作为一家专注于AI安全的头部企业,Anthropic从创立之初就将人工智能技术深度融入其研发体系。最典型的案例是其全员使用的Claude系列模型,这套内部称为"Constitutional AI"的系统已渗透到…

2026/7/28 20:38:44阅读更多 →
Simulink实现Dijkstra算法:自动驾驶路径规划可视化建模

Simulink实现Dijkstra算法:自动驾驶路径规划可视化建模

1. 项目概述:当Dijkstra遇上Simulink 第一次在Simulink里实现Dijkstra算法时,我盯着那个不断闪烁的路径动画看了足足十分钟——这比单纯看代码输出直观太多了。作为自动驾驶领域最经典的最短路径算法,Dijkstra在MATLAB脚本中的实现你可能见过…

2026/7/28 20:36:44阅读更多 →
覆盖国产 + 海外 + 开源模型,OpenClaw 2.7.9 Windows/Mac 双端部署详解

覆盖国产 + 海外 + 开源模型,OpenClaw 2.7.9 Windows/Mac 双端部署详解

🔹 工具基础介绍 OpenClaw 是开源生态中一款实用性较强的本地智能工具,凭借本地离线运行、可视化图形操作和任务自动化三大核心特性,赢得了众多用户的青睐。与普通在线对话AI工具不同,它属于能够直接操控本机软硬件的智能数字员工…

2026/7/28 4:06:39阅读更多 →
伺服阀焊完微漏毁整机?精密激光焊接三关锁住高压

伺服阀焊完微漏毁整机?精密激光焊接三关锁住高压

所谓液压伺服阀体的精密激光焊接,是用激光束对阀座壳体(通常为不锈钢或铝合金)进行密封焊接,使阀体在21-35MPa的高压液压油或压缩气体中长期运行而不发生介质泄漏。液压伺服阀是高端液压系统的"大脑"。从航空航天飞行控…

2026/7/28 2:08:06阅读更多 →
D2DX:三步实现《暗黑破坏神2》高清宽屏体验的终极指南

D2DX:三步实现《暗黑破坏神2》高清宽屏体验的终极指南

D2DX:三步实现《暗黑破坏神2》高清宽屏体验的终极指南 【免费下载链接】d2dx D2DX is a complete solution to make Diablo II run well on modern PCs, with high fps and better resolutions. 项目地址: https://gitcode.com/gh_mirrors/d2/d2dx 你是否还在…

2026/7/28 1:38:28阅读更多 →
告别臃肿!3步让你的暗影精灵笔记本重获新生

告别臃肿!3步让你的暗影精灵笔记本重获新生

告别臃肿!3步让你的暗影精灵笔记本重获新生 【免费下载链接】OmenSuperHub Control Omen laptop performance, fan speeds, and keyboard lighting, and unlock power limits. 项目地址: https://gitcode.com/gh_mirrors/om/OmenSuperHub 你是否也曾为官方Om…

2026/7/28 0:00:29阅读更多 →
RAG必踩坑!财报法规检索不准?这款开源工具让答案浮出水面,准确率飙升98.7%!

RAG必踩坑!财报法规检索不准?这款开源工具让答案浮出水面,准确率飙升98.7%!

做 RAG 的人应该都踩过这个致命的坑:把几百页的财报、法规、技术手册扔给向量库,问一个具体问题,搜出来的全是沾边但没用的内容 —— 关键信息要么被硬切块拆碎了,要么藏在几十条结果的最下面。语义相似≠真正相关,这个…

2026/7/28 0:00:29阅读更多 →
抖音视频文案提取工具全指南:免费2026版、手机App、在线工具一网打尽

抖音视频文案提取工具全指南:免费2026版、手机App、在线工具一网打尽

2026年做短视频运营,从抖音上扒文案早就不是偷偷抄笔记的事了。我刚开始做内容的时候,每天刷半小时抖音,手动把爆款视频的口播敲进备忘录,一条2分钟的视频得花十来分钟,碰到语速快的还要反复回听。后来试了一圈工具&am…

2026/7/28 0:00:29阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/28 20:22:24阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/28 3:17:03阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/28 2:35:58阅读更多 →