元数据索引有关的错
1、代码#!/usr/bin/env python # -*- coding: UTF-8 -*- from langchain_chroma import Chroma from meta_data import docs, metadata_field_info # 自我问询rag self-rag from base_llm import llm, embeddings_model from langchain_classic.retrievers.self_query.base import SelfQueryRetriever #from langchain_classic.retrievers.self_query.chroma import ChromaTranslator # 文档内容描述指导LLM理解文档内容 document_content_description Brief description of technical articles # 创建向量数据库 vectorstore Chroma.from_documents(docs, embeddings_model) SelfQueryRetriever.from_llm 问题:作者A发布的论文2025的 发送给大模型 意图识别 { query: 发布的论文 filter: {year:2025, author:A} } 2.元数据过滤 本地条件判断 3. 语义搜索 在过滤完之后的数据中进行相识度对比 retriever SelfQueryRetriever.from_llm( llm, vectorstore, document_content_description, metadata_field_info, #translatorChromaTranslator(), # 明确指定 enable_limitTrue ) print(retriever.invoke(作者A发布的一篇论文))引用的文件base_llm.py代码如下#!/usr/bin/env python # -*- coding: UTF-8 -*- from dotenv import load_dotenv from langchain_huggingface import HuggingFaceEmbeddings from langchain_openai import ChatOpenAI import os load_dotenv() llm ChatOpenAI(api_keyos.getenv(DASHSCOPE_API_KEY), base_urlos.getenv(DASHSCOPE_BASE_URL), model_nameqwen3.7-plus) # 本地embedding模型地址 embedding_model_path rD:\LLM\Local_model\maidalun\bce-embedding-base_v1 # 初始化嵌入模型用于文本向量化 embeddings_model HuggingFaceEmbeddings( model_nameembedding_model_path )引用的文件meta_data.py代码如下#!/usr/bin/env python # -*- coding: UTF-8 -*- from langchain_core.documents import Document from langchain_classic.chains.query_constructor.schema import AttributeInfo docs [ Document( page_content作者A团队开发出基于深度学习的图像识别系统在复杂场景下的识别准确率提升250%, metadata{year: 2025, rating: 9.3, genre: AI, author: A}, ), Document( page_content物联网技术成功应用于智能农业监控作者B主导的项目实现农作物产量提升20%, metadata{year: 2024, rating: 9.5, genre: IoT, author: B}, ), Document( page_content边缘计算平台实现实时数据处理突破作者C构建的新型架构支持千万级并发计算, metadata{year: 2023, rating: 8.8, genre: Edge Computing, author: C}, ), Document( page_content机器学习模型预测2025年股市趋势作者A团队构建的模型准确率超95%, metadata{year: 2024, rating: 9.0, genre: Machine Learning, author: A}, ), Document( page_content基于人工智能的心脏病诊断系统在临床应用中达到顶级专家水平作者B获医疗科技创新奖, metadata{year: 2025, rating: 7.2, genre: AI, author: B}, ), Document( page_content区块链技术在供应链管理中取得突破作者C设计的新型协议提升供应链透明度30%, metadata{year: 2024, rating: 8.9, genre: Blockchain, author: C}, ), Document( page_content云计算平台实现能效优化作者A研发的智能调度系统使数据中心能耗降低50%, metadata{year: 2024, rating: 8.6, genre: Cloud, author: A}, ), Document( page_content大数据分析助力环保监测作者B团队实现污染源识别准确率提升30%, metadata{year: 2025, rating: 7.5, genre: Big Data, author: B}, ) ] # 元数据字段定义指导LLM如何解析查询条件 工具 metadata_field_info [ AttributeInfo( namegenre, descriptionTechnical domain of the article, options: [AI, Blockchain, Cloud, Big Data], typestring, ), AttributeInfo( nameyear, descriptionPublication year of the article, typeinteger, ), AttributeInfo( nameauthor, descriptionAuthors name who signed the article, typestring, ), AttributeInfo( namerating, descriptionTechnical value assessment score (1-10 scale), typefloat ) ]2、执行报错了报错内容如下C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Scripts\python.exe C:\Users\lenovo\PycharmProjects\PythonProject\rag\day08\02-元数据索引.py C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_core\utils\pydantic.py:41: UserWarning: Core Pydantic V1 functionality isnt compatible with Python 3.14 or greater. from pydantic.v1 import BaseModel as BaseModelV1 Loading weights: 100%|██████████| 199/199 [00:0000:00, 65081.21it/s] Traceback (most recent call last): File C:\Users\lenovo\PycharmProjects\PythonProject\rag\day08\02-元数据索引.py, line 39, in module retriever SelfQueryRetriever.from_llm( llm, ...4 lines... enable_limitTrue ) File C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_classic\retrievers\self_query\base.py, line 374, in from_llm structured_query_translator _get_builtin_translator(vectorstore) File C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_classic\retrievers\self_query\base.py, line 71, in _get_builtin_translator from langchain_community.vectorstores import ( ...17 lines... ) ImportError: cannot import name DatabricksVectorSearch from langchain_community.vectorstores (C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_community\vectorstores\__init__.py) Process finished with exit code 1在deepseek上面搜索方案DeepSeek使用了这种方案执行还是报一样的错C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Scripts\python.exe C:\Users\lenovo\PycharmProjects\PythonProject\rag\day08\02-元数据索引.py C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_core\utils\pydantic.py:41: UserWarning: Core Pydantic V1 functionality isnt compatible with Python 3.14 or greater. from pydantic.v1 import BaseModel as BaseModelV1 Loading weights: 100%|██████████| 199/199 [00:0000:00, 49983.02it/s] Traceback (most recent call last): File C:\Users\lenovo\PycharmProjects\PythonProject\rag\day08\02-元数据索引.py, line 39, in module retriever SelfQueryRetriever.from_llm( llm, ...4 lines... enable_limitTrue ) File C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_classic\retrievers\self_query\base.py, line 374, in from_llm structured_query_translator _get_builtin_translator(vectorstore) File C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_classic\retrievers\self_query\base.py, line 71, in _get_builtin_translator from langchain_community.vectorstores import ( ...17 lines... ) ImportError: cannot import name DatabricksVectorSearch from langchain_community.vectorstores (C:\Users\lenovo\PycharmProjects\PythonProject\.venv\Lib\site-packages\langchain_community\vectorstores\__init__.py) Process finished with exit code 1

相关新闻

杨辉三角:从C语言打印到组合数学与动态规划的核心理解

杨辉三角:从C语言打印到组合数学与动态规划的核心理解

1. 从“打印三角形”到“理解递推”:杨辉三角的认知误区提到杨辉三角,很多学过C语言的朋友第一反应可能就是:“哦,那个要打印一个等腰的数字三角形嘛,用二维数组,然后算每个数是上面两个数之和。” 然后刷刷…

2026/8/2 4:14:18阅读更多 →
3分钟完成Blender 3MF插件安装:彻底告别STL格式局限

3分钟完成Blender 3MF插件安装:彻底告别STL格式局限

3分钟完成Blender 3MF插件安装:彻底告别STL格式局限 【免费下载链接】Blender3mfFormat Blender add-on to import/export 3MF files 项目地址: https://gitcode.com/gh_mirrors/bl/Blender3mfFormat 还在为Blender无法直接支持3D打印专用格式而烦恼吗&#…

2026/8/2 4:14:17阅读更多 →
Spring与WEB环境集成

Spring与WEB环境集成

1.生命周期对比(记住核心区别)依赖范围 编译时 测试时 运行时 是否打进 jar/war 包 compile(默认) ✅ ✅ ✅ 是 test ❌ ✅ ❌ 否(仅测试时用,如 JUnit) runtime ❌ ✅ ✅ 是(如 JDB…

2026/8/2 4:14:16阅读更多 →
相机标定实战指南:从原理到OpenCV实现,解决视觉测量不准问题

相机标定实战指南:从原理到OpenCV实现,解决视觉测量不准问题

1. 项目概述:从“拍不准”到“算得准”的基石如果你玩过3D建模、做过机器人视觉,或者捣鼓过自动驾驶小车,大概率都遇到过同一个问题:为什么我的相机拍出来的图像,用来测距、建模或者拼接时,总感觉“差那么一…

2026/8/2 5:42:41阅读更多 →
Pytest 的底层源码最应该学习的技术

Pytest 的底层源码最应该学习的技术

在 Pytest 的底层源码中,它并不是简单地“在指定函数地方 Mock”,也不是单纯地“增加异常捕获”。它的设计要精妙得多: 1. 不是“在指定地方 Mock”,而是“在内存中偷梁换柱” 你理解的“在指定的函数地方 mock”,听起…

2026/8/2 5:42:41阅读更多 →
【266期】公开我每次重装系统必装的软件!

【266期】公开我每次重装系统必装的软件!

作为一个重度电脑用户,每天基本都要跟电脑打交道,所以能在我的电脑中长期留下来的软件,那都是属于夯中之夯了。今天重点挑几个我高频使用的给大家过一遍,无广告也全都是免费的,放心使用。 卸载工具天花板 Geek 首先是…

2026/8/2 5:42:41阅读更多 →
Zenodo数据下载终极指南:3步掌握zenodo_get命令行工具

Zenodo数据下载终极指南:3步掌握zenodo_get命令行工具

Zenodo数据下载终极指南:3步掌握zenodo_get命令行工具 【免费下载链接】zenodo_get Zenodo_get - a downloader for Zenodo records 项目地址: https://gitcode.com/gh_mirrors/ze/zenodo_get Zenodo_get是一个专门为科研工作者设计的Zenodo数据下载工具&…

2026/8/2 5:42:41阅读更多 →
脱离博图13天:工业自动化工程师的通用技术生存指南

脱离博图13天:工业自动化工程师的通用技术生存指南

1. 项目缘起:当“博图”成为日常在工业自动化这个行当里,尤其是和西门子PLC打交道,TIA Portal(我们习惯叫它“博图”)就像空气和水一样,是绕不开的存在。从最早的STEP 7 V5.5,到后来集成了WinCC…

2026/8/2 5:42:41阅读更多 →
PCB包地设计实战指南:从原理到应用,解决高速信号干扰

PCB包地设计实战指南:从原理到应用,解决高速信号干扰

包地,在 PCB 设计里,是处理高速、敏感信号线时最常用也最容易被误解的“土办法”之一。很多人知道要包,但不知道为什么包、怎么包才有效,结果要么是白费功夫,要么是画蛇添足,甚至引入新的干扰。这篇文章不讲…

2026/8/2 5:40:40阅读更多 →
MATLAB xcorr函数详解:从互相关原理到四大实战应用

MATLAB xcorr函数详解:从互相关原理到四大实战应用

1. 从一次信号“找茬”说起:为什么我们需要互相关几年前,我在处理一组声学传感器数据时遇到了一个棘手的问题。我有两个麦克风记录了一段相同的音频信号,理论上它们接收到的声音波形应该非常相似,只是由于麦克风位置不同&#xff…

2026/8/2 0:00:10阅读更多 →
限时公开!某头部SaaS公司内部AI模板工厂架构文档(含5类行业模板源码+性能压测报告)

限时公开!某头部SaaS公司内部AI模板工厂架构文档(含5类行业模板源码+性能压测报告)

更多请点击: https://intelliparadigm.com 第一章:AI模板批量生成的核心价值与落地全景 AI模板批量生成正从实验性工具演进为现代软件工程的关键基础设施。它通过语义理解、上下文感知与结构化约束,将重复性高、模式明确的代码/文档/配置生成…

2026/8/2 0:00:12阅读更多 →
如何快速找回消失的网页:Web Archives浏览器扩展终极指南

如何快速找回消失的网页:Web Archives浏览器扩展终极指南

如何快速找回消失的网页:Web Archives浏览器扩展终极指南 【免费下载链接】web-archives Browser extension for viewing archived and cached versions of web pages, available for Chrome, Edge and Safari 项目地址: https://gitcode.com/gh_mirrors/we/web-a…

2026/8/2 0:00:13阅读更多 →
MATLAB xcorr函数详解:从互相关原理到四大实战应用

MATLAB xcorr函数详解:从互相关原理到四大实战应用

1. 从一次信号“找茬”说起:为什么我们需要互相关几年前,我在处理一组声学传感器数据时遇到了一个棘手的问题。我有两个麦克风记录了一段相同的音频信号,理论上它们接收到的声音波形应该非常相似,只是由于麦克风位置不同&#xff…

2026/8/2 0:00:10阅读更多 →
限时公开!某头部SaaS公司内部AI模板工厂架构文档(含5类行业模板源码+性能压测报告)

限时公开!某头部SaaS公司内部AI模板工厂架构文档(含5类行业模板源码+性能压测报告)

更多请点击: https://intelliparadigm.com 第一章:AI模板批量生成的核心价值与落地全景 AI模板批量生成正从实验性工具演进为现代软件工程的关键基础设施。它通过语义理解、上下文感知与结构化约束,将重复性高、模式明确的代码/文档/配置生成…

2026/8/2 0:00:12阅读更多 →
如何快速找回消失的网页:Web Archives浏览器扩展终极指南

如何快速找回消失的网页:Web Archives浏览器扩展终极指南

如何快速找回消失的网页:Web Archives浏览器扩展终极指南 【免费下载链接】web-archives Browser extension for viewing archived and cached versions of web pages, available for Chrome, Edge and Safari 项目地址: https://gitcode.com/gh_mirrors/we/web-a…

2026/8/2 0:00:13阅读更多 →
无损视频剪辑终极指南:如何实现快速高效的多媒体处理

无损视频剪辑终极指南:如何实现快速高效的多媒体处理

无损视频剪辑终极指南:如何实现快速高效的多媒体处理 【免费下载链接】lossless-cut The swiss army knife of lossless video/audio editing 项目地址: https://gitcode.com/gh_mirrors/lo/lossless-cut 在数字媒体创作领域,视频编辑处理的质量损…

2026/8/2 1:29:34阅读更多 →
AI辅助本科论文写作:8大工具评测与高效使用指南

AI辅助本科论文写作:8大工具评测与高效使用指南

1. 本科生论文写作的AI辅助现状本科毕业论文是每个大学生必须跨越的一道坎。记得我当年写论文时,光是文献检索就花了整整两周时间,打印的参考文献堆满了半个书桌。如今AI技术的发展为学术写作带来了革命性变化,合理使用这些工具可以节省80%以…

2026/8/2 2:32:55阅读更多 →
如何快速配置大麦自动抢票系统:从零开始搭建Python抢票助手

如何快速配置大麦自动抢票系统:从零开始搭建Python抢票助手

如何快速配置大麦自动抢票系统:从零开始搭建Python抢票助手 【免费下载链接】ticket-purchase 大麦自动抢票,支持人员、城市、日期场次、价格选择 项目地址: https://gitcode.com/GitHub_Trending/ti/ticket-purchase 还在为抢不到热门演唱会门票…

2026/8/2 2:09:20阅读更多 →