LangChain Memory 记忆系统:让 AI 记住对话的魔法
引言为什么 AI 需要“记忆”在与 ChatGPT 等大模型对话时你是否曾感到一丝“挫败”你刚刚在上一轮对话中详细说明了需求下一轮它却仿佛失忆般问道“您能再详细描述一下吗” 这种“金鱼式”的七秒记忆正是早期 AI 应用在构建多轮对话或复杂任务流程时面临的核心挑战。LangChain Memory记忆系统正是为解决这一问题而生的核心组件。它如同一个智能的“对话笔记本”能够跨越多次交互持久化、选择性地存储和检索用户与模型之间的历史信息让 AI 应用真正拥有“上下文感知”的能力。无论是构建一个贴心的客服机器人、一个持续学习的编程助手还是一个能记住你偏好的个性化应用Memory 都是不可或缺的基石。本文将带你深入 LangChain Memory 的世界从核心概念到实战应用手把手教你如何为你的 AI 应用注入“记忆”的魔法。1. 理解 Memory核心概念与工作原理1.1 什么是 Memory在 LangChain 框架中Memory是一个用于在链Chain或智能体Agent的多次调用之间持久化状态的模块。这里的“状态”通常指代对话历史、用户偏好、会话变量等上下文信息。简单来说Memory 做了两件事存储在每次对话或交互后将重要的信息如用户查询、AI 回复、提取的实体等保存起来。检索在后续的交互中根据当前查询从存储中提取相关的历史信息并将其作为上下文注入到给大模型的提示Prompt中。1.2 Memory 的核心组件一个典型的 Memory 模块包含以下几个关键部分Memory Variables定义了需要存储和读取的变量名。最常见的两个是chat_history存储完整的对话记录列表。input存储最近一次的用户输入有时用于短期上下文。LLM大型语言模型本身。某些复杂的 Memory 类型如ConversationSummaryMemory需要 LLM 来总结或提炼历史。Retriever决定如何从存储中查找相关信息的组件。可以是简单的“返回全部”也可以是基于向量相似度的语义检索。Backing Store底层的数据存储可以是内存BufferMemory、数据库、文件系统等。1.3 工作原理流程图渲染错误:Mermaid 渲染失败: Parse error on line 4: ... A1[“用户输入(Query)”] -- A2[“Me -----------------------^ Expecting SQE, DOUBLECIRCLEEND, PE, -), STADIUMEND, SUBROUTINEEND, PIPE, CYLINDEREND, DIAMOND_STOP, TAGEND, TRAPEND, INVTRAPEND, UNICODE_TEXT, TEXT, TAGSTART, got PS2. LangChain 内置 Memory 类型详解LangChain 提供了多种开箱即用的 Memory 类适用于不同场景。2.1 ConversationBufferMemory最基础、最常用的记忆类型。它将完整的对话历史以字符串或消息列表的形式保存在内存缓冲区中。特点优点简单直接保留所有原始信息。缺点当对话轮次增多时Prompt 会急剧膨胀可能触及模型上下文长度限制且成本增加。代码示例fromlangchain.memoryimportConversationBufferMemoryfromlangchain_openaiimportChatOpenAIfromlangchain.chainsimportConversationChain# 初始化 Memory 和 LLMmemoryConversationBufferMemory()llmChatOpenAI(modelgpt-3.5-turbo,temperature0)# 创建对话链conversationConversationChain(llmllm,memorymemory,verboseTrue)# 进行多轮对话response1conversation.predict(input你好我叫小明。)print(response1)# 输出: 你好小明很高兴认识你。response2conversation.predict(input你还记得我的名字吗)print(response2)# 输出: 当然记得你刚才说你叫小明。2.2 ConversationBufferWindowMemoryConversationBufferMemory的升级版它只保留最近k轮对话。特点优点有效控制上下文长度避免无限增长。缺点会“遗忘”超出窗口的早期重要信息。代码示例fromlangchain.memoryimportConversationBufferWindowMemory# 只保留最近2轮对话memoryConversationBufferWindowMemory(k2)# ... 后续使用同上2.3 ConversationSummaryMemory一种更高级的记忆方式。它并不存储完整的对话原文而是利用 LLM 对之前的对话历史进行总结只将总结文本存入记忆。在新的交互中将最新的总结和当前问题一起交给 LLM。特点优点极大地压缩了上下文长度能保留长期对话的“精髓”。缺点总结过程会产生额外的 LLM 调用和成本可能存在信息损失。代码示例fromlangchain.memoryimportConversationSummaryMemoryfromlangchain_openaiimportChatOpenAI llmChatOpenAI(modelgpt-3.5-turbo)memoryConversationSummaryMemory(llmllm)# ... 后续使用同上2.4 ConversationSummaryBufferMemory结合了Buffer和Summary的优点。它维护一个固定长度的缓冲区当对话长度超过阈值时将最早的对话进行总结同时保留较新的原始对话。特点在控制长度和保留细节之间取得了较好的平衡。2.5 其他实用 Memory 类型ConversationEntityMemory专注于识别和记忆对话中提到的实体如人名、地点、产品并建立实体之间的关系。ConversationKnowledgeGraphMemory将对话信息以知识图谱的形式存储支持更复杂的关联查询。VectorStoreRetrieverMemory将对话历史存入向量数据库如 Chroma, Pinecone每次通过语义检索召回最相关的片段非常适合超长对话。3. 实战构建一个能记住上下文的聊天机器人让我们构建一个完整的、使用 Memory 的聊天机器人应用。3.1 项目初始化与环境准备# 创建项目目录并安装依赖mkdirlangchain-memory-botcdlangchain-memory-bot pipinstalllangchain langchain-openai python-dotenv在项目根目录创建.env文件填入你的 OpenAI API KeyOPENAI_API_KEYyour_api_key_here3.2 核心代码实现创建app.pyimportosfromdotenvimportload_dotenvfromlangchain.memoryimportConversationBufferMemoryfromlangchain_openaiimportChatOpenAIfromlangchain.chainsimportConversationChainfromlangchain_core.promptsimportPromptTemplate# 加载环境变量load_dotenv()defcreate_chatbot(memory_typebuffer):创建并返回一个配置了 Memory 的对话链llmChatOpenAI(modelgpt-3.5-turbo,temperature0.7,api_keyos.getenv(OPENAI_API_KEY))# 选择 Memory 类型ifmemory_typebuffer:memoryConversationBufferMemory(return_messagesTrue)elifmemory_typebuffer_window:memoryConversationBufferWindowMemory(k3,return_messagesTrue)else:memoryConversationBufferMemory(return_messagesTrue)# 定义一个更友好的系统提示词prompt_templatePromptTemplate.from_template(你是一个友好且专业的助手。请根据以下的对话历史和当前问题给出有帮助的回答。 如果历史对话中有相关信息请利用它们。 当前对话历史 {history} 人类{input} 助手)# 创建对话链conversationConversationChain(llmllm,memorymemory,promptprompt_template,verboseFalse# 设为 True 可查看详细的链执行过程)returnconversationdefmain():print( 启动 LangChain Memory 聊天机器人 (输入 quit 退出))print(-*50)botcreate_chatbot(memory_typebuffer)whileTrue:try:user_inputinput(\n你: )ifuser_input.lower()in[quit,exit,q]:print(助手: 再见期待下次与你聊天。)breakifuser_input.strip():responsebot.predict(inputuser_input)print(f助手:{response})exceptKeyboardInterrupt:print(\n\n程序被中断。)breakexceptExceptionase:print(f发生错误:{e})if__name____main__:main()3.3 运行与测试运行程序python app.py进行多轮对话测试观察机器人是否能记住上下文你: 你好我是张三来自北京。 助手: 你好张三很高兴认识你。北京是个很棒的城市。今天有什么可以帮你的吗 你: 我的名字是什么 助手: 你刚才说你叫张三。 你: 我来自哪个城市 助手: 你来自北京。4. 高级技巧与最佳实践4.1 将 Memory 持久化到数据库默认的 Memory 存储在内存中程序重启后记忆会消失。我们可以将其保存到数据库中。示例使用 SQLite 持久化ConversationBufferMemory(需安装langchain-community)fromlangchain_community.chat_message_historiesimportSQLChatMessageHistoryfromlangchain.memoryimportConversationBufferMemory# 创建基于 SQLite 的消息历史存储message_historySQLChatMessageHistory(session_iduser_session_123,# 会话ID用于区分不同用户或对话connection_stringsqlite:///chat_history.db)memoryConversationBufferMemory(chat_memorymessage_history,return_messagesTrue)# 现在 memory 的内容会被自动保存到数据库4.2 在 Chain 和 Agent 中使用 MemoryMemory 不仅可以用于简单的ConversationChain还可以集成到更复杂的链和智能体中。在自定义链中使用fromlangchain.chainsimportLLMChainfromlangchain.memoryimportConversationBufferMemoryfromlangchain_core.promptsimportPromptTemplate template你是一个编程助手。基于以下对话历史和当前问题给出代码建议。 历史对话 {chat_history} 当前问题{question} 代码建议promptPromptTemplate.from_template(template)memoryConversationBufferMemory(memory_keychat_history,input_keyquestion)chainLLMChain(llmllm,promptprompt,memorymemory,verboseTrue)# 调用链resultchain.invoke({question:如何在Python中反转列表})print(result[text])4.3 处理超长对话的策略分层记忆结合ConversationSummaryBufferMemory既保留近期细节又总结远期内容。向量检索记忆使用VectorStoreRetrieverMemory只召回与当前问题最相关的历史片段极大扩展有效记忆容量。关键信息提取在对话中主动识别并存储关键实体日期、决定、任务而非存储全部文本。

相关新闻

含多类型V2G电动汽车的微网日前-日内两阶段协同优化调度模型研究(Matlab代码实现)

含多类型V2G电动汽车的微网日前-日内两阶段协同优化调度模型研究(Matlab代码实现)

💥💥💞💞欢迎来到本博客❤️❤️💥💥 🏆博主优势:🌞🌞🌞博客内容尽量做到思维缜密,逻辑清晰,为了方便读者。 &#x1f381…

2026/7/23 0:52:40阅读更多 →
中翰软件:用“本体论”给数据治理立规矩,用AI让规矩“活”起来

中翰软件:用“本体论”给数据治理立规矩,用AI让规矩“活”起来

数据治理的困境,往往源于“规矩不清”或“规矩不灵”。中翰软件最新发布的AI原生治理方案,正是从“立规矩”和“活应用”两端破局。 在“立规矩”层面,方案引入“本体论”,为企业核心业务实体(如客户、产品&#xff09…

2026/7/23 0:52:40阅读更多 →
微服务中使用JWT 认证体系详解:HMAC vs RSA 签名、OAuth2 Token 获取机制

微服务中使用JWT 认证体系详解:HMAC vs RSA 签名、OAuth2 Token 获取机制

微服务中使用JWT 认证体系详解:HMAC vs RSA 签名、OAuth2 Token 获取机制 一、JWT 基础概念 1.1 什么是 JWT JWT(JSON Web Token)是一种紧凑的、自包含的令牌格式,用于在各方之间安全传递信息。它由三部分组成,用点号 …

2026/7/23 0:52:40阅读更多 →
KingbaseES集群failover失败案例分析与解决方案

KingbaseES集群failover失败案例分析与解决方案

1. 案例背景与问题描述最近在维护一套KingbaseES V8R3数据库集群时,遇到了一次典型的failover切换失败案例。这套集群采用标准的主备架构,主库运行在node209(192.168.103.209),备库在node210(192.168.103.2…

2026/7/23 2:00:49阅读更多 →
RT-DETR-R18与MobileNet-SSD轻量化检测模型对比与应用

RT-DETR-R18与MobileNet-SSD轻量化检测模型对比与应用

1. 轻量化检测模型的技术背景与需求在计算机视觉领域,目标检测技术已经发展出两条主要技术路线:基于CNN的传统检测框架和基于Transformer的端到端检测架构。随着边缘计算和移动端AI应用的普及,模型轻量化成为工业落地的核心诉求。RT-DETR-R18…

2026/7/23 2:00:49阅读更多 →
ShiftLUT:高效图像修复技术的突破与实现

ShiftLUT:高效图像修复技术的突破与实现

1. 项目概述:ShiftLUT如何重新定义高效图像修复在移动端图像处理领域,我们常常面临一个经典矛盾:算法性能与计算效率的拉锯战。传统基于深度学习的图像修复方法虽然效果出色,但动辄需要数亿次浮点运算,根本无法在手机或…

2026/7/23 2:00:49阅读更多 →
Tiva™ ADC采样序列器配置详解:从多通道轮询到数字比较器应用

Tiva™ ADC采样序列器配置详解:从多通道轮询到数字比较器应用

1. 采样序列:从“单兵作战”到“流水线生产”的思维跃迁在嵌入式开发的早期,很多工程师对ADC的使用还停留在“单次触发、单次读取”的初级阶段。这种模式就像让一个工人(CPU)去操作一台机器(ADC)&#xff0…

2026/7/23 2:00:49阅读更多 →
深入解析Tiva™ MCU时钟系统:从PLL配置到低功耗管理实战

深入解析Tiva™ MCU时钟系统:从PLL配置到低功耗管理实战

1. 项目概述:微控制器的心脏——时钟系统在嵌入式开发领域,无论是驱动一个简单的LED闪烁,还是处理复杂的实时通信协议,微控制器(MCU)的每一次“心跳”都至关重要。这个“心跳”的节拍器,就是时钟…

2026/7/23 2:00:49阅读更多 →
2026年AI编程工具实测横评:Claude Code v2.1、Cursor 3.0、Trae SOLO、Copilot、Windsurf 谁更好用?

2026年AI编程工具实测横评:Claude Code v2.1、Cursor 3.0、Trae SOLO、Copilot、Windsurf 谁更好用?

五款工具,两周深度使用,一个后端开发者的真实感受。一、先说说2026年AI编程工具到底变成了什么样 说实话,2025年大家还在讨论"AI代码补全到底有没有用",到了2026年中,这个话题已经没人聊了。原因很简单——A…

2026/7/23 1:58:49阅读更多 →
Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/23 0:56:31阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/23 0:56:31阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/23 0:56:31阅读更多 →
Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具 【免费下载链接】chitchatter Secure peer-to-peer chat that is serverless, decentralized, and ephemeral 项目地址: https://gitcode.com/gh_mirrors/ch/chitchatter Chitchatter是一款革命性的安…

2026/7/23 0:00:28阅读更多 →
从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

更多请点击: https://intelliparadigm.com 第一章:从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表) 当AI副业主理人不再仅满足于单次服务交付,而是主动构建可复用、可裂变、可…

2026/7/23 0:00:28阅读更多 →
油泥处理设备哪里能买到

油泥处理设备哪里能买到

油泥处理设备哪里有?这是许多从事油田、炼化、清罐业务的从业者最关心的问题。根据河南三丰环保设备有限公司的行业经验,选购油泥处理设备的核心在于设备能否适配当地环保法规与原料特性,而非单纯看价格。该公司总经理王钦田先生指出&#xf…

2026/7/23 0:00:28阅读更多 →
YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

YOLOv8推理性能优化:从1.2FPS到35FPS的全链路加速实践

如果你在部署 YOLOv8 时,发现推理速度只有可怜的 1-2 FPS,而别人的演示视频却能跑到 30 FPS 以上,那么问题很可能不在模型本身,而在于你的整个处理链路。很多开发者拿到一个训练好的 YOLOv8 模型后,会直接使用官方示例…

2026/7/22 22:56:18阅读更多 →
Coze与Dify对比指南:低代码AI应用开发从入门到实战

Coze与Dify对比指南:低代码AI应用开发从入门到实战

1. 从零到一:为什么你需要了解 Coze 和 Dify?如果你对 AI 应用开发感兴趣,但一看到“大模型”、“智能体”、“工作流”这些词就头疼,觉得门槛太高,那这篇文章就是为你准备的。很多开发者,包括我自己&#…

2026/7/22 18:55:50阅读更多 →
AI生图工具怎么选?2026年6月版实测对比

AI生图工具怎么选?2026年6月版实测对比

做自媒体的朋友应该都有体会:配图一直是个让人头疼的问题。2026年,AI生图工具已经非常成熟了,但工具太多反而不知道怎么选。以下是截至2026年6月我对主流AI生图工具的实测对比。Midjourney V8.1:速度之王2026年6月11日&#xff0c…

2026/7/22 18:55:50阅读更多 →