LangChain 学习笔记:从零搭建 LLM 应用的完整路线
会调大模型 API 之后,下一步通常是:加多轮对话、接知识库、调工具。这些如果全靠手写,代码量上去了不说,稳定性和可维护性也很难保证。
LangChain 就是干这个的——把 LLM 应用开发中那些重复的活抽成标准组件,拼起来就能用。
- 先理解 LangChain 整体定位 ——为什么不直接调 API 而要用框架
- 再搞清 Model I/O ——跟模型对话的标准姿势
- 然后学 Chain 链 ——用 LCEL 把多个步骤串起来
- 接着理解 Memory 记忆 ——让对话机器人记住上下文
- 再掌握 Retrieval 检索 ——RAG 系统在 LangChain 里怎么搭
- 最终学习 Agent 智能体 ——让模型学会调用外部工具
这条路径就是这套笔记的主线。接下来会按这个顺序,把 6 个主题的笔记陆续发出来。这篇先理一下整体结构。
6 个主题
① 概述(全局认知) → ② Model I/O(模型交互) → ③ Chain 链(流程编排) → ④ Memory 记忆(对话状态) → ⑤ Retrieval 检索(知识增强) → ⑥ Agent 智能体(工具调用)① LangChain 概述——为什么不直接调 API 而要用框架
直接调 API 当然能跑通,但一旦涉及多轮对话、文档检索、输出解析这些需求,手写的胶水代码就越来越多。LangChain 把这些通用能力抽成了模块,理解它的生态和组件划分,后面学具体模块会快很多。
- 框架定位:LLM 应用开发的"胶水层"
- 版本演进:从 LangChain 到 LangChain + LangGraph 的生态拆分
- 核心组件:Model I/O、Chain、Memory、Retrieval、Agent 的职责划分
- LangSmith 和 LangServe 等周边工具的定位
② Model I/O——跟模型对话的标准姿势
模型接口、Prompt 模板和输出解析器,这三件套是所有 LangChain 应用的起点。搞清楚 PromptTemplate 怎么用、OutputParser 怎么把模型的自由文本解析成结构化数据,后面写 Chain 和 Agent 就顺了。
- 模型接口:ChatModel 和 LLM 的区别,怎么切换不同厂商的模型
- Prompt 模板:PromptTemplate、ChatPromptTemplate 的用法
- 输出解析:StrOutputParser、JsonOutputParser 怎么把自由文本变成结构化数据
- 流式输出:
.stream()和.astream()的使用场景
③ Chain 链——用 LCEL 把多个步骤串起来
LCEL(LangChain Expression Language)是 LangChain 1.0 之后主推的编排方式,用管道操作符|把 Prompt、模型、解析器串成一条处理链。比起老的SequentialChain,写起来更简洁,也支持并行和条件分支。
- LCEL 语法:管道操作符
|和 Runnable 协议 - 常用 Chain 类型:顺序链、并行链、条件分支链
- RunnablePassthrough 和 RunnableLambda 的使用场景
- 从老的 Chain API 迁移到 LCEL 的思路
④ Memory 记忆——让对话机器人记住上下文
默认情况下,LLM 每次调用都是"无状态"的——上一轮说了什么它不知道。Memory 模块解决这个问题,把对话历史管理起来,支持不同的记忆策略(全量、摘要、窗口)。
- 记忆类型:ConversationBufferMemory、SummaryMemory、WindowMemory 的区别
- 记忆与 Chain 的集成方式
- 持久化:怎么把对话历史存到 Redis / 数据库
- 多用户隔离:怎么用 session_id 区分不同用户的对话
⑤ Retrieval 检索——RAG 系统在 LangChain 里怎么搭
文档加载、文本分割、向量存储、检索器——这是用 LangChain 搭 RAG 系统的核心链路。这部分和后面 RAG 系列有交叉,这里侧重框架层面怎么用,RAG 系列侧重技术原理和优化。
- 文档加载:PDF、网页、数据库等不同数据源怎么接入
- 文本分割:RecursiveCharacterTextSplitter 等分割策略
- 向量存储:FAISS、Chroma、Milvus 等向量数据库的集成
- 检索器:相似度检索、MMR 检索和自定义检索器
⑥ Agent 智能体——让模型学会调用外部工具
ReAct 模式是 LangChain Agent 的核心——模型先"思考"要做什么,再调用工具执行,看到结果后决定下一步。搞清楚 Agent、Tool 和 AgentExecutor 三者的关系,是理解 LLM 工具调用的基础。
- Agent 类型:ReAct、OpenAI Functions Agent 等不同实现
- 工具开发:怎么用
@tool装饰器定义自定义工具 - AgentExecutor:执行循环、最大迭代次数和错误处理
- 从 AgentExecutor 到 LangGraph 的演进方向
这里给大家精心整理了一份全面的AI大模型学习资源,包括:AI大模型全套学习路线图(从入门到实战)、精品AI大模型学习书籍手册、视频教程、实战学习、面试题等,资料免费分享!
👇👇扫码免费领取全部内容👇👇
1. 成长路线图&学习规划
要学习一门新的技术,作为新手一定要先学习成长路线图,方向不对,努力白费。
这里,我们为新手和想要进一步提升的专业人士准备了一份详细的学习成长路线图和规划。可以说是最科学最系统的学习成长路线。
2. 大模型经典PDF书籍
书籍和学习文档资料是学习大模型过程中必不可少的,我们精选了一系列深入探讨大模型技术的书籍和学习文档,它们由领域内的顶尖专家撰写,内容全面、深入、详尽,为你学习大模型提供坚实的理论基础。(书籍含电子版PDF)
3. 大模型视频教程
对于很多自学或者没有基础的同学来说,书籍这些纯文字类的学习教材会觉得比较晦涩难以理解,因此,我们提供了丰富的大模型视频教程,以动态、形象的方式展示技术概念,帮助你更快、更轻松地掌握核心知识。
4. 2026行业报告
行业分析主要包括对不同行业的现状、趋势、问题、机会等进行系统地调研和评估,以了解哪些行业更适合引入大模型的技术和应用,以及在哪些方面可以发挥大模型的优势。
5. 大模型项目实战
学以致用,当你的理论知识积累到一定程度,就需要通过项目实战,在实际操作中检验和巩固你所学到的知识,同时为你找工作和职业发展打下坚实的基础。
6. 大模型面试题
面试不仅是技术的较量,更需要充分的准备。
在你已经掌握了大模型技术之后,就需要开始准备面试,我们将提供精心整理的大模型面试题库,涵盖当前面试中可能遇到的各种技术问题,让你在面试中游刃有余。
7. 资料领取:全套内容免费抱走,学 AI 不用再找第二份
不管你是 0 基础想入门 AI 大模型,还是有基础想冲刺大厂、了解行业趋势,这份资料都能满足你!
现在只需按照提示操作,就能免费领取:
👇👇扫码免费领取全部内容👇👇
