当前位置: 首页 > news >正文

LangChain重磅更新:让AI自己决定何时压缩记忆

AI Agent 在执行长任务时有一个绕不开的问题:上下文窗口是有限的。

当对话历史、工具调用结果、文件内容不断堆积,模型的注意力会被稀释,关键指令被淹没,决策质量随之下滑——这种现象被称为"上下文腐烂"(context rot)。

LangChain 的 Deep Agents SDK 此前已经实现了自动压缩:当上下文使用量达到模型窗口的 85% 时,系统会自动触发摘要化,将旧消息替换为结构化摘要。

这套机制能用,但不够聪明——它不知道现在是不是压缩的好时机。

最新发布的版本做了一件有意思的事:把"何时压缩"这个决定权交给了模型本身。

为什么固定阈值不够好

压缩上下文这件事,有好时机,也有坏时机。

如果模型正在进行一次复杂的代码重构,中途突然压缩,很可能丢失关键的中间状态,导致后续步骤出错。

但如果一个阶段性任务刚刚完成,用户准备开启新话题,这时候压缩就非常合适——旧的上下文已经没什么用了,清掉反而能让模型更专注。

很多交互式编程工具(比如 Claude Code)提供了 /compact 这样的手动命令,让用户自己决定什么时候清理上下文。但这要求用户理解上下文窗口的概念,并且在合适的时机主动操作——对大多数人来说这个门槛并不低。

Deep Agents 的新方案是:把这个工具暴露给模型,让它自己判断。

哪些时刻适合压缩

LangChain 在系统提示中为模型提供了判断指引,总结下来大致有这几类场景:

• 任务边界:用户明确表示要切换到新任务,或者当前交付物已完成并得到确认
• 信息提取完毕:模型从大量上下文中得出了结论、摘要或关键事实,原始内容已不再需要
• 即将消费大量新内容:准备生成长文档,或者要读入大量新文件
• 进入复杂多步流程前:大型重构、迁移、多文件编辑等任务开始之前,或者计划已制定、即将进入执行阶段
• 旧上下文已被新决策覆盖:新需求推翻了之前的方向,或者存在大量无效的探索路径需要清理

这些场景的共同特点是:历史上下文的边际价值已经很低,而接下来的任务需要更清晰的工作记忆。

压缩时发生了什么

这个工具的实现复用了 Deep Agents 已有的摘要化中间件逻辑:保留最近 10% 的可用上下文作为近期消息,对更早的内容生成结构化摘要。

触发压缩的工具调用本身及其响应,也会被保留在近期上下文中。

值得一提的是,Deep Agents 会把完整的对话历史保存在虚拟文件系统中,即便压缩之后,原始内容依然可以通过文件系统检索找回。这在一定程度上降低了误触发压缩的风险。

如何启用

在 SDK 中,这个功能作为独立中间件提供,需要手动加入到 create_deep_agent 的中间件列表:

from deepagents import create_deep_agent from deepagents.backends import StateBackend from deepagents.middleware.summarization import ( create_summarization_tool_middleware, ) backend = StateBackend model = "openai:gpt-5.4" agent = create_deep_agent( model=model, middleware=[ create_summarization_tool_middleware(model, backend), ], )

在 Deep Agents CLI 中,这个功能默认开启。用户也可以继续使用 /compact 命令手动触发。

实测表现:保守但有效

LangChain 在调优时刻意让这个功能偏保守。

他们用三种方式进行了测试:

  • 基于自家 LangSmith 追踪记录构建的评估集(注入后续 prompt,判断是否应该触发压缩)
  • Terminal-bench-2 基准测试(未观察到任何自主压缩行为)
  • 团队内部在 Deep Agents CLI 上的日常编码任务。

结果是:模型触发压缩的频率不高,但每次触发都发生在比较合理的节点,而且确实改善了后续的工作流。

这背后有一个更大的设计哲学:Agent 框架应该尽量"让开",把更多控制权交给底层推理模型本身,而不是靠手工调参来打补丁。这是"苦涩的教训"(bitter lesson)在 Agent 设计上的一次具体实践——与其精心设计触发规则,不如让模型自己学会判断。

对于正在构建长时运行或交互式 Agent 的开发者来说,这个功能值得一试。它本身不算大,但它所指向的方向——让模型更主动地管理自己的工作记忆——可能会成为下一代 Agent 框架的标配。

学习资源推荐

如果你想更深入地学习大模型,以下是一些非常有价值的学习资源,这些资源将帮助你从不同角度学习大模型,提升你的实践能力。

一、全套AGI大模型学习路线

AI大模型时代的学习之旅:从基础到前沿,掌握人工智能的核心技能!​

因篇幅有限,仅展示部分资料,需要点击文章最下方名片即可前往获取

二、640套AI大模型报告合集

这套包含640份报告的合集,涵盖了AI大模型的理论研究、技术实现、行业应用等多个方面。无论您是科研人员、工程师,还是对AI大模型感兴趣的爱好者,这套报告合集都将为您提供宝贵的信息和启示

​因篇幅有限,仅展示部分资料,需要点击文章最下方名片即可前往获取

三、AI大模型经典PDF籍

随着人工智能技术的飞速发展,AI大模型已经成为了当今科技领域的一大热点。这些大型预训练模型,如GPT-3、BERT、XLNet等,以其强大的语言理解和生成能力,正在改变我们对人工智能的认识。 那以下这些PDF籍就是非常不错的学习资源。

因篇幅有限,仅展示部分资料,需要点击文章最下方名片即可前往获取

四、AI大模型商业化落地方案

作为普通人,入局大模型时代需要持续学习和实践,不断提高自己的技能和认知水平,同时也需要有责任感和伦理意识,为人工智能的健康发展贡献力量。

http://www.cnnetsun.cn/news/1251275.html

相关文章:

  • ⚡ SenseVoice-Small ONNX医院食堂:营养师语音→膳食方案+热量计算自动生成
  • Qwen3-VL-WEBUI开发者快速入门:WebUI接口调用完整示例代码
  • 基于LineAI的智能客服系统搭建:提示词优化与效率提升实战
  • Zotero开源插件期刊缩写文件处理问题高效解决方案
  • obs-multi-rtmp:全能多平台直播分发工具,主播的效率倍增指南
  • CPAL脚本自动化测试 ———— System Variables 实战应用与性能优化
  • 解锁信息自由:7款内容访问工具深度横评与实战指南
  • 探索SMUDebugTool:Ryzen系统硬件调试与性能优化全指南
  • ThinkPad散热控制新纪元:TPFanCtrl2深度技术指南
  • ai辅助开发mcp应用:在快马平台用对话式提示词生成完整集成代码
  • ai辅助开发:让快马智能生成cursor注册手机号验证的交互与代码
  • 高效解析蛋白质配体相互作用:PLIP实战指南
  • 告别Markdown阅读难题:浏览器插件让文档预览效率提升10倍
  • 魔兽争霸III卡顿掉帧?用WarcraftHelper让老游戏焕发新生
  • CLIP文本编码优化实战:如何高效处理negative prompt提升生成效率
  • Templater动态模板高效工作流:从入门到精通
  • 6大模块精通VTube Studio:开源虚拟主播工具全栈学习路径
  • 构建企业级权限管理系统:基于YiShaAdmin的实施方法论与效能优化
  • 3种核心方案:IDM功能解锁工具永久体验全攻略
  • 大模型的重点已经不是训练,也不是推理
  • Unity Mod Manager:让游戏模组管理变得简单高效
  • 革新性Windows透明特效引擎:DWMBlurGlass焕新桌面视觉体验
  • Page Assist 本地AI扩展故障排除指南:从环境配置到日常使用
  • Markdown浏览器预览工具:极简配置实现高效文档阅读与个性化渲染
  • 如何用游戏手柄操控电脑?Gopher360让客厅娱乐更自由
  • Token压缩新范式:基于视觉显著性与文本相似性的自适应VLM加速策略
  • 快马平台快速验证openclaw更新:十分钟搭建机器人抓取演示原型
  • 3大媒体工具黑科技:猫抓cat-catch让资源下载难题迎刃而解
  • 植物根系研究的革命:高精度根系分析仪技术白皮书
  • 减少回退版本…