agentmemory快速开始:30秒跑通,见证语义搜索的魔力
agentmemory快速开始:30秒跑通,见证语义搜索的魔力
【免费下载链接】agentmemory#1 Persistent memory for AI coding agents based on real-world benchmarks项目地址: https://gitcode.com/GitHub_Trending/age/agentmemory
agentmemory 是一款为 AI 编程助手打造的持久记忆系统,让 Claude Code、Cursor、Codex、Gemini CLI 等智能体"过目不忘"。它能自动捕获会话中的每一次操作,压缩成可搜索的记忆,并在新会话开始时自动注入相关上下文——无需再重复解释你的项目架构。本教程带你 30 秒安装跑通,亲眼见证语义搜索如何"隔空找到"关键词完全匹配不上的记忆。
为什么你的 AI 编程助手需要一个"外脑" 🧠
每个 AI 编程助手关闭会话后都会"失忆":
- 每次都要重新解释你的技术栈和架构
- 反复排查同一个 bug
- 内置记忆文件(如 CLAUDE.md)通常只有 200 行上限,且容易过时
agentmemory 的思路是:让助手在后台自动记录,用混合搜索在需要时精准召回。一次安装,所有支持 MCP 的智能体共享同一个记忆服务。
30 秒安装:一条命令跑通记忆服务
前置条件:Node.js ≥ 20。打开终端,只需两条命令:
# 终端 1:启动记忆服务器(首次运行会进入交互式向导:选择智能体、选择 LLM 提供商) npx @agentmemory/agentmemory # 终端 2:注入示例数据,现场演示语义召回 npx @agentmemory/agentmemory demo💡 不想开两个终端?用一行命令版:
npx @agentmemory/agentmemory demo --serve,它会自己起服务、跑演示、再收尾。
demo命令会种入3 个真实感会话(JWT 鉴权、N+1 查询修复、限流方案)和数十条观察记录,然后自动执行 3 条搜索查询。demo 的实现位于src/cli.ts的runDemo函数,感兴趣可以翻源码看看它是怎么验证召回的。
想确认服务是否健康?访问http://localhost:3111/agentmemory/health即可。
见证语义搜索的魔力:搜"性能优化"能找到"N+1 修复" ⚡️
demo 中最精彩的时刻在这里——你搜索"database performance optimization"(数据库性能优化),它找到的却是之前记录的N+1 查询修复方案。
注意:你的查询里根本没有 "N+1" 这个词。纯关键词匹配(grep 式搜索)做不到这一点,而语义搜索可以。
这是 agentmemory 三流混合检索的威力:
| 检索流 | 作用 | 触发时机 |
|---|---|---|
| BM25 关键词 | 词干化匹配 + 同义词扩展 | 始终开启 |
| 向量相似度 | 稠密嵌入的余弦相似度 | 配置了嵌入模型时 |
| 知识图谱 | 按查询中的实体遍历图 | 检测到实体时 |
三路结果通过 RRF(倒数排名融合)合并排序。混合检索的核心逻辑实现在src/state/hybrid-search.ts与src/functions/smart-search.ts中。
嵌入模型方面,默认使用本地免费的all-MiniLM-L6-v2(离线运行、无需 API Key),相比纯 BM25 召回率提升约 8 个百分点;也可接入 OpenAI、Gemini 等云端模型获得更高精度。
效果有多好?在 ICLR 2025 的 LongMemEval-S 基准(500 题)上,agentmemory 的R@5 召回率达 95.2%,显著领先纯 BM25 的 86.2%。完整的基准报告见 benchmark/LONGMEMEVAL.md、benchmark/SCALE.md 等文档目录下的评测说明(详见benchmark/目录)。
打开实时看板:亲眼看着记忆"生长" 📊
服务器启动后,访问http://localhost:3113打开实时可视化面板:
- Dashboard:会话数、记忆数、图谱节点数、健康状态一目了然
- Memories / Sessions:每条记忆可展开查看完整记录与来源溯源
- Replay:像看录像一样回放任意会话——提示词、工具调用、工具结果、回复都以时间线事件呈现,支持 0.5x~4x 倍速
- Graph:知识图谱按实体类型聚类展示
所有记录过的会话都可以回放。如果你使用 Claude Code,还可以把历史 JSONL 转录导入进来:npx @agentmemory/agentmemory import-jsonl,导入的会话同样会被索引、可搜索。
日常命令速查表
跑通 demo 后,日常管理只需要记住这几条:
| 命令 | 用途 |
|---|---|
agentmemory | 启动记忆服务器 |
agentmemory stop | 停止并清理 |
agentmemory connect <agent> | 接入另一个智能体(claude-code、cursor、codex、gemini-cli 等 20+ 适配器) |
agentmemory doctor | 交互式诊断 + 自动修复建议 |
agentmemory remove | 一键卸载全部配置 |
接入智能体后,它会通过12 个自动钩子记录每次工具调用,并解锁54 个 MCP 记忆工具(memory_smart_search、memory_save、memory_recall等)。以 Claude Code 为例,装好插件后自动注册全部钩子与 MCP 服务,零额外配置。
总结:从"金鱼记忆"到"过目不忘"
用 30 秒回顾一下你刚刚完成的事:
- ✅ 一条
npx命令启动了本地记忆服务器(零外部数据库依赖) - ✅
demo命令证明了语义搜索:查询与记忆用词不同也能精准召回 - ✅ 打开
:3113看板,实时观察记忆的生长与回放
从此,会话 1 配置了 JWT 鉴权,会话 2 只需说"加个限流"——助手已经知道你的鉴权用了哪个中间件、测试写在哪里、为什么选了 jose 而不是 jsonwebtoken。零重复解释,直接开干。
如果遇到问题,先跑agentmemory doctor;想深入了解架构与配置,可查看 DESIGN.md 与src/源码目录。
【免费下载链接】agentmemory#1 Persistent memory for AI coding agents based on real-world benchmarks项目地址: https://gitcode.com/GitHub_Trending/age/agentmemory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
