标签: 记忆持久化

  • cognee:为AI智能体打造的开源记忆平台,跨会话持久记忆+自托管知识图谱,23K+Stars让AI真正拥有长期记忆

    cognee:为AI智能体打造的开源记忆平台,跨会话持久记忆+自托管知识图谱,23K+Stars让AI真正拥有长期记忆

    🧠 项目简介

    Cognee 是为 AI 智能体打造的开源记忆平台,通过自托管知识图谱引擎,为智能体提供跨会话的持久长期记忆。它支持任意格式的数据摄入,构建可动态演进的知识图谱,让智能体能够基于完整上下文进行回忆、关联和行动。结合向量嵌入、图推理和认知科学基础的本体生成能力,Cognee 让文档既支持语义搜索,又能通过关系关联,且知识图谱会随知识积累动态演进。


    📦 安装要求和过程

    环境要求

    • Python:3.10 ~ 3.14
    • 可选:Docker(用于本地 MCP 服务或完整部署)
    • LLM API Key:默认支持 OpenAI,也可对接其他 LLM 提供商

    快速安装

    # 使用 uv 安装(推荐)
    uv pip install cognee
    
    # 使用 pip 安装
    pip install cognee
    
    # 如需使用 Postgres 作为后端,安装对应依赖
    pip install "cognee[postgres]"
    

    环境配置

    # 复制环境变量模板
    cp .env.template .env
    
    # 配置 LLM API Key(默认 OpenAI)
    echo 'LLM_API_KEY="your_openai_api_key"' > .env
    

    Docker 一键部署

    # 克隆仓库并配置
    git clone https://github.com/topoteretes/cognee.git
    cd cognee
    cp .env.template .env
    
    # 启动 API 服务(默认端口 8000)
    docker compose up
    
    # 同时启动前端(端口 3000)
    docker compose --profile ui up
    
    # 启动 MCP 服务(端口 8001)
    docker compose --profile mcp up
    

    ⭐ 核心功能

    1. 跨会话持久记忆

    AI 智能体的记忆不会随会话结束而丢失。Cognee 提供两种存储模式:永久存储(直接写入知识图谱,执行完整处理流程)和会话存储(先写入快速缓存,后台异步同步到知识图谱)。

    2. 自托管知识图谱引擎

    知识关系可动态演进,随知识积累自动更新。Cognee 1.0 支持在单个 Postgres 实例上运行完整记忆层(关系存储 + 向量嵌入 + 会话缓存 + 元数据存储),无需维护多组件栈,性能比分离式图+向量方案快约 10%。

    3. 多后端支持

    默认使用 Postgres 全栈运行记忆层,也可按需切换 Neo4j、Neptune、Redis、Qdrant 等专用后端。灵活适配不同规模的部署需求。

    4. 多语言官方客户端

    除 Python 主客户端外,还提供 Rust(cognee-rs,可通过 cargo add cognee 安装)和 TypeScript(@cognee/cognee-ts,可通过 npm install 安装)官方客户端,覆盖更多开发场景。

    5. 多智能体工具集成

    支持 Claude Code、OpenClaw 等智能体工具集成,也支持对接 Cognee Cloud 托管服务。提供 MCP 服务器原生支持,可无缝接入 AI 编程助手。


    🚀 典型使用场景

    场景一:客服智能体

    目标:结合用户的金融、客服、产品历史等个人数据,解决客户问题。

    示例交互

    • 用户提问:”我的发票有问题,而且问题一直没解决”
    • 智能体响应:”我找到 2 个上个月解决的类似账单问题,原因是支付和发票系统同步延迟,我们已经在你的账户上应用了修复方案。”

    底层逻辑:统一整合企业多渠道数据源 → 重建交互时间线 → 检索相似已解决案例 → 匹配最优解决方案 → 执行后更新记忆。

    场景二:专家知识蒸馏(SQL 助手)

    目标:帮助初级分析师复用专家的查询、模式和推理逻辑,完成数据分析任务。

    示例交互

    • 用户提问:”我该怎么为这个数据集计算客户留存率?”
    • 智能体响应:”这是高级分析师解决类似留存查询的方法,Cognee 将你的数据表结构和已知结构做了匹配,把专家的逻辑适配到了你的数据集上。”

    底层逻辑:提取并存储专家 SQL 查询 → 将当前数据表结构映射到已识别的结构 → 检索相似任务和成功实现方案 → 将专家推理逻辑适配到当前上下文。


    💡 推荐理由

    Cognee 解决了 AI 智能体领域一个根本性问题:如何让智能体拥有持久、可演进的记忆。在大模型应用从”单次对话”走向”长期协作”的今天,记忆层已成为 AI 智能体不可或缺的基础设施。

    最打动我的几点

    • Single Postgres 架构:Cognee 1.0 的巧妙设计让整个记忆层运行在单个 Postgres 实例上,极大降低了运维复杂度,同时性能不输专用分离方案。
    • 动态演进的知识图谱:不同于静态 RAG,Cognee 的知识图谱会随知识积累自动更新关系,真正实现”越用越聪明”。
    • 基准测试领先:在长上下文记忆基准测试 BEAM 中,Cognee 得分 0.79(开启按问题路由后 >0.8),优于之前的 SOTA 方案(0.735)和 RAG 基线(~0.33)。
    • 多语言客户端:同时提供 Python、Rust、TypeScript 官方客户端,覆盖从 AI 应用开发到高性能系统集成的全场景。
    • 活跃社区:8426+ 次提交,304 个开放 Issues(说明使用人数多、反馈活跃),Apache-2.0 永久开源。

    如果你正在构建需要”记住用户”的 AI 应用——无论是客服机器人、个人助手还是企业知识助手,Cognee 值得一试。23K+ Stars 和本周新增 5000+ Stars 的趋势,已经说明了开发者的认可。


    📥 下载地址


    📌 许可协议:Apache License 2.0(永久开源,可自由使用、修改和分发)

    👥 维护团队:topotherete 社区(8426+ 次提交,活跃开发中)

    📄 相关研究Optimizing the Interface Between Knowledge Graphs and LLMs for Complex Reasoning(arXiv 2025)

  • Mem0:为AI智能体打造通用记忆层,59K+ Stars让AI真正「记住」你

    Mem0:为AI智能体打造通用记忆层,59K+ Stars让AI真正「记住」你

    Mem0 - AI Agent Memory Layer
    Mem0 官方网站首页 — AI Agent 通用记忆层

    🧠 项目简介

    Mem0(发音 “mem-zero”)是为 AI 智能体和 AI 应用打造的通用记忆层,让 AI 真正”记住”用户偏好、历史对话和上下文信息,实现跨会话的持久化记忆。

    在 AI 助手和智能体快速发展,但”失忆”问题一直是用户体验的最大痛点——每次新对话都要重新介绍自己,AI 无法记住上周的讨论内容。Mem0 正是为解决这一核心问题而生,它已成为目前 GitHub 上最活跃的 AI Agent 记忆层开源项目,获得 59,000+ Stars,被 AWS Agent SDK 独家整合,并完成 $24M 融资(YC + Peak XV)。

    📦 安装要求和过程

    环境要求

    • Python:3.9+(推荐 3.10+)
    • Node.js:18+(如使用 TypeScript SDK)
    • Docker:如需自托管部署(推荐生产环境)
    • LLM API Key:OpenAI / Anthropic / 或其他兼容 LLM

    快速安装(3种方式)

    • 方式一:Python SDK(最常用)
      pip install mem0ai

      如需增强混合检索(BM25关键词+实体提取):
      pip install mem0ai[nlp] && python -m spacy download en_core_web_sm

    • 方式二:自托管(Docker,生产推荐)
      git clone https://github.com/mem0ai/mem0.git && cd mem0/server && docker compose up -d

      服务默认运行在 http://localhost:3000,支持 Kubernetes / 私有云 / 气隙部署

    • 方式三:托管云服务(最快上手)

      注册 app.mem0.ai 获取 API Key,无需部署,直接调用

      export MEM0_API_KEY="your-key-here"

    ⚡ 核心功能

    • 🧩 多级记忆管理 — 无缝保留用户级、会话级、智能体级的状态,支持自适应个性化。每个用户、每次对话、每个智能体都有独立的记忆空间,互不干扰。
    • 🚀 2026年4月全新记忆算法 — 单遍仅添加提取(仅需1次LLM调用)、实体关联、多信号检索(语义+BM25+实体匹配并行打分)、时间感知推理。在 LoCoMo 基准测试中达到 91.6分(较旧版提升20分),Token消耗仅 7.0K
    • 🔌 多工具集成支持 — 与 Claude Code、Codex、Cursor、Windsurf、OpenClaw 等 AI 编码工具无缝集成;同时支持 LangGraph、CrewAI 等智能体框架。一行命令即可为现有 AI 工具添加长期记忆。
    • 💻 CLI 管理能力 — 支持通过终端命令完成记忆的初始化、添加、搜索等操作。npm install -g @mem0/cli 安装后,直接用命令行管理 AI 记忆。
    • 🔄 记忆迁移能力 — 支持从开源版本迁移到托管平台,也支持托管 Qdrant 向量数据导入平台。数据完全可移植,不会被厂商锁定。

    🎯 典型使用场景

    • 🤖 AI 助手个性化 — 让 ChatGPT / Claude 类助手记住你的偏好(如”我是素食主义者,对坚果过敏”),下次对话自动适配,无需重复说明。支持跨平台同步记忆。
    • 🏥 医疗健康辅助 — 记录患者病史、过敏信息和治疗偏好,为每次问诊提供个性化支持。Mem0 已通过 HIPAA 合规认证,满足医疗数据隐私要求。
    • 🛒 电商智能推荐 — 记住用户的浏览历史、购买偏好和尺码信息,提供真正个性化的购物体验。Mem0 支持实时记忆更新,用户行为立即可被用于推荐。

    💡 推荐理由

    AI “失忆”是我在使用各种 AI 工具时最大的痛点。Mem0 从根子上解决了这个问题,而且做得非常彻底:

    为什么选 Mem0 而不是自己实现记忆功能?
    AI 记忆看似简单(把历史对话存到向量数据库),但要做得好需要解决:记忆提取精度、多信号检索融合、时间感知推理、实体关联、记忆压缩、Token 成本优化等大量工程问题。Mem0 团队在这些方向上持续投入,2026年4月的新算法将 LoCoMo 基准从71.6提升到91.6——这不是简单工程能做到的。

    另外特别值得关注的是 Mem0 的企业级可靠性:SOC 2 + HIPAA 双合规、支持私有云/气隙部署、每笔读写操作全程审计日志。如果你在为生产环境选型 AI 记忆方案,Mem0 是目前唯一同时满足开源透明企业合规的选择。

    项目使用 Apache-2.0 许可,自托管完全免费。托管云服务按使用量计费,适合快速验证想法的团队。

    📥 下载地址


    📌 本文由自动化任务采集发布,内容基于项目 GitHub 主页及官方文档整理

  • claude-mem —— 82.9K+ Stars,让 AI 智能体拥有跨会话持久记忆的开源工具

    🔥 GitHub 热门 AI 开源项目 · 第 21 期

    📌 项目简介

    claude-mem 是为所有 AI 智能体提供跨会话持久化记忆的开源工具。它能自动捕获 AI 代理在会话中的所有操作行为,通过 AI 压缩生成结构化记忆条目,并在后续会话中自动注入相关历史上下文。支持 Claude Code、OpenClaw、Codex、Gemini、Copilot 等主流 AI 编程工具,让无状态的 AI 代理拥有真正的”长期记忆”。

    🖼️ 项目预览

    claude-mem 项目预览
    claude-mem – AI 智能体跨会话记忆引擎

    ⚙️ 安装要求与过程

    环境要求

    • Node.js ≥ 18.0.0(核心运行环境)
    • ✅ 支持的操作系统:macOSLinuxWindows(WSL2 推荐)
    • ✅ 已安装任意支持的 AI 工具:Claude Code / OpenClaw / Codex / Gemini CLI / Copilot 等
    • ✅ 网络畅通(需访问 AI 供应商 API)

    快速安装

    # 交互式安装(推荐)
    npx claude-mem install
    
    # 指定参数安装
    npx claude-mem install --provider gemini --model gemini-pro
    
    # 安装后修复(如遇问题)
    npx claude-mem repair
    
    # 查看版本
    npx claude-mem --version

    Server Beta 模式(团队协作)

    # 配置环境变量
    export CLAUDE_MEM_RUNTIME=server-beta
    export CLAUDE_MEM_SERVER_DATABASE_URL=postgres://user:pass@localhost:5432/claudemem
    
    # 启动 API 服务
    claude-mem server start
    
    # 启动生成 Worker
    claude-mem server worker start

    ✨ 核心功能

    1. 全自动上下文捕获与注入

    无需任何手动标注,claude-mem 自动捕获会话中的所有工具调用、文件读写、代码编辑等行为,通过 AI 压缩生成结构化记忆条目。新会话启动时,自动注入最相关的历史上下文,让 AI 代理”记得”之前做过的工作。

    2. 多工具统一支持

    原生支持 Claude CodeOpenClawCodexGeminiHermesGitHub CopilotOpenCode 等主流 AI 编程工具。同时支持通过 MCP 协议接入 Cursor、Windsurf 等更多 IDE,真正实现”一次安装,处处可用”。

    3. 可视化记忆管理

    内置 Web 查看器(默认 localhost),可实时查看 AI 代理的操作记录、生成的记忆条目、会话统计等信息。支持按项目筛选记忆内容,可手动触发项目全量学习(/learn-codebase),帮助 AI 快速理解代码库。

    4. 企业级多租户支持(Server Beta)

    支持基于 Postgres 的独立服务端部署,无需依赖本地 Worker 进程。提供团队/项目级别的权限隔离、API Key 管理、操作审计链路,支持 Docker 容器化部署和水平扩展,满足企业协作场景需求。

    5. 成本优化遥测

    采用 5 分钟滚动窗口聚合遥测事件,可降低 99.9% 的 PostHog 使用成本。支持历史遥测数据匿名化回填,AI 生成任务幂等性设计避免重复计费,用户可自主选择是否开启遥测。

    💡 典型使用场景

    场景一:多日开发项目的上下文延续

    你正在用 Claude Code 开发一个复杂功能,工作日结束时会话上下文已达到上限。第二天开始新会话时,claude-mem 自动注入昨天的设计决策、修改的文件、遇到的问题等关键上下文,让你无需重新解释项目背景,直接继续开发。

    场景二:团队协作中的知识共享

    在团队项目中,开发者 A 用 Claude Code 完成了某个模块的开发。通过 claude-mem 的 Server Beta 模式,团队成员 B 在新会话中也能获取到 A 的开发上下文,包括设计思路、踩过的坑、未完成的 TODO 等,实现 AI 辅助开发的”知识传承”。

    场景三:跨工具开发体验统一

    你白天用 Claude Code 开发,晚上用 Gemini CLI 做代码 Review。claude-mem 作为统一的记忆层,让不同 AI 工具之间共享上下文,无论在哪个工具中操作,AI 都能”记得”你之前做过什么。

    🌟 推荐理由

    AI 编程工具的最大痛点之一就是会话结束后上下文丢失——你花了半小时给 AI 解释项目背景,新会话又要重新来一遍。claude-mem 从根本上解决了这个问题。

    我特别欣赏它的零摩擦设计:安装后无需任何手动操作,AI 代理的所有行为都会被自动捕获和压缩。当你开始新会话时,相关记忆会自动注入,就像 AI “自然记得”之前的工作一样。

    另一个亮点是多工具统一支持。如果你像我一样同时使用多个 AI 编程工具,claude-mem 提供了一个统一的记忆层,让不同工具之间可以共享上下文。这比每个工具各自维护记忆要高效得多。

    项目的活跃度也很高,截至目前已有 82,991 个 Stars,最近更新在 2026 年 6 月,说明维护团队在持续迭代。Apache-2.0 许可也让它可以放心用于商业项目。


    📥 下载地址

    💡 小贴士:安装完成后,在 AI 工具中输入 /learn-codebase 可触发项目全量学习,让 AI 更快理解你的代码库。查看记忆内容可访问安装时显示的 Web 查看器地址(默认 http://localhost:<端口>)。