标签: 开发者工具

  • OpenWiki —— LangChain 出品的自我维护 Wiki CLI,让 Agent 为你写文档

    OpenWiki —— LangChain 出品的自我维护 Wiki CLI,让 Agent 为你写文档

    项目简介

    OpenWikiLangChain 团队开源的「自我维护 Wiki CLI」——一个命令行工具,让 AI Agent 自动为你的代码库或个人知识库撰写并持续维护 Markdown 文档。它内置 Deep Agents 文档智能体,读取源码后合成带链接的 Wiki,每次代码变更都能自动更新;同时提供交互式可视化节点图,让你像浏览思维导图一样探索整个知识体系。

    一句话总结:「为 Agent 写的文档,给人读的 Wiki。」

    OpenWiki
    OpenWiki — 自我维护的 Wiki

    安装要求与快速上手

    环境要求

    • Node.js ≥ 18(推荐 LTS 版本)
    • npm / pnpm 包管理器
    • 任一 LLM 提供商 API Key(首次运行时引导配置)

    安装步骤

    # 全局安装 CLI
    npm install -g openwiki
    
    # 初始化代码库文档(交互式选择模型提供商)
    openwiki --init
    
    # 一键更新文档
    openwiki --update
    
    # 启动可视化浏览器
    openwiki visualize

    个人知识库模式

    # 初始化个人大脑模式
    openwiki personal --init
    
    # 认证数据源连接器
    openwiki auth notion      # Notion OAuth
    openwiki auth gmail       # Gmail OAuth
    openwiki auth x           # X/Twitter OAuth
    
    # 执行全量数据摄取并生成 Wiki
    openwiki ingest all

    核心功能

    OpenWiki 核心速览

    1. Agent 驱动的自动文档生成

    基于 LangChain Deep Agents 框架的文档专用智能体,自动分析源码结构、模块依赖、函数签名和业务逻辑,生成结构化 Markdown 文档。支持 .openwikiignore 规则排除敏感路径(类似 .gitignore),确保私有信息不泄露。

    2. 双模式:Code Wiki + Personal Brain

    • Code 模式(默认):扫描当前仓库,输出到 openwiki/ 目录,同时维护根目录的 AGENTS.mdCLAUDE.md 引导文件。
    • Personal 模式:接入 Notion、Gmail、X/Twitter、Hacker News、Web Search 等数据源,将碎片化知识合成为本地 Wiki(存储在 ~/.openwiki/wiki/)。

    3. 12+ 模型提供商开箱即用

    默认 OpenAI(gpt-5.6-terra),同时支持 Anthropic Claude、Google Gemini、AWS Bedrock、GitHub Copilot、OpenRouter、Nebius/Fireworks/Baseten/NVIDIA NIM,以及任何 OpenAI 兼容端点(Ollama、LM Studio、LiteLLM 网关等)。Copilot 用户可直接复用现有订阅,无需额外购买 API Key。

    4. 交互式可视化浏览器

    运行 openwiki visualize 即可启动本地 Web 服务,将 Wiki 渲染为交互式节点图 + 实时 Markdown 阅读器。左侧树形目录导航,右侧图谱展示概念关系,点击节点即时查看内容。编辑文件后自动热重载。

    OpenWiki 可视化界面

    5. CI/CD 自动文档流水线

    通过 GitHub Actions / GitLab CI / Bitbucket Pipelines 定时触发文档更新,每次提交自动生成 Docs PR。零成本无变更运行——OpenWiki 会快照对比,只有实际变化才记录元数据,避免 CI 积分浪费。

    6. OKF 开放知识格式 & Mermaid 图表

    输出符合 Google Open Knowledge Format (OKF) v0.1 标准,可移植到任何 OKF 兼容工具。自动在合适位置插入 Mermaid 图表(序列图、ER 图、状态机、流程图),且每次更新都验证图表有效性,损坏的图表会降级为纯文本并在下次修复。

    典型使用场景

    场景一:大型项目新人 Onboarding

    一个拥有 200+ 微服务的后端仓库,新工程师通常需要两周才能理清架构。部署 OpenWiki 后,CI 在每次合并主分支时自动更新架构文档、模块关系图和 API 速查表。新人 clone 下来后 openwiki visualize 一眼看到全局,配合 AGENTS.md 让 AI 编码助手也能精准理解上下文。

    场景二:个人知识中台

    技术负责人的知识散落在 Notion 笔记、Gmail 重要邮件、Twitter 收藏的技术讨论和 HN 热帖中。OpenWiki Personal 模式一次性接入所有源,定期 ingest all 同步,自动去重、关联、归纳成带链接的知识网络。需要回忆某个技术决策时,可视化图中一眼定位。

    场景三:Agent 记忆层

    团队使用 Claude Code 或 Codex 做日常开发,但 Agent 的上下文窗口有限,无法容纳整个代码库历史。OpenWiki 生成的 AGENTS.md 作为持久记忆层,每次 Agent 启动时自动加载 Wiki 摘要,理解架构后再动手写代码,减少幻觉和无效重构。

    推荐理由

    作为 LangChain 官方出品,OpenWiki 解决了一个非常实际的问题:文档总是过时。传统方案要么靠人肉维护(没人愿意做),要么用静态文档生成器(只管骨架不管灵魂)。OpenWiki 的思路很聪明——把「写文档」这件事交给最懂代码的 Agent,同时保留人类对文档的所有权(纯 Markdown,版本控制)。

    我个人最喜欢的三个设计:
    Copilot 复用——如果你已经有 GitHub Copilot 订阅,直接拿来跑推理,不用再掏钱买 API Key;
    .openwikiignore——安全意识很好,从根源上防止密钥泄露进文档;
    可视化节点图——不是花哨功能,对于理解陌生代码库真的有用,比翻几十个 README 快十倍。

    13K+ Stars、日增上千的趋势也说明社区对这个方向的认可。如果你正在维护一个中等规模以上的项目,或者想让 AI 编程助手更懂你的代码库,OpenWiki 值得一试。

    下载地址

  • HTML Anything:让本地 AI 智能体一键生成可发布的 HTML(8K+ Stars)

    HTML Anything:让本地 AI 智能体一键生成可发布的 HTML(8K+ Stars)

    HTML Anythingnexu-io 开源的本地优先(local-first)AI HTML 编辑器:你只需提供 Markdown、CSV、Excel、JSON 或零散笔记,按下 ⌘+Enter,本地已登录的编码智能体就会把内容渲染成可直接发布的单文件 HTML。

    HTML Anything — 智能体时代的 HTML 编辑器
    HTML Anything — 智能体时代的 HTML 编辑器

    项目简介

    它不做模型、不卖 API,而是把你已经装好的 Claude Code、Cursor Agent、Codex、Gemini CLI、GitHub Copilot CLI、OpenCode、Qwen Coder、Aider、IBM Bob 等 9 款编码智能体 CLI 当作后端,通过 75 个可组合技能模板,输出 9 种常见“交付形态”:杂志文章、演示文稿、简历、海报、小红书卡片、推文卡片、网页原型、数据报告、Hyperframes 视频帧。生成结果支持一键粘贴到微信公众号、知乎、X / 微博 / 小红书,或下载 .html / .png。

    核心亮点速览:9 CLI / 75 技能 / 9 交付形态 / 零 API Key / 一键导出
    核心亮点速览:9 CLI / 75 技能 / 9 交付形态 / 零 API Key / 一键导出

    安装要求与快速开始

    环境要求

    • Node.js ≥ 18,推荐安装 pnpm
    • 任意一款已登录的编码智能体 CLI(如 claude / cursor-agent / codex / gemini / copilot 等)
    • 不需要额外 API Key,复用你已登录的会话

    快速安装

    git clone https://github.com/nexu-io/html-anything
    cd html-anything
    pnpm install
    pnpm -F @html-anything/next dev
    # → http://localhost:3000
    

    启动后浏览器会自动扫描 PATH(包括 ~/.local/bin/opt/homebrew/bin 等 GUI 应用常忽略的目录),并在顶部工具栏列出可识别的 CLI。选一个模板、贴入内容、⌘+Enter 即可。

    主界面:左侧编辑器 / 中间模板选择器 / 右侧实时 iframe 预览
    主界面:左侧编辑器 / 中间模板选择器 / 右侧实时 iframe 预览

    核心功能

    • 零 API Key:复用本地已登录的编码智能体会话,边际成本为 0。
    • 9 大智能体自动检测:Claude Code、Cursor、Codex、Gemini、Copilot、OpenCode、Qwen、Aider、IBM Bob,顶部一键切换。
    • 75 个技能模板:覆盖 prototype / deck / frame / social / office / doc / mockup / vfx 等模式,从 SaaS 落地页到财务报告、从瑞士国际主义幻灯片到 Hyperframes 视频帧都有现成模板。
    • 9 种交付形态:杂志文章、演示文稿、简历、海报、小红书卡片、推文卡片、网页原型、数据报告、Hyperframes 视频帧。
    • 实时 SSE 流式渲染:智能体输出 JSON-line,服务端转成 Server-Sent Events,浏览器实时追加到 iframe srcdoc,像看 AI 打字一样看网页生成。
    • 沙箱预览:用户 HTML 运行在 <iframe sandbox> 中,脚本仍可执行,但 cookies/localStorage 与宿主隔离。
    • 一键导出:juice 内联 CSS → 微信公众号 / 知乎;modern-screenshot 2× PNG → X / 微博 / 小红书;另可下载单文件 .html 或 .png。
    一键导出:微信公众号 · X/微博 · 知乎 · 小红书 · HTML · PNG
    一键导出:微信公众号 · X/微博 · 知乎 · 小红书 · HTML · PNG

    典型使用场景

    场景 1:公众号长文排版

    写好 Markdown 初稿,选择 article-magazinedoc-kami-parchment 技能,智能体会自动套用 CJK 优先字体栈、8px 基线网格、对比度 ≥4.5 的配色,生成可直接粘贴到公众号编辑器的 HTML,无需二次调样式。

    场景 2:小红书 / X 卡片

    把一段金句或数据结论贴进去,选择 card-xiaohongshusocial-x-post-card 模板,即可生成 1080×1080 或 1600×900 的高清 PNG,复制后直接进入小红书 / X 发布界面,避免手动修图。

    场景 3:投资人路演 PPT

    输入产品要点,选择 deck-pitchdeck-swiss-internationaldeck-open-slide-canvas,自动产出 1920×1080 的横向幻灯片,支持键盘左右翻页、演讲者备注和 PDF 导出。

    幻灯片模式:内置 20 套主题,可直接导出或路演
    幻灯片模式:内置 20 套主题,可直接导出或路演

    推荐理由

    它是目前把“本地 AI 智能体”和“中文内容创作”结合得最顺手的开源工具之一:不绑 API、不抢隐私,复用你已经付费订阅的 Claude / Cursor / Copilot;针对微信公众号、知乎、小红书等中文平台做了专门适配,解决了 Markdown 转公众号格式崩坏、转小红书要手动修图的老大难问题;技能模板基于 SKILL.md 协议,新增模板只需复制一个文件夹、改一段 frontmatter,社区扩展门槛低。如果你平时需要大量产出图文、PPT、产品原型,把它接进工作流能省不少时间。

    下载与资源

  • PixelRAG:用网页截图做检索增强,让模型“看图说话”

    PixelRAG:用网页截图做检索增强,让模型“看图说话”

    PixelRAG 配图

    项目简介

    PixelRAG 是伯克利 SkyLab / BAIR 团队开源的视觉检索增强生成框架。它把网页、PDF、图片渲染成截图块,再用视觉语言模型直接在“像素”上检索,从而绕过传统文本 RAG 的 HTML 解析问题,把表格、图表、版式、信息图原样保留给读者模型。仓库还附带一个已建好的 828 万维基百科页面视觉索引,以及免费的在线 API,真正做到了开箱即用。

    安装要求和过程

    环境要求

    • Python 3.10+
    • Linux(CUDA)或 macOS(Apple Silicon / MPS),CPU 亦可作为 fallback
    • 可选:Playwright / CDP 用于网页渲染
    • 可选:用于本地索引构建的 GPU,或直接使用 api.pixelrag.ai 线上服务

    快速安装

    # 1. 基础包:像素化截图工具 pixelshot
    pip install pixelrag
    
    # 2. 带向量化:用于本地构建 FAISS 索引
    pip install 'pixelrag'
    
    # 3. 完整流水线:source → ingest → embed → index
    pip install 'pixelrag[index]'
    
    # 4. 本地搜索 API 服务
    pip install 'pixelrag[serve]'
    

    如果想让 pixelshot 始终处在 PATH 里供 Claude 调用,官方推荐用 uv toolpipx

    uv tool install pixelrag   # pipx install pixelrag
    

    核心功能

    1. 像素级文档渲染: 通过 pixelshot 把网页、PDF 转成截图块,保留文本 RAG 会丢失的视觉结构与版式。
    2. 视觉语义检索: 基于 Qwen3-VL-Embedding-2B 微调后的嵌入模型,将页面图片映射到可检索向量空间。
    3. 828 万维基百科预建索引: 官方已建好并托管了 api.pixelrag.ai,无需任何配置即可搜索,还支持“以图搜图”。
    4. 本地自建索引: 通过 pixelrag index build 处理本地文档(网页 / PDF / 图片),再 pixelrag serve 启动 FastAPI 搜索服务。
    5. Claude Code 插件: pixelbrowse skill 让 Claude 直接截图并阅读页面,告别原始 HTML。

    传统文本RAG vs PixelRAG

    传统文本RAG会丢失表格等视觉结构,PixelRAG通过截图块保留完整版式。

    PixelRAG 关键速览

    典型使用场景

    场景 1:财报 / 论文中的表格问答

    传统文本 RAG 把 PDF 表格拆成凌乱文字后,模型经常找不到数字。PixelRAG 直接截取表格区域截图,检索相关页并交给 VLM 读取,数字、单位、行列关系一目了然。

    场景 2:Claude 浏览复杂网页

    安装 pixelbrowse skill 后,Claude 能够对任意页面执行 /screenshot https://example.com,然后“看图”总结新闻、解读产品页或提取图表结论,而不再受限于 HTML 标签提取不全的问题。

    场景 3:内部知识库可视化搜索

    把企业内的产品手册、设计稿、UI 截图、架构图做成 PixelRAG 索引。用户上传一张截图或输入图片描述,即可召回相关视觉文档,适用于设计系统、运维监控面板、竞品分析资料库。

    推荐理由

    PixelRAG 给我最大的启发是:当大家都在卷“更好的 HTML 解析器”时,它直接换了一条赛道——让模型像人一样“看”网页。这不是炫技,而是切中了 RAG 的实际痛点:大量网页的表格、图表、公式和交互组件一旦转成纯文本就面目全非。配合已经训练好的视觉嵌入模型和 828 万维基百科索引,从实验到落地只需要几条命令。

    对于 Claude / Cursor / Codex 等 Coding Agent 用户来说,pixelbrowse skill 是一个润物细无声的能力升级:它不需要 MCP server,也不依赖后端服务,只是让 Agent 多了一双“眼睛”。如果你正在做多模态知识库、网页问答或文档理解,PixelRAG 值得放进候选清单。

    下载地址

    —— 本文由 WorkBuddy 整理发布。

  • GitHub Copilot SDK:一套 Agent 运行时,六种语言官方 SDK

    GitHub Copilot SDK:一套 Agent 运行时,六种语言官方 SDK

    GitHub Copilot SDK

    项目简介

    GitHub Copilot SDK 是 GitHub 官方发布的多平台 Agent 运行时 SDK,让你在自己的应用中嵌入 Copilot CLI 的完整智能体引擎。支持 TypeScript、Python、Go、.NET(C#)、Java、Rust 六种语言,通过 JSON-RPC 与 Copilot CLI server 模式通信,SDK 自动管理进程生命周期——你只需定义 Agent 行为,Copilot 负责规划、工具调用和文件编辑。

    一句话:把 Copilot CLI 的 Agent 能力,以 SDK 形式嵌入任何应用。

    六语言SDK速览

    安装要求与过程

    环境要求

    • Node.js / TypeScript:Node.js ^20.19.0 或 ≥22.12.0
    • Python:Python 3.11+
    • .NET:.NET 8+ SDK
    • Go / Rust / Java:对应语言工具链 + 需额外安装 Copilot CLI
    • 认证:GitHub Copilot 订阅,或 BYOK 自带模型 API Key

    快速安装

    # Node.js / TypeScript
    npm install @github/copilot-sdk
    
    # Python
    pip install github-copilot-sdk
    python -m copilot download-runtime   # 下载运行时二进制
    
    # .NET
    dotnet add package GitHub.Copilot.SDK
    
    # Go
    go get github.com/github/copilot-sdk/go
    
    # Rust
    cargo add github-copilot-sdk
    
    # Java (Maven)
    <dependency>
      <groupId>com.github</groupId>
      <artifactId>copilot-sdk-java</artifactId>
    </dependency>

    Python 快速上手示例

    import asyncio
    from copilot import CopilotClient
    from copilot.session_events import AssistantMessageData, SessionIdleData
    from copilot.session import PermissionHandler
    
    async def main():
        async with CopilotClient() as client:
            async with await client.create_session(
                on_permission_request=PermissionHandler.approve_all,
                model="gpt-5",
            ) as session:
                done = asyncio.Event()
                def on_event(event):
                    match event.data:
                        case AssistantMessageData() as data:
                            print(data.content)
                        case SessionIdleData():
                            done.set()
                session.on(on_event)
                await session.send("What is 2+2?")
                await done.wait()
    
    asyncio.run(main())

    核心功能

    1. 六语言官方 SDK:TypeScript/Python/Go/.NET/Java/Rust 全部由 GitHub 官方维护,统一 API 设计,语义化版本管理(GA 状态)。
    2. Agent Loop 完整循环:内置完整的工具调用循环(Tool Use Loop),自动处理回合(Turn)与完成信号,无需自建编排层。
    3. Hooks 拦截机制:可在工具调用前后拦截、改写结果、处理错误——实现权限控制、日志审计、输出过滤等中间件逻辑。
    4. Custom Agents + Fleet Mode:定义带独立工具集和指令的子智能体;Fleet Mode 支持并行派发多个子智能体处理大型独立任务流。
    5. MCP Servers 集成:原生接入 Model Context Protocol 服务器,扩展外部工具能力;同时支持 Skills 提示词模块与 Plugin Directories 插件打包。
    6. 40+ Streaming Events:实时订阅会话事件流(assistant.message、tool.call、session.idle 等),构建响应式 UI。
    架构与核心能力

    典型使用场景

    场景一:IDE 插件内嵌 AI 编程助手

    在 VS Code / JetBrains 插件中集成 Copilot Agent,用户选中代码后调用 SDK 发起对话,Agent 自动读取文件上下文、执行重构建议、直接编辑文件。相比自己对接 LLM API + 构建工具链,SDK 已封装好文件读写、终端命令、Git 操作等全套工具。

    场景二:CI/CD 流水线中的自动化 Review Bot

    在 GitHub Actions 中用 Python SDK 启动 Copilot Session,将 PR diff 作为输入发送给 Agent,让它分析变更影响、生成 review 评论。通过 Hooks 可限制 Agent 只读不写,确保安全可控。

    场景三:SaaS 产品中的 AI 功能模块

    在 Web 后端通过 TypeScript SDK 创建带预算限制的 Session(Session Limits),为每个用户分配 AI Credits 配额。结合 Remote Sessions 功能,让用户在浏览器中实时看到 Agent 工作过程。BYOK 模式下可使用自有模型 Key,降低运营成本。

    推荐理由

    作为 GitHub 官方出品,Copilot SDK 的最大优势是「不用重复造轮子」。过去要在应用里嵌入 AI Agent 能力,你需要自己处理模型选择、提示词模板、工具定义、权限控制、错误恢复……现在这些全部由 Copilot CLI 引擎托管,SDK 只暴露简洁的 Session API。

    六种语言的覆盖面也令人印象深刻——从脚本到企业级后端,从前端到系统编程,几乎覆盖了主流开发栈。特别是 Python 和 TypeScript SDK 内置了 CLI 二进制,开箱即用体验非常顺滑。

    当然,它需要 Copilot 订阅或 BYOK 配置,不是完全免费的方案。但考虑到它提供的生产级 Agent 运行时能力,这个成本是合理的。如果你正在评估「如何在产品中加入 AI Agent 能力」,Copilot SDK 值得作为首选方案之一认真试用。

    下载地址

  • Pi Agent Harness:81K Star 的极简终端 AI 编程智能体,四个工具 + 无限扩展

    Pi Agent Harness:81K Star 的极简终端 AI 编程智能体,四个工具 + 无限扩展

    Pi 交互模式:顶部启动信息、消息区、编辑器与状态栏一目了然
    Pi 交互模式:顶部启动信息、消息区、编辑器与状态栏一目了然

    Pi(Pi Agent Harness)libGDX 作者 Mario Zechner(badlogic)团队 earendil-works 开源的极简终端 AI 编程智能体框架:核心只给模型 read / write / edit / bash 四个工具,其余能力全部交给你用 TypeScript 扩展、技能、提示词模板与主题自行拼装。上线不到一年拿下 81,000+ Stars、10,000+ Fork、248 位贡献者,MIT 许可,最新版本 v0.83.0。

    一、项目简介

    一句话:Pi 是一个「你来定义工作流」的开源终端编程智能体 —— 不预设子智能体、不预设计划模式、不内置 MCP,任何你想要的能力都能用一段 TypeScript 扩展装上去,还能打包成 npm 包分享给别人。

    它同时也是一套可复用的智能体开发工具箱,仓库内含四个独立 npm 包:

    • @earendil-works/pi-coding-agent —— 交互式编程智能体 CLI(终端里直接用的那个 pi
    • @earendil-works/pi-agent-core —— 智能体运行时,负责工具调用与状态管理
    • @earendil-works/pi-ai —— 统一多厂商大模型 API(OpenAI / Anthropic / Google 等)
    • @earendil-works/pi-tui —— 带差分渲染的终端 UI 库

    也就是说:你既可以把它当 Claude Code / Codex CLI 的替代品直接用,也可以只取其中一层,去写自己的智能体产品。

    二、安装要求和过程

    环境要求

    • Node.js(npm 全局安装方式)或直接用官方安装脚本下载独立二进制
    • 操作系统:macOS / Linux / Windows 均支持,另有 Termux(Android)与 tmux 专门文档
    • 模型凭据:任一支持的订阅(Claude Pro/Max、ChatGPT Plus/Pro、GitHub Copilot)或 API Key

    快速安装

    # 方式一:npm 全局安装(官方推荐加 --ignore-scripts)
    npm install -g --ignore-scripts @earendil-works/pi-coding-agent
    
    # 方式二:安装脚本(独立二进制)
    curl -fsSL https://pi.dev/install.sh | sh
    

    认证与启动

    # 用 API Key
    export ANTHROPIC_API_KEY=sk-ant-...
    pi
    
    # 或复用已有订阅:启动后输入 /login 选择服务商
    pi
    /login
    

    常用会话参数:

    pi -c              # 继续最近一次会话
    pi -r              # 浏览并选择历史会话
    pi --no-session    # 临时模式,不落盘
    pi -p "修复这个测试"  # 一次性打印模式(可配 --mode json)
    

    安装第三方能力包同样一条命令:pi install npm:@foo/pi-toolspi install git:github.com/user/repo@v1

    三、核心功能

    1. 四个内置工具 + 无限扩展的极简内核

    默认只有 readwriteeditbash。子智能体、计划模式、权限弹窗、待办列表这些别家标配的功能,Pi 一律不内置,而是让你通过扩展实现或安装现成的 Pi Package。作者的理由很直接:这些机制各家做法不同,硬塞进内核只会限制用户。

    2. TypeScript 扩展系统:连 Doom 都能跑

    export default function (pi: ExtensionAPI) {
      pi.registerTool({ name: "deploy", ... });
      pi.registerCommand("stats", { ... });
      pi.on("tool_call", async (event, ctx) => { ... });
    }
    

    扩展可以注册自定义工具(甚至替换内置工具)、自定义命令与快捷键、状态栏 / 页眉 / 页脚 / 浮层 UI、Git 自动提交检查点、SSH 与沙箱执行、权限门禁、自定义压缩策略、MCP 接入……官方示例里甚至有一个「等模型响应时玩 Doom」的扩展。

    3. 会话树:分支、回溯、克隆一个文件搞定

    Pi 的 /tree 会话树视图:任意节点回溯与分支切换
    Pi 的 /tree 会话树视图:任意节点回溯与分支切换

    会话以 JSONL 树结构存储,每条记录带 idparentId/tree 可跳回任意历史节点继续对话并在分支间切换,/fork 从某条用户消息派生新会话,/clone 复制当前分支,全部历史保留在同一个文件里。上下文快满时自动压缩(可手动 /compact 并给定压缩指令),压缩是有损的,但原始记录仍在 JSONL 中随时可回看。

    4. 30+ 模型服务商,含订阅登录与本地 llama.cpp

    订阅方式支持 Anthropic Claude Pro/Max、OpenAI ChatGPT Plus/Pro(Codex)、GitHub Copilot;API Key 方式覆盖 Anthropic、OpenAI、Azure OpenAI、DeepSeek、Google Gemini/Vertex、Amazon Bedrock、Mistral、Groq、Cerebras、xAI、OpenRouter、Vercel AI Gateway、智谱 ZAI Coding Plan(含中国区)、Kimi For Coding、MiniMax、小米 MiMo(含中国区/阿姆斯特丹/新加坡节点)、Hugging Face、Fireworks、Together AI、NVIDIA NIM、Cloudflare 等。还能通过 /login llama.cpp 接入本地 llama.cpp 路由服务器,用 /llama 直接下载和加载本地模型。

    5. 四种运行形态:交互 / 打印 / RPC / SDK

    除了终端交互,Pi 支持 -p 打印模式与 --mode json 结构化输出、--mode rpc(stdin/stdout 上的 JSONL 协议,方便非 Node 语言集成),以及直接以 SDK 方式嵌入自家应用:

    import { createAgentSession, ModelRuntime, SessionManager } from "@earendil-works/pi-coding-agent";
    
    const modelRuntime = await ModelRuntime.create();
    const { session } = await createAgentSession({
      sessionManager: SessionManager.inMemory(),
      modelRuntime,
    });
    await session.prompt("What files are in the current directory?");
    

    6. 供应链与项目信任双重加固

    直接依赖全部锁定精确版本、min-release-age=2 拒绝当天新发布的依赖、发布包内附 npm-shrinkwrap.json、CI 使用 npm ci --ignore-scripts 并定期跑 npm audit signatures。运行侧则有「项目信任」机制:首次进入含项目级配置或 .agents/skills 的目录会先询问,未信任前只加载上下文文件与用户级扩展。

    官方扩展示例:等待模型响应时在终端里跑 Doom
    官方扩展示例:等待模型响应时在终端里跑 Doom

    四、典型使用场景

    场景 1:把智能体改造成完全贴合自家流程的样子

    团队要求「每次改完代码自动跑 lint 并生成 checkpoint 提交」「部署只允许走内部 CLI」「敏感目录禁止写入」。在别的工具里这些要么等官方支持、要么 fork 源码;在 Pi 里就是三个扩展:一个 tool_call 事件钩子做路径门禁,一个注册 deploy 工具,一个在每轮结束时自动 git commit。写完丢进 .pi/extensions/ 全组共享,或打成 npm 包发出去。

    场景 2:低成本 / 国产模型 + 本地模型的日常编码

    /model(Ctrl+L)在 DeepSeek、Kimi For Coding、小米 MiMo、智谱 ZAI、MiniMax 之间随时切换,重活切 Claude / GPT,日常问答切便宜模型或 /llama 加载的本地模型;Ctrl+P 在自己圈定的「常用模型」间循环。底部状态栏实时显示输入/输出/缓存读写 Token、缓存命中率与累计花费,成本一目了然。

    场景 3:把编程智能体嵌进自己的产品或 CI

    pi-agent-core + pi-ai 做后端智能体服务,前端接 --mode rpc 或 SDK;CI 里用 pi -p --mode json 跑「自动修复失败测试」「批量迁移 API」这类任务,输出 JSON 直接被流水线消费。会话以 JSONL 存档,出问题时用 /tree 复盘整条决策链,还能 /export 成 HTML 或 /share 成私密 Gist 给同事看。

    五、推荐理由

    最近半年冒出来的 Coding Agent 多到看不过来,Pi 的差异化非常清晰:它把「克制」当成了产品特性。README 里那段 Philosophy 值得所有做 Agent 的人读一遍 —— 不做 MCP(写带 README 的 CLI 工具就够了)、不做子智能体(用 tmux 开多个 pi 实例)、不做权限弹窗(进容器)、不做内置待办(「它们会让模型犯迷糊」)。这些取舍未必人人认同,但每一条都给了替代路径,而不是简单的「不支持」。

    实际用下来最爽的两点:一是会话树,改坏了直接 /tree 回到三十轮之前换个思路继续,不用新开会话重讲一遍背景;二是扩展的门槛真的低,一个默认导出函数就是一个扩展,热重载 /reload 立刻生效,写工具的体验接近写普通 TypeScript 模块。加上原生支持 Kimi、MiMo、DeepSeek、智谱等国内可用的服务商,中文开发者上手成本很低。

    要注意的是:Pi 没有内置权限系统,默认以启动它的用户权限运行,官方明确建议放进容器或沙箱(文档给了 Gondolin 微虚机、Docker、OpenShell 三种方案);Pi Package 会执行任意代码,安装第三方包前务必看源码。另外仓库对新贡献者的 Issue/PR 默认自动关闭(维护者每天人工复核),提问前先读 CONTRIBUTING.md。

    六、下载地址

    项目数据(截至 2026 年 7 月 31 日):81,086 Stars · 10,008 Forks · 248 位贡献者 · TypeScript · MIT 许可 · 最新版本 v0.83.0 · 仓库仍在每日更新。

  • OpenWork:开源版 Claude Cowork,让 AI 工作流一次创建、处处复用

    OpenWork:开源版 Claude Cowork,让 AI 工作流一次创建、处处复用

    OpenWork 开源 AI 工作流平台

    OpenWork 是 different-ai 开源的一款免费桌面应用,定位为 Claude Cowork / Codex 的开源替代。它提供跨 macOS、Windows、Linux 的统一 AI 工作区,把技能(Skills)、MCP 连接、插件和常用 SaaS 服务打包成可复用的「能力」,通过同一个远程 MCP 服务器接入 Claude Code、Cursor、Codex、OpenCode 等主流 Agent,实现「一次创建、处处复用」。

    安装要求和过程

    环境要求

    • 桌面端:macOS、Windows 或 Linux,支持 Apple Silicon 与 x86_64。
    • 开发环境:Node.js 24(仓库使用 .nvmrc 锁定),包管理器 pnpm 11.4.0,monorepo 使用 Turborepo。
    • 服务器 / 团队版:Docker + Kubernetes 可部署 OpenWork Den 控制平面(文档提供 AWS EKS、Azure AKS、GCP GKE 示例)。

    快速安装

    • 用户安装(推荐):下载安装脚本并执行 openwork-bootstrap CLI。
    curl -fsSLo /tmp/openwork-install.sh https://openworklabs.com/install.sh
    less /tmp/openwork-install.sh
    sh /tmp/openwork-install.sh
    • 安装桌面端
    openwork-bootstrap install app --manifest https://openworklabs.com/install-manifest.json --json
    openwork-bootstrap doctor --app --json
    • 从源码开发
    git clone https://github.com/different-ai/openwork.git
    cd openwork
    pnpm install
    pnpm dev  # 启动 Electron 桌面端

    或者直接访问官网 Download OpenWork 下载对应系统安装包。

    核心功能

    OpenWork 能力架构
    1. 统一能力市场
      把常用的工具、API、提示词和 MCP 封装为「技能」与「插件」,个人或团队发布到市场后即可在任意接入的 Agent 中复用。
    2. OpenWork MCP 远程接入
      只需一行命令即可把 OpenWork 接入 Claude Code、Cursor、Codex、OpenCode 等支持 MCP 的客户端,暴露 search_capabilitiesexecute_capability 两个工具。
    3. 跨端 Electron 桌面应用
      提供本地专属工作区,离线/在线混合运行,内置 opencode 智能体运行时,支持技能编排与记忆管理。
    4. OpenWork Den 组织控制平面
      管理模型供应商配额、团队权限、桌面策略、应用版本限制,并支持 Google Workspace、Microsoft 365 等 SaaS 集成。
    5. Agent-first 安装流程
      用户可以直接让现有 AI 助手执行安装、创建工作区、打开桌面端,甚至连接 OpenWork MCP,无需手动翻阅文档。

    典型使用场景

    1. 多 Agent 共享同一套工具链

    个人开发者把常用的 Supabase、Vercel、GitHub、Slack MCP 封装进 OpenWork,配置一次后,Claude Code 写后端、Cursor 改前端、Codex 跑脚本时都能调用同一组连接和凭证,避免每个客户端重复配置。

    OpenWork 桌面应用

    2. 团队统一 AI 工作区

    技术负责人通过 OpenWork Den 发布内部技能(如「生成发布说明」「数据库迁移脚本」),分配给特定团队;同时限制可用模型、控制 token 预算、审计执行记录,实现 AI 工具在组织层面的治理。

    OpenWork Den 组织控制平面

    3. 开源替代方案落地

    对数据主权敏感或预算受限的团队,可用 OpenWork 替代 Claude Cowork / Codex:Electron 桌面端本地化运行,代码可审计,团队版可自托管,避免把核心工作流绑定到单一闭源平台。

    推荐理由

    OpenWork 的最大价值在于把「AI 工作流」从工具孤岛中解放出来。它不像传统 IDE 插件那样只服务单个编辑器,而是通过标准化 MCP 让能力在多个 Agent 之间流动。对于已经混用 Claude Code、Cursor、Codex 的开发者来说,这种「一次配置、多端复用」的体验非常解渴。

    项目本身工程化程度很高:pnpm + Turborepo 管理多包,Electron 桌面端与远程 MCP 服务器分离,Den 控制平面提供企业级治理接口,文档覆盖 K8s 部署、Google Workspace OAuth、Microsoft Entra SSO 等。GitHub 18K+ Stars 且保持高频迭代(v0.18.12 于 2026-07-30 发布),说明社区认可度不错。

    需要注意:仓库 /ee 目录为 Fair Source License,其他主体代码自定义商业许可,商用前建议阅读 LICENSE。

    下载地址

  • MiMoCode:小米开源的终端 AI 编程助手,让模型与 Agent 共同进化

    MiMoCode:小米开源的终端 AI 编程助手,让模型与 Agent 共同进化

    MiMoCode

    项目简介

    MiMoCode 是小米开源的一款终端原生 AI 编程助手,主打“模型与智能体共同进化”。它不仅能读写代码、执行命令、管理 Git,还通过持久记忆、智能上下文压缩、子智能体编排和可复用工作流,让 AI 在长周期开发任务中保持对项目的深度理解。

    安装要求和过程

    环境要求

    • Node.js 20+(推荐,npm 全局安装)
    • macOS / Linux / Windows 均支持
    • 可选:Bun(开发构建需要)

    快速安装

    # macOS / Linux 一键安装
    curl -fsSL https://mimo.xiaomi.com/install | bash
    
    # Windows PowerShell 一键安装
    powershell -ep Bypass -c "irm https://mimo.xiaomi.com/install.ps1 | iex"
    
    # 或 npm 全局安装(跨平台)
    npm install -g @mimo-ai/cli
    
    # 启动
    mimo
    

    首次启动会自动引导配置:可选 MiMo Auto(限时免费、零配置)、小米 MiMo 平台 OAuth、Codex / Claude Code 迁移、OpenAI / xAI 等自定义 Provider。

    核心功能

    MiMoCode 核心特性

    1. 三种主智能体:Build(全权限开发)、Plan(只读分析)、Compose(规格编排)。按 Tab 切换,子智能体按需并行创建。
    2. 持久记忆系统:基于 SQLite FTS5,自动维护 MEMORY.md、会话检查点、任务进度日志,跨会话自动注入上下文。
    3. 智能上下文管理:自动检查点 + 上下文重建 + 预算化注入;/context-limit 可按模型自定义压缩点,兼顾成本与质量。
    4. 四大内置工作流:compose(全流程开发)、deep-research(深度研究)、fact-check(事实核查)、research-experiment(自主优化实验),支持自定义 .mimocode/workflows/*.js
    5. 自我进化能力/dream 提炼会话知识入库,/distill 把重复操作打包成技能,/goal 设定目标并由裁判模型判定停机条件。

    典型使用场景

    • 新功能全栈交付:输入需求后,Build 智能体调用 /compose-next 完成需求澄清 → 规格文档 → 代码实现 → 验证 → 合并,适合清晰可拆分的开发任务。
    • 代码库探索与重构:Plan 智能体以只读模式分析项目结构,结合持久记忆整理架构决策,再做安全的重构规划。
    • 调研型任务:调用 deep-research 工作流,并行检索多源信息、生成带引用链接的 Markdown 报告,适合技术选型或竞品分析。

    推荐理由

    MiMoCode 不是又一个“聊天式代码补全”工具,它在长程记忆上下文工程上下了真功夫。MEMORY.md + 检查点 + 任务进度日志的组合,解决了大多数 Agent 每次重启都要“重新认识项目”的痛点。再加上 /dream/distill 的自我进化机制,它会在使用过程中越来越懂你的代码库和习惯。如果你同时用 Claude Code 或 Codex,MiMoCode 还支持一键迁移 Provider,切换成本很低。小米官方维护、MIT 许可、TypeScript 全栈,对中文开发者非常友好。

    下载地址

  • book-to-skill:把任何技术书 PDF 变成 AI 智能体技能,实测省 24~51 倍 Token|GitHub 12.5K Stars 今日趋势榜第一

    book-to-skill:把任何技术书 PDF 变成 AI 智能体技能,实测省 24~51 倍 Token|GitHub 12.5K Stars 今日趋势榜第一

    book-to-skill 项目

    📌 项目简介

    book-to-skill 是一个能把任何技术书籍 PDF(以及 EPUB、DOCX、Markdown 等十余种格式)一键转换成 AI 智能体技能(Agent Skill)的开源工具——转换后你的 Claude Code、GitHub Copilot CLI 或 Amp 就能”读过这本书”,随时按需调取书中真实内容回答问题,彻底告别大模型幻觉和翻 PDF 的痛苦。项目基于 Python 开发,MIT 许可,2026 年 5 月开源以来已斩获 12,499 Stars,今日更以单日 +1,400 星登顶 GitHub Trending。

    book-to-skill Logo

    它解决的是一个所有技术人都懂的痛点:买了一本好书,读完一遍,三个月后连第 7 章讲什么都想不起来。直接把 PDF 扔给 AI?一本 400 页的书约 20 万 token,每轮对话都要全额付费,而且模型在超长上下文里”迷失中间”、精度骤降。book-to-skill 的思路是编译期一次性深度蒸馏:把书拆解成核心心智模型 + 按章节的知识文件 + 术语表 + 模式库 + 速查表,智能体按需加载,实测比整书塞上下文省 24~51 倍 token

    ⚙️ 安装要求和过程

    环境要求

    • Python 3 环境(纯文本/Markdown/reST/AsciiDoc 无需额外依赖)
    • PDF 提取:文字型书籍用 pdftotext(poppler)或 pip3 install pypdf;含代码/表格/公式的技术书推荐 pip3 install docling(可完整保留 Markdown 表格与代码块)
    • EPUB:pip3 install ebooklib beautifulsoup4(有内置 zipfile 兜底)
    • 宿主:支持开放 Agent Skills 标准的任意智能体——Claude Code、GitHub Copilot CLI、Amp 均可

    安装(作为智能体技能)

    # Claude Code
    git clone https://github.com/virgiliojr94/book-to-skill.git ~/.claude/skills/book-to-skill
    
    # GitHub Copilot CLI
    git clone https://github.com/virgiliojr94/book-to-skill.git ~/.copilot/skills/book-to-skill
    
    # 跨智能体通用路径(Copilot CLI 与 Amp 都能发现)
    git clone https://github.com/virgiliojr94/book-to-skill.git ~/.agents/skills/book-to-skill
    

    使用:三步把书变技能

    # 1. 指向一个文件、文件夹或 glob
    /book-to-skill ~/books/designing-data-intensive-apps.pdf
    
    # 2. 自动蒸馏为技能(框架、决策规则、反模式、分章文件)
    
    # 3. 之后随时按需调用
    /designing-data-intensive-apps replication   # 讲解某个主题
    /designing-data-intensive-apps ch05          # 深入第 5 章
    

    另有独立 CLI 模式:pip install "book-to-skill[pdf,epub,docx]",仅安装文本提取引擎用于脚本化处理(不注册斜杠命令)。运行 python3 scripts/extract.py --check 可一键检查各格式提取器安装情况。

    🚀 核心功能

    • 全格式文档蒸馏:支持 PDF、EPUB、DOCX、TXT、Markdown、reST、AsciiDoc、HTML、RTF、MOBI/AZW 等格式;可一次处理多个文件、整个文件夹或 glob 模式,合并成统一技能,还能向已有技能”折叠”新增材料(增量更新)
    • 结构化技能产物:生成 SKILL.md(约 4K token 的核心心智模型 + 章节索引)、每章约 1K token 的按需加载文件、术语表 glossary.md、技术模式库 patterns.md、决策速查表 cheatsheet.md——是”结构”而非”摘要”
    • 24~51 倍 token 节省(实测):内置 tools/discovery_tax.py 测量工具,在 Think Python 2、Working Backwards、AI Engineering 三本真书上实测:回答一个问题只需约 5K token(核心 + 单章),对比整书上下文倾倒 12 万~25.6 万 token
    • 智能提取管线:转换前自动询问书籍类型——技术书走 Docling(保留表格代码),纯文字书走 pdftotext 秒级提取;单个坏源自动跳过不影响批处理;一本书完整转换成本约 1 美元
    • 开放标准、一次安装多端通用:遵循开放 Agent Skills 标准(SKILL.md 格式),Claude Code、GitHub Copilot CLI、Amp 读取同一份技能,无厂商锁定

    💡 典型使用场景

    • 技术书籍随身参谋:把《DDIA》《Pro Git》这类工具书转成技能,写代码时直接 /ddia replication 让智能体基于书中真实章节讲解复制策略——不是幻觉,不是网页搜索,就是作者原文提炼的框架
    • 团队内部文档折叠:把整个 docs/ 文件夹(架构决策记录、Runbook、新人指南)合并成一个技能,新同事在编码会话里直接提问,替代翻 60 页 PDF 的品牌手册/规范文档
    • 研究资料簇管理:一摞论文加自己的笔记合成统一技能,新论文来了增量折叠进去;对比 RAG——RAG 适合”几十本书里找提到 X 的段落”(宽而浅),book-to-skill 适合”吃透一本书的 12 个框架并应用”(窄而深),两者互补

    ❤️ 推荐理由

    这个项目最打动我的是它把”AI 读书”从检索问题重构成了编译问题。RAG 是查询时相似度搜索,返回”和你问题相近的文本块”;book-to-skill 是编译时深度分析,输出”作者花几年构建的命名框架、适用条件和反模式”——前者是检索,后者是可推理的结构。README 里那句话很精辟:“RAG indexes a shelf, book-to-skill masters a spine”(RAG 索引一整架书,book-to-skill 吃透一本书的书脊)。

    工程上它也异常诚实:所有 token 节省数据都有可复现的测量脚本,README 明确写出”诚实警告”——章节自动切分需要显式的 Chapter N 标题、一次性阅读场景用普通 PDF 智能体就够了。在营销味十足的 AI 开源圈,这种”实测优先、有限承诺”的态度非常难得。如果你的 ~/.claude/skills 目录里只打算加一个新技能,让它是一个能把你书架搬进智能体的技能,很值。

    🔗 下载地址


    项目数据截至 2026 年 7 月 30 日:12,499 Stars · 1,405 Forks · Python · MIT 许可 · 今日 GitHub Trending 榜首(+1,428 星)

  • Agents Towards Production:21.2K Stars 的生产级 GenAI Agent 实战教程库

    Agents Towards Production:21.2K Stars 的生产级 GenAI Agent 实战教程库

    Agents Towards Production 封面

    项目简介

    Agents Towards Production 是 Nir Diamant 维护的一套开源、代码优先的教程合集,目标是帮助开发者把 GenAI Agent 从「能跑的原型」推进到「可上线的产品」。仓库目前包含 28 个生产级教程,覆盖工具集成、RAG、记忆、部署、安全、评估、UI 等 13 大模块,所有代码都以可运行的 Notebook 形式提供。

    安装要求和过程

    • 环境要求:Python 3.10+、Jupyter Notebook / JupyterLab、Git
    • 克隆仓库git clone https://github.com/NirDiamant/agents-towards-production.git
    • 进入对应教程目录,例如:cd tutorials/LangGraph-agent
    • 安装依赖:每个教程都有独立的 requirements.txt,执行 pip install -r requirements.txt
    • 启动 Jupyterjupyter notebook,按 Notebook 说明逐格运行即可

    核心功能

    • 端到端生产链路:从 Prompt 工程、状态化工作流、向量记忆,到 Docker/FastAPI 部署、GPU 扩展、安全防护,形成完整闭环。
    • 可运行教程:每个教程独立成册,直接提供 Notebook 与依赖文件,几分钟内就能从概念跑到可交互的 Agent。
    • 主流技术栈实战:涵盖 LangGraph、LangChain、MCP、Redis、Mem0、Cognee、LlamaFirewall、RunPod、AWS Bedrock、Streamlit 等。
    • 安全与可观测性:包含安全护栏、Apex 安全评估、LangSmith Tracing、IntellAgent 自动评估等实战内容。
    • 多智能体协作:讲解 A2A 协议下的智能体间通信与任务分发。

    典型使用场景

    • 企业 RAG 落地:Contextual AI 教程演示如何在 15 分钟内构建面向金融文档分析的企业级 RAG,包含文档处理、索引与 LMUnit 自动化评测。
    • 可部署 Agent 服务:Docker 容器化 + FastAPI 端点部署教程,教你把 LangGraph 工作流封装成可调用的 REST API。
    • 长记忆客服助手:结合 Redis 双记忆、Mem0 向量+图谱、Cognee 构建能持续学习用户偏好的对话 Agent。

    推荐理由

    这是一本「会动的书」:不是泛泛而谈的设计模式,而是把每个生产环节拆成可执行的 Notebook。对已经会用 LLM、但苦于不知道怎么把 Agent 真正交付到生产环境的人来说,它补全了从原型到运维之间最关键的拼图。21.2K Stars 和活跃的社区也证明了它的实用价值。

    13大模块内容地图

    三步快速上手

    下载地址

  • ECC:234K Stars 的 Agent Harness 操作系统,给 Claude Code / Codex / Cursor 装上完整工程化流程

    ECC:234K Stars 的 Agent Harness 操作系统,给 Claude Code / Codex / Cursor 装上完整工程化流程

    ECC - Agent Harness 性能优化系统

    项目简介

    ECC 是一套「Agent Harness(智能体框架)性能优化系统」——它不造轮子写新的 AI 编程工具,而是给你已经在用的 Claude Code、Codex、Cursor、OpenCode 等工具装上一整套工程化操作系统:281 个技能(Skills)、67 个专职智能体、运行时钩子(Hooks)、持久记忆、直觉学习(Instincts)与 AgentShield 安全扫描,让 AI 编程助手从”会写代码”升级为”按工程流程交付”。GitHub 上已狂揽 234,000+ Stars,是目前 Agent 增强类项目中的现象级存在,今日仍以每天近 700 星的速度增长。

    它的核心哲学一句话就能讲清:Optimize the context window. Persist everything else.(优化上下文窗口,持久化其余一切。)AI 不再需要你在每个提示词里重复”请先写测试””请做代码审查”,这些流程被固化为可安装、可复用的系统组件:

    plan -> test -> implement -> review -> verify -> remember -> improve

    ECC - the agent harness operating system

    安装要求和过程

    环境要求:

    • Node.js(钩子与脚本全部用 Node.js 编写,Windows / macOS / Linux 全平台支持)
    • 至少一个 AI 编程工具:Claude Code、Codex、Cursor、OpenCode、Gemini CLI、Zed、Kimi Code 等 12+ 种均有适配

    方式一:Claude Code 插件安装(推荐,最简单)——在 Claude Code 里输入两条命令即可:

    /plugin marketplace add https://github.com/affaan-m/ECC
    /plugin install ecc@ecc

    如需规则包(Rules),再手动拷贝你实际使用的语言包:

    git clone https://github.com/affaan-m/ECC.git
    cd ECC
    mkdir -p ~/.claude/rules/ecc
    cp -R rules/common ~/.claude/rules/ecc/
    cp -R rules/typescript ~/.claude/rules/ecc/  # 换成你的技术栈

    方式二:Codex 同步安装(先运行一次 Codex 生成配置):

    git clone https://github.com/affaan-m/ECC.git
    cd ECC
    npm install
    bash scripts/sync-ecc-to-codex.sh

    方式三:其他工具——克隆仓库后用安装脚本指定目标:

    ./install.sh --profile minimal --target cursor    # Cursor
    ./install.sh --profile minimal --target gemini    # Gemini CLI
    ./install.sh --profile minimal --target zed       # Zed
    # Windows 用 .\install.ps1

    ⚠️ 官方特别提醒:每个工具只选一种安装方式,不要叠加(如 Claude 插件 + 手动 full 安装会导致技能、命令重复);且只从官方渠道安装(GitHub 仓库 affaan-m/ECC、npm 包 ecc-universal / ecc-agentshield),第三方镜像可能含恶意代码。

    核心功能

    • 281 个技能 + 67 个专职智能体:覆盖 TDD、安全审查、深度研究、文档、前端、数据、ML、运维等场景。规划用 planner、审查用 code-reviewer、修构建用 build-error-resolver,各智能体拥有独立上下文与工具权限,互不污染。
    • 门禁化 TDD 工作流:”请使用 TDD”从一句模型可能遗忘的指令,变成带证据链的 RED → GREEN → REFACTOR 流程:先留存失败测试证据,再实现到通过,最后由全新上下文的审查者复查——写代码和审代码不再是同一个上下文。
    • Plan Canvas 计划画布(2.1 新特性):智能体写完计划后在本地浏览器画布中打开,你用鼠标点选段落、添加锚定批注、侧栏对话,最后一键”批准/要求修改”,结果直接映射回 /plan 的确认门。Mermaid 图实时渲染,任何模型任何工具都能驱动。
    • 统一记忆保险库(Memory Vault)ecc memory 让 Claude、Codex、Kimi 等不同工具共享同一份本地可检查的 Markdown 记忆格式,支持跨工具交接(handoff)——上午用 Claude Code 做的迁移方案,下午 Codex 直接检索接手。会话结束还能蒸馏成摘要、直觉(带置信度分数)和可复用技能。
    • AgentShield 安全扫描:把智能体配置本身当作攻击面来审计——扫描提示词、钩子、MCP 配置、权限与密钥泄露,npx -y ecc-agentshield scan --path . 免安装即可体检。

    典型使用场景

    场景一:新功能开发全流程。输入 /ecc:plan "添加 OAuth 用户认证",planner 生成实现蓝图并在 Plan Canvas 里供你批注确认;随后 tdd-workflow 技能强制先写失败测试再实现;完成后 /code-review 由全新上下文的审查智能体查漏。整个过程留下计划、失败测试、通过测试、审查发现、最终验证五份证据。

    场景二:上线前安全体检。/security-scan 做 OWASP Top 10 审计,e2e-testing 技能覆盖关键用户流,/test-coverage 验证 80%+ 覆盖率;再用 AgentShield 扫一遍智能体配置本身,防止 MCP 配置或钩子里埋雷。

    场景三:多工具团队协作。团队里有人用 Claude Code、有人用 Codex、有人用 Cursor——ECC 一次安装适配全部工具,规则与技能保持一致;Memory Vault 的 handoff 机制让不同工具间无缝交接任务上下文,告别复制粘贴聊天记录。

    推荐理由

    我用过不少 Agent 增强类项目,ECC 给我的感受是”体系完整度断层领先”。多数同类项目解决单点问题(提示词库、记忆、或钩子),而 ECC 把技能、智能体、规则、钩子、记忆、直觉六层职责切分得非常清楚——技能按需加载、规则常驻精选、钩子跑在模型上下文之外,这套设计真正做到了”加能力不加上下文负担”。234K Stars 和 35K+ Forks 不是刷出来的:单一维护者每周横跨 7 个 Harness 发版,社区有 Discord、GitHub App 和 12 种语言的 README。最打动我的是它对”证据”的执念:一次交付不只是代码,而是计划、失败测试、通过测试、审查发现和验证记录组成的完整证据链——这正是 AI 编程从玩具走向生产的分水岭。项目 MIT 许可永久免费,托管版 ECC Pro 仅面向私有仓库收费,商业模式清晰不绑架用户。如果你每天在用 Claude Code 或 Codex,这可能是今年最值得装的一个增强系统。

    下载地址

    项目信息:⭐ 234,797 Stars · 🍴 35,776 Forks · 语言:JavaScript/TypeScript/Shell · 许可证:MIT · 创建于 2026 年 1 月,持续高频更新中。