标签: Coding Agent

  • book-to-skill:把任何技术书 PDF 变成 AI 智能体技能,实测省 24~51 倍 Token|GitHub 12.5K Stars 今日趋势榜第一

    book-to-skill:把任何技术书 PDF 变成 AI 智能体技能,实测省 24~51 倍 Token|GitHub 12.5K Stars 今日趋势榜第一

    book-to-skill 项目

    📌 项目简介

    book-to-skill 是一个能把任何技术书籍 PDF(以及 EPUB、DOCX、Markdown 等十余种格式)一键转换成 AI 智能体技能(Agent Skill)的开源工具——转换后你的 Claude Code、GitHub Copilot CLI 或 Amp 就能”读过这本书”,随时按需调取书中真实内容回答问题,彻底告别大模型幻觉和翻 PDF 的痛苦。项目基于 Python 开发,MIT 许可,2026 年 5 月开源以来已斩获 12,499 Stars,今日更以单日 +1,400 星登顶 GitHub Trending。

    book-to-skill Logo

    它解决的是一个所有技术人都懂的痛点:买了一本好书,读完一遍,三个月后连第 7 章讲什么都想不起来。直接把 PDF 扔给 AI?一本 400 页的书约 20 万 token,每轮对话都要全额付费,而且模型在超长上下文里”迷失中间”、精度骤降。book-to-skill 的思路是编译期一次性深度蒸馏:把书拆解成核心心智模型 + 按章节的知识文件 + 术语表 + 模式库 + 速查表,智能体按需加载,实测比整书塞上下文省 24~51 倍 token

    ⚙️ 安装要求和过程

    环境要求

    • Python 3 环境(纯文本/Markdown/reST/AsciiDoc 无需额外依赖)
    • PDF 提取:文字型书籍用 pdftotext(poppler)或 pip3 install pypdf;含代码/表格/公式的技术书推荐 pip3 install docling(可完整保留 Markdown 表格与代码块)
    • EPUB:pip3 install ebooklib beautifulsoup4(有内置 zipfile 兜底)
    • 宿主:支持开放 Agent Skills 标准的任意智能体——Claude Code、GitHub Copilot CLI、Amp 均可

    安装(作为智能体技能)

    # Claude Code
    git clone https://github.com/virgiliojr94/book-to-skill.git ~/.claude/skills/book-to-skill
    
    # GitHub Copilot CLI
    git clone https://github.com/virgiliojr94/book-to-skill.git ~/.copilot/skills/book-to-skill
    
    # 跨智能体通用路径(Copilot CLI 与 Amp 都能发现)
    git clone https://github.com/virgiliojr94/book-to-skill.git ~/.agents/skills/book-to-skill
    

    使用:三步把书变技能

    # 1. 指向一个文件、文件夹或 glob
    /book-to-skill ~/books/designing-data-intensive-apps.pdf
    
    # 2. 自动蒸馏为技能(框架、决策规则、反模式、分章文件)
    
    # 3. 之后随时按需调用
    /designing-data-intensive-apps replication   # 讲解某个主题
    /designing-data-intensive-apps ch05          # 深入第 5 章
    

    另有独立 CLI 模式:pip install "book-to-skill[pdf,epub,docx]",仅安装文本提取引擎用于脚本化处理(不注册斜杠命令)。运行 python3 scripts/extract.py --check 可一键检查各格式提取器安装情况。

    🚀 核心功能

    • 全格式文档蒸馏:支持 PDF、EPUB、DOCX、TXT、Markdown、reST、AsciiDoc、HTML、RTF、MOBI/AZW 等格式;可一次处理多个文件、整个文件夹或 glob 模式,合并成统一技能,还能向已有技能”折叠”新增材料(增量更新)
    • 结构化技能产物:生成 SKILL.md(约 4K token 的核心心智模型 + 章节索引)、每章约 1K token 的按需加载文件、术语表 glossary.md、技术模式库 patterns.md、决策速查表 cheatsheet.md——是”结构”而非”摘要”
    • 24~51 倍 token 节省(实测):内置 tools/discovery_tax.py 测量工具,在 Think Python 2、Working Backwards、AI Engineering 三本真书上实测:回答一个问题只需约 5K token(核心 + 单章),对比整书上下文倾倒 12 万~25.6 万 token
    • 智能提取管线:转换前自动询问书籍类型——技术书走 Docling(保留表格代码),纯文字书走 pdftotext 秒级提取;单个坏源自动跳过不影响批处理;一本书完整转换成本约 1 美元
    • 开放标准、一次安装多端通用:遵循开放 Agent Skills 标准(SKILL.md 格式),Claude Code、GitHub Copilot CLI、Amp 读取同一份技能,无厂商锁定

    💡 典型使用场景

    • 技术书籍随身参谋:把《DDIA》《Pro Git》这类工具书转成技能,写代码时直接 /ddia replication 让智能体基于书中真实章节讲解复制策略——不是幻觉,不是网页搜索,就是作者原文提炼的框架
    • 团队内部文档折叠:把整个 docs/ 文件夹(架构决策记录、Runbook、新人指南)合并成一个技能,新同事在编码会话里直接提问,替代翻 60 页 PDF 的品牌手册/规范文档
    • 研究资料簇管理:一摞论文加自己的笔记合成统一技能,新论文来了增量折叠进去;对比 RAG——RAG 适合”几十本书里找提到 X 的段落”(宽而浅),book-to-skill 适合”吃透一本书的 12 个框架并应用”(窄而深),两者互补

    ❤️ 推荐理由

    这个项目最打动我的是它把”AI 读书”从检索问题重构成了编译问题。RAG 是查询时相似度搜索,返回”和你问题相近的文本块”;book-to-skill 是编译时深度分析,输出”作者花几年构建的命名框架、适用条件和反模式”——前者是检索,后者是可推理的结构。README 里那句话很精辟:“RAG indexes a shelf, book-to-skill masters a spine”(RAG 索引一整架书,book-to-skill 吃透一本书的书脊)。

    工程上它也异常诚实:所有 token 节省数据都有可复现的测量脚本,README 明确写出”诚实警告”——章节自动切分需要显式的 Chapter N 标题、一次性阅读场景用普通 PDF 智能体就够了。在营销味十足的 AI 开源圈,这种”实测优先、有限承诺”的态度非常难得。如果你的 ~/.claude/skills 目录里只打算加一个新技能,让它是一个能把你书架搬进智能体的技能,很值。

    🔗 下载地址


    项目数据截至 2026 年 7 月 30 日:12,499 Stars · 1,405 Forks · Python · MIT 许可 · 今日 GitHub Trending 榜首(+1,428 星)

  • ECC:234K Stars 的 Agent Harness 操作系统,给 Claude Code / Codex / Cursor 装上完整工程化流程

    ECC:234K Stars 的 Agent Harness 操作系统,给 Claude Code / Codex / Cursor 装上完整工程化流程

    ECC - Agent Harness 性能优化系统

    项目简介

    ECC 是一套「Agent Harness(智能体框架)性能优化系统」——它不造轮子写新的 AI 编程工具,而是给你已经在用的 Claude Code、Codex、Cursor、OpenCode 等工具装上一整套工程化操作系统:281 个技能(Skills)、67 个专职智能体、运行时钩子(Hooks)、持久记忆、直觉学习(Instincts)与 AgentShield 安全扫描,让 AI 编程助手从”会写代码”升级为”按工程流程交付”。GitHub 上已狂揽 234,000+ Stars,是目前 Agent 增强类项目中的现象级存在,今日仍以每天近 700 星的速度增长。

    它的核心哲学一句话就能讲清:Optimize the context window. Persist everything else.(优化上下文窗口,持久化其余一切。)AI 不再需要你在每个提示词里重复”请先写测试””请做代码审查”,这些流程被固化为可安装、可复用的系统组件:

    plan -> test -> implement -> review -> verify -> remember -> improve

    ECC - the agent harness operating system

    安装要求和过程

    环境要求:

    • Node.js(钩子与脚本全部用 Node.js 编写,Windows / macOS / Linux 全平台支持)
    • 至少一个 AI 编程工具:Claude Code、Codex、Cursor、OpenCode、Gemini CLI、Zed、Kimi Code 等 12+ 种均有适配

    方式一:Claude Code 插件安装(推荐,最简单)——在 Claude Code 里输入两条命令即可:

    /plugin marketplace add https://github.com/affaan-m/ECC
    /plugin install ecc@ecc

    如需规则包(Rules),再手动拷贝你实际使用的语言包:

    git clone https://github.com/affaan-m/ECC.git
    cd ECC
    mkdir -p ~/.claude/rules/ecc
    cp -R rules/common ~/.claude/rules/ecc/
    cp -R rules/typescript ~/.claude/rules/ecc/  # 换成你的技术栈

    方式二:Codex 同步安装(先运行一次 Codex 生成配置):

    git clone https://github.com/affaan-m/ECC.git
    cd ECC
    npm install
    bash scripts/sync-ecc-to-codex.sh

    方式三:其他工具——克隆仓库后用安装脚本指定目标:

    ./install.sh --profile minimal --target cursor    # Cursor
    ./install.sh --profile minimal --target gemini    # Gemini CLI
    ./install.sh --profile minimal --target zed       # Zed
    # Windows 用 .\install.ps1

    ⚠️ 官方特别提醒:每个工具只选一种安装方式,不要叠加(如 Claude 插件 + 手动 full 安装会导致技能、命令重复);且只从官方渠道安装(GitHub 仓库 affaan-m/ECC、npm 包 ecc-universal / ecc-agentshield),第三方镜像可能含恶意代码。

    核心功能

    • 281 个技能 + 67 个专职智能体:覆盖 TDD、安全审查、深度研究、文档、前端、数据、ML、运维等场景。规划用 planner、审查用 code-reviewer、修构建用 build-error-resolver,各智能体拥有独立上下文与工具权限,互不污染。
    • 门禁化 TDD 工作流:”请使用 TDD”从一句模型可能遗忘的指令,变成带证据链的 RED → GREEN → REFACTOR 流程:先留存失败测试证据,再实现到通过,最后由全新上下文的审查者复查——写代码和审代码不再是同一个上下文。
    • Plan Canvas 计划画布(2.1 新特性):智能体写完计划后在本地浏览器画布中打开,你用鼠标点选段落、添加锚定批注、侧栏对话,最后一键”批准/要求修改”,结果直接映射回 /plan 的确认门。Mermaid 图实时渲染,任何模型任何工具都能驱动。
    • 统一记忆保险库(Memory Vault)ecc memory 让 Claude、Codex、Kimi 等不同工具共享同一份本地可检查的 Markdown 记忆格式,支持跨工具交接(handoff)——上午用 Claude Code 做的迁移方案,下午 Codex 直接检索接手。会话结束还能蒸馏成摘要、直觉(带置信度分数)和可复用技能。
    • AgentShield 安全扫描:把智能体配置本身当作攻击面来审计——扫描提示词、钩子、MCP 配置、权限与密钥泄露,npx -y ecc-agentshield scan --path . 免安装即可体检。

    典型使用场景

    场景一:新功能开发全流程。输入 /ecc:plan "添加 OAuth 用户认证",planner 生成实现蓝图并在 Plan Canvas 里供你批注确认;随后 tdd-workflow 技能强制先写失败测试再实现;完成后 /code-review 由全新上下文的审查智能体查漏。整个过程留下计划、失败测试、通过测试、审查发现、最终验证五份证据。

    场景二:上线前安全体检。/security-scan 做 OWASP Top 10 审计,e2e-testing 技能覆盖关键用户流,/test-coverage 验证 80%+ 覆盖率;再用 AgentShield 扫一遍智能体配置本身,防止 MCP 配置或钩子里埋雷。

    场景三:多工具团队协作。团队里有人用 Claude Code、有人用 Codex、有人用 Cursor——ECC 一次安装适配全部工具,规则与技能保持一致;Memory Vault 的 handoff 机制让不同工具间无缝交接任务上下文,告别复制粘贴聊天记录。

    推荐理由

    我用过不少 Agent 增强类项目,ECC 给我的感受是”体系完整度断层领先”。多数同类项目解决单点问题(提示词库、记忆、或钩子),而 ECC 把技能、智能体、规则、钩子、记忆、直觉六层职责切分得非常清楚——技能按需加载、规则常驻精选、钩子跑在模型上下文之外,这套设计真正做到了”加能力不加上下文负担”。234K Stars 和 35K+ Forks 不是刷出来的:单一维护者每周横跨 7 个 Harness 发版,社区有 Discord、GitHub App 和 12 种语言的 README。最打动我的是它对”证据”的执念:一次交付不只是代码,而是计划、失败测试、通过测试、审查发现和验证记录组成的完整证据链——这正是 AI 编程从玩具走向生产的分水岭。项目 MIT 许可永久免费,托管版 ECC Pro 仅面向私有仓库收费,商业模式清晰不绑架用户。如果你每天在用 Claude Code 或 Codex,这可能是今年最值得装的一个增强系统。

    下载地址

    项目信息:⭐ 234,797 Stars · 🍴 35,776 Forks · 语言:JavaScript/TypeScript/Shell · 许可证:MIT · 创建于 2026 年 1 月,持续高频更新中。

  • Oh My OpenAgent:66.7K Stars 的 AI 编程智能体”满配套件”,一个词启动 11 个智能体并行开发

    Oh My OpenAgent:66.7K Stars 的 AI 编程智能体”满配套件”,一个词启动 11 个智能体并行开发

    Oh My OpenAgent

    项目简介

    Oh My OpenAgent(OmO)是韩国开发者 code-yeongyu 开源的「AI 编程智能体增强套件(Agent Harness)」——一句话概括:给 OpenCode / Codex CLI 装上一个”满配的 AI 开发团队”,装完只需输入 ultrawork 一个词,11 个专职智能体、54+ 生命周期钩子、5 个内置 MCP 就会自动协同,把复杂任务一路干到完成为止。项目目前已收获 66,693 Stars,甚至因为太火导致 Anthropic 封锁了 OpenCode 的 Claude 订阅接入——作者干脆转身拥抱多模型路由,主打”不要选赢家,要编排所有模型”。

    Oh My OpenAgent Team Mode 运行界面

    ▲ Team Mode 实战:Kimi K3 + GPT-5.6 Sol 多智能体并行工作

    安装要求和过程

    环境要求

    • Ultimate 版(OpenCode):需安装 Bun 与 OpenCode
    • Light 版(Codex CLI):仅需 Node.js/npm 环境,无需 Bun
    • 至少一个模型订阅或 API(推荐组合:ChatGPT $20 / Kimi Code $19 / GLM Coding $10,低成本即可跑满血)

    快速安装

    # Ultimate 版(OpenCode 完整体:11 智能体 + Team Mode + 全部功能)
    bunx oh-my-openagent install
    
    # Light 版(Codex CLI 插件:rules/LSP/ultrawork/ulw-loop 等便携组件)
    npx lazycodex-ai install
    # 非交互推荐模式
    npx lazycodex-ai install --no-tui --codex-autonomous
    
    # 两个都装
    bunx oh-my-openagent install --platform=both

    官方还推荐一种更省心的方式——直接把安装指南 URL 扔给任意 AI 助手(Claude Code、Cursor 等),让 AI 替你完成订阅检测、11 个智能体的模型匹配和各家 Provider 认证:

    Install and configure oh-my-openagent by following the instructions here:
    https://raw.githubusercontent.com/code-yeongyu/oh-my-openagent/refs/heads/dev/docs/guide/installation.md

    注意:npm 包与 CLI 命令仍叫 oh-my-opencode(更名过渡期双发布),但不要用 npx omo——那是另一个同名无关包。

    核心功能

    • ultrawork 一词流:输入 ultrawork(或 ulw)即激活全部智能体,配合 Todo Enforcer”偷懒检测”,智能体一旦闲置就被系统拽回来继续干,任务不完成不停手。
    • 纪律型智能体团队:主指挥 Sisyphus(Opus 5 / Kimi K3)负责规划与并行派活;深度工人 Hephaestus(GPT-5.6 Sol)端到端自主执行;规划师 Prometheus 以”面试模式”先访谈再出方案,另有 Oracle(架构/调试)、Librarian(文档检索)、Explore(快速扫码)各司其职。
    • Team Mode 多智能体系统(v4.0):Lead + 最多 8 个并行成员,tmux 实时可视化,衍生 hyperplan(5 个”敌对评审”轮番拆解你的方案)与 security-research(3 个漏洞猎手 + 2 个 PoC 工程师并行审计)两大技能。
    • Hashline 哈希锚定编辑:每行代码带内容哈希标签(11#VK|),编辑前校验、文件变了就拒绝写入,从根源消灭”stale line”错误——Grok Code Fast 1 的编辑成功率靠它从 6.7% 飙到 68.3%。
    • 按类别自动路由模型:子任务只声明类别(visual-engineering / deep / quick / ultrabrain),框架自动匹配最擅长的模型;同时完全兼容 Claude Code 的 hooks、commands、skills、MCP 与插件生态。

    典型使用场景

    • 大规模代码翻新:有用户用它一天清掉 8000 条 ESLint 警告;还有人一夜之间把 4.5 万行的 Tauri 桌面应用改造成 SaaS 网页应用——睡前下指令,醒来验收。
    • 多订阅省钱组合拳:不必为单一厂商付 $200/月,用 Kimi K3 + GPT-5.6 Sol 的平价组合即可超越原版 Claude Code 体验,模型按任务类别自动分工。
    • 方案评审与安全审计:写代码前先跑 hyperplan 让 5 个”杠精”智能体从不同角度挑刺;上线前用 security-research 让 5 个智能体并行做渗透式代码审计,按真实可利用性定级。

    推荐理由

    这是我见过”工程密度”最高的 Agent Harness 项目。它不是又一个 prompt 合集,而是把作者烧掉 2.4 万美元 token 试错换来的经验固化成了产品:Hashline 编辑工具解决的是所有编码智能体最痛的”改错行”问题;类别路由让”选模型”这件事彻底消失;Todo Enforcer 治好了 AI”干一半就摆烂”的顽疾。社区口碑也相当能打——”让我退订了 Cursor””用了就回不去了”。如果你已经在用 OpenCode 或 Codex CLI,这基本是无脑必装的存在;哪怕只是想围观多智能体协作的工程实践,读它的源码和文档也极有收获。唯一注意点:License 为 SUL-1.0(Sisyphus 使用许可),商用前建议先读一下条款,且默认开启匿名遥测(可通过 OMO_DISABLE_POSTHOG=1 关闭)。

    下载地址

    项目数据:66,693 Stars | 语言:TypeScript | License:SUL-1.0 | 最近更新:2026-07-28

  • Impeccable:50.9K Stars!专治AI生成界面的「AI味」,让Claude Code、Cursor真正懂设计的开源设计语言

    Impeccable:50.9K Stars!专治AI生成界面的「AI味」,让Claude Code、Cursor真正懂设计的开源设计语言

    Impeccable 官方封面

    项目简介

    Impeccable 是由前 Google 开发者布道师 Paul Bakaus 开源的一套「让 AI 编码工具更擅长设计」的设计语言系统——它以 1 个 Skill + 23 个设计命令 + 60 条确定性检测规则 + 设计钩子的形式,接入 Claude Code、Cursor、Codex CLI、Gemini CLI、GitHub Copilot 等十余种 AI 编程工具,专治 AI 生成前端界面千篇一律的「AI 味」(Inter 字体、紫蓝渐变、卡片套卡片……)。项目 2025 年 11 月发布,目前已斩获 50,900+ Stars,今日仍在 GitHub 趋势榜上持续攀升。

    Impeccable GitHub 仓库卡片

    安装要求和过程

    环境要求

    • Node.js 环境(使用 npx 安装,无需全局依赖)
    • 任意受支持的 AI 编程工具:Claude Code、Cursor、Codex CLI、Gemini CLI、GitHub Copilot、OpenCode、Grok Build、Trae、Qoder 等 13+ 种
    • CLI 与浏览器扩展的检测器无需 API Key 即可运行

    快速安装

    # 方式一:CLI 一键安装(推荐,在项目根目录执行)
    npx impeccable install
    
    # 非交互式安装:指定工具与作用域
    npx impeccable install --providers=claude,cursor --scope=project
    
    # 更新到最新版本
    npx impeccable update
    
    # 方式二:作为 Claude Code 插件安装
    /plugin marketplace add pbakaus/impeccable
    
    # 方式三:Git Submodule 方式
    git submodule add https://github.com/pbakaus/impeccable .impeccable
    npx impeccable link --source=.impeccable --providers=claude,cursor

    安装后重载你的 AI 编程工具即可。首次使用建议先运行 /impeccable init,它会引导生成 PRODUCT.mdDESIGN.md,把品牌与产品设计上下文固化到项目里。

    核心功能

    • 23 个设计命令,给 AI 一套共享设计词汇/impeccable craft(完整设计流程)、critique(UX 审查)、audit(技术检查)、polish(发布前终检)、bolder/quieter(视觉强化/降噪)、animate(动效)、colorize(配色)、typeset(字体排印)等,覆盖从规划到打磨的全链路;
    • 60 条确定性「AI 味」检测规则:精准狙击 AI 生成界面的通病——默认 Inter/Arial 字体、紫蓝渐变、纯黑纯白灰、卡片嵌套卡片、弹跳缓动动画等,同时检查行宽、触控热区等通用可用性指标,规则引擎零 LLM、零 API 成本;
    • 设计钩子(Hooks)自动拦截:在 Claude Code、Copilot、Codex、Cursor、Grok Build 上写入代码时自动运行检测器,发现严重设计问题可直接阻断坏代码写入,把关口前移;
    • PRODUCT.md / DESIGN.md 上下文固化:通过 initdocument 命令把品牌调性、产品定位写成文档,让 AI 每次生成都带着你的设计基因而非「出厂默认审美」;
    • 独立 CLI + 实时浏览器迭代npx impeccable detect src/ 可脱离 AI 工具独立扫描目录/文件/URL(支持 --json 输出接入 CI),/impeccable live 支持在浏览器里对界面变体做可视化迭代。

    典型使用场景

    1. Vibe Coding 项目去「AI 味」:用 Claude Code/Cursor 快速搭出的产品原型总是长着一张「AI 脸」?安装后运行 /impeccable init + /impeccable craft landing,让落地页拥有独特的品牌气质,摆脱紫渐变 + Inter 字体的流水线审美;
    2. 发布前的设计质量门禁:在 CI 中挂上 npx impeccable detect --json .,60 条规则自动检查行宽、对比度、触控区、动效缓动等问题;配合 /impeccable polish 做上线终检,把设计审查从「靠感觉」变成「有清单」;
    3. 无设计师团队的 UX 自助审查:小团队没有专职设计师?/impeccable critique checkout 可对结账流程做启发式 UX 审查,/impeccable harden 补齐错误态与边界场景,相当于给团队配了一位 AI 设计顾问。

    推荐理由

    我把 Impeccable 装进 Claude Code 用了几天,最大的感受是:它治的不是「AI 不会写前端」,而是「AI 写的前端都长一个样」。以前让 AI 改设计只能反复喊「好看一点、高级一点」,现在有了 bolderquieterdistill 这样的精确词汇,沟通成本断崖式下降——这正是「给人和 AI 建立共享设计语言」的价值。60 条确定性规则不烧 token、不用 API Key,钩子还能在坏代码写入前直接拦截,工程化程度远超一般的提示词合集。项目基于 Anthropic 官方 frontend-design skill 扩展,作者 Paul Bakaus 是 jQuery UI 创始人之一,设计与工程功底都过硬。Apache-2.0 协议,13+ 种 AI 编程工具通吃,做 AI 辅助开发的前端同学强烈建议装上。

    下载地址

    项目信息:50,900+ Stars | 2,998 Forks | JavaScript | Apache-2.0 许可证

  • OpenSpec:为 AI 编程助手打造的规格驱动开发框架,写代码前先对齐需求

    OpenSpec:为 AI 编程助手打造的规格驱动开发框架,写代码前先对齐需求

    OpenSpec - Spec-Driven Development for AI Coding Assistants
    OpenSpec:为 AI 编程助手打造的规格驱动开发框架

    一、项目简介

    OpenSpec 是 Fission AI 开源的一款「规格驱动开发(Spec-Driven Development, SDD)」框架,核心理念是:在写任何一行代码之前,先让你和 AI 就「要做什么」达成一致。它为 AI 编程助手补上了一层轻量的规格层(spec layer),把原本只存在于聊天记录里的模糊需求,沉淀成结构化、可评审、可复用的 Markdown 规格文档。截至目前项目已在 GitHub 收获 62,500+ Stars,是当前最受欢迎的规格框架之一。

    二、安装要求与快速上手

    环境要求:Node.js 20.19.0 或更高版本(同时兼容 pnpm、yarn、bun、nix)。

    全局安装:

    npm install -g @fission-ai/openspec@latest

    初始化项目:进入你的项目目录并初始化,OpenSpec 会自动为你的 AI 助手写入配置。

    cd your-project
    openspec init

    开始与 AI 对话:直接在支持的编程助手中使用斜杠命令。

    # 还没想清楚要做什么?先探索,让 AI 读代码、权衡方案、成型计划
    /opsx:explore
    
    # 已经明确需求?直接提出变更提案
    /opsx:propose add-dark-mode
    
    # 提案通过后,逐条实施任务
    /opsx:apply
    
    # 完成后归档,规格自动更新
    /opsx:archive

    升级只需 npm install -g @fission-ai/openspec@latest,再在各项目内运行 openspec update 刷新 AI 指令即可。

    三、核心功能

    • 规格先行、代码后行:每个变更都会生成独立文件夹,包含 proposal.md(为什么做/改什么)、specs/(需求与场景)、design.md(技术方案)、tasks.md(实施清单),人和 AI 先对齐再动手。
    • 纯 Markdown、零学习成本:规格就是带具体场景(WHEN/THEN)的普通 Markdown,无需学习任何专用语法,AI 负责撰写、你负责评审。
    • 流式而非瀑布:任何产物随时可改,没有僵硬的阶段闸门(phase gates),支持从探索到实现的自由迭代。
    • 广泛的工具兼容:通过斜杠命令支持 25+(并持续增长)主流 AI 编程助手,包括 Claude Code、Codex、Cursor 等,不锁定任何 IDE 或模型。
    • 团队级 Stores(Beta):把规划放进独立仓库,通过 git push 共享,实现跨仓库特性、共享需求、代码未动先立规划——为多团队协作提供单一事实来源。
    OpenSpec Dashboard
    OpenSpec 内置仪表盘:可视化查看规格与进行中的变更

    四、典型使用场景

    • 为老项目做增量特性开发(Brownfield):OpenSpec 明确定位「不只是绿地项目」。在成熟代码库里加新功能时,用 /opsx:explore 让 AI 先读懂现有代码结构,再权衡最干净的实现路径,避免 AI 凭空乱改。
    • 个人开发者约束 AI「别跑偏」:单人开发时,规格层能让你和 AI 在单仓库上保持诚实——先评审计划再写代码,杜绝「模糊 prompt → 不可预测结果」的困境。
    • 企业团队跨仓库协作:一个特性横跨 API 服务、Web 前端和共享库时,用 Stores 把「一个变更、一份计划」共享给三个仓库;平台团队维护规格,产品团队只读引用,让每个编程 Agent 都能读到同一份需求,告别到处漂移的 Wiki。

    五、推荐理由

    体验下来,OpenSpec 最打动我的是它对「轻量」的坚持。同类的 GitHub Spec Kit 更全面但偏重——僵硬的阶段闸门、大量 Markdown、还要配 Python 环境;AWS 的 Kiro 很强却把你锁死在它的 IDE 和 Claude 模型上。OpenSpec 则用一条 npm install 就接入你已经在用的工具链,规格全是能随手改的纯 Markdown,真正做到了「有预测性但不繁文缛节」。

    官方建议搭配高推理能力的模型(如 Codex、Opus 系列)效果最佳,并注意保持干净的上下文窗口——实施前清理上下文,能显著提升产出质量。对于厌倦了「AI 一顿乱写、结果全靠运气」的开发者,OpenSpec 是一个成本极低、收益明显的习惯升级。MIT 许可,可放心用于商业项目。

    六、下载地址


    项目信息:Stars 62,500+ | Forks 4,325 | 主语言 TypeScript | 许可证 MIT | 首次发布 2025-08

  • Cline:跑在 VS Code、JetBrains 和终端里的开源 AI 编程 Agent(6.3万+ Star)

    Cline:跑在 VS Code、JetBrains 和终端里的开源 AI 编程 Agent(6.3万+ Star)

    Cline

    项目简介

    Cline 是完全开源、支持自带模型的 AI 编程智能体:它能在 VS Code、JetBrains 乃至命令行里帮你读写代码、运行终端、连接 MCP,并且每一步改动都以可审阅的 diff 呈现,让你随时把关。截至 2026 年中,项目已突破 6.3 万 Star、VS Code 安装量超 150 万,是开源 AI 编程赛道增长最快的扩展之一。

    安装要求和过程

    环境要求

    • Node.js 18+(CLI / SDK 形态需要)
    • VS Code 1.84+ 或任意 JetBrains IDE(2023.3+)
    • 一个 LLM API Key(Anthropic / OpenAI / Gemini / Bedrock / Groq / Ollama 本地模型等任意 OpenAI 兼容端点)
    • 可选:Docker(用于浏览器自动化沙箱)

    快速安装

    # 方式一:VS Code 扩展市场搜索 "Cline"(扩展 ID:saoudrizwan.claude-dev)一键安装
    # 方式二:JetBrains 插件市场安装 Cline 插件(IntelliJ / PyCharm / WebStorm / GoLand ...)
    
    # 方式三:命令行(交互式或 CI 无头模式)
    npm i -g cline
    
    # 方式四:嵌入自己的程序 / 集成
    npm install @cline/sdk

    所有形态都跑在同一个 Agent 内核(@cline/sdk)之上,在编辑器里搭好的工作流可无缝迁移到 CLI 与 SDK。

    核心功能

    1. Plan / Act 双模式:先用 Plan 模式探索代码库、提出方案并经你确认,再切到 Act 执行。这是 Cline 对”自动 Agent 自信地做错二十个文件”这一经典失败模式的答案——先规划、再行动,给你一个可在破坏发生前喊停的检查点。
    2. 全程可审阅的 Diff 与检查点:每一次文件改动都落成可审查的 diff;每个步骤都有检查点,可一键回滚到任意历史节点,远比”只能靠 git 历史兜底”的终端工具更可靠。
    3. 自带模型、零加价:填入自己的 API Key(Anthropic / OpenAI / Gemini / Bedrock / Groq / Ollama / LM Studio 或任意 OpenAI 兼容端点),直接付费给模型方,无中间商加价,模型随意切换。
    4. 浏览器自动化 + 终端执行:能导航 URL、截图、验证 UI 改动;在终端运行命令并实时响应输出,边干边盯 linter 与编译器报错。
    5. 完整 MCP 支持与 .clinerules:可接入数据库、API、设计工具等 100+ 现成 MCP server 扩展能力;并通过 .clinerules 文件让 Agent 遵守你的项目约定,而不是自创规范。

    典型使用场景

    • 想用 Cursor 级 Agent 能力却不想被订阅锁死:Cline 扩展本身免费,只为 LLM token 付费,模型可在 Anthropic / OpenAI / 本地 Ollama 之间自由切换。
    • 隐私要求严格的团队:直接接入本地 Ollama 模型,代码与上下文不出内网,满足合规需求。
    • 全栈开发验证 UI 改动:让 Cline 改完前端代码后自动开浏览器、截图、核对界面效果,把”改完—运行—看结果”的循环自动化。

    推荐理由

    我把 Cline 当作“带审批闸门的结对工程师”来用。和纯自动 Agent 相比,它每一步都先让你看 diff、看终端命令,再决定是否放行——这种”人在回路(human-in-the-loop)”的设计,把 AI 幻觉的破坏面压到了最低。再叠加自带模型、成本完全透明,以及 MCP 生态带来的近乎无限的扩展能力,Cline 几乎是 VS Code 生态里最值得长期持有的开源编程 Agent。如果你想在零订阅成本下获得接近 Cursor 的 Agentic 体验,它是不二之选。

    下载地址

  • Grok Build:xAI 开源的终端 AI 编码智能体(16.4K+ Stars)

    Grok Build:xAI 开源的终端 AI 编码智能体(16.4K+ Stars)

    Grok Build 终端 AI 编码智能体 TUI 界面

    项目简介

    Grok BuildxAI(SpaceXAI) 本周开源的一款终端型 AI 编码智能体(Coding Agent)。它以一个全屏 TUI 为载体,把代码库理解、文件编辑、Shell 执行、网络搜索、长任务管理整合在一个可扩展的 harness 里,并支持交互式、headless 脚本/CI 以及通过 ACP 嵌入编辑器三种运行模式。

    安装要求和过程

    环境要求

    • 使用预编译二进制:macOS / Linux / Windows 均可一键安装。
    • 从源码构建:需要 Rust 工具链(仓库中的 rust-toolchain.toml 会自动锁定版本)和 DotSlash(用于拉取 bin/protoc 等 hermetic 工具)。

    快速安装(推荐)

    macOS / Linux / Git Bash:

    curl -fsSL https://x.ai/cli/install.sh | bash
    grok --version

    Windows PowerShell:

    irm https://x.ai/cli/install.ps1 | iex

    从源码构建

    cargo install dotslash
    cargo build -p xai-grok-pager-bin --release

    构建产物为 target/release/xai-grok-pager,官方安装包会把它命名为 grok。首次启动会引导浏览器完成认证。

    核心功能

    • 全屏终端 TUI:类似编辑器体验的沉浸式界面,支持鼠标、快捷键、滚动历史与模态操作。
    • 代码库感知:自动索引项目文件,支持跨文件编辑、执行 Shell 命令、网络搜索与上下文召回。
    • 长任务管理:检查点、重试、会话保持,适合复杂重构、多步骤自动化与失败恢复。
    • ACP 协议支持:通过 Agent Client Protocol 把 grok 嵌入 VS Code、Cursor 或其他编辑器,保留现有工作流。
    • MCP 与 Skills:可接入 MCP 服务器、加载 Skills、插件与 hooks,扩展 Agent 的工具集。
    • 三模运行:交互式 TUI、headless 脚本/CI、嵌入式编辑器,覆盖从日常开发到自动化的全场景。

    Grok Build 核心功能

    典型使用场景

    场景一:大型代码重构

    在 TUI 中描述“把同步数据库调用改为异步”,Grok Build 会自动跨文件改代码、跑 cargo test、处理失败重试,并生成可审查的 diff;用户只需确认或拒绝,不会丢失当前会话。

    场景二:CI 自动修复流水线

    在 headless 模式下接入 GitHub Actions/GitLab CI,当测试失败时自动拉取日志、定位根因、提交补丁,让 Agent 在 CI 中承担“修复工程师”角色。

    场景三:编辑器增强

    通过 ACP 在 VS Code 或 Cursor 中直接调用 grok,既保留现有 IDE 的快捷键和文件树,又能随时让 Agent 接管复杂任务。

    推荐理由

    • xAI 官方出品:仓库与 SpaceXAI 内部 monorepo 周期性同步,代码质量和更新频率有保障。
    • 终端原住民的体验:全屏 TUI 比聊天框更贴近开发者终端习惯,鼠标交互也降低了学习成本。
    • 架构清晰、可扩展:Rust 实现,crate 拆分明确(TUI / shell / tools / workspace / MCP 等),便于二次开发。
    • 热度极高:开源 4 天内斩获 16,428+ Stars、3,000+ Forks,是近期 GitHub Trending 上增长最快的 AI 编码项目之一。

    下载地址

    如果你已经习惯 Claude Code、Codex CLI 或 Cursor Agent,Grok Build 提供了一个更“终端原生”且可扩展的替代方案,值得一试。