标签: AI编程

  • ECC:234K Stars 的 Agent Harness 操作系统,给 Claude Code / Codex / Cursor 装上完整工程化流程

    ECC:234K Stars 的 Agent Harness 操作系统,给 Claude Code / Codex / Cursor 装上完整工程化流程

    ECC - Agent Harness 性能优化系统

    项目简介

    ECC 是一套「Agent Harness(智能体框架)性能优化系统」——它不造轮子写新的 AI 编程工具,而是给你已经在用的 Claude Code、Codex、Cursor、OpenCode 等工具装上一整套工程化操作系统:281 个技能(Skills)、67 个专职智能体、运行时钩子(Hooks)、持久记忆、直觉学习(Instincts)与 AgentShield 安全扫描,让 AI 编程助手从”会写代码”升级为”按工程流程交付”。GitHub 上已狂揽 234,000+ Stars,是目前 Agent 增强类项目中的现象级存在,今日仍以每天近 700 星的速度增长。

    它的核心哲学一句话就能讲清:Optimize the context window. Persist everything else.(优化上下文窗口,持久化其余一切。)AI 不再需要你在每个提示词里重复”请先写测试””请做代码审查”,这些流程被固化为可安装、可复用的系统组件:

    plan -> test -> implement -> review -> verify -> remember -> improve

    ECC - the agent harness operating system

    安装要求和过程

    环境要求:

    • Node.js(钩子与脚本全部用 Node.js 编写,Windows / macOS / Linux 全平台支持)
    • 至少一个 AI 编程工具:Claude Code、Codex、Cursor、OpenCode、Gemini CLI、Zed、Kimi Code 等 12+ 种均有适配

    方式一:Claude Code 插件安装(推荐,最简单)——在 Claude Code 里输入两条命令即可:

    /plugin marketplace add https://github.com/affaan-m/ECC
    /plugin install ecc@ecc

    如需规则包(Rules),再手动拷贝你实际使用的语言包:

    git clone https://github.com/affaan-m/ECC.git
    cd ECC
    mkdir -p ~/.claude/rules/ecc
    cp -R rules/common ~/.claude/rules/ecc/
    cp -R rules/typescript ~/.claude/rules/ecc/  # 换成你的技术栈

    方式二:Codex 同步安装(先运行一次 Codex 生成配置):

    git clone https://github.com/affaan-m/ECC.git
    cd ECC
    npm install
    bash scripts/sync-ecc-to-codex.sh

    方式三:其他工具——克隆仓库后用安装脚本指定目标:

    ./install.sh --profile minimal --target cursor    # Cursor
    ./install.sh --profile minimal --target gemini    # Gemini CLI
    ./install.sh --profile minimal --target zed       # Zed
    # Windows 用 .\install.ps1

    ⚠️ 官方特别提醒:每个工具只选一种安装方式,不要叠加(如 Claude 插件 + 手动 full 安装会导致技能、命令重复);且只从官方渠道安装(GitHub 仓库 affaan-m/ECC、npm 包 ecc-universal / ecc-agentshield),第三方镜像可能含恶意代码。

    核心功能

    • 281 个技能 + 67 个专职智能体:覆盖 TDD、安全审查、深度研究、文档、前端、数据、ML、运维等场景。规划用 planner、审查用 code-reviewer、修构建用 build-error-resolver,各智能体拥有独立上下文与工具权限,互不污染。
    • 门禁化 TDD 工作流:”请使用 TDD”从一句模型可能遗忘的指令,变成带证据链的 RED → GREEN → REFACTOR 流程:先留存失败测试证据,再实现到通过,最后由全新上下文的审查者复查——写代码和审代码不再是同一个上下文。
    • Plan Canvas 计划画布(2.1 新特性):智能体写完计划后在本地浏览器画布中打开,你用鼠标点选段落、添加锚定批注、侧栏对话,最后一键”批准/要求修改”,结果直接映射回 /plan 的确认门。Mermaid 图实时渲染,任何模型任何工具都能驱动。
    • 统一记忆保险库(Memory Vault)ecc memory 让 Claude、Codex、Kimi 等不同工具共享同一份本地可检查的 Markdown 记忆格式,支持跨工具交接(handoff)——上午用 Claude Code 做的迁移方案,下午 Codex 直接检索接手。会话结束还能蒸馏成摘要、直觉(带置信度分数)和可复用技能。
    • AgentShield 安全扫描:把智能体配置本身当作攻击面来审计——扫描提示词、钩子、MCP 配置、权限与密钥泄露,npx -y ecc-agentshield scan --path . 免安装即可体检。

    典型使用场景

    场景一:新功能开发全流程。输入 /ecc:plan "添加 OAuth 用户认证",planner 生成实现蓝图并在 Plan Canvas 里供你批注确认;随后 tdd-workflow 技能强制先写失败测试再实现;完成后 /code-review 由全新上下文的审查智能体查漏。整个过程留下计划、失败测试、通过测试、审查发现、最终验证五份证据。

    场景二:上线前安全体检。/security-scan 做 OWASP Top 10 审计,e2e-testing 技能覆盖关键用户流,/test-coverage 验证 80%+ 覆盖率;再用 AgentShield 扫一遍智能体配置本身,防止 MCP 配置或钩子里埋雷。

    场景三:多工具团队协作。团队里有人用 Claude Code、有人用 Codex、有人用 Cursor——ECC 一次安装适配全部工具,规则与技能保持一致;Memory Vault 的 handoff 机制让不同工具间无缝交接任务上下文,告别复制粘贴聊天记录。

    推荐理由

    我用过不少 Agent 增强类项目,ECC 给我的感受是”体系完整度断层领先”。多数同类项目解决单点问题(提示词库、记忆、或钩子),而 ECC 把技能、智能体、规则、钩子、记忆、直觉六层职责切分得非常清楚——技能按需加载、规则常驻精选、钩子跑在模型上下文之外,这套设计真正做到了”加能力不加上下文负担”。234K Stars 和 35K+ Forks 不是刷出来的:单一维护者每周横跨 7 个 Harness 发版,社区有 Discord、GitHub App 和 12 种语言的 README。最打动我的是它对”证据”的执念:一次交付不只是代码,而是计划、失败测试、通过测试、审查发现和验证记录组成的完整证据链——这正是 AI 编程从玩具走向生产的分水岭。项目 MIT 许可永久免费,托管版 ECC Pro 仅面向私有仓库收费,商业模式清晰不绑架用户。如果你每天在用 Claude Code 或 Codex,这可能是今年最值得装的一个增强系统。

    下载地址

    项目信息:⭐ 234,797 Stars · 🍴 35,776 Forks · 语言:JavaScript/TypeScript/Shell · 许可证:MIT · 创建于 2026 年 1 月,持续高频更新中。

  • Cognition花九位数买下Poke:AI的性格开始比模型还值钱

    Poke是个你可以像给朋友发短信一样聊天的AI助手,现在它被卖掉了。买家是做AI编程的Cognition——就是Devin背后那家公司。交易金额没有精确披露,但Poke母公司The Interaction Company of California的联合创始人Marvin von Hagen向TechCrunch确认了估值区间:”低九位数”,也就是一到三亿美元这个档。

    Poke AI助手被Cognition收购
    像发短信一样用的 AI 助手 Poke(图源:Poke / The Interaction Company)

    这笔收购的逻辑有点反常识:一家写代码的公司,花九位数买的不是什么模型或者算法,而是”性格”。Poke最出圈的地方就是它不像个工具——它回消息像朋友,会用俚语、会开玩笑、还会主动找你。Cognition想把这套交互模式和人格移植到Devin身上,让自家的编程智能体不再像一个冷冰冰的软件。

    von Hagen的原话很直白:”你大概更喜欢有性格的同事,而不是一群机器人同事。如果你的同事也是软件工程师,他们还能讲个笑话,你会觉得有趣。”

    用户很多,钱很难赚

    Poke今年3月才正式上线,支持iMessage、短信、Telegram,部分市场还能用WhatsApp。用户拿它订行程、管邮件、设提醒、记待办,过去三个月平台上跑了超过1亿条消息,用户数有几十万。6月它还拿下一个头衔:第一个被批准入驻苹果Messages for Business平台的AI智能体。

    但热闹背后,von Hagen也承认,Poke的运行成本太高,靠自己很难盈利。这次卖身其实是各取所需——Poke拿到Cognition的模型和基础设施,变得更快更稳定;Cognition拿到一套用户真心喜欢的交互层。Cognition联合创始人Scott Wu在博客里写道:”Interaction团队做出了一个大家真正喜爱的智能体:它主动、懂你、聊起来有意思。和Devin协作就应该是这种感觉。”顺便说一句,Scott Wu和另一位联创Walden Yan早就是Poke的天使投资人,这买卖多少有点近水楼台。


    Poke指挥Devin干活,才是真正的想象空间

    短期内什么都不变:Poke年内照常运营,也继续留在苹果平台上。变化在明年——两边会开始互相渗透:

    • Poke的部分任务会切到Cognition最新的软件工程模型SWE-1.7上;
    • Devin现在一次只能处理一个PR,未来可以让Poke同时调度多个Devin会话并行干活;
    • Poke还能帮Devin跨会话记住任务,变成一个”有记忆的长期同事”;
    • 两个产品彻底合并的可能性,官方也没有排除。

    这笔交易背后是一个正在成形的行业判断:模型能力在快速拉平,AI助手怎么跟人打交道,正在变得和底层模型一样值钱。当每家的智能体都会写代码的时候,谁更像个活人,谁就多一分胜算。

  • Oh My OpenAgent:66.7K Stars 的 AI 编程智能体”满配套件”,一个词启动 11 个智能体并行开发

    Oh My OpenAgent:66.7K Stars 的 AI 编程智能体”满配套件”,一个词启动 11 个智能体并行开发

    Oh My OpenAgent

    项目简介

    Oh My OpenAgent(OmO)是韩国开发者 code-yeongyu 开源的「AI 编程智能体增强套件(Agent Harness)」——一句话概括:给 OpenCode / Codex CLI 装上一个”满配的 AI 开发团队”,装完只需输入 ultrawork 一个词,11 个专职智能体、54+ 生命周期钩子、5 个内置 MCP 就会自动协同,把复杂任务一路干到完成为止。项目目前已收获 66,693 Stars,甚至因为太火导致 Anthropic 封锁了 OpenCode 的 Claude 订阅接入——作者干脆转身拥抱多模型路由,主打”不要选赢家,要编排所有模型”。

    Oh My OpenAgent Team Mode 运行界面

    ▲ Team Mode 实战:Kimi K3 + GPT-5.6 Sol 多智能体并行工作

    安装要求和过程

    环境要求

    • Ultimate 版(OpenCode):需安装 Bun 与 OpenCode
    • Light 版(Codex CLI):仅需 Node.js/npm 环境,无需 Bun
    • 至少一个模型订阅或 API(推荐组合:ChatGPT $20 / Kimi Code $19 / GLM Coding $10,低成本即可跑满血)

    快速安装

    # Ultimate 版(OpenCode 完整体:11 智能体 + Team Mode + 全部功能)
    bunx oh-my-openagent install
    
    # Light 版(Codex CLI 插件:rules/LSP/ultrawork/ulw-loop 等便携组件)
    npx lazycodex-ai install
    # 非交互推荐模式
    npx lazycodex-ai install --no-tui --codex-autonomous
    
    # 两个都装
    bunx oh-my-openagent install --platform=both

    官方还推荐一种更省心的方式——直接把安装指南 URL 扔给任意 AI 助手(Claude Code、Cursor 等),让 AI 替你完成订阅检测、11 个智能体的模型匹配和各家 Provider 认证:

    Install and configure oh-my-openagent by following the instructions here:
    https://raw.githubusercontent.com/code-yeongyu/oh-my-openagent/refs/heads/dev/docs/guide/installation.md

    注意:npm 包与 CLI 命令仍叫 oh-my-opencode(更名过渡期双发布),但不要用 npx omo——那是另一个同名无关包。

    核心功能

    • ultrawork 一词流:输入 ultrawork(或 ulw)即激活全部智能体,配合 Todo Enforcer”偷懒检测”,智能体一旦闲置就被系统拽回来继续干,任务不完成不停手。
    • 纪律型智能体团队:主指挥 Sisyphus(Opus 5 / Kimi K3)负责规划与并行派活;深度工人 Hephaestus(GPT-5.6 Sol)端到端自主执行;规划师 Prometheus 以”面试模式”先访谈再出方案,另有 Oracle(架构/调试)、Librarian(文档检索)、Explore(快速扫码)各司其职。
    • Team Mode 多智能体系统(v4.0):Lead + 最多 8 个并行成员,tmux 实时可视化,衍生 hyperplan(5 个”敌对评审”轮番拆解你的方案)与 security-research(3 个漏洞猎手 + 2 个 PoC 工程师并行审计)两大技能。
    • Hashline 哈希锚定编辑:每行代码带内容哈希标签(11#VK|),编辑前校验、文件变了就拒绝写入,从根源消灭”stale line”错误——Grok Code Fast 1 的编辑成功率靠它从 6.7% 飙到 68.3%。
    • 按类别自动路由模型:子任务只声明类别(visual-engineering / deep / quick / ultrabrain),框架自动匹配最擅长的模型;同时完全兼容 Claude Code 的 hooks、commands、skills、MCP 与插件生态。

    典型使用场景

    • 大规模代码翻新:有用户用它一天清掉 8000 条 ESLint 警告;还有人一夜之间把 4.5 万行的 Tauri 桌面应用改造成 SaaS 网页应用——睡前下指令,醒来验收。
    • 多订阅省钱组合拳:不必为单一厂商付 $200/月,用 Kimi K3 + GPT-5.6 Sol 的平价组合即可超越原版 Claude Code 体验,模型按任务类别自动分工。
    • 方案评审与安全审计:写代码前先跑 hyperplan 让 5 个”杠精”智能体从不同角度挑刺;上线前用 security-research 让 5 个智能体并行做渗透式代码审计,按真实可利用性定级。

    推荐理由

    这是我见过”工程密度”最高的 Agent Harness 项目。它不是又一个 prompt 合集,而是把作者烧掉 2.4 万美元 token 试错换来的经验固化成了产品:Hashline 编辑工具解决的是所有编码智能体最痛的”改错行”问题;类别路由让”选模型”这件事彻底消失;Todo Enforcer 治好了 AI”干一半就摆烂”的顽疾。社区口碑也相当能打——”让我退订了 Cursor””用了就回不去了”。如果你已经在用 OpenCode 或 Codex CLI,这基本是无脑必装的存在;哪怕只是想围观多智能体协作的工程实践,读它的源码和文档也极有收获。唯一注意点:License 为 SUL-1.0(Sisyphus 使用许可),商用前建议先读一下条款,且默认开启匿名遥测(可通过 OMO_DISABLE_POSTHOG=1 关闭)。

    下载地址

    项目数据:66,693 Stars | 语言:TypeScript | License:SUL-1.0 | 最近更新:2026-07-28

  • 被SpaceX收购前夕,Cursor在印度干了件大事:月费7美元

    还有几周,SpaceX对Cursor那笔600亿美元的全股票收购就要正式交割了。就在这个节骨眼上,Cursor没闲着,反而在印度放了个大招——推出史上第一个针对单一国家定制的订阅套餐。

    Cursor AI编程工具
    Cursor推出印度专属订阅Cursor Start(图源:TechCrunch)

    649卢比,约等于一顿外卖钱

    这个新套餐叫Cursor Start,周一上线,每月649卢比,折合大约7美元——只有标准版Pro订阅(20美元/月)的三分之一。里面包含Cursor自家的Composer 2.5模型和Grok 4.5,用量上限比免费版高不少,云端智能体、iOS应用、插件、MCP支持、hooks和skills也都有。

    当然,便宜有便宜的道理。Start版不带OpenAI和Anthropic的前沿模型,Bugbot、Auto Mode、自动化和Cursor SDK这些高级功能也被砍掉了。Cursor亚太及日本区负责人Simon Green说得直白:这个套餐是给那些”免费版不够用、但又没必要上Pro”的开发者准备的,不是要取代旗舰产品。

    印度已经是Cursor全球第三大市场,重度用户浓度全球最高,过去一年用户数翻了三倍还多。

    为什么是印度

    数字摆在那里。GitHub今年早些时候公布,印度平台开发者超过2700万,仅次于美国,光2026年就新增了200多万。Green的原话是:”这个国家的技术素养和现成的工程人才,让它成为一个非常自然的选择。”

    套餐用卢比结算,支持信用卡、借记卡和印度本地的UPI支付。为了防止其他地区用户薅羊毛,Cursor会用多重校验确认订阅者确实身在印度,连VPN绕道都做了防范。Green还强调,这个价格不是赔本赚吆喝——因为Start版跑的是Cursor自家模型,运营成本比调用第三方前沿模型低得多,商业上算得过账。

    这条路其实有人趟过。OpenAI当年就是先在印度推出了不到5美元的ChatGPT Go,跑通之后才扩展到亚洲另外16个国家。Anthropic本月也刚给印度上线了本地化定价的Claude套餐。Green没把话说死:”如果这个模式被验证有效,也许我们会带到其他市场。说永远不会在别处做,那才是疯了。”


    SpaceX的星链,可能成为意外助攻

    • Cursor刚在印度招了第一位销售,德里还会再来一位负责人;
    • 政府事务办公室正在筹建,另加三名技术支持岗位;
    • 班加罗尔、金奈、海得拉巴、孟买四城同步扩张;
    • 企业级市场刚起步,银行和大型企业被视为重点方向。

    收购预计三季度完成,在那之前Cursor保持独立运营。不过Green透露了一个有意思的细节:交割之后,SpaceX靠星链在印度攒下的商业和运营基础,可能帮Cursor把扩张速度再提一档。一家造火箭的公司,给一个写代码的工具铺路,这画面放在两年前没人敢想。

  • Impeccable:50.9K Stars!专治AI生成界面的「AI味」,让Claude Code、Cursor真正懂设计的开源设计语言

    Impeccable:50.9K Stars!专治AI生成界面的「AI味」,让Claude Code、Cursor真正懂设计的开源设计语言

    Impeccable 官方封面

    项目简介

    Impeccable 是由前 Google 开发者布道师 Paul Bakaus 开源的一套「让 AI 编码工具更擅长设计」的设计语言系统——它以 1 个 Skill + 23 个设计命令 + 60 条确定性检测规则 + 设计钩子的形式,接入 Claude Code、Cursor、Codex CLI、Gemini CLI、GitHub Copilot 等十余种 AI 编程工具,专治 AI 生成前端界面千篇一律的「AI 味」(Inter 字体、紫蓝渐变、卡片套卡片……)。项目 2025 年 11 月发布,目前已斩获 50,900+ Stars,今日仍在 GitHub 趋势榜上持续攀升。

    Impeccable GitHub 仓库卡片

    安装要求和过程

    环境要求

    • Node.js 环境(使用 npx 安装,无需全局依赖)
    • 任意受支持的 AI 编程工具:Claude Code、Cursor、Codex CLI、Gemini CLI、GitHub Copilot、OpenCode、Grok Build、Trae、Qoder 等 13+ 种
    • CLI 与浏览器扩展的检测器无需 API Key 即可运行

    快速安装

    # 方式一:CLI 一键安装(推荐,在项目根目录执行)
    npx impeccable install
    
    # 非交互式安装:指定工具与作用域
    npx impeccable install --providers=claude,cursor --scope=project
    
    # 更新到最新版本
    npx impeccable update
    
    # 方式二:作为 Claude Code 插件安装
    /plugin marketplace add pbakaus/impeccable
    
    # 方式三:Git Submodule 方式
    git submodule add https://github.com/pbakaus/impeccable .impeccable
    npx impeccable link --source=.impeccable --providers=claude,cursor

    安装后重载你的 AI 编程工具即可。首次使用建议先运行 /impeccable init,它会引导生成 PRODUCT.mdDESIGN.md,把品牌与产品设计上下文固化到项目里。

    核心功能

    • 23 个设计命令,给 AI 一套共享设计词汇/impeccable craft(完整设计流程)、critique(UX 审查)、audit(技术检查)、polish(发布前终检)、bolder/quieter(视觉强化/降噪)、animate(动效)、colorize(配色)、typeset(字体排印)等,覆盖从规划到打磨的全链路;
    • 60 条确定性「AI 味」检测规则:精准狙击 AI 生成界面的通病——默认 Inter/Arial 字体、紫蓝渐变、纯黑纯白灰、卡片嵌套卡片、弹跳缓动动画等,同时检查行宽、触控热区等通用可用性指标,规则引擎零 LLM、零 API 成本;
    • 设计钩子(Hooks)自动拦截:在 Claude Code、Copilot、Codex、Cursor、Grok Build 上写入代码时自动运行检测器,发现严重设计问题可直接阻断坏代码写入,把关口前移;
    • PRODUCT.md / DESIGN.md 上下文固化:通过 initdocument 命令把品牌调性、产品定位写成文档,让 AI 每次生成都带着你的设计基因而非「出厂默认审美」;
    • 独立 CLI + 实时浏览器迭代npx impeccable detect src/ 可脱离 AI 工具独立扫描目录/文件/URL(支持 --json 输出接入 CI),/impeccable live 支持在浏览器里对界面变体做可视化迭代。

    典型使用场景

    1. Vibe Coding 项目去「AI 味」:用 Claude Code/Cursor 快速搭出的产品原型总是长着一张「AI 脸」?安装后运行 /impeccable init + /impeccable craft landing,让落地页拥有独特的品牌气质,摆脱紫渐变 + Inter 字体的流水线审美;
    2. 发布前的设计质量门禁:在 CI 中挂上 npx impeccable detect --json .,60 条规则自动检查行宽、对比度、触控区、动效缓动等问题;配合 /impeccable polish 做上线终检,把设计审查从「靠感觉」变成「有清单」;
    3. 无设计师团队的 UX 自助审查:小团队没有专职设计师?/impeccable critique checkout 可对结账流程做启发式 UX 审查,/impeccable harden 补齐错误态与边界场景,相当于给团队配了一位 AI 设计顾问。

    推荐理由

    我把 Impeccable 装进 Claude Code 用了几天,最大的感受是:它治的不是「AI 不会写前端」,而是「AI 写的前端都长一个样」。以前让 AI 改设计只能反复喊「好看一点、高级一点」,现在有了 bolderquieterdistill 这样的精确词汇,沟通成本断崖式下降——这正是「给人和 AI 建立共享设计语言」的价值。60 条确定性规则不烧 token、不用 API Key,钩子还能在坏代码写入前直接拦截,工程化程度远超一般的提示词合集。项目基于 Anthropic 官方 frontend-design skill 扩展,作者 Paul Bakaus 是 jQuery UI 创始人之一,设计与工程功底都过硬。Apache-2.0 协议,13+ 种 AI 编程工具通吃,做 AI 辅助开发的前端同学强烈建议装上。

    下载地址

    项目信息:50,900+ Stars | 2,998 Forks | JavaScript | Apache-2.0 许可证

  • OpenSpec:为 AI 编程助手打造的规格驱动开发框架,写代码前先对齐需求

    OpenSpec:为 AI 编程助手打造的规格驱动开发框架,写代码前先对齐需求

    OpenSpec - Spec-Driven Development for AI Coding Assistants
    OpenSpec:为 AI 编程助手打造的规格驱动开发框架

    一、项目简介

    OpenSpec 是 Fission AI 开源的一款「规格驱动开发(Spec-Driven Development, SDD)」框架,核心理念是:在写任何一行代码之前,先让你和 AI 就「要做什么」达成一致。它为 AI 编程助手补上了一层轻量的规格层(spec layer),把原本只存在于聊天记录里的模糊需求,沉淀成结构化、可评审、可复用的 Markdown 规格文档。截至目前项目已在 GitHub 收获 62,500+ Stars,是当前最受欢迎的规格框架之一。

    二、安装要求与快速上手

    环境要求:Node.js 20.19.0 或更高版本(同时兼容 pnpm、yarn、bun、nix)。

    全局安装:

    npm install -g @fission-ai/openspec@latest

    初始化项目:进入你的项目目录并初始化,OpenSpec 会自动为你的 AI 助手写入配置。

    cd your-project
    openspec init

    开始与 AI 对话:直接在支持的编程助手中使用斜杠命令。

    # 还没想清楚要做什么?先探索,让 AI 读代码、权衡方案、成型计划
    /opsx:explore
    
    # 已经明确需求?直接提出变更提案
    /opsx:propose add-dark-mode
    
    # 提案通过后,逐条实施任务
    /opsx:apply
    
    # 完成后归档,规格自动更新
    /opsx:archive

    升级只需 npm install -g @fission-ai/openspec@latest,再在各项目内运行 openspec update 刷新 AI 指令即可。

    三、核心功能

    • 规格先行、代码后行:每个变更都会生成独立文件夹,包含 proposal.md(为什么做/改什么)、specs/(需求与场景)、design.md(技术方案)、tasks.md(实施清单),人和 AI 先对齐再动手。
    • 纯 Markdown、零学习成本:规格就是带具体场景(WHEN/THEN)的普通 Markdown,无需学习任何专用语法,AI 负责撰写、你负责评审。
    • 流式而非瀑布:任何产物随时可改,没有僵硬的阶段闸门(phase gates),支持从探索到实现的自由迭代。
    • 广泛的工具兼容:通过斜杠命令支持 25+(并持续增长)主流 AI 编程助手,包括 Claude Code、Codex、Cursor 等,不锁定任何 IDE 或模型。
    • 团队级 Stores(Beta):把规划放进独立仓库,通过 git push 共享,实现跨仓库特性、共享需求、代码未动先立规划——为多团队协作提供单一事实来源。
    OpenSpec Dashboard
    OpenSpec 内置仪表盘:可视化查看规格与进行中的变更

    四、典型使用场景

    • 为老项目做增量特性开发(Brownfield):OpenSpec 明确定位「不只是绿地项目」。在成熟代码库里加新功能时,用 /opsx:explore 让 AI 先读懂现有代码结构,再权衡最干净的实现路径,避免 AI 凭空乱改。
    • 个人开发者约束 AI「别跑偏」:单人开发时,规格层能让你和 AI 在单仓库上保持诚实——先评审计划再写代码,杜绝「模糊 prompt → 不可预测结果」的困境。
    • 企业团队跨仓库协作:一个特性横跨 API 服务、Web 前端和共享库时,用 Stores 把「一个变更、一份计划」共享给三个仓库;平台团队维护规格,产品团队只读引用,让每个编程 Agent 都能读到同一份需求,告别到处漂移的 Wiki。

    五、推荐理由

    体验下来,OpenSpec 最打动我的是它对「轻量」的坚持。同类的 GitHub Spec Kit 更全面但偏重——僵硬的阶段闸门、大量 Markdown、还要配 Python 环境;AWS 的 Kiro 很强却把你锁死在它的 IDE 和 Claude 模型上。OpenSpec 则用一条 npm install 就接入你已经在用的工具链,规格全是能随手改的纯 Markdown,真正做到了「有预测性但不繁文缛节」。

    官方建议搭配高推理能力的模型(如 Codex、Opus 系列)效果最佳,并注意保持干净的上下文窗口——实施前清理上下文,能显著提升产出质量。对于厌倦了「AI 一顿乱写、结果全靠运气」的开发者,OpenSpec 是一个成本极低、收益明显的习惯升级。MIT 许可,可放心用于商业项目。

    六、下载地址


    项目信息:Stars 62,500+ | Forks 4,325 | 主语言 TypeScript | 许可证 MIT | 首次发布 2025-08

  • Cognition花上亿美元买下Poke,赌的是AI会不会“说人话”

    写代码的AI工具Cognition又出手了,这次买下的不是什么技术公司,而是一个”会跟你贫嘴”的聊天助手Poke。交易金额官方说法是”低九位数”,也就是一亿多美元的量级。Poke背后的公司叫The Interaction Company of California,接下来它的那套交互方式和”性格”会被塞进Cognition的编程助手Devin里。

    Poke AI助手界面
    Poke:一个你可以像发短信给朋友一样使用的AI助手(图片来源:Poke / The Interaction Company of California)

    Poke最有意思的地方,也正是Cognition看上它的原因:它不像个工具,更像个人。你给它发消息,它会用俚语、带点幽默地回你,聊天感很强,而不是冷冰冰地执行命令。反过来,Poke也能借上Cognition的模型和基础设施,跑得更快更稳。

    为什么”有性格”值这么多钱

    Interaction Company的联合创始人Marvin von Hagen在接受TechCrunch采访时,把这笔账算得挺直白。他说的大意是,谁不喜欢有点脾气、能聊得来的同事呢,总比对着一堆机器人强。如果你的同事本身就是软件工程师,还能开个玩笑,你会觉得这活儿干得舒服多了。

    这笔收购背后是一个越来越被认同的判断:AI助手怎么跟人打交道,正变得和它底层的模型一样值钱。Cognition想让Devin少一点”软件味儿”,多一点”同事感”。

    Cognition联合创始人Scott Wu在博客里写道,Interaction团队做出了一个大家真心喜欢的智能体——它主动、懂你、还聊得来,而这正是跟Devin协作时该有的感觉。他还提到,自己和另一位联合创始人Walden Yan早就以天使投资人的身份投过Poke背后的公司。

    Poke这一路走过来

    Poke是2026年3月才上线的,最大的特点是你可以直接在自己惯用的消息App里跟它对话——iMessage、短信、Telegram,部分地区还支持WhatsApp。用户拿它干各种事,旅行、健康、理财、日程、学习都有人用。von Hagen说,最常见的还是管邮件、设提醒、列待办这类效率活儿。

    • 过去三个月,Poke上用户来回发了超过1亿条消息
    • 用户数已经有几十万,但跑起来太烧钱,一直难盈利
    • 今年6月,它成了苹果Messages for Business平台上第一个获批的AI智能体

    接下来两边怎么玩

    短期内Poke不会有大变化,今年年底前照旧运营,也会继续留在苹果的平台上。真正的动作要等明年——Poke的部分任务会改用Cognition最新的编程模型SWE-1.7,两个产品彻底合并也没被排除掉。

    von Hagen设想的画面是这样的:长远看,Poke可以负责调度那些编程任务,而Devin会变得越来越像Poke。他举了个例子,现在Devin一次只能处理一个PR(代码合并请求),如果让Poke来协调多个Devin会话,价值就出来了。更进一步,Poke还能帮Devin跨会话记住任务。用他的话说,有个”记性好又常在身边的同事”,挺好。

  • Open Code Review:阿里巴巴开源的 AI 代码评审 CLI,Token 只用 1/9 却更精准

    Open Code Review:阿里巴巴开源的 AI 代码评审 CLI,Token 只用 1/9 却更精准

    如果你用过 Claude Code 之类的通用 Agent 做代码评审,大概率遇到过这些坑:改动一多就”偷工减料”只看部分文件、报出来的问题行号对不上、换个提示词质量就飘。Open Code Review(OCR) 是阿里巴巴刚开源的一款 AI 代码评审命令行工具,它把”确定性工程”和”Agent 动态决策”拧在一起,专门解决这些问题。项目上线不久便冲上 GitHub Trending,目前已收获约 12.2K Stars

    Open Code Review 功能亮点
    Open Code Review 功能亮点(图片来源:项目 README)

    一句话简介

    Open Code Review 是阿里巴巴开源的 AI 代码评审 CLI 工具——读取 Git diff,交给可配置的大模型 Agent 进行带工具调用的深度评审,产出行级精准的结构化评审意见。它源自阿里内部使用两年、服务数万开发者、累计发现数百万代码缺陷的官方评审助手,经大规模验证后开源。

    安装要求与快速上手

    环境要求

    • Git ≥ 2.41:OCR 依赖 Git 生成 diff、检索代码与仓库操作。
    • 支持 Windows / macOS / Linux 三大平台;需要配置一个大模型接口(OpenAI / Anthropic 兼容即可),或使用”委托模式”无需配模型。

    安装(npm 全局安装)

    npm install -g @alibaba-group/open-code-review

    安装完成后,全局即可使用 ocr 命令。也支持安装脚本、GitHub Release 二进制、源码编译等方式。

    配置模型

    # 选择内置服务商或添加自定义服务商
    ocr config provider
    # 为当前服务商选择模型
    ocr config model

    交互式界面会引导你完成服务商选择、API Key 填写与模型配置,并自动测试连通性。

    模型配置界面
    交互式模型配置界面(图片来源:项目 README)

    开始评审

    cd your-project
    
    # 工作区模式:评审所有暂存/未暂存/未跟踪的改动
    ocr review
    
    # 分支范围:对比两个 ref
    ocr review --from main --to feature-branch
    
    # 单个 commit
    ocr review --commit abc123
    
    # 整文件扫描:不看 diff,直接审阅整个仓库或指定目录
    ocr scan
    ocr scan --path internal/agent

    核心功能

    • 确定性工程 × Agent 混合架构:对”绝不能出错”的评审步骤(选文件、匹配规则、定位行号)用工程逻辑硬约束保证正确,把动态决策与上下文检索交给 Agent,各司其职。
    • 精准选文件 + 智能打包:明确判定哪些文件需评审、哪些应过滤;把关联文件(如中英两份 message 属性文件)打包为一个评审单元,每包作为隔离上下文的子 Agent 并发运行,在超大改动集上依然稳定。
    • 行级精准定位 + 反思模块:独立的评论定位与评论反思模块,系统性提升 AI 反馈的位置准确度与内容准确度,避免”行号漂移”。
    • diff 评审 + 整文件扫描ocr review 审阅改动,ocr scan 审阅整份文件——适合审计陌生代码库或没有有意义 diff 的目录。
    • 丰富集成能力:内置 MCP Server 扩展工具、CI/CD 集成(GitHub Actions / GitLab CI / Gerrit 等),并可作为 Skill 或插件接入 Claude Code、Codex、Cursor;浏览器端 Session Viewer 可回放评审过程。

    性能基准

    官方基于 50 个热门开源仓库、200 个真实 PR、10 种编程语言构建了真实世界评审基准,由 80+ 资深工程师交叉标注出 1505 个基准问题。结果显示:在同一底座模型下,OCR 的 准确率(Precision)与 F1 显著更高,而 Token 消耗仅约通用 Agent 的 1/9、评审更快;召回率略低,是”以精度换噪声”的有意取舍。

    性能基准对比
    在同一底座模型下的基准表现概览

    典型使用场景

    • 提交前自检:在本地 ocr review 一把,把行级问题在推送前就修掉,减少来回改 PR 的成本。
    • CI 流水线自动评审:接入 GitHub Actions / GitLab CI,对每个 PR 自动评审并留下行级评论,低 Token 成本让团队大规模跑得起。
    • 审计陌生代码库:接手老项目或第三方代码时用 ocr scan 整文件扫描,快速摸清 NPE、线程安全、XSS、SQL 注入等隐患。

    推荐理由

    市面上”给 Agent 套个 Skill 就当代码评审”的方案不少,但真正在工程上把稳定性做扎实的不多。OCR 最打动我的一点,是它没有一味迷信大模型,而是把”该确定的地方交给工程、该灵活的地方交给 Agent”这条边界划得很清楚——这正是它能在阿里内部大规模跑两年、且在基准上只花约 1/9 Token 就拿到更高精度的原因。对追求 CI 成本可控、又不想被误报刷屏的团队来说,这是个值得一试的选择。它还内置了针对 NPE、线程安全、XSS、SQL 注入等常见缺陷的微调规则集,开箱即用。

    下载地址

  • Cline:跑在 VS Code、JetBrains 和终端里的开源 AI 编程 Agent(6.3万+ Star)

    Cline:跑在 VS Code、JetBrains 和终端里的开源 AI 编程 Agent(6.3万+ Star)

    Cline

    项目简介

    Cline 是完全开源、支持自带模型的 AI 编程智能体:它能在 VS Code、JetBrains 乃至命令行里帮你读写代码、运行终端、连接 MCP,并且每一步改动都以可审阅的 diff 呈现,让你随时把关。截至 2026 年中,项目已突破 6.3 万 Star、VS Code 安装量超 150 万,是开源 AI 编程赛道增长最快的扩展之一。

    安装要求和过程

    环境要求

    • Node.js 18+(CLI / SDK 形态需要)
    • VS Code 1.84+ 或任意 JetBrains IDE(2023.3+)
    • 一个 LLM API Key(Anthropic / OpenAI / Gemini / Bedrock / Groq / Ollama 本地模型等任意 OpenAI 兼容端点)
    • 可选:Docker(用于浏览器自动化沙箱)

    快速安装

    # 方式一:VS Code 扩展市场搜索 "Cline"(扩展 ID:saoudrizwan.claude-dev)一键安装
    # 方式二:JetBrains 插件市场安装 Cline 插件(IntelliJ / PyCharm / WebStorm / GoLand ...)
    
    # 方式三:命令行(交互式或 CI 无头模式)
    npm i -g cline
    
    # 方式四:嵌入自己的程序 / 集成
    npm install @cline/sdk

    所有形态都跑在同一个 Agent 内核(@cline/sdk)之上,在编辑器里搭好的工作流可无缝迁移到 CLI 与 SDK。

    核心功能

    1. Plan / Act 双模式:先用 Plan 模式探索代码库、提出方案并经你确认,再切到 Act 执行。这是 Cline 对”自动 Agent 自信地做错二十个文件”这一经典失败模式的答案——先规划、再行动,给你一个可在破坏发生前喊停的检查点。
    2. 全程可审阅的 Diff 与检查点:每一次文件改动都落成可审查的 diff;每个步骤都有检查点,可一键回滚到任意历史节点,远比”只能靠 git 历史兜底”的终端工具更可靠。
    3. 自带模型、零加价:填入自己的 API Key(Anthropic / OpenAI / Gemini / Bedrock / Groq / Ollama / LM Studio 或任意 OpenAI 兼容端点),直接付费给模型方,无中间商加价,模型随意切换。
    4. 浏览器自动化 + 终端执行:能导航 URL、截图、验证 UI 改动;在终端运行命令并实时响应输出,边干边盯 linter 与编译器报错。
    5. 完整 MCP 支持与 .clinerules:可接入数据库、API、设计工具等 100+ 现成 MCP server 扩展能力;并通过 .clinerules 文件让 Agent 遵守你的项目约定,而不是自创规范。

    典型使用场景

    • 想用 Cursor 级 Agent 能力却不想被订阅锁死:Cline 扩展本身免费,只为 LLM token 付费,模型可在 Anthropic / OpenAI / 本地 Ollama 之间自由切换。
    • 隐私要求严格的团队:直接接入本地 Ollama 模型,代码与上下文不出内网,满足合规需求。
    • 全栈开发验证 UI 改动:让 Cline 改完前端代码后自动开浏览器、截图、核对界面效果,把”改完—运行—看结果”的循环自动化。

    推荐理由

    我把 Cline 当作“带审批闸门的结对工程师”来用。和纯自动 Agent 相比,它每一步都先让你看 diff、看终端命令,再决定是否放行——这种”人在回路(human-in-the-loop)”的设计,把 AI 幻觉的破坏面压到了最低。再叠加自带模型、成本完全透明,以及 MCP 生态带来的近乎无限的扩展能力,Cline 几乎是 VS Code 生态里最值得长期持有的开源编程 Agent。如果你想在零订阅成本下获得接近 Cursor 的 Agentic 体验,它是不二之选。

    下载地址

  • Archon:把 AI 编码变成确定性工作流的开源 harness 构建器

    Archon:把 AI 编码变成确定性工作流的开源 harness 构建器

    Archon 封面

    Archon logo

    项目简介

    Archon 是首个开源的 AI 编码 harness(流程编排)构建器——用 YAML 把“规划→实现→校验→审查→提 PR”等开发流程固化下来,让 AI 编码智能体每次都按同一套确定性步骤执行,把“看模型心情”变成“可重复、可提交”的工程实践。

    如果说 Dockerfile 之于基础设施、GitHub Actions 之于 CI/CD,那么 Archon 之于 AI 编码工作流。可以把它理解为“面向软件开发的 n8n”。

    安装要求和过程

    环境要求

    • 运行时Bun(macOS/Linux/Windows 均支持)
    • AI 编码助手:Claude Code(默认),或 Codex、Pi
    • GitHub CLIgh):用于自动建分支、提 PR
    • 系统:macOS / Linux / WSL / Windows(PowerShell);数据库默认 SQLite,可切 PostgreSQL

    快速安装(30 秒,已有 Claude Code)

    # macOS / Linux
    curl -fsSL https://archon.diy/install | bash
    
    # Windows (PowerShell)
    irm https://archon.diy/install.ps1 | iex
    
    # 或 Homebrew
    brew install coleam00/archon/archon

    ⚠️ 编译版二进制不含 Claude Code,需单独安装并指定 CLAUDE_BIN_PATH;Docker 镜像则已自带。

    完整初始化(5 分钟,推荐)

    git clone https://github.com/coleam00/Archon
    cd Archon
    bun install
    claude          # 在 Claude Code 里说:“Set up Archon”

    引导向导会配置凭证、选择接入平台,并把 Archon skill 复制到你的目标仓库。之后在你的项目里直接对编码智能体说 “Use archon to fix issue #42” 即可。

    核心功能

    • 确定性、可重复:开发流程写成 YAML 工作流,固定阶段与校验门(validation gate),每次运行同一套顺序——计划、实现、校验、审查、PR,结果一致。
    • 隔离并行:每个工作流运行都在独立的 git worktree 中,可同时修 5 个 Bug 而互不冲突。
    • 发射后不管(Fire & forget):启动一个工作流就去忙别的,回来已经是一个带审查意见的成品 PR。
    • 确定性节点 + AI 节点可组合:bash 脚本、测试、git 操作等确定性步骤由机器精确执行;规划、代码生成、审查等只在 AI 真正增值的地方运行。
    • 随处可跑、全员共用:工作流定义在 .archon/workflows/,提交进仓库后,从 CLI、Web UI、Slack、Telegram 到 GitHub 表现完全一致;内置 19 个常用工作流,也可自定义。

    为什么需要 Archon

    典型使用场景

    场景一:自动修 GitHub Issue

    对智能体说 “Use archon to fix issue #42”,自动触发 archon-fix-github-issue 工作流:分类 → 调研/规划 → 实现 → 校验 → 提 PR → 智能审查 → 自我修复,全程无需你盯着。

    场景二:从想法到 PR(Idea-to-PR)

    archon-idea-to-pr 把“给设置页加暗黑模式”这类想法,自动走规划 → 循环实现(直到测试通过)→ 审查 → 提 PR → 5 个并行 reviewer → 自我修复,产出完整 Pull Request。

    场景三:团队远程异步协作

    接入 Slack / Telegram / GitHub / Discord 后,在群聊里丢一句话就能触发工作流;所有平台的活动汇聚到同一个 Web 仪表盘(Mission Control),实时查看进度与历史。

    Archon 工作原理

    推荐理由

    我自己最吃这一套的点在于“把流程的所有权拿回自己手里”。平时让 AI 智能体修 Bug,跑十次九个样:有时忘了跑测试、有时 PR 描述敷衍、并行修多个问题时还互相踩。Archon 用一份 YAML 把团队认可的工程纪律写死,AI 只在需要创造力的节点上发挥作用,其余交给确定性执行——稳定、可审计、可复现。它不绑定某家模型,Claude / Codex / Pi 随便换;Web 仪表盘 + 多平台接入也让“远程派活、回来收 PR”变得很顺。对想把 AI 编码真正纳入研发流程的团队,这是目前最像样的开源方案之一。

    下载地址