标签: AI编程助手

  • Meta 终于做编程智能体了,Muse Code 想用低价抢 Claude Code 的饭碗

    Meta 向来不是开发者工具这条赛道上的领跑者。过去一两年里,提到在终端里帮你写代码的 AI,大家首先想到的多是 Anthropic 的 Claude Code 和 OpenAI 的 Codex。但本周,Meta 终于把自己的第一款编程智能体 Muse Code 推到了台前。

    这款工具目前还在测试阶段,跑在终端里,靠一条命令就能装好,支持 macOS 和 Linux。它背后驱动的是 Meta 自己训练的编程模型 Muse Spark 1.2。扎克伯格亲自在社交平台上公布了这件事,语气里带着一点”我们来了”的意味——他说 Muse Code 能完成”跨大型代码库的完整软件工程任务”,包括规划改动、写代码、验证结果这一整套流程。

    真正有意思的是它处理大项目的方式。面对一个庞大的仓库,Muse Code 不会自己一个人硬扛,而是把任务拆开,派出好几个子智能体在各自隔离的工作区里并行干活。扎克伯格特别强调了一点:你的工作副本永远不会被碰到。他在测试里让它同时搭六个游戏功能,彼此之间没有冲突。这对那些动辄几百万行代码的单体仓库来说,是个很实在的卖点——大多数轻量级工具一旦遇到跨文件、跨依赖的复杂改动就容易乱套。

    Meta Muse Code 终端编程智能体概念图
    Meta 把 Muse Code 定位为一款跑在终端里的并行编程智能体

    Meta 的 AI 负责人 Alexandr Wang 在跟《华尔街日报》聊的时候说得很直白:”对很多工作流和用例来说,这是个极好的选择,尤其是从成本角度。”

    这话基本把 Meta 的打法说透了:不跟你拼谁模型更聪明,先拼谁更便宜。Meta 给 Muse Code 定了两档价,一档是常规按量付费,另一档是”贡献者档”——开发者同意用自己的数据去训练模型,就能拿到便宜得多的价格。据 CNBC 的说法,贡献者档比按量付费还要便宜十倍以上。再加上 Muse Spark 1.2 本身每百万输入 token 大约 1.25 美元的水平,对跑大量智能体工作流的团队来说,这差价足够影响基础设施的选型决策。

    从广告引擎到开发者工具

    Meta 做这件事并不突兀。六月它刚闯进企业 AI 市场,推出了面向 WhatsApp、Instagram 和 Messenger 商家的 Meta Business Agent,做客服和销售。Muse Code 算是顺着同一条线再往前走一步:既然要挣广告之外的 AI 钱,开发者这群人自然绕不开。

    技术上还有几个细节值得记一笔。Muse Code 用本地事件日志把每一步操作都记下来,万一崩了能从断点精确续上;Muse Spark 1.2 除了跟着智能体走,也通过 Meta 的模型 API 和 OpenRouter 平台对外开放;对企业客户在意的隐私问题,Wang 说已经开始接受”零数据留存”的申请。

    • 终端安装,一条命令搞定,目前支持 macOS 和 Linux
    • 大仓库自动拆任务,子智能体并行、隔离工作区,不动你的工作副本
    • 双档定价,贡献者档靠数据共享把价格压到按量付费的十分之一以下

    不过也要泼点冷水。Meta 在 AI 工具这块长期被形容为”追赶者”,Muse Code 到底能不能扛住真实项目的考验,还得看社区很快会跑出来的 SWE-bench 这类评测。Windows 支持目前也还是空白,对企业开发团队不算友好。再说,上周 Meta 刚因为营收指引偏软、自由现金流下滑,股价不大好看,这时候把开发者工具抬到台前,多少也有转移叙事、证明 AI 投入能变现的意味。

    但不管怎么说,coding agent 这个战场又多了一个重量级玩家。Claude Code 逼着行业认真看待智能体编程,Muse Code 则很可能逼着所有人把价格再卷一轮。对写代码的人来说,这种内卷从来都不是坏事。

  • Pi Agent Harness:81K Star 的极简终端 AI 编程智能体,四个工具 + 无限扩展

    Pi Agent Harness:81K Star 的极简终端 AI 编程智能体,四个工具 + 无限扩展

    Pi 交互模式:顶部启动信息、消息区、编辑器与状态栏一目了然
    Pi 交互模式:顶部启动信息、消息区、编辑器与状态栏一目了然

    Pi(Pi Agent Harness)libGDX 作者 Mario Zechner(badlogic)团队 earendil-works 开源的极简终端 AI 编程智能体框架:核心只给模型 read / write / edit / bash 四个工具,其余能力全部交给你用 TypeScript 扩展、技能、提示词模板与主题自行拼装。上线不到一年拿下 81,000+ Stars、10,000+ Fork、248 位贡献者,MIT 许可,最新版本 v0.83.0。

    一、项目简介

    一句话:Pi 是一个「你来定义工作流」的开源终端编程智能体 —— 不预设子智能体、不预设计划模式、不内置 MCP,任何你想要的能力都能用一段 TypeScript 扩展装上去,还能打包成 npm 包分享给别人。

    它同时也是一套可复用的智能体开发工具箱,仓库内含四个独立 npm 包:

    • @earendil-works/pi-coding-agent —— 交互式编程智能体 CLI(终端里直接用的那个 pi
    • @earendil-works/pi-agent-core —— 智能体运行时,负责工具调用与状态管理
    • @earendil-works/pi-ai —— 统一多厂商大模型 API(OpenAI / Anthropic / Google 等)
    • @earendil-works/pi-tui —— 带差分渲染的终端 UI 库

    也就是说:你既可以把它当 Claude Code / Codex CLI 的替代品直接用,也可以只取其中一层,去写自己的智能体产品。

    二、安装要求和过程

    环境要求

    • Node.js(npm 全局安装方式)或直接用官方安装脚本下载独立二进制
    • 操作系统:macOS / Linux / Windows 均支持,另有 Termux(Android)与 tmux 专门文档
    • 模型凭据:任一支持的订阅(Claude Pro/Max、ChatGPT Plus/Pro、GitHub Copilot)或 API Key

    快速安装

    # 方式一:npm 全局安装(官方推荐加 --ignore-scripts)
    npm install -g --ignore-scripts @earendil-works/pi-coding-agent
    
    # 方式二:安装脚本(独立二进制)
    curl -fsSL https://pi.dev/install.sh | sh
    

    认证与启动

    # 用 API Key
    export ANTHROPIC_API_KEY=sk-ant-...
    pi
    
    # 或复用已有订阅:启动后输入 /login 选择服务商
    pi
    /login
    

    常用会话参数:

    pi -c              # 继续最近一次会话
    pi -r              # 浏览并选择历史会话
    pi --no-session    # 临时模式,不落盘
    pi -p "修复这个测试"  # 一次性打印模式(可配 --mode json)
    

    安装第三方能力包同样一条命令:pi install npm:@foo/pi-toolspi install git:github.com/user/repo@v1

    三、核心功能

    1. 四个内置工具 + 无限扩展的极简内核

    默认只有 readwriteeditbash。子智能体、计划模式、权限弹窗、待办列表这些别家标配的功能,Pi 一律不内置,而是让你通过扩展实现或安装现成的 Pi Package。作者的理由很直接:这些机制各家做法不同,硬塞进内核只会限制用户。

    2. TypeScript 扩展系统:连 Doom 都能跑

    export default function (pi: ExtensionAPI) {
      pi.registerTool({ name: "deploy", ... });
      pi.registerCommand("stats", { ... });
      pi.on("tool_call", async (event, ctx) => { ... });
    }
    

    扩展可以注册自定义工具(甚至替换内置工具)、自定义命令与快捷键、状态栏 / 页眉 / 页脚 / 浮层 UI、Git 自动提交检查点、SSH 与沙箱执行、权限门禁、自定义压缩策略、MCP 接入……官方示例里甚至有一个「等模型响应时玩 Doom」的扩展。

    3. 会话树:分支、回溯、克隆一个文件搞定

    Pi 的 /tree 会话树视图:任意节点回溯与分支切换
    Pi 的 /tree 会话树视图:任意节点回溯与分支切换

    会话以 JSONL 树结构存储,每条记录带 idparentId/tree 可跳回任意历史节点继续对话并在分支间切换,/fork 从某条用户消息派生新会话,/clone 复制当前分支,全部历史保留在同一个文件里。上下文快满时自动压缩(可手动 /compact 并给定压缩指令),压缩是有损的,但原始记录仍在 JSONL 中随时可回看。

    4. 30+ 模型服务商,含订阅登录与本地 llama.cpp

    订阅方式支持 Anthropic Claude Pro/Max、OpenAI ChatGPT Plus/Pro(Codex)、GitHub Copilot;API Key 方式覆盖 Anthropic、OpenAI、Azure OpenAI、DeepSeek、Google Gemini/Vertex、Amazon Bedrock、Mistral、Groq、Cerebras、xAI、OpenRouter、Vercel AI Gateway、智谱 ZAI Coding Plan(含中国区)、Kimi For Coding、MiniMax、小米 MiMo(含中国区/阿姆斯特丹/新加坡节点)、Hugging Face、Fireworks、Together AI、NVIDIA NIM、Cloudflare 等。还能通过 /login llama.cpp 接入本地 llama.cpp 路由服务器,用 /llama 直接下载和加载本地模型。

    5. 四种运行形态:交互 / 打印 / RPC / SDK

    除了终端交互,Pi 支持 -p 打印模式与 --mode json 结构化输出、--mode rpc(stdin/stdout 上的 JSONL 协议,方便非 Node 语言集成),以及直接以 SDK 方式嵌入自家应用:

    import { createAgentSession, ModelRuntime, SessionManager } from "@earendil-works/pi-coding-agent";
    
    const modelRuntime = await ModelRuntime.create();
    const { session } = await createAgentSession({
      sessionManager: SessionManager.inMemory(),
      modelRuntime,
    });
    await session.prompt("What files are in the current directory?");
    

    6. 供应链与项目信任双重加固

    直接依赖全部锁定精确版本、min-release-age=2 拒绝当天新发布的依赖、发布包内附 npm-shrinkwrap.json、CI 使用 npm ci --ignore-scripts 并定期跑 npm audit signatures。运行侧则有「项目信任」机制:首次进入含项目级配置或 .agents/skills 的目录会先询问,未信任前只加载上下文文件与用户级扩展。

    官方扩展示例:等待模型响应时在终端里跑 Doom
    官方扩展示例:等待模型响应时在终端里跑 Doom

    四、典型使用场景

    场景 1:把智能体改造成完全贴合自家流程的样子

    团队要求「每次改完代码自动跑 lint 并生成 checkpoint 提交」「部署只允许走内部 CLI」「敏感目录禁止写入」。在别的工具里这些要么等官方支持、要么 fork 源码;在 Pi 里就是三个扩展:一个 tool_call 事件钩子做路径门禁,一个注册 deploy 工具,一个在每轮结束时自动 git commit。写完丢进 .pi/extensions/ 全组共享,或打成 npm 包发出去。

    场景 2:低成本 / 国产模型 + 本地模型的日常编码

    /model(Ctrl+L)在 DeepSeek、Kimi For Coding、小米 MiMo、智谱 ZAI、MiniMax 之间随时切换,重活切 Claude / GPT,日常问答切便宜模型或 /llama 加载的本地模型;Ctrl+P 在自己圈定的「常用模型」间循环。底部状态栏实时显示输入/输出/缓存读写 Token、缓存命中率与累计花费,成本一目了然。

    场景 3:把编程智能体嵌进自己的产品或 CI

    pi-agent-core + pi-ai 做后端智能体服务,前端接 --mode rpc 或 SDK;CI 里用 pi -p --mode json 跑「自动修复失败测试」「批量迁移 API」这类任务,输出 JSON 直接被流水线消费。会话以 JSONL 存档,出问题时用 /tree 复盘整条决策链,还能 /export 成 HTML 或 /share 成私密 Gist 给同事看。

    五、推荐理由

    最近半年冒出来的 Coding Agent 多到看不过来,Pi 的差异化非常清晰:它把「克制」当成了产品特性。README 里那段 Philosophy 值得所有做 Agent 的人读一遍 —— 不做 MCP(写带 README 的 CLI 工具就够了)、不做子智能体(用 tmux 开多个 pi 实例)、不做权限弹窗(进容器)、不做内置待办(「它们会让模型犯迷糊」)。这些取舍未必人人认同,但每一条都给了替代路径,而不是简单的「不支持」。

    实际用下来最爽的两点:一是会话树,改坏了直接 /tree 回到三十轮之前换个思路继续,不用新开会话重讲一遍背景;二是扩展的门槛真的低,一个默认导出函数就是一个扩展,热重载 /reload 立刻生效,写工具的体验接近写普通 TypeScript 模块。加上原生支持 Kimi、MiMo、DeepSeek、智谱等国内可用的服务商,中文开发者上手成本很低。

    要注意的是:Pi 没有内置权限系统,默认以启动它的用户权限运行,官方明确建议放进容器或沙箱(文档给了 Gondolin 微虚机、Docker、OpenShell 三种方案);Pi Package 会执行任意代码,安装第三方包前务必看源码。另外仓库对新贡献者的 Issue/PR 默认自动关闭(维护者每天人工复核),提问前先读 CONTRIBUTING.md。

    六、下载地址

    项目数据(截至 2026 年 7 月 31 日):81,086 Stars · 10,008 Forks · 248 位贡献者 · TypeScript · MIT 许可 · 最新版本 v0.83.0 · 仓库仍在每日更新。

  • OpenWork:开源版 Claude Cowork,让 AI 工作流一次创建、处处复用

    OpenWork:开源版 Claude Cowork,让 AI 工作流一次创建、处处复用

    OpenWork 开源 AI 工作流平台

    OpenWork 是 different-ai 开源的一款免费桌面应用,定位为 Claude Cowork / Codex 的开源替代。它提供跨 macOS、Windows、Linux 的统一 AI 工作区,把技能(Skills)、MCP 连接、插件和常用 SaaS 服务打包成可复用的「能力」,通过同一个远程 MCP 服务器接入 Claude Code、Cursor、Codex、OpenCode 等主流 Agent,实现「一次创建、处处复用」。

    安装要求和过程

    环境要求

    • 桌面端:macOS、Windows 或 Linux,支持 Apple Silicon 与 x86_64。
    • 开发环境:Node.js 24(仓库使用 .nvmrc 锁定),包管理器 pnpm 11.4.0,monorepo 使用 Turborepo。
    • 服务器 / 团队版:Docker + Kubernetes 可部署 OpenWork Den 控制平面(文档提供 AWS EKS、Azure AKS、GCP GKE 示例)。

    快速安装

    • 用户安装(推荐):下载安装脚本并执行 openwork-bootstrap CLI。
    curl -fsSLo /tmp/openwork-install.sh https://openworklabs.com/install.sh
    less /tmp/openwork-install.sh
    sh /tmp/openwork-install.sh
    • 安装桌面端
    openwork-bootstrap install app --manifest https://openworklabs.com/install-manifest.json --json
    openwork-bootstrap doctor --app --json
    • 从源码开发
    git clone https://github.com/different-ai/openwork.git
    cd openwork
    pnpm install
    pnpm dev  # 启动 Electron 桌面端

    或者直接访问官网 Download OpenWork 下载对应系统安装包。

    核心功能

    OpenWork 能力架构
    1. 统一能力市场
      把常用的工具、API、提示词和 MCP 封装为「技能」与「插件」,个人或团队发布到市场后即可在任意接入的 Agent 中复用。
    2. OpenWork MCP 远程接入
      只需一行命令即可把 OpenWork 接入 Claude Code、Cursor、Codex、OpenCode 等支持 MCP 的客户端,暴露 search_capabilitiesexecute_capability 两个工具。
    3. 跨端 Electron 桌面应用
      提供本地专属工作区,离线/在线混合运行,内置 opencode 智能体运行时,支持技能编排与记忆管理。
    4. OpenWork Den 组织控制平面
      管理模型供应商配额、团队权限、桌面策略、应用版本限制,并支持 Google Workspace、Microsoft 365 等 SaaS 集成。
    5. Agent-first 安装流程
      用户可以直接让现有 AI 助手执行安装、创建工作区、打开桌面端,甚至连接 OpenWork MCP,无需手动翻阅文档。

    典型使用场景

    1. 多 Agent 共享同一套工具链

    个人开发者把常用的 Supabase、Vercel、GitHub、Slack MCP 封装进 OpenWork,配置一次后,Claude Code 写后端、Cursor 改前端、Codex 跑脚本时都能调用同一组连接和凭证,避免每个客户端重复配置。

    OpenWork 桌面应用

    2. 团队统一 AI 工作区

    技术负责人通过 OpenWork Den 发布内部技能(如「生成发布说明」「数据库迁移脚本」),分配给特定团队;同时限制可用模型、控制 token 预算、审计执行记录,实现 AI 工具在组织层面的治理。

    OpenWork Den 组织控制平面

    3. 开源替代方案落地

    对数据主权敏感或预算受限的团队,可用 OpenWork 替代 Claude Cowork / Codex:Electron 桌面端本地化运行,代码可审计,团队版可自托管,避免把核心工作流绑定到单一闭源平台。

    推荐理由

    OpenWork 的最大价值在于把「AI 工作流」从工具孤岛中解放出来。它不像传统 IDE 插件那样只服务单个编辑器,而是通过标准化 MCP 让能力在多个 Agent 之间流动。对于已经混用 Claude Code、Cursor、Codex 的开发者来说,这种「一次配置、多端复用」的体验非常解渴。

    项目本身工程化程度很高:pnpm + Turborepo 管理多包,Electron 桌面端与远程 MCP 服务器分离,Den 控制平面提供企业级治理接口,文档覆盖 K8s 部署、Google Workspace OAuth、Microsoft Entra SSO 等。GitHub 18K+ Stars 且保持高频迭代(v0.18.12 于 2026-07-30 发布),说明社区认可度不错。

    需要注意:仓库 /ee 目录为 Fair Source License,其他主体代码自定义商业许可,商用前建议阅读 LICENSE。

    下载地址

  • ECC:234K Stars 的 Agent Harness 操作系统,给 Claude Code / Codex / Cursor 装上完整工程化流程

    ECC:234K Stars 的 Agent Harness 操作系统,给 Claude Code / Codex / Cursor 装上完整工程化流程

    ECC - Agent Harness 性能优化系统

    项目简介

    ECC 是一套「Agent Harness(智能体框架)性能优化系统」——它不造轮子写新的 AI 编程工具,而是给你已经在用的 Claude Code、Codex、Cursor、OpenCode 等工具装上一整套工程化操作系统:281 个技能(Skills)、67 个专职智能体、运行时钩子(Hooks)、持久记忆、直觉学习(Instincts)与 AgentShield 安全扫描,让 AI 编程助手从”会写代码”升级为”按工程流程交付”。GitHub 上已狂揽 234,000+ Stars,是目前 Agent 增强类项目中的现象级存在,今日仍以每天近 700 星的速度增长。

    它的核心哲学一句话就能讲清:Optimize the context window. Persist everything else.(优化上下文窗口,持久化其余一切。)AI 不再需要你在每个提示词里重复”请先写测试””请做代码审查”,这些流程被固化为可安装、可复用的系统组件:

    plan -> test -> implement -> review -> verify -> remember -> improve

    ECC - the agent harness operating system

    安装要求和过程

    环境要求:

    • Node.js(钩子与脚本全部用 Node.js 编写,Windows / macOS / Linux 全平台支持)
    • 至少一个 AI 编程工具:Claude Code、Codex、Cursor、OpenCode、Gemini CLI、Zed、Kimi Code 等 12+ 种均有适配

    方式一:Claude Code 插件安装(推荐,最简单)——在 Claude Code 里输入两条命令即可:

    /plugin marketplace add https://github.com/affaan-m/ECC
    /plugin install ecc@ecc

    如需规则包(Rules),再手动拷贝你实际使用的语言包:

    git clone https://github.com/affaan-m/ECC.git
    cd ECC
    mkdir -p ~/.claude/rules/ecc
    cp -R rules/common ~/.claude/rules/ecc/
    cp -R rules/typescript ~/.claude/rules/ecc/  # 换成你的技术栈

    方式二:Codex 同步安装(先运行一次 Codex 生成配置):

    git clone https://github.com/affaan-m/ECC.git
    cd ECC
    npm install
    bash scripts/sync-ecc-to-codex.sh

    方式三:其他工具——克隆仓库后用安装脚本指定目标:

    ./install.sh --profile minimal --target cursor    # Cursor
    ./install.sh --profile minimal --target gemini    # Gemini CLI
    ./install.sh --profile minimal --target zed       # Zed
    # Windows 用 .\install.ps1

    ⚠️ 官方特别提醒:每个工具只选一种安装方式,不要叠加(如 Claude 插件 + 手动 full 安装会导致技能、命令重复);且只从官方渠道安装(GitHub 仓库 affaan-m/ECC、npm 包 ecc-universal / ecc-agentshield),第三方镜像可能含恶意代码。

    核心功能

    • 281 个技能 + 67 个专职智能体:覆盖 TDD、安全审查、深度研究、文档、前端、数据、ML、运维等场景。规划用 planner、审查用 code-reviewer、修构建用 build-error-resolver,各智能体拥有独立上下文与工具权限,互不污染。
    • 门禁化 TDD 工作流:”请使用 TDD”从一句模型可能遗忘的指令,变成带证据链的 RED → GREEN → REFACTOR 流程:先留存失败测试证据,再实现到通过,最后由全新上下文的审查者复查——写代码和审代码不再是同一个上下文。
    • Plan Canvas 计划画布(2.1 新特性):智能体写完计划后在本地浏览器画布中打开,你用鼠标点选段落、添加锚定批注、侧栏对话,最后一键”批准/要求修改”,结果直接映射回 /plan 的确认门。Mermaid 图实时渲染,任何模型任何工具都能驱动。
    • 统一记忆保险库(Memory Vault)ecc memory 让 Claude、Codex、Kimi 等不同工具共享同一份本地可检查的 Markdown 记忆格式,支持跨工具交接(handoff)——上午用 Claude Code 做的迁移方案,下午 Codex 直接检索接手。会话结束还能蒸馏成摘要、直觉(带置信度分数)和可复用技能。
    • AgentShield 安全扫描:把智能体配置本身当作攻击面来审计——扫描提示词、钩子、MCP 配置、权限与密钥泄露,npx -y ecc-agentshield scan --path . 免安装即可体检。

    典型使用场景

    场景一:新功能开发全流程。输入 /ecc:plan "添加 OAuth 用户认证",planner 生成实现蓝图并在 Plan Canvas 里供你批注确认;随后 tdd-workflow 技能强制先写失败测试再实现;完成后 /code-review 由全新上下文的审查智能体查漏。整个过程留下计划、失败测试、通过测试、审查发现、最终验证五份证据。

    场景二:上线前安全体检。/security-scan 做 OWASP Top 10 审计,e2e-testing 技能覆盖关键用户流,/test-coverage 验证 80%+ 覆盖率;再用 AgentShield 扫一遍智能体配置本身,防止 MCP 配置或钩子里埋雷。

    场景三:多工具团队协作。团队里有人用 Claude Code、有人用 Codex、有人用 Cursor——ECC 一次安装适配全部工具,规则与技能保持一致;Memory Vault 的 handoff 机制让不同工具间无缝交接任务上下文,告别复制粘贴聊天记录。

    推荐理由

    我用过不少 Agent 增强类项目,ECC 给我的感受是”体系完整度断层领先”。多数同类项目解决单点问题(提示词库、记忆、或钩子),而 ECC 把技能、智能体、规则、钩子、记忆、直觉六层职责切分得非常清楚——技能按需加载、规则常驻精选、钩子跑在模型上下文之外,这套设计真正做到了”加能力不加上下文负担”。234K Stars 和 35K+ Forks 不是刷出来的:单一维护者每周横跨 7 个 Harness 发版,社区有 Discord、GitHub App 和 12 种语言的 README。最打动我的是它对”证据”的执念:一次交付不只是代码,而是计划、失败测试、通过测试、审查发现和验证记录组成的完整证据链——这正是 AI 编程从玩具走向生产的分水岭。项目 MIT 许可永久免费,托管版 ECC Pro 仅面向私有仓库收费,商业模式清晰不绑架用户。如果你每天在用 Claude Code 或 Codex,这可能是今年最值得装的一个增强系统。

    下载地址

    项目信息:⭐ 234,797 Stars · 🍴 35,776 Forks · 语言:JavaScript/TypeScript/Shell · 许可证:MIT · 创建于 2026 年 1 月,持续高频更新中。

  • Oh My OpenAgent:66.7K Stars 的 AI 编程智能体”满配套件”,一个词启动 11 个智能体并行开发

    Oh My OpenAgent:66.7K Stars 的 AI 编程智能体”满配套件”,一个词启动 11 个智能体并行开发

    Oh My OpenAgent

    项目简介

    Oh My OpenAgent(OmO)是韩国开发者 code-yeongyu 开源的「AI 编程智能体增强套件(Agent Harness)」——一句话概括:给 OpenCode / Codex CLI 装上一个”满配的 AI 开发团队”,装完只需输入 ultrawork 一个词,11 个专职智能体、54+ 生命周期钩子、5 个内置 MCP 就会自动协同,把复杂任务一路干到完成为止。项目目前已收获 66,693 Stars,甚至因为太火导致 Anthropic 封锁了 OpenCode 的 Claude 订阅接入——作者干脆转身拥抱多模型路由,主打”不要选赢家,要编排所有模型”。

    Oh My OpenAgent Team Mode 运行界面

    ▲ Team Mode 实战:Kimi K3 + GPT-5.6 Sol 多智能体并行工作

    安装要求和过程

    环境要求

    • Ultimate 版(OpenCode):需安装 Bun 与 OpenCode
    • Light 版(Codex CLI):仅需 Node.js/npm 环境,无需 Bun
    • 至少一个模型订阅或 API(推荐组合:ChatGPT $20 / Kimi Code $19 / GLM Coding $10,低成本即可跑满血)

    快速安装

    # Ultimate 版(OpenCode 完整体:11 智能体 + Team Mode + 全部功能)
    bunx oh-my-openagent install
    
    # Light 版(Codex CLI 插件:rules/LSP/ultrawork/ulw-loop 等便携组件)
    npx lazycodex-ai install
    # 非交互推荐模式
    npx lazycodex-ai install --no-tui --codex-autonomous
    
    # 两个都装
    bunx oh-my-openagent install --platform=both

    官方还推荐一种更省心的方式——直接把安装指南 URL 扔给任意 AI 助手(Claude Code、Cursor 等),让 AI 替你完成订阅检测、11 个智能体的模型匹配和各家 Provider 认证:

    Install and configure oh-my-openagent by following the instructions here:
    https://raw.githubusercontent.com/code-yeongyu/oh-my-openagent/refs/heads/dev/docs/guide/installation.md

    注意:npm 包与 CLI 命令仍叫 oh-my-opencode(更名过渡期双发布),但不要用 npx omo——那是另一个同名无关包。

    核心功能

    • ultrawork 一词流:输入 ultrawork(或 ulw)即激活全部智能体,配合 Todo Enforcer”偷懒检测”,智能体一旦闲置就被系统拽回来继续干,任务不完成不停手。
    • 纪律型智能体团队:主指挥 Sisyphus(Opus 5 / Kimi K3)负责规划与并行派活;深度工人 Hephaestus(GPT-5.6 Sol)端到端自主执行;规划师 Prometheus 以”面试模式”先访谈再出方案,另有 Oracle(架构/调试)、Librarian(文档检索)、Explore(快速扫码)各司其职。
    • Team Mode 多智能体系统(v4.0):Lead + 最多 8 个并行成员,tmux 实时可视化,衍生 hyperplan(5 个”敌对评审”轮番拆解你的方案)与 security-research(3 个漏洞猎手 + 2 个 PoC 工程师并行审计)两大技能。
    • Hashline 哈希锚定编辑:每行代码带内容哈希标签(11#VK|),编辑前校验、文件变了就拒绝写入,从根源消灭”stale line”错误——Grok Code Fast 1 的编辑成功率靠它从 6.7% 飙到 68.3%。
    • 按类别自动路由模型:子任务只声明类别(visual-engineering / deep / quick / ultrabrain),框架自动匹配最擅长的模型;同时完全兼容 Claude Code 的 hooks、commands、skills、MCP 与插件生态。

    典型使用场景

    • 大规模代码翻新:有用户用它一天清掉 8000 条 ESLint 警告;还有人一夜之间把 4.5 万行的 Tauri 桌面应用改造成 SaaS 网页应用——睡前下指令,醒来验收。
    • 多订阅省钱组合拳:不必为单一厂商付 $200/月,用 Kimi K3 + GPT-5.6 Sol 的平价组合即可超越原版 Claude Code 体验,模型按任务类别自动分工。
    • 方案评审与安全审计:写代码前先跑 hyperplan 让 5 个”杠精”智能体从不同角度挑刺;上线前用 security-research 让 5 个智能体并行做渗透式代码审计,按真实可利用性定级。

    推荐理由

    这是我见过”工程密度”最高的 Agent Harness 项目。它不是又一个 prompt 合集,而是把作者烧掉 2.4 万美元 token 试错换来的经验固化成了产品:Hashline 编辑工具解决的是所有编码智能体最痛的”改错行”问题;类别路由让”选模型”这件事彻底消失;Todo Enforcer 治好了 AI”干一半就摆烂”的顽疾。社区口碑也相当能打——”让我退订了 Cursor””用了就回不去了”。如果你已经在用 OpenCode 或 Codex CLI,这基本是无脑必装的存在;哪怕只是想围观多智能体协作的工程实践,读它的源码和文档也极有收获。唯一注意点:License 为 SUL-1.0(Sisyphus 使用许可),商用前建议先读一下条款,且默认开启匿名遥测(可通过 OMO_DISABLE_POSTHOG=1 关闭)。

    下载地址

    项目数据:66,693 Stars | 语言:TypeScript | License:SUL-1.0 | 最近更新:2026-07-28

  • Cognition九位数买下Poke:AI的’性格’正在变成新的护城河

    那个”你可以像跟朋友发短信一样使唤它”的AI助手Poke,要换东家了。它背后的公司The Interaction Company of California,被做AI编程的初创公司Cognition收购,交易估值落在”低九位数”的区间里。

    AI助手Poke被Cognition收购
    Poke:像发短信一样对话的AI助手 · 图片来源 Poke/The Interaction Company of California

    这笔交易会把Poke的交互方式和”性格”,搬到Cognition旗下的编程助手Devin身上。反过来,Poke也能用上Cognition的模型和基础设施,跑得更快、更稳。

    买的不是功能,是”聊天的感觉”

    Poke能让消费者上头、也让收购方看中的地方,在于它跟人打交道的方式。它不像个工具,更像个朋友:会用网络俚语,会开玩笑,回起消息来带着人味儿。这种气质,恰好能补上Devin作为编程智能体缺的那一块。

    “你多半更愿意跟有性格的同事共事,而不是一群只会干活的机器人。如果你的同事同时也是软件工程师,他还能讲个笑话,你会觉得挺有意思、挺享受。”——Interaction Company联合创始人 Marvin von Hagen

    Cognition联合创始人Scott Wu的说法也是一个意思:Interaction团队做出的这个智能体是被用户真心喜欢的——它主动、懂你、聊起来有意思,而这正是跟Devin协作时该有的感觉。他还提了一句,自己和另一位联合创始人Walden Yan早就是Poke母公司的天使投资人。

    用得多,但一直在烧钱

    Poke今年3月才上线,用户可以通过自己顺手的消息渠道调用它——iMessage、短信、Telegram,部分市场还支持WhatsApp。大家拿它处理的事五花八门,旅行、健康、理财、日程、学习都有,其中管邮件、提醒和待办这类效率活儿最常见。

    • 过去三个月,Poke用户在平台上收发了超过1亿条消息;
    • 用户规模已经到了几十万人,但运营成本高,一直难盈利;
    • 今年6月,它成了苹果Messages for Business平台上第一个获批的AI智能体。

    短期不变,长期可能”合体”

    年底之前,Poke这边不会有立刻的变化,也会继续留在苹果的平台上。到了明年,团队才会开始折腾:让Poke部分任务改用Cognition最新的软件工程模型SWE-1.7,并试验两个产品各自怎么变得更好。两者彻底融合的可能,也没被排除。

    von Hagen设想得更远:长远看,Poke可以去编排一堆编程任务,而Devin也可以变得更像Poke。他举了个眼下的痛点——Devin现在一次只能处理一个PR(拉取请求),如果让Poke来调度多个Devin会话,价值就出来了;再加上Poke还能帮Devin跨会话记住任务。用他的话说,”有个记得住事、一直在的同事,挺好。”

    把这两笔账放一起看,这场收购其实点出了一个正在成型的共识:AI助手怎么跟人互动,可能会和底层模型本身一样值钱。谁能让智能体从”软件”变成”同事”,谁就多了一条别人短期抄不走的护城河。

  • OpenAI 卖起了硬件:230美元的Codex键盘,重点其实不在键盘

    OpenAI 与 Work Louder 联名推出的 Codex Micro 键盘
    OpenAI 与 Work Louder 联名推出的 Codex Micro 键盘

    OpenAI 这回动真格进硬件圈了,第一件产品是一把会发光的键盘,售价 230 美元,专门配它的 AI 编程助手 Codex 用。这把键盘叫 Codex Micro,是跟小众键盘厂牌 Work Louder 联名做的,主打给那些手里同时跑着一堆 AI 编程智能体的 ChatGPT 用户。

    与其在手机或桌面 App 里一个个管你的智能体,不如把这把键盘当成”智能体工作的指挥中心”。

    这把键盘到底特别在哪

    它有一排会亮灯的”Agent 键”,用不同的灯光状态告诉你每个智能体现在在干嘛;还有一组可自定义的命令键,把常用的 Codex 操作设成快捷键;旁边配了个摇杆,用来一键启动常用工作流。最有意思的是那颗旋钮,拧一拧就能调节智能体的”推理强度”——说白了,就是让它在一个任务上多花点时间和算力,还是快点过一遍。所有设置都通过 ChatGPT 桌面端来调。

    OpenAI 跟 TechCrunch 说了句大实话:这是限量联名款。翻译一下就是,它更像个摆在桌上好看的新奇玩意儿,不是奔着走量去的大众产品。

    真正的大招是另一个设备

    就在键盘发布前一天,Bloomberg 抖了个更劲爆的料。OpenAI 还在憋一个没公布的设备,描述听着挺玄乎:便携、没有屏幕、像个智能音箱,还带着”能自己动的机械部件”。屏幕没有、能移动、还便携,这几个词凑一块儿到底会长成啥样,现在谁也说不清,OpenAI 自己也没松口。报道还提了一句,这东西没定型,随时可能改。

    这个新设备据说由几位前苹果工程师操刀,而苹果眼下正因为商业机密的事,把 OpenAI 告上了法庭。

    苹果上周起诉 OpenAI,指控对方高层有意套取自家机密信息,还说 OpenAI 把这些信息用在了自己的硬件开发上。OpenAI 矢口否认。所以这把小键盘看着热闹,背后其实缠着一场关于硬件路线的官司。

    为什么这事值得多看两眼

    抛开官司不谈,Codex Micro 自己不一定能成大生意,但它挺准地戳中了下一代生产力工具的痛点。AI 工具现在最头疼的不是”能不能做”,而是用户压根不知道它在后台干啥、什么时候该自己插手、怎么把好几个任务同时管起来。一颗告诉你智能体是开着、停着还是在等指令的灯,可能比翻软件后台的仪表盘直观多了。

    • 对开发者:AI 编程工具的竞争,正从比模型能力,扩展到比状态管理、工作流和人机协作界面。
    • 对企业:以后一个员工要同时调度好几个智能体,权限、审计、任务状态和人工确认会比”聊天框好不好用”更要紧。
    • 对普通用户:这不是非买不可的键盘,但它把 AI 工具从聊天软件走向”工作控制台”的方向,摆到了台面上。

  • OpenSpec:为 AI 编程助手打造的规格驱动开发框架,写代码前先对齐需求

    OpenSpec:为 AI 编程助手打造的规格驱动开发框架,写代码前先对齐需求

    OpenSpec - Spec-Driven Development for AI Coding Assistants
    OpenSpec:为 AI 编程助手打造的规格驱动开发框架

    一、项目简介

    OpenSpec 是 Fission AI 开源的一款「规格驱动开发(Spec-Driven Development, SDD)」框架,核心理念是:在写任何一行代码之前,先让你和 AI 就「要做什么」达成一致。它为 AI 编程助手补上了一层轻量的规格层(spec layer),把原本只存在于聊天记录里的模糊需求,沉淀成结构化、可评审、可复用的 Markdown 规格文档。截至目前项目已在 GitHub 收获 62,500+ Stars,是当前最受欢迎的规格框架之一。

    二、安装要求与快速上手

    环境要求:Node.js 20.19.0 或更高版本(同时兼容 pnpm、yarn、bun、nix)。

    全局安装:

    npm install -g @fission-ai/openspec@latest

    初始化项目:进入你的项目目录并初始化,OpenSpec 会自动为你的 AI 助手写入配置。

    cd your-project
    openspec init

    开始与 AI 对话:直接在支持的编程助手中使用斜杠命令。

    # 还没想清楚要做什么?先探索,让 AI 读代码、权衡方案、成型计划
    /opsx:explore
    
    # 已经明确需求?直接提出变更提案
    /opsx:propose add-dark-mode
    
    # 提案通过后,逐条实施任务
    /opsx:apply
    
    # 完成后归档,规格自动更新
    /opsx:archive

    升级只需 npm install -g @fission-ai/openspec@latest,再在各项目内运行 openspec update 刷新 AI 指令即可。

    三、核心功能

    • 规格先行、代码后行:每个变更都会生成独立文件夹,包含 proposal.md(为什么做/改什么)、specs/(需求与场景)、design.md(技术方案)、tasks.md(实施清单),人和 AI 先对齐再动手。
    • 纯 Markdown、零学习成本:规格就是带具体场景(WHEN/THEN)的普通 Markdown,无需学习任何专用语法,AI 负责撰写、你负责评审。
    • 流式而非瀑布:任何产物随时可改,没有僵硬的阶段闸门(phase gates),支持从探索到实现的自由迭代。
    • 广泛的工具兼容:通过斜杠命令支持 25+(并持续增长)主流 AI 编程助手,包括 Claude Code、Codex、Cursor 等,不锁定任何 IDE 或模型。
    • 团队级 Stores(Beta):把规划放进独立仓库,通过 git push 共享,实现跨仓库特性、共享需求、代码未动先立规划——为多团队协作提供单一事实来源。
    OpenSpec Dashboard
    OpenSpec 内置仪表盘:可视化查看规格与进行中的变更

    四、典型使用场景

    • 为老项目做增量特性开发(Brownfield):OpenSpec 明确定位「不只是绿地项目」。在成熟代码库里加新功能时,用 /opsx:explore 让 AI 先读懂现有代码结构,再权衡最干净的实现路径,避免 AI 凭空乱改。
    • 个人开发者约束 AI「别跑偏」:单人开发时,规格层能让你和 AI 在单仓库上保持诚实——先评审计划再写代码,杜绝「模糊 prompt → 不可预测结果」的困境。
    • 企业团队跨仓库协作:一个特性横跨 API 服务、Web 前端和共享库时,用 Stores 把「一个变更、一份计划」共享给三个仓库;平台团队维护规格,产品团队只读引用,让每个编程 Agent 都能读到同一份需求,告别到处漂移的 Wiki。

    五、推荐理由

    体验下来,OpenSpec 最打动我的是它对「轻量」的坚持。同类的 GitHub Spec Kit 更全面但偏重——僵硬的阶段闸门、大量 Markdown、还要配 Python 环境;AWS 的 Kiro 很强却把你锁死在它的 IDE 和 Claude 模型上。OpenSpec 则用一条 npm install 就接入你已经在用的工具链,规格全是能随手改的纯 Markdown,真正做到了「有预测性但不繁文缛节」。

    官方建议搭配高推理能力的模型(如 Codex、Opus 系列)效果最佳,并注意保持干净的上下文窗口——实施前清理上下文,能显著提升产出质量。对于厌倦了「AI 一顿乱写、结果全靠运气」的开发者,OpenSpec 是一个成本极低、收益明显的习惯升级。MIT 许可,可放心用于商业项目。

    六、下载地址


    项目信息:Stars 62,500+ | Forks 4,325 | 主语言 TypeScript | 许可证 MIT | 首次发布 2025-08

  • 会写代码还会开玩笑:Cognition收购Poke,AI的“性格”成了新护城河

    你有没有想过,跟AI打交道时最打动你的,可能不是它有多聪明,而是它够不够”有意思”?做AI编程工具的Cognition显然是这么想的——它刚刚把Poke给收购了。Poke是那款”你可以像发短信给朋友一样使唤”的AI助手,背后公司叫The Interaction Company of California,这笔交易的估值落在”低九位数美元”区间。

    这笔收购透露出一个越来越被认同的判断:AI助手怎么跟人打交道,正变得和它底层模型有多强一样值钱。

    Cognition 收购 Poke
    Poke 以像朋友聊天的方式与用户互动(图片来源:Poke / The Interaction Company of California)

    买的不是技术,是”性格”

    Poke最让普通用户上头的地方,在于它回应请求的方式。它不像一个工具,倒更像个熟人——聊天时会用网络热词、开玩笑,语气随和得像老朋友。Cognition要把这套交互模式和”人格”搬到自家编程助手Devin身上;作为交换,Poke能用上Cognition的模型和基础设施,跑得更快、更稳。

    “如果同事都有点性格,总比一群只会干活的机器人强吧。”Interaction Company联合创始人Marvin von Hagen在接受TechCrunch采访时这么说,他也顺便确认了交易价格,”当你的同事同时还是软件工程师,他们也能抖个包袱,你会觉得挺有意思、挺开心的。”

    让Devin别那么像软件

    Cognition的算盘很清楚:让Devin用起来少一点”软件味”,多一点”同事感”。联合创始人Scott Wu在博客里写道,Interaction团队做出了一个”用户真心喜欢的智能体:它主动、懂你、聊起来还挺有意思,而这正是我们希望用户和Devin协作时的感觉”。他还提到,自己和另一位联合创始人Walden Yan早就是Poke母公司的天使投资人。


    用户很多,钱却不好赚

    Poke在2026年3月首次亮相,用户可以通过自己惯用的消息平台跟它对话,iMessage、短信、Telegram,部分地区还支持WhatsApp。大家用它处理旅行、健康、理财、日程、学习等各种琐事,其中最常见的还是管邮件、设提醒、列待办这类效率活儿。过去三个月,Poke上的消息往来超过了1亿条。

    但热闹归热闹,von Hagen坦言,尽管用户数已经到了几十万级别,Poke运行成本一直很高,赚钱并不容易。今年6月,它成了首个获准跑在苹果”Messages for Business”平台上的AI智能体——这个平台让企业能在苹果消息应用里用统一的方式处理客户沟通。

    明年才是真正的融合期

    短期内Poke不会有什么变化,今年内照旧留在苹果平台上。真正的动作要等到明年:Poke会开始用Cognition最新的软件工程模型SWE-1.7来处理部分任务,两款产品彻底合并的可能性也没被排除。

    • Cognition以”低九位数美元”收购Poke母公司Interaction Company
    • 看中的是Poke像朋友般会开玩笑、有人格的交互方式
    • Poke的”性格”将注入编程助手Devin,Poke则用上Cognition算力
    • Poke三个月内消息量破1亿条,但运行成本高、盈利难
    • 明年Poke将启用SWE-1.7模型,未来或由它编排多个Devin会话

    von Hagen还给出了一个更长远的设想:Poke擅长统筹调度,未来完全可以让它去编排多个Devin会话。要知道,现在Devin一次只能处理一个PR(拉取请求),而Poke还能帮它记住跨会话的任务。用他的话说——”有个记性好、一直在线的同事,挺好的。”

  • 马斯克连夜开源Grok Build,但代码里还留着上传用户整个仓库的痕迹

    事情经过是这样的:7月13号左右,一位叫 Cereblab 的安全研究人员在测试 xAI(现在叫 SpaceXAI)的终端编程工具 Grok Build 时,发现了一个让人后背发凉的问题——这个号称”本地优先”的 AI 编程助手,会在你毫不知情的情况下,把你的整个 Git 代码仓库打包上传到 Google Cloud Storage。

    Grok Build代码上传隐私问题示意图
    AI编程工具的隐私边界正在成为开发者最关心的问题

    在一个12GB的测试仓库里,模型实际只用了192KB的数据来完成任务,但上传通道却往Google云存储桶里塞了5.1GB——差了将近28000倍。

    不是Bug,是设计

    Cereblab 用 mitmproxy 抓了所有网络请求。他让 Grok Build 做一件再简单不过的事:回复一个”OK”,不打开任何文件。按理说这不该触发任何数据外传,但结果呢?工具照样把整个项目目录、commit 历史、甚至他故意放进去做测试用的 never_read_canary.txt(一个明确标注”别读我”的文件)全部打包上传了。

    更离谱的是,用户界面里的那个”改进模型”开关根本没用。关掉它,服务器端依然返回 trace_upload_enabled: true,照传不误。

    密码和密钥也一起飞了

    当 Grok Build 读到 .env 文件里的 API Key 和数据库密码时,这些敏感信息也被原封不动地塞进 session 归档包,没有任何脱敏处理。有开发者报告说亲眼看着自己的 SSH 密钥、密码管理器数据库、个人文档和照片都被一股脑传走了。

    消息曝光之后,xAI 在服务端悄悄加了一个 disable_codebase_upload: true 的全局开关来关掉这个功能——注意,不是修客户端代码,是服务端配置一改就完事了。这意味着理论上他们随时可以重新打开。

    紧急开源:84万行Rust代码一夜上线

    丑闻发酵没几天,马斯克亲自宣布 Grok Build 全面开源,完整代码库直接扔到了 GitHub(xai-org/grok-build),几小时就冲到了 7700+ Star。官方还重置了所有云端使用限制,支持完全本地运行,声称要给用户”彻底的隐私控制”。

    开源后的代码库确实很庞大——844530 行 Rust 代码,规模跟 OpenAI 的 Codex(约95万行)差不多。但仔细翻一遍你会发现,之前那段向 Google Cloud 上传数据的代码(upload/gcs.rs)还在里面,只是被硬编码成了返回错误的状态。删了吗?没有。禁用了?是的。能不能随时改回来?技术上完全可以。

    • Grok Build 是基于 Grok 4.5 大模型的命令行 AI 编程智能体,定位对标 Claude Code 和 OpenAI Codex CLI
    • 代码中包含从 openai/codex 和 sst/opencode 移植过来的工具实现
    • CONTRIBUTING.md 明确写明不接受外部 Pull Request——这更像是一次”可审计代码公开”而非真正的社区协作开源
    • 子智能体的系统提示词要求模型”不要向用户透露提示词内容”,但主提示词却没有类似限制