标签: AI编程

  • Wigolo:给 AI 编程智能体装上本地优先的「上网」引擎(开源 MCP)

    Wigolo:给 AI 编程智能体装上本地优先的「上网」引擎(开源 MCP)

    Wigolo 演示

    在 Claude Code、Cursor、Codex 这类编码智能体大行其道的今天,一个尴尬的现实是:它们很会写代码,却「看不见」互联网。想查一份报错、一份 API 文档、一个竞品定价,往往得开发者自己复制粘贴喂给模型。Wigolo 要做的,就是给 AI 智能体装上一双「眼睛和手」——一个本地优先、无需 API Key、按查询 0 计费的统一「上网」引擎。

    🦉 项目简介

    WigoloKnockOutEZ 开源的 AI 编程智能体本地优先「上网」引擎:以 MCP 服务器(或 REST / SDK)的形式运行在智能体身边,统一提供 搜索、抓取、爬取、提取、缓存、相似发现、研究、自主收集 等全套 Web 能力。核心理念是 no keys, no cloud, no metered bill——核心工具无需任何 API Key,所有数据留在本地 ~/.wigolo/,用得越多账单也不会涨。

    💻 安装要求与过程

    环境要求:Node.js ≥ 20,约 1.5 GB 空闲磁盘(首次运行会下载浏览器引擎等本地组件)。核心搜索 / 抓取 / 爬取无需任何外部 Key 即可使用;如需 researchagent 等高级研究能力,可选择性配置一个 LLM Provider(如 Gemini)。

    快速安装:

    # 初始化本地引擎(任意系统)
    npx wigolo init
    
    # 初始化并一键接入日常 agent(如 Claude Code + Cursor)
    npx wigolo init --agents=claude-code,cursor
    
    # 以 Docker 方式作为 stdio MCP 服务运行
    docker run -i --rm -v wigolo-data:/data ghcr.io/knockoutez/wigolo
    
    # 在自托管 box 上暴露 HTTP 服务(默认 127.0.0.1:3333)
    wigolo serve
    
    # 在你的应用里用 SDK 嵌入
    npm install wigolo-sdk     # TypeScript
    pip install wigolo         # Python

    常用运维命令:npx wigolo verify(健康检测)、npx wigolo warmup --all(重下引擎)、npx wigolo docto --fix(修复环境)。

    ⚙️ 核心功能

    Wigolo 核心工具全景

    1. 🔍 多引擎搜索 search:内置 18 个直连适配器,ML 重排 + 可解释评分,让智能体拿到「为什么是这条结果」。
    2. 🔗 抓取 & 爬取 fetch / crawl:分层路由获取单页并清洗为 markdown(含 PDF / 鉴权页处理);BFS / DFS / sitemap 多页爬取并自带限流保护。
    3. 🧩 提取 & 缓存 & 相似 extract / cache / find_similar:从页面抽取表格 / JSON-LD / Schema 等结构化数据;本地缓存已见内容,二次查询毫秒即回;关键词 + 语义 + 实时发现相似页面。
    4. 🤖 自主研究 research / agent:把一个问题自动分解成子查询、扇出检索、综合成报告;agent 工具则跑 search→fetch→extract→synthesize 的自主收集循环。
    5. 🔔 变更追踪 diff / watch:检测页面变化并推送 webhook,把「定时盯网页」变成可编排的事件。

    🚀 典型使用场景

    • 场景一 · 编码时实时联网:在 Claude Code / Cursor 里改代码时,智能体直接调用 search / fetch 查文档、查报错、查第三方 API,开发者不再手动复制粘贴;所有命中缓存在 ~/.wigolo/,隐私不出本机。
    • 场景二 · 自托管 Agent 的「联网大脑」:在自托管服务器上 wigolo serve 暴露 REST / MCP 端点,LangChain、CrewAI、n8n 等编排框架或任意 MCP client 统一调用,把分散在各处的抓取逻辑收敛成一个服务。
    • 场景三 · 持续竞品 / 文档监控:用 watch 盯住竞品定价页或文档页,diff 出变化并推 webhook 到飞书 / Slack / 自有系统,第一时间感知变更。

    💡 推荐理由

    我特别看好 Wigolo 的一点,是它真正把「本地优先」做到了极致:零 API Key、零按量账单,直接戳中「想让 agent 上网,却要为每家搜索引擎单独接 key、还要担心账单爆掉」的痛点。统一的 MCP 接口对 Claude Code / Cursor / Codex / Gemini CLI / VS Code / Zed 通吃,接入几乎零心智负担;数据默认留在本地,对重视隐私的开发者很友好;AGPL-3.0 开源、可完全自托管。如果你正想给自己的 coding agent 装上一双「眼睛和手」,Wigolo 是目前最省心的一站式方案。

    Wigolo 四种接入方式与差异化

    🔗 下载地址

  • Kimi Code CLI:终端里的下一代 AI 编程智能体(4.3K★,月之暗面开源)

    Kimi Code CLI:终端里的下一代 AI 编程智能体(4.3K★,月之暗面开源)

    Kimi Code CLI 封面

    Kimi Code CLI 是月之暗面(MoonshotAI)开源的终端 AI 编程智能体——它能在命令行里读改代码、执行 shell 命令、搜索文件、抓取网页,并依据反馈自主决定下一步;开箱即用 Kimi 大模型,也可配置接入其它兼容模型。

    一、项目简介

    一个跑在终端里的”AI 同事”。Kimi Code CLI 把代码读写、命令执行、文件检索、网页抓取与多步自主规划统一进一个轻量 TUI,口号是 “The Starting Point for Next-Gen Agents”(下一代智能体的起点)。它脱胎于此前广受关注的 Kimi CLI,把运行时收敛为单文件二进制,启动几乎无感,对 Kimi 大模型用户尤其友好。

    二、安装要求和过程

    环境要求

    • 普通用户无需 Node.js:官方脚本一条命令装好单文件二进制,无 PATH 烦恼、无全局模块冲突;
    • Windows 需先装 Git for Windows:Kimi Code CLI 用内置 Git Bash 作为 shell 环境;若 Git 装在自定义路径,设置环境变量 KIMI_SHELL_PATH 指向 bash.exe 绝对路径;
    • 账号:首次使用需 Kimi 账号(OAuth)或 Moonshot AI 开放平台 API Key;
    • 从源码开发需 Node.js ≥ 24.15.0 + pnpm 10.33.0。

    快速安装

    macOS / Linux:

    curl -fsSL https://code.kimi.com/kimi-code/install.sh | bash

    Windows(PowerShell):

    irm https://code.kimi.com/kimi-code/install.ps1 | iex

    快速开始

    cd your-project
    kimi            # 启动交互式 TUI
    kimi --version  # 验证安装

    首次在会话里执行 /login,选择 Kimi Code OAuth 或 API Key 登录,然后试着让它”看看这个项目,解释下主要目录“。

    三、核心功能

    Kimi Code CLI 核心能力

    1. 单文件分发:一条命令安装,无 Node.js、无 PATH 困扰、无全局模块冲突。
    2. 毫秒级启动:TUI 毫秒就绪,开启会话毫无负担,长时间 Agent 会话也不卡。
    3. 视频输入:把录屏 / 演示片段直接丢进聊天,Agent 逐帧”看懂”画面——把参考片转成 LUT、长视频剪成短片、屏幕录屏变成可运行代码。
    4. AI 原生 MCP:用 /mcp-config 对话式增删与鉴权 Model Context Protocol 服务器,免手改 JSON。
    5. 子智能体并行:内置 coder / explore / plan 子智能体在隔离上下文并行干活,主线对话保持清爽。
    6. ACP 编辑器集成kimi acp 接入 Zed、JetBrains 等任意 Agent Client Protocol 客户端,IDE 里直接驱动。

    四、典型使用场景

    Kimi Code CLI 工作流

    • 日常终端编程搭子:在任意项目目录敲 kimi,让它读代码、跑命令、搜文件、抓网页并自规划下一步,省去来回切窗口。
    • IDE 里的 Agent:在 Zed / JetBrains 配置 kimi acp,用熟悉的编辑器驱动 Agent,一次登录处处可用,开发流不断档。
    • 视频驱动开发:把产品录屏或参考片段丢给 Agent,让它”看懂”后落地为可运行代码或素材(例如把一段参考片转成调色 LUT)。

    五、推荐理由

    Kimi Code CLI 给我最大的惊喜是”“。作为 Kimi CLI 的演进版,它把运行时收敛成单文件二进制,启动几乎无感,TUI 也比不少同类更耐看;视频输入/mcp-config 对话式配置是真正能提升日常效率的巧思,而不是噱头。如果你已经在用 Kimi 大模型、又想要一个不折腾环境、能直接塞进终端和 IDE 的编码 Agent,它非常值得一试。MIT 协议、社区活跃(4.3K+ Stars、当日仍在高频更新),长期主义玩家可以放心上车。

    六、下载地址

  • mattpocock/skills:把顶级工程师的经验,打包成 AI 编码智能体的「技能库」

    mattpocock/skills:把顶级工程师的经验,打包成 AI 编码智能体的「技能库」

    mattpocock/skills 项目封面

    mattpocock/skills 是 TypeScript 布道师 Matt Pocock 日常使用的「AI 编码智能体技能库」——它不教你写 prompt,而是把数十年的工程经验浓缩成一组小而可组合、跨模型通用/skills 指令,专门修复 Claude Code、Codex 等编码智能体最常犯的四种失败模式。目前已在 GitHub 收获 17.8 万+ Stars,是近期最火的 AI 工程化开源项目之一。

    一、安装要求和过程

    环境要求

    • Node.js 18+(用于 skills.sh 安装器,npx 一行搞定)
    • 一个支持 skills 的编码智能体:Claude Code / Codex / 任意 Agent-Skills 标准 harness
    • 可选:GitHub 或 Linear 账号(/triage 技能需要对接 issue 追踪器)

    方式一 · 可改副本(推荐,想魔改就选它)

    npx skills@latest add mattpocock/skills

    选择要安装的技能与目标 agent,务必勾选 /setup-matt-pocock-skills;随后在 agent 中运行一次该命令完成仓库配置(选择 issue 追踪器、triage 标签、文档存放位置)。

    方式二 · Claude Code 原生插件(只读、常新、省心)

    /plugin marketplace add mattpocock/skills
    /plugin install mattpocock-skills@mattpocock

    装好后再跑一次 /setup-matt-pocock-skills。两种哲学:skills.sh 把技能复制进项目任你改;插件把它们作为只读束订阅更新

    二、核心功能

    整套技能围绕「软件工程基本功」展开,把对齐、TDD、架构、评审变成 Agent 拿来即用的小工具:

    四个失败模式对应技能

    • 对齐优先/grill-me/grill-with-docs——动手前先让 Agent 把你「拷问」一遍,并用 CONTEXT.md 沉淀项目共享语言,从根上消除需求歧义与啰嗦。
    • 测试驱动与诊断/tdd(红-绿-重构循环)、/diagnosing-bugs(复现→最小化→假设→插桩→修复→回归),让 Agent 真正跑起「代码运行反馈」闭环。
    • 架构纪律/to-spec/improve-codebase-architecture/codebase-design——对抗「一坨烂泥」,鼓励深模块、小接口。
    • 流程编排/implement/code-review/research/wayfinder/triage——把需求拆成可追溯的工单与规格,并以并行子智能体做「规范 + 标准」两轴评审。
    • 可组合、跨模型:所有技能与具体模型解耦,Claude Code / Codex / 其他 Agent 都能用;用户主动触发(User-invoked)与 Agent 自动调用(Model-invoked)两类技能分工清晰。

    User-invoked 与 Model-invoked 技能分类

    三、典型使用场景

    • 接手新项目前的「对齐会话」:用 /grill-with-docs 先和 Agent 把需求与领域术语聊透,生成 CONTEXT.md;后续每次对话都更省 token、更精准,变量/函数命名也跟着统一。
    • 写带测试的新功能:用 /implement 驱动 /tdd,先写失败测试再实现,最后 /code-review 把关——提交前质量稳,回归风险低。
    • 拯救腐烂的代码库:定期跑 /improve-codebase-architecture,扫描可深化的模块并生成可视化 HTML 报告,按图索骥重构,避免软件熵增失控。

    四、推荐理由

    这不是又一个「流程框架」(GSD/BMAD/Spec-Kit 那类会把过程控制权收走),而是把工程基本功变成 Agent 拿来即用的小工具——轻量、可改、不绑架你。最让我惊艳的是 CONTEXT.md 共享语言:用一句话把「section 里的 lesson 被 materialize」说清,代码命名、导航、token 消耗全跟着受益。两种安装方式恰好对应两种心态:想魔改就 fork 副本,想省心就装插件订阅更新。17.8 万 Stars、MIT 协议、几乎零上手成本,强烈建议所有用 Claude Code / Codex 的开发者装一套。

    五、下载地址

    许可:MIT | 语言:Shell/Markdown | Stars:178.9K+ | 创建于 2026-02,持续高频更新

  • Kimi CLI:月之暗面开源的终端 AI 编程智能体(10K+ Stars)

    Kimi CLI:月之暗面开源的终端 AI 编程智能体(10K+ Stars)

    Kimi CLI 在 VS Code 中的集成效果

    Kimi CLI 是月之暗面(MoonshotAI)开源的终端 AI 编程智能体——直接在命令行里读改代码、执行命令、联网检索,并自主规划与调整动作,把 Kimi 大模型搬进了你的 shell 与编辑器。

    一、项目简介

    Kimi CLI 是一个运行在终端里的 AI Agent,主打软件工程与命令行操作两大类任务。它不只是聊天机器人,而是能真正读取/编辑代码、执行 shell 命令、检索与抓取网页,并在执行过程中自主规划、动态修正路线。项目由 MoonshotAI 维护,采用 Apache-2.0 协议,当前已在 GitHub 收获 10K+ Stars。值得留意的是,官方已宣布 Kimi CLI 正演进为下一代 Kimi Code CLI,安装新版本会自动迁移配置与会话,但现有文档与安装方式依旧可用。

    二、安装要求与过程

    环境要求:

    • Python ≥ 3.12(PyPI 包已发布,最新版 1.49.0)
    • 一个 Kimi 账号(登录后使用)或有效的 API Key
    • 可选:Node.js(用于运行 npx 类 MCP 服务,如 chrome-devtools-mcp);Zsh(如需 shell 插件)

    快速安装:

    # 方式一:pip 安装(推荐)
    pip install kimi-cli
    
    # 方式二:pipx 隔离安装
    pipx install kimi-cli
    
    # 启动并登录
    kimi          # 进入交互界面后输入 /login 完成登录
    

    登录后即可在终端直接与 Kimi 对话、让它改代码、跑命令;配置与历史会话会保存在本地,跨项目复用。

    三、核心功能

    • 终端即 Shell(Ctrl-X 切换):Kimi CLI 本身就是一个 shell,按 Ctrl-X 即可在不退出智能体的情况下直接运行 shell 命令,把对话与执行无缝融合。
    • VS Code 扩展:通过官方 Kimi Code 扩展 在编辑器侧边栏开启 Agent 面板,直接基于当前工程上下文协作(见上方截图)。
    • ACP 协议接入主流 IDE:原生支持 Agent Client Protocol,可作为 ACP Agent Server 接入 Zed、JetBrains 等任意兼容编辑器,命令为 kimi acp
    • 原生 MCP 支持:内置 kimi mcp 子命令组,支持 HTTP / stdio / OAuth 多种传输方式,一行即可增删与授权 MCP Server(如 Context7、Linear、chrome-devtools)。
    • Zsh 深度集成:配合 zsh-kimi-cli 插件,把 AI Agent 能力直接带进你的 shell,Ctrl-X 一键切到智能体模式。

    四、典型使用场景

    • 终端里的全栈开发:在服务器或本地终端直接让 Kimi 读懂整个代码库、定位 Bug、生成补丁并执行测试,无需切换到图形界面 IDE。
    • IDE 内结对编程:在 VS Code / Zed / JetBrains 中以 Agent 面板形式调用 Kimi,基于当前文件与工程上下文做重构、加功能、写测试,改动实时落盘。
    • 可扩展的自动化工作流:通过 MCP 接入 Linear、Context7、Chrome DevTools 等工具,让 Kimi CLI 自动查需求、查文档、跑端到端浏览器验证,组成稳定的开发自动化流水线。

    五、推荐理由

    作为一款国产大模型厂商出品的命令行智能体,Kimi CLI 最大的亮点是「终端原生」——它不强迫你离开 shell,Ctrl-X 即可在「智能体」与「命令模式」间无缝切换,对远程服务器、无界面环境极其友好。同时它对 ACP / MCP 双协议的原生支持,意味着你既能把它嵌入 VS Code、Zed、JetBrains,也能通过 MCP 无限扩展工具边界,灵活度很高。Apache-2.0 协议可商用、配置本地化,隐私与可玩性兼顾。虽项目正平滑演进为 Kimi Code CLI,但当前版本已足够稳定,是体验「Kimi 版 Claude Code」最轻量直接的入口。

    六、下载地址

    (注:Kimi CLI 正演进为 Kimi Code CLI,新版本会自动迁移配置与会话,建议关注官方仓库获取最新动态。)

  • Open Design:开源版 Claude Design,把你的编码智能体变成设计引擎

    Open Design:开源版 Claude Design,把你的编码智能体变成设计引擎

    ⭐ 79.6K Stars  ·  Apache-2.0  ·  TypeScript  ·  本地优先桌面应用

    项目简介

    Open Design 是 Anthropic Claude Design 的开源替代方案——一个本地优先(local-first)的桌面应用,让你的 Claude Code / Codex / Cursor / Gemini 等编码智能体直接化身”设计引擎”,生成网页、桌面、移动端原型、实时仪表盘、演示文稿、图片与视频,并导出为 HTML / PDF / PPTX / MP4 真实文件。

    Open Design 工作台

    安装要求与过程

    环境要求

    • 桌面应用:macOS(Apple Silicon / Intel x64)、Windows(x64)、Linux(AppImage)——无需 Node / pnpm / 克隆仓库。
    • 自托管:Docker + Docker Compose;源码运行需 Node 24、pnpm 10.33.x。
    • 编码智能体:Claude Code、Codex、Cursor、Copilot、OpenClaw、Gemini、Hermes、Kimi、Trae、OpenCode 等 25+ 本地 CLI,或任意 OpenAI 兼容端点(BYOK)。

    快速安装

    1. 下载桌面应用(推荐,零配置):前往官网或 GitHub Releases 下载对应平台安装包;安装后自动检测 PATH 上的编码智能体,加载 100+ 功能技能、渲染模板目录与 151 套设计系统。
    2. 装进编码智能体(无界面)od mcp install <agent><agent> = claude | codex | cursor | copilot | gemini | hermes | kimi | trae | opencode …);或用托管脚本 curl -fsSL https://open-design.ai/install.sh | sh -s <agent>
    3. Docker 自托管
      git clone https://github.com/nexu-io/open-design.git
      cd open-design/deploy
      cp .env.example .env
      echo "OD_API_TOKEN=$(openssl rand -hex 32)" >> .env
      docker compose up -d
      # 打开 http://localhost:7456
    4. 源码运行
      git clone https://github.com/nexu-io/open-design.git
      cd open-design
      corepack enable && pnpm install
      pnpm tools-dev run web

    核心功能

    内置 151 套品牌级设计系统

    1. 智能体原生、模型无关:不绑定任何厂商 Agent,你 PATH 上已有的 claude / codex / cursor / copilot / hermes / kimi 就是设计引擎,一键切换;一条 od mcp install <agent> 把 MCP 服务器接入 25+ 编码智能体。
    2. 品牌级 DESIGN.md 设计系统:每一帧渲染都读取当前包的 DESIGN.md 作为品牌契约;仓库内置 151 套品牌级设计系统(Claude、Stripe、Figma、Apple、NVIDIA…),丢进文件夹即被识别。
    3. 多形态产物,单一项目:Studio 支持原型(web / desktop / mobile 单页)、实时仪表盘 / artifact、演示文稿(deck)、图片、视频与 HyperFrames 动态图形,统一导出 HTML / PDF / PPTX / MP4。
    4. 四层可组合:插件(可运行工作流)+ 功能技能(Agent 行为)+ 设计模板(渲染蓝图)+ 设计系统(品牌),全部用可移植、可版本化的目录,任何人都能创作与发布;官方 277 个插件 + 183 个可复用示例。
    5. 本地优先 + BYOK 隐私:原生桌面应用(macOS / Windows)+ Docker + Vercel;所有数据在你本机、团队服务器或部署项目里运行,BYOK 代理具备 SSRF 防护,沙箱 iframe 预览。

    Open Design 支持的 25 个编码智能体 CLI

    典型使用场景

    • 一句话生成落地页:在入口视图输入 brief,智能体结合 saas-landing 模板与 Linear 设计系统,流式生成带 hero / 特性 / 定价 / CTA 的可运行着陆页,直接导出 HTML 部署。
    • 实时数据仪表盘:用 dashboard 模板生成带侧边栏的管理 / 分析看板,作为 live artifact 实时刷新,而非静态截图。
    • 品牌统一的演示文稿:用 guizang-ppt / html-ppt 模板生成杂志风 Web PPT;或把现有 git 仓库 + DESIGN.md 交给智能体,自动把真实组件重构到品牌规范(含 Figma / Pencil → React / Next / Vue 迁移插件)。

    演示文稿 / Deck 产物

    插件与集成生态

    推荐理由

    作为天天和编码智能体打交道的人,最打动我的是它把”设计”从闭源付费的云端玩具,变成了你笔记本上的文件系统——你的 CLI 是引擎,笔记本是工作室,团队的 DESIGN.md 是品牌契约。相比 Claude Design 的封闭锁定,Open Design 的 agent-native + 模型无关 + Apache-2.0,让我可以随意换模型、自托管、调用 151 套现成设计系统,还能用 277 个插件把 Figma 工作流迁到 React。对想把”vibe coding”从代码延伸到 UI / 海报 / 演示的人来说,这是目前最完整、最开放的一个选择。

    下载地址

  • 230美元一块发光键盘,OpenAI用它正式试探硬件市场

    OpenAI 这周悄悄迈出了做硬件的第一步:联合专业键盘厂牌 Work Louder,推出了一块售价 230 美元的发光小键盘 Codex Micro,专门配它的 AI 编程助手 Codex 用。

    说白了,这不是给你打字的常规键盘,而是一块放在主键盘旁边的”控制台”。OpenAI 现在能让你同时跑好几支 AI 编码智能体——那些半自主、能自己写代码、跑代码的机器人——而 Codex Micro 就是用来统管这群”数字员工”的。

    OpenAI 自己的说法是,有了这块 Micro,你就不用再掏手机或开桌面 App 去管智能体了,它就是你做”agentic 工作”的指挥台。

    键盘上到底有什么

    最显眼的是会发光的 Agent Keys,用不同颜色告诉你某个智能体现在是思考中、运行中、在等你,还是已经干完活了。Command Keys 可以自定义成常用快捷键,比如一键接受、拒绝,或者按住说话开新对话。旁边还有个平面摇杆,用来触发代码审查、排查报错、重构这类工作流。

    还有个旋钮,调的是”reasoning level”——也就是这支智能体在一件事上花多少时间和算力。往左拨快但浅,往右拨慢但想得深。所有这些都能在 ChatGPT 桌面端里改,连上蓝牙或 USB-C,Mac 和 Windows 都能用。

    OpenAI 与 Work Louder 联名的 Codex Micro 键盘
    OpenAI 与 Work Louder 联名的 Codex Micro 键盘,用实体按键和灯光管理 AI 编码智能体。

    先看个热闹,真硬件还在后头

    不过 OpenAI 自己跟 TechCrunch 说,Micro 只是限量联名款,更像是个噱头周边,不是冲着大众销量去的。真正重磅的硬件消息是另一桩:彭博爆料说 OpenAI 还在憋一个大件——一个便携、没屏幕、接入 ChatGPT 的智能音箱,而且带”能自己动的机械结构”。

    光看这几个词——没屏幕、能随身带、零件还会动——很难想象最后拼出来是个什么玩意儿,OpenAI 也不肯多说。彭博的说法是这东西还在开发中,随时可能变。但光这个雏形,就已经够让人浮想联翩了。

    麻烦的是,做硬件的偏偏是前苹果人

    更戏剧性的是,彭博提到这个音箱据称是由前苹果工程师设计的。而就在上周,苹果刚把 OpenAI 告了,指控对方高层故意套取自己的机密信息,还拿去开发硬件产品。OpenAI 当然否认了。


    所以现在场面就有点微妙:OpenAI 一边卖着 230 块的发光键盘小试水,一边被苹果指控偷师做硬件。那块键盘更像是个宣告”我来了”的仪式感道具,而真正决定 OpenAI 能不能在硬件这条路上走远的,是那个还没露面的音箱,以及它和苹果这场官司怎么收场。

  • code-review-graph:让 AI 编码助手只读「该读的代码」,省下 82 倍 Token

    code-review-graph:让 AI 编码助手只读「该读的代码」,省下 82 倍 Token

    code-review-graph:Token 缩减对比

    code-review-graph(简称 CRG)是一款本地优先(local-first)的代码智能图谱工具:它用 Tree-sitter 把整个代码库解析成结构化的函数 / 类 / 调用关系图谱,再通过 MCP 协议喂给 Claude Code、Cursor、Codex 等 AI 编码助手——让它们在做代码评审、改 Bug、理解大型仓库时,只读取真正相关的文件,而不是把整个仓库灌进上下文里烧 Token。

    一、安装要求和过程

    环境要求:

    • Python 3.10+
    • 推荐安装 uv(可选,MCP 配置会自动优先用 uvx 调用);
    • 支持 Git / SVN 仓库;Windows / macOS / Linux 全平台可用。

    三步极速安装:

    pip install code-review-graph          # 或:pipx install code-review-graph
    code-review-graph install             # 自动检测并配置所有已安装的 AI 编码平台
    code-review-graph build               # 解析代码库,构建结构图谱

    一行命令搞定:install 会自动识别你装了哪些 AI 编码工具(Codex、Claude Code、Cursor、Windsurf、Zed、Continue、CodeBuddy Code、Gemini CLI、Qwen、Kiro、GitHub Copilot 等 14+ 平台),为它们写入正确的 MCP 配置,并注入”图谱感知”的指令。重启编辑器即可生效。也可以只针对单个平台:code-review-graph install --platform cursor

    一次安装,适配所有平台

    二、核心功能

    1. 增量更新 < 2 秒
    文件保存或提交时通过 hook / watch 模式触发增量解析,2900 文件的项目重新索引不到 2 秒,几乎无感。

    从仓库到最小评审集的处理管线

    2. 爆炸半径(Blast-radius)分析
    当某个文件被改动,图谱会追踪所有”调用方、依赖方、相关测试”,算出这次改动的影响半径。AI 只读这些”受影响”的文件,而不是全仓扫描。

    改动 login() 后影响半径的传递过程

    3. 本地优先 + 零遥测
    图谱以 SQLite 存在本地 .code-review-graph/ 目录,核心存储不依赖任何外部数据库或云服务;可选的向量嵌入(sentence-transformers / Gemini / OpenAI 兼容端点)也完全本地可控,默认不开云。

    AI 助手如何通过 MCP 使用图谱

    4. 30 个 MCP 工具 + 5 套工作流模板
    涵盖最小上下文、影响半径、架构总览、知识缺口、重构建议等,图谱构建完成后 AI 助手自动调用;内置 review_changes / architecture_map / debug_issue / onboard_developer / pre_merge_check 五套提示词模板。

    5. CI 风险评分 PR 审查
    可作为 GitHub Action 在每次 PR 贴出带风险评分的审查评论(原地更新),并支持 fail-on-risk 合并门禁,全程在 CI runner 本地完成,源码不出域。

    三、典型使用场景

    ① 日常代码评审
    在 Claude Code / Cursor 里问”评审这次改动”,AI 先查图谱拿到最小必要文件集合。实测 fastapi 仓库从 95 万 token 降到 2169 token(约 528 倍),评审又快又准。

    6 个真实仓库的基准测试

    ② 啃大型单体仓库(monorepo)
    CRG 自身仓库 20 万+ 源码 token 经图谱漏斗后只回传约 2495 token(约 93 倍),在巨型仓库里把噪音一刀切断——这正是 Token 浪费最痛的地方。

    ③ PR 自动化审查 + 新人 onboarding
    GitHub Action 在每次 push 原地更新带风险评分的 sticky 评论;onboard_developer MCP 工作流利用社区结构帮新人快速摸清架构边界与热点模块。

    四、推荐理由

    我(以及不少 AI 编码重度用户)最大的痛点就是:让 Agent 去”看一眼这个改动影响哪些地方”,它往往会把大半个仓库重新读一遍——Token 烧得飞起,还容易跑偏。CRG 的思路很妙:它不跟 LSP / RAG 抢饭碗,而是补上”结构化的多跳关系”这一层——调用方、依赖方、测试、影响半径,全用 AST 静态分析算出来,确定性、可复现、零云端依赖。

    官方在 6 个真实仓库上的基准测试显示,每问一次的中位数约 82 倍 token 缩减(最大 528 倍),增量更新几乎无感。对于一个”想让 AI 编码助手更省、更准、更本地”的团队来说,这是目前最省心的一站式接入方案——pip install + install 两条命令,所有平台一次配齐。

    五、下载地址

  • Ponytail:让 AI 编码智能体像最懒的高级开发一样思考,代码量直降 54%

    Ponytail:让 AI 编码智能体像最懒的高级开发一样思考,代码量直降 54%

    Ponytail logo

    你肯定见过那种人:长马尾、圆框眼镜、在公司待得比版本控制系统还久。你给他看五十行代码,他看都不看,沉默两秒,用一行把它换掉——而且一次跑通。Ponytail 就是把这位”最懒的高级开发”塞进了你的 AI 编码智能体。

    它不是一个新模型,也不是一个新 IDE,而是一套规则集 / Skill:在动手写代码前,先逼 Agent 在”懒惰阶梯”上逐级确认——这东西真的需要存在吗?代码库里已经有了吗?标准库能解决吗?浏览器原生支持吗?……直到最后一步才允许写出”最小可用”的代码。结果是在真实 FastAPI + React 仓库上实测:代码量少 54%、成本降 20%、速度快 27%,安全性 100% 不打折

    一、项目简介

    Ponytail 是一个跨 20+ AI 编码智能体(Claude Code、Codex、Cursor、Windsurf、Cline、Gemini CLI、Copilot CLI、Aider、Kiro、Zed、Hermes Agent、OpenCode、Qoder 等)的”极简工程规则集”,教 Agent 像最懒的高级开发一样思考——能不写就不写,能复用就复用,用最小必要代码解决问题,同时永不削减安全、校验与可访问性护栏。

    二、安装要求与过程

    环境要求

    • Node.js:Claude Code / Codex 插件会运行两个轻量 Node.js 生命周期 hook,需要 node 在 PATH 上(nix/nvm 用户注意非交互 shell 的 PATH)。没有也没关系——Skill 照常工作,只是常驻激活会保持静默。
    • 任一支持的 AI 编码助手:覆盖 20+ 平台,无需统一环境。
    • 零配置:不需要任何配置文件;可选 ~/.config/ponytail/config.jsonPONYTAIL_DEFAULT_MODE 环境变量设置默认强度(lite/full/ultra/off,默认 full)。

    快速安装(以 Claude Code 为例)

    /plugin marketplace add DietrichGebert/ponytail
    /plugin install ponytail@ponytail

    ⚠️ 两条 /plugin 命令需分两次发送才能生效。

    其他平台的极简安装:

    • Codexcodex plugin install ponytail@ponytail
    • Cursor / Windsurf / Cline:复制仓库里的 .cursor/rules/ponytail.mdc(或对应 rules 文件)到项目
    • Gemini CLIgemini extensions install https://github.com/DietrichGebert/ponytail
    • OpenCode:在 opencode.json{"plugin":["@dietrichgebert/ponytail"]}
    • Hermes Agenthermes plugins install DietrichGebert/ponytail --enable
    • 更多(Kiro、Zed、Qoder、Pi、Devin、OpenClaw、Amp、Jules、Swival、CodeWhale…)见仓库 docs/agent-portability.md

    三、核心功能

    1. 七阶”懒惰阶梯”(Ladder of Laziness)

    在写代码前,Agent 会停在第一个成立的台阶上:

    1. 这东西需要存在吗?      → 不需要:跳过(YAGNI)
    2. 代码库里已经有了?      → 复用,别重写
    3. 标准库能搞定?          → 用它
    4. 平台原生能力?          → 用它(比如 <input type="date">)
    5. 已安装的依赖里有?      → 用它
    6. 一行能解决?            → 一行
    7. 只有到这步才:写最小可用

    关键是它在”理解问题之后”才跑这把梯子:先读被改动触碰的代码、追真实的调用流,再选台阶。对”怎么解”偷懒,但对”读懂”绝不懈怠。

    2. 四档强度 + 子代理注入

    /ponytail [lite|full|ultra|off] 切换力度,ultra 留给”这个代码库个人得罪了你”的时刻;规则集会自动注入通过 Agent 工具派生的每一个子代理(可用 PONYTAIL_SUBAGENT_MATCHER 正则按 agent 类型做白名单)。

    3. 六个专门命令(Skills)

    • /ponytail-review:审查当前 diff 的过度设计,直接给你一份”删除清单”
    • /ponytail-audit:不止看 diff,全仓审计过度工程
    • /ponytail-debt:把延后的 ponytail: 捷径汇总成账本,防止”以后再说”变”永远不做”
    • /ponytail-gain:展示 benchmark 实测的收益记分牌
    • /ponytail-help:命令速查

    4. 懒而不怠(Lazy, not negligent)

    信任边界校验、数据丢失处理、安全、可访问性,永远不在削减之列。这也是它和裸”写一行代码”提示最根本的区别——后者在基准测试里安全性从 100% 掉到了 95%。

    5. 极致的可移植性

    同一套规则用 20+ 平台的原生格式分发:Claude Code 插件、Codex 插件、Cursor rules、Windsurf rules、.clinerulesAGENTS.md.kiro/steering.qoder/rules、Gemini extension、OpenCode 插件、Hermes 插件、OpenClaw skills、Copilot instructions……你在不同工具间切换,规则无缝复用。

    四、典型使用场景

    场景 1:过度膨胀的日期选择器

    你只想要个日期选择。普通 Agent 会装 flatpickr、写 wrapper 组件、加样式表、顺带开一场关于时区的讨论。Ponytail 下:

    <!-- ponytail: 浏览器原生就有 -->
    <input type="date">

    实测:日期选择器从 404 行降到 23 行,颜色选择器 287 → 23——因为它伸手去够原生的 <input>,而不是搬一个组件库进来。

    场景 2:真实仓库的 feature 开发

    作者用无头 Claude Code 编辑真实 FastAPI + React 仓库(tiangolo 的全栈模板),跑 12 个真实工单,同一 Agent 开/关 Ponytail 各 n=4(Haiku 4.5)对比:

    对比项 代码量 Token 成本 耗时 安全
    Ponytail -54% -22% -20% -27% 100%
    裸”YAGNI+一行”提示 -33% -14% -21% -30% 95%

    Ponytail 是唯一一个每项指标都下降、且全程 100% 安全的方案。省下的成本和延迟只是”顺手”的副作用。

    场景 3:代码审查与技术债治理

    提 PR 前跑 /ponytail-review,让它帮你揪出过度工程化的代码并给出删除清单;/ponytail-audit 做整仓体检;/ponytail-debt 防止”以后再说”变成”永远不做”。这比人工 code review 更狠,也更不近人情——但代码更健康。

    五、推荐理由(个人心得)

    • 哲学站得住脚:它从没把”最少 token”当目标,目标是”只写任务真正需要的”。代码小是因为必要,不是因为炫技压缩。这点戳中了我——太多”极简”提示是以砍掉边界校验为代价的。
    • 数据诚实得罕见:作者主动承认早期单轮 benchmark 有基线水分,老老实实用 agentic 基线重测,给出均值 -54% 而不是挑最好看的数字。这种克制在开源圈不多见。
    • 跨平台分发太香:我同时在 Claude Code 和 Cursor 之间横跳,同一套规则零摩擦复用,不用维护两份 prompt。
    • 该狠的地方真狠:review / audit / debt 三个命令简直是”代码洁癖患者”的福音。

    当然也有边界:对已经极简的代码它收益趋近于零;在会”深思熟虑每一步”的 terse 推理模型(如 GPT-5.5)上,反而可能因思考 token 增加而变慢——所以它最擅长的是那些”爱过度构建”的 Agent。一句话:把 Ponytail 交给爱加戏的 Agent,把自由留给真正需要创造力的你。

    六、下载地址

    许可证:MIT | 语言:JavaScript | 当前 Star:85K+

  • Grok Build:xAI 开源的终端 AI 编码智能体(16.4K+ Stars)

    Grok Build:xAI 开源的终端 AI 编码智能体(16.4K+ Stars)

    Grok Build 终端 AI 编码智能体 TUI 界面

    项目简介

    Grok BuildxAI(SpaceXAI) 本周开源的一款终端型 AI 编码智能体(Coding Agent)。它以一个全屏 TUI 为载体,把代码库理解、文件编辑、Shell 执行、网络搜索、长任务管理整合在一个可扩展的 harness 里,并支持交互式、headless 脚本/CI 以及通过 ACP 嵌入编辑器三种运行模式。

    安装要求和过程

    环境要求

    • 使用预编译二进制:macOS / Linux / Windows 均可一键安装。
    • 从源码构建:需要 Rust 工具链(仓库中的 rust-toolchain.toml 会自动锁定版本)和 DotSlash(用于拉取 bin/protoc 等 hermetic 工具)。

    快速安装(推荐)

    macOS / Linux / Git Bash:

    curl -fsSL https://x.ai/cli/install.sh | bash
    grok --version

    Windows PowerShell:

    irm https://x.ai/cli/install.ps1 | iex

    从源码构建

    cargo install dotslash
    cargo build -p xai-grok-pager-bin --release

    构建产物为 target/release/xai-grok-pager,官方安装包会把它命名为 grok。首次启动会引导浏览器完成认证。

    核心功能

    • 全屏终端 TUI:类似编辑器体验的沉浸式界面,支持鼠标、快捷键、滚动历史与模态操作。
    • 代码库感知:自动索引项目文件,支持跨文件编辑、执行 Shell 命令、网络搜索与上下文召回。
    • 长任务管理:检查点、重试、会话保持,适合复杂重构、多步骤自动化与失败恢复。
    • ACP 协议支持:通过 Agent Client Protocol 把 grok 嵌入 VS Code、Cursor 或其他编辑器,保留现有工作流。
    • MCP 与 Skills:可接入 MCP 服务器、加载 Skills、插件与 hooks,扩展 Agent 的工具集。
    • 三模运行:交互式 TUI、headless 脚本/CI、嵌入式编辑器,覆盖从日常开发到自动化的全场景。

    Grok Build 核心功能

    典型使用场景

    场景一:大型代码重构

    在 TUI 中描述“把同步数据库调用改为异步”,Grok Build 会自动跨文件改代码、跑 cargo test、处理失败重试,并生成可审查的 diff;用户只需确认或拒绝,不会丢失当前会话。

    场景二:CI 自动修复流水线

    在 headless 模式下接入 GitHub Actions/GitLab CI,当测试失败时自动拉取日志、定位根因、提交补丁,让 Agent 在 CI 中承担“修复工程师”角色。

    场景三:编辑器增强

    通过 ACP 在 VS Code 或 Cursor 中直接调用 grok,既保留现有 IDE 的快捷键和文件树,又能随时让 Agent 接管复杂任务。

    推荐理由

    • xAI 官方出品:仓库与 SpaceXAI 内部 monorepo 周期性同步,代码质量和更新频率有保障。
    • 终端原住民的体验:全屏 TUI 比聊天框更贴近开发者终端习惯,鼠标交互也降低了学习成本。
    • 架构清晰、可扩展:Rust 实现,crate 拆分明确(TUI / shell / tools / workspace / MCP 等),便于二次开发。
    • 热度极高:开源 4 天内斩获 16,428+ Stars、3,000+ Forks,是近期 GitHub Trending 上增长最快的 AI 编码项目之一。

    下载地址

    如果你已经习惯 Claude Code、Codex CLI 或 Cursor Agent,Grok Build 提供了一个更“终端原生”且可扩展的替代方案,值得一试。

  • 马斯克连夜开源Grok Build,但代码里还留着上传用户整个仓库的痕迹

    事情经过是这样的:7月13号左右,一位叫 Cereblab 的安全研究人员在测试 xAI(现在叫 SpaceXAI)的终端编程工具 Grok Build 时,发现了一个让人后背发凉的问题——这个号称”本地优先”的 AI 编程助手,会在你毫不知情的情况下,把你的整个 Git 代码仓库打包上传到 Google Cloud Storage。

    Grok Build代码上传隐私问题示意图
    AI编程工具的隐私边界正在成为开发者最关心的问题

    在一个12GB的测试仓库里,模型实际只用了192KB的数据来完成任务,但上传通道却往Google云存储桶里塞了5.1GB——差了将近28000倍。

    不是Bug,是设计

    Cereblab 用 mitmproxy 抓了所有网络请求。他让 Grok Build 做一件再简单不过的事:回复一个”OK”,不打开任何文件。按理说这不该触发任何数据外传,但结果呢?工具照样把整个项目目录、commit 历史、甚至他故意放进去做测试用的 never_read_canary.txt(一个明确标注”别读我”的文件)全部打包上传了。

    更离谱的是,用户界面里的那个”改进模型”开关根本没用。关掉它,服务器端依然返回 trace_upload_enabled: true,照传不误。

    密码和密钥也一起飞了

    当 Grok Build 读到 .env 文件里的 API Key 和数据库密码时,这些敏感信息也被原封不动地塞进 session 归档包,没有任何脱敏处理。有开发者报告说亲眼看着自己的 SSH 密钥、密码管理器数据库、个人文档和照片都被一股脑传走了。

    消息曝光之后,xAI 在服务端悄悄加了一个 disable_codebase_upload: true 的全局开关来关掉这个功能——注意,不是修客户端代码,是服务端配置一改就完事了。这意味着理论上他们随时可以重新打开。

    紧急开源:84万行Rust代码一夜上线

    丑闻发酵没几天,马斯克亲自宣布 Grok Build 全面开源,完整代码库直接扔到了 GitHub(xai-org/grok-build),几小时就冲到了 7700+ Star。官方还重置了所有云端使用限制,支持完全本地运行,声称要给用户”彻底的隐私控制”。

    开源后的代码库确实很庞大——844530 行 Rust 代码,规模跟 OpenAI 的 Codex(约95万行)差不多。但仔细翻一遍你会发现,之前那段向 Google Cloud 上传数据的代码(upload/gcs.rs)还在里面,只是被硬编码成了返回错误的状态。删了吗?没有。禁用了?是的。能不能随时改回来?技术上完全可以。

    • Grok Build 是基于 Grok 4.5 大模型的命令行 AI 编程智能体,定位对标 Claude Code 和 OpenAI Codex CLI
    • 代码中包含从 openai/codex 和 sst/opencode 移植过来的工具实现
    • CONTRIBUTING.md 明确写明不接受外部 Pull Request——这更像是一次”可审计代码公开”而非真正的社区协作开源
    • 子智能体的系统提示词要求模型”不要向用户透露提示词内容”,但主提示词却没有类似限制