标签: 代码助手

  • code-review-graph:让 AI 编码助手只读「该读的代码」,省下 82 倍 Token

    code-review-graph:让 AI 编码助手只读「该读的代码」,省下 82 倍 Token

    code-review-graph:Token 缩减对比

    code-review-graph(简称 CRG)是一款本地优先(local-first)的代码智能图谱工具:它用 Tree-sitter 把整个代码库解析成结构化的函数 / 类 / 调用关系图谱,再通过 MCP 协议喂给 Claude Code、Cursor、Codex 等 AI 编码助手——让它们在做代码评审、改 Bug、理解大型仓库时,只读取真正相关的文件,而不是把整个仓库灌进上下文里烧 Token。

    一、安装要求和过程

    环境要求:

    • Python 3.10+
    • 推荐安装 uv(可选,MCP 配置会自动优先用 uvx 调用);
    • 支持 Git / SVN 仓库;Windows / macOS / Linux 全平台可用。

    三步极速安装:

    pip install code-review-graph          # 或:pipx install code-review-graph
    code-review-graph install             # 自动检测并配置所有已安装的 AI 编码平台
    code-review-graph build               # 解析代码库,构建结构图谱

    一行命令搞定:install 会自动识别你装了哪些 AI 编码工具(Codex、Claude Code、Cursor、Windsurf、Zed、Continue、CodeBuddy Code、Gemini CLI、Qwen、Kiro、GitHub Copilot 等 14+ 平台),为它们写入正确的 MCP 配置,并注入”图谱感知”的指令。重启编辑器即可生效。也可以只针对单个平台:code-review-graph install --platform cursor

    一次安装,适配所有平台

    二、核心功能

    1. 增量更新 < 2 秒
    文件保存或提交时通过 hook / watch 模式触发增量解析,2900 文件的项目重新索引不到 2 秒,几乎无感。

    从仓库到最小评审集的处理管线

    2. 爆炸半径(Blast-radius)分析
    当某个文件被改动,图谱会追踪所有”调用方、依赖方、相关测试”,算出这次改动的影响半径。AI 只读这些”受影响”的文件,而不是全仓扫描。

    改动 login() 后影响半径的传递过程

    3. 本地优先 + 零遥测
    图谱以 SQLite 存在本地 .code-review-graph/ 目录,核心存储不依赖任何外部数据库或云服务;可选的向量嵌入(sentence-transformers / Gemini / OpenAI 兼容端点)也完全本地可控,默认不开云。

    AI 助手如何通过 MCP 使用图谱

    4. 30 个 MCP 工具 + 5 套工作流模板
    涵盖最小上下文、影响半径、架构总览、知识缺口、重构建议等,图谱构建完成后 AI 助手自动调用;内置 review_changes / architecture_map / debug_issue / onboard_developer / pre_merge_check 五套提示词模板。

    5. CI 风险评分 PR 审查
    可作为 GitHub Action 在每次 PR 贴出带风险评分的审查评论(原地更新),并支持 fail-on-risk 合并门禁,全程在 CI runner 本地完成,源码不出域。

    三、典型使用场景

    ① 日常代码评审
    在 Claude Code / Cursor 里问”评审这次改动”,AI 先查图谱拿到最小必要文件集合。实测 fastapi 仓库从 95 万 token 降到 2169 token(约 528 倍),评审又快又准。

    6 个真实仓库的基准测试

    ② 啃大型单体仓库(monorepo)
    CRG 自身仓库 20 万+ 源码 token 经图谱漏斗后只回传约 2495 token(约 93 倍),在巨型仓库里把噪音一刀切断——这正是 Token 浪费最痛的地方。

    ③ PR 自动化审查 + 新人 onboarding
    GitHub Action 在每次 push 原地更新带风险评分的 sticky 评论;onboard_developer MCP 工作流利用社区结构帮新人快速摸清架构边界与热点模块。

    四、推荐理由

    我(以及不少 AI 编码重度用户)最大的痛点就是:让 Agent 去”看一眼这个改动影响哪些地方”,它往往会把大半个仓库重新读一遍——Token 烧得飞起,还容易跑偏。CRG 的思路很妙:它不跟 LSP / RAG 抢饭碗,而是补上”结构化的多跳关系”这一层——调用方、依赖方、测试、影响半径,全用 AST 静态分析算出来,确定性、可复现、零云端依赖。

    官方在 6 个真实仓库上的基准测试显示,每问一次的中位数约 82 倍 token 缩减(最大 528 倍),增量更新几乎无感。对于一个”想让 AI 编码助手更省、更准、更本地”的团队来说,这是目前最省心的一站式接入方案——pip install + install 两条命令,所有平台一次配齐。

    五、下载地址

  • Ponytail:让 AI 编码智能体像最懒的高级开发一样思考,代码量直降 54%

    Ponytail:让 AI 编码智能体像最懒的高级开发一样思考,代码量直降 54%

    Ponytail logo

    你肯定见过那种人:长马尾、圆框眼镜、在公司待得比版本控制系统还久。你给他看五十行代码,他看都不看,沉默两秒,用一行把它换掉——而且一次跑通。Ponytail 就是把这位”最懒的高级开发”塞进了你的 AI 编码智能体。

    它不是一个新模型,也不是一个新 IDE,而是一套规则集 / Skill:在动手写代码前,先逼 Agent 在”懒惰阶梯”上逐级确认——这东西真的需要存在吗?代码库里已经有了吗?标准库能解决吗?浏览器原生支持吗?……直到最后一步才允许写出”最小可用”的代码。结果是在真实 FastAPI + React 仓库上实测:代码量少 54%、成本降 20%、速度快 27%,安全性 100% 不打折

    一、项目简介

    Ponytail 是一个跨 20+ AI 编码智能体(Claude Code、Codex、Cursor、Windsurf、Cline、Gemini CLI、Copilot CLI、Aider、Kiro、Zed、Hermes Agent、OpenCode、Qoder 等)的”极简工程规则集”,教 Agent 像最懒的高级开发一样思考——能不写就不写,能复用就复用,用最小必要代码解决问题,同时永不削减安全、校验与可访问性护栏。

    二、安装要求与过程

    环境要求

    • Node.js:Claude Code / Codex 插件会运行两个轻量 Node.js 生命周期 hook,需要 node 在 PATH 上(nix/nvm 用户注意非交互 shell 的 PATH)。没有也没关系——Skill 照常工作,只是常驻激活会保持静默。
    • 任一支持的 AI 编码助手:覆盖 20+ 平台,无需统一环境。
    • 零配置:不需要任何配置文件;可选 ~/.config/ponytail/config.jsonPONYTAIL_DEFAULT_MODE 环境变量设置默认强度(lite/full/ultra/off,默认 full)。

    快速安装(以 Claude Code 为例)

    /plugin marketplace add DietrichGebert/ponytail
    /plugin install ponytail@ponytail

    ⚠️ 两条 /plugin 命令需分两次发送才能生效。

    其他平台的极简安装:

    • Codexcodex plugin install ponytail@ponytail
    • Cursor / Windsurf / Cline:复制仓库里的 .cursor/rules/ponytail.mdc(或对应 rules 文件)到项目
    • Gemini CLIgemini extensions install https://github.com/DietrichGebert/ponytail
    • OpenCode:在 opencode.json{"plugin":["@dietrichgebert/ponytail"]}
    • Hermes Agenthermes plugins install DietrichGebert/ponytail --enable
    • 更多(Kiro、Zed、Qoder、Pi、Devin、OpenClaw、Amp、Jules、Swival、CodeWhale…)见仓库 docs/agent-portability.md

    三、核心功能

    1. 七阶”懒惰阶梯”(Ladder of Laziness)

    在写代码前,Agent 会停在第一个成立的台阶上:

    1. 这东西需要存在吗?      → 不需要:跳过(YAGNI)
    2. 代码库里已经有了?      → 复用,别重写
    3. 标准库能搞定?          → 用它
    4. 平台原生能力?          → 用它(比如 <input type="date">)
    5. 已安装的依赖里有?      → 用它
    6. 一行能解决?            → 一行
    7. 只有到这步才:写最小可用

    关键是它在”理解问题之后”才跑这把梯子:先读被改动触碰的代码、追真实的调用流,再选台阶。对”怎么解”偷懒,但对”读懂”绝不懈怠。

    2. 四档强度 + 子代理注入

    /ponytail [lite|full|ultra|off] 切换力度,ultra 留给”这个代码库个人得罪了你”的时刻;规则集会自动注入通过 Agent 工具派生的每一个子代理(可用 PONYTAIL_SUBAGENT_MATCHER 正则按 agent 类型做白名单)。

    3. 六个专门命令(Skills)

    • /ponytail-review:审查当前 diff 的过度设计,直接给你一份”删除清单”
    • /ponytail-audit:不止看 diff,全仓审计过度工程
    • /ponytail-debt:把延后的 ponytail: 捷径汇总成账本,防止”以后再说”变”永远不做”
    • /ponytail-gain:展示 benchmark 实测的收益记分牌
    • /ponytail-help:命令速查

    4. 懒而不怠(Lazy, not negligent)

    信任边界校验、数据丢失处理、安全、可访问性,永远不在削减之列。这也是它和裸”写一行代码”提示最根本的区别——后者在基准测试里安全性从 100% 掉到了 95%。

    5. 极致的可移植性

    同一套规则用 20+ 平台的原生格式分发:Claude Code 插件、Codex 插件、Cursor rules、Windsurf rules、.clinerulesAGENTS.md.kiro/steering.qoder/rules、Gemini extension、OpenCode 插件、Hermes 插件、OpenClaw skills、Copilot instructions……你在不同工具间切换,规则无缝复用。

    四、典型使用场景

    场景 1:过度膨胀的日期选择器

    你只想要个日期选择。普通 Agent 会装 flatpickr、写 wrapper 组件、加样式表、顺带开一场关于时区的讨论。Ponytail 下:

    <!-- ponytail: 浏览器原生就有 -->
    <input type="date">

    实测:日期选择器从 404 行降到 23 行,颜色选择器 287 → 23——因为它伸手去够原生的 <input>,而不是搬一个组件库进来。

    场景 2:真实仓库的 feature 开发

    作者用无头 Claude Code 编辑真实 FastAPI + React 仓库(tiangolo 的全栈模板),跑 12 个真实工单,同一 Agent 开/关 Ponytail 各 n=4(Haiku 4.5)对比:

    对比项 代码量 Token 成本 耗时 安全
    Ponytail -54% -22% -20% -27% 100%
    裸”YAGNI+一行”提示 -33% -14% -21% -30% 95%

    Ponytail 是唯一一个每项指标都下降、且全程 100% 安全的方案。省下的成本和延迟只是”顺手”的副作用。

    场景 3:代码审查与技术债治理

    提 PR 前跑 /ponytail-review,让它帮你揪出过度工程化的代码并给出删除清单;/ponytail-audit 做整仓体检;/ponytail-debt 防止”以后再说”变成”永远不做”。这比人工 code review 更狠,也更不近人情——但代码更健康。

    五、推荐理由(个人心得)

    • 哲学站得住脚:它从没把”最少 token”当目标,目标是”只写任务真正需要的”。代码小是因为必要,不是因为炫技压缩。这点戳中了我——太多”极简”提示是以砍掉边界校验为代价的。
    • 数据诚实得罕见:作者主动承认早期单轮 benchmark 有基线水分,老老实实用 agentic 基线重测,给出均值 -54% 而不是挑最好看的数字。这种克制在开源圈不多见。
    • 跨平台分发太香:我同时在 Claude Code 和 Cursor 之间横跳,同一套规则零摩擦复用,不用维护两份 prompt。
    • 该狠的地方真狠:review / audit / debt 三个命令简直是”代码洁癖患者”的福音。

    当然也有边界:对已经极简的代码它收益趋近于零;在会”深思熟虑每一步”的 terse 推理模型(如 GPT-5.5)上,反而可能因思考 token 增加而变慢——所以它最擅长的是那些”爱过度构建”的 Agent。一句话:把 Ponytail 交给爱加戏的 Agent,把自由留给真正需要创造力的你。

    六、下载地址

    许可证:MIT | 语言:JavaScript | 当前 Star:85K+

  • Grok Build:xAI 开源的终端 AI 编码智能体(16.4K+ Stars)

    Grok Build:xAI 开源的终端 AI 编码智能体(16.4K+ Stars)

    Grok Build 终端 AI 编码智能体 TUI 界面

    项目简介

    Grok BuildxAI(SpaceXAI) 本周开源的一款终端型 AI 编码智能体(Coding Agent)。它以一个全屏 TUI 为载体,把代码库理解、文件编辑、Shell 执行、网络搜索、长任务管理整合在一个可扩展的 harness 里,并支持交互式、headless 脚本/CI 以及通过 ACP 嵌入编辑器三种运行模式。

    安装要求和过程

    环境要求

    • 使用预编译二进制:macOS / Linux / Windows 均可一键安装。
    • 从源码构建:需要 Rust 工具链(仓库中的 rust-toolchain.toml 会自动锁定版本)和 DotSlash(用于拉取 bin/protoc 等 hermetic 工具)。

    快速安装(推荐)

    macOS / Linux / Git Bash:

    curl -fsSL https://x.ai/cli/install.sh | bash
    grok --version

    Windows PowerShell:

    irm https://x.ai/cli/install.ps1 | iex

    从源码构建

    cargo install dotslash
    cargo build -p xai-grok-pager-bin --release

    构建产物为 target/release/xai-grok-pager,官方安装包会把它命名为 grok。首次启动会引导浏览器完成认证。

    核心功能

    • 全屏终端 TUI:类似编辑器体验的沉浸式界面,支持鼠标、快捷键、滚动历史与模态操作。
    • 代码库感知:自动索引项目文件,支持跨文件编辑、执行 Shell 命令、网络搜索与上下文召回。
    • 长任务管理:检查点、重试、会话保持,适合复杂重构、多步骤自动化与失败恢复。
    • ACP 协议支持:通过 Agent Client Protocol 把 grok 嵌入 VS Code、Cursor 或其他编辑器,保留现有工作流。
    • MCP 与 Skills:可接入 MCP 服务器、加载 Skills、插件与 hooks,扩展 Agent 的工具集。
    • 三模运行:交互式 TUI、headless 脚本/CI、嵌入式编辑器,覆盖从日常开发到自动化的全场景。

    Grok Build 核心功能

    典型使用场景

    场景一:大型代码重构

    在 TUI 中描述“把同步数据库调用改为异步”,Grok Build 会自动跨文件改代码、跑 cargo test、处理失败重试,并生成可审查的 diff;用户只需确认或拒绝,不会丢失当前会话。

    场景二:CI 自动修复流水线

    在 headless 模式下接入 GitHub Actions/GitLab CI,当测试失败时自动拉取日志、定位根因、提交补丁,让 Agent 在 CI 中承担“修复工程师”角色。

    场景三:编辑器增强

    通过 ACP 在 VS Code 或 Cursor 中直接调用 grok,既保留现有 IDE 的快捷键和文件树,又能随时让 Agent 接管复杂任务。

    推荐理由

    • xAI 官方出品:仓库与 SpaceXAI 内部 monorepo 周期性同步,代码质量和更新频率有保障。
    • 终端原住民的体验:全屏 TUI 比聊天框更贴近开发者终端习惯,鼠标交互也降低了学习成本。
    • 架构清晰、可扩展:Rust 实现,crate 拆分明确(TUI / shell / tools / workspace / MCP 等),便于二次开发。
    • 热度极高:开源 4 天内斩获 16,428+ Stars、3,000+ Forks,是近期 GitHub Trending 上增长最快的 AI 编码项目之一。

    下载地址

    如果你已经习惯 Claude Code、Codex CLI 或 Cursor Agent,Grok Build 提供了一个更“终端原生”且可扩展的替代方案,值得一试。

  • OpenWiki:让 AI 智能体为你的代码库自动写「活文档」的 CLI 工具

    OpenWiki:让 AI 智能体为你的代码库自动写「活文档」的 CLI 工具

    OpenWiki

    项目简介

    OpenWiki 是 LangChain 开源的命令行工具,专为 AI 智能体(Agent)设计,能自动为你的代码库或个人知识源生成并持续维护一份本地 Wiki(知识库)。它把分散在代码、邮件、笔记、社交动态里的信息,用 LLM 合成结构化、可检索、可被编码助手直接引用的文档。

    安装要求和过程

    环境要求

    • Node.js 运行环境(推荐用 npmpnpm 安装)。Windows 上建议避开 bun——它安装时需要本地编译 better-sqlite3 原生依赖,需先装 Visual Studio Build Tools(桌面开发 with C++ 工作负载)。
    • 至少一个 LLM 提供商的 API Key:开箱支持 OpenAI / Anthropic / Gemini / Vertex AI / AWS Bedrock / OpenRouter / Fireworks / NVIDIA NIM 等,默认模型 gpt-5.6-terra

    快速安装

    # 全局安装
    npm install -g openwiki
    # 或
    pnpm add -g openwiki

    快速开始

    # 代码模式:初始化并配置模型/Key,自动为当前仓库生成文档
    openwiki --init
    
    # 进入交互式 CLI,开始生成仓库 Wiki
    openwiki
    
    # 带初始指令一次性运行
    openwiki "Please generate documentation for this repository"
    
    # 更新文档(可放进 CI 定时跑)
    openwiki --update
    
    # 个人大脑模式:从 Gmail/Notion/X 等构建本地知识库
    openwiki personal --init

    OpenWiki 提供 两种模式Code 模式为当前代码库在 openwiki/ 生成仓库文档;Personal 模式从配置的本地仓库、Gmail、Notion、Web Search、Hacker News、X/Twitter 在 ~/.openwiki/wiki 构建”个人大脑”。配置与密钥保存在本地 ~/.openwiki/.env

    核心功能

    1. 双模式 Wiki:代码库 & 个人大脑

    代码模式下,OpenWiki 不仅生成 openwiki/ 目录的仓库文档,还会在仓库根目录维护 AGENTS.mdCLAUDE.md;个人模式则把 Git / Notion / Gmail / X / Hacker News / Web 统一 ingested 成一份本地可问答的知识库。

    2. 为 Agent 而生:把 Wiki 焊进编码助手

    OpenWiki 用 <!-- OPENWIKI:START -->…<!-- OPENWIKI:END --> 注释块向 AGENTS.md / CLAUDE.md 注入指引,且只改写自己的区块、不动你写的内容。结果是 Claude Code、Codex、Cursor 等编码智能体在检索上下文时会直接引用这份 Wiki,而不用把整页代码塞进上下文窗口,显著节省 token。

    3. 多连接器 Ingestion

    内置 git-repo / gmail / notion / x(Twitter) / web-search(Tavily) / hackernews 连接器,同一连接器可配置多个实例(如 web-search-1web-search-2),用 openwiki auth <provider> 完成 OAuth 登录。

    4. 全模型供应商兼容

    开箱支持 OpenAI(含 ChatGPT 订阅登录,免 API 计费)、Anthropic、Gemini(AI Studio)、Gemini Enterprise(Vertex AI)、AWS Bedrock(IAM 凭证)、OpenRouter、Fireworks、Baseten、NVIDIA NIM、以及任意 OpenAI 兼容端点;甚至支持自托管/代理网关的 ANTHROPIC_BASE_URLOPENAI_COMPATIBLE_BASE_URL

    5. CI 自动化 + 隐私友好

    提供 GitHub Actions / GitLab CI / Bitbucket 流水线模板,定时自动开 PR 更新文档;数据全部存于本地(本地优先),匿名遥测可一键关闭(OPENWIKI_TELEMETRY_DISABLED=1DO_NOT_TRACK=1)。

    典型使用场景

    场景一:团队代码库”活文档”

    openwiki-update.yml 放进 GitHub Actions,每次定时运行自动生成/更新仓库 Wiki 并开 PR。新成员和 AI 编码助手都能秒懂项目结构、模块职责与历史决策,告别”文档写完就过期”。

    场景二:个人知识大脑

    连接 Gmail、Notion、X、Hacker News 与本地 Git 仓库,OpenWiki 把它们合成一份可问答的本地 Wiki。想回顾某段技术讨论或某封邮件结论时,直接对话即可,知识不再散落各处。

    场景三:给编码 Agent 减负

    OpenWiki 把 Wiki 注入 AGENTS.md / CLAUDE.md 后,Claude Code 等智能体在动手改代码前会先读 Wiki,避免重复探索、显著降低上下文 token 消耗——这正是”代码库语义化”落地的关键一环。

    推荐理由(个人使用心得)

    “代码库语义化”是 2026 年 Agent 基础设施里最实在的刚需之一。OpenWiki 的巧思在于:它不只是一个文档生成器,而是把生成的 Wiki 直接焊进 AGENTS.md / CLAUDE.md——这是 Claude Code、Codex、Cursor 都会主动读取的文件。换句话说,它让 AI 编码助手在每次开工前自动带上项目上下文,而不是靠把整页源码塞进上下文窗口。

    TypeScript 写的单 CLI、MIT 协议、本地优先、数据不出机器,对个人开发者和注重隐私的团队都很友好;LangChain 出品也意味着模型兼容性与工程质量有保障。唯一的小门槛是需要自备 LLM Key,以及 Windows 上用 bun 装要额外编译原生依赖——用 npm/pnpm 则毫无障碍。如果你已经被”AI 改代码却不懂项目全貌”折磨过,值得一试。

    下载地址

  • Hallmark:一个”拒绝 AI 味”的设计技能,让 Claude Code / Cursor / Codex 产出不像模板套出来的页面

    Hallmark:一个”拒绝 AI 味”的设计技能,让 Claude Code / Cursor / Codex 产出不像模板套出来的页面

    Bubble 酸面团 App 首页,由 Hallmark 生成

    一、项目简介

    Hallmark 是由 Together AI 开源的一个「设计技能(Skill)」,专门给 Claude Code、Cursor、Codex 这类 AI 编程助手注入一套反”AI 味”(Anti-AI-slop)的设计规则:它会为目标自主挑选宏观结构、从 20 套主题中”着装”、跑 57 道”烂大街”检测闸门加一遍自检,让产出的页面彼此像不同的网站,而不是同一套模板换色。

    二、安装要求和过程

    环境要求:Node.js(用于 npx)、并安装 Claude Code / Cursor / Codex 中的任一 AI 编码助手;也可以纯拷贝文件手动安装,无需额外依赖。

    快速安装(推荐):

    npx skills add nutlope/hallmark

    随时重新运行即可更新到最新版本。若不想走 npx,也可手动把仓库里的 SKILL.md + references/ 拷贝到对应目录:

    • Claude Code~/.claude/skills/hallmark/
    • Cursor.cursor/rules/hallmark.mdc(取 SKILL.md 正文,无需 frontmatter)
    • Codex~/.codex/skills/hallmark/(个人)或 .codex/skills/hallmark/(项目级)

    三、核心功能

    1. 四大”动词”工作流:默认直接构建新 UI;audit 给现有代码打分挑刺(只列清单不改代码);redesign 推倒结构、保留文案/信息架构/品牌后重塑;study 从你欣赏的设计里提取”DNA”(宏观结构、字体配对、色彩锚点),并明确拒绝像素级抄袭与付费模板,可输出可移植的 design.md
    2. 57 道反 AI-slop 检测闸门 + 发布前自检:拒绝每个 LLM 都被训练进的”分布内默认项”——渐变紫、玻璃拟态、千篇一律的圆角卡片网格。
    3. 20 套主题 + 宏观结构引擎:针对每个 brief 自主挑选主题、结构与工艺,不同需求产出截然不同的页面形态,而非同一模板的换色。
    4. Custom 自定主题(新增):当创意意图超出目录主题时,切换为 Custom 从零设计——量身配色、字体与排版,同样受 57 道闸门约束,底层无模板。
    5. 自包含产物 + 可移植:每个页面都是独立的 HTML + CSS,并在 CSS 注释中盖戳宏观结构;study 还能导出 design.md 交给其他 AI 工具接力。

    Distil 内容抽取 API 首页Cold Snap 唱片厂牌 EP 首页

    左:Distil 内容抽取 API | 右:Cold Snap 唱片厂牌 —— 不同 brief,完全不同的气质

    四、典型使用场景

    1. 给新产品做落地页 / 官网原型:输入一句 brief(如”一个酸面团 App 的首页”),Hallmark 直接产出有独特气质的 hero 页,而不是 ChatGPT 默认那种蓝色渐变卡片。
    2. 给”AI 味”过重的现有页面做体检与改造:audit 给老页面打分列出顽疾清单,再用 redesign 保留文案与品牌、推翻结构重做,得到截然不同的”指纹”。
    3. 向优秀设计”借 DNA”而不抄袭:把竞品或灵感图的截图 / URL 喂给 study,提取其结构、字体与配色锚点用于自己的项目,且明确拒绝像素克隆与付费模板。

    五、推荐理由(个人使用心得)

    做 AI 辅助前端最破防的就是”一眼 AI 生成”——紫渐变、玻璃卡片、无限圆角。Hallmark 把资深设计师的”反套路直觉”固化成可复用的规则集,等于给编码助手配了个审美总监。它最妙的地方是”同样的指令、不同的 brief,产出像不同站点”,这对想快速产出有辨识度原型的独立开发者 / 小团队太香了。MIT 许可、一键 npx 安装、可移植 design.md,几乎零门槛。

    注意:它是”设计技能”而非独立 App,需要搭配 Claude Code / Cursor / Codex 使用;审美风格偏编辑 / 杂志 / 独立品牌感,若你要的是中规中矩的企业后台风,它可能”太有性格”。

    Cinder AI 推理工具首页

    六、下载地址

  • Spec Kit:GitHub 官方出品的「规格驱动开发」工具包,让 AI 编码助手先写规格、再写代码

    Spec Kit:GitHub 官方出品的「规格驱动开发」工具包,让 AI 编码助手先写规格、再写代码

    Spec Kit

    项目简介

    Spec Kit 是 GitHub 官方开源的规格驱动开发(Spec-Driven Development, SDD)工具包。它给 GitHub Copilot、Claude Code、Gemini CLI、Codex 等 30+ 款 AI 编码助手注入一套「宪法 → 规格 → 计划 → 任务 → 实现」的结构化工作流,让你在动手写代码之前,先把「要做什么、为什么做」想清楚、写明白——告别想到哪写到哪的「vibe coding」。

    安装要求和过程

    环境要求

    • 操作系统:Linux / macOS / Windows
    • Python 3.11 及以上
    • 包管理器:uv(推荐)或 pipx
    • Git
    • 一个受支持的 AI 编码助手(Copilot / Claude Code / Gemini / Codex 等 30+)

    快速安装步骤

    ① 安装 uv(详见 astral.sh/uv):

    # 参见 https://docs.astral.sh/uv/getting-started/installation/
    curl -LsSf https://astral.sh/uv/install.sh | sh

    ② 安装 Specify CLI(已发布到 PyPI):

    uv tool install specify-cli
    # 或从源码锁定版本:
    # uv tool install specify-cli --from git+https://github.com/github/spec-kit.git@v0.12.16

    ③ 初始化项目并选择你的编码助手:

    specify init my-project --integration copilot
    cd my-project

    ④ 在项目目录里启动 AI 编码助手,即可使用 /speckit.* 系列命令(Codex 等 skills 模式用 $speckit-*)。

    核心功能

    • 结构化 SDD 工作流:constitution(项目宪法)→ specify(需求规格)→ plan(技术方案)→ tasks(任务拆解)→ implement(实现),把「先写规格、再写代码」固化成可复用的标准流程。
    • 兼容 30+ AI 编码助手:Copilot、Claude Code、Gemini、Codex、Cursor 等,通过 slash 命令或 skills 模式无缝集成,一个工具链覆盖全团队。
    • 项目宪法(Constitution):/speckit.constitution 定义代码质量、测试标准、性能与体验等治理原则,在规格、计划、实现的每一环约束 AI 的决策。
    • 可扩展的扩展 / 预设 / 打包体系:extensions 增加新命令与能力,presets 改写模板与术语(如合规、安全门禁),bundles 一键部署「产品经理 / 安全研究员 / 开发者」等角色化工作流。
    • 离线可用 & 自管理升级:所有 consume/author 命令可针对本地或锁定源离线运行;specify self upgrade 一键升级到稳定版本,且安装幂等、仅作用于项目根目录。

    典型使用场景

    • 从零搭建应用(Greenfield):用一句话需求生成功能规格,再让 AI 按计划与任务清单逐步实现,避免「vibe coding」式的方向跑偏与大量返工。
    • 团队标准化研发流程:通过 presets 强制合规 / 安全的规格格式,用 bundles 给不同角色一键装配统一工具链,保证多人协作的产出口径一致、可追溯。
    • 遗留系统现代化(Brownfield):在已有项目中迭代加功能、做现代化改造;Spec Kit 工具更新与功能规格演进分离,支持平滑演进的 brownfield 循环。

    推荐理由

    用过 AI 编码助手的人大多有过这种体验:让它「帮我做个照片相册应用」,它啪一下甩出几百行代码,跑起来才发现需求理解错了、结构一团糟、改起来比自己写还累。Spec Kit 解决的正是这个痛点——它不替你思考,而是逼你把需求先写成规格

    我最看重三点:一是 Constitution 把团队的工程质量标准沉淀成可复用的「宪法」,AI 全程受它约束,产出更稳;二是 tasks 把大需求拆成可勾选的任务清单,每一步都有据可查、可回退;三是它足够——本质上只是个 CLI + 一组 slash 命令,没有重运行时,和 Claude Code / Copilot 配合几乎零摩擦。当然,它是一套「流程纪律」而非魔法:规格写得好不好,直接决定最终质量。把它当成一个让 AI「先审题再答题」的脚手架,体验会非常顺。

    下载地址

    * 本文数据来自 GitHub API,截至 2026-07-16;Spec Kit 由 GitHub 团队开源,采用 MIT 许可。

  • Graphify:把整个代码库变成 AI 可推理的知识图谱

    Graphify:把整个代码库变成 AI 可推理的知识图谱

    📌 项目简介

    Graphify 是一个开源的 AI 编程助手技能(Skill),用一条命令把你手头的代码库、SQL schema、论文 PDF、文档、截图甚至白板照片,全部解析成一张可查询的知识图谱。你的 AI 助手(Claude Code / Cursor / Codex / Gemini CLI / Aider 等 17 种)不再靠 grep 或模糊检索”猜”答案,而是沿着图谱里的真实路径推理——而且每条关系都可溯源、可审计。

    💻 安装要求和过程

    环境要求

    • Python 3.10+(解析与存储完全本地运行,无需任何服务器)
    • 任意一个支持的 AI 编程助手:Claude Code、Cursor、GitHub Copilot、OpenAI Codex、Gemini CLI、Aider 等(共 17 种),或任意 MCP 客户端
    • 联网(仅用于把文件送给你自己配置的模型,如 Claude / Ollama;代码本身不出本机)

    快速安装

    PyPI 上的包名暂时叫 graphifyy(两个 y),但命令与技能名仍然是 graphify

    pip install graphifyy
    graphify install        # 把技能注入你的 AI 助手

    然后在任意目录下打开你的 AI 助手,输入:

    /graphify .            # 对当前目录建图,代码 / 笔记 / 论文通吃

    Windows 若提示找不到命令,把 %APPDATA%\Python\Python3xx\Scripts 加入 PATH,或直接用 pipx install graphifyy;macOS 若报 externally-managed 错误同样改用 pipx 即可。

    ✨ 核心功能

    1. 全模态建图:万物皆可成节点

    支持代码(Python / TS / Go / Rust / Java / C++ 等 36 种 tree-sitter 语法)、文档(md / txt / rst)、论文 PDF,以及截图 / 流程图 / 白板照片 / 多语言文字图片(借助 Claude 视觉能力)。App 代码、数据库 schema、基础设施被统一进同一张图。

    2. 本地优先、零云端、零遥测

    解析在本地跑,图谱就是磁盘上的一个文件(graph.json),没有任何服务器在环、没有任何遥测上报。代码永远不会离开你的机器——对重视隐私和合规的团队尤其关键。

    3. 可审计的溯源:每条边都标明”怎么知道的”

    图谱里每一条关系都被打上 EXTRACTED(源码里实锤)、INFERRED(由结构与命名推理,通常靠谱但值得复核)、AMBIGUOUS(证据指向多于一方)三种标签。AI 回答时引用的是它走过的真实路径,而不是”凭感觉”。

    4. 17 个 AI 助手 + 自带 MCP Server

    一个技能可装进 17 种助手,并额外提供 MCP server:既可 stdio 单机服务,也能 HTTP 给整个团队共享。还附带 graphify prs 终端 PR 看板(CI 状态 / AI 分诊 / 合并冲突风险)。

    5. 自动同步:图谱跟着代码长

    --watch 后台实时重建(代码保存即时、文档 / 图片变化提醒你跑 --update);graphify hook install 还能装一个 git post-commit 钩子,每次提交后自动重建图谱,多 Agent 并行写码时图谱始终保持最新。

    Graphify 知识图谱可视化
    Graphify 将代码库映射为可交互知识图谱:节点=符号,颜色=自动识别的模块社区,大节点=God Node

    🎯 典型使用场景

    场景一:接手一个陌生代码库

    不用硬读 100 个文件——直接查 “god nodes”(连接度最高的符号,改动影响面最大),几分钟摸清架构与模块边界,新成员上手速度拉满。

    场景二:团队共享”谁负责什么”

    把 graph.json 提交进仓库,或用 graphify.serve 走 HTTP。新人问 “谁负责 billing?”,得到的是穿过真实代码的两条跳路径,而不是一周前的 Slack 聊天记录。

    场景三:给 AI 编程助手装”记忆”,省下海量 token

    官方基准:在 Karpathy 仓库 + 论文 + 图片的混合语料上,相比逐文件读取原始文件,每次查询 token 减少 71.5 倍;社区实测在 49.6 万 token 的代码库上省 79 倍,且零向量数据库。NOTE / WHY / HACK 注释还会变成可追查的图谱节点。

    💡 推荐理由

    我最早是被”用图谱替代 grep”这个点打动的。实际用下来,最戳我的是可审计——现在太多 RAG / 向量库方案给的是个不透明的相似度分数,你根本不知道 AI 为什么这么答;Graphify 把每条边都标了出处,你能直接点开源码第几行去验证。再加上纯本地、MIT、零账号零卡片,安全感拉满。它不算”重”的工具,装一个 skill、跑一条命令,就能让手头的 AI 编程助手从”猜”变成”走查”。如果你也受够了助手读不全代码、答非所问,值得一试。

    🔗 下载地址

  • Orca:把一整支 AI 编程舰队装进一个 IDE(并行 Agent 开发环境 ADE)

    Orca:把一整支 AI 编程舰队装进一个 IDE(并行 Agent 开发环境 ADE)

    Orca 并行 worktree 界面

    如果你已经离不开 Claude Code、Codex 这类编码智能体,却苦于在一堆终端窗口里来回切换、分支互相打架,Orca 就是为这种痛而生的。它自称 “The AI Orchestrator for 100x builders”,是一个开源(MIT)的 ADE(Agent Development Environment,智能体开发环境)——和传统 IDE 不同,Orca 不是给你一个人用的,而是给你和你的”一舰队”智能体一起用的。

    项目简介

    Orca 是一款跨桌面(macOS / Windows / Linux)与移动端(iOS / Android)的 Agent IDE,让你把 Claude Code、Codex、OpenCode、Cursor、Copilot、Gemini 等任意 CLI 智能体并排运行在各自独立的 git worktree 中,统一编排、跟踪与合并,还配了一个能在手机上远程监控和发指令的伴侣 App。

    安装要求和过程

    环境要求:

    • 桌面端:macOS 11+ / Windows 10+ / 主流 Linux 发行版;
    • 需自行准备至少一个编码智能体的订阅(Claude Code、Codex、OpenCode 等任一即可);
    • 移动伴侣:iOS 16+ 或 Android 8+;
    • 无头服务器场景可选:Linux 服务器 + orca serve

    快速安装:

    1. 桌面端直接下载安装包(或用包管理器):
    # macOS (Homebrew)
    brew install --cask stablyai/orca/orca
    
    # Arch Linux (AUR)
    yay -S stably-orca-bin
    
    # 或前往 https://onorca.dev/download 下载 dmg / exe / AppImage
    
    1. 打开 Orca,登录你的智能体订阅账号,新建 Workspace;
    2. (可选)手机安装 Orca 伴侣 App,扫码与桌面端配对;
    3. (可选)无头服务器:orca serve 启动远程 worktree 服务。

    核心功能

    • 并行 Worktrees:一条提示可扇出到 5 个智能体,各自在隔离的 git worktree 中独立干活,互不干扰,你只需对比结果、合并最优解——告别 stash 与分支打架。
    • 终端分屏:内置 Ghostty 级终端,WebGL 渲染、无限分屏、重启后滚动历史不丢,还支持全文搜索。
    • 设计模式(Design Mode):每个 worktree 附带真实 Chromium 窗口,点击任意 UI 元素即可把它的 HTML、CSS 和裁剪截图直接送进智能体提示,做前端迭代超顺手。
    • GitHub & Linear 原生集成:应用内浏览 PR、issue 和项目看板,从任务直接开 worktree 审查、合并,无需切上下文。
    • 移动伴侣:手机端实时看智能体状态、查用量、切换账号,智能体跑完推送通知,离开工位也能续命。

    Orca 终端分屏

    Orca Design Mode

    典型使用场景

    • 同一需求多智能体赛马:把”修复登录竞态”同时丢给 Claude Code 和 Codex,各自在独立 worktree 实现,再挑实现更干净的合并,质量与速度双增。
    • 远程算力 + 本地轻量:在强劲的云服务器上跑 orca serve,本地笔记本只做轻量操作,SSH worktree 自动重连、端口转发,CI 跑挂了也能随时续。
    • 通勤中远程续命:智能体在桌面端跑长任务,你在地铁上用手机伴侣看进度、发现走偏了直接发一句纠正指令,到家正好收工。

    推荐理由

    我自己的体感是:当你的工作流里同时养了 2 个以上编码智能体,纯终端 + tmux 的管理成本会指数上升——分支冲突、上下文丢失、账号切换最磨人。Orca 把”并行隔离 + 统一编排 + 移动可观测”这三件事打包成一个干净的应用,而且开源 MIT、自带 Ghostty 级终端和真实浏览器,比那些只包一层终端的 wrapper 完整太多。它不绑定任何一家模型厂商, bring-your-own-subscription 的思路也让成本可控。唯一门槛是它更偏”重环境”,轻度用户用终端就够了;但只要你开始”以舰队为单位”写代码,Orca 几乎是必装。

    下载地址

  • Matt Pocock’s Skills:给真工程师用的 AI 编程 Skill 合集(167K★,MIT)

    Matt Pocock’s Skills:给真工程师用的 AI 编程 Skill 合集(167K★,MIT)

    Matt Pocock Skills

    AI 编程助手很强,但常常「生成很强、理解很弱」——需求没对齐就开干、跑不通就乱试、代码越写越乱。Matt Pocock’s Skills 是 Total TypeScript 作者、TypeScript 圈大佬 Matt Pocock 把自己 .claude 目录里每天在用的工程技能开源出来的合集:不接管你的流程,而是把真实工程纪律封装成一组足够小、可改造、可组合的 Skill。

    一、项目简介

    Matt Pocock’s Skills 是一套面向「真工程师」的 AI 编程 Agent 技能库(Skills for Real Engineers),源自作者每天都在用的 .claude 配置,用几十个可组合的小技能把需求对齐、TDD、结构化调试、架构治理等工程纪律固化下来,而不是像 GSD/BMAD/Spec-Kit 那样「接管整个开发流程」。

    二、安装要求和过程

    环境要求

    • 任意支持 Agent Skills 标准的编程智能体:Claude Code、Codex、Gemini CLI、Cursor 等(skills.sh 安装器可覆盖 70+ Agent)
    • Node.js 环境(用于 npx 一键安装)
    • 零运行时依赖:纯 Markdown + Shell 技能,MIT 协议

    快速安装

    # 一行安装(从 skills.sh 拉取并按提示选择技能)
    npx skills@latest add mattpocock/skills
    
    # 或在 Claude Code 中使用 plugin marketplace 添加
    # 安装后即可用 /ask-matt 跳转开始

    三、核心功能

    1. 小而可组合的设计哲学:每个 Skill 都小到能读懂、能改、能删;不接管流程,把决策权留给人,避免重型框架的“流程自身出 bug 难查”。
    2. Grilling 柚问式访谈:动手前先对齐需求(/grill-me/grill-with-docs 会更新 CONTEXT.md 与 ADR),根治“Agent 没做你想要的事”。
    3. TDD + 结构化调试:把红绿重构和诊断纪律封装成可复用技能(/tdd/diagnose),让代码做出来就能跑。
    4. 共享语言与架构治理:通过 CONTEXT.md / ADR 建立团队共享术语,/improve-codebase-architecture 生成可视化 HTML 架构报告。
    5. 标准化、跨工具:遵循开放的 Agent Skills 标准,技能按调用方式分为 User-invoked(人工触发)与 Model-invoked(Agent 自动调用),通用于各编程智能体。

    四、典型使用场景

    • 新功能前需求对齐:用 /grill-me 把模糊想法柚问成清晰需求,再用 /to-issues 拆成工单、/to-prd 产出产品需氛文档,防止 Agent 跑偏。
    • 遇到诡异 Bug:不让 Agent 乱试,用 /diagnose 走结构化调试法,逐步定位根因。
    • 持续保持代码健康:编码时让 Agent 自动调用 /tdd 保持测试驱动,随时用 /improve-codebase-architecture 给代码层做体检并生成可视化报告。

    五、推荐理由

    我个人非常吃这套“真工程”路线。现在大量 Agent 框架走的是“接管流程”,一上来就把你的控制权收走,流程本身出了 bug 还难查。mattpocock/skills 反道而行:技能够小、够透明,你能读懂、能改、能删,把理解的过程交还给人和 Agent 之间的对话。对于已经有本地 Skill 体系的团队,它最适合的定位不是“替换”,而是“增强”。尤其推荐给被 Vibe Coding 耗到的同学——它是真正的 Real Engineering 和随便写代码之间的分野。

    六、下载地址

    文章配图来源:项目官方仓库 / Total TypeScript Cloudinary。本文由自动化任务采集整理,转载请注明出处。

  • Page Agent:阿里巴巴开源的“住在网页里的”GUI 智能体,一行脚本让网页自己动起来

    Page Agent:阿里巴巴开源的“住在网页里的”GUI 智能体,一行脚本让网页自己动起来

    Page Agent 项目横幅

    项目简介

    Page Agent 是阿里巴巴开源的一个运行在网页内部的 JavaScript GUI 智能体。只需一行脚本,就能让任意网页拥有自己的 AI 代理,用自然语言直接控制 Web 界面——点击按钮、填写表单、跳转页面,全部交给 AI 完成。项目当前已收获约 2.6 万 Star,采用 MIT 协议,主要使用 TypeScript 编写,运行时以纯前端 JavaScript 注入。

    “The GUI Agent Living in Your Webpage. One script gives any web page its own AI agent.”

    安装要求和过程

    环境要求

    • 任意支持 <script> 标签或 npm 的网页环境即可;
    • 无需浏览器扩展、Python 或无头浏览器,纯前端运行;
    • 如需自托管大模型,需一个可访问的模型 API(如通义千问 Qwen、本地模型等);
    • 使用 npm 安装 / 二次构建时需要 Node.js 环境。

    快速安装(三种方式)

    方式一:CDN 一行接入

    <script
        src="https://cdn.jsdelivr.net/npm/page-agent@1.12.1/dist/iife/page-agent.demo.js"
        crossorigin="anonymous"
    ></script>

    国内镜像:https://registry.npmmirror.com/page-agent/1.12.1/files/dist/iife/page-agent.demo.js

    方式二:NPM 安装

    npm install page-agent
    import { PageAgent } from 'page-agent'
    
    const agent = new PageAgent({
        model: 'qwen3.5-plus',
        baseURL: 'https://dashscope.aliyuncs.com/compatible-mode/v1',
        apiKey: 'YOUR_API_KEY',
        language: 'en-US',
    })
    
    await agent.execute('Click the login button')

    方式三:Chrome 扩展 —— 从 Chrome 网上应用店安装 Page Agent 扩展,用于跨多标签页的多页面任务。

    核心功能

    • 🎯 极简集成:纯页面内 JavaScript,不需要浏览器扩展、Python 或无头浏览器,几行代码即可嵌入。
    • 📖 基于文本的 DOM 操作:无需截图、不依赖多模态大模型或特殊权限,通过结构化 DOM 文本理解页面并执行操作。
    • 🧠 自带 LLM(BYO):支持绝大多数主流模型(含本地部署),模型选择完全自由。
    • 🐙 可选 Chrome 扩展:支持跨标签页的多页面任务编排。
    • 🔌 MCP Server(Beta):允许外部 Agent 客户端(如 Claude Code / Cursor)从外部控制你的浏览器。

    典型使用场景

    • SaaS AI Copilot:几行代码为自家产品嵌入 AI 助手,无需重写后端,立刻获得“对话式操作界面”能力。
    • 智能表单填充:把原本需要 20 步点击的流程压缩成一句话,特别适合 ERP / CRM / 后台管理系统等高频重复操作。
    • 无障碍访问:通过自然语言让任何 Web 应用变得可操作,配合语音 / 读屏为行动不便的用户打开大门。
    • 多页面自动化 / MCP 控制:借助 Chrome 扩展或 MCP Server,让 AI 跨页面完成复杂工作流(如比价、数据搬运)。

    推荐理由

    我第一次看到 Page Agent 时最直接的感受是:它把“浏览器自动化”这件事做得太轻了。传统方案(如 Playwright / Puppeteer 脚本、或无头浏览器方案)要么要写一堆选择器、要么要吃截图走多模态,门槛和成本都不低。Page Agent 反其道而行——它就活在页面里,用文本化的 DOM 理解来“读懂”界面,再用自然语言驱动操作,心智负担几乎为零。

    对前端 / 产品同学尤其友好:你想给后台加个“AI 帮我导这份报表”的入口,挂一段脚本就行,不用动架构。再加上它支持 BYO 模型、可接本地大模型,数据不出内网也能玩。如果你正琢磨怎么给产品接一个“会自己点页面”的 AI,Page Agent 是目前最省心、最贴近生产的选择之一。

    下载地址