标签: Apache许可

  • ZeroClaw:32K Stars 的 Rust 全自主 AI 个人助手基础设施,单二进制部署、30+通道接入、还能直控硬件

    ZeroClaw:32K Stars 的 Rust 全自主 AI 个人助手基础设施,单二进制部署、30+通道接入、还能直控硬件

    ZeroClaw 官方 Banner

    项目简介

    ZeroClaw 是一个用 Rust 编写的全自主 AI 个人助手基础设施——一个单二进制的智能体运行时(Agent Runtime),口号非常硬核:「You own the agent. You own the data. You own the machine it runs on.」(智能体是你的,数据是你的,跑它的机器也是你的)。它对接 Anthropic、OpenAI、Ollama 等约 20 家模型提供商,通过 Discord、Telegram、Matrix、邮件、语音、Webhook 等 30+ 消息通道与你交互,并能调用 Shell、浏览器、HTTP、硬件(树莓派 GPIO!)和自定义 MCP 服务器执行任务。整个系统跑在你自己的机器上,用你自己的密钥。项目 2026 年 2 月创建,短短 5 个多月即斩获 32,400+ Stars,由 Harvard、MIT、Sundai Club 社区孵化,是当前 GitHub 上最火的 Rust AI 基础设施项目之一。

    安装要求和过程

    环境要求

    • 操作系统:Linux / macOS / Windows / FreeBSD / NixOS / Docker 全平台支持,也可跑在树莓派等硬件上
    • Rust:仅源码构建需要(Rust Edition 2024);官方提供预编译二进制,无需工具链
    • 磁盘占用:minimal 内核精简版仅约 6.6 MB
    • 模型来源:任一 LLM 提供商 API Key,或本地 Ollama(完全离线可用)

    快速安装

    # 一键安装(自动选择预编译二进制,失败则回退源码构建)
    curl -fsSL https://raw.githubusercontent.com/zeroclaw-labs/zeroclaw/master/install.sh | bash
    
    # 或克隆后安装(可交互选择功能特性)
    git clone https://github.com/zeroclaw-labs/zeroclaw.git
    cd zeroclaw && ./install.sh
    
    # 常用安装选项
    ./install.sh --preset minimal     # 仅内核精简版(约6.6MB)
    ./install.sh --prebuilt           # 强制使用预编译二进制
    ./install.sh --source --features agent-runtime,channel-discord  # 自定义特性

    快速上手

    zeroclaw quickstart        # 一站式引导:选择模型提供商、生成可用配置
    zeroclaw agent -a <alias>  # 与指定智能体交互式对话
    zeroclaw service install   # 注册为 systemd/launchctl/Windows 服务
    zeroclaw service start     # 后台常驻运行

    所有配置集中在一个 TOML 文件(~/.zeroclaw/config.toml),provider、channel、agent、安全策略全部声明式定义。

    核心功能

    • 多通道统一接入:Discord、Telegram、Matrix、邮件、语音、Webhook、CLI 等 30+ 通道适配器,所有入站消息汇入同一个智能体循环——一个 Agent 在所有平台回复你
    • 模型提供商无关:可插拔接入 Anthropic、OpenAI、本地 Ollama 及任意 OpenAI 兼容端点,支持故障回退链与智能路由,某家 API 抽风时自动切换保持在线
    • 安全优先架构:默认「supervised」监督模式——中风险操作需审批、高风险直接拦截;工作区边界、命令策略、OS 级沙箱(Landlock / Bubblewrap / Seatbelt / Docker)、每次工具调用都有密码学签名回执(Tool Receipts);开发机可切 YOLO 模式放飞
    • 硬件直控能力:通过 Peripheral trait 支持树莓派、STM32、Arduino、ESP32 的 GPIO / I2C / SPI / USB——让 AI 助手直接操控物理世界
    • SOP 事件引擎 + 网关面板:MQTT / Webhook / Cron / 外设事件触发标准作业流程(含审批门与断点续跑);HTTP/WebSocket 网关自带 Web 仪表盘,可视化管理聊天、记忆、配置与定时任务;还支持 ACP 协议接入 IDE

    典型使用场景

    1. 7×24 小时私人 AI 管家:注册为系统服务常驻后台,你在 Telegram 上问它日程、在邮件里让它整理附件、在 Discord 里让它跑脚本——同一个大脑,全渠道待命,数据永不出你的服务器
    2. 智能家居 / 硬件自动化中枢:跑在树莓派上直控 GPIO 传感器与继电器,配合 SOP 引擎实现「温度超标→MQTT 触发→AI 判断→自动开风扇并通知你」这类带审批门的物理世界自动化
    3. 企业内网离线 AI 运维助手:搭配本地 Ollama 全离线部署,利用命令策略与 OS 级沙箱严格限权,工具回执提供完整审计链——在合规敏感环境中安全落地 AI 自动化

    推荐理由

    试用下来最大的感受是「克制而完整」。市面上的个人 AI 助手项目大多是 Python 全家桶+一堆依赖,而 ZeroClaw 是一个 Rust 单二进制,最小 6.6MB,装完即跑,树莓派上也轻松常驻。它的安全设计诚意十足:默认监督模式、OS 级沙箱、每个工具调用带密码学回执,这在同类项目中相当罕见——大多数 Agent 框架是「先跑起来再说」,它是「先关进笼子再放权」。多通道统一智能体循环的设计也很优雅:不是每个平台一个 Bot,而是一个智能体在所有渠道等你。如果你想要一个真正属于自己、数据不外流、还能摸到硬件的 AI 助手,这可能是目前最工程化的开源答案。MIT/Apache-2.0 双许可,商用无忧。注意:官方特别提醒有仿冒仓库/域名,认准唯一官方仓库 zeroclaw-labs/zeroclaw。

    下载地址

    项目数据:32,420+ Stars | 4,847 Forks | Rust | MIT OR Apache-2.0 双许可 | 创建于 2026 年 2 月

  • Impeccable:50.9K Stars!专治AI生成界面的「AI味」,让Claude Code、Cursor真正懂设计的开源设计语言

    Impeccable:50.9K Stars!专治AI生成界面的「AI味」,让Claude Code、Cursor真正懂设计的开源设计语言

    Impeccable 官方封面

    项目简介

    Impeccable 是由前 Google 开发者布道师 Paul Bakaus 开源的一套「让 AI 编码工具更擅长设计」的设计语言系统——它以 1 个 Skill + 23 个设计命令 + 60 条确定性检测规则 + 设计钩子的形式,接入 Claude Code、Cursor、Codex CLI、Gemini CLI、GitHub Copilot 等十余种 AI 编程工具,专治 AI 生成前端界面千篇一律的「AI 味」(Inter 字体、紫蓝渐变、卡片套卡片……)。项目 2025 年 11 月发布,目前已斩获 50,900+ Stars,今日仍在 GitHub 趋势榜上持续攀升。

    Impeccable GitHub 仓库卡片

    安装要求和过程

    环境要求

    • Node.js 环境(使用 npx 安装,无需全局依赖)
    • 任意受支持的 AI 编程工具:Claude Code、Cursor、Codex CLI、Gemini CLI、GitHub Copilot、OpenCode、Grok Build、Trae、Qoder 等 13+ 种
    • CLI 与浏览器扩展的检测器无需 API Key 即可运行

    快速安装

    # 方式一:CLI 一键安装(推荐,在项目根目录执行)
    npx impeccable install
    
    # 非交互式安装:指定工具与作用域
    npx impeccable install --providers=claude,cursor --scope=project
    
    # 更新到最新版本
    npx impeccable update
    
    # 方式二:作为 Claude Code 插件安装
    /plugin marketplace add pbakaus/impeccable
    
    # 方式三:Git Submodule 方式
    git submodule add https://github.com/pbakaus/impeccable .impeccable
    npx impeccable link --source=.impeccable --providers=claude,cursor

    安装后重载你的 AI 编程工具即可。首次使用建议先运行 /impeccable init,它会引导生成 PRODUCT.mdDESIGN.md,把品牌与产品设计上下文固化到项目里。

    核心功能

    • 23 个设计命令,给 AI 一套共享设计词汇/impeccable craft(完整设计流程)、critique(UX 审查)、audit(技术检查)、polish(发布前终检)、bolder/quieter(视觉强化/降噪)、animate(动效)、colorize(配色)、typeset(字体排印)等,覆盖从规划到打磨的全链路;
    • 60 条确定性「AI 味」检测规则:精准狙击 AI 生成界面的通病——默认 Inter/Arial 字体、紫蓝渐变、纯黑纯白灰、卡片嵌套卡片、弹跳缓动动画等,同时检查行宽、触控热区等通用可用性指标,规则引擎零 LLM、零 API 成本;
    • 设计钩子(Hooks)自动拦截:在 Claude Code、Copilot、Codex、Cursor、Grok Build 上写入代码时自动运行检测器,发现严重设计问题可直接阻断坏代码写入,把关口前移;
    • PRODUCT.md / DESIGN.md 上下文固化:通过 initdocument 命令把品牌调性、产品定位写成文档,让 AI 每次生成都带着你的设计基因而非「出厂默认审美」;
    • 独立 CLI + 实时浏览器迭代npx impeccable detect src/ 可脱离 AI 工具独立扫描目录/文件/URL(支持 --json 输出接入 CI),/impeccable live 支持在浏览器里对界面变体做可视化迭代。

    典型使用场景

    1. Vibe Coding 项目去「AI 味」:用 Claude Code/Cursor 快速搭出的产品原型总是长着一张「AI 脸」?安装后运行 /impeccable init + /impeccable craft landing,让落地页拥有独特的品牌气质,摆脱紫渐变 + Inter 字体的流水线审美;
    2. 发布前的设计质量门禁:在 CI 中挂上 npx impeccable detect --json .,60 条规则自动检查行宽、对比度、触控区、动效缓动等问题;配合 /impeccable polish 做上线终检,把设计审查从「靠感觉」变成「有清单」;
    3. 无设计师团队的 UX 自助审查:小团队没有专职设计师?/impeccable critique checkout 可对结账流程做启发式 UX 审查,/impeccable harden 补齐错误态与边界场景,相当于给团队配了一位 AI 设计顾问。

    推荐理由

    我把 Impeccable 装进 Claude Code 用了几天,最大的感受是:它治的不是「AI 不会写前端」,而是「AI 写的前端都长一个样」。以前让 AI 改设计只能反复喊「好看一点、高级一点」,现在有了 bolderquieterdistill 这样的精确词汇,沟通成本断崖式下降——这正是「给人和 AI 建立共享设计语言」的价值。60 条确定性规则不烧 token、不用 API Key,钩子还能在坏代码写入前直接拦截,工程化程度远超一般的提示词合集。项目基于 Anthropic 官方 frontend-design skill 扩展,作者 Paul Bakaus 是 jQuery UI 创始人之一,设计与工程功底都过硬。Apache-2.0 协议,13+ 种 AI 编程工具通吃,做 AI 辅助开发的前端同学强烈建议装上。

    下载地址

    项目信息:50,900+ Stars | 2,998 Forks | JavaScript | Apache-2.0 许可证

  • Agno:41K Stars 的开源智能体平台框架,SDK+运行时+管理 UI 一站式自建你的 AI Agent 服务

    Agno:41K Stars 的开源智能体平台框架,SDK+运行时+管理 UI 一站式自建你的 AI Agent 服务

    Agno AgentOS 控制台
    Agno AgentOS:内置 Web UI 的智能体平台运行时

    Agnoagno-agi/agno)是一个用于构建、运行和管理「智能体平台(Agent Platform)」的开源框架与运行时,让你用一套 Python SDK 就能把 AI 智能体做成可上线的服务,并通过自带 Web UI 统一管理。截至发文,项目已在 GitHub 收获 41,400+ Stars,采用对商用友好的 Apache-2.0 许可。

    一句话简介

    Agno = Agno SDK(写智能体)+ AgentOS 运行时(跑成服务)+ AgentOS UI(可视化管理),让你完整拥有自己的智能体技术栈——数据、记忆、安全(JWT + RBAC)全部掌握在自己手里。

    安装要求与快速上手

    环境要求:Python 3.8+,建议使用虚拟环境;生产部署推荐 Docker + PostgreSQL(用于存储会话、记忆与追踪)。

    手写第一个智能体(约 20 行):

    # 1. 安装
    pip install -U agno openai
    
    # 2. 定义一个智能体
    from agno.agent import Agent
    from agno.models.openai import OpenAIChat
    
    agent = Agent(
        model=OpenAIChat(id="gpt-4o"),
        markdown=True,
    )
    
    # 3. 运行
    agent.print_response("用三句话介绍一下向量数据库", stream=True)

    一键搭平台:把下面这段话丢给你的编程助手(Claude Code / Cursor / Codex),它会自动 clone 启动模板、用 Docker 在本地拉起一个带 REST API、Postgres、MCP Server 和控制台的完整平台:

    Help me set up my agent platform.
    Clone https://github.com/agno-agi/agentos-railway into a folder called
    agent-platform, cd in, read the README, and follow the get started guide.

    核心功能

    • 生产级 API:AgentOS 运行时开箱提供 50+ 端点,支持 SSE 与 WebSocket,直接在其上构建产品。
    • 自有存储:会话、记忆、知识库与追踪数据全部存进你自己的数据库,不外泄。
    • 100+ 集成 & 上下文源:内置 GitHub、Slack、Postgres 等预制工具包,并可从 Slack、Drive、Wiki、MCP 等实时拉取上下文。
    • 企业级安全:基于 JWT 的 RBAC,原生支持多用户、多租户隔离;可对敏感工具设置人工审批(Human Approval)。
    • 全链路可观测:OpenTelemetry 追踪 + 运行历史 + 审计日志,配合定时任务(Cron 调度)与后台作业,无需额外基础设施。
    • 多渠道接入 & 随处部署:可将智能体暴露为 Slack / Telegram / WhatsApp / Discord / AG-UI / A2A 接口,并部署到 Docker、Railway、AWS、GCP、Azure 等任意容器平台。

    典型使用场景

    • 企业内部智能体平台:需要多租户隔离、权限控制与审计日志的团队,可用 Agno 快速搭建”自持”的 Agent 服务,避免把数据交给第三方 SaaS。
    • 面向用户的 AI 产品后端:借助 50+ REST 端点与流式接口,把智能体作为产品能力对外提供,前端只需消费 API。
    • 带人工审批的自动化工作流:在关键动作(如发邮件、改数据库)前暂停等待确认,兼顾自动化效率与可控性,适合运维、财务、客服等场景。

    推荐理由

    相比 LangChain 这类”全家桶”,Agno 的定位更清晰——它不只给你一个写 Agent 的库,而是把「运行时 + 管理 UI + 安全 + 可观测」这些上线时最头疼的工程问题一并解决。对于想把 Demo 真正推到生产、又不愿把数据主权交出去的团队,Agno 提供了一条”自建可控”的完整路径。SDK 上手快(20 行跑通),运行时功能齐全,配合 Docker 模板几乎零配置起步,是当下值得重点评估的智能体平台方案之一。

    下载与相关链接

  • Open Code Review:阿里巴巴开源的 AI 代码评审 CLI,Token 只用 1/9 却更精准

    Open Code Review:阿里巴巴开源的 AI 代码评审 CLI,Token 只用 1/9 却更精准

    如果你用过 Claude Code 之类的通用 Agent 做代码评审,大概率遇到过这些坑:改动一多就”偷工减料”只看部分文件、报出来的问题行号对不上、换个提示词质量就飘。Open Code Review(OCR) 是阿里巴巴刚开源的一款 AI 代码评审命令行工具,它把”确定性工程”和”Agent 动态决策”拧在一起,专门解决这些问题。项目上线不久便冲上 GitHub Trending,目前已收获约 12.2K Stars

    Open Code Review 功能亮点
    Open Code Review 功能亮点(图片来源:项目 README)

    一句话简介

    Open Code Review 是阿里巴巴开源的 AI 代码评审 CLI 工具——读取 Git diff,交给可配置的大模型 Agent 进行带工具调用的深度评审,产出行级精准的结构化评审意见。它源自阿里内部使用两年、服务数万开发者、累计发现数百万代码缺陷的官方评审助手,经大规模验证后开源。

    安装要求与快速上手

    环境要求

    • Git ≥ 2.41:OCR 依赖 Git 生成 diff、检索代码与仓库操作。
    • 支持 Windows / macOS / Linux 三大平台;需要配置一个大模型接口(OpenAI / Anthropic 兼容即可),或使用”委托模式”无需配模型。

    安装(npm 全局安装)

    npm install -g @alibaba-group/open-code-review

    安装完成后,全局即可使用 ocr 命令。也支持安装脚本、GitHub Release 二进制、源码编译等方式。

    配置模型

    # 选择内置服务商或添加自定义服务商
    ocr config provider
    # 为当前服务商选择模型
    ocr config model

    交互式界面会引导你完成服务商选择、API Key 填写与模型配置,并自动测试连通性。

    模型配置界面
    交互式模型配置界面(图片来源:项目 README)

    开始评审

    cd your-project
    
    # 工作区模式:评审所有暂存/未暂存/未跟踪的改动
    ocr review
    
    # 分支范围:对比两个 ref
    ocr review --from main --to feature-branch
    
    # 单个 commit
    ocr review --commit abc123
    
    # 整文件扫描:不看 diff,直接审阅整个仓库或指定目录
    ocr scan
    ocr scan --path internal/agent

    核心功能

    • 确定性工程 × Agent 混合架构:对”绝不能出错”的评审步骤(选文件、匹配规则、定位行号)用工程逻辑硬约束保证正确,把动态决策与上下文检索交给 Agent,各司其职。
    • 精准选文件 + 智能打包:明确判定哪些文件需评审、哪些应过滤;把关联文件(如中英两份 message 属性文件)打包为一个评审单元,每包作为隔离上下文的子 Agent 并发运行,在超大改动集上依然稳定。
    • 行级精准定位 + 反思模块:独立的评论定位与评论反思模块,系统性提升 AI 反馈的位置准确度与内容准确度,避免”行号漂移”。
    • diff 评审 + 整文件扫描ocr review 审阅改动,ocr scan 审阅整份文件——适合审计陌生代码库或没有有意义 diff 的目录。
    • 丰富集成能力:内置 MCP Server 扩展工具、CI/CD 集成(GitHub Actions / GitLab CI / Gerrit 等),并可作为 Skill 或插件接入 Claude Code、Codex、Cursor;浏览器端 Session Viewer 可回放评审过程。

    性能基准

    官方基于 50 个热门开源仓库、200 个真实 PR、10 种编程语言构建了真实世界评审基准,由 80+ 资深工程师交叉标注出 1505 个基准问题。结果显示:在同一底座模型下,OCR 的 准确率(Precision)与 F1 显著更高,而 Token 消耗仅约通用 Agent 的 1/9、评审更快;召回率略低,是”以精度换噪声”的有意取舍。

    性能基准对比
    在同一底座模型下的基准表现概览

    典型使用场景

    • 提交前自检:在本地 ocr review 一把,把行级问题在推送前就修掉,减少来回改 PR 的成本。
    • CI 流水线自动评审:接入 GitHub Actions / GitLab CI,对每个 PR 自动评审并留下行级评论,低 Token 成本让团队大规模跑得起。
    • 审计陌生代码库:接手老项目或第三方代码时用 ocr scan 整文件扫描,快速摸清 NPE、线程安全、XSS、SQL 注入等隐患。

    推荐理由

    市面上”给 Agent 套个 Skill 就当代码评审”的方案不少,但真正在工程上把稳定性做扎实的不多。OCR 最打动我的一点,是它没有一味迷信大模型,而是把”该确定的地方交给工程、该灵活的地方交给 Agent”这条边界划得很清楚——这正是它能在阿里内部大规模跑两年、且在基准上只花约 1/9 Token 就拿到更高精度的原因。对追求 CI 成本可控、又不想被误报刷屏的团队来说,这是个值得一试的选择。它还内置了针对 NPE、线程安全、XSS、SQL 注入等常见缺陷的微调规则集,开箱即用。

    下载地址

  • Buzz:Block 开源的”人机同室”协作平台,让 AI 智能体成为团队正式成员 | GitHub 今日 Trending 榜首

    Buzz:Block 开源的”人机同室”协作平台,让 AI 智能体成为团队正式成员 | GitHub 今日 Trending 榜首

    Buzz 项目频道:人与智能体在同一房间协调发布计划
    Buzz 项目频道:人与智能体在同一房间协调发布计划

    项目简介

    Buzz 是 Block, Inc.(Square/Cash App 母公司,也是知名开源智能体 goose 的东家)开源的一款「人类与 AI 智能体共处一室」的自托管协作工作空间——用一条 Nostr 签名事件日志,把聊天、代码评审、CI、工作流、审批和项目记忆统一到同一个 Relay 上,智能体和人拥有完全相同的操作界面与审计轨迹。今日登顶 GitHub Trending 榜首(单日 +2,100 星),目前已收获 7,600+ Stars,Rust 编写,Apache-2.0 许可。

    一句话概括:Slack + GitHub + CI 面板 + 自动化胶水代码,被压缩成一个你自己掌控的事件日志;智能体不再是”闹鬼的定时任务”,而是房间里的正式成员。

    一条签名事件日志,统一七种工具
    一条签名事件日志,统一七种工具

    安装要求和过程

    环境要求

    • 只想试用桌面应用:直接下载打包版,macOS(.dmg)/ Linux(.AppImage / .deb)/ Windows(.exe),无需任何依赖
    • 自托管 / 源码运行:Docker + Hermit(或 Rust 1.88+、Node 24+、pnpm 10+、just)
    • Windows 额外要求:安装 Git for Windows(智能体 Shell 工具依赖 Git Bash,可用 BUZZ_SHELL 指向其他 bash 兼容 Shell)

    快速安装

    方式一:下载安装包(最简单)

    GitHub Releases 下载对应平台安装包,像普通应用一样安装。默认连接 ws://localhost:3000,可通过 BUZZ_RELAY_URL 环境变量或应用内切换 Relay。

    方式二:源码构建 + 自托管(开发者路径)

    # 克隆并激活固定工具链(工具首次使用自动下载)
    git clone https://github.com/block/buzz.git && cd buzz
    . ./bin/activate-hermit
    
    # 一次性初始化:复制 .env、启动 Docker 服务 + 数据库迁移
    just setup && just build
    
    # 日常开发:同时启动 Relay + 桌面应用
    just dev
    

    Relay 跑在 ws://localhost:3000,桌面应用自动弹出。智能体侧设置 BUZZ_PRIVATE_KEY 后即可使用 buzz-cli(JSON 进 / JSON 出,为 LLM 工具调用而设计)。

    核心功能

    智能体是成员,不是机器人——像添加同事一样把智能体拉进频道
    智能体是成员,不是机器人——像添加同事一样把智能体拉进频道
    1. 智能体是”正式成员”而非外挂机器人——每个智能体持有自己的密钥、自己的频道成员身份、自己的审计轨迹,能开仓库、发补丁、评审代码、跑工作流、编辑画布、进语音房间,操作面与人类teammate完全一致,权限按身份而非标志位划分。
    2. 一条事件日志统一一切——消息、表情回应、工作流步骤、评审批准、Git 事件(NIP-34 补丁/仓库公告/状态)全部是同一形状的 Nostr 签名事件,同一身份模型、同一搜索索引、同一审计链。
    3. 分支即房间——开一个 feature 分支就自动生成一个频道,补丁、CI 结果、智能体首轮评审、同事表情反馈和最终合并决定都留在同一个房间里,”这段代码为什么存在”从此有据可查。
    4. YAML 工作流自动化——支持消息 / 表情回应 / 定时 / Webhook 四种触发器;一个 👍 表情就能作为审批门放行一次发布,且每一步都被签名、可搜索。
    5. ACP 智能体接入 + 完整的 Rust Crate 生态——buzz-acp 桥接 ACP↔MCP,官方已适配 goose、Codex、Claude Code;buzz-persona 提供智能体人格包;git-sign-nostr 实现 Nostr 签名的 Git 操作。桌面端 Tauri + React,后端 Postgres + Redis + S3/MinIO。
    Buzz 架构:Relay 是唯一事实来源
    Buzz 架构:Relay 是唯一事实来源

    典型使用场景

    1. 凌晨两点的事故记忆:线上报错,你在频道里问一句”这个错误以前见过吗?”,值守频道的智能体翻出六个月的历史,贴出相关线程、根因和修复记录,并主动提出呼叫上次修复的人——问、答、证据全部留在频道里。
    2. 会自己写发布说明的 Release:打 tag 触发工作流,智能体读取项目频道里合并的 PR,起草 Release Notes 发给人类审阅,收到 👍 表情后自动发布——每一步签名、每一步可搜索。
    3. 不交出”王国钥匙”的 Bug 分诊:让智能体在限定频道内分诊 Bug,它的密钥、成员身份和审计轨迹与人类隔离,像管理一个新同事一样管理它的可见范围,而不是给它一把全局 API Key。
    可讨论的媒体:评论钉在视频的具体帧上
    可讨论的媒体:评论钉在视频的具体帧上

    推荐理由

    我把 Buzz 跑起来体验后的最大感受是:它认真回答了”智能体在团队里应该以什么身份存在”这个问题。市面上的方案大多把 AI 塞进聊天工具当 bot,或者塞进 CI 当脚本,权限靠一堆 API Key 拼凑,出了事没法追溯。Buzz 的答案干脆利落——给智能体一把自己的密钥,让它跟人用同一套协议、进同一个房间、留同一种审计记录。

    值得注意的三点:一是出身硬,Block 是 goose 的东家,这套 ACP harness 直接兼容 goose/Codex/Claude Code,不是玩具;二是技术选型有味道,Nostr 协议的签名事件模型天然适合”人机同权”的审计需求,且不含任何区块链代币成分(README 原话:不用买纪念币);三是坦诚,README 明确列出”今天能用 / 正在接线 / 只有想法”三栏,移动端和推送还在路上。如果你的团队正被 Slack + GitHub + CI 面板 + 各种 bot 胶水折磨,这个”一个基底替代七个标签页”的赌注非常值得关注。

    下载地址


    项目数据(截至 2026-07-24):7,648 Stars · 608 Forks · 语言 Rust · 许可 Apache-2.0 · 创建于 2026-03 · 今日 GitHub Trending 榜首(单日 +2,100 星)

  • Outlines:15K Star 的 LLM 结构化输出库,让大模型 100% 生成合法 JSON

    Outlines:15K Star 的 LLM 结构化输出库,让大模型 100% 生成合法 JSON

    Outlines - LLM 结构化输出库

    项目简介

    Outlines 是由 .txt(dottxt)团队开源的 LLM 结构化输出(Structured Outputs)库——它在生成阶段就保证大模型输出严格符合你指定的类型或结构(枚举、整数、Pydantic 模型、JSON Schema、正则、上下文无关文法),从根源上消灭”解析失败、JSON 残缺”问题。项目在 GitHub 上已收获 15,200+ Stars,被 NVIDIA、Cohere、HuggingFace、vLLM 等信任并采用,vLLM 的 Structured Output 后端正是基于它的 outlines-core。

    一句话:别再用正则和 try/except 去”修补”模型输出了——Outlines 让模型从一开始就只能生成合法结构:model(prompt, output_type)

    安装要求和过程

    环境要求

    • Python 3.9+(建议 3.10 以上)
    • 按需选择后端:本地推理需 transformers / llama.cpp(配相应硬件),或走 vLLM / Ollama 服务端,或直接用 OpenAI / Gemini API(无本地算力要求)
    • 操作系统不限,CPU 也能跑(配合 API 或 Ollama)

    快速安装

    pip install outlines

    # 基础安装
    pip install outlines
    
    # 按后端安装可选依赖(示例)
    pip install outlines[transformers]   # 本地 transformers 模型
    pip install outlines[vllm]           # vLLM 服务
    pip install outlines[openai]         # OpenAI API

    30 秒上手

    import outlines
    from typing import Literal
    from transformers import AutoTokenizer, AutoModelForCausalLM
    
    MODEL = "microsoft/Phi-3-mini-4k-instruct"
    model = outlines.from_transformers(
        AutoModelForCausalLM.from_pretrained(MODEL, device_map="auto"),
        AutoTokenizer.from_pretrained(MODEL),
    )
    
    # 情感分类:输出只可能是这三个值之一
    sentiment = model(
        "Analyze: 'This product completely changed my life!'",
        Literal["Positive", "Negative", "Neutral"],
    )
    print(sentiment)  # "Positive"
    
    # 提取数值:保证返回合法 int
    temperature = model("What's the boiling point of water in Celsius?", int)
    print(temperature)  # 100

    核心功能

    Outlines 使用哲学:指定类型即可

    1. 类型即约束,贴合 Python 类型系统Literal 做多选一、int/float 做数值、Pydantic 模型/JSON Schema 做复杂对象、正则约束字符串格式、CFG 文法约束复杂语法——一行 model(prompt, type) 全部搞定。
    2. 生成期保证合法,而非事后修补:基于约束解码(constrained decoding),在每个 token 采样时就屏蔽非法选项,输出 100% 可被 model_validate_json 解析,不存在破损 JSON。
    3. 一套代码横跨所有模型:统一接口支持 transformers、llama.cpp(本地),vLLM、Ollama(服务端),OpenAI、Gemini(API),换模型/换供应商不改业务代码。
    4. 函数签名即 Schema 的 Function Calling:把 Python 函数直接当输出类型传入,Outlines 自动从签名推断结构,返回可直接 **kwargs 调用的参数字典。
    5. Jinja 提示词模板与可复用应用outlines.Template 把复杂 Prompt 从代码中分离,支持 few-shot 模板文件复用,方便工程化管理。

    典型使用场景

    1. 客服工单自动分诊

    把自由格式的用户来信一步解析为结构化工单(优先级枚举 / 类别 / 是否需主管介入 / 行动项列表),直接驱动自动路由与升级告警——priority 字段只可能是 low/medium/high/urgent 四个合法值,下游逻辑零防御代码。

    2. 电商商品自动归类与信息抽取

    批量把商品描述转成 主类目/子类目/属性列表/品牌 结构化数据,喂给库存和搜索系统;同理可做文档分类(财报/合同/技术文档)、事件信息抽取,甚至用 Union 类型优雅处理”信息不足则返回 I don’t know”的兜底。

    3. 生产级 Agent / RAG 管道的可靠胶水层

    Agent 的工具调用参数、RAG 的引用格式、多步工作流的中间态,全部用 Pydantic 模型锁死结构。vLLM 等推理引擎已内置其核心库,本地部署大模型时开启结构化输出几乎零成本。

    推荐理由

    使用 Outlines 的公司

    • 解决的是 LLM 工程化第一痛点:任何把 LLM 输出接入程序的人都被破损 JSON 折磨过。Outlines 的思路是”让非法输出根本不可能被生成”,比重试+修复的方案优雅一个量级。
    • 学习成本极低:会写 Python 类型注解就会用,10 分钟能跑通第一个例子;README 附 6 个可直接抄的生产级示例。
    • 学术与工业双背书:源自论文《Efficient Guided Generation for Large Language Models》,NVIDIA、HuggingFace、vLLM、Cohere 都在用,不是玩具项目。
    • Apache-2.0 宽松许可:商用无忧;核心 outlines-core 用 Rust 重写,约束编译速度快,生产可用。
    • 实测感受:约束解码对本地小模型提升尤其明显——Phi-3 这类 3B 级模型配合 Outlines 做分类/抽取,可靠性直逼裸用大一个数量级的模型,非常适合降本场景。

    下载地址


    项目信息(截至 2026-07-23):15,256 Stars · 809 Forks · Python · Apache-2.0 许可 · 由 .txt(dottxt-ai)团队维护