分类: 开源项目

专注盘点全网热门人工智能开源项目,涵盖大模型、智能应用、视觉算法、工具插件等领域,搭建教程与优化思路,助力开发者低成本学习实践。

  • Last 30 Days —— 由点赞、转发和真金白银评分的 AI 全网搜索引擎

    Last 30 Days —— 由点赞、转发和真金白银评分的 AI 全网搜索引擎

    项目简介

    /last30days 是一个 AI Agent 技能(Agent Skill),它能在 Reddit、X(Twitter)、YouTube、Hacker News、Polymarket、TikTok、arXiv、小红书等 19+ 个平台并行检索任意话题,按真实用户互动(点赞、转发、交易量)评分,再由 AI Agent 合成一份带引用的 30 天情报简报。

    它的核心理念是:“Google 聚合编辑,/last30days 搜索人”——每个平台都是围墙花园,但你可以自带钥匙,让一个 Agent 同时搜索所有平台,告诉你什么真正重要。

    工作流与安装

    核心功能

    • 19+ 信息源并行检索:Reddit(免 API Key)、X/Twitter、YouTube 全文转写、Hacker News、Polymarket 预测市场、GitHub API 实时数据、TikTok、Instagram Reels、arXiv 论文、Techmeme 科技新闻、Digg AI 1000 账号聚合、LinkedIn、Threads、Bluesky、StockTwits、小红书、Pinterest 等。社区贡献者持续添加新源。
    • 真实互动评分:1500 赞的 Reddit 帖 > 没人读的博客;$66K 交易量的 Polymarket 赔率 > 专家猜测;360 万播放的 TikTok > 新闻稿。社交相关性优先于 SEO 相关性。
    • 发现模式(Discovery Mode):输入 /last30days what's exploding in AI agents? 自动切换为话题发现引擎,扫描 Reddit 分类、HN 热帖、Digg AI 1000 feed 和 X,由 Agent 评审后输出 5-10 个动量排名话题。
    • 跨平台对比/last30days OpenClaw vs Hermes vs Paperclip 输出架构/记忆/安全/适用场景的并排对比表,Star 数实时从 GitHub API 拉取。
    • 零配置开箱即用:Reddit / HN / Polymarket / GitHub 无需任何 Key 即可使用;首次运行设置向导在 30 秒内解锁 X、YouTube、TikTok、arXiv 等更多源。
    19+ 信息源总览

    安装要求与过程

    环境要求:

    • Claude Code(推荐):自动通过 marketplace 更新
    • Node.js 18+(用于 npx skills 安装)
    • Python 3.10+(可选,用于脚本模式)
    • Grok Build CLI / OpenClaw(对应宿主)

    快速安装步骤:

    Claude Code(推荐):

    /plugin marketplace add mvanhorn/last30days-skill

    Codex / Cursor / Copilot / Gemini CLI 等 50+ Agent Skills 宿主:

    npx skills add mvanhorn/last30days-skill -g

    Grok Build CLI:

    grok plugin install mvanhorn/last30days-skill

    OpenClaw:

    clawhub install last30days-official

    安装后在任意项目中运行 /last30days <话题> 即可开始研究。首次运行会弹出配置向导,引导你解锁更多需要认证的信息源。

    典型使用场景

    • 会议前调研/last30days Peter Steinberger —— 不只是 LinkedIn 2023 年的旧资料,而是他本月加入 OpenAI Codex 团队、23 个 PR 以 85% 合并率合并、r/ClaudeCode 上 227 赞讨论的最新动态。
    • 招聘信号分析/last30days Listen Labs --hiring-signals —— 从招聘页面变化推断公司战略方向:是否在扩张企业安全、客户成功或基础设施团队。
    • 热点追踪/last30days what's exploding in AI agents? —— 发现模式下输出动量排名的新兴话题,每条附带跨平台数据和 /last30days "<话题>" 一键跟进命令。
    • 工具选型决策/last30days OpenClaw vs Hermes vs Paperclip —— 并排对比表 + 架构差异 + 适用场景,Star 数实时拉取而非过时博客数据。
    • 旅行规划/last30days Universal Epic Universe —— 社区真实反馈:哪些项目在建、排队时间多长、年票何时开放。

    推荐理由

    这个项目解决了一个 Google 和 ChatGPT 都无法解决的问题:跨平台的实时社会信号聚合。Google 不碰 Reddit 评论和 X 帖子;ChatGPT 有 Reddit 合作但搜不了 X 或 TikTok;Gemini 有 YouTube 但没有 Reddit。每个平台都是孤岛,而 /last30days 用 Agent 把它们桥接起来。

    54K+ Stars、175 个合并 PR(其中 122 个来自 52 位社区贡献者)、支持 50+ 编程助手宿主——这已经从一个个人工具成长为社区基础设施。对于需要快速了解任意领域最新动态的人来说,这是目前最全面的开源方案。

    下载地址

  • Claude Cookbooks:Anthropic 官方维护的 Claude 实战范例集(50K+ Stars)

    Claude Cookbooks:Anthropic 官方维护的 Claude 实战范例集(50K+ Stars)

    Claude Cookbooks

    Claude Cookbooks 是 Anthropic 官方在 GitHub 上开源维护的 Jupyter Notebook 范例集,已收获 50.4K+ Stars5.9K+ Forks,MIT 许可证。它像一本持续更新的”Claude 实战菜谱”,用可以直接复制运行的代码片段,手把手教开发者把 Claude API 用到生产里——覆盖文本分类、RAG、工具调用、Agent SDK、Skills、多模态、扩展思考、第三方集成等几乎所有主流场景。

    无论是刚接触 Claude API 的新手,还是要把 Claude 嵌入自家产品的资深工程师,都能在这里找到即拿即用的最佳实践。所有 Notebook 都用 Python 写成,但概念同样适用于任何支持 Claude API 的语言。

    Claude Cookbooks 内容地图

    为什么需要它?

    很多人第一次调用 Claude API 只能写出”问个问题拿个回答”的脚本——但生产里要面对的是:结构化输出、上下文管理、长文档解析、Agent 工作流、RAG 检索、工具调用循环、子智能体拆分…这些工程化能力的最佳范式,往往不是 API 文档里那几段示例能覆盖的。Cookbooks 正是 Anthropic 工程师团队把生产经验沉淀下来的”答案库”。

    安装要求和过程

    环境要求

    • Python 3.10+(项目用 uv 管理依赖)
    • Jupyter Lab / VS Code Jupyter 扩展
    • 一个 Anthropic API Key(前往 anthropic.com 免费注册)

    快速安装

    # 1. 克隆仓库
    git clone https://github.com/anthropics/claude-cookbooks.git
    cd claude-cookbooks
    
    # 2. 安装依赖(项目使用 uv,也可用 pip)
    pip install -r requirements-dev.txt
    # 或:uv sync
    
    # 3. 配置密钥
    cp .env.example .env
    # 编辑 .env 填入你的 ANTHROPIC_API_KEY
    
    # 4. 启动 Jupyter
    jupyter lab

    三步快速上手

    核心功能

    1. 基础能力 Recipes

    capabilities/ 目录里包含文本分类、RAG 检索增强、长文摘要、结构化 JSON 输出四大基础用法。每个 Recipe 都配了独立 Notebook,从最小调用示例一路演化到生产级实现。

    2. 工具调用与函数集成

    tool_use/ 演示了 Claude 如何调用外部工具——从最简单的计算器、SQL 查询,到完整的多步骤客服智能体。这是把 Claude 从”聊天机器人”升级成”可执行 Agent”的关键能力。

    3. Claude Agent SDK

    claude_agent_sdk/ 是新近加入的官方 Agent SDK 范例,示范如何用 Python SDK 构建可独立运行的智能体应用、调度工具、规划子任务。

    4. Agent Skills 技能系统

    skills/ 目录展示如何为 Claude 编写模块化技能——把专业能力封装成可复用的 Skills,让 Agent 在不同场景下按需调用。

    5. 多模态能力

    multimodal/ 覆盖图像理解、图表解读、表单/PDF 内容提取、视觉最佳实践等,配合 Claude 强大的视觉模型可直接处理扫描件、合同、PPT。

    6. 扩展思考与设计模式

    extended_thinking/patterns/ 深入推理模式、子智能体协作、提示词缓存、评估驱动开发(Eval-Driven Development)等高阶范式。

    7. 第三方集成

    third_party/ 给出Pinecone 向量数据库、Wikipedia、VoyageAI Embeddings等流行服务的对接范例,把 Claude 嵌入现有技术栈成本极低。

    8. 微调与可观测性

    finetuning/observability/ 提供模型微调生产链路观测的端到端代码,是把 Claude 部署到线上服务的最后一块拼图。

    典型使用场景

    场景 1:快速搭建企业知识库 RAG

    复制 capabilities/retrieval_augmented_generationthird_party/Pinecone 两个 Notebook,半天就能搭起一个基于 Pinecone + Claude 的企业知识问答系统。Notebook 里连如何切分文档、嵌入、检索、重排序、生成都一步步跑通。

    场景 2:构建带工具调用的客服 Agent

    参考 tool_use/customer_service_agent.ipynb 的代码结构,把你的订单查询 API、退款流程、商品库存接口注册成 Claude 可调用的工具,立即得到一个能回答”我的订单到哪了”的多轮 Agent。

    场景 3:批量处理 PDF/扫描件

    multimodal/ 里的 PDF 解析与表单提取 Recipe,配合 Claude 视觉模型,搭建合同关键条款抽取、发票识别、报告摘要等自动化工作流。

    场景 4:评估驱动的提示词迭代

    misc/building_evals.ipynb 给出用 Claude 自身来评估另一批 Claude 输出质量的工程范式——适合团队协作打磨生产级 Prompt,让提示词的优化变成可量化、可回归的过程。

    推荐理由

    用 Cookbooks 这半年,最大的感受是:它不是”玩具示例”,而是真正从生产里长出来的代码

    • 覆盖全面:从基础调用到 Agent SDK,从 RAG 到微调,几乎所有 Claude 应用方向都有现成 Recipe,避免重复造轮子。
    • 持续更新:紧跟 Anthropic 的功能发布(比如 Claude 4 系列、扩展思考、Agent SDK、Skills 都是最近几个月加入的新章节)。
    • 可读性极强:每个 Notebook 都是”一段说明 + 一段代码 + 一段输出”的节奏,能当教程读,也能当模板抄。
    • 社区友好:MIT 许可,欢迎提 PR;CLAUDE.md 里甚至写了让 Claude 帮忙做贡献的指南(meta!)
    • 企业可商用:MIT 协议允许商业使用,没有 Apache-2.0 那种专利条款的顾虑。

    对国内开发者来说,唯一需要注意的是 Anthropic API 的访问渠道——可以走官方、AWS Bedrock、Vertex AI 或合规中转服务。模型本身支持中文,是 Claude 进军中文 AI 应用开发的官方”最佳实践手册”。

    下载地址

    用 Cookbook 抄答案,把 Claude 真正用进生产——这可能是 2026 年最值得收藏的 AI 工程仓库之一。

  • Impeccable:50.9K Stars!专治AI生成界面的「AI味」,让Claude Code、Cursor真正懂设计的开源设计语言

    Impeccable:50.9K Stars!专治AI生成界面的「AI味」,让Claude Code、Cursor真正懂设计的开源设计语言

    Impeccable 官方封面

    项目简介

    Impeccable 是由前 Google 开发者布道师 Paul Bakaus 开源的一套「让 AI 编码工具更擅长设计」的设计语言系统——它以 1 个 Skill + 23 个设计命令 + 60 条确定性检测规则 + 设计钩子的形式,接入 Claude Code、Cursor、Codex CLI、Gemini CLI、GitHub Copilot 等十余种 AI 编程工具,专治 AI 生成前端界面千篇一律的「AI 味」(Inter 字体、紫蓝渐变、卡片套卡片……)。项目 2025 年 11 月发布,目前已斩获 50,900+ Stars,今日仍在 GitHub 趋势榜上持续攀升。

    Impeccable GitHub 仓库卡片

    安装要求和过程

    环境要求

    • Node.js 环境(使用 npx 安装,无需全局依赖)
    • 任意受支持的 AI 编程工具:Claude Code、Cursor、Codex CLI、Gemini CLI、GitHub Copilot、OpenCode、Grok Build、Trae、Qoder 等 13+ 种
    • CLI 与浏览器扩展的检测器无需 API Key 即可运行

    快速安装

    # 方式一:CLI 一键安装(推荐,在项目根目录执行)
    npx impeccable install
    
    # 非交互式安装:指定工具与作用域
    npx impeccable install --providers=claude,cursor --scope=project
    
    # 更新到最新版本
    npx impeccable update
    
    # 方式二:作为 Claude Code 插件安装
    /plugin marketplace add pbakaus/impeccable
    
    # 方式三:Git Submodule 方式
    git submodule add https://github.com/pbakaus/impeccable .impeccable
    npx impeccable link --source=.impeccable --providers=claude,cursor

    安装后重载你的 AI 编程工具即可。首次使用建议先运行 /impeccable init,它会引导生成 PRODUCT.mdDESIGN.md,把品牌与产品设计上下文固化到项目里。

    核心功能

    • 23 个设计命令,给 AI 一套共享设计词汇/impeccable craft(完整设计流程)、critique(UX 审查)、audit(技术检查)、polish(发布前终检)、bolder/quieter(视觉强化/降噪)、animate(动效)、colorize(配色)、typeset(字体排印)等,覆盖从规划到打磨的全链路;
    • 60 条确定性「AI 味」检测规则:精准狙击 AI 生成界面的通病——默认 Inter/Arial 字体、紫蓝渐变、纯黑纯白灰、卡片嵌套卡片、弹跳缓动动画等,同时检查行宽、触控热区等通用可用性指标,规则引擎零 LLM、零 API 成本;
    • 设计钩子(Hooks)自动拦截:在 Claude Code、Copilot、Codex、Cursor、Grok Build 上写入代码时自动运行检测器,发现严重设计问题可直接阻断坏代码写入,把关口前移;
    • PRODUCT.md / DESIGN.md 上下文固化:通过 initdocument 命令把品牌调性、产品定位写成文档,让 AI 每次生成都带着你的设计基因而非「出厂默认审美」;
    • 独立 CLI + 实时浏览器迭代npx impeccable detect src/ 可脱离 AI 工具独立扫描目录/文件/URL(支持 --json 输出接入 CI),/impeccable live 支持在浏览器里对界面变体做可视化迭代。

    典型使用场景

    1. Vibe Coding 项目去「AI 味」:用 Claude Code/Cursor 快速搭出的产品原型总是长着一张「AI 脸」?安装后运行 /impeccable init + /impeccable craft landing,让落地页拥有独特的品牌气质,摆脱紫渐变 + Inter 字体的流水线审美;
    2. 发布前的设计质量门禁:在 CI 中挂上 npx impeccable detect --json .,60 条规则自动检查行宽、对比度、触控区、动效缓动等问题;配合 /impeccable polish 做上线终检,把设计审查从「靠感觉」变成「有清单」;
    3. 无设计师团队的 UX 自助审查:小团队没有专职设计师?/impeccable critique checkout 可对结账流程做启发式 UX 审查,/impeccable harden 补齐错误态与边界场景,相当于给团队配了一位 AI 设计顾问。

    推荐理由

    我把 Impeccable 装进 Claude Code 用了几天,最大的感受是:它治的不是「AI 不会写前端」,而是「AI 写的前端都长一个样」。以前让 AI 改设计只能反复喊「好看一点、高级一点」,现在有了 bolderquieterdistill 这样的精确词汇,沟通成本断崖式下降——这正是「给人和 AI 建立共享设计语言」的价值。60 条确定性规则不烧 token、不用 API Key,钩子还能在坏代码写入前直接拦截,工程化程度远超一般的提示词合集。项目基于 Anthropic 官方 frontend-design skill 扩展,作者 Paul Bakaus 是 jQuery UI 创始人之一,设计与工程功底都过硬。Apache-2.0 协议,13+ 种 AI 编程工具通吃,做 AI 辅助开发的前端同学强烈建议装上。

    下载地址

    项目信息:50,900+ Stars | 2,998 Forks | JavaScript | Apache-2.0 许可证

  • MemPalace:57.7K Stars 的本地优先开源 AI 记忆系统,逐字存储 + 96.6% 检索召回,零 API 成本

    MemPalace:57.7K Stars 的本地优先开源 AI 记忆系统,逐字存储 + 96.6% 检索召回,零 API 成本

    MemPalace Logo

    项目简介

    MemPalace 是一款本地优先(Local-first)的开源 AI 记忆系统:它把你与 AI 的对话历史、项目文档以”逐字原文”的方式存进一座结构化的”记忆宫殿”,再用语义搜索精准召回——在权威长期记忆基准 LongMemEval 上,纯本地检索(不调用任何 LLM、不需要任何 API Key)就拿下了 96.6% R@5 的成绩,号称”基准测试打得最透明的开源 AI 记忆系统”。项目 2026 年 4 月上线,短短三个多月即斩获 57.7K+ Stars,MIT 许可,完全免费。

    与 Mem0、Zep 等”摘要式”记忆方案不同,MemPalace 的哲学是不摘要、不改写、不提炼——原文进、原文出。它借用”记忆宫殿”的记忆术概念组织索引:人物和项目是”侧厅(wings)”,主题是”房间(rooms)”,原始内容躺在”抽屉(drawers)”里,搜索可以按范围限定,而不是在一个扁平语料库里大海捞针。

    安装要求和过程

    环境要求:

    • Python 3.9+
    • 向量存储后端(默认内置 ChromaDB,零配置)
    • 约 300 MB 磁盘空间用于本地嵌入模型(推荐多语言的 embeddinggemma-300m,支持 100+ 语言;也可选 30 MB 的英文版 all-MiniLM-L6-v2)
    • 核心功能无需任何 API Key

    快速安装(推荐 uv,隔离环境防依赖冲突):

    # 方式一:uv(推荐)
    uv tool install mempalace
    mempalace init ~/projects/myapp
    
    # 方式二:pipx
    pipx install mempalace
    
    # 方式三:pip(虚拟环境内)
    python -m venv .venv && source .venv/bin/activate
    pip install mempalace

    Docker 部署(可直接作为 MCP 服务器运行):

    docker build -t mempalace .
    # MCP 服务器(stdio 模式,注意 -i 参数)
    docker run -i --rm -v mempalace-data:/data mempalace
    # 或直接跑 CLI 命令
    docker run --rm -v mempalace-data:/data mempalace search "why GraphQL"

    30 秒上手:

    # 把项目文件"挖"进记忆宫殿
    mempalace mine ~/projects/myapp
    # 挖掘 Claude Code 历史会话
    mempalace mine ~/.claude/projects/ --mode convos
    # 语义搜索
    mempalace search "当初为什么改用 GraphQL"
    # 新会话开始时加载上下文
    mempalace wake-up

    核心功能

    • 逐字原文存储 + 语义检索:不摘要、不改写,对话与文档按原文入库;LongMemEval 上纯语义检索 R@5 达 96.6%,混合管线(关键词加权 + 时间邻近加权)在留出集上达 98.4%,加 LLM 重排后 ≥99%——全部结果可用仓库内脚本复现。
    • 可插拔存储后端:默认 ChromaDB 零配置开箱即用,另支持 SQLite(精确匹配)、Milvus、Qdrant、pgvector,一个环境变量即可切换,接口契约独立于任何单一厂商。
    • 36 个 MCP 工具 + 时序知识图谱:内置 MCP 服务器覆盖宫殿读写、知识图谱操作(带有效期窗口的实体关系:添加/查询/失效/时间线)、跨侧厅导航和智能体日记,本地 SQLite 支撑。
    • 自动保存钩子(Auto-save Hooks):为 Claude Code、Codex CLI、Cursor IDE 提供钩子,定期保存并在上下文压缩前抢救现场——专治”Claude Code 会话 30 天过期”之痛。
    • 彻底本地、彻底免费:嵌入模型本地运行,数据不出机器(除非你主动选择),MIT 许可,无任何付费墙。

    典型使用场景

    场景一:给 Claude Code / Cursor 装上”永久记忆”。AI 编程工具的会话记录会过期、上下文会被压缩,三周前”为什么放弃方案 A 改用方案 B”的讨论早已无处可寻。装上 MemPalace 的自动保存钩子后,每次对话都逐字入库,新会话里一句 mempalace wake-up 或通过 MCP 工具即可召回全部历史决策。

    场景二:团队/个人的项目决策考古。把项目代码、文档、历史会话统统 mine 进宫殿,之后用自然语言问”当初为什么选 PostgreSQL 而不是 MongoDB”,直接命中当时的原始讨论原文——而不是某个 LLM 事后脑补的摘要。

    场景三:隐私敏感环境下的 AI 记忆层。法务、医疗、金融等不能把数据传到云端的场景,MemPalace 全链路本地运行(嵌入模型本地、向量库本地、检索本地),配合 Ollama 等本地模型即可搭出完全离线的”有记忆的 AI 助手”。

    推荐理由

    AI 记忆赛道今年异常拥挤(Mem0、Zep、Supermemory、Letta……),MemPalace 能三个月冲到 57K Stars,我认为靠的是两个字:诚实。它是少数把基准测试方法论、每道题的原始结果文件全部提交到仓库、并且主动说明”最后 0.6% 是看着错题调出来的所以我们不宣传 100%”的项目——甚至拒绝与竞品做不对等的表格对比。这种工程品味在营销味浓重的 AI 开源圈里非常稀缺。

    实际体验上,”逐字存储”这个反直觉的设计恰恰是最大亮点:摘要式记忆一旦摘错,信息就永久丢失;而 MemPalace 永远保留原文,检索层再怎么迭代都能吃到红利。加上零 API 成本、五种后端随意切换、36 个 MCP 工具即插即用,把它接进 Claude Code / Cursor 的成本极低。如果你只想给自己的 AI 工作流加一层”不会失忆”的保险,这是目前开箱体验最好的选择之一。唯一要提醒的是:官方明确警告有大量仿冒网站,请只从 GitHub、PyPI 和 mempalaceofficial.com 获取。

    下载地址

  • OpenHuman:本地优先的个人 AI 超级大脑,连续 9 天登顶 GitHub 趋势榜(35K+ Stars)

    OpenHuman:本地优先的个人 AI 超级大脑,连续 9 天登顶 GitHub 趋势榜(35K+ Stars)

    OpenHuman 界面演示

    项目简介

    OpenHuman 是一个「本地优先」的个人 AI 超级智能体:它既是一个能记住你全部生活与工作数据的大脑(Brain),又是一个能编排智能体舰队与工作流的指挥官(Orchestrator),还是一个能在你话音未落时就完成资料搜集的深度研究员(Deep Researcher)。项目由 tinyhumansai 团队用 Rust 打造,上线一周即连续 9 天登顶 GitHub 趋势榜,目前已收获 35,000+ Stars

    安装要求和过程

    环境要求:OpenHuman 是 UI 优先的桌面应用,普通用户无需命令行、无需配置文件,几次点击即可从安装到可用。支持 macOS / Windows / Linux 三大平台。

    普通用户(推荐):直接从官网或 GitHub Releases 下载对应平台安装包即可。

    • 官网下载:https://tinyhumans.ai/openhuman
    • GitHub Releases:https://github.com/tinyhumansai/openhuman/releases/latest
    • 终端安装:支持 Homebrew、Debian/Ubuntu .deb、AUR 及安装脚本,详见仓库 INSTALL.md

    从源码构建(贡献者):

    1. 安装依赖:Git、Node.js 24+、pnpm 10.10.0、Rust 1.93.0(含 rustfmt + clippy)、CMake、Ninja、ripgrep 及桌面构建前置工具。
    2. Fork 并克隆仓库,先执行 git submodule update --init --recursive,再运行 pnpm install
    3. 开发调试:pnpm dev(Web UI)、pnpm --filter openhuman-app dev:app(桌面端)。

    核心功能

    OpenHuman 记忆构建示意图

    • 记忆树 + Obsidian 知识库:把你的数据压缩成带评分的 Markdown 树,存在本机 SQLite 里,并镜像为可打开编辑的 Obsidian 库——不是「向量黑盒」,记忆看得见、改得动。
    • 海量集成:100+ OAuth 集成、5,000+ MCP 服务器、90,000+ Skills,一键接入 Gmail、Notion、GitHub、Slack;自动抓取每 20 分钟同步一次,让智能体「今早就拿到明天的上下文」。
    • 潜意识后台循环(Subconscious):在你停止输入后仍持续思考,比对世界变化、推进目标、生成晨间简报。
    • TokenJuice 压缩:工具输出在进入模型前先压缩,信息不变但 Token 最多减少 80%,让「大脑」跑得起也养得起。
    • 智能体编排(图而非循环):基于开源 tinyagents 的检查点图运行,可暂停等人工、重启后续跑、卡住自动纠偏;子智能体舰队最深可派生三级。

    典型使用场景

    OpenHuman 智能体编排示意图

    • 个人第二大脑:连接邮箱、日历、代码仓库、笔记与聊天记录,一次同步即可让智能体全面(压缩后)掌握你的上下文,无需数周「养成期」,随时问它「我这周的进展」「谁在等我回复」。
    • 多智能体统一指挥台:通过 Signal 协议端到端加密的智能体互联,把 Claude Code、Codex、OpenClaw、Hermes 等工具接进来,用 OpenHuman 统一编排调度,密钥永不落盘。
    • 会议与自动化助理:以头像+声音自动加入 Meet / Zoom / Teams / Webex 会议,实时转写、按名应答、会后生成带待办的纪要;可视化工作流(灵感来自 n8n / Zapier)由智能体自动提议、你在画布上审核后保存。

    OpenHuman 可视化工作流画布

    推荐理由

    用下来最打动我的是它对「隐私」和「记忆」的执念。开启一键 Privacy Mode 后,所有推理都不会离开本机,且由 Rust 核心强制执行;日常数据在设备端加密、密钥走系统钥匙串、敏感操作有审批闸门。相比要么云端黑盒、要么需要数周喂上下文的同类产品,OpenHuman 让「几分钟就懂你」成为现实,还自带模型路由、浏览器、语音、图像/视频生成等一整套原生工具,一个订阅打通全部。需要留意的是它目前仍是 Early Beta,且采用 GPL-3.0 许可证,商业集成前请评估其传染性。

    下载地址

    项目数据截至发布时:35,000+ Stars · Rust · GPL-3.0 · Early Beta。开源世界迭代飞快,具体以官方仓库为准。

  • Agno:41K Stars 的开源智能体平台框架,SDK+运行时+管理 UI 一站式自建你的 AI Agent 服务

    Agno:41K Stars 的开源智能体平台框架,SDK+运行时+管理 UI 一站式自建你的 AI Agent 服务

    Agno AgentOS 控制台
    Agno AgentOS:内置 Web UI 的智能体平台运行时

    Agnoagno-agi/agno)是一个用于构建、运行和管理「智能体平台(Agent Platform)」的开源框架与运行时,让你用一套 Python SDK 就能把 AI 智能体做成可上线的服务,并通过自带 Web UI 统一管理。截至发文,项目已在 GitHub 收获 41,400+ Stars,采用对商用友好的 Apache-2.0 许可。

    一句话简介

    Agno = Agno SDK(写智能体)+ AgentOS 运行时(跑成服务)+ AgentOS UI(可视化管理),让你完整拥有自己的智能体技术栈——数据、记忆、安全(JWT + RBAC)全部掌握在自己手里。

    安装要求与快速上手

    环境要求:Python 3.8+,建议使用虚拟环境;生产部署推荐 Docker + PostgreSQL(用于存储会话、记忆与追踪)。

    手写第一个智能体(约 20 行):

    # 1. 安装
    pip install -U agno openai
    
    # 2. 定义一个智能体
    from agno.agent import Agent
    from agno.models.openai import OpenAIChat
    
    agent = Agent(
        model=OpenAIChat(id="gpt-4o"),
        markdown=True,
    )
    
    # 3. 运行
    agent.print_response("用三句话介绍一下向量数据库", stream=True)

    一键搭平台:把下面这段话丢给你的编程助手(Claude Code / Cursor / Codex),它会自动 clone 启动模板、用 Docker 在本地拉起一个带 REST API、Postgres、MCP Server 和控制台的完整平台:

    Help me set up my agent platform.
    Clone https://github.com/agno-agi/agentos-railway into a folder called
    agent-platform, cd in, read the README, and follow the get started guide.

    核心功能

    • 生产级 API:AgentOS 运行时开箱提供 50+ 端点,支持 SSE 与 WebSocket,直接在其上构建产品。
    • 自有存储:会话、记忆、知识库与追踪数据全部存进你自己的数据库,不外泄。
    • 100+ 集成 & 上下文源:内置 GitHub、Slack、Postgres 等预制工具包,并可从 Slack、Drive、Wiki、MCP 等实时拉取上下文。
    • 企业级安全:基于 JWT 的 RBAC,原生支持多用户、多租户隔离;可对敏感工具设置人工审批(Human Approval)。
    • 全链路可观测:OpenTelemetry 追踪 + 运行历史 + 审计日志,配合定时任务(Cron 调度)与后台作业,无需额外基础设施。
    • 多渠道接入 & 随处部署:可将智能体暴露为 Slack / Telegram / WhatsApp / Discord / AG-UI / A2A 接口,并部署到 Docker、Railway、AWS、GCP、Azure 等任意容器平台。

    典型使用场景

    • 企业内部智能体平台:需要多租户隔离、权限控制与审计日志的团队,可用 Agno 快速搭建”自持”的 Agent 服务,避免把数据交给第三方 SaaS。
    • 面向用户的 AI 产品后端:借助 50+ REST 端点与流式接口,把智能体作为产品能力对外提供,前端只需消费 API。
    • 带人工审批的自动化工作流:在关键动作(如发邮件、改数据库)前暂停等待确认,兼顾自动化效率与可控性,适合运维、财务、客服等场景。

    推荐理由

    相比 LangChain 这类”全家桶”,Agno 的定位更清晰——它不只给你一个写 Agent 的库,而是把「运行时 + 管理 UI + 安全 + 可观测」这些上线时最头疼的工程问题一并解决。对于想把 Demo 真正推到生产、又不愿把数据主权交出去的团队,Agno 提供了一条”自建可控”的完整路径。SDK 上手快(20 行跑通),运行时功能齐全,配合 Docker 模板几乎零配置起步,是当下值得重点评估的智能体平台方案之一。

    下载与相关链接

  • DeerFlow:字节跳动开源的超级智能体运行时,77.8K Stars 登顶 GitHub Trending

    DeerFlow:字节跳动开源的超级智能体运行时,77.8K Stars 登顶 GitHub Trending

    DeerFlow

    项目简介

    DeerFlow(Deep Exploration and Efficient Research Flow) 是字节跳动开源的一款「超级智能体运行时(Super Agent Harness)」——它把沙箱、记忆、工具、技能、子智能体和消息网关整合在一起,让 AI 智能体能够自主完成从几分钟到数小时不等的长程任务:研究、写代码、做报告、生成幻灯片,几乎无所不能。

    截至发稿,DeerFlow 在 GitHub 上已收获约 77,800+ Stars,并在 2026 年 2 月 DeerFlow 2.0 发布后一度登顶 GitHub Trending 榜首。

    环境要求与安装过程

    环境要求:Python 3.12+、Node.js 22+;推荐使用 Docker 部署(本地评估建议 4 核 8G,长期运行服务器建议 8 核 16G 起)。Linux + Docker 是推荐的生产部署环境,macOS/Windows 更适合作为开发评估环境。

    快速开始:

    # 1. 克隆仓库
    git clone https://github.com/bytedance/deer-flow.git
    cd deer-flow
    
    # 2. 运行安装向导(约 2 分钟,交互式选择 LLM 提供商、搜索引擎、沙箱等)
    make setup
    
    # 3. 用 Docker 启动(推荐)
    make docker-init    # 首次拉取沙箱镜像
    make docker-start   # 启动服务
    
    # 之后访问 http://localhost:2026
    

    随时可运行 make doctor 检查配置并获取修复建议。官方推荐搭配 Doubao-Seed-2.0-Code、DeepSeek v3.2 或 Kimi 2.5 等模型运行。

    DeerFlow 与姊妹项目 LLM Space
    配套桌面工具 LLM Space:可原型化智能体思路、逐步检查每一步、回放失败并做性能基准测试

    核心功能

    • 技能与工具(Skills & Tools):技能是让 DeerFlow「无所不能」的核心。每个技能是一个结构化的 Markdown 能力模块,内置研究、报告生成、幻灯片制作、网页、图像与视频生成等;技能按需渐进加载,保持上下文窗口精简,对 token 敏感的模型也很友好。
    • 子智能体(Sub-Agents):主智能体可即时派生子智能体,每个拥有独立作用域的上下文、工具与终止条件,尽可能并行执行并汇总结构化结果,最终由主智能体综合成连贯输出。
    • 沙箱与文件系统:沙箱感知的执行环境,让智能体安全地运行代码、读写文件,处理更复杂的多步任务。
    • 长期记忆:跨会话持久记住你的画像、偏好与积累的知识——写作风格、技术栈、常用工作流,用得越多越懂你。记忆本地存储,完全由你掌控。
    • 开放集成:基于 LangGraph 与 LangChain 构建,支持 MCP Server、多模型提供商、Claude Code / Codex CLI 集成、IM 渠道、飞书/Lark 集成以及 LangSmith / Langfuse 等可观测性追踪。

    典型使用场景

    • 深度研究报告:作为最初的 Deep Research 框架,DeerFlow 擅长针对复杂主题自动检索、爬取、交叉验证并输出结构化研究报告,甚至生成播客音频。
    • 内容与办公自动化:社区已用它构建数据管道、生成幻灯片、搭建仪表盘、自动化内容工作流——一个 harness 覆盖多类办公与创作任务。
    • 长程复杂任务编排:借助子智能体并行拆解、沙箱执行与长期记忆,适合需要数分钟到数小时、涉及多步骤和多工具协作的自动化流程。

    推荐理由

    DeerFlow 最打动我的地方,是它从「一个 Deep Research 框架」进化成了「开箱即用又高度可扩展的超级智能体运行时」。2.0 版本完全重写,把智能体真正落地干活所需的基础设施——文件系统、记忆、技能、沙箱、子智能体——全部内置。你既可以拿来即用,也可以拆开改造成自己的东西。加之字节跳动背书、MIT 许可、活跃维护和庞大社区,无论是想学习智能体架构,还是想搭一套自己的自动化工作台,DeerFlow 都非常值得一试。

    下载地址

    开源许可:MIT|主要语言:Python|Stars:约 77.8K

  • OpenSpec:为 AI 编程助手打造的规格驱动开发框架,写代码前先对齐需求

    OpenSpec:为 AI 编程助手打造的规格驱动开发框架,写代码前先对齐需求

    OpenSpec - Spec-Driven Development for AI Coding Assistants
    OpenSpec:为 AI 编程助手打造的规格驱动开发框架

    一、项目简介

    OpenSpec 是 Fission AI 开源的一款「规格驱动开发(Spec-Driven Development, SDD)」框架,核心理念是:在写任何一行代码之前,先让你和 AI 就「要做什么」达成一致。它为 AI 编程助手补上了一层轻量的规格层(spec layer),把原本只存在于聊天记录里的模糊需求,沉淀成结构化、可评审、可复用的 Markdown 规格文档。截至目前项目已在 GitHub 收获 62,500+ Stars,是当前最受欢迎的规格框架之一。

    二、安装要求与快速上手

    环境要求:Node.js 20.19.0 或更高版本(同时兼容 pnpm、yarn、bun、nix)。

    全局安装:

    npm install -g @fission-ai/openspec@latest

    初始化项目:进入你的项目目录并初始化,OpenSpec 会自动为你的 AI 助手写入配置。

    cd your-project
    openspec init

    开始与 AI 对话:直接在支持的编程助手中使用斜杠命令。

    # 还没想清楚要做什么?先探索,让 AI 读代码、权衡方案、成型计划
    /opsx:explore
    
    # 已经明确需求?直接提出变更提案
    /opsx:propose add-dark-mode
    
    # 提案通过后,逐条实施任务
    /opsx:apply
    
    # 完成后归档,规格自动更新
    /opsx:archive

    升级只需 npm install -g @fission-ai/openspec@latest,再在各项目内运行 openspec update 刷新 AI 指令即可。

    三、核心功能

    • 规格先行、代码后行:每个变更都会生成独立文件夹,包含 proposal.md(为什么做/改什么)、specs/(需求与场景)、design.md(技术方案)、tasks.md(实施清单),人和 AI 先对齐再动手。
    • 纯 Markdown、零学习成本:规格就是带具体场景(WHEN/THEN)的普通 Markdown,无需学习任何专用语法,AI 负责撰写、你负责评审。
    • 流式而非瀑布:任何产物随时可改,没有僵硬的阶段闸门(phase gates),支持从探索到实现的自由迭代。
    • 广泛的工具兼容:通过斜杠命令支持 25+(并持续增长)主流 AI 编程助手,包括 Claude Code、Codex、Cursor 等,不锁定任何 IDE 或模型。
    • 团队级 Stores(Beta):把规划放进独立仓库,通过 git push 共享,实现跨仓库特性、共享需求、代码未动先立规划——为多团队协作提供单一事实来源。
    OpenSpec Dashboard
    OpenSpec 内置仪表盘:可视化查看规格与进行中的变更

    四、典型使用场景

    • 为老项目做增量特性开发(Brownfield):OpenSpec 明确定位「不只是绿地项目」。在成熟代码库里加新功能时,用 /opsx:explore 让 AI 先读懂现有代码结构,再权衡最干净的实现路径,避免 AI 凭空乱改。
    • 个人开发者约束 AI「别跑偏」:单人开发时,规格层能让你和 AI 在单仓库上保持诚实——先评审计划再写代码,杜绝「模糊 prompt → 不可预测结果」的困境。
    • 企业团队跨仓库协作:一个特性横跨 API 服务、Web 前端和共享库时,用 Stores 把「一个变更、一份计划」共享给三个仓库;平台团队维护规格,产品团队只读引用,让每个编程 Agent 都能读到同一份需求,告别到处漂移的 Wiki。

    五、推荐理由

    体验下来,OpenSpec 最打动我的是它对「轻量」的坚持。同类的 GitHub Spec Kit 更全面但偏重——僵硬的阶段闸门、大量 Markdown、还要配 Python 环境;AWS 的 Kiro 很强却把你锁死在它的 IDE 和 Claude 模型上。OpenSpec 则用一条 npm install 就接入你已经在用的工具链,规格全是能随手改的纯 Markdown,真正做到了「有预测性但不繁文缛节」。

    官方建议搭配高推理能力的模型(如 Codex、Opus 系列)效果最佳,并注意保持干净的上下文窗口——实施前清理上下文,能显著提升产出质量。对于厌倦了「AI 一顿乱写、结果全靠运气」的开发者,OpenSpec 是一个成本极低、收益明显的习惯升级。MIT 许可,可放心用于商业项目。

    六、下载地址


    项目信息:Stars 62,500+ | Forks 4,325 | 主语言 TypeScript | 许可证 MIT | 首次发布 2025-08

  • ego lite:为 AI 智能体打造的最快浏览器,你和 AI 并行工作互不打扰

    ego lite:为 AI 智能体打造的最快浏览器,你和 AI 并行工作互不打扰

    ego lite

    一、项目简介

    ego lite 是一个”人和 AI 智能体并行工作”的浏览器——你在前台正常浏览,你的 AI 智能体(Claude Code、Codex、Cursor 等)在后台各自独立的 Space 里跑网页自动化任务,两者互不抢标签、互不干扰,而且任务完成更快、消耗的 token 更少。

    与 browser-use、Vercel agent-browser 这类”浏览器自动化框架”不同,它们本身不带浏览器、需要另开一个浏览器来驱动,登录态往往带不过去;ego lite 则是一整个为”你和智能体共用”而设计的浏览器,无需额外配置,智能体通过 ego-browser 就能直接用上你真实的登录态和标签页。

    二、安装要求与快速上手

    环境要求:目前仅支持 macOS(Apple Silicon / Intel 均可),Windows 与 Linux 已在路线图中;需要一个支持 skills 的智能体 CLI(Claude Code、Codex、Cursor 或自定义)。

    三种安装方式(任选其一):

    1. 直接下载 macOS 应用:从官网下载 .dmg,打开安装即可。安装后会自动把 ego-browser 技能加到每个智能体的 skills 目录。
    2. 用 npx 只装技能
      npx skills add citrolabs/ego-lite

      首次运行浏览器任务时,会引导你完成 ego lite 应用的安装。

    3. 让智能体自己装:把仓库地址粘给智能体,让它读取 skills/ego-browser/references/install.md 按步骤安装。

    首次启动时它只问一个问题:是否迁移 Chrome 数据。选”是”,你的智能体就继承了现有登录态、Cookie、扩展和书签。运行第一个任务时,在智能体 CLI 里输入 /ego-browser 加空格,然后用自然语言描述需求即可:

    ego-browser follow @ego_agent on x.com for me

    三、核心功能

    • 代码驱动而非命令行驱动,复杂任务更快更省 token:能力以 JavaScript 函数暴露给智能体,让它一次写出完整的多步脚本,而不是”调两个命令→看结果→再调两个”地反复循环。官方称复杂工作流比传统 CLI 方式快达 2.5 倍,工具调用次数大幅减少。
    • 每个智能体独享一个 Space:完全隔离的工作区,你在前台浏览、智能体在后台干活,互不干扰;随时可以查看哪个 Space 正在运行、接管或停止它。
    • 同一浏览器内多 Space 并行:Claude Code 在 10 个并行 Space 里丰富 10 条线索、Codex 在另外 5 个 Space 里抓取 5 个竞品网站,彼此不冲突,也不会抢走你的鼠标和标签页。
    • 业界最强的页面 Snapshot:得益于内核级定制,能可靠处理深层嵌套 iframe 等其他方案常常翻车的场景,为文本模型提供高质量的”页面视觉”输入。
    • 任何智能体都能通过 ego-browser 驱动:它是连接层,把浏览器暴露成一组页面内 JavaScript 工具(snapshot、fill、click、wait、navigate、capture),智能体写一段片段即可一次执行。

    四、典型使用场景

    1. 批量线索丰富 / 数据抓取:让 Claude Code 在多个并行 Space 里同时处理几十条销售线索,或让 Codex 并行抓取多个竞品站点信息,全程不打断你手头的浏览。
    2. 需要登录态的网页操作:因为继承了 Chrome 的 Cookie 与登录,智能体可以直接在你已登录的 X、后台系统、SaaS 面板里执行操作,省去每次重新登录的摩擦。
    3. 日常自动化小任务:像”帮我在 x.com 上关注某账号””填个表单””等页面加载完再截图”这类零散操作,一句自然语言交给智能体后台完成。

    五、性能对比

    官方在四个复杂网页自动化任务上,把 ego lite 与 Vercel 的 agent-browser 做了对比:每个任务最快提速达 2.5 倍,token 消耗显著更低,且任务越难差距越大。

    ego lite 与 agent-browser 性能对比

    六、推荐理由

    市面上大多数工具都能”自动化一个浏览器”,真正的区别在于:智能体拿到的是什么浏览器、你能否同时继续工作、以及它是为你已有的智能体服务还是绑死一个内置智能体。ego lite 的巧妙之处在于把”日常浏览器”和”智能体自动化”合二为一——你不用为了让 AI 干活而牺牲自己的浏览体验,也不必再维护一套独立的自动化环境和登录态。对于已经在用 Claude Code / Codex / Cursor 的人来说,一条 npx skills add 就能接上,几乎零迁移成本。目前它是免费、开源(MIT)、数据本地存储的,隐私上也更让人放心;唯一的门槛是暂时仅支持 macOS,Windows/Linux 用户可以先关注路线图。

    七、下载地址


    项目数据(截至发布时):⭐ 3,387 Stars | 🍴 164 Forks | 语言 JavaScript | 许可证 MIT

  • Chat2DB:AI 驱动的开源数据库客户端,一个工具连接 30+ 种数据库

    Chat2DB:AI 驱动的开源数据库客户端,一个工具连接 30+ 种数据库

    Chat2DB 仪表盘与图表
    Chat2DB —— AI 驱动的数据库客户端与 SQL 工作台

    一句话简介

    Chat2DB 是由 OtterMind(CodePhiliaX)团队开源的一款 AI 驱动的数据库客户端与 SQL 工作台,用自然语言即可生成、解释、优化 SQL,一个工具连接 30+ 种数据库,目前已收获 26.5K+ Stars,是当下最火的开源 GUI 数据库客户端之一。

    安装要求和过程

    环境要求:桌面版无需额外配置;Docker 部署需 Docker 19.03.0+、Docker Compose 2.0.0+、2 核 CPU、4 GiB 内存以上。

    方式一:桌面应用(最简单)

    前往 GitHub Releases 下载对应平台(Windows / macOS / Linux)的安装包,安装后直接连接数据库即可,无需任何额外配置。

    方式二:Docker 部署(自托管)

    # 克隆仓库并初始化加密密钥(务必备份该密钥文件)
    git clone https://github.com/OtterMind/Chat2DB.git && cd Chat2DB
    ./script/security/init-community-encryption-key.sh
    
    docker run --detach \
      --name chat2db-community \
      --restart unless-stopped \
      --publish 127.0.0.1:10825:10825 \
      --volume "$HOME/.chat2db-community-docker:/root/.chat2db-community" \
      --env CHAT2DB_COMMUNITY_ENCRYPTION_KEY_FILE=/run/secrets/chat2db-community-encryption.key \
      --volume "$HOME/.config/chat2db-community/encryption.key:/run/secrets/chat2db-community-encryption.key:ro" \
      chat2db/chat2db:latest

    随后浏览器打开 http://localhost:10825 即可使用。注意:加密密钥(AES-256-GCM)用于加密存储的数据源密码与 AI API Key,请务必单独备份 ~/.config/chat2db-community/encryption.key,丢失后已存密码将无法解密。

    核心功能

    • 30+ 数据库支持:MySQL、PostgreSQL、Oracle、SQL Server、ClickHouse、MongoDB、Redis、SQLite、MariaDB、TiDB、Hive、DB2、Snowflake、BigQuery、Elasticsearch 等,并可通过插件扩展。
    • AI 智能助手:接入你自己的大模型(Bring Your Own Model),用自然语言生成、解释、优化 SQL,支持 Text2SQL。
    • 完整 SQL 工作台:编辑、智能补全、格式化、执行、SQL 收藏与执行历史一应俱全。
    • 数据库管理:浏览元数据,管理表与对象(DDL/DML),支持原地编辑数据。
    • 可视化与开放能力:内置仪表盘与图表、ER 图、数据导入导出,并提供支持 MCP 的开源 CLI 工具
    Chat2DB 可视化数据管理
    可视化数据管理:浏览元数据、原地编辑数据

    典型使用场景

    • 开发者日常查数据:不必再记复杂 SQL 语法,直接用中文/英文描述需求(如”统计上月各地区订单总额并按降序排列”),AI 自动生成可执行 SQL。
    • DBA 多库统一管理:一个客户端同时连接 MySQL、PostgreSQL、Oracle、Redis 等多种数据库,替代 Navicat、DBeaver、DataGrip 等多个工具。
    • 数据分析与 BI:查询结果一键生成仪表盘与图表,配合 ER 图快速理清表关系,适合分析师与数据团队做轻量级 BI 展示。
    Chat2DB ER 关系图
    自动生成 ER 关系图,快速理清库表结构

    推荐理由

    用过 Navicat、DBeaver 的人应该都懂那种”记不住 SQL 又懒得翻文档”的痛。Chat2DB 最打动我的地方是它把 AI 助手专业 SQL 客户端真正融合在了一起——不是简单套一个聊天框,而是让自然语言查询、SQL 优化、ER 图、可视化图表在同一个工作流里顺畅衔接。更难得的是它完全本地运行、开源免费、跨平台,并且支持接入自己的模型,数据不出本机,对企业和注重隐私的团队非常友好。如果你正在找一款能替代付费商业客户端的开源方案,Chat2DB 很值得一试。

    Chat2DB 数据导入导出
    灵活的数据导入与导出

    下载地址

    项目数据:26,502 Stars · 2,891 Forks · 主力语言 Java · 30+ 数据库支持(数据截至 2026-07-25)