分类: 开源项目

专注盘点全网热门人工智能开源项目,涵盖大模型、智能应用、视觉算法、工具插件等领域,搭建教程与优化思路,助力开发者低成本学习实践。

  • AutoGPT:引爆AI智能体革命的开源里程碑,185K+ Stars让AI学会自主思考和行动

    AutoGPT:引爆AI智能体革命的开源里程碑,185K+ Stars让AI学会自主思考和行动

    2023年AI智能体革命的起点

    AutoGPT

    引爆AI智能体浪潮的开源里程碑,185K+ Stars 让 AI 学会自主思考和行动

    🚀 185K+ Stars
    🏠 自托管
    🐳 Docker 部署
    🤖 自主智能体

    AutoGPT 是2023年引爆AI智能体浪潮的开源项目,让AI能够自主拆解目标、分解任务、调用工具、持续迭代,无需人工干预即可完成复杂任务。它不仅是AI Agent领域的”比特币时刻”,更发展成了一个完整的AI智能体构建、部署和管理平台。

    AutoGPT Platform

    AutoGPT 平台架构示意图(图片来自 GitHub)

    📦 安装要求和过程

    环境要求

    CPU 4+ 核心(推荐)
    内存 最低 8GB,推荐 16GB
    存储 至少 10GB 可用空间
    操作系统 Linux / macOS / Windows 10+ (WSL2)
    必需软件 Docker Engine 20.10+, Docker Compose 2.0+, Git, Node.js 16+, npm 8+

    🚀 一键安装(推荐)

    AutoGPT 提供官方一键安装脚本,自动完成所有依赖配置:

    # macOS / Linux 一键安装
    curl -fsSL https://setup.agpt.co/install.sh -o install.sh && bash install.sh
    
    # Windows (PowerShell)
    powershell -c "iwr -useb https://setup.agpt.co/install.ps1 | iex"

    安装完成后访问本地 Web 界面即可开始使用,无需手动配置。

    🐳 Docker 手动部署

    git clone https://github.com/Significant-Gravitas/AutoGPT.git
    cd AutoGPT
    cp .env.template .env
    # 编辑 .env 填入 OPENAI_API_KEY 等配置
    docker-compose up -d

    完整文档:agpt.co/docs

    ⚡ 核心功能

    🎯 自主任务拆解与执行

    AI 自动将大目标拆解为可执行的子任务,持续迭代执行直到完成。支持循环执行、条件分支和错误自动恢复,让 AI 真正”会思考”。

    🛠️ 多工具集成能力

    内置联网搜索、代码执行、文件操作、记忆管理、浏览器自动化等工具。支持通过插件系统扩展自定义工具,让 Agent 具备实际操作能力。

    🏗️ 平台化架构

    从单一 Agent 工具发展为完整平台,支持构建、部署和管理多个 AI Agent。提供 REST API、Webhook 和图形化管理界面,适合生产环境使用。

    🖥️ 图形化管理界面

    基于 Web 的控制面板,可视化管理和监控 Agent 运行状态。支持实时日志查看、任务进度追踪和结果预览,无需命令行即可操作。

    ☁️ 云托管 + 自托管双模式

    支持完全本地 Docker 部署(免费),也提供云端托管版本(Beta)。数据和应用完全自主可控,满足不同场景的部署需求。

    💡 典型使用场景

    📊 场景一:自动化市场调研

    给 AutoGPT 一个目标:”分析 AI 编程工具市场竞品,输出对比报告”。它会自动搜索资料、访问竞品官网、汇总功能特性、截取关键页面,最终生成结构化的 Markdown 报告。整个过程无需人工干预。

    提示词示例:Research the top 5 open-source AI agent frameworks on GitHub, compare their star counts, key features, and licensing. Output a Markdown comparison table.

    💻 场景二:端到端代码项目搭建

    描述你的需求,AutoGPT 自动生成代码框架、编写功能模块、运行测试、修复错误、提交 Git 记录。支持与 GitHub 集成,实现从需求到部署的端到端自动化。

    提示词示例:Build a FastAPI app with user authentication (JWT), PostgreSQL database, and Swagger docs. Include unit tests and Dockerfile.

    🌟 推荐理由

    AutoGPT 在 AI 发展史上的地位,怎么强调都不为过。2023年3月,它成为 GitHub 史上增速最快的开源项目,仅用几天就从几千星冲到十万星,让全世界第一次直观看到”AI 自主完成复杂任务”的真实能力。

    虽然今天已有 LangChain、AutoGen、CrewAI 等更先进的框架,但 AutoGPT 的历史意义不可替代——它定义了”AI Agent 自主循环执行”这一范式,启发了此后几乎所有的 Agent 框架设计。

    现在的 AutoGPT 已不再是简单的循环脚本,而是发展成了包含 Web UI、Agent 市场、云托管平台在内的完整生态系统。如果你想理解 AI Agent 的来龙去脉,或者需要一个开箱即用的自主 Agent 平台,AutoGPT 依然是最好的起点之一。

    📌 项目许可:NOASSERTION(核心框架 · 查看仓库最新许可信息)

    🔄 最后更新:2026-06-24(GitHub 实时数据)

    ⭐ 当前 Stars:185,142+ | Fork:43,000+ | 贡献者:300+

  • Graphify:让AI编码助手拥有持久记忆的知识图谱工具,71K+ Stars让代码/文档/会议全部可查询

    Graphify:让AI编码助手拥有持久记忆的知识图谱工具,71K+ Stars让代码/文档/会议全部可查询

    ⭐ GitHub 71.2K+ Stars | MIT 许可 | Python

    Graphify

    AI 编码助手的知识图谱技能,让代码、文档、会议记录全部可查询

    📋 项目简介

    Graphify 是一款 AI 编码助手技能插件,支持 Claude Code、Codex、Cursor、Gemini CLI 等几乎所有主流 AI 编码工具。它可以将任意文件夹下的代码、SQL 模式、文档、论文、图片、视频等内容,转换为可查询的知识图谱,实现单个图谱同时覆盖应用代码、数据库模式和基础设施信息。

    核心价值:让 AI 编码助手拥有持久记忆,不再「忘记」之前的对话和决策。

    71.2K+
    GitHub Stars

    1.1M+
    下载量

    20+
    AI 工具支持

    36
    语言/格式支持

    ⚙️ 安装要求和过程

    环境要求

    依赖 最低版本 安装方式
    Python 3.10+ python.org
    uv(推荐) 任意版本 curl -LsSf https://astral.sh/uv/install.sh | sh

    快速安装(3步搞定)

    # 1. 安装 graphify(PyPI 包名为 graphifyy,双 y)
    uv tool install graphifyy
    
    # 2. 注册到 AI 助手
    graphify install
    
    # 3. 在 AI 助手中使用
    /graphify .

    可选扩展功能

    uv tool install "graphifyy[all]" — 安装全部扩展(PDF/Office/视频/MCP/Neo4j/中文分词)

    🚀 核心功能

    🧠 知识图谱自动构建

    支持 36 种编程语言 AST 解析、PDF/Office 文档、图片、视频/音频、YouTube 链接等几乎所有项目相关文件,自动构建可查询的知识图谱。

    ⚡ 增量更新(无需重建)

    不同于 RAG 管道每次更改都重新嵌入所有内容,Graphify 维护一个活图谱。文件变更时,仅更新受影响的节点和边,其余保持不变。

    🔍 多模态语义查询

    支持语义查询、节点路径查询、节点解释、PR 影响分析、PR 冲突检测等功能,查询结果附带来源和置信度评分。

    🤖 20+ AI 工具兼容

    支持 Claude Code、Cursor、VS Code Copilot、Aider、Devin CLI、OpenClaw、Codex、Gemini CLI 等几乎所有主流 AI 编码工具。

    🔒 隐私优先(本地处理)

    代码文件完全本地通过 tree-sitter 解析,无需调用 API;无遥测、无用户行为追踪;支持气隙(air-gapped)部署。

    👥 团队协作友好

    生成的 graphify-out/ 目录可直接提交到 Git,团队成员拉取后可直接使用图谱,无需重复构建;支持 MCP 服务暴露供团队共享。

    💡 典型使用场景

    场景一:新人快速上手大型代码库

    问题:新工程师加入团队,需要数周时间阅读文档、grep 代码才能理解代码库。

    解决:运行 /graphify .,图谱一次性构建完成。询问 AI 助手「为什么我们移动从 REST 到 gRPC?」即可获得完整决策链路,包括 RFC 文档、设计会议记录、相关提交。

    场景二:PR 影响分析与冲突检测

    问题:提交 PR 时不知道哪些模块会受影响,容易引入隐形 Bug。

    解决:使用 graphify prs 42 查看 PR 的详细影响分析;使用 graphify prs --conflicts 检测共享图谱社区的 PR,避免合并冲突。

    场景三:跨代码/文档/会议的完整上下文

    问题:AI 编码助手只看到代码,看不到设计文档、会议记录、研究论文,导致建议不全面。

    解决:将代码仓库、PDF 设计文档、Markdown 会议记录、YouTube 技术讲座全部添加到图谱(graphify add <url>),AI 助手查询时获得完整上下文。

    🌟 推荐理由

    Graphify 是我近期关注的最令人兴奋的新项目之一。它解决了 AI 编码助手的一个核心痛点:遗忘。每次新对话,AI 助手都不记得之前的决策和上下文,导致重复解释、决策不一致。

    Graphify 通过知识图谱方案解决这个问题,比传统 RAG 更高效:

    • 增量更新:文件变更时仅更新受影响部分,不需要像 RAG 那样每次都重新嵌入所有文档
    • 结构化关系:图谱中的节点和边能够表达代码之间的调用关系、文档之间的引用关系,查询结果更有意义
    • 本地优先:代码解析完全在本地进行,不需要发送到大模型 API,保护代码隐私

    特别适合:使用 Claude Code、Cursor、Aider 等 AI 编码工具的开发者;需要管理大型代码库或跨多个文档/会议工作的团队;重视代码隐私、希望本地处理敏感项目的企业。

    ⚡ 增长惊人:项目 2026 年 4 月 3 日才创建,仅 3 个月已达到 71,275 Stars 和 110 万次下载,是 YC S26 孵化项目,增长势头非常强劲!

    📌 项目开源许可:MIT | 最新版本:0.8.46 | 最后更新:2026 年 6 月

    🏷️ 相关标签:AI Agent · 知识图谱 · RAG · 代码智能 · Claude Code · Cursor

  • Pydantic AI:类型安全的AI Agent框架,Pydantic官方出品,17.9K+ Stars为GenAI开发带来FastAPI体验

    项目简介:Pydantic AI 是由 Pydantic 官方团队开发的 Python 原生 AI Agent 框架,目标是将 FastAPI 的开发体验带到生成式 AI 应用和 Agent 开发中。Pydantic 验证库已被 OpenAI SDK、Anthropic SDK、LangChain 等主流 AI 工具采用,而 Pydantic AI 则直接从源头集成 Pydantic 能力,让开发者能够快速、自信、低痛苦地构建生产级 GenAI 应用和工作流。

    ⭐ GitHub Stars
    17.9K+
    🍴 Forks
    2,250+
    📜 开源许可
    MIT
    🏢 开发团队
    Pydantic

    Pydantic AI Logo

    🔧 安装要求和过程

    环境要求

    • Python 3.9+(推荐 Python 3.10+)
    • pip 或 uv 包管理器
    • 支持的操作系统:Windows / macOS / Linux

    快速安装

    # 使用 pip 安装
    pip install pydantic-ai

    # 或使用 uv 安装(推荐)
    uv pip install pydantic-ai

    # 安装可选依赖(如需运行示例)
    pip install "pydantic-ai[examples]"

    验证安装

    python -c "import pydantic_ai; print(pydantic_ai.__version__)"

    🚀 核心功能

    1. 官方团队原生开发

    Pydantic 验证是 OpenAI SDK、Google ADK、Anthropic SDK、LangChain、LlamaIndex 等主流 AI 工具的基础验证层。Pydantic AI 直接从源头集成 Pydantic 能力,稳定性和兼容性更强。

    2. 完全类型安全

    充分利用 Python 类型提示,为 IDE 提供充足上下文,支持自动补全和静态类型检查,将大量运行时错误提前到编写时发现,获得类似 Rust “编译通过即可用” 的开发体验。

    3. 模型无关性

    支持几乎所有主流模型和提供商:OpenAI、Anthropic、Gemini、DeepSeek、Grok、Cohere、Mistral、Perplexity;云厂商:Azure AI Foundry、Amazon Bedrock、Google Cloud;本地推理:Ollama、LiteLLM、Groq、OpenRouter 等。未覆盖的模型可通过自定义模型扩展。

    4. 无缝可观测性

    深度集成 Pydantic Logfire(通用 OpenTelemetry 可观测平台),支持实时调试、基于评估的性能监控、行为追踪、成本追踪。同时也支持其他兼容 OpenTelemetry 的可观测平台。

    5. 强大的评估与扩展能力

    支持系统化测试和评估 Agent 系统的性能和准确性;支持通过可组合的能力(Capabilities)构建 Agent,能力可打包工具、钩子、指令、模型设置为可复用单元;支持完全通过 YAML/JSON 定义 Agent,无需编写代码。

    💡 典型使用场景

    场景一:银行客服 Agent

    构建具备工具调用、依赖注入、结构化输出的银行客服 Agent。通过 RunContext 注入数据库连接,使用 Pydantic BaseModel 定义结构化输出,实现类型安全的 Agent 响应。

    from pydantic_ai import Agent, RunContext
    from pydantic import BaseModel

    class SupportOutput(BaseModel):
        support_advice: str
        block_card: bool
        risk: int

    agent = Agent('openai:gpt-5.2', output_type=SupportOutput)

    场景二:带可观测性的生产级 Agent

    集成 Pydantic Logfire 实现全链路可观测性,监控 Agent 的完整运行链路、工具调用、数据库查询、Token 消耗和成本追踪,让生产环境 AI 应用透明可控。

    import logfire
    logfire.configure()
    logfire.instrument_pydantic_ai()
    logfire.instrument_sqlite3()

    💬 推荐理由

    Pydantic AI 是我见过的类型安全做得最彻底的 Python AI Agent 框架。如果你已经在用 Pydantic 做数据验证(相信我,你一定在用),那么 Pydantic AI 会让你感觉”回家了”。

    最打动我的是它的开发体验——类型提示让 IDE 自动补全几乎能”预测”你想写什么,大量潜在错误在编写阶段就被捕获,而不是在运行时才爆雷。这种”编译通过即可用”的 Rust 式体验,在 Python AI 开发中实在难能可贵。

    另外,Pydantic 团队在构建 Pydantic Logfire 时因为没有找到符合预期的 Agent 框架,干脆自己造了一个——这种”自己用它才做得好”的项目,质量通常有保障。目前 17.9K Stars,正处于快速成长阶段,现在上手正当其时。

    📥 下载地址

    📚
    官方文档

    ai.pydantic.dev

    🐍
    PyPI 安装

    pypi.org/project/pydantic-ai

    🔥
    Pydantic Logfire

    logfire.pydantic.dev

    🚀 Pydantic AI —— 类型安全的 AI Agent 框架,让 GenAI 开发像 FastAPI 一样流畅

  • Stable Diffusion WebUI:最流行的AI图像生成工具,163K+ Stars让你在浏览器里玩转Stable Diffusion

    Stable Diffusion WebUI:最流行的AI图像生成工具,163K+ Stars让你在浏览器里玩转Stable Diffusion

    Stable Diffusion WebUI 界面截图

    🎨 项目简介

    Stable Diffusion WebUI 是由 AUTOMATIC1111 开发的基于 Gradio 框架的 Stable Diffusion 浏览器交互界面,是 AI 图像生成领域最流行、功能最完整的开源工具。只需简单部署,即可在浏览器中完成文生图、图生图、模型训练、参数微调等全流程 AI 绘画操作。

    🟣 163K+ Stars
    📦 最流行 AI 绘画工具
    🔧 丰富扩展生态
    💻 本地私有部署

    ⚙️ 安装要求和过程

    环境要求

    • Python 3.10.6(更高版本可能不兼容 torch)
    • Git
    • NVIDIA 显卡(推荐 4GB+ 显存,2GB 也可运行)
    • 或 AMD 显卡 / Intel 核显 / Apple Silicon(需参考对应安装指南)

    Windows 快速安装(推荐方式)

    # 方式1:一键包(最简单)
    下载 v1.0.0-pre 版本的 sd.webui.zip
    解压后依次运行 update.bat 和 run.bat 即可

    # 方式2:源码安装
    1. 安装 Python 3.10.6(勾选 “Add Python to PATH”)
    2. 安装 Git
    3. 克隆仓库:
    git clone https://github.com/AUTOMATIC1111/stable-diffusion-webui.git
    4. 双击运行 webui-user.bat

    Linux 安装

    # Debian/Ubuntu
    sudo apt install wget git python3 python3-venv libgl1 libglib2.0-0
    git clone https://github.com/AUTOMATIC1111/stable-diffusion-webui.git
    cd stable-diffusion-webui
    ./webui.sh

    🚀 核心功能

    🖼️ 文生图 / 图生图
    支持 txt2img 和 img2img 核心模式,内置参数调节、分辨率控制、批处理

    🎭 Inpainting / Outpainting
    支持局部重绘(内绘)和扩展画布(外绘),智能补全图像内容

    🔧 模型与扩展
    支持 Textual Inversion、LoRA、Hypernetworks,兼容数千个社区扩展插件

    🎨 后期处理与超分
    集成 GFPGAN、CodeFormer 人脸修复,RealESRGAN 超分辨率,批处理工具

    🎯 Attention 精准控制
    支持 ((keyword)) 和 (keyword:weight) 语法精确控制模型对提示词的关注度

    💡 典型使用场景

    🎬 场景一:AI 艺术创作

    输入自然语言提示词(如 “a fantasy castle on a floating island, digital art, trending on ArtStation”),即可生成高质量 AI 艺术作品。通过 Negative Prompt 排除不想要的元素,使用 X/Y/Z plot 批量测试不同参数组合,快速找到最佳生成配置。

    🔄 场景二:图生图风格转换

    上传参考图片,配合提示词进行风格转换(如将照片转为动漫风格、油画风格)。支持 Denoising strength 控制与原图的相似度,配合 Inpainting 可精确重绘指定区域(如更换人物服装、修改背景)。

    🏋️ 场景三:LoRA 模型微调与训练

    使用 Training 标签页训练自己的 Textual Inversion 嵌入或 LoRA 模型,只需几十张样本图片即可学习特定人物、风格或物品特征。训练完成后一键加载,在生成中调用自定义概念,实现个性化 AI 绘画。

    🌟 推荐理由

    Stable Diffusion WebUI 是 AI 绘画领域毫无争议的标杆工具。作为 GitHub 上 Star 数最多的 Stable Diffusion 界面(163K+),它不仅功能全面,更重要的是拥有最活跃的社区和扩展生态——目前已有数千个自定义脚本和扩展插件,覆盖从人脸修复、批量处理到 ComfyUI 工作流集成的各类需求。

    与云端 AI 绘画服务(如 Midjourney)相比,WebUI 的最大优势是完全本地运行,无需付费订阅,数据隐私有保障,且支持任意开源 Stable Diffusion 模型(SD1.5/SD2.0/SDXL/SD3 等)。对显存的要求也相当亲民——4GB 显存即可流畅运行,甚至 2GB 也有成功案例。

    无论你是 AI 艺术创作者、游戏美术设计师,还是仅仅对 AI 绘画感兴趣的爱好者,Stable Diffusion WebUI 都是最好的起点。一键安装脚本让部署变得异常简单,丰富的教程资源和社区支持也能帮助你快速上手。

    AI绘画
    Stable Diffusion
    图像生成
    本地部署
    开源
  • LangGraph:Build Resilient Agents,LangChain 团队出品的 AI 智能体编排框架,循环计算图让智能体真正「会思考」(35.5K Stars)

    LangGraph:Build Resilient Agents,LangChain 团队出品的 AI 智能体编排框架,循环计算图让智能体真正「会思考」(35.5K Stars)

    🔄

    LangGraph

    Build Resilient Agents —— LangChain 团队出品的 AI 智能体编排框架

    35.5K+ Stars
    MIT 许可
    Python
    LangChain 官方

    LangGraph 是由 LangChain 团队开发的 AI 智能体编排框架,专为构建有状态、可循环、鲁棒的 AI 智能体而设计。与传统的 DAG(有向无环图)工作流不同,LangGraph 支持循环计算图,让智能体能够真正”思考-行动-反思”,实现接近人类的问题解决过程。

    LangGraph 架构设计

    LangGraph 循环计算图设计(支持状态循环与条件分支)

    ⚙️
    安装要求和过程

    环境要求

    • Python >= 3.9
    • pip 或 poetry 包管理器
    • (可选)LangChain 生态集成
    • (可选)LangSmith 用于调试追踪

    快速安装

    # 安装 LangGraph 核心库
    pip install langgraph
    
    # 安装 LangGraph CLI(用于本地开发)
    pip install langgraph-cli
    
    # 安装 LangChain(如需使用 LangChain 集成)
    pip install langchain langchain-openai
    
    # 使用 poetry
    poetry add langgraph

    最新版本:langgraph==1.2.6(2026-06-18 发布)


    核心功能

    01

    🔄 循环计算图支持

    与传统 DAG 框架不同,LangGraph 支持循环(cycles)条件分支,让智能体能够迭代优化输出、进行多轮对话、实现复杂的决策逻辑。这是构建真正”会思考”的智能体的关键能力。

    02

    💾 持久化状态管理

    内置 Checkpointer 机制,支持将智能体状态持久化到内存、SQLite、PostgreSQL 等存储后端。支持人机协作(Human-in-the-Loop):可以在智能体执行过程中暂停、审核、修改状态,然后继续执行。

    03

    🎯 细粒度控制与调试

    支持 时间旅行(Time Travel) 调试:可以回到智能体执行的任意步骤,检查状态、修改输入、重新运行。完美集成 LangSmith 进行追踪和评估。支持断点、单步执行、状态快照等高级调试功能。

    04

    🏗️ LangGraph Studio 可视化 IDE

    提供 LangGraph Studio 桌面应用,可视化编辑智能体工作流、实时预览执行状态、交互式调试。支持一键部署为 API 服务,或导出为 Python 代码。让智能体开发从”写代码”升级为”画流程”。

    05

    🚀 生产级部署方案

    提供 LangGraph Cloud(托管服务)和 自托管(Docker + LangGraph Server)两种部署方式。支持水平扩展、异步执行、长时运行任务、Webhook 回调等企业级特性。已有数千家公司在生产环境使用。

    💡
    典型使用场景

    场景一:多轮对话智能客服

    利用 LangGraph 的循环计算图,构建能够”理解上下文→查询知识库→生成回复→等待用户反馈→迭代优化”的智能客服。通过持久化状态,即使会话中断数小时,智能体仍能记住之前的对话内容。配合 LangSmith 可以持续优化回复质量。

    场景二:AI 研究智能体

    构建能够”分解问题→搜索资料→阅读内容→综合答案→验证准确性→补充细节”的自主研究智能体。LangGraph 的循环机制让智能体可以在发现信息不足时自动回溯、重新搜索,直到找到满意答案。这是 LangGraph 官方示例中的经典案例。

    场景三:代码审查智能体

    构建代码审查工作流:智能体 A 负责读取 PR diff,智能体 B 负责检查代码规范,智能体 C 负责生成审查意见,协调器(supervisor)负责整合结果。LangGraph 的多智能体协调能力让这种复杂协作变得简单。支持人工审核节点,关键决策需人工确认后才执行。

    ❤️
    推荐理由

    作为 LangChain 生态的核心框架,LangGraph 解决了 AI 智能体开发中最棘手的问题:如何让智能体”有记忆、能循环、可调试”。如果你用过 LangChain 的 LCEL(LangChain Expression Language),可能会觉得”链式调用”很方便,但遇到需要循环、条件分支、状态管理的复杂场景就力不从心了。LangGraph 正是为这些场景而生。

    我最欣赏 LangGraph 的 「时间旅行调试」功能。传统智能体开发是”黑盒”——你输入一个问题,等半天得到一个答案,中间发生了什么完全不知道。LangGraph 让你可以”回到过去”:查看某一步的状态、修改输入、重新运行。这简直是 AI 智能体开发的”时光机”,大幅提升了调试效率。

    另外,LangGraph Studio 是我见过最实用的 AI 智能体可视化工具。它不仅能”看”到智能体的执行流程,还能”改”——直接在某一步修改状态,然后继续运行。对于复杂智能体的开发和演示,这是无敌的工具。

    当然,LangGraph 也有学习曲线。如果你是完全的新手,建议先从 官方教程开始,跟着示例做一遍”聊天机器人”和”研究智能体”两个案例,就能掌握核心概念。MIT 许可 + LangChain 团队维护 + 35K+ Stars,这是目前最值得学习的 AI 智能体框架之一。

    📊 项目信息

    GitHub Stars: 35,504+
    Forks: 5,956+
    开源许可: MIT
    主要语言: Python
    最新版本: langgraph==1.2.6
    最后更新: 2026-06-23
    维护团队: LangChain 团队
    Issues 开放: 591

    🔄 如果你正在构建需要”记忆、循环、反思”能力的 AI 智能体,

    LangGraph 是目前最成熟、最完整的解决方案。

    LangChain 生态官方框架 · MIT 许可 · 35K+ Stars · 生产环境验证

  • OpenCut:开源CapCut替代品,免费视频剪辑工具,58,936+ Stars让创作者不再被绑架

    OpenCut:开源CapCut替代品,免费视频剪辑工具,58,936+ Stars让创作者不再被绑架

    OpenCut

    开源 CapCut 替代品,免费视频剪辑工具

    ⭐ 58,936+ Stars
    🍴 6,420+ Forks
    📅 2025-06 创建
    📄 MIT 许可

    OpenCut Logo

    OpenCut 项目组织头像

    📌 项目简介

    OpenCut 是一款免费开源的视频剪辑工具,定位为 CapCut(剪映国际版)的开源替代品。项目支持 Web、桌面和移动端三端,基于 Rust 核心 + TypeScript/Next.js 构建,MIT 许可确保永久免费。项目在 GitHub 上仅用不到一年时间就获得了近 6 万星标,是 2026 年最受关注的开源创意工具之一。

    58,936+
    GitHub Stars

    6,420+
    Forks

    328
    Open Issues

    TypeScript
    主要语言

    ⚙️ 安装要求和过程

    环境要求

    • Node.js / Bun 运行时(项目使用 Bun 作为包管理器)
    • proto 工具链管理器(用于管理 Bun 和 moon 版本)
    • Rust 编译环境(核心模块,正在重写中)
    • Git

    快速安装步骤

    # 1. 安装 proto 工具链管理器
    bash <(curl -fsSL https://moonrepo.dev/install/proto.sh)

    # 2. 克隆仓库
    git clone https://github.com/OpenCut-app/OpenCut.git
    cd OpenCut

    # 3. 安装依赖(proto 会自动安装 bun + moon)
    proto use
    bun install

    # 4. 启动开发服务器
    moon run web:dev # Web 端 → localhost:5173
    moon run api:dev # API 端 → localhost:8787

    💡 当前项目正在从零重写(rewrite 分支),经典版本可在 opencut-classic 仓库获取。

    ✨ 核心功能

    1

    三端统一,随处剪辑

    基于 Rust 核心 + TypeScript/Next.js 构建,同一套代码库同时支持 Web 浏览器、桌面应用(Windows/macOS/Linux)和移动端(iOS/Android),随时随地继续你的剪辑项目。

    2

    插件优先架构,无限扩展

    正在重写中的版本采用插件优先(plugin-first)架构,支持一等公民第三方插件。官方将提供 Editor API,让开发者可以深度定制剪辑功能,打造专属工作流。

    3

    MCP 服务器支持,AI 智能体就绪

    重写的 OpenCut 将内置 MCP(Model Context Protocol)服务器,允许 AI 智能体直接调用剪辑功能。这意味着未来可以用自然语言描述剪辑需求,由 AI 自动完成视频编辑。

    4

    无头模式,批量自动化渲染

    支持 Headless 模式(无界面运行),可用于自动化批处理、模板化视频生成等场景。结合脚本功能(编辑器内直接编写脚本),可实现复杂的自动化剪辑流程。

    5

    隐私优先,MIT 永久免费

    MIT 许可协议确保项目永远免费、永远开源。与 CapCut 不断加锁基础功能、强制水印不同,OpenCut 承诺永不收费、永不加水印,所有数据本地处理,隐私完全掌控在自己手中。

    🎬 典型使用场景

    📱 场景一:短视频创作者

    抖音、快手、B站短视频创作者可以用 OpenCut 替代 CapCut,完成剪辑、字幕、转场、滤镜等全套操作。MIT 许可意味着你可以商用、可以二次开发,不用担心版权问题。Web 端无需安装,打开浏览器就能剪。

    🤖 场景二:AI 辅助视频生产

    利用即将上线的 MCP 服务器功能,可以将 OpenCut 接入 AI 智能体工作流。例如:用 LLM 生成视频脚本 → AI 自动匹配素材库 → 调用 OpenCut MCP 接口自动剪辑 → 批量生成多语言版本。这对于内容电商、教育培训等需要大量视频内容的场景极具价值。

    🏢 场景三:企业内网部署

    OpenCut 支持自托管部署,企业可以在内网搭建私有视频剪辑平台,供市场部、培训部等团队使用。不同于 CapCut 需要联网、有数据出境风险,OpenCut 完全离线运行,满足金融、政府等行业的数据合规要求。

    💡 推荐理由

    CapCut 无疑是当前最好用的免费视频剪辑工具之一,但它的”免费”正在逐步缩水 —— 高级功能不断收归付费墙后,导出视频强制加水印,这一切都让创作者感到被绑架。

    OpenCut 的出现,给了创作者一个真正的选择。它不只是”另一个剪辑工具”,而是从根本上重新思考了视频编辑软件的商业模式 —— 软件本身应该免费,开发者通过企业赞助和高级服务盈利(fal.ai 已是赞助商)。这种模式下,普通用户永远免费,企业用户获得专业支持,开发者有可持续的收入来源。

    特别值得关注的是它的 MCP 服务器计划。当大多数剪辑软件还在思考如何整合 AI 时,OpenCut 直接把剪辑能力暴露为 MCP 接口,让任何 AI 智能体都能调用。这意味着不久的将来,你可能对 AI 说”帮我把这段素材剪成 30 秒的抖音风格视频”,AI 就会直接调用 OpenCut 完成剪辑。

    当然,项目目前处于重写阶段(rewrite 分支),经典版本功能已经可用,但新架构带来的插件系统、MCP 支持等还需要等待。如果你等不及,可以先使用 opencut.app 的在线版本。

    🔧 技术架构

    核心语言 Rust(核心模块)+ TypeScript(前端/后端)
    前端框架 Next.js(React 生态)
    包管理器 Bun(高性能 JS 运行时)
    构建工具 moon(monorepo 任务编排)
    许可协议 MIT License(永久免费开源)
    托管平台 GitHub(OpenCut-app/OpenCut)

    📥 下载地址

    当前经典版本可直接使用,重写版本请关注 new.opencut.app 上线通知

    OpenCut 正在重新定义视频剪辑软件的可能性 —— 免费不代表低质,开源不代表难用。

    项目处于活跃开发阶段,建议 Star 收藏以跟进最新进展 🌟

  • DSPy:用编程取代提示词工程,Stanford 出品 LLM 应用优化框架,27.5K+ Stars

    DSPy:用编程取代提示词工程,Stanford 出品 LLM 应用优化框架,27.5K+ Stars

    📌 项目简介

    DSPy(Declarative Self-improving Language Programs in Python)是斯坦福大学开发的 LLM 编程框架,让你用 编程取代提示词工程。不再手写 prompt,而是定义模块 + 数据,DSPy 自动优化提示词和权重,让 LLM 应用可靠、可测量、可迭代。

    🔧 安装要求与过程

    环境要求

    • Python ≥ 3.9
    • pip 包管理器
    • (可选)OpenAI / Anthropic / Google API Key,或本地 Ollama

    快速安装

    # 基础安装(仅 DSPy 核心)
    pip install dspy-ai
    
    # 安装常用扩展(推荐)
    pip install dspy-ai[vertexai,anthropic,cohere]
    
    # 从源码安装最新版
    pip install git+https://github.com/stanfordnlp/dspy.git
    

    Hello World

    import dspy
    
    # 配置 LLM(支持 OpenAI / Claude / Gemini / Ollama 等)
    lm = dspy.LM("openai/gpt-4o-mini")
    dspy.configure(lm=lm)
    
    # 定义签名(Signature):输入 → 输出
    class QnA(dspy.Signature):
        question = dspy.InputField()
        answer   = dspy.OutputField()
    
    # 创建预测器
    qa = dspy.Predict(QnA)
    
    # 直接调用!
    result = qa(question="DSPy 是什么?")
    print(result.answer)
    

    ⭐ 核心功能

    1
    签名(Signature)= 结构化 Prompt

    用类型安全的 Python 类定义输入输出,DSPy 自动生成高质量 prompt。告别手工调 prompt,代码即文档。
    2
    自动优化器(Optimizer)= 自动 Prompt 工程

    内置 BootstrapFewShotMIPROv2COPRO 等优化器,只需提供训练数据,DSPy 自动搜索最优 prompt / 示例 / 权重。质量可测量、可复现。
    3
    模块化编程模型 = 像 PyTorch 一样组合 LLM

    提供 PredictChainOfThoughtProgramOfThoughtRetriever 等模块,自由组合成复杂 pipeline,支持多跳推理、工具调用、RAG。
    4
    全模型兼容 = 一处编写,任意 LLM 运行

    统一接口支持 OpenAI、Anthropic、Google、Cohere、Ollama、Together AI、Azure 等 30+ LLM 提供商,切换模型只需改一行配置。
    5
    内置评估框架 = 量化 AI 应用质量

    提供 EvaluateMetric 工具,科学评估模型效果,支撑数据驱动的迭代优化。

    🚀 典型使用场景

    场景 1:RAG 问答系统(最经典用法)

    import dspy
    from dspy.datasets import HotPotQA
    
    # 配置检索器 + LM
    colbertv2 = dspy.ColBERTv2(url="http://20.102.90.50:2017/wiki17_abstracts")
    lm = dspy.LM("openai/gpt-4o-mini")
    dspy.configure(lm=lm, rm=colbertv2)
    
    # 定义 RAG 签名
    class GenerateAnswer(dspy.Signature):
        context = dspy.InputField(desc="相关维基百科段落")
        question = dspy.InputField()
        answer   = dspy.OutputField()
    
    # 构建 RAG 管道
    class RAG(dspy.Module):
        def __init__(self):
            super().__init__()
            self.retrieve = dspy.Retrieve(k=3)
            self.generate = dspy.ChainOfThought(GenerateAnswer)
    
        def forward(self, question):
            context = self.retrieve(question).passages
            return self.generate(context=context, question=question)
    
    # 编译优化(自动调参)
    from dspy.teleprompt import MIPROv2
    teleprompter = MIPROv2(metric=dspy.evaluate.answer_exact_match)
    optimized_rag = teleprompter.compile(
        RAG(), trainset=your_trainset, valset=your_valset
    )
    

    场景 2:多跳推理 Agent

    DSPy 原生支持构建多步推理 Agent,结合 ReAct 模块和工具调用,让 LLM 自主规划 + 执行复杂任务:

    class MultiHopQA(dspy.Module):
        def __init__(self):
            self.react = dspy.ReAct(GenerateAnswer)
            # ReAct 自动循环:Thought → Action → Observation → ...
        
        def forward(self, question):
            return self.react(question=question)
    

    场景 3:生产级 Prompt 优化(MLOps 集成)

    用 DSPy 的评估 + 优化管线,将 prompt 工程纳入 CI/CD:每次模型更新自动重新优化 prompt,保证质量不回退。


    💡 推荐理由

    如果你还在手写 prompt、手动调 few-shot 示例、靠感觉评估 LLM 应用质量——DSPy 会彻底改变你的工作方式

    它的核心洞察是:Prompt 是代码,应该像代码一样被编译、优化、测试。DSPy 把 prompt 工程从「手工艺」升级为「工程学科」,让 LLM 应用开发进入可测量、可迭代的正循环。

    最打动我的是 MIPROv2 优化器:给它一堆训练数据,它能自动搜索最优的指令指令 + few-shot 示例组合,效果往往超过手工调参。对于需要稳定质量的 production 场景,这是救命稻草。

    另外,DSPy 的学术背景(斯坦福 Ocelot 团队,NeurIPS/ICML 多篇论文)保证了它的方法论严谨性,不是又一个「AI 包装框架」。

    📊 项目数据

    GitHub Stars 27.5K+
    开源许可 MIT License
    主要语言 Python
    维护团队 Stanford Ocelot Lab(@stanfordnlp)
    最新版本 v2.6+(2026 持续更新)
    文档地址 dspy.ai

    📥 下载地址

    🌐
    官方网站

    dspy.ai

    💻
    GitHub 仓库

    github.com/stanfordnlp/dspy

    📚
    官方文档

    dspy.ai/docs

    💬
    Discord 社区

    discord.gg/XCGy2WOMnX

    🎯 立即用 DSPy 把你的 LLM 应用工程化
    告别手工调 prompt,拥抱可测量、可优化的 LLM 编程新范式
  • Qdrant:用Rust打造的高性能向量数据库,AI检索引擎的新标杆

    Qdrant:用Rust打造的高性能向量数据库,AI检索引擎的新标杆

    🚀 项目简介

    Qdrant 是一个用 Rust 编写的高性能、大规模向量数据库与向量搜索引擎,专为下一代 AI 应用设计。它将向量相似度搜索与丰富的 JSON 元数据处理能力深度融合,是构建 RAG、语义搜索、AI 智能体等应用的理想检索底座。

    GitHub:qdrant/qdrant|Stars:32.5K+|语言:Rust 🦀|许可:Apache 2.0

    ⚙️ 安装要求与过程

    环境要求

    • 最低配置:2 vCPU、4GB RAM(测试环境)
    • 生产推荐:8+ vCPU、16GB+ RAM、SSD 存储
    • 支持平台:Linux / macOS / Windows(Docker)、Kubernetes
    • 客户端支持:Python、JavaScript/TypeScript、Go、Rust、.NET/C#、Java
    • 依赖:Docker(快速启动),或直接从 Release 下载二进制

    快速安装(Docker 方式)

    # 拉取并启动 Qdrant(默认端口 6333)
    docker run -p 6333:6333 qdrant/qdrant
    
    # Python 客户端连接
    pip install qdrant-client
    
    python -c "
    from qdrant_client import QdrantClient
    client = QdrantClient(url='http://localhost:6333')
    print(client.get_collections())
    "

    其他安装方式

    • Qdrant Cloud:注册即用,含免费套餐(cloud.qdrant.io
    • 自托管 Kubernetes:官方 Helm Chart 支持
    • Qdrant Edge:轻量版,可嵌入应用进程,适合边缘设备
    • Hybrid Cloud / Private Cloud:企业级自建云部署方案

    ⭐ 核心功能

    🔍 多向量搜索

    同时支持稠密向量(语义搜索)、稀疏向量(关键词搜索)、多向量(ColBERT 等晚期交互模型),一套引擎覆盖全场景。

    🔀 原生混合检索

    在单次查询中融合稠密与稀疏向量,支持 BM25、SPLADE++、miniCOIL 等多种算法,结果通过 RRF/DBSF 策略智能合并。

    📊 高级元数据过滤

    HNSW 遍历过程中直接应用过滤条件(非后过滤),支持嵌套对象、全文检索、地理位置、has_vector 等丰富过滤类型,高召回低延迟。

    ⚡ 极致性能优化

    Rust + SIMD 指令加速;Scalar/Asymmetric/Binary 量化降低内存占用最高 64 倍;GPU 加速索引(NVIDIA/AMD);io_uring 异步 I/O 最大化磁盘吞吐。

    🏗️ 企业级部署能力

    分布式水平扩展(分片 + 副本);零停机扩缩容;多租户数据隔离;SOC 2 / GDPR 合规;SSO(SAML/OIDC);Prometheus / Grafana / Datadog 监控集成;严格模式磁盘保护;WAL 持久化保证断电不丢数据。

    🏆 典型使用场景

    📚 RAG(检索增强生成)系统

    Qdrant 是 RAG 应用最流行的向量数据库选择之一。将企业文档、知识库切分后存入 Qdrant,用户提问时先向量检索最相关片段,再喂给 LLM 生成答案。Tripadvisor 使用 Qdrant 为数十亿条评论和图片提供 AI 旅行规划检索,收入提升 2-3 倍。
    技术栈:Qdrant + LangChain/LlamaIndex + OpenAI/DeepSeek

    🤖 AI 智能体长期记忆

    AI Agent 需要跨会话持久化记忆,Qdrant 提供高性能向量存储让智能体”记住”历史上下文。Deutsche Telekom 的多智能体平台基于 Qdrant 实现实时上下文检索,支撑 200 万+ AI 驱动对话。
    技术栈:Qdrant + Mem0 + LangChain/CrewAI

    🛍️ 电商语义推荐系统

    传统关键词搜索无法理解用户意图,Qdrant 的向量语义匹配让”类似风格””可以搭配”等模糊需求精准命中。Lyzr 的 AI 智能体平台接入 Qdrant 后,延迟降低 90%、吞吐量提升 150%。支持实时相似度匹配数百万商品,结合元数据过滤实现个性化推荐。
    技术栈:Qdrant + 多模态嵌入模型(CLIP)+ 推荐算法

    💡 推荐理由

    作为一个深度使用过多个向量数据库的开发者,Qdrant 给我印象最深刻的是它的“工程完成度”。以下是我的真实使用体会:

    • 🦀 Rust 带来的安心感:生产环境最怕 OOM 和奇怪的崩溃,Qdrant 用 Rust 编写,内存安全 + 高并发,跑了几个月稳如磐石,不像某些 Java 系的方案动不动就要调 JVM 参数。
    • 🎯 过滤性能是真的强:很多向量数据库的元数据过滤是”后过滤”(先搜再筛),大数据量下性能灾难。Qdrant 的过滤是在 HNSW 遍历过程中完成的,实测百万级向量 + 复杂过滤条件,延迟依然在毫秒级。
    • 📦 量化功能省真金白银:Scalar Quantization 开箱即用,内存占用直接砍掉 75%,精度损失微乎其微。如果用量大,这一项就能省好几台服务器的钱。
    • 🔌 生态集成无脑顺畅:LangChain、LlamaIndex、Haystack、MCP 协议……主流 AI 框架全部原生支持,基本不用写适配代码,直接 pip install qdrant-client 开箱即用。
    • ☁️ Cloud 免费额度够用:不想自己运维可以用 Qdrant Cloud,免费套餐够小型项目跑起来,后续扩容也无缝迁移,不用担心被锁定。

    ⚠️ 注意事项:默认 Docker 启动是无认证的,千万不要直接暴露到公网!一定要先看官方安全配置指南,开启 API Key 或 mTLS 认证。另外,如果数据量在千万级以下,其实 Chroma 这类更轻量的方案也够用,Qdrant 的优势在大规模生产场景才完全体现。

    📦 下载地址 & 资源链接

    🌐 官方网站

    qdrant.tech

    💻 GitHub 仓库

    github.com/qdrant/qdrant

    ☁️ Qdrant Cloud

    cloud.qdrant.io(含免费套餐)

    📖 官方文档

    qdrant.tech/documentation

    🐍 Python 客户端

    qdrant-client (PyPI)

    📊 性能基准测试

    qdrant.tech/benchmarks

    Apache License 2.0 开源 · 完全自托管 · 32.5K+ Stars

  • Chroma:AI原生开源向量数据库,RAG与语义搜索首选,28,530 Stars让搜索基础设施零门槛

    Chroma:AI原生开源向量数据库,RAG与语义搜索首选,28,530 Stars让搜索基础设施零门槛

    Chroma Logo

    Chroma – Search Infrastructure for AI

    📦 项目简介

    Chroma 是一款AI 原生的开源向量数据库,提供向量、全文、正则表达式和元数据搜索一体化基础设施。专为 AI 应用设计,支持语义相似搜索、混合检索和数据集版本管理,是 RAG(检索增强生成)和 AI 搜索场景的首选开源方案。

    ⭐ 28,530 Stars
    🍴 2,333 Forks
    📜 Apache-2.0
    🐍 Python / TypeScript / Rust
    📦 15M+ 月下载

    ⚙️ 安装要求和过程

    环境要求

    • Python ≥ 3.8(推荐 3.9+)
    • Node.js ≥ 18(TypeScript 客户端)
    • Rust ≥ 1.70(可选,自行编译时使用)
    • Docker(可选,服务端部署)

    快速安装(Python)

    # 安装 Chroma Python 客户端
    pip install chromadb
    
    # 启动 Chroma 服务端(默认端口 8000)
    pip install chromadb[server]
    chromadb run
    
    # 或使用 Docker 一键启动
    docker run -d --name chroma \
      -p 8000:8000 \
      -v $(pwd)/chroma-data:/chroma/chroma \
      chromadb/chroma:latest

    TypeScript / JavaScript 安装

    # npm
    npm install chromadb
    
    # 在 Node.js / 浏览器中使用
    import { ChromaClient } from 'chromadb';
    
    const client = new ChromaClient({ path: "http://localhost:8000" });

    Chroma Cloud(托管服务)

    注册 Chroma Cloud 即可获得免运维、自动扩缩容的托管向量数据库,支持 S3/GCS 对象存储、SOC 2 Type II 合规。

    ✨ 核心功能

    🔍 多模态搜索

    同时支持向量搜索(语义相似度)、全文搜索(BM25/SPLADE 稀疏向量)、正则表达式搜索元数据过滤。可在单次查询中混合多种搜索策略,实现更精准的召回效果。

    📦 集合 Forking(数据集版本管理)

    支持写时复制(Copy-on-Write)Forking,可快速复制整个 Collection 用于 A/B 测试、模型版本对比或数据回滚,无需额外存储空间。

    ⚡ 对象存储原生架构

    索引专门优化用于 S3 / GCS 对象存储,热数据内存缓存 + 温数据 SSD + 冷数据对象存储三层智能分层。存储成本降低 10 倍(向量 1GB → 对象存储 $0.02/GB/mo vs 内存 $5/GB/mo)。

    🔌 多语言 SDK + 生态集成

    官方支持 Python、TypeScript、Rust 三语言 SDK;无缝集成 LangChain、LlamaIndex、OpenAI、Cohere、Hugging Face 等主流 AI 框架;也可通过 MCP 协议直接接入 AI Agent。

    📊 企业级可靠性

    SOC 2 Type II 认证;支持多租户隔离、VPC 私有部署(BYOC)、CMEK 客户托管密钥、AWS PrivateLink 私有网络;索引状态实时监控;读写一致性级别可控(ReadLevel)。

    🚀 典型使用场景

    场景一:RAG(检索增强生成)知识库

    将企业文档、技术手册、FAQ 等嵌入为向量存入 Chroma,LLM 回答问题时先检索相关片段再生成答案。相比直接使用 LLM,准确率提升 40%+,同时可追溯答案来源。

    # RAG 典型代码(Python)
    import chromadb
    from langchain.vectorstores import Chroma
    from langchain.embeddings import OpenAIEmbeddings
    
    # 创建向量库
    vectordb = Chroma.from_documents(
        documents=splits,
        embedding=OpenAIEmbeddings(),
        persist_directory="./chroma_db"
    )
    
    # 检索相关文档
    retriever = vectordb.as_retriever(search_kwargs={"k": 4})
    relevant_docs = retriever.get_relevant_documents("如何重置密码?")

    场景二:语义搜索与推荐系统

    电商、内容平台可用 Chroma 实现”以文搜图”、”相关推荐”等功能。用户查询经嵌入模型转化为向量后,与数据库中商品/内容向量计算相似度,返回最相关的结果。支持混合检索(向量+全文+元数据过滤联合排序)。

    场景三:AI Agent 长期记忆

    为 AI Agent 提供跨会话的持久化记忆。将历史对话、用户偏好、工具调用记录存入 Chroma,Agent 每次运行时检索相关上下文注入 Prompt,实现”越用越懂你”的个性化体验。可与 Mem0、claude-mem 等记忆层搭配使用。

    💡 推荐理由

    Chroma 是目前最易上手的向量数据库,没有之一。pip install chromadb 后 3 行代码即可启动,不需要任何外部依赖或复杂配置。这对于想要快速验证 RAG 想法的开发者来说,是绝对的”第一步”首选。

    它的多模态搜索能力尤其值得称道——不再是单一的向量相似度搜索,而是可以混合稀疏向量(BM25)、稠密向量、全文和正则表达式,在一个查询里完成多路召回再重排序。这个设计让召回率比单纯向量搜索提升了不少,尤其在专业术语、产品编码等”精确匹配”场景。

    对象存储原生架构也是一个被低估的亮点。很多向量数据库把索引放内存,数据量大了成本直线上升。Chroma 把向量存 S3/GCS,热数据才进内存,存储成本直接降到 1/10。对于千万级向量规模的应用,这个差异就是”用得起”和”用不起”的分界线。

    最后,Chroma 的社区活跃度很高,27K+ Stars、15M+ 月下载量、9 万+ GitHub 仓库依赖,意味着你踩过的坑几乎一定有人踩过,Stack Overflow / Discord 上能找到现成答案。加上 LangChain、LlamaIndex 的官方集成,基本上”开箱即用”。

    📊 技术规格

    项目 详情
    GitHub chroma-core/chroma
    Stars 28,530
    最新版本 Python 1.5.9 / JS 3.4.5 / CLI 1.4.4
    开源许可 Apache-2.0
    主要语言 Python、Rust、Go、TypeScript
    月下载量 15,000,000+
    存储后端 S3 / GCS(对象存储原生)
    查询延迟(P50) 20ms(热缓存)/ 650ms(冷启动)
    集合上限 100 万 Collection / 500 万条记录
    搜索类型 向量 / 全文 / 正则 / 元数据 / 混合

    🚀 Chroma 让每个开发者都能在 5 分钟内拥有生产级向量搜索能力。
    无论是构建 RAG 知识库、语义搜索引擎,还是为 AI Agent 配备长期记忆,它都是最值得信赖的开源基石。

  • LlamaIndex:构建LLM应用的领先数据框架,50K+ Stars让私有数据赋能AI,RAG开发首选

    LlamaIndex:构建LLM应用的领先数据框架,50K+ Stars让私有数据赋能AI,RAG开发首选

    LlamaIndex

    LlamaIndex 🦙 — 面向LLM应用的数据框架

    🦙 项目简介

    LlamaIndex 是构建基于私有数据的 LLM 应用的领先框架,提供数据连接器、索引结构、查询引擎和 Agent 工具链,让开发者能够轻松实现 RAG(检索增强生成)、文档理解、自主 Agent 等 AI 应用。由 Jerry Liu 于 2022 年创立,现已成为 LlamaIndex 公司的核心产品,MIT 开源许可,GitHub 50,261+ Stars。

    50K+
    GitHub Stars

    7.6K+
    Forks

    300+
    集成包

    MIT
    开源许可

    ⚙️ 安装要求和过程

    环境要求

    • Python 3.8+(推荐 3.10+)
    • pip 或 conda 包管理器
    • OpenAI API Key(使用默认 LLM 时)
    • 或本地 LLM(Ollama、LM Studio 等)

    快速安装(入门版)

    # 安装完整入门包(含常用集成)
    pip install llama-index

    # 设置 OpenAI API Key
    export OPENAI_API_KEY=”sk-…”

    # 5行代码跑通 RAG!
    from llama_index.core import VectorStoreIndex, SimpleDirectoryReader
    docs = SimpleDirectoryReader(‘data’).load_data()
    index = VectorStoreIndex.from_documents(docs)
    query_engine = index.as_query_engine()
    print(query_engine.query(‘你的问题’))

    自定义安装(高级用户)

    # 安装核心包 + 按需添加集成
    pip install llama-index-core
    pip install llama-index-llms-openai
    pip install llama-index-llms-ollama
    pip install llama-index-embeddings-huggingface
    pip install llama-index-vector-stores-chroma

    🌟 核心功能

    📥 1. 数据连接器(Data Connectors)

    通过 LlamaHub 提供 300+ 数据连接器,支持 API、PDF、Word、PowerPoint、SQL 数据库、Notion、Google Drive、Slack 等几乎所有数据源。只需一行代码即可将任意格式的数据摄取为 LLM 可用的文档对象。

    🔍 2. 向量索引与 RAG 流水线

    提供 VectorStoreIndex、SummaryIndex、TreeIndex、KnowledgeGraphIndex 等多种索引结构。内置完整的 RAG 流水线:文档解析 → 分块 → 向量化 → 存储 → 检索 → 重排序 → 生成。支持与 Chroma、Qdrant、Pinecone、Weaviate 等 20+ 向量数据库无缝集成。

    🤖 3. Agent 与 Workflows

    原生支持构建 LLM Agent,可将 RAG 管道作为 Agent 的工具之一。Workflows 提供事件驱动的微服务编排,支持多 Agent 协作、反思、错误自修复等高级模式,并可部署为生产级微服务(配合 llama_deploy)。支持 MCP 协议,可接入任意 MCP 服务器。

    📄 4. LlamaParse —— 企业级文档解析

    LlamaIndex 官方提供的商业级文档解析 API,支持 130+ 格式,基于 VLM(视觉语言模型)处理复杂文档中的嵌套表格、嵌入图表/图片等。可与 LlamaIndex 框架无缝配合,也可独立使用。注册即送每月 10,000 免费积分。

    🌐 5. 多语言支持 + TypeScript 版本

    除 Python 主版本外,LlamaIndex 提供完整的 TypeScript/JavaScript 版本(llamaindex),可在 Node.js 和浏览器环境中运行。支持所有主流 LLM(OpenAI、Anthropic、Gemini、DeepSeek、Ollama 等),真正实现了全栈 LLM 应用开发。

    🚀 典型使用场景

    场景一:企业知识库 RAG 系统

    将企业内部文档(PDF 手册、Word 制度、Confluence 页面、钉钉/飞书文档)统一摄取,构建向量索引。员工可通过自然语言提问,系统从私有文档中检索相关段落并生成准确答案,实现”企业版 ChatGPT”。某金融科技公司使用 LlamaIndex + LlamaParse 构建了覆盖 10 万份研报的知识问答系统,查询准确率达 92%。

    场景二:AI 数据分析 Agent

    结合 LlamaIndex Agent 和 SQL 数据库连接器,构建能够理解自然语言并自动生成 SQL 查询、执行数据分析的 AI Agent。用户问”上个月销售额最高的产品是什么?”,Agent 自动查询数据库、生成图表、输出分析报告。支持多轮对话和上下文记忆,真正解放数据分析师的生产力。

    场景三:多模态文档理解

    利用 LlamaParse 解析包含图片、表格、图表的复杂 PDF 文档,结合多模态 LLM(如 GPT-4V、Claude Opus)实现图文联合理解。适用于法律合同审查、医学报告分析、学术论文摘要等场景,解析精度远超传统 OCR 工具。

    💡 推荐理由

    作为 RAG 领域的开创者之一,LlamaIndex 几乎定义了”上下文增强 LLM 应用”这一品类。我个人从 2023 年初就开始使用 LlamaIndex,见证了它从单一 RAG 库演进为完整的 Agent 平台。

    最让我印象深刻的是它的模块化设计哲学:高级 API 让新手 5 行代码跑通 demo,低级 API 让高级用户能定制每一个模块(数据连接器、索引策略、检索器、重排序器……)。这种”易者易用、难者难精”的设计,在开源框架中极为难得。

    另外,LlamaIndex 的文档质量也是开源项目中的顶级水准——不仅有完整的 API 参考,还有大量教程、Cookbook、视频课程,甚至出版了《LLM Application Development with LlamaIndex》一书。社区活跃度极高,Discord 频道每天有数百条讨论,问题基本能在 24 小时内得到解答。

    ⭐ 如果你正在构建任何需要”私有数据 + LLM”的应用,LlamaIndex 是你不应该错过的基础框架。

    ━━━━━━━━━━━━━━━━━━━━

    📅 本文撰写于 2026 年 6 月 22 日,基于 LlamaIndex 最新版本信息

    ⭐ 数据来源:GitHub API | 项目持续更新中,建议访问官网获取最新信息