标签: AI Agent

  • vLLM —— 83K+ Stars 的 LLM 高性能推理引擎,PagedAttention 颠覆内存管理

    vLLM Logo

    vLLM — 高性能 LLM 推理与服务引擎

    ⚡ vLLM

    83K+ Stars · 面向大模型的高吞吐量、内存高效推理与服务引擎

    📌 项目简介

    vLLM 是由加州大学伯克利分校 Sky Computing Lab 发起、现由 2800+ 贡献者共同维护的开源 LLM 推理与服务引擎。其核心竞争力在于首创的 PagedAttention 技术,通过智能管理注意力键值内存,大幅降低内存碎片,将 GPU 利用率推向极限。无论是本地开发调试,还是生产级大规模部署,vLLM 都是当前最热门的推理加速选择。

    83K+
    GitHub Stars

    2.8K+
    贡献者

    200+
    支持模型架构

    🛠️ 安装要求与过程

    环境要求:

    • Python 3.10+(推荐 3.12+)
    • NVIDIA GPU(CUDA 12.9/13.x)或 AMD GPU(ROCm)
    • 也支持 CPU、Google TPU、Apple Silicon 等多种硬件
    # 推荐用 uv 安装(更快更可靠)

    uv pip install vllm

    # 或用 pip

    pip install vllm

    # 快速启动 OpenAI 兼容 API 服务

    python -m vllm.entrypoints.openai.api_server \
    –model Qwen/Qwen3-8B –port 8000

    🚀 核心功能

    ⚡ PagedAttention 内存管理

    将注意力键值内存分页管理,类似操作系统的虚拟内存机制,大幅减少内存碎片和冗余复制,内存利用率提升 2-4 倍。

    🔄 持续批处理 + 前缀缓存

    动态合并正在处理的请求,并复用相同前缀(如 system prompt)的计算结果,吞吐量提升 3-5 倍。

    🧩 200+ 模型架构原生支持

    无缝兼容 Hugging Face 主流模型,涵盖 Llama、Qwen、DeepSeek-V3、Gemma、Mixtral、LLaVA 等,开箱即用。

    🔧 丰富量化方案

    支持 FP8、INT8、INT4、AWQ、GPTQ、GGUF 等主流量化格式,在保持精度的同时大幅降低显存占用和推理延迟。

    🌐 OpenAI 兼容 API

    提供与 OpenAI API 完全兼容的接口,只需改一行代码即可从 OpenAI 切换到自托管 vLLM,零迁移成本。

    💡 典型使用场景

    场景一:私有化部署大模型 API 服务

    企业希望在内部环境部署 Qwen 或 Llama 大模型,提供类似 OpenAI 的 API 供业务系统调用。vLLM 可在单张 H100 上实现远超传统方案的吞吐量,显著降低推理成本。

    场景二:本地开发与环境调试

    开发者在本地机器上调试 Prompt 或测试 Agent 工作流,需要快速启动一个兼容 OpenAI SDK 的本地服务。vLLM 一条命令即可启动,支持流式输出和工具调用。

    场景三:多模态模型推理服务

    需要部署 LLaVA、Qwen-VL 等多模态模型,同时处理文本和图像输入。vLLM 对多模态模型提供原生支持,统一的 API 接口让多模态应用开发更加便捷。

    ✨ 推荐理由

    vLLM 是目前 LLM 推理领域最炙手可热的开源项目,没有之一。它的核心竞争力在于 PagedAttention——这项技术直接解决了 LLM 推理中内存管理效率低下的痛点,是业界首个将操作系统虚拟内存思想引入注意力机制的工作,还发表了 SOSP 2023 学术论文。

    实际使用下来,vLLM 最让人省心的是「开箱即用」——Hugging Face 模型直接加载,OpenAI API 直接兼容,量化方案直接配置。对于想把大模型「跑起来」的团队,vLLM 是目前最成熟、社区最活跃的选择。

    值得一提的是,vLLM 的社区生态极其繁荣,AWS、NVIDIA、AMD、Google Cloud 等巨头均在赞助其开发。这意味着 vLLM 不仅是一个开源项目,更正在成为 AI 推理层的事实标准

    📥 下载地址

    License: Apache 2.0 | 语言: Python | 最初开发: UC Berkeley Sky Computing Lab

  • AI代理进公司打工,这家公司要给它们发员工身份

    AI代理进公司打工,这家公司要给它们发员工身份

    AI代理进公司打工,这件事在过去一年里从概念变成了现实。Goldman Sachs去年把AI编程代理Devin当正式员工来用,McKinsey年初说自家已经有25000个AI代理在和60000名人类员工一起干活。问题跟着来了:这些”数字员工”谁来管?权限怎么给?出了问题找谁?

    给AI代理发”工牌”

    网络安全创业公司NewCore从隐身模式走了出来,拿了6600万美元种子轮,估值after investment 3亿美元。领投的是专注网络安全的风投Cyberstarts,Index Ventures和Evolution Equity Partners跟投。他们的产品说白了就是一件事:把AI代理当”员工”来管理,给它们发身份、设权限、能吊销、能审计。

    AI代理身份管理概念图
    AI代理需要自己的”员工身份”,而不只是一串API密钥 | 配图来源:WorkBuddy AI生成

    创始人Zohar Alon之前创办过云安全公司Dome9(后来卖给了Check Point),他说服自己再创业的理由是:现在的身份系统——Okta、微软的Entra这些——都是给人类员工设计的,AI代理往里一塞,scale和复杂度会把它们撑爆。

    “我们很确定,AI代理要给那些用了15年、20年的身份平台增加的规模和复杂度,迟早会把它们搞崩。”
    ——Zohar Alon,NewCore联合创始人兼CEO

    不是给机器密钥,是给数字员工身份

    NewCore的平台把人类员工和AI代理的身份放在同一个系统里管,但AI代理拿的是”一等身份”——有自己的权限生命周期控制、独立的吊销机制,而不是被塞进传统的service account或者机器密钥的抽屉里。

    技术上一个关键是所谓的”split-key”架构:把关键身份凭证分成两份,客户拿一份,平台拿一份,这样就没有单一妥协点了。对于已经在用Anthropic Claude Code、OpenAI Codex或者Cursor的团队,NewCore提供了一个”Agentic Skill”集成包,让这些AI工具以受管身份访问企业系统,而不是靠人工分发的密钥。

    员工还可以用NewCore的手机App来授权、审查、吊销AI代理的访问权限——Alon把它描述成人类监督层,公司在部署更自主的系统时,总得有个”人”在循环里。

    AI代理比你想象的更快进入职场

    NewCore现在有50多个员工,分布在美国和以色列,平台当前有不到10个客户和10多个设计伙伴在用它。公司预计今年夏天开始向客户收费。

    Alon的预测是:在聚焦技术的组织里,AI代理数量几年内就会超过人类员工。TCS董事长N. Chandrasekaran最近也说了类似的话:AI代理的规模终将匹敌这家印度IT服务公司的员工总数。

    身份系统很可能是第一个被大规模AI代理部署压垮的企业系统。公司最终会需要新办法来监控、授权和吊销那些在网络里跑来跑去的数字工人——在它们搞出乱子之前。


  • Ollama — 本地大模型运行首选工具,165K+ Stars 的本地 LLM 神器

    Ollama — 本地大模型运行首选工具,165K+ Stars 的本地 LLM 神器

    Ollama - Get up and running with LLMs

    ⚡ GitHub 热门 AI 开源项目

    Ollama

    在本地一键运行 Llama 3、DeepSeek、Qwen、Gemma 等开源大语言模型,无需云端,隐私优先

    165K+ Stars
    📥 40K+ 社区集成
    🦙 Go + C++
    📜 MIT 开源协议

    📌 项目简介

    Ollama 是一款开源的本地大语言模型运行工具,让你在 macOS、Windows、Linux 上轻松下载、运行和管理各类开源 LLM。它内置了 llama.cpp 推理引擎,支持量化模型的高效运行,同时提供简洁的 CLI、REST API 以及 Python / JavaScript SDK,是本地 AI 开发的首选入口。

    🔧 安装要求和过程

    环境要求

    • 支持 macOS 11+、Windows 10+、Linux(x86_64 / ARM64)
    • 建议 8GB+ 内存(7B 模型);16GB+(13B 模型);32GB+(33B+ 模型)
    • 磁盘空间:每个模型约 4GB~20GB
    🍎 macOS

    brew install ollama

    或下载 Ollama.dmg 手动安装

    🪟 Windows
    下载 OllamaSetup.exe
    官网 ollama.com 直接下载安装包

    🐧 Linux

    curl -fsSL https://ollama.com/install.sh | sh

    🐳 Docker

    docker run ollama/ollama

    ⚡ 快速开始

    1. 安装完成后,终端运行 ollama serve 启动服务(默认 11434 端口)
    2. 运行 ollama run deepseek-r1 拉取并启动 DeepSeek-R1 模型
    3. 直接在终端对话,或访问 http://localhost:11434 调用 REST API

    🚀 核心功能

    ① 一键运行海量开源模型

    内置模型库(ollama.com/library)涵盖 Llama 3、DeepSeek-R1、Qwen2.5、Gemma、Mistral、Phi-3 等数百个模型,一条命令即可拉取运行。支持自定义 Modelfile 导入 GGML / GGUF 格式模型。

    ② 完整的 REST API 与 SDK

    默认在 11434 端口提供 OpenAI 兼容的 REST API,官方提供 Python 和 JavaScript SDK。可以无缝接入 LangChain、Lobe Chat、Open WebUI 等生态,开发者集成成本极低。

    ③ 多模型并行与 GPU 加速

    支持同时加载多个模型,自动检测并利用 NVIDIA / AMD GPU 进行推理加速。macOS 上原生支持 Metal GPU 加速,Linux 支持 CUDA 和 ROCm,推理速度大幅提升。

    ④ 丰富的生态集成

    社区已推出 40,000+ 个集成工具,涵盖桌面应用(Open WebUI、Enchanted)、IDE 插件(Continue、CopilotKit)、Agent 框架(LangChain、AutoGen)、RAG 工具(AnythingLLM)等,几乎覆盖所有 AI 开发场景。

    ⑤ 隐私优先,完全离线

    所有推理在本地执行,数据不出本机。无需注册、无需联网、无需付费 API Key,特别适合对数据隐私有严格要求的企业内网和个人开发者。

    💡 典型使用场景

    场景一:本地 AI 编程助手

    搭配 Continue.devVS Code Ollama 插件,在断网环境下也能使用本地 LLM 辅助代码补全、解释和重构。使用 DeepSeek-Coder 或 CodeLlama 模型,响应速度毫秒级,代码质量媲美云端模型。

    实战示例:运行 ollama run deepseek-coder:6.7b,然后在 Continue.dev 中配置 Ollama 为默认 Provider,即可在 VS Code 侧边栏直接对话编程。

    场景二:私有知识库 RAG 系统

    结合 AnythingLLMOpen WebUI,将企业内网文档、PDF、Markdown 文件作为知识库,通过 Ollama 本地推理实现零数据外泄的智能问答系统。金融、医疗、法律等敏感行业尤为适用。

    实战示例:Docker 部署 AnythingLLM,在设置中选择 Ollama 作为 LLM Provider,指定本地模型(如 Llama3:8b),然后上传内部文档即可开始私有问答。

    场景三:AI 应用本地开发测试

    在开发 AI 应用时,使用 Ollama 替代 OpenAI API 进行本地测试和迭代,无需消耗云端配额,也避免了敏感测试数据外传的风险。Ollama 的 API 与 OpenAI 高度兼容,切换成本极低。

    实战示例:在 .env 中设置 OPENAI_BASE_URL=http://localhost:11434/v1OPENAI_API_KEY=ollama,现有基于 OpenAI SDK 的代码几乎不用改动即可切换至本地模型。

    ✨ 推荐理由

    作为本地 LLM 领域的”Docker”,Ollama 几乎是所有 AI 开发者入门本地模型的第一站。它把复杂的模型量化、推理引擎配置、GPU 驱动适配等底层细节全部封装,真正做到了”一行命令运行大模型”。

    我个人最常用的场景是在无网环境下做代码审查和文档撰写——启动 DeepSeek-R1 本地模型,响应速度非常快,且完全不担心代码泄露。相比云端 API,本地运行的成本优势在长期使用中极为明显:一次性下载模型,后续零费用无限调用。

    另外值得一提的是 Ollama 的 REST API 与 OpenAI 高度兼容,这意味着你可以用同一套代码同时支持云端和本地模型,在开发阶段用本地模型省成本,上线时切换到 GPT-4 保质量,这种灵活性是其他本地 LLM 工具难以提供的。

    如果你还没试过在本地运行 LLM,Ollama 是最好的起点。165K Stars 和 40K+ 社区集成不是偶然——它真的好用。


      GitHub 热门 AI 开源项目系列  
  • CrewAI — 53.7K+ Stars,让多个AI智能体像团队一样协作的Python框架

    CrewAI — 53.7K+ Stars,让多个AI智能体像团队一样协作的Python框架

    🚀 CrewAI — 让多个 AI 智能体像团队一样协作

    📌 项目简介

    CrewAI 是一个完全独立、轻量、高性能的 Python 多智能体编排框架,专门用于协调角色扮演型自主 AI 智能体。它从零构建,不依赖 LangChain 或其他智能体框架,兼顾高层级开发的简洁性和底层控制的精准性,让多个 AI Agent 像真实团队一样分工协作,高效完成复杂任务。

    目前已有超过 10 万名开发者通过官方学习平台完成认证,CrewAI 正快速成为企业级 AI 自动化的标准框架。

    ⚙️ 安装要求和过程

    环境要求

    • Python: ≥ 3.10 且 < 3.14
    • 依赖管理: 推荐使用 UV(极速 Python 包管理器)
    • LLM 接入: 需配置 OpenAI API Key 或兼容接口(支持 Ollama 本地模型)

    快速安装

    # 安装基础版本
    uv pip install crewai
    
    # 安装带常用工具的完整版本
    uv pip install 'crewai[tools]'
    
    # 创建新项目(推荐)
    crewai create crew my_project
    

    常见问题排查

    报错信息 解决方案
    ModuleNotFoundError: No module named 'tiktoken' 显式安装: uv pip install 'crewai[embeddings]'
    Failed building wheel for tiktoken 安装 Rust 编译器 + Visual C++ Build Tools,或使用预编译包

    ✨ 核心功能

    1. 完全独立的轻量框架

    CrewAI 从零开始构建,完全不依赖 LangChain 等第三方智能体框架。执行速度比 LangGraph 快 5.76 倍(QA 任务场景),资源占用更低,定制更灵活。你可以在任意层级深度自定义 —— 从整体工作流到智能体内部提示词,全部开放。

    2. 双模式编排:Crew + Flow

    CrewAI 提供两种互补的核心编排能力:

    • Crew(智能体组):支持智能体自主协作和动态决策,适合需要灵活交互的任务
    • Flow(工作流):企业级生产架构,提供细粒度、事件驱动的流程控制,支持单 LLM 调用精准编排,原生兼容 Crew

    两者可无缝结合,兼顾灵活性与可控性。

    3. YAML 配置驱动开发

    通过 agents.yamltasks.yaml 声明式配置智能体角色、目标和任务描述,将业务逻辑与代码逻辑完全解耦。@CrewBase 装饰器自动加载配置,开发体验极佳:

    # config/agents.yaml
    researcher:
      role: "{topic} Senior Data Researcher"
      goal: "Uncover cutting-edge developments in {topic}"
      backstory: "You're a seasoned researcher with a knack for ..."
    
    # config/tasks.yaml
    research_task:
      description: "Conduct a thorough research about {topic}"
      expected_output: "A list with 10 bullet points ..."
      agent: researcher
    

    4. 丰富的工具生态与集成

    内置 crewai_tools 工具包,包含 SerperDevTool(Google 搜索)、ScrapeWebsiteToolPDFSearchTool 等常用工具。同时支持:

    • 对接 Ollama / LM Studio 本地模型
    • 对接 OpenAI / Anthropic / Gemini 等主流 LLM
    • 自定义 Tool 类,轻松扩展能力边界
    • 与企业现有系统、数据源和云基础设施无缝集成

    5. 企业级可观测性与安全

    CrewAI AMP Suite 提供企业级综合解决方案:

    • 追踪与可观测性:实时监控 AI 智能体和 Workflows,提供指标、日志、调用链路追踪
    • 统一控制平面:集中管理、监控、扩缩 AI 智能体和自动化流程
    • 高级安全能力:内置安全与合规机制,支持本地/云端灵活部署
    • 7×24 小时企业支持:专属支持团队保障业务无中断运行

    💡 典型使用场景

    场景一:AI 行业动态自动研究报告

    配置一个「资深研究员」智能体和「报告分析师」智能体,前者利用搜索工具搜集最新资料,后者将分析结果整理为结构化 Markdown 报告。全程自动化,每天早上收到一份行业动态简报。

    inputs = {'topic': 'AI Agents'}
    LatestAiDevelopmentCrew().crew().kickoff(inputs=inputs)
    # 输出: report.md — 完整的研究报告
    

    适用:市场调研、竞品分析、技术趋势跟踪

    场景二:股票分析自动化流水线

    结合 SerperDevTool 获取实时财经新闻,多个分析智能体分别负责基本面分析、技术面分析、风险评估,最终由汇总智能体输出投资建议报告。CrewAI 官方示例仓库中提供了完整的 Stock Analysis 案例。

    适用:量化投研、财经内容自动生成、投资决策辅助

    场景三:旅行规划智能体组

    「目的地推荐师」「酒店比价员」「行程安排师」三个智能体协同工作:推荐师根据预算和偏好输出目的地清单,比价员自动抓取酒店价格,安排师生成逐日行程表。CrewAI 官方 Trip Planner 示例可直接运行。

    适用:个性化推荐系统、旅行/餐饮/购物助手、智能客服

    🌟 推荐理由

    在多智能体框架的选型上,我曾对比过 LangGraph、AutoGen 和 CrewAI,最终选择深入使用 CrewAI,原因主要有三点:

    1. 学习曲线最平缓。YAML 配置 + Python 代码的分离设计让业务逻辑一目了然,官方 learn.crewai.com 学习平台提供从入门到精通的系统课程,还有 DeepLearning.AI 的 免费短课程,上手速度远超同类框架。
    2. 生产就绪。很多多智能体框架停留在 Demo 阶段,CrewAI 在设计之初就考虑了生产环境需求 —— Memory(记忆)、Delegation(任务委托)、Human-in-the-loop(人工介入)等生产必备功能一应俱全,且有企业级 AMP Suite 提供运维保障。
    3. 性能优势明显。官方基准测试显示 CrewAI 比 LangGraph 快 5.76 倍,在实际项目中我也感受到明显差异,尤其是多智能体并行执行场景下,响应速度和稳定性表现出色。

    如果你正在考虑引入多智能体架构,CrewAI 是目前最成熟、最易上手的选项之一。建议从官方示例仓库 crewAI-examples 挑一个最接近你需求的案例跑起来,15 分钟就能感受到它的威力。

    📥 下载地址

  • n8n – 192K+ Stars,安全工作流自动化平台,原生AI能力加持

    n8n – 192K+ Stars,安全工作流自动化平台,原生AI能力加持

    📦 项目简介

    n8n 是一个面向技术团队的安全工作流自动化平台,兼具代码的灵活性与无代码的速度优势。它采用fair-code许可证,支持自托管和云服务两种部署方式。

    截至2026年,n8n在GitHub上已获得 192,000+ Stars,拥有400+第三方集成、900+现成工作流模板,是当前最热门的开源自动化工具之一。

    🚀 核心功能

    1. 灵活编码支持:支持编写JavaScript/Python代码、添加npm包,也可使用可视化界面搭建流程
    2. 原生AI能力:可基于LangChain构建AI智能体工作流,支持使用自定义数据和模型
    3. 400+集成:与主流应用和服务无缝集成(Slack、GitHub、Google Workspace等)
    4. 900+模板:社区贡献的现成工作流模板,一键导入使用
    5. 企业级能力:支持高级权限管理、单点登录(SSO)、离线部署

    💻 安装要求与步骤

    环境要求

    • Node.js:版本 18.10 或更高
    • npm:随Node.js安装
    • Docker:(可选)用于容器化部署

    快速安装 – 方式1:npx一键启动(推荐)

    # 需要预先安装 Node.js
    npx n8n

    启动后访问 http://localhost:5678 即可进入编辑器。

    快速安装 – 方式2:Docker部署

    docker volume create n8n_data
    docker run -it --rm --name n8n -p 5678:5678   -v n8n_data:/home/node/.n8n   docker.n8n.io/n8nio/n8n

    启动后访问 http://localhost:5678 使用。

    快速安装 – 方式3:npm全局安装

    npm install -g n8n
    n8n

    🌟 典型使用场景

    场景1:AI智能体工作流

    结合LangChain和自定义数据,构建智能化的AI Agent工作流。例如:自动从邮件中提取任务、调用AI分析优先级、自动创建Trello卡片并通知团队。

    场景2:多系统数据同步

    连接CRM、营销工具、数据库等多个系统,实现数据自动同步。例如:当Salesforce新增客户时,自动在Mailchimp中创建订阅者、在Slack中通知销售团队。

    场景3:定期报告自动生成

    定时从多个数据源拉取数据、生成可视化报告并自动发送。例如:每周一早上9点,自动汇总上周的网站分析数据、生成PDF报告并邮件发送给团队。

    💡 推荐理由

    • 开源可控:fair-code许可证,自托管完全掌控数据,无供应商锁定风险
    • 技术友好:支持写代码也支持可视化,开发者和非开发者都能高效使用
    • AI原生:深度集成LangChain,轻松构建AI驱动的工作流
    • 生态丰富:400+集成、900+模板,几乎覆盖所有主流工具
    • 社区活跃:GitHub 192K+ Stars,社区论坛活跃,问题响应快

    🔗 下载地址


    标签:#n8n #工作流自动化 #AI Agent #开源 #Python #自动化 #低代码

  • LangChain — 135K+ Stars 的 AI 智能体工程平台,构建 LLM 应用的首选框架

    LangChain Logo

    🔗 LangChain

    The Agent Engineering Platform — 135K+ Stars

    📦 langchain-ai/langchain · MIT License · Python

    📝 项目简介

    LangChain 是一个智能体工程平台,为构建 LLM 驱动的应用提供标准化接口与丰富的第三方集成,帮助开发者快速构建、调试和部署生产级 AI 智能体应用。

    135K+
    GitHub Stars

    279K+
    依赖项目

    600+
    集成组件

    v1.x
    最新稳定版

    ⚙️ 安装要求与过程

    环境要求
    • Python ≥ 3.9
    • 推荐使用 uv 作为包管理工具
    • 需要有效的 LLM API Key(OpenAI / Anthropic / 国内模型等)
    # 快速安装
    # 使用 uv 安装(推荐)
    uv add langchain
    
    # 使用 pip 安装
    pip install langchain
    
    # 安装特定模型集成
    pip install langchain-openai
    pip install langchain-anthropic

    # 快速开始 — Hello World
    from langchain.chat_models import init_chat_model
    
    # 初始化模型(支持任意提供商)
    model = init_chat_model("openai:gpt-4o")
    # model = init_chat_model("anthropic:claude-sonnet-4-20250514")
    
    result = model.invoke("用一句话解释什么是 LangChain")
    print(result.content)

    ⭐ 核心功能

    1
    标准化模型接口
    为模型、嵌入、向量存储等核心组件提供统一接口,切换底层模型无需重构业务代码,彻底告别厂商锁定。

    2
    丰富的第三方集成
    内置 600+ 集成组件,覆盖主流 LLM 提供商、向量数据库、检索工具、API 工具等,即插即用。

    3
    灵活的抽象层次
    从高层级链式调用(快速原型)到底层组件细粒度控制(复杂生产场景),支持不同复杂度的应用需求。

    4
    LangGraph 智能体编排
    配套 LangGraph 提供低层级智能体编排框架,支持复杂可控的多智能体工作流,适合生产级应用场景。

    5
    LangSmith 可观测性
    无缝对接 LangSmith 进行智能体评估、调试与监控,支持生产环境部署与长时状态工作流扩缩容。

    🚀 典型使用场景

    场景一:RAG(检索增强生成)问答系统
    将企业知识库文档向量化存储,结合 LangChain 的 Retriever 组件与 LLM,实现基于私有数据的精准问答。支持对接 Chroma、Pinecone、FAISS 等主流向量数据库,是构建企业 AI 知识助手的首选方案。

    场景二:智能客服 / AI Agent 工作流
    利用 LangChain 的 Agent 与 Tools 机制,让 LLM 自主调用搜索引擎、数据库查询、API 接口等工具,构建能完成多步骤复杂任务的智能助手。结合 LangGraph 可实现包含人工审批节点的复杂业务流程自动化。

    场景三:结构化数据抽取与处理
    利用 LangChain 的 OutputParser 与 Structured Output 功能,从非结构化文本中抽取结构化信息(如提取简历关键信息、解析合同要素),并输出为 JSON / Pydantic 模型,方便后续业务系统处理。

    💡 推荐理由

    LangChain 是 AI 应用开发领域当之无愧的”基础设施”。如果你正在构建任何与 LLM 相关的应用,LangChain 几乎是你绕不开的选择。

    它的核心价值在于标准化:无论你用 OpenAI、Anthropic 还是国产模型,接口一致;无论你用 PostgreSQL、Pinecone 还是 FAISS 存向量,接口一致。这种抽象让你可以随时切换底层技术,而不用重写应用逻辑。

    2026 年 LangChain 已迭代至 v1.x 稳定版,配套生态(LangGraph 智能体编排、LangSmith 可观测性、Deep Agents 低代码智能体)日趋完善,从快速原型到生产部署的全流程都有成熟方案支撑。

    当然,LangChain 的抽象层较厚,对于追求极致性能的场景可能需要权衡。但对于绝大多数 AI 应用开发者而言,它依然是目前最成熟、社区最活跃、学习资源最丰富的不二之选。

    ⋯⋯

    AI
    开源
    LangChain
    LLM
    AI Agent
  • Agent-Reach:给AI Agent装上「全网眼睛」,30K+ Stars的免费互联网接入神器

    Agent-Reach:给AI Agent装上「全网眼睛」,30K+ Stars的免费互联网接入神器

    Agent-Reach - 给AI Agent装上全网眼睛

    项目简介

    Agent-Reach 是一个为 AI 智能体(AI Agent)提供全网内容读取与搜索能力的开源工具。它让 AI Agent 能够一键读取 Twitter、Reddit、YouTube、B站、小红书、GitHub 等 15+ 平台的内容——完全免费、无需付费 API,只需一行命令安装。

    项目目前拥有 30K+ GitHub Stars,是当前 AI Agent 基础设施领域最热门的项目之一。由开发者 Panniantong 开发并持续维护,采用 MIT 开源协议。

    为什么需要 Agent Reach?

    AI Agent 已经能帮你写代码、改文档、管项目——但你让它去网上找点东西,它就抓瞎了:

    • 📺 让 AI 看 YouTube 教程 → 拿不到字幕
    • 🐦 让 AI 搜推特产品评价 → Twitter API 要付费
    • 📖 让 AI 去 Reddit 找同类 bug → 返回 403
    • 📕 让 AI 看小红书商品口碑 → 必须登录才能打开
    • 📺 让 AI 总结 B 站技术视频 → 被风控拦截
    • 🔍 让 AI 搜索最新 LLM 框架对比 → 没有好用的免费工具

    安装要求与环境配置

    环境要求 说明
    Python 版本 Python 3.10 及以上
    操作系统 macOS / Linux / Windows 全平台支持
    兼容 Agent Claude Code、OpenClaw、Cursor、Windsurf、Codex 等所有能执行命令的 Agent
    网络代理 本地电脑不需要;服务器部署可能需要(~$1/月)

    快速安装步骤

    方法一:一键安装(推荐)
    # 复制这句话给你的 AI Agent:
    帮我安装 Agent Reach:https://raw.githubusercontent.com/Panniantong/agent-reach/main/docs/install.md
    
    # 或手动执行:
    pip install agent-reach
    agent-reach install --env=auto
    方法二:安全模式(生产环境推荐)
    pip install agent-reach
    agent-reach install --env=auto --safe

    安装完成后,运行诊断命令查看各渠道状态:

    agent-reach doctor

    核心功能

    🌐 网页阅读

    基于 Jina Reader 免费读取任意网页内容,自动清洗 HTML 标签,输出干净文本。无需 API Key。

    🐦 Twitter/X 读取

    通过 Cookie 认证免费读取和搜索推文,支持单条推文、时间线浏览、长文阅读。无需 Twitter API 付费。

    📺 YouTube 字幕提取

    基于 yt-dlp(154K Stars)提取视频字幕和元数据,支持多语言,无需 API Key。

    📺 B站搜索与阅读

    使用 bili-cli 无需登录即可搜索视频、获取详情。支持字幕提取(需 OpenCLI 配置)。

    🔍 全网语义搜索

    集成 Exa AI 语义搜索引擎(MCP 接入),支持自然语言查询,免费无需 Key。

    完整平台支持列表

    平台 零配置功能 配置后解锁
    🌐 网页 阅读任意网页
    📺 YouTube 字幕 + 搜索
    📡 RSS 解析任意源
    📦 GitHub 公开仓库 + 搜索 私有仓库 / Issue / PR
    🐦 Twitter/X 读单条推文 搜索 / 时间线 / 长文
    📖 Reddit 搜索 + 读帖子和评论
    📕 小红书 搜索 / 阅读 / 评论
    💼 LinkedIn Jina Reader 公开页 Profile / 公司页面
    💻 V2EX 热门帖子 + 详情
    📈 雪球 行情 + 搜索 + 热榜 高级数据

    典型使用场景

    🎯 场景一:AI 产品调研助手

    让 AI Agent 同时搜索 Twitter 用户对竞品的真实评价、Reddit 上的讨论帖、YouTube 上的评测视频,再汇总成调研报告。以前需要人工切换多个平台的操作,现在一句话搞定:

    "帮我调研一下 Cursor vs Windsurf 的用户反馈,
    搜一下 Twitter 和 Reddit 上的讨论"

    🎯 场景二:技术视频学习加速器

    把 YouTube/B站的技术教程链接丢给 Agent,它会自动提取字幕、总结要点、生成笔记。再也不用花 2 小时看完一个视频才知道讲的是什么:

    "总结一下这个 YouTube 视频的核心内容:
    https://youtube.com/watch?v=xxx"

    🎯 场景三:全网信息监控与聚合

    设置定时任务让 Agent 监控特定关键词在 Twitter、Reddit、V2EX 等平台的最新动态,汇总后推送给你。特别适合追踪技术趋势、竞品动态或舆情监测:

    "每天早上搜一下 RAG 相关的最新讨论,
    看看 Twitter 和 Reddit 上有什么新进展"

    推荐理由

    💡 个人使用心得:

    作为一个每天和各种 AI Agent 打交道的人,Agent-Reach 解决了我最大的痛点——Agent 的「互联网盲区」。以前让 Claude Code 去查个资料,它只能靠内置知识或者我手动复制粘贴;现在装上 Agent-Reach 后,它能自己去看 Twitter 讨论、读 Reddit 帖子、甚至总结 YouTube 视频内容。

    最让我印象深刻的是它的「能力层」设计理念:它不自己造轮子,而是帮你在底层选好、装好、配好各个平台的最佳开源工具(twitter-cli、bili-cli、OpenCLI 等)。而且当某个工具失效时(比如 yt-dlp 被 B 站风控封了),它会自动切换备选方案,用户几乎无感。

    另一个亮点是 `agent-reach doctor`——一条命令告诉你每个渠道通不通、走的是哪个后端、怎么修。这种「体检」设计在开源工具里非常少见。

    如果你正在使用 Claude Code、Cursor 或任何 AI 编程助手,强烈建议试试 Agent-Reach。它会让你的 Agent 从「只能写代码的程序员」进化为「能联网调研的全栈工程师」。

    技术架构亮点

    • 多后端路由机制:每个平台维护「首选 + 备选」有序后端列表,某条路失效自动切下一条
    • 零包装层设计:Agent 直接调用上游工具,没有中间封装层,性能损耗最小化
    • SKILL.md 注册制:安装后在 Agent skills 目录注册使用指南,Agent 自动知道该调什么
    • 安全优先:Cookie 仅存本地(权限 600)、支持安全模式和 Dry Run、代码完全可审计
    • 跨平台兼容:macOS / Linux / Windows 全平台支持,兼容所有主流 AI Agent

    下载地址

    GitHub 仓库 github.com/Panniantong/Agent-Reach
    PyPI 安装 pip install agent-reach
    开源协议 MIT License
    Star 数量 ⭐ 30K+ Stars
  • Open-WebUI:自托管AI平台,打造专属的ChatGPT体验

    在本地运行大语言模型(LLM)已经成为越来越多开发者和AI爱好者的选择。但Ollama等工具缺乏友好的Web界面,而Open-WebUI完美解决了这个问题——它提供了一个功能丰富、可自托管的AI交互平台,让你在本地也能享受媲美ChatGPT的使用体验。

    项目简介

    Open-WebUI 是一个可扩展、功能丰富、用户友好的自托管AI平台,支持完全离线运行。它兼容Ollama、OpenAI兼容API等多种LLM运行器,并内置RAG(检索增强生成)推理引擎。目前GitHub Stars已超过105,000+,是本地AI部署的首选界面方案。

    安装要求和过程

    环境要求

    • Python方式:需要 Python 3.11(避免使用其他版本以免兼容性问题)
    • Docker方式:需要安装Docker,建议使用GPU环境以获得更好性能
    • Ollama:如需本地运行模型,需提前安装Ollama
    • 存储空间:至少预留5GB空间用于模型和数据集

    快速安装步骤

    方式一:Python pip安装(最简单)

    # 安装项目
    pip install open-webui
    
    # 启动服务,访问地址:http://localhost:8080
    open-webui serve
    

    方式二:Docker快速部署(推荐)

    # 基础部署(Ollama在本地)
    docker run -d -p 3000:8080   --add-host=host.docker.internal:host-gateway   -v open-webui:/app/backend/data   --name open-webui --restart always   ghcr.io/open-webui/open-webui:main
    
    # 访问地址:http://localhost:3000
    

    方式三:一体化部署(包含Ollama)

    # 带GPU支持
    docker run -d -p 3000:8080 --gpus=all   -v ollama:/root/.ollama   -v open-webui:/app/backend/data   --name open-webui --restart always   ghcr.io/open-webui/open-webui:ollama
    
    # 仅CPU
    docker run -d -p 3000:8080   -v ollama:/root/.ollama   -v open-webui:/app/backend/data   --name open-webui --restart always   ghcr.io/open-webui/open-webui:ollama
    

    核心功能

    • 多模型兼容:无缝集成Ollama、OpenAI API,支持对接LMStudio、GroqCloud、Mistral、OpenRouter等第三方服务,一个界面管理所有AI模型。
    • 本地RAG能力:内置检索增强生成引擎,支持9种向量数据库(ChromaDB、PGVector、Qdrant、Milvus等),可直接上传文档进行智能问答。
    • 多模态交互:支持语音/视频通话,集成多种语音转文本和文本转语音引擎;支持DALL-E、Gemini、ComfyUI等多种图像生成引擎。
    • 权限管理:细粒度用户角色与权限控制,支持LDAP/AD集成、SSO单点登录,适合团队和企业部署。
    • 插件扩展:支持Pipelines插件框架,可自定义业务逻辑(函数调用、用户限流、实时翻译、内容过滤等)。

    典型使用场景

    场景一:个人本地AI助手

    通过Docker一键部署Open-WebUI + Ollama,在本地运行Llama 3、Mistral等开源模型。所有数据完全离线,保障隐私安全;同时获得与ChatGPT媲美的Web交互体验,支持多轮对话、Markdown渲染、代码高亮等功能。

    场景二:团队协作AI平台

    利用Open-WebUI的权限管理和SSO集成能力,为企业团队搭建内部AI平台。通过RBAC控制不同用户的模型访问权限,对接企业内部知识库实现RAG问答,并监控API使用量和成本。

    场景三:AI应用开发测试

    开发者可使用Open-WebUI快速测试不同LLM模型的效果,通过模型构建器自定义提示词和角色,利用Python函数调用扩展自定义能力,加速AI应用的原型开发和测试验证。

    推荐理由

    Open-WebUI是我试用过的最优秀的本地LLM Web界面,没有之一。它的设计非常贴合实际使用场景:响应式界面适配各种设备,PWA支持让你可以像原生App一样使用,RAG功能让你可以轻松对接个人知识库。

    相比其他类似工具,Open-WebUI的最大优势在于完整性和成熟度:它不仅有精美的界面,还有完整的企业级功能(权限管理、SSO、监控等),同时支持广泛的模型和后端的灵活配置。无论你是个人用户还是企业团队,都能找到适合自己的部署方式。

    特别推荐它的RAG集成能力——上传文档后可以直接在对话中引用,支持多种向量数据库和搜索引擎,真正实现”个人AI知识库”的落地。如果你一直在寻找一个好用的本地LLM界面,Open-WebUI绝对值得一试。

    下载地址

    如果你觉得这个项目有帮助,欢迎到GitHub上点个Star支持开发者!

  • 【开源推荐】aisuite:14.5K+ Stars!Andrew Ng 出品,一行代码切换 14+ 个 AI 大模型

    【开源推荐】aisuite:14.5K+ Stars!Andrew Ng 出品,一行代码切换 14+ 个 AI 大模型

    🚀 aisuite
    Simple, unified interface to multiple Generative AI providers
    ⭐ 14,500+ Stars  |  🍴 1,500+ Forks  |  🐍 Python  |  📜 MIT License

    📌 项目简介

    aisuiteAndrew Ng(吴恩达)团队开源的轻量级 Python 库,通过一套统一 API 接口同时调用 OpenAI、Anthropic、Google、Mistral、AWS、Ollama 等 14+ 个 AI 大模型提供商。只需修改一个字符串即可切换模型,彻底告别各家 SDK 差异带来的适配噩梦。

    该项目采用两层架构:底层是统一 Chat Completions API(兼容 OpenAI 格式),上层是带工具调用的 Agents API。同仓库还包含基于 aisuite 构建的桌面 AI 助手 OpenCoworker

    ⚙️ 安装要求和过程

    环境要求

    • Python 3.9+
    • 各 AI 提供商的 API Key(或本地 Ollama)
    • 磁盘空间:约 50MB(基础包)

    快速安装(3步)

    # 基础安装(不含提供商 SDK)
    pip install aisuite
    
    # 安装时附带指定提供商的 SDK
    pip install 'aisuite[anthropic]'
    pip install 'aisuite[openai]'
    pip install 'aisuite[google]'
    
    # 安装所有提供商 SDK(完整版)
    pip install 'aisuite[all]'

    API Key 配置

    # 设置环境变量(Linux/macOS)
    export OPENAI_API_KEY="sk-your-key"
    export ANTHROPIC_API_KEY="sk-ant-your-key"
    
    # Windows PowerShell
    $env:OPENAI_API_KEY = "sk-your-key"
    $env:ANTHROPIC_API_KEY = "sk-ant-your-key"

    ✨ 核心功能

    ① 统一 Chat Completions API —— 一行切换模型
    模型名格式 <provider>:<model-name>,修改一个字符串即可在不同提供商之间切换,所有核心参数(temperature、max_tokens、tools 等)均为提供商无关。

    ② Agents API —— 让模型使用真实工具
    传入普通 Python 函数即可获得工具调用能力,aisuite 自动生成 JSON Schema、执行函数调用、将结果反馈给模型。max_turns 参数控制多轮对话,也可手动控制每一轮。

    ③ Toolkits —— 开箱即用的工具集
    内置 files(文件操作)、git(版本控制)、shell(命令行)等工具集,也可接入任意 MCP 服务器,让 Agent 获得文件系统、浏览器自动化等真实能力。

    ④ 生产级 Agent 管控
    支持 Tool Policies(工具调用审批策略)、State Stores(跨进程持久化对话状态,支持内存/文件/Postgres)、Artifacts & Tracing(完整记录 Agent 产出和每一步执行轨迹)。

    ⑤ OpenCoworker —— 开箱即用的桌面 AI 助手
    同仓库附赠 OpenCoworker 桌面应用(macOS/Windows),能聊天、做深度研究、读写文件、收发消息(Slack/Email)、生成 PDF 报告,并支持定时自动化任务(如每日新闻摘要)。数据完全留在本地。

    🎯 典型使用场景

    场景一:多模型对比评测
    研究人员可以用同一段代码,分别调用 GPT-4o、Claude 3.5 Sonnet 和 Gemini Pro,对比不同模型在同一 Prompt 下的响应质量,而无需维护三套 SDK 调用代码。aisuite 让 A/B 测试大模型 变得极其简单。

    场景二:构建支持多提供商的 AI 产品
    SaaS 产品需要同时支持 OpenAI 和 Anthropic,或允许用户选择自己偏好的模型。使用 aisuite,产品代码只需维护一套接口,后端根据配置动态路由到不同提供商,大幅降低维护成本。

    场景三:本地 + 云端混合部署
    开发阶段使用免费本地模型 Ollama,上线后切换到 OpenAI API。aisuite 让这种切换只需改一个字符串("ollama:llama3""openai:gpt-4o"),无需改动任何业务逻辑代码。

    💡 推荐理由

    Andrew Ng 亲自站台的项目,质量有保障。我推荐它的核心原因是它解决了一个真实存在的痛点:每家 AI 公司的 API 都不一样。OpenAI 用一套格式,Anthropic 用另一套,Google 又是另一套……如果你要同时支持多家,代码里全是 if provider == "openai" 这种恶心的判断逻辑。

    aisuite 把这一切统一了。它的 API 设计完全兼容 OpenAI 的 Chat Completions 格式,其他提供商只是”适配层”,对使用者完全透明。这种设计意味着你现有的 OpenAI 代码几乎不用改,就能无缝迁移到 Claude 或 Gemini。

    更让人惊喜的是它的 Agents API 设计——传入普通 Python 函数就能让模型调用工具,不需要手写 JSON Schema。加上对 MCP(Model Context Protocol)的原生支持,未来接入各种工具生态会很方便。

    如果你正在做 AI 应用开发,或者需要对比评测多个大模型,aisuite 是目前最优雅的解决方案,没有之一。

    📥 下载地址

    🌐 官方网站:
    github.com/andrewyng/aisuite
    💻 快速安装:
    pip install aisuite
    💬 Discord 社区:
    discord.gg/T6Nvn8ExSb

    🔌 支持的 AI 提供商

    提供商 模型示例 调用格式
    OpenAI gpt-4o, gpt-4-turbo openai:gpt-4o
    Anthropic claude-3-5-sonnet anthropic:claude-3-5-sonnet-20240620
    Google gemini-pro, gemini-1.5-pro google:gemini-pro
    Mistral mistral-large, mixtral-8x7b mistral:mistral-large
    Ollama(本地) llama3, mistral, codellama ollama:llama3
    AWS Bedrock anthropic.claude-3-5-sonnet bedrock:anthropic.claude-3-5-sonnet
    Hugging Face 任意 HF 模型 huggingface:model-name

    📅 文章发布时间:2026 年 6 月 15 日
    📜 开源协议:MIT License(可自由用于商业和非商业项目)

  • 【开源推荐】Open WebUI:142K+ Stars!自托管 AI 聊天界面,隐私优先的本地大模型前端

    【开源推荐】Open WebUI:142K+ Stars!自托管 AI 聊天界面,隐私优先的本地大模型前端

    Open WebUI

    Open WebUI – 自托管 AI 聊天界面

    📦 项目简介

    Open WebUI 是一个用户友好的自托管 AI 界面,支持 Ollama、OpenAI API 等多种 LLM 服务,可完全离线运行。它提供了类似 ChatGPT 的优雅聊天体验,同时保障数据隐私,是企业和个人部署本地 AI 能力的首选前端方案。

    ⭐ 142K+ Stars
    🍴 20.3K+ Forks
    🐍 Python + Svelte
    📦 Docker 一键部署

    ⚙️ 安装要求和过程

    环境要求

    • Python 3.11(pip 安装方式必须使用此版本)
    • Docker(推荐,最简单)
    • Ollama(如需本地模型,可选)
    • 磁盘空间:至少 2GB(含依赖和模型)

    方式一:Docker 安装(推荐)

    # 基础安装(Ollama 在本地)

    docker run -d -p 3000:8080 \
      –add-host=host.docker.internal:host-gateway \
      -v open-webui:/app/backend/data \
      –name open-webui –restart always \
      ghcr.io/open-webui/open-webui:main

    # 内置 Ollama(CPU)

    docker run -d -p 3000:8080 \
      -v ollama:/root/.ollama \
      -v open-webui:/app/backend/data \
      –name open-webui –restart always \
      ghcr.io/open-webui/open-webui:ollama

    方式二:Python pip 安装

    pip install open-webui
    open-webui serve

    ⚠️ 注意:必须使用 Python 3.11,避免兼容性问题!

    安装完成后访问 http://localhost:8080 即可使用。

    ✨ 核心功能

    🤖 1. 多模型兼容

    原生支持 Ollama、OpenAI 兼容 API,可对接 LMStudio、GroqCloud、Mistral、OpenRouter 等第三方服务。支持同时调用多个模型,获取最优输出结果。

    📚 2. RAG 检索增强生成

    支持 9 种向量数据库(ChromaDB、PGVector、Qdrant 等),多种内容提取引擎。可上传文档到知识库,通过 # 命令快速调用文档内容,打造私人知识助手。

    🔍 3. 联网搜索能力

    支持 15+ 搜索引擎(SearXNG、Google PSE、Brave Search 等)的 RAG 联网搜索,可直接输入 URL 引用网页内容到对话中,让 AI 获取实时信息。

    🎨 4. 多模态交互

    支持语音/视频通话,集成多种语音转文字、文字转语音引擎。支持图像生成与编辑,可对接 DALL-E、Gemini、ComfyUI、AUTOMATIC1111 等引擎。

    🔧 5. 企业级管理能力

    支持基于角色的访问控制(RBAC)、LDAP/AD 认证集成、SSO 单点登录。数据库支持 SQLite 和 PostgreSQL,存储可对接 S3、Azure Blob,支持水平扩展。

    🚀 典型使用场景

    场景一:个人本地 AI 助手

    搭配 Ollama 使用,在本地运行 Llama 3、Mistral、Gemma 等开源模型。所有对话数据完全离线,保障隐私安全。无需联网,随时随地使用 AI 助手。

    场景二:企业内网 AI 中台

    通过 Open WebUI 搭建企业内部 AI 平台,对接公司私有 LLM API 或本地部署的开源模型。支持用户权限管理、对话历史保存、知识库共享,让团队成员安全高效地使用 AI。

    场景三:RAG 知识库问答

    上传公司文档、技术手册、FAQ 到 Open WebUI 知识库,即可通过对话快速检索相关内容。支持 PDF、Word、Markdown 等多种格式,结合 RAG 技术实现精准问答。

    💡 推荐理由

    Open WebUI 是我见过最优雅的自托管 AI 界面。如果你在本地用 Ollama 跑模型,或者想给企业搭一个私有的 AI 聊天平台,Open WebUI 几乎是不二之选

    它的体验非常接近 ChatGPT——响应式界面、Markdown 渲染、代码高亮、多会话管理,一应俱全。但更重要的是数据主权:你可以让所有 AI 交互发生在自己的服务器上,不用担心对话记录被第三方留存。

    另外,它的 RAG 知识库联网搜索功能非常实用,让本地模型也能获取实时信息和私有文档内容。如果你关心 AI 隐私和数据安全,Open WebUI 值得一试。