标签: 多模型支持

  • Dify:开源 LLM 应用开发平台,148K Stars 把 AI 工作流从原型秒送生产

    Dify:开源 LLM 应用开发平台,148K Stars 把 AI 工作流从原型秒送生产

    Dify 一览

    在 AI 应用落地的草莽时代,几乎每个团队都在重复造轮子:接模型要写一遍适配、做检索要搭一套向量库、上生产还要自己补日志和监控。把这套东西拼起来,往往比业务本身还费劲。Dify 的出现,就是要把这件事彻底标准化。

    一、项目简介

    Dify 是一个开源的 LLM 应用开发平台,用一张可视化画布把 AI 工作流、RAG 检索增强、Agent 能力、模型管理与可观测性打包在一起,让你从原型到生产只差一次部署。目前 GitHub 已收获 148.4K Stars、23K+ Fork,是开源 LLM 应用开发领域当之无愧的头部项目。

    二、安装要求和过程

    环境要求:

    • CPU ≥ 2 核
    • 内存(RAM)≥ 4 GiB
    • 已安装 DockerDocker Compose
    • 操作系统:Linux / macOS / Windows(WSL2)

    快速安装(Docker Compose,官方最推荐方式):

    git clone https://github.com/langgenius/dify.git
    cd dify/docker
    cp .env.example .env
    docker compose up -d

    启动完成后,浏览器访问 http://localhost/install 即可进入初始化向导。如果你需要高可用部署,官方文档还提供了 Helm Chart、Terraform(Azure / GCP)、AWS CDK 以及阿里云计算巢等多种方案。

    三、核心功能

    1. 可视化工作流画布(Workflow)
    在画布上拖拽编排 AI 流程,节点可调试、可分支、可回放,复杂逻辑一目了然。

    2. 全面的模型支持
    无缝接入数百个闭源 / 开源大模型(GPT、Mistral、Llama3 及所有 OpenAI 兼容模型),覆盖几十家推理服务商与自托管方案,切换模型无需改代码。

    3. 开箱即用的 RAG 管线
    从文档摄入到检索全链路覆盖,原生支持 PDF、PPT 等常见格式的智能提取,几步就能搭出带引用来源的问答助手。

    4. 强大的 Agent 能力
    基于 Function Calling 或 ReAct 定义智能体,内置 50+ 工具(Google 搜索、DALL·E、Stable Diffusion、WolframAlpha 等),也可接入自定义工具。

    5. LLMOps 与 Backend-as-a-Service
    应用日志与性能可监控、可迭代;所有能力均提供对应 API,轻松把 AI 能力嵌入自有业务系统。

    四、典型使用场景

    1. 企业知识库问答 / 智能客服
    导入内部文档构建 RAG,几步搭出带引用来源、可溯源的客服助手,替代翻手册式的重复答疑。

    2. 可视化 Agent 工作流自动化
    把“检索 → 生成 → 调用工具 → 校验”串成一张画布,用可视化的方式替代脆弱的脚本编排。

    3. 快速原型 + API 集成
    先用 Dify 低成本验证想法,再通过 BaaS API 把打磨好的 AI 能力无缝嵌入现有产品。

    五、推荐理由

    个人使用下来,Dify 最打动我的是“把复杂度收敛到一个画布上”。它不要求你先成为向量数据库专家或 Prompt 工程师,普通开发者也能在半小时内跑通一个带 RAG 的可用应用;而当项目要上生产时,LLMOps 的日志、评估与 API 化能力又刚好补上团队最缺的那一环。对于想认真做 AI 产品的团队,它是目前最省心的一站式底座——既能自建私有化守住数据,也能平滑对接云端大模型。

    六、下载地址

    许可证:Dify Open Source License(基于 Apache 2.0,附加部分条款)。本文数据截至 2026-07-11,Stars 约 148.4K。

  • NextChat:轻量快速的跨平台 AI 助手,88K+ Stars 让部署专属 ChatGPT 变得简单

    NextChat:轻量快速的跨平台 AI 助手,88K+ Stars 让部署专属 ChatGPT 变得简单

    💬 NextChat

    轻量快速的跨平台 AI 助手,一键部署专属 ChatGPT 替代品

    ⭐ 88,330+ Stars | Fork 59,509+ | MIT 许可

    一句话介绍:NextChat(原 ChatGPT-Next-Web)是一款轻量、快速的跨平台 AI 助手,支持 Web、iOS、macOS、Android、Linux、Windows 全平台,兼容几乎所有主流大模型 API,是部署私人 AI 聊天服务的首选开源方案。

    📦 安装要求与过程

    环境要求

    • Node.js ≥ 18(本地开发)
    • Docker ≥ 20(容器部署)
    • Vercel / Zeabur / Gitpod 账号(一键部署)
    • Tauri 运行时(桌面客户端)

    方式一:Vercel 一键部署(推荐)

    1. 访问 NextChat GitHub 仓库,点击 README 中的 Vercel 部署按钮
    2. 在 Vercel 中配置环境变量:OPENAI_API_KEY(必填)、CODE(访问密码,选填)
    3. 点击部署,约 1 分钟内完成,获得专属域名

    方式二:Docker 部署

    docker run -d -p 3000:3000 \
      -e OPENAI_API_KEY=sk-xxxx \
      -e CODE=your-password \
      yidadaa/chatgpt-next-web

    如需开启 MCP 功能,添加 -e ENABLE_MCP=true

    方式三:直接下载客户端(无需部署)

    • 网页端直接使用:app.nextchat.club
    • 桌面端下载:GitHub Releases(Windows/macOS/Linux,约 5MB)
    • iOS App:在 App Store 搜索 “NextChat AI” 下载

    🚀 核心功能

    🌐
    全平台支持
    Web、iOS、macOS、Android、Linux、Windows 六端全覆盖,Tauri 桌面端仅约 5MB,PWA 网页端无需安装

    🔌
    多模型兼容
    支持 OpenAI、Azure、Google Gemini、Anthropic Claude、百度、阿里云、DeepSeek、智谱 ChatGLM 等数十家厂商 API

    🔒
    隐私优先
    所有数据默认存储在浏览器本地,桌面端 Tauri 版本支持直接调用 API,避免前端暴露密钥

    🧩
    MCP & 插件扩展
    支持 Model Context Protocol(需开启 ENABLE_MCP),支持插件系统扩展网络搜索、计算器、第三方 API 等能力

    🎨
    Artifacts 内容预览
    支持 Artifacts & Stable Diffusion,可单独窗口预览、复制、分享生成的内容/网页,支持实时对话

    极致性能优化
    首屏仅约 100KB,支持流式响应,自动压缩聊天历史以节省 Token,支持长对话

    💡 典型使用场景

    场景一:个人私有 AI 聊天服务

    通过 Vercel 一键部署,绑定自己的域名,接入 OpenAI / DeepSeek / Claude 等 API,为个人或团队提供专属 AI 聊天界面。相比官方 ChatGPT,无地域限制、支持多模型切换、聊天记录完全私有。

    场景二:企业内网 AI 助手(私有化部署)

    通过 Docker 或企业服务器部署,接入企业内部知识库,配合 MCP 协议连接企业数据源。NextChat 提供企业定制版,支持品牌定制、权限管控、安全审计、私有化部署,满足企业合规需求。

    场景三:多模型对比与 Prompt 调试

    利用 Prompt 模板(Mask)功能,创建、分享和调试自定义聊天工具。在同一界面中切换不同模型对比输出质量,配合 Artifacts 功能实时预览生成的网页或内容,大幅提升 AI 辅助开发效率。

    ✨ 推荐理由

    NextChat 是我用过的最流畅的开源 AI 聊天界面。相比其他同类项目,它的核心优势在于 “轻量”和”快速”——首屏仅约 100KB,Tauri 桌面端不到 5MB,从打开到开始对话只需几秒。

    对于个人用户,Vercel 一键部署真的做到了”1分钟上线”;对于企业用户,MIT 许可 + 私有化部署 + MCP 支持,让它可以无缝融入企业 AI 基础设施。支持 14 种语言(含简体中文),对国内用户非常友好。

    如果你在寻找一个 ChatGPT 的开源替代品,或者需要为团队搭建私有 AI 聊天服务,NextChat 是目前 GitHub 上 Star 最多、最活跃的选择之一,88K+ Stars 和 59K+ Forks 的数据足以证明其实力。

    本文由 AI 自动整理,信息来自 GitHub 仓库,最新版本请以官方为准。

  • LobeChat —— 72K+ Stars 开源 AI 聊天框架,比 ChatGPT 更自由的选择

    LobeChat —— 72K+ Stars 开源 AI 聊天框架,比 ChatGPT 更自由的选择

    🤯 LobeChat

    开源 AI 聊天框架,72K+ Stars,比 ChatGPT 更自由的 AI 客户端

    ⭐ GitHub 72K+ Stars  | 
    🌐 在线体验  | 
    MIT 开源

    📌 项目简介

    LobeChat 是 LobeHub 团队开发的开源 AI 聊天框架,也是 GitHub 上 Star 数最多的开源 AI 客户端之一(72K+ Stars)。它支持 Web 和桌面两种形式,在一个界面里同时接入 GPT、Claude、Gemini、DeepSeek、Ollama 等 80+ 模型,还内置插件市场、RAG 知识库、多模型对比等实用功能。最重要的是——完全免费开源,数据可完全本地化

    72K+
    GitHub Stars

    🤖
    80+
    支持模型

    🔌
    40+
    内置插件

    💻
    3 平台
    Web/桌面/Docker

    1
    安装要求和过程

    环境要求

    部署方式 环境要求
    Web 版 浏览器访问,无需安装
    桌面版 Windows/macOS/Linux,下载安装包
    Docker Docker + Docker Compose
    本地开发 Node.js 18+, pnpm, Git

    快速安装(桌面版)

    # 1. 从 GitHub Releases 下载对应平台安装包

    https://github.com/lobehub/lobe-chat/releases

    # Windows: LobeChat-win.exe

    # macOS: LobeChat-mac.dmg

    # Linux: LobeChat-linux.AppImage

    Docker 部署(自托管推荐)

    # 拉取镜像并启动

    docker run -d -p 3210:3210 \

    -e OPENAI_API_KEY=your-key \

    –name lobechat lobehub/lobe-chat

    2
    核心功能

    🤖 多模型统一接入

    支持 OpenAI、Claude、Gemini、DeepSeek、Kimi、智谱、Ollama 等 80+ 模型,一个界面随意切换。自定义 Base URL,可接入任何兼容 OpenAI 协议的 API。

    🔌 插件市场 + MCP 集成

    内置 40+ 插件,联网搜索、代码执行、图片生成开箱即用。支持 MCP 协议,可一键接入 AI Agent 工具链,扩展能力无上限。

    📚 RAG 知识库

    上传 PDF、Word、网页,自动建立向量索引。基于个人知识库问答,适合企业文档、技术手册、合同条款等场景。本地向量数据库,数据不出门。

    ⚡ 多模型对比 + 语音对话

    同一问题多模型同时回答,横向对比 Claude/GPT/Gemini 差异。内置 TTS/STT,支持语音对话。还有「助手市场」,几百个预设专业助手直接可用。

    🏠 完全自托管 + 隐私优先

    Docker 一键部署,数据全留本地。MIT 开源,可自由修改分发。对比 ChatGPT Plus $20/月,LobeChat 客户端免费,只需按 API 用量付费。

    3
    典型使用场景

    🎯 场景一:多模型对比选型

    在模型选型阶段,同一个 Prompt 同时发给 Claude Opus、GPT-5.4、Gemini 2.5 Pro,直接对比输出质量,不再靠猜。LobeChat 的多模型对比功能让选型决策有数据支撑。

    📚 场景二:企业知识库问答

    将公司技术文档、产品手册、合同模板上传到 LobeChat 知识库,基于 RAG 检索增强生成,精准回答内部问题。支持 Docker 私有化部署,数据完全不出企业内网。

    💻 场景三:开发者日常助手

    配置 DeepSeek V3(中文代码能力强,价格低)+ Claude Sonnet(复杂逻辑)+ GPT-5.4(多模态),不同任务自动切换最合适模型。助手市场里的「代码审查」「SQL 优化」等预设助手,开箱即用。

    💡 推荐理由

    我用过不少 AI 客户端,LobeChat 是最顺手的选择之一,原因如下:

    • 真的免费:客户端 MIT 开源,桌面版零成本,只需付 API 费用(比 ChatGPT Plus 灵活太多)
    • 真的开放:不绑定任何厂商,自定义 Base URL 接入任何兼容 API,甚至支持本地 Ollama
    • 真的好用:界面现代美观,多模型对比、知识库、插件市场一应俱全,功能深度足够
    • 真的私密:Docker 一键自托管,数据 100% 本地,适合对隐私有要求的企业和个人

    如果你同时用多个 AI 模型,或者不想把数据交给 OpenAI,LobeChat 是目前最好的开源替代方案

    📥 下载地址

    许可协议:MIT License  |  语言:TypeScript  |  支持平台:Web / Windows / macOS / Linux / Docker

    ⚠️ 本文基于公开资料整理,项目数据截至 2026 年 6 月。LobeChat 与 LobeHub 为同一团队产品,功能持续迭代中。

  • Open-WebUI:自托管AI平台,打造专属的ChatGPT体验

    在本地运行大语言模型(LLM)已经成为越来越多开发者和AI爱好者的选择。但Ollama等工具缺乏友好的Web界面,而Open-WebUI完美解决了这个问题——它提供了一个功能丰富、可自托管的AI交互平台,让你在本地也能享受媲美ChatGPT的使用体验。

    项目简介

    Open-WebUI 是一个可扩展、功能丰富、用户友好的自托管AI平台,支持完全离线运行。它兼容Ollama、OpenAI兼容API等多种LLM运行器,并内置RAG(检索增强生成)推理引擎。目前GitHub Stars已超过105,000+,是本地AI部署的首选界面方案。

    安装要求和过程

    环境要求

    • Python方式:需要 Python 3.11(避免使用其他版本以免兼容性问题)
    • Docker方式:需要安装Docker,建议使用GPU环境以获得更好性能
    • Ollama:如需本地运行模型,需提前安装Ollama
    • 存储空间:至少预留5GB空间用于模型和数据集

    快速安装步骤

    方式一:Python pip安装(最简单)

    # 安装项目
    pip install open-webui
    
    # 启动服务,访问地址:http://localhost:8080
    open-webui serve
    

    方式二:Docker快速部署(推荐)

    # 基础部署(Ollama在本地)
    docker run -d -p 3000:8080   --add-host=host.docker.internal:host-gateway   -v open-webui:/app/backend/data   --name open-webui --restart always   ghcr.io/open-webui/open-webui:main
    
    # 访问地址:http://localhost:3000
    

    方式三:一体化部署(包含Ollama)

    # 带GPU支持
    docker run -d -p 3000:8080 --gpus=all   -v ollama:/root/.ollama   -v open-webui:/app/backend/data   --name open-webui --restart always   ghcr.io/open-webui/open-webui:ollama
    
    # 仅CPU
    docker run -d -p 3000:8080   -v ollama:/root/.ollama   -v open-webui:/app/backend/data   --name open-webui --restart always   ghcr.io/open-webui/open-webui:ollama
    

    核心功能

    • 多模型兼容:无缝集成Ollama、OpenAI API,支持对接LMStudio、GroqCloud、Mistral、OpenRouter等第三方服务,一个界面管理所有AI模型。
    • 本地RAG能力:内置检索增强生成引擎,支持9种向量数据库(ChromaDB、PGVector、Qdrant、Milvus等),可直接上传文档进行智能问答。
    • 多模态交互:支持语音/视频通话,集成多种语音转文本和文本转语音引擎;支持DALL-E、Gemini、ComfyUI等多种图像生成引擎。
    • 权限管理:细粒度用户角色与权限控制,支持LDAP/AD集成、SSO单点登录,适合团队和企业部署。
    • 插件扩展:支持Pipelines插件框架,可自定义业务逻辑(函数调用、用户限流、实时翻译、内容过滤等)。

    典型使用场景

    场景一:个人本地AI助手

    通过Docker一键部署Open-WebUI + Ollama,在本地运行Llama 3、Mistral等开源模型。所有数据完全离线,保障隐私安全;同时获得与ChatGPT媲美的Web交互体验,支持多轮对话、Markdown渲染、代码高亮等功能。

    场景二:团队协作AI平台

    利用Open-WebUI的权限管理和SSO集成能力,为企业团队搭建内部AI平台。通过RBAC控制不同用户的模型访问权限,对接企业内部知识库实现RAG问答,并监控API使用量和成本。

    场景三:AI应用开发测试

    开发者可使用Open-WebUI快速测试不同LLM模型的效果,通过模型构建器自定义提示词和角色,利用Python函数调用扩展自定义能力,加速AI应用的原型开发和测试验证。

    推荐理由

    Open-WebUI是我试用过的最优秀的本地LLM Web界面,没有之一。它的设计非常贴合实际使用场景:响应式界面适配各种设备,PWA支持让你可以像原生App一样使用,RAG功能让你可以轻松对接个人知识库。

    相比其他类似工具,Open-WebUI的最大优势在于完整性和成熟度:它不仅有精美的界面,还有完整的企业级功能(权限管理、SSO、监控等),同时支持广泛的模型和后端的灵活配置。无论你是个人用户还是企业团队,都能找到适合自己的部署方式。

    特别推荐它的RAG集成能力——上传文档后可以直接在对话中引用,支持多种向量数据库和搜索引擎,真正实现”个人AI知识库”的落地。如果你一直在寻找一个好用的本地LLM界面,Open-WebUI绝对值得一试。

    下载地址

    如果你觉得这个项目有帮助,欢迎到GitHub上点个Star支持开发者!

  • 【开源推荐】aisuite:14.5K+ Stars!Andrew Ng 出品,一行代码切换 14+ 个 AI 大模型

    【开源推荐】aisuite:14.5K+ Stars!Andrew Ng 出品,一行代码切换 14+ 个 AI 大模型

    🚀 aisuite
    Simple, unified interface to multiple Generative AI providers
    ⭐ 14,500+ Stars  |  🍴 1,500+ Forks  |  🐍 Python  |  📜 MIT License

    📌 项目简介

    aisuiteAndrew Ng(吴恩达)团队开源的轻量级 Python 库,通过一套统一 API 接口同时调用 OpenAI、Anthropic、Google、Mistral、AWS、Ollama 等 14+ 个 AI 大模型提供商。只需修改一个字符串即可切换模型,彻底告别各家 SDK 差异带来的适配噩梦。

    该项目采用两层架构:底层是统一 Chat Completions API(兼容 OpenAI 格式),上层是带工具调用的 Agents API。同仓库还包含基于 aisuite 构建的桌面 AI 助手 OpenCoworker

    ⚙️ 安装要求和过程

    环境要求

    • Python 3.9+
    • 各 AI 提供商的 API Key(或本地 Ollama)
    • 磁盘空间:约 50MB(基础包)

    快速安装(3步)

    # 基础安装(不含提供商 SDK)
    pip install aisuite
    
    # 安装时附带指定提供商的 SDK
    pip install 'aisuite[anthropic]'
    pip install 'aisuite[openai]'
    pip install 'aisuite[google]'
    
    # 安装所有提供商 SDK(完整版)
    pip install 'aisuite[all]'

    API Key 配置

    # 设置环境变量(Linux/macOS)
    export OPENAI_API_KEY="sk-your-key"
    export ANTHROPIC_API_KEY="sk-ant-your-key"
    
    # Windows PowerShell
    $env:OPENAI_API_KEY = "sk-your-key"
    $env:ANTHROPIC_API_KEY = "sk-ant-your-key"

    ✨ 核心功能

    ① 统一 Chat Completions API —— 一行切换模型
    模型名格式 <provider>:<model-name>,修改一个字符串即可在不同提供商之间切换,所有核心参数(temperature、max_tokens、tools 等)均为提供商无关。

    ② Agents API —— 让模型使用真实工具
    传入普通 Python 函数即可获得工具调用能力,aisuite 自动生成 JSON Schema、执行函数调用、将结果反馈给模型。max_turns 参数控制多轮对话,也可手动控制每一轮。

    ③ Toolkits —— 开箱即用的工具集
    内置 files(文件操作)、git(版本控制)、shell(命令行)等工具集,也可接入任意 MCP 服务器,让 Agent 获得文件系统、浏览器自动化等真实能力。

    ④ 生产级 Agent 管控
    支持 Tool Policies(工具调用审批策略)、State Stores(跨进程持久化对话状态,支持内存/文件/Postgres)、Artifacts & Tracing(完整记录 Agent 产出和每一步执行轨迹)。

    ⑤ OpenCoworker —— 开箱即用的桌面 AI 助手
    同仓库附赠 OpenCoworker 桌面应用(macOS/Windows),能聊天、做深度研究、读写文件、收发消息(Slack/Email)、生成 PDF 报告,并支持定时自动化任务(如每日新闻摘要)。数据完全留在本地。

    🎯 典型使用场景

    场景一:多模型对比评测
    研究人员可以用同一段代码,分别调用 GPT-4o、Claude 3.5 Sonnet 和 Gemini Pro,对比不同模型在同一 Prompt 下的响应质量,而无需维护三套 SDK 调用代码。aisuite 让 A/B 测试大模型 变得极其简单。

    场景二:构建支持多提供商的 AI 产品
    SaaS 产品需要同时支持 OpenAI 和 Anthropic,或允许用户选择自己偏好的模型。使用 aisuite,产品代码只需维护一套接口,后端根据配置动态路由到不同提供商,大幅降低维护成本。

    场景三:本地 + 云端混合部署
    开发阶段使用免费本地模型 Ollama,上线后切换到 OpenAI API。aisuite 让这种切换只需改一个字符串("ollama:llama3""openai:gpt-4o"),无需改动任何业务逻辑代码。

    💡 推荐理由

    Andrew Ng 亲自站台的项目,质量有保障。我推荐它的核心原因是它解决了一个真实存在的痛点:每家 AI 公司的 API 都不一样。OpenAI 用一套格式,Anthropic 用另一套,Google 又是另一套……如果你要同时支持多家,代码里全是 if provider == "openai" 这种恶心的判断逻辑。

    aisuite 把这一切统一了。它的 API 设计完全兼容 OpenAI 的 Chat Completions 格式,其他提供商只是”适配层”,对使用者完全透明。这种设计意味着你现有的 OpenAI 代码几乎不用改,就能无缝迁移到 Claude 或 Gemini。

    更让人惊喜的是它的 Agents API 设计——传入普通 Python 函数就能让模型调用工具,不需要手写 JSON Schema。加上对 MCP(Model Context Protocol)的原生支持,未来接入各种工具生态会很方便。

    如果你正在做 AI 应用开发,或者需要对比评测多个大模型,aisuite 是目前最优雅的解决方案,没有之一。

    📥 下载地址

    🌐 官方网站:
    github.com/andrewyng/aisuite
    💻 快速安装:
    pip install aisuite
    💬 Discord 社区:
    discord.gg/T6Nvn8ExSb

    🔌 支持的 AI 提供商

    提供商 模型示例 调用格式
    OpenAI gpt-4o, gpt-4-turbo openai:gpt-4o
    Anthropic claude-3-5-sonnet anthropic:claude-3-5-sonnet-20240620
    Google gemini-pro, gemini-1.5-pro google:gemini-pro
    Mistral mistral-large, mixtral-8x7b mistral:mistral-large
    Ollama(本地) llama3, mistral, codellama ollama:llama3
    AWS Bedrock anthropic.claude-3-5-sonnet bedrock:anthropic.claude-3-5-sonnet
    Hugging Face 任意 HF 模型 huggingface:model-name

    📅 文章发布时间:2026 年 6 月 15 日
    📜 开源协议:MIT License(可自由用于商业和非商业项目)

  • 【开源推荐】Open WebUI:142K+ Stars!自托管 AI 聊天界面,隐私优先的本地大模型前端

    【开源推荐】Open WebUI:142K+ Stars!自托管 AI 聊天界面,隐私优先的本地大模型前端

    Open WebUI

    Open WebUI – 自托管 AI 聊天界面

    📦 项目简介

    Open WebUI 是一个用户友好的自托管 AI 界面,支持 Ollama、OpenAI API 等多种 LLM 服务,可完全离线运行。它提供了类似 ChatGPT 的优雅聊天体验,同时保障数据隐私,是企业和个人部署本地 AI 能力的首选前端方案。

    ⭐ 142K+ Stars
    🍴 20.3K+ Forks
    🐍 Python + Svelte
    📦 Docker 一键部署

    ⚙️ 安装要求和过程

    环境要求

    • Python 3.11(pip 安装方式必须使用此版本)
    • Docker(推荐,最简单)
    • Ollama(如需本地模型,可选)
    • 磁盘空间:至少 2GB(含依赖和模型)

    方式一:Docker 安装(推荐)

    # 基础安装(Ollama 在本地)

    docker run -d -p 3000:8080 \
      –add-host=host.docker.internal:host-gateway \
      -v open-webui:/app/backend/data \
      –name open-webui –restart always \
      ghcr.io/open-webui/open-webui:main

    # 内置 Ollama(CPU)

    docker run -d -p 3000:8080 \
      -v ollama:/root/.ollama \
      -v open-webui:/app/backend/data \
      –name open-webui –restart always \
      ghcr.io/open-webui/open-webui:ollama

    方式二:Python pip 安装

    pip install open-webui
    open-webui serve

    ⚠️ 注意:必须使用 Python 3.11,避免兼容性问题!

    安装完成后访问 http://localhost:8080 即可使用。

    ✨ 核心功能

    🤖 1. 多模型兼容

    原生支持 Ollama、OpenAI 兼容 API,可对接 LMStudio、GroqCloud、Mistral、OpenRouter 等第三方服务。支持同时调用多个模型,获取最优输出结果。

    📚 2. RAG 检索增强生成

    支持 9 种向量数据库(ChromaDB、PGVector、Qdrant 等),多种内容提取引擎。可上传文档到知识库,通过 # 命令快速调用文档内容,打造私人知识助手。

    🔍 3. 联网搜索能力

    支持 15+ 搜索引擎(SearXNG、Google PSE、Brave Search 等)的 RAG 联网搜索,可直接输入 URL 引用网页内容到对话中,让 AI 获取实时信息。

    🎨 4. 多模态交互

    支持语音/视频通话,集成多种语音转文字、文字转语音引擎。支持图像生成与编辑,可对接 DALL-E、Gemini、ComfyUI、AUTOMATIC1111 等引擎。

    🔧 5. 企业级管理能力

    支持基于角色的访问控制(RBAC)、LDAP/AD 认证集成、SSO 单点登录。数据库支持 SQLite 和 PostgreSQL,存储可对接 S3、Azure Blob,支持水平扩展。

    🚀 典型使用场景

    场景一:个人本地 AI 助手

    搭配 Ollama 使用,在本地运行 Llama 3、Mistral、Gemma 等开源模型。所有对话数据完全离线,保障隐私安全。无需联网,随时随地使用 AI 助手。

    场景二:企业内网 AI 中台

    通过 Open WebUI 搭建企业内部 AI 平台,对接公司私有 LLM API 或本地部署的开源模型。支持用户权限管理、对话历史保存、知识库共享,让团队成员安全高效地使用 AI。

    场景三:RAG 知识库问答

    上传公司文档、技术手册、FAQ 到 Open WebUI 知识库,即可通过对话快速检索相关内容。支持 PDF、Word、Markdown 等多种格式,结合 RAG 技术实现精准问答。

    💡 推荐理由

    Open WebUI 是我见过最优雅的自托管 AI 界面。如果你在本地用 Ollama 跑模型,或者想给企业搭一个私有的 AI 聊天平台,Open WebUI 几乎是不二之选

    它的体验非常接近 ChatGPT——响应式界面、Markdown 渲染、代码高亮、多会话管理,一应俱全。但更重要的是数据主权:你可以让所有 AI 交互发生在自己的服务器上,不用担心对话记录被第三方留存。

    另外,它的 RAG 知识库联网搜索功能非常实用,让本地模型也能获取实时信息和私有文档内容。如果你关心 AI 隐私和数据安全,Open WebUI 值得一试。

  • 【开源推荐】Open Notebook:29.9K+ Stars!Notebook LM 开源替代品,隐私优先+18家AI模型随意切换

    【开源推荐】Open Notebook:29.9K+ Stars!Notebook LM 开源替代品,隐私优先+18家AI模型随意切换

    📌 项目简介

    Open Notebook 是 Google Notebook LM 的开源替代品,隐私优先、支持自托管,兼容 18+ AI 服务商(OpenAI、Anthropic、Ollama 等),让你完全掌控研究数据,不再受大厂绑定。

    29.9K+
    GitHub Stars

    18+
    AI 服务商

    100%
    数据自主

    MIT
    开源协议

    ⚙️ 安装要求和过程

    环境要求

    • 仅需安装 Docker Desktop(所有平台通用)
    • 支持 Windows / macOS / Linux
    • 需要约 2GB 磁盘空间

    快速安装(3 步搞定)

    # 第1步:下载 docker-compose.yml
    curl -o docker-compose.yml https://raw.githubusercontent.com/lfnovo/open-notebook/main/docker-compose.yml

    # 第2步:修改加密密钥(可选但推荐)
    # 编辑 docker-compose.yml,修改 OPEN_NOTEBOOK_ENCRYPTION_KEY

    # 第3步:启动服务
    docker compose up -d

    # 等待 15-20 秒后访问
    浏览器打开 http://localhost:8502

    安装完成后在浏览器打开 http://localhost:8502 即可使用,AI 密钥可在 Web UI 中配置,无需提前写入配置文件。

    ✨ 核心功能

    🔒
    隐私优先,数据自主

    自托管部署,所有研究数据存储在本地,完全不受 Google 服务器约束。支持 Docker / 云端 / 本地多种部署方式。

    🤖
    18+ AI 服务商兼容

    原生支持 OpenAI、Anthropic、Google、Groq、Ollama、DeepSeek、Mistral、xAI 等 18+ 家,也支持任意 OpenAI 兼容接口(LM Studio 等)。

    🎙️
    专业多角色播客生成

    支持 1-4 个可自定义角色的播客生成,比 Notebook LM 的 2 角色更灵活,可打造个性化内容输出。

    🔍
    全文 + 向量语义双搜索

    所有上传内容同时支持关键词全文检索和向量语义搜索,快速定位研究资料中的关键信息。

    完整 REST API

    提供完整的 REST API 接口,支持全流程程序化调用,可集成到现有工作流或自动化系统中。

    💡 典型使用场景

    场景一:学术研究资料管理

    上传论文 PDF、会议视频、网页资料,让 AI 基于你的资料库进行问答和总结。数据完全本地存储,敏感研究内容不外泄。

    场景二:多模型对比研究

    同时配置 OpenAI、Anthropic、DeepSeek 等多个模型,在同一套资料上对比不同模型的分析能力,选出最适合的模型。

    场景三:团队知识库 + 播客输出

    将团队文档、会议记录导入 Open Notebook,用 AI 生成洞察;还可将研究成果一键转换为多角色播客,方便团队内部分享。

    ⚡ Open Notebook vs Notebook LM

    对比维度 Open Notebook Notebook LM
    数据隐私 ✅ 自托管,完全自主 ❌ 仅 Google 云端
    AI 模型选择 ✅ 18+ 家,含本地模型 ❌ 仅 Google 模型
    播客角色数 ✅ 1-4 个可自定义 ⚠️ 仅 2 个
    API 访问 ✅ 完整 REST API ❌ 无
    成本 ✅ 只需支付 AI 调用费 ⚠️ 免费层 + 月费订阅
    开源定制 ✅ MIT 协议,完全可改 ❌ 封闭系统

    💬 推荐理由

    Google Notebook LM 确实好用,但它有两个痛点:数据在 Google 服务器上,以及只能用 Google 的模型。如果你研究的内容比较敏感,或者想用 DeepSeek / 本地 Ollama 来节省成本,Notebook LM 就没法满足你了。

    Open Notebook 最大的价值就是把控制权还给你:数据存在自己服务器上,想用哪个 AI 就用哪个,甚至可以在完全没有外网的环境里跑本地模型。而且它还有完整 REST API,可以接入自己的自动化流程。

    部署也超级简单,会 Docker 就能跑,三行命令搞定。如果你一直在找 Notebook LM 的平替,这个项目值得一试。开源、免费、不绑架数据,还要什么自行车?

    🤖 已支持 AI 服务商(部分)

    OpenAI
    Anthropic
    Google GenAI
    Groq
    Ollama
    DeepSeek
    Mistral
    xAI (Grok)
    OpenRouter
    Azure OpenAI
    Vertex AI
    MiniMax
    DashScope (Qwen)
    LM Studio

  • 【开源推荐】Cherry Studio:47K+ Stars!多模型AI桌面客户端,一个应用搞定所有大模型

    【开源推荐】Cherry Studio:47K+ Stars!多模型AI桌面客户端,一个应用搞定所有大模型

    🍒 项目名称:Cherry Studio

    GitHub Stars:47.1K+

    🏷️ 开源协议:AGPL-3.0

    💻 支持平台:Windows / macOS / Linux

    🔗 GitHubgithub.com/CherryHQ/cherry-studio

    🌐 官网cherry-ai.com

    📝 项目简介

    Cherry Studio 是一款支持多种大语言模型提供商的开源AI桌面客户端,覆盖 Windows、Mac、Linux 三大平台。它提供智能聊天、自主智能体、300+ 预配置助手能力,可统一访问前沿大语言模型,是2026年最值得关注的 AI 生产力工具之一。

    无论你是用 OpenAI Gemini Claude 等云端模型,还是用 Ollama 跑本地模型,Cherry Studio 都能一站式搞定,告别在多个网页和客户端之间来回切换的烦恼。

    Cherry Studio 界面预览

    ⚙️ 安装要求和过程

    环境要求

    • 操作系统:Windows 10+、macOS 11+、主流 Linux 发行版
    • 无需额外环境配置:开箱即用,下载安装包直接运行
    • 网络要求:使用云端模型需配置 API Key;使用本地模型需提前安装 Ollama 或 LM Studio

    快速安装步骤

    1. 访问 GitHub Releases 页面,下载对应系统的安装包
    2. Windows:下载 .exe 安装包,双击运行
    3. macOS:下载 .dmg 文件,拖入 Applications 文件夹
    4. Linux:下载 .AppImage.deb / .rpm 包安装
    5. 启动后,在设置中配置模型 API Key 或连接本地 Ollama

    🌟 核心功能

    🤖 多 LLM 提供商支持

    支持 OpenAI、Gemini、Anthropic、Claude 等主流云端大模型,同时支持 Ollama、LM Studio 等本地模型,一个客户端搞定所有模型。

    🧠 300+ 预配置 AI 助手

    内置丰富领域的专业 AI 助手模板,涵盖编程、写作、翻译、分析等场景,开箱即用,也支持自定义助手创建。

    📄 多格式文档处理

    支持文本、图片、Office 文档、PDF 等多格式文件处理,内置 RAG 知识库能力,让 AI 基于你的文档作答。

    🔌 MCP 协议支持

    支持模型上下文协议(MCP)服务器,可扩展 AI 能力边界,接入专业工具和数据源。

    🎨 可视化与开发工具

    支持 Mermaid 图表可视化、代码语法高亮、全局搜索、话题管理系统,满足专业用户的需求。

    Cherry Studio 功能展示

    🚀 典型使用场景

    场景一:多模型对比测试

    研究者或开发者需要同时对比 GPT-4.1、Claude 4 Opus、Gemini 2.5 Pro 在同一任务上的表现?Cherry Studio 支持多模型同时对话,同一条消息发送给多个模型,结果并排展示,轻松找出最强模型。

    场景二:本地 + 云端混合使用

    日常聊天用免费的本地模型(Ollama + Qwen3),重要任务切换云端前沿模型。Cherry Studio 统一入口管理,无需在多个工具间切换,数据隐私和模型能力兼得。

    场景三:企业知识库问答

    上传公司文档、技术手册到 Cherry Studio 知识库,结合 RAG 技术,让 AI 基于企业内部知识精准作答,打造专属的企业 AI 助手。

    💡 推荐理由

    作为一款开源免费的 AI 桌面客户端,Cherry Studio 最大的价值在于统一——统一了模型入口、统一了对话历史、统一了工具生态。

    在此之前,用 OpenAI 要去网页,用 Claude 要开另一个网页,本地 Ollama 又是命令行,多模型对比更是麻烦。Cherry Studio 把这些全部整合到一个窗口里,还加上了知识库、MCP 工具扩展、300+ 助手模板,真正做到了”一个客户端,所有 AI 能力”。

    尤其值得一提的是它的开箱即用体验——无需配置 Python 环境,无需折腾依赖,下载安装包,点几下鼠标配置 Key,马上就能用。对非技术用户非常友好。

    如果你同时满足以下任意一点,强烈推荐试试 Cherry Studio:

    • 同时使用多个 AI 模型(GPT/Claude/Gemini/本地模型)
    • 希望 AI 能读取并处理你的本地文档
    • 想要一个统一、美观、功能完整的 AI 客户端
    • 重视数据隐私,希望本地运行 AI

    📥 下载地址

    🍒 GitHub 仓库
    🌐 官方网站
    📦 下载安装包


    📌 本文由 WorkBuddy AI 自动化任务 定时发布,选题自 GitHub 热门 AI 开源项目。欢迎关注本站「开源项目」栏目,每周精选优质 AI 开源工具深度介绍。

  • 【开源推荐】Lobe Chat:46K+ Stars!高颜值可扩展的开源AI聊天框架

    Lobe Chat 界面预览

    📝 项目简介

    Lobe Chat 是一款高颜值、可扩展的开源AI聊天框架,支持接入OpenAI、Claude、Gemini等数十种主流大语言模型,提供丰富的插件生态与个性化配置能力,可快速搭建私有化AI聊天应用。

    ⚙️ 安装要求和过程

    环境要求

    • Node.js 18.0及以上版本
    • pnpm包管理器(推荐8.x及以上版本)

    快速安装步骤

    1. 克隆项目仓库:git clone https://github.com/lobehub/lobe-chat.git
    2. 进入项目目录并安装依赖:cd lobe-chat && pnpm install
    3. 启动开发环境:pnpm dev,访问 http://localhost:3010 即可体验
    4. 生产环境部署:执行 pnpm build && pnpm start,可配合Nginx等反向代理工具实现外网访问

    ✨ 核心功能

    • 多模型支持:原生支持OpenAI、Anthropic Claude、Google Gemini、Meta Llama、本地Ollama等数十种主流大语言模型,无需额外适配即可切换使用
    • 插件扩展系统:支持自定义插件开发,官方提供天气查询、网页搜索、代码执行、文档解析等数十种开箱即用的插件,可快速扩展AI能力边界
    • 知识库集成:支持上传PDF、Word、Markdown等格式的文档,构建私有知识库,实现基于自有数据的精准问答,避免通用模型的幻觉问题
    • 多模态交互:支持图片、文件上传,可实现图文混合问答,部分模型支持语音输入与输出,交互体验更自然
    • 高度可定制:支持自定义主题样式、模型参数、提示词模板、快捷键等,满足不同用户的个性化使用需求

    🚀 典型使用场景

    1. 个人私有AI助手搭建:将Lobe Chat部署在本地或私有服务器,对接个人常用的AI模型,所有对话数据均存储在本地,避免敏感数据上传第三方平台,保障数据隐私
    2. 企业内部知识库问答系统:上传企业内部的产品手册、规章制度、技术文档等资料,搭建企业专属的智能问答系统,员工可快速查询相关信息,大幅提升信息查询效率
    3. AI应用原型快速验证:借助Lobe Chat丰富的插件和模型支持,开发者可快速搭建AI应用原型,验证产品想法,降低AI应用的开发门槛与成本

    💡 推荐理由

    作为开源AI聊天框架的标杆项目,Lobe Chat的界面设计简洁美观,交互体验流畅,插件生态非常丰富,即使是不熟悉前端开发的用户,也能通过简单的配置快速搭建出功能完善的AI聊天应用。同时项目社区活跃,更新迭代速度快,问题响应及时,非常适合个人开发者和中小企业使用。

    我在本地部署后,对接了Ollama运行的Qwen3本地模型,完全离线也能正常使用,数据隐私性非常有保障。另外项目的主题定制功能也很实用,我可以根据自己的喜好调整界面风格,使用体验非常好,强烈推荐给大家。

    📥 下载地址