标签: 隐私保护

  • Voicebox:47.5K Stars 的开源 AI 语音工作室,克隆声音、全局听写、让 AI 智能体开口说话

    Voicebox:47.5K Stars 的开源 AI 语音工作室,克隆声音、全局听写、让 AI 智能体开口说话

    Voicebox 应用界面截图

    项目简介

    Voicebox 是一款本地优先的开源 AI 语音工作室——相当于把 ElevenLabs(语音合成)+ WisprFlow(语音听写) 两大云服务装进同一个免费开源的桌面应用:几秒参考音频即可克隆任意声音、7 大 TTS 引擎覆盖 23 种语言、全局热键把语音听写进系统任意输入框,还能通过 MCP 让 Claude Code / Cursor 等 AI 智能体用你克隆的声音「开口说话」。全部模型与数据均在本机运行,目前已收获 47.5K Stars,MIT 许可。

    安装要求和过程

    环境要求

    • macOS:Apple Silicon(MLX/Metal 加速)或 Intel
    • Windows:支持 NVIDIA CUDA 加速
    • Linux:暂无预编译包,需源码构建;另支持 AMD ROCm、Intel Arc
    • Docker:任意平台一行命令部署
    • 轻量引擎 LuxTTS 仅需 ~1GB 显存,CPU 也能 150 倍实时速度推理

    快速安装

    # 方式一:直接下载安装包(推荐)
    # macOS (Apple Silicon): https://voicebox.sh/download/mac-arm
    # macOS (Intel):         https://voicebox.sh/download/mac-intel
    # Windows (MSI):         https://voicebox.sh/download/windows
    
    # 方式二:Docker 一键启动
    git clone https://github.com/jamiepine/voicebox.git
    cd voicebox
    docker compose up
    

    首次启动时应用会引导下载所需模型;macOS 上还有权限向导,一步步带你完成「辅助功能」「输入监控」授权,用于全局听写自动粘贴。

    核心功能

    • 多引擎语音克隆:内置 Qwen3-TTS、Qwen CustomVoice、LuxTTS、Chatterbox Multilingual/Turbo、HumeAI TADA、Kokoro 共 7 大 TTS 引擎,零样本克隆 + 50 多个精选预置声音,覆盖 23 种语言,可逐次生成切换引擎。
    • 全局语音听写:按住热键在系统任意位置说话,松开即把转写文本粘贴进当前输入框(macOS 经辅助功能校验注入,且自动保存/恢复剪贴板);内置 Whisper 全系列模型(Turbo 版比 Large 快约 8 倍),可选本地 LLM 自动清理「嗯、啊」等口头语。
    • 给 AI 智能体一个声音:自带 MCP 服务器与 REST API,Claude Code、Cursor、Cline 等任意支持 MCP 的智能体只需调用 voicebox.speak 工具,就能用你克隆的声音向你「汇报工作」。
    • 专业级生产能力:不限长度生成(自动分句 + 交叉淡化拼接,最长 5 万字符)、多轨 Stories 时间线编辑器(做播客/对话/有声书)、8 种后期效果(变调/混响/延迟/压缩等,基于 Spotify pedalboard),生成版本全程可溯源。
    • 完全本地、隐私优先:模型、声音数据、录音捕获全部留在本机,永不上传;应用基于 Tauri(Rust)构建而非 Electron,原生性能,安装包小、内存占用低。

    典型使用场景

    1. 内容创作者做配音/播客:用自己的几秒录音克隆声音,把文章、剧本、章节直接批量转成音频;Stories 编辑器多轨拖拽即可编排双人对话播客,再叠加混响、电台音效等预设,全流程零云端费用。
    2. 开发者的「会说话的」编码智能体:给 Claude Code / Cursor 接上 Voicebox 的 MCP 服务器,长任务跑完后智能体用你指定的声音口头播报结果;配合全局听写热键,动口不动手地写 prompt,形成完整的语音 I/O 闭环。
    3. 注重隐私的日常语音输入:会议纪要、日记、即时消息全部用本地 Whisper 听写,敏感内容不经过任何第三方服务器;Captures 标签页保留每段原始音频 + 转写文本,可随时重转写、改写或升级为克隆样本。

    推荐理由

    试用下来最打动我的是「输入 + 输出一体」的产品思路:市面上克隆声音要买 ElevenLabs,语音听写要买 WisprFlow,而 Voicebox 把两半闭环装进一个 MIT 开源应用,还用本地 LLM 把两端串了起来。工程质量也远超一般开源项目——Tauri 原生应用不卡顿,生成队列异步不阻塞,甚至连 macOS 剪贴板保护、崩溃恢复这类细节都做了。对开发者来说,一行 MCP 配置就能让编码智能体开口说话,这个体验相当新奇实用。如果你需要一套不上云、不订阅的完整语音方案,这个项目值得马上装上试试。

    下载地址

  • ZeroClaw:32.4K Stars 的 Rust 全自主个人 AI 助理基础设施,6.6MB 单二进制、30+ 渠道、数据完全自持

    ZeroClaw:32.4K Stars 的 Rust 全自主个人 AI 助理基础设施,6.6MB 单二进制、30+ 渠道、数据完全自持

    ZeroClaw Banner

    项目简介

    ZeroClaw 是一个用 Rust 编写的全自主个人 AI 助理基础设施(Agent Runtime)——一个体积小、速度快的单二进制程序,让你在自己的机器上跑一个 7×24 小时在线的私人 AI 助理:它对接 Anthropic、OpenAI、Ollama 等 20 余家模型提供商,通过 Discord、Telegram、Matrix、邮件、语音、Webhook 等 30+ 渠道与你对话,并能调用 Shell、浏览器、HTTP、硬件外设与自定义 MCP 服务器执行真实操作。项目口号非常直白:“You own the agent. You own the data. You own the machine it runs on.”(智能体是你的,数据是你的,机器也是你的。)

    项目诞生于 2026 年 2 月,由 Harvard、MIT 与 Sundai Club 社区孵化,短短 5 个多月即斩获 32,400+ Stars、4,800+ Fork,是当下最火的 Rust AI 项目之一。采用 MIT OR Apache-2.0 双许可,可自由选择。

    安装要求和过程

    环境要求

    • 操作系统:Linux / macOS / Windows / FreeBSD / NixOS / Docker 全平台支持,也可跑在树莓派等单板机上
    • 运行环境:预编译二进制开箱即用;从源码构建需 Rust(edition 2024)工具链
    • 体积:minimal 内核预设仅约 6.6 MB,资源占用极低
    • 模型接入:任一 LLM 提供商的 API Key,或本地 Ollama(可完全离线)

    快速安装

    # 一键安装(自动选择预编译二进制,失败则回退源码构建)
    curl -fsSL https://raw.githubusercontent.com/zeroclaw-labs/zeroclaw/master/install.sh | bash
    
    # 或克隆后安装(可交互选择组件和特性)
    git clone https://github.com/zeroclaw-labs/zeroclaw.git
    cd zeroclaw
    ./install.sh
    
    # 极简内核(约6.6MB)
    ./install.sh --preset minimal
    

    快速上手

    zeroclaw quickstart           # 一站式配置:选择模型提供商,生成可用配置
    zeroclaw agent -a <alias>     # 交互式对话
    zeroclaw service install      # 注册为 systemd/launchctl/Windows 服务
    zeroclaw service start        # 后台常驻运行
    

    所有配置集中在一个 TOML 文件(~/.zeroclaw/config.toml),支持 Codex 订阅、Claude Max setup-token 等多种认证方式导入。

    核心功能

    • 多渠道统一接入:Discord、Telegram、Matrix、邮件、语音、Webhook、CLI 等 30+ 渠道适配器,全部消息汇入同一个智能体循环,一个助理全端响应
    • 模型提供商无关:可插拔接入 Anthropic、OpenAI、本地 Ollama 及任意 OpenAI 兼容端点约 20+ 家,支持故障回退链与智能路由,单家挂掉不影响服务
    • 安全优先架构:默认 supervised 监督模式——中风险操作需审批、高风险直接拦截;工作区边界、命令策略、OS 级沙箱(Landlock/Bubblewrap/Seatbelt/Docker)加密码学工具回执(Tool Receipts)记录每一次操作;开发机可切 YOLO 模式放飞
    • 硬件控制能力:通过 Peripheral trait 支持树莓派、STM32、Arduino、ESP32 的 GPIO/I2C/SPI/USB,AI 助理可以直接操控物理硬件
    • SOP 引擎 + 网关面板:事件触发的标准作业程序(MQTT/Webhook/Cron/外设触发,带审批门与断点续跑);HTTP/WebSocket 网关配 Web 仪表盘,可视化管理对话、记忆、配置与定时任务;另有 ACP 协议支持 IDE 集成

    ZeroClaw 硬件架构
    ZeroClaw 硬件接入架构:从单板机 GPIO 到智能体循环

    典型使用场景

    1. 私有化全天候个人助理:在家庭服务器或 VPS 上以 systemd 服务常驻运行,用 Telegram/Discord 随时召唤——查资料、跑脚本、管日程、收发邮件,所有数据和 API Key 都留在自己机器上,零云端依赖
    2. 智能家居与硬件自动化中枢:跑在树莓派上,结合 SOP 引擎的 MQTT/Cron/外设触发器,让 AI 根据传感器读数自动执行标准作业流程(如温度异常告警并开启风扇),审批门保证关键操作人工确认
    3. 离线/内网 AI 运维助手:搭配本地 Ollama 在无外网环境下运行,通过 Shell 与 HTTP 工具执行巡检、日志分析等任务,沙箱与工具回执满足安全审计要求

    推荐理由

    体验下来最深的感受是「」和「」:相比动辄上 GB 依赖的 Python Agent 框架,ZeroClaw 一个 6.6MB 起步的 Rust 二进制就能常驻后台,树莓派也毫无压力;配置只有一个 TOML 文件,quickstart 三分钟跑通。它的安全设计是我见过的开源助理里最认真的——默认监督模式、OS 级沙箱、每次工具调用都有加密回执,敢放心给它 Shell 权限。多渠道 + 多提供商 + 故障回退的组合意味着它真的能当”基础设施”用,而不只是玩具 Demo。如果你想要一个数据完全自持、能接硬件、7×24 在线的私人 Jarvis,ZeroClaw 是目前 Rust 生态里最值得入手的选择。注意:官方仓库只有 zeroclaw-labs/zeroclaw 一个,谨防仿冒包。

    下载地址

  • ZeroClaw:32K Stars 的 Rust 全自主 AI 个人助手基础设施,单二进制部署、30+通道接入、还能直控硬件

    ZeroClaw:32K Stars 的 Rust 全自主 AI 个人助手基础设施,单二进制部署、30+通道接入、还能直控硬件

    ZeroClaw 官方 Banner

    项目简介

    ZeroClaw 是一个用 Rust 编写的全自主 AI 个人助手基础设施——一个单二进制的智能体运行时(Agent Runtime),口号非常硬核:「You own the agent. You own the data. You own the machine it runs on.」(智能体是你的,数据是你的,跑它的机器也是你的)。它对接 Anthropic、OpenAI、Ollama 等约 20 家模型提供商,通过 Discord、Telegram、Matrix、邮件、语音、Webhook 等 30+ 消息通道与你交互,并能调用 Shell、浏览器、HTTP、硬件(树莓派 GPIO!)和自定义 MCP 服务器执行任务。整个系统跑在你自己的机器上,用你自己的密钥。项目 2026 年 2 月创建,短短 5 个多月即斩获 32,400+ Stars,由 Harvard、MIT、Sundai Club 社区孵化,是当前 GitHub 上最火的 Rust AI 基础设施项目之一。

    安装要求和过程

    环境要求

    • 操作系统:Linux / macOS / Windows / FreeBSD / NixOS / Docker 全平台支持,也可跑在树莓派等硬件上
    • Rust:仅源码构建需要(Rust Edition 2024);官方提供预编译二进制,无需工具链
    • 磁盘占用:minimal 内核精简版仅约 6.6 MB
    • 模型来源:任一 LLM 提供商 API Key,或本地 Ollama(完全离线可用)

    快速安装

    # 一键安装(自动选择预编译二进制,失败则回退源码构建)
    curl -fsSL https://raw.githubusercontent.com/zeroclaw-labs/zeroclaw/master/install.sh | bash
    
    # 或克隆后安装(可交互选择功能特性)
    git clone https://github.com/zeroclaw-labs/zeroclaw.git
    cd zeroclaw && ./install.sh
    
    # 常用安装选项
    ./install.sh --preset minimal     # 仅内核精简版(约6.6MB)
    ./install.sh --prebuilt           # 强制使用预编译二进制
    ./install.sh --source --features agent-runtime,channel-discord  # 自定义特性

    快速上手

    zeroclaw quickstart        # 一站式引导:选择模型提供商、生成可用配置
    zeroclaw agent -a <alias>  # 与指定智能体交互式对话
    zeroclaw service install   # 注册为 systemd/launchctl/Windows 服务
    zeroclaw service start     # 后台常驻运行

    所有配置集中在一个 TOML 文件(~/.zeroclaw/config.toml),provider、channel、agent、安全策略全部声明式定义。

    核心功能

    • 多通道统一接入:Discord、Telegram、Matrix、邮件、语音、Webhook、CLI 等 30+ 通道适配器,所有入站消息汇入同一个智能体循环——一个 Agent 在所有平台回复你
    • 模型提供商无关:可插拔接入 Anthropic、OpenAI、本地 Ollama 及任意 OpenAI 兼容端点,支持故障回退链与智能路由,某家 API 抽风时自动切换保持在线
    • 安全优先架构:默认「supervised」监督模式——中风险操作需审批、高风险直接拦截;工作区边界、命令策略、OS 级沙箱(Landlock / Bubblewrap / Seatbelt / Docker)、每次工具调用都有密码学签名回执(Tool Receipts);开发机可切 YOLO 模式放飞
    • 硬件直控能力:通过 Peripheral trait 支持树莓派、STM32、Arduino、ESP32 的 GPIO / I2C / SPI / USB——让 AI 助手直接操控物理世界
    • SOP 事件引擎 + 网关面板:MQTT / Webhook / Cron / 外设事件触发标准作业流程(含审批门与断点续跑);HTTP/WebSocket 网关自带 Web 仪表盘,可视化管理聊天、记忆、配置与定时任务;还支持 ACP 协议接入 IDE

    典型使用场景

    1. 7×24 小时私人 AI 管家:注册为系统服务常驻后台,你在 Telegram 上问它日程、在邮件里让它整理附件、在 Discord 里让它跑脚本——同一个大脑,全渠道待命,数据永不出你的服务器
    2. 智能家居 / 硬件自动化中枢:跑在树莓派上直控 GPIO 传感器与继电器,配合 SOP 引擎实现「温度超标→MQTT 触发→AI 判断→自动开风扇并通知你」这类带审批门的物理世界自动化
    3. 企业内网离线 AI 运维助手:搭配本地 Ollama 全离线部署,利用命令策略与 OS 级沙箱严格限权,工具回执提供完整审计链——在合规敏感环境中安全落地 AI 自动化

    推荐理由

    试用下来最大的感受是「克制而完整」。市面上的个人 AI 助手项目大多是 Python 全家桶+一堆依赖,而 ZeroClaw 是一个 Rust 单二进制,最小 6.6MB,装完即跑,树莓派上也轻松常驻。它的安全设计诚意十足:默认监督模式、OS 级沙箱、每个工具调用带密码学回执,这在同类项目中相当罕见——大多数 Agent 框架是「先跑起来再说」,它是「先关进笼子再放权」。多通道统一智能体循环的设计也很优雅:不是每个平台一个 Bot,而是一个智能体在所有渠道等你。如果你想要一个真正属于自己、数据不外流、还能摸到硬件的 AI 助手,这可能是目前最工程化的开源答案。MIT/Apache-2.0 双许可,商用无忧。注意:官方特别提醒有仿冒仓库/域名,认准唯一官方仓库 zeroclaw-labs/zeroclaw。

    下载地址

    项目数据:32,420+ Stars | 4,847 Forks | Rust | MIT OR Apache-2.0 双许可 | 创建于 2026 年 2 月

  • MemPalace:57.7K Stars 的本地优先开源 AI 记忆系统,逐字存储 + 96.6% 检索召回,零 API 成本

    MemPalace:57.7K Stars 的本地优先开源 AI 记忆系统,逐字存储 + 96.6% 检索召回,零 API 成本

    MemPalace Logo

    项目简介

    MemPalace 是一款本地优先(Local-first)的开源 AI 记忆系统:它把你与 AI 的对话历史、项目文档以”逐字原文”的方式存进一座结构化的”记忆宫殿”,再用语义搜索精准召回——在权威长期记忆基准 LongMemEval 上,纯本地检索(不调用任何 LLM、不需要任何 API Key)就拿下了 96.6% R@5 的成绩,号称”基准测试打得最透明的开源 AI 记忆系统”。项目 2026 年 4 月上线,短短三个多月即斩获 57.7K+ Stars,MIT 许可,完全免费。

    与 Mem0、Zep 等”摘要式”记忆方案不同,MemPalace 的哲学是不摘要、不改写、不提炼——原文进、原文出。它借用”记忆宫殿”的记忆术概念组织索引:人物和项目是”侧厅(wings)”,主题是”房间(rooms)”,原始内容躺在”抽屉(drawers)”里,搜索可以按范围限定,而不是在一个扁平语料库里大海捞针。

    安装要求和过程

    环境要求:

    • Python 3.9+
    • 向量存储后端(默认内置 ChromaDB,零配置)
    • 约 300 MB 磁盘空间用于本地嵌入模型(推荐多语言的 embeddinggemma-300m,支持 100+ 语言;也可选 30 MB 的英文版 all-MiniLM-L6-v2)
    • 核心功能无需任何 API Key

    快速安装(推荐 uv,隔离环境防依赖冲突):

    # 方式一:uv(推荐)
    uv tool install mempalace
    mempalace init ~/projects/myapp
    
    # 方式二:pipx
    pipx install mempalace
    
    # 方式三:pip(虚拟环境内)
    python -m venv .venv && source .venv/bin/activate
    pip install mempalace

    Docker 部署(可直接作为 MCP 服务器运行):

    docker build -t mempalace .
    # MCP 服务器(stdio 模式,注意 -i 参数)
    docker run -i --rm -v mempalace-data:/data mempalace
    # 或直接跑 CLI 命令
    docker run --rm -v mempalace-data:/data mempalace search "why GraphQL"

    30 秒上手:

    # 把项目文件"挖"进记忆宫殿
    mempalace mine ~/projects/myapp
    # 挖掘 Claude Code 历史会话
    mempalace mine ~/.claude/projects/ --mode convos
    # 语义搜索
    mempalace search "当初为什么改用 GraphQL"
    # 新会话开始时加载上下文
    mempalace wake-up

    核心功能

    • 逐字原文存储 + 语义检索:不摘要、不改写,对话与文档按原文入库;LongMemEval 上纯语义检索 R@5 达 96.6%,混合管线(关键词加权 + 时间邻近加权)在留出集上达 98.4%,加 LLM 重排后 ≥99%——全部结果可用仓库内脚本复现。
    • 可插拔存储后端:默认 ChromaDB 零配置开箱即用,另支持 SQLite(精确匹配)、Milvus、Qdrant、pgvector,一个环境变量即可切换,接口契约独立于任何单一厂商。
    • 36 个 MCP 工具 + 时序知识图谱:内置 MCP 服务器覆盖宫殿读写、知识图谱操作(带有效期窗口的实体关系:添加/查询/失效/时间线)、跨侧厅导航和智能体日记,本地 SQLite 支撑。
    • 自动保存钩子(Auto-save Hooks):为 Claude Code、Codex CLI、Cursor IDE 提供钩子,定期保存并在上下文压缩前抢救现场——专治”Claude Code 会话 30 天过期”之痛。
    • 彻底本地、彻底免费:嵌入模型本地运行,数据不出机器(除非你主动选择),MIT 许可,无任何付费墙。

    典型使用场景

    场景一:给 Claude Code / Cursor 装上”永久记忆”。AI 编程工具的会话记录会过期、上下文会被压缩,三周前”为什么放弃方案 A 改用方案 B”的讨论早已无处可寻。装上 MemPalace 的自动保存钩子后,每次对话都逐字入库,新会话里一句 mempalace wake-up 或通过 MCP 工具即可召回全部历史决策。

    场景二:团队/个人的项目决策考古。把项目代码、文档、历史会话统统 mine 进宫殿,之后用自然语言问”当初为什么选 PostgreSQL 而不是 MongoDB”,直接命中当时的原始讨论原文——而不是某个 LLM 事后脑补的摘要。

    场景三:隐私敏感环境下的 AI 记忆层。法务、医疗、金融等不能把数据传到云端的场景,MemPalace 全链路本地运行(嵌入模型本地、向量库本地、检索本地),配合 Ollama 等本地模型即可搭出完全离线的”有记忆的 AI 助手”。

    推荐理由

    AI 记忆赛道今年异常拥挤(Mem0、Zep、Supermemory、Letta……),MemPalace 能三个月冲到 57K Stars,我认为靠的是两个字:诚实。它是少数把基准测试方法论、每道题的原始结果文件全部提交到仓库、并且主动说明”最后 0.6% 是看着错题调出来的所以我们不宣传 100%”的项目——甚至拒绝与竞品做不对等的表格对比。这种工程品味在营销味浓重的 AI 开源圈里非常稀缺。

    实际体验上,”逐字存储”这个反直觉的设计恰恰是最大亮点:摘要式记忆一旦摘错,信息就永久丢失;而 MemPalace 永远保留原文,检索层再怎么迭代都能吃到红利。加上零 API 成本、五种后端随意切换、36 个 MCP 工具即插即用,把它接进 Claude Code / Cursor 的成本极低。如果你只想给自己的 AI 工作流加一层”不会失忆”的保险,这是目前开箱体验最好的选择之一。唯一要提醒的是:官方明确警告有大量仿冒网站,请只从 GitHub、PyPI 和 mempalaceofficial.com 获取。

    下载地址

  • OpenHuman:本地优先的个人 AI 超级大脑,连续 9 天登顶 GitHub 趋势榜(35K+ Stars)

    OpenHuman:本地优先的个人 AI 超级大脑,连续 9 天登顶 GitHub 趋势榜(35K+ Stars)

    OpenHuman 界面演示

    项目简介

    OpenHuman 是一个「本地优先」的个人 AI 超级智能体:它既是一个能记住你全部生活与工作数据的大脑(Brain),又是一个能编排智能体舰队与工作流的指挥官(Orchestrator),还是一个能在你话音未落时就完成资料搜集的深度研究员(Deep Researcher)。项目由 tinyhumansai 团队用 Rust 打造,上线一周即连续 9 天登顶 GitHub 趋势榜,目前已收获 35,000+ Stars

    安装要求和过程

    环境要求:OpenHuman 是 UI 优先的桌面应用,普通用户无需命令行、无需配置文件,几次点击即可从安装到可用。支持 macOS / Windows / Linux 三大平台。

    普通用户(推荐):直接从官网或 GitHub Releases 下载对应平台安装包即可。

    • 官网下载:https://tinyhumans.ai/openhuman
    • GitHub Releases:https://github.com/tinyhumansai/openhuman/releases/latest
    • 终端安装:支持 Homebrew、Debian/Ubuntu .deb、AUR 及安装脚本,详见仓库 INSTALL.md

    从源码构建(贡献者):

    1. 安装依赖:Git、Node.js 24+、pnpm 10.10.0、Rust 1.93.0(含 rustfmt + clippy)、CMake、Ninja、ripgrep 及桌面构建前置工具。
    2. Fork 并克隆仓库,先执行 git submodule update --init --recursive,再运行 pnpm install
    3. 开发调试:pnpm dev(Web UI)、pnpm --filter openhuman-app dev:app(桌面端)。

    核心功能

    OpenHuman 记忆构建示意图

    • 记忆树 + Obsidian 知识库:把你的数据压缩成带评分的 Markdown 树,存在本机 SQLite 里,并镜像为可打开编辑的 Obsidian 库——不是「向量黑盒」,记忆看得见、改得动。
    • 海量集成:100+ OAuth 集成、5,000+ MCP 服务器、90,000+ Skills,一键接入 Gmail、Notion、GitHub、Slack;自动抓取每 20 分钟同步一次,让智能体「今早就拿到明天的上下文」。
    • 潜意识后台循环(Subconscious):在你停止输入后仍持续思考,比对世界变化、推进目标、生成晨间简报。
    • TokenJuice 压缩:工具输出在进入模型前先压缩,信息不变但 Token 最多减少 80%,让「大脑」跑得起也养得起。
    • 智能体编排(图而非循环):基于开源 tinyagents 的检查点图运行,可暂停等人工、重启后续跑、卡住自动纠偏;子智能体舰队最深可派生三级。

    典型使用场景

    OpenHuman 智能体编排示意图

    • 个人第二大脑:连接邮箱、日历、代码仓库、笔记与聊天记录,一次同步即可让智能体全面(压缩后)掌握你的上下文,无需数周「养成期」,随时问它「我这周的进展」「谁在等我回复」。
    • 多智能体统一指挥台:通过 Signal 协议端到端加密的智能体互联,把 Claude Code、Codex、OpenClaw、Hermes 等工具接进来,用 OpenHuman 统一编排调度,密钥永不落盘。
    • 会议与自动化助理:以头像+声音自动加入 Meet / Zoom / Teams / Webex 会议,实时转写、按名应答、会后生成带待办的纪要;可视化工作流(灵感来自 n8n / Zapier)由智能体自动提议、你在画布上审核后保存。

    OpenHuman 可视化工作流画布

    推荐理由

    用下来最打动我的是它对「隐私」和「记忆」的执念。开启一键 Privacy Mode 后,所有推理都不会离开本机,且由 Rust 核心强制执行;日常数据在设备端加密、密钥走系统钥匙串、敏感操作有审批闸门。相比要么云端黑盒、要么需要数周喂上下文的同类产品,OpenHuman 让「几分钟就懂你」成为现实,还自带模型路由、浏览器、语音、图像/视频生成等一整套原生工具,一个订阅打通全部。需要留意的是它目前仍是 Early Beta,且采用 GPL-3.0 许可证,商业集成前请评估其传染性。

    下载地址

    项目数据截至发布时:35,000+ Stars · Rust · GPL-3.0 · Early Beta。开源世界迭代飞快,具体以官方仓库为准。

  • 亚马逊Ring门铃把路人脸偷偷存了,集体诉讼把亚马逊告上法庭

    亚马逊的Ring门铃最近摊上大事了。一位弗吉尼亚州的居民Charles Sigwalt在西雅图联邦法院提起集体诉讼,指控Ring的”熟悉面孔”(Familiar Faces)功能在路人完全不知情的情况下,用AI识别并存储了他们的面部数据。

    这个功能去年9月就宣布了,当时电子前沿基金会(EFF)和马萨诸塞州参议员Ed Markey就跳出来反对。但亚马逊还是去年12月硬着头皮把功能上线了。

    Ring门铃摄像头
    Ring门铃的摄像头覆盖着无数美国家庭的门口(图:Getty Images)

    功能本身没大问题,问题出在”被识别的人”没有选择权

    “熟悉面孔”的逻辑其实挺直观——Ring用户开启之后,门铃能识别出经常出现在门口的人,然后推送更精准的通知,比如”爸爸在门口”,而不是泛泛地说”有人在门口”。

    问题在哪?开启功能是Ring用户的主动选择,但那些每天路过这些门铃的路人——邮递员、邻居、散步的陌生人——对此完全不知情,也没有任何方式可以”选择退出”。诉讼文件里的说法很直接:”数百万美国人在不知情的情况下,被Ring摄像头采集了面部识别信息。”

    Ring用户需要主动开启这个功能,但路过的非用户完全无法得知自己被采集了面部信息,也无法选择退出。这个不对称的信息关系,是整起集体诉讼的核心。

    Ring的隐私黑历史不止这一桩

    亚马逊对这起诉讼暂时没有回应。但在功能上线时,公司曾表示面部数据是加密存储的,不会对外共享,未识别的面孔会在30天后自动删除。

    问题是,Ring在用户隐私这件事上,口碑一直不怎么样。2023年,亚马逊跟美国联邦贸易委员会(FTC)和解,赔了580万美元,原因是Ring的员工和承包商可以随意查看女性用户的私人视频——FTC的说法更狠:当时每个员工都能访问所有客户的视频,完全不需要什么业务理由。

    还有一件事,Ring跟执法部门的关系一直很暧昧,曾经允许警察在无搜查令的情况下向用户索要录像。这个权限后来在2024年1月取消了。今年超级碗期间,Ring推了一个用AI找走失宠物的功能”Search Party”,也引发了类似的隐私争议,随后Ring取消了跟监控公司Flock Safety的合作——这家公司被曝向ICE等联邦机构提供监控录像。


  • 谷歌给安卓加了道通话防火墙:AI深度伪造的诈骗电话,现在能自动识别了

    你有没有接过那种电话——来电显示是”Mom”,声音听起来也像,但对方一开口就要你转钱救急?最近这类AI深度伪造的诈骗电话越来越多了,谷歌终于给安卓用户出了个针对性的功能。

    AI诈骗电话是怎么骗过你的?

    诈骗者现在的套路是:先 spoof 一个你信任的号码(比如家人的号码),再用AI深度伪造技术把声音模仿得一模一样。你一看来电显示是”Mom”,声音也对,很容易就信了,等发现不对劲的时候,钱可能已经转出去了。

    谷歌在官方博客里解释:”如果一个诈骗者试图伪装成你信任的联系人,那个初始的确认信号就会缺失。你的设备会立刻注意到这一点,并且ping对方的实际设备来双重确认。如果对方的真实设备说’我现在没在打电话’,你屏幕上就会收到警告,建议你立即挂断。”

    这个功能是怎么工作的?

    其实原理有点像”设备间的数字握手”——当你和另一个使用Google Phone应用的联系人通话时,双方的手机都会发送一个静默确认信号来验证通话的合法性。

    这个功能默认是开启的,会在后台自动运行,你不需要做任何设置。而且谷歌把这个功能构建在RCS(富通信服务)之上,这意味着其他应用和公司也可以采用这项技术,以后可能会有更多的通话应用支持类似的反诈骗功能。

    谷歌安卓虚假通话检测功能示意图
    谷歌新推出的虚假通话检测功能会自动验证来电合法性

    同期还有其他安卓更新

    除了反诈骗通话功能,谷歌这次还推出了几个其他的安卓更新:比如Google Photos的”wardrobe”功能,可以帮你虚拟试穿衣服,下周起在美国、印度、巴西的安卓10+设备上推出;Google Play Books的”Catch me up”功能,可以帮你recap读到一半的故事,还能高亮段落提问;还有Circle to Search现在可以一次性搜索整套穿搭,不用再一件一件搜了,安卓14+设备现在就能用。


  • NextChat:88K Stars!轻量极速的跨平台AI对话界面,让AI助手触手可及

    NextChat:88K Stars!轻量极速的跨平台AI对话界面,让AI助手触手可及

    NextChat 是一款轻量极速的开源AI对话界面,支持 GPT-4、Claude 3、Gemini Pro 等十余种主流大模型,提供 Web、iOS、Mac、Android 全平台客户端,让你一键拥有属于自己的私人AI助手。

    NextChat 界面预览

    NextChat 优雅的对话界面

    🚀 项目简介

    NextChat(原名 ChatGPT-Next-Web)是一个基于 Next.js + React 构建的跨平台 AI 聊天机器人 Web UI。项目从2023年发布至今,已获得 88K+ Stars,成为 GitHub 上最受欢迎的开源 AI 对话前端之一。

    它的设计理念是:快、轻、美。整个应用打包后仅约 5MB(Tauri 桌面端),网页端更是做到了极致的加载速度和响应体验。

    NextChat 多模型支持

    📦 安装要求和过程

    环境要求

    • Web 部署:Node.js 18+ 或 Vercel 账号(推荐)
    • 桌面端:Windows / macOS / Linux
    • 移动端:iOS 15+ / Android 8+
    • API Key:需要 OpenAI / Claude / Gemini 等任一模型的 API Key

    快速安装 – 三种方式

    方式一:Vercel 一键部署(推荐)

    最快的方式,5秒钟完成部署:

    1. 访问 NextChat GitHub 仓库
    2. 点击 Deploy with Vercel 按钮
    3. 登录 Vercel,fork 项目并部署
    4. 在 Vercel 环境变量中添加你的 OPENAI_API_KEY
    5. 部署完成!获得你的私人 ChatGPT 域名

    方式二:Docker 部署

    # 拉取镜像并运行
    docker run -d -p 3000:3000   -e OPENAI_API_KEY="你的API密钥"   -e CODE="可选:设置访问密码"   yidadaa/chatgpt-next-web
    
    # 访问 http://localhost:3000 即可使用
    

    方式三:本地开发

    # 克隆项目
    git clone https://github.com/ChatGPTNextWeb/NextChat.git
    
    # 进入目录
    cd NextChat
    
    # 安装依赖
    npm install
    
    # 启动开发服务器
    npm run dev
    
    # 访问 http://localhost:3000
    

    💡 核心功能

    1. 多模型支持,一个界面搞定所有AI

    NextChat 最大的优势在于统一接口。你可以在同一个界面中切换:

    • OpenAI:GPT-3.5, GPT-4, GPT-4o, GPT-4 Turbo
    • Anthropic Claude:Claude 3 Haiku, Sonnet, Opus
    • Google:Gemini Pro, Gemini Ultra
    • 国内模型:DeepSeek, 通义千问, 文心一言, 讯飞星火
    • 本地模型:Ollama, LM Studio (通过 OpenAI 兼容接口)

    这意味着你可以用同一个界面,根据不同的任务选择最合适的模型 —— 写代码用 GPT-4,聊天用 Claude,节省成本用 DeepSeek。

    2. 极速响应,本地存储保护隐私

    NextChat 在性能优化上做到了极致:

    • 首屏加载 < 1秒:得益于 Next.js 的 SSR 和静态生成
    • 流式输出:打字机效果,响应无延迟
    • 本地存储:所有对话记录保存在浏览器 LocalStorage,不会上传到服务器
    • Markdown 渲染:支持代码高亮、表格、数学公式(KaTeX)
    • 对话搜索:快速检索历史对话

    3. 对话管理,像专业IDE一样强大

    • 对话分支:可以基于某条消息创建分支,方便对比不同回复
    • 提示词模板:内置多种系统提示词,也支持自定义
    • 对话导入/导出:支持 Markdown、JSON 格式
    • 多会话管理:左侧边栏快速切换不同对话
    • 消息编辑:可以修改已发送的消息重新生成回复

    4. 全平台覆盖,随时随地使用AI

    NextChat 提供了完整的多端支持:

    • Web:响应式设计,手机/平板/电脑自适应
    • macOS:Tauri 打包,原生应用体验(仅 5MB)
    • Windows:同样使用 Tauri,启动快速
    • iOS:App Store 可下载
    • Android:Google Play 或侧载 APK

    5. 高度可定制,打造你的专属AI界面

    • 主题切换:内置浅色/深色主题,支持自定义 CSS
    • 多语言:支持中文、英文、日文等 18+ 种语言
    • API 代理:支持设置自定义底座 URL,解决网络问题
    • 访问控制:可设置访问密码,分享给团队使用
    • 插件系统:支持自定义功能和第三方集成

    🎯 典型使用场景

    场景一:个人AI助手,隐私数据不上云

    用户:注重隐私的个人用户、自由职业者

    痛点:使用官方 ChatGPT 担心对话记录被用于存储训练,且需要付费订阅 Plus。

    解决方案

    • 部署 NextChat 到自己的服务器或 Vercel
    • 接入自己的 OpenAI API Key(按量付费,更划算)
    • 所有对话本地存储,完全隐私
    • 可切换多个模型,根据任务选择最合适的

    成本对比:ChatGPT Plus $20/月 vs NextChat + API 按量付费(轻度使用 < $10/月)

    场景二:团队协作,统一AI工具入口

    用户:小团队、创业公司、教育机构

    痛点:团队成员各自购买 AI 订阅,成本高且无法共享 Prompt 和对话记录。

    解决方案

    • 部署 NextChat 到团队服务器
    • 设置访问密码,团队成员共享使用
    • 使用同一个 API Key 池,集中管理成本
    • 导出优质对话记录,建立团队知识库

    实际案例:一个 10 人团队,使用 NextChat 自部署,每月 API 成本约 $50,人均 $5,远低于每人 $20 的 Plus 订阅。

    场景三:开发者调试,快速测试不同模型

    用户:AI 应用开发者、Prompt 工程师

    痛点:需要在不同模型中测试同一 Prompt 的效果,但官方界面切换麻烦。

    解决方案

    • 在 NextChat 中配置多个模型 API
    • 同一对话中快速切换模型
    • 使用对话分支功能,对比不同模型的回复
    • 导出 Markdown 格式,方便整理测试报告

    🌟 推荐理由

    为什么我强烈推荐 NextChat?

    1. 开源且活跃
    项目在 GitHub 上开源,代码透明,社区活跃。你可以自己审查代码,确保没有后门。而且更新频繁,新模型支持速度快。

    2. 性能极致优化
    作为前端项目,NextChat 的性能优化做到了极致。首屏加载快,流式输出无延迟,即使在网络不佳的情况下也能流畅使用。相比其他 Web UI,NextChat 的响应速度是最快的之一。

    3. 真正的跨平台
    很多项目声称”跨平台”,但实际上只支持 Web。NextChat 提供了完整的桌面端和移动端应用,而且桌面端使用 Tauri 打包,体积小、启动快、内存占用低。

    4. 隐私保护到位
    所有对话记录保存在本地,不会上传到任何服务器。即使你部署在自己的服务器上,只要不配置云端同步,数据就只在用户设备上。对于注重隐私的用户来说,这一点非常重要。

    5. 成本可控
    使用官方 ChatGPT Plus 需要每月 $20,而 NextChat 按量付费,对于轻度使用者来说,每月可能只需要几美元。而且你可以根据不同任务选择不同模型,进一步控制成本。

    我的使用心得
    我自己部署了 NextChat,接入了 OpenAI API 和 DeepSeek API。日常聊天用 DeepSeek(便宜),写代码用 GPT-4(准确),每月总成本不到 $10。界面美观,响应快速,是我每天使用最多的 AI 工具。

    📥 下载地址

    🎬 总结

    NextChat 是一款真正为用户着想的开源 AI 对话界面。它不追求花哨的功能,而是把速度、隐私、跨平台这三个核心需求做到了极致。

    如果你:

    • ✅ 希望拥有自己的私人 AI 助手
    • ✅ 注重对话隐私,不想数据被上传
    • ✅ 需要同时使用多个 AI 模型
    • ✅ 想要降低成本,按量付费
    • ✅ 需要在多个设备上使用统一的 AI 界面

    那么,NextChat 绝对是你的 最佳选择

    5分钟部署,拥有一个完全属于你的AI助手 🚀

  • 谷歌把AI强塞进搜索结果,DuckDuckGo趁机把无AI搜索做成了生意

    谷歌5月官宣搜索框迎来25年来最大改版之后,DuckDuckGo的流量数据就开始一路往上飙。上周,它的无AI搜索页面访问量周环比涨了将近30%,美国地区应用安装量周环比增长18.1%,其中iOS端的峰值更是达到69.9%。这家一直主打隐私保护的搜索引擎公司,现在又给自己贴上了新的标签:反AI。

    DuckDuckGo No AI搜索页面
    DuckDuckGo 推出的无AI搜索页面(图片来源:DuckDuckGo)

    谷歌改版,DuckDuckGo接住了流量

    谷歌这次改版的核心变化是:搜索结果页顶部的”10条蓝色链接”被降级了,取而代之的是AI生成的概览卡片,还能根据后续问题把用户直接带入AI对话模式。对于习惯了传统搜索体验的用户来说,这个变化来得太猛,而且没有关闭选项。

    DuckDuckGo瞄准的就是这批”被谷歌强喂AI”的用户。它新推出了浏览器扩展,安装之后可以把 noai.duckduckgo.com 设为默认搜索引擎——这个页面没有AI辅助答案、没有聊天提示框,搜索结果里AI生成图片的出现频率也更低。目前扩展已支持 Chrome 和 Firefox,使用DuckDuckGo自家浏览器的用户则可以在设置里直接保留自己的AI偏好,清历史记录也不会重置。

    DuckDuckGo特别强调,5月28日当天,它的无AI搜索页面流量创了谷歌改版宣布以来的新高,是当天的3倍。而且这波增长看起来不是短期波动——访问量平均比基准线高出约84%,说明用户在用脚投票,而且是持续性地转走。

    DuckDuckGo自己也在做AI,这只是另一种产品策略

    这里有个微妙的细节:DuckDuckGo并不是一家”反AI”公司。它自己的AI聊天机器人产品一直在运营,还提供订阅计划,用户可以访问最新模型,附带VPN、身份盗用修复等服务。它做的更像是一种产品分层——想要无AI体验的用户有得选,想要AI功能的用户也有得选,而不是像谷歌那样把AI当成默认项硬推给所有人。

    接下来DuckDuckGo还会更新它的隐私要点浏览器扩展(支持Chrome、Firefox、Edge、Opera),新增AI搜索设置的开关,让用户更细粒度地控制自己想要的搜索体验。这个动作背后的逻辑很清楚:既然谷歌把AI搜索变成了默认,那”可选”本身就成了一个卖点。


    用户到底在反感什么

    这波”反AI搜索”情绪背后,其实是两类不满的叠加。一类是纯粹的产品体验问题——很多人用搜索就是要快速找到链接,AI概览占了半屏,还得要多点一次才能看到传统结果。另一类则是对AI生成内容准确性的不信任,尤其是当AI概览给出错误答案的时候,用户连纠错的机会都要多花几步才能找到。

    DuckDuckGo这波操作本质上是把”不想要AI”这个需求商业化了。它没有直接攻击AI技术本身,而是攻击了”强制默认”这个产品设计决策。这个角度挺聪明,因为即便是最热衷AI的人,也未必希望每次搜索都被AI拦一道。