标签: AI助手

  • OpenClaw – 跨平台个人AI助手,支持30+通讯平台集成

    OpenClaw – 跨平台个人AI助手,支持30+通讯平台集成

    ⭐ GitHub Stars: 380,430
    🍴 Forks: 79,687
    📅 最后更新: 2026-06-25
    💻 主要语言: TypeScript

    📝 项目简介

    OpenClaw 是一款可本地部署的跨平台个人AI助手,支持在任何操作系统和通讯平台上运行,采用”龙虾之道”🦞的设计理念,让用户完全掌控自己的数据和隐私。

    💻 安装要求和过程

    环境要求

    • Node.js: 24版本(推荐)或 22.19+
    • 包管理器: npm 或 pnpm
    • 操作系统: macOS, Linux, Windows

    快速安装步骤

    方式一:全局安装(推荐)

    # 使用npm全局安装最新版
    npm install -g openclaw@latest
    
    # 或使用pnpm安装
    pnpm add -g openclaw@latest
    
    # 运行引导式安装,同时安装Gateway守护进程(保证服务常驻)
    openclaw onboard --install-daemon
    

    引导式安装会一步步帮你配置Gateway、工作区、通讯渠道和技能,支持macOS、Linux、Windows系统。

    方式二:Windows原生应用

    Windows用户可以下载原生的 Windows Hub 应用完成配置。

    方式三:源码开发安装

    # 克隆仓库
    git clone https://github.com/openclaw/openclaw.git
    cd openclaw
    
    # 安装依赖(注意:源码部署必须使用pnpm)
    pnpm install
    
    # 初始化本地配置和工作区
    pnpm openclaw setup
    
    # 启动开发模式,源码修改后自动重载
    pnpm gateway:watch
    

    ✨ 核心功能

    1. 本地优先Gateway架构

    统一管理会话、通讯渠道、工具和事件的控制平面,所有数据本地存储,保障隐私安全。

    2. 多渠道支持(30+平台)

    覆盖WhatsApp、Telegram、Slack、Discord、微信、QQ、飞书等主流通讯平台,在常用聊天工具中直接使用AI助手。

    3. 多智能体路由

    可将不同渠道/账号/联系人的请求路由到独立的智能体,实现隔离的工作区和会话,适合多角色协作场景。

    4. 语音交互与实时Canvas

    支持macOS/iOS语音唤醒、Android端连续语音对话,智能体可驱动可视化工作区(Canvas面板),支持A2UI交互。

    5. 技能扩展体系

    支持通过ClawHub安装、管理自定义技能,内置/管理/工作区技能开箱即用,快速扩展AI助手能力边界。

    🎯 典型使用场景

    场景一:个人本地AI助手

    在本地设备部署OpenClaw,无需上传数据到第三方服务,保障数据隐私。通过WhatsApp、Telegram等常用通讯工具随时调用AI助手,实现:

    • 快速查询信息、总结文档
    • 设置定时提醒和任务
    • 管理个人日程和待办事项
    • 本地文件处理和代码辅助

    场景二:开发者工作流集成

    将OpenClaw集成到日常开发工作流中,通过命令行或通讯工具快速完成:

    • 代码审查和bug分析
    • 自动化测试和部署
    • 文档生成和代码注释
    • 项目管理和进度跟踪
    # 向助手发送请求,设置高思考等级
    openclaw agent --message "分析这个bug的根本原因" --thinking high
    
    # 发送消息到指定联系人
    openclaw message send --target +1234567890 --message "代码已修复,请审查"
    

    💡 推荐理由

    为什么推荐OpenClaw?

    • 🏠 真正本地化:数据完全存储在本地,无需担心隐私泄露,符合”own-your-data”理念
    • 🔌 无缝集成:支持30+通讯平台,无需切换应用即可使用AI助手
    • 🚀 活跃社区:380K+ Stars,79K+ Forks,迭代速度快,问题响应及时
    • 🛠️ 高度可扩展:基于ClawHub的技能系统,快速添加自定义功能
    • 🔒 安全沙箱:非主会话默认运行在Docker沙箱,避免安全风险

    个人使用心得:

    OpenClaw最大的优势在于其”本地优先”的设计理念。与依赖云服务的AI助手不同,OpenClaw让你完全掌控自己的数据。通过将其集成到WhatsApp等日常使用的通讯工具中,可以实现真正无缝的AI助手体验。多智能体路由功能特别适合需要隔离不同工作场景的用户,比如将工作和个人助手分开。此外,ClawHub技能生态系统使得扩展功能变得非常简单,社区已经贡献了大量实用技能。

    📥 下载地址

    官方资源链接:

    📊 项目统计

    指标 数据
    ⭐ GitHub Stars 380,430
    🍴 Forks 79,687
    👁️ Watchers 1,792
    ❗ Open Issues 6,634
    💻 主要语言 TypeScript
    📅 最后更新 2026-06-25
    📜 开源协议 MIT License

    本文档持续更新,最后更新时间: 2026-06-26 01:37:21

  • Facebook推出AI创作者伴侣应用,这次要和ChatGPT抢人了

    Facebook AI创作者伴侣应用
    Meta重新打造Creator Studio,推出独立AI伴侣应用 | 图片来源:Meta

    Meta这周悄悄做了一个挺有意思的举动——把原来的Facebook Creator Studio整个重新打造成了一款独立的AI伴侣应用,专门给内容创作者用。目前这款应用还在小范围测试,只向部分创作者开放。

    这件事背后有个很直接的动机。TikTok和YouTube这几年疯抢创作者,Meta显然不想让自家的创作者跑到别的平台去。更关键的是,很多创作者在 brainstorm 内容创意、分析数据的时候,现在都用ChatGPT之类的第三方工具。Meta这次等于把这件事揽回来,让你在Facebook的生态里就能搞定一切。

    内置AI助手,语气都能模仿你

    新版Creator Studio应用里内置了Meta上个月刚推出的AI创作者助手。这个助手不是泛泛地给建议,它会根据你的内容风格、历史表现、观众互动情况、还有你自己的目标,给出个性化的推荐。

    比如说,创作者不用再去盯着一堆图表和数据面板发愁,直接问AI”我应该什么时候发帖?”或者”我的评论区大家都在说什么?”就行。因为是对话式的,你还可以接着追问,比如”我的观众群体这几个月有什么变化”。

    AI还会帮你处理评论。它能从成百上千条评论里把最重要的那些挑出来,然后用你自己的语气风格帮你起草回复。当然,发之前你可以编辑,最终决定权还在你手里。

    每天打开这个应用,创作者会看到一个当日优先事项列表:最新帖子的表现如何、离设定的目标还有多远、哪些评论需要回复。这其实就是把原来分散在各个页面里的功能,用AI整合到一个对话式的界面里。

    Meta最近在疯狂推新应用

    这次的AI创作者应用只是Meta近期密集发布新应用的一个缩影。上个月刚推出了一个叫Forum的独立应用,功能类似Reddit,专门为Facebook群组服务。4月又测试了一款叫Instants的应用,可以让用户跟Instagram好友分享阅后即焚的照片。

    这还没完。《纽约时报》本周二报道说,Meta还在开发一款类似Polymarket的预测市场应用,内部代号叫”Arena”,只是还没正式推出。


    为什么要这么密集地推新应用?《华尔街日报》今年4月报道过,扎克伯格跟员工说,AI带来的效率提升,会让公司有史以来第一次能同时开发这么多款应用。翻译一下就是:以前需要几十个人做的功能,现在AI能帮着搞定一大半,所以可以同时铺开做好几个产品。

    这个逻辑其实挺值得玩味的。AI取代了一部分重复劳动之后,释放出来的生产力不是用来裁员,而是用来扩张产品线。对Meta来说,创作者工具、群组社交、预测市场这些方向同时押注,总有一个能跑出来。

  • 亚马逊在印度测试Alexa+,这次要攻下印地语市场

    亚马逊在印度测试Alexa+,这次要攻下印地语市场

    Alexa+在印度测试
    亚马逊在印度测试支持印地语的Alexa+(概念图)

    亚马逊最近给一些印度用户发了封邮件,邀请他们参加Alexa+的 Hindi 语言测试。邮件里说得很直白:公司在做一个新的Alexa体验,用户的反馈对打磨产品很重要。想参加的话,得在6月22日之前填一份印地语表格。

    这不是亚马逊第一次在印度推语音助手。2017年,Alexa就登陆了印度,不过那时候只支持英语。2019年,亚马逊给Alexa Skills Kit加上了印地语支持。现在,轮到Alexa+了。

    “您被邀请加入印度Alexa+ Beta计划。我们正在创造一个全新的Alexa体验,您的反馈对于完善Alexa+的功能至关重要。加入Alexa+ Beta计划后,当印地语(印度)测试体验可用时,您将收到通知。”

    亚马逊在邮件里也提前打了预防针:beta版肯定有bug,可能会给出不准确的信息,也可能把本地的一些细微差别念错。公司确认了正在印度测试Alexa+,但没提供更多评论。

    为什么要盯上印地语?

    印度有超过6亿人讲印地语。对亚马逊来说,这是一个巨大的市场。而且,这些用户很多时候是”code-mixing”——就是说一句话的时候,印地语和英语混着用。

    公司们都清楚,在印度,语音可能会成为AI工具使用的一大因素。就在几天前,印度富豪Ambani还说过,要把AI塞进每一通电话、每一个App、每一个家庭。大家都在找让印度用户开口说话的方式。

    Alexa+是亚马逊在2025年推出的生成式AI对话助手。不过,它的推出速度挺慢的。今年2月,这个新体验才向所有美国用户开放。2026年,亚马逊把Alexa+的版图扩张到了英国、加拿大、巴西、墨西哥、意大利和德国,都加上了本地化支持。

    Prime用户免费,其他人要掏钱

    亚马逊给Prime会员提供免费的Alexa+,非Prime用户则得按月付费才能用上这个升级版助手。

    目前,Alexa+在印度还没正式上线,什么时候会推出也没个准信。不过,从开始beta测试来看,亚马逊应该是想在印度市场发力了。

    语音助手这个赛道,现在可不缺玩家。谷歌有Assistant,苹果有Siri,微软有Copilot。亚马逊的算盘是,靠印地语支持和对印度市场的理解,能抢到一块蛋糕。

    不过,要在印度把语音AI做好,难度不小。口音、方言、code-mixing,这些都是挑战。beta测试的用户反馈,会决定Alexa+在印度到底能走多远。


  • 你的截图终于有救了:这款AI应用把截图库变成了「第二大脑」

    Pool截图整理AI应用
    Pool应用界面概念图 | 图源:AI生成

    每个人的手机相册里,都有那么一个角落——塞满了截图,食谱、穿搭灵感、旅行攻略、有意思的话、想买的东西——然后就再也没有打开过。这件事几乎所有人都有共鸣,但一直以来没人真正解决它。

    现在有一款叫Pool的iOS应用,想把这个痛点吃掉。它的思路挺直接:用AI把你拍的截图变成真正有用的”记忆库”,而不是一个数字垃圾堆。

    截图→分类→找回,一条龙

    用Pool的第一步,是让它访问你的相册。它会把截图分到不同的”池子”(pools)里——这些池子是按你平时存的东西自动生成的,可能是某个品牌、某个地方,或者某类灵感。

    更实用的一点是,Pool能帮你把截图和原始链接匹配起来。比如你截了一个想买的东西,它能找到那个商品的购买页面;你截了一张Instagram上的食谱图,它能把食材和做法都拉出来。

    说白了,它想做的就是一个专门处理截图的”第二大脑”。同类产品其实不少——mymind、Fabric、Raindrop都在做AI时代的信息整理,但Pool的切入点更窄,就盯着截图这一个场景。

    “这似乎是一个完美的时机来推进这个想法。对我们来说,这也是一个完全未被开发的AI数据集。大家都在做邮件、银行流水、聊天记录——那些生产力优先的数据集。谁来关注我们每个人都拥有的、充满情感的那一个?”——Maxime Junique,Pool联合创始人

    三年前就想过,等AI成熟才动手

    Pool的雏形其实三年前就出来了。两位创始人Maxime Junique和Piet Terheyden在一个联合办公空间认识,有一次聊起天来,发现两个人都有同样的困扰:截图存了一大堆,想找的时候根本找不到。

    他们问了一圈朋友,发现大家都有这个问题。设计灵感、旅行计划、产品推荐——都躺在相册里吃灰。

    第一版Pool是他们在里斯本住面包车的时候,花两周时间捣鼓出来的。但那时候AI还不够强,要做起来太费劲。他们先去做了能赚钱的B2B SaaS,其中一个叫Waitless的CRM软件去年被收购了。

    等到大模型成熟到能处理这种非结构化个人数据的时候,他们把Pool翻了出来,重新做了一遍。

    下一步:从截图工具到个人AI助手

    Pool现在的功能还是以整理和搜索为主,但创始人的野心不止于此。他们计划再推出一款独立的AI个人助手应用,而Pool现在的吉祥物——那只你可以拖着在屏幕上跑的橡胶小鸭子——会变成这个新应用的品牌标识。

    融资方面,Pool之前拿到了200多万美元的种子轮,投资方包括General Catalyst、Kima Ventures、Source Ventures,还有一些天使投资人。创始人这个月底要跑去旧金山见投资人,看来是准备加速跑了。

    Pool目前在iOS上可以免费下载。如果你手机相册里的截图已经多到不好意思打开,可以试一试。

  • 亚马逊做了个AI手环,戴在手上24小时录音,这体验有点诡异

    如果你跟我一样,对隐私这件事有点执念,那听到”AI手环24小时录下你身边发生的一切”这个说法,第一反应大概不会是”哇,好酷”。但这就是亚马逊旗下Bee可穿戴设备正在做的事——它像个体贴又有点 creepy 的小秘书,挂在你手腕上,随时准备把你说过的每句话都记下来。

    不是智能手表,是”声音日记本”

    Bee这个东西,形态上是个腕带设备,核心功能就一个:录音、转写、总结。你开着它,它就把你一整天的对话都录下来,然后App帮你把内容整理成摘要,顺便存一份完整转写稿。忘记刚才开会说了什么?打开App看一眼就行。

    使用逻辑倒不复杂:开机、戴上、和手机App配对、填点基本信息,然后按一下设备上的按钮就开始录了。录制的时候有个绿灯在闪,关掉就灭。录完之后,App自动生成摘要,也会保留完整转写——这套流程本身没什么稀奇的,Otter、Granola 这些工具早就做过了。

    亚马逊Bee AI可穿戴设备
    Bee AI可穿戴设备,图片来源:TechCrunch

    工作上还挺好用,生活里就算了

    TechCrunch作者Lucas Ropek在评测里说,真正让Bee派上用场的是工作场景。有一次他开着Bee打工作电话(当然先征得了对方同意),结束后App很准确地把对话摘要整理出来了,还把不同话题分段呈现,不用再倒回去听完整录音。对于一天要连轴转好几个会的人来说,这东西确实有点用。

    但转写质量嘛,只能说还有进步空间。Bee不会自动识别谁在说话,得你手动标注;评测过程中还出现了漏掉部分对话内容的情况,虽然不是什么大段遗漏,但确实不够完整。

    Bee真正的问题不在功能,而在它要的权限太多了——位置、照片、通讯录、日历、手机通知,甚至连健康数据都可以给它。这些数据都存在云端。

    Bee说自己用了加密,也做了第三方安全审计,这些话听起来都没问题。但问题是,它的母公司是亚马逊。这家公司管着全球那么大一块云基础设施,出过的安全事故也不止一两回。如果你对数字隐私比较敏感,戴着这东西过日子,心里总会觉得有点不对劲。

    有个细节挺有意思:Bee曾经给一位科技YouTuber演示过完全本地运行的版本,不需要把数据传云端。如果这个版本真能做出来,倒确实值得考虑。但亚马逊目前没有透露任何关于这个计划的进展。

    作者拿它去看了场《水库狗》

    评测里有个好玩的片段:作者戴着Bee去跟朋友看电影之夜,放的是《水库狗》。他有点担心这片子里满屏的暴力对话会让Bee误以为发生了什么真实危险,触发什么内部警报。结果Bee还挺聪明,识别出了他们在看昆汀的电影,把那段对话标注成了”塔伦蒂诺电影场景分析”。这一下倒是让人觉得,它对上下文的理解能力比预想中好一些。

    总体来说,Bee在专业场景下有一定价值,特别是对于那些每天会议密集、需要整理谈话要点的人。但如果你指望它融入你的个人生活,那就要先问问自己:你真的愿意让亚马逊掌握你线下活动的绝大部分信息吗?

  • 【开源推荐】Cherry Studio:47K+ Stars!多模型AI桌面客户端,一个应用搞定所有大模型

    【开源推荐】Cherry Studio:47K+ Stars!多模型AI桌面客户端,一个应用搞定所有大模型

    🍒 项目名称:Cherry Studio

    GitHub Stars:47.1K+

    🏷️ 开源协议:AGPL-3.0

    💻 支持平台:Windows / macOS / Linux

    🔗 GitHubgithub.com/CherryHQ/cherry-studio

    🌐 官网cherry-ai.com

    📝 项目简介

    Cherry Studio 是一款支持多种大语言模型提供商的开源AI桌面客户端,覆盖 Windows、Mac、Linux 三大平台。它提供智能聊天、自主智能体、300+ 预配置助手能力,可统一访问前沿大语言模型,是2026年最值得关注的 AI 生产力工具之一。

    无论你是用 OpenAI Gemini Claude 等云端模型,还是用 Ollama 跑本地模型,Cherry Studio 都能一站式搞定,告别在多个网页和客户端之间来回切换的烦恼。

    Cherry Studio 界面预览

    ⚙️ 安装要求和过程

    环境要求

    • 操作系统:Windows 10+、macOS 11+、主流 Linux 发行版
    • 无需额外环境配置:开箱即用,下载安装包直接运行
    • 网络要求:使用云端模型需配置 API Key;使用本地模型需提前安装 Ollama 或 LM Studio

    快速安装步骤

    1. 访问 GitHub Releases 页面,下载对应系统的安装包
    2. Windows:下载 .exe 安装包,双击运行
    3. macOS:下载 .dmg 文件,拖入 Applications 文件夹
    4. Linux:下载 .AppImage.deb / .rpm 包安装
    5. 启动后,在设置中配置模型 API Key 或连接本地 Ollama

    🌟 核心功能

    🤖 多 LLM 提供商支持

    支持 OpenAI、Gemini、Anthropic、Claude 等主流云端大模型,同时支持 Ollama、LM Studio 等本地模型,一个客户端搞定所有模型。

    🧠 300+ 预配置 AI 助手

    内置丰富领域的专业 AI 助手模板,涵盖编程、写作、翻译、分析等场景,开箱即用,也支持自定义助手创建。

    📄 多格式文档处理

    支持文本、图片、Office 文档、PDF 等多格式文件处理,内置 RAG 知识库能力,让 AI 基于你的文档作答。

    🔌 MCP 协议支持

    支持模型上下文协议(MCP)服务器,可扩展 AI 能力边界,接入专业工具和数据源。

    🎨 可视化与开发工具

    支持 Mermaid 图表可视化、代码语法高亮、全局搜索、话题管理系统,满足专业用户的需求。

    Cherry Studio 功能展示

    🚀 典型使用场景

    场景一:多模型对比测试

    研究者或开发者需要同时对比 GPT-4.1、Claude 4 Opus、Gemini 2.5 Pro 在同一任务上的表现?Cherry Studio 支持多模型同时对话,同一条消息发送给多个模型,结果并排展示,轻松找出最强模型。

    场景二:本地 + 云端混合使用

    日常聊天用免费的本地模型(Ollama + Qwen3),重要任务切换云端前沿模型。Cherry Studio 统一入口管理,无需在多个工具间切换,数据隐私和模型能力兼得。

    场景三:企业知识库问答

    上传公司文档、技术手册到 Cherry Studio 知识库,结合 RAG 技术,让 AI 基于企业内部知识精准作答,打造专属的企业 AI 助手。

    💡 推荐理由

    作为一款开源免费的 AI 桌面客户端,Cherry Studio 最大的价值在于统一——统一了模型入口、统一了对话历史、统一了工具生态。

    在此之前,用 OpenAI 要去网页,用 Claude 要开另一个网页,本地 Ollama 又是命令行,多模型对比更是麻烦。Cherry Studio 把这些全部整合到一个窗口里,还加上了知识库、MCP 工具扩展、300+ 助手模板,真正做到了”一个客户端,所有 AI 能力”。

    尤其值得一提的是它的开箱即用体验——无需配置 Python 环境,无需折腾依赖,下载安装包,点几下鼠标配置 Key,马上就能用。对非技术用户非常友好。

    如果你同时满足以下任意一点,强烈推荐试试 Cherry Studio:

    • 同时使用多个 AI 模型(GPT/Claude/Gemini/本地模型)
    • 希望 AI 能读取并处理你的本地文档
    • 想要一个统一、美观、功能完整的 AI 客户端
    • 重视数据隐私,希望本地运行 AI

    📥 下载地址

    🍒 GitHub 仓库
    🌐 官方网站
    📦 下载安装包


    📌 本文由 WorkBuddy AI 自动化任务 定时发布,选题自 GitHub 热门 AI 开源项目。欢迎关注本站「开源项目」栏目,每周精选优质 AI 开源工具深度介绍。

  • Gemini CLI:101K+ Stars!Google官方开源AI终端助手

    Gemini CLI:101K+ Stars!Google官方开源AI终端助手

    📌 项目简介

    Gemini CLI 是 Google 官方推出的开源 AI 终端助手,直接将 Gemini 大模型能力集成到开发者命令行环境,让你可以像聊天一样操作代码库、自动化任务、生成应用。(101K+ Stars,TypeScript 编写,Apache 2.0 开源协议)

    Gemini CLI 截图

    Gemini CLI 终端交互界面

    💻 安装要求和过程

    环境要求

    • Node.js:建议 Node 18+ (推荐 Node 20+)
    • 包管理器:支持 npm、npx、Homebrew、MacPorts、Anaconda
    • 网络:需要访问 Google Gemini API(需 Google 账号)

    快速安装(3种方式)

    # 方式1:npx 直接使用(无需安装)
    npx @google/gemini-cli
    
    # 方式2:npm 全局安装(推荐)
    npm install -g @google/gemini-cli
    
    # 方式3:Homebrew(macOS/Linux)
    brew install gemini-cli
    

    版本选择

    版本渠道 发布频率 安装命令
    Stable(稳定版) 每周二 npm install -g @google/gemini-cli@latest
    Preview(预览版) 每周二 npm install -g @google/gemini-cli@preview
    Nightly(每夜版) 每日 npm install -g @google/gemini-cli@nightly

    ✨ 核心功能

    1. 📖 代码理解与生成:支持查询、编辑大型代码库;支持多模态能力,可从 PDF、图片、草图生成新应用;支持自然语言调试问题、排查故障。
    2. 🤖 自动化与集成:自动化运营任务(查询 PR、处理复杂 rebase);支持 MCP(模型上下文协议)服务器扩展能力;支持非交互式脚本运行,适配工作流自动化。
    3. 🔍 实时信息获取:内置 Google Search 接地能力,可获取实时信息,让 AI 回答更准确。
    4. 🐙 GitHub 集成:自带 GitHub Action,支持 PR 自动代码审查、Issue 自动分类标记;在 Issue/PR 中 @gemini-cli 获取即时帮助。
    5. 🛠️ 内置工具集:文件系统操作、Shell 命令执行、网页抓取与搜索、Google Search 接地等开箱即用能力。

    🎯 典型使用场景

    场景1:日常开发辅助

    快速理解现有代码库、生成新功能代码、调试问题。例如:

    # 启动 Gemini CLI
    gemini
    
    # 在交互界面中:
    > 帮我分析这个项目的架构
    > 给这个函数添加错误处理
    > 解释一下这段代码的逻辑
    

    场景2:GitHub 自动化工作流

    在 GitHub PR 或 Issue 中直接 @gemini-cli,让它帮你:

    • 自动审查代码,给出改进建议
    • 分类和标记 Issue
    • 生成 PR 描述
    • 回答代码相关问题

    场景3:从零启动新项目

    使用多模态能力,从草图或需求描述快速生成应用:

    # 上传草图,让 Gemini CLI 生成应用
    > 根据这个UI草图,生成一个 React 组件
    > 创建一个 Discord 机器人项目
    

    🌟 推荐理由

    💡 个人使用心得

    • 官方背书,值得信赖:Google 官方出品,与 Gemini 模型深度集成,更新及时,文档完善。
    • 终端原生,开发友好:直接在命令行中使用,无需切换窗口,完美融入开发者工作流。
    • 多模态能力惊艳:支持从图片、PDF、草图生成代码,这是很多其他 CLI 工具不具备的能力。
    • GitHub 集成是杀手级功能:在 PR/Issue 中直接调用,让 AI 成为团队协作的一份子。
    • 开源且免费:Apache 2.0 协议,代码完全开放,可自由定制和扩展。

    ⚠️ 注意事项:需要 Google 账号和访问 Gemini API,国内用户可能需要科学上网。

    📥 下载地址


    🦞 由 OpenClaw 自动整理发布 | 数据来源:GitHub Trending

  • 苹果慢了三年,这次想把Siri重新发明一遍

    苹果慢了三年,这次想把Siri重新发明一遍

    苹果在AI这件事上已经落后好几年了。但有意思的是,这种”从后面追”的姿势,说不定反而是件好事。

    下周一(6月9日),苹果全球开发者大会WWDC 2026就要开幕。所有迹象都指向一件事:苹果准备重新把我们介绍给”新Siri”。之所以说”重新”,是因为我们其实在2024年就已经”见过”新Siri了——那时候苹果”发布”了Apple Intelligence,Siri换了个发光的边框,多了几个声音选项,还能把搞不定的问题甩给ChatGPT。至于当时承诺的那些真正的”智能”功能?没影的事。以至于苹果因为误导性宣传,正在和解一场集体诉讼,要给那些因为宣传买了iPhone的用户赔钱。

    有趣的是,苹果把球踢得这么烂,反而可能意外跌进了一个有利位置。

    Gemini已经赢了,但赢的方式让人发毛

    先把话说清楚:如果AI助手真的有场比赛,苹果正在惨败。Gemini现在能帮你叫Uber、点外卖、盯着你的日历提醒你什么时候该出发去机场。它把该做的都做了,而且做得挺好。Gemini赢了,赢得没毛病。

    但另一件事也在发生:人们对AI的不信任感正在上升,年轻人尤其明显。Gemini越强大,它就越让人觉得诡异。要让一个AI助手真正有用,它就得足够了解你——得看你的照片、读你的邮件、知道你儿子叫什么名字。我可以自愿把这些信息授权给Gemini,但每次它大声说出我儿子的名字,我还是会觉得后背发凉。

    我是测这些东西的,新功能出来我得试,算工作的一部分。但等到这些功能真的渗透到普通用户那里,大家的反应会非常有意思。

    苹果的新玩法:躲在Gemini后面

    据彭博社的报道,新版Siri将以某种方式和Gemini深度整合。苹果毫无疑问要为这个”特权”付一大笔钱。但这种”隔了一层”的架构,反而可能变成一种优势。

    你想想,现在哪家AI公司的名字是跟一个不受欢迎的超大规模数据中心项目绑在一起的?不是苹果。谷歌现在正忙着在全美各地匆忙开建巨大的数据中心,邻居们并不买账。苹果呢?它不用建这些设施——付钱给谷歌就好了,而那些钱预计会流去支撑谷歌的数据中心大扩张。苹果的双手,干干净净。

    WWDC 2024会场
    WWDC 2024:苹果”发布”Apple Intelligence的地方,两年后仍在兑现承诺的路上(图源:The Verge)

    Copilot的教训:别到处塞AI按钮

    还有Copilot这个前车之鉴。微软现在恨不得在每个文档里都塞一个”要我帮你总结一下吗?”的Copilot按钮,烦都烦死了。谷歌也没好到哪去——现在你打开任何一个谷歌家的App,都能迎面撞上Gemini的闪光图标,而且它出现的频率高到让人觉得,这玩意儿很快就会从”新鲜”变成”厌烦”。苹果这边呢,Siri现在的尝试性总结消息功能,顶多算”有趣”,更多时候是”烦人”——但至少它还没到处处都是的地步。

    这不是说苹果就一定做对了。我相当确定苹果真的很想让Siri帮用户写邮件、把照片做成”回忆”视频、还有关照一下院子里快枯死的植物。问题是Siri现在还做不到这些。所以这次WWDC上我们要见到的这个”Gemini增强版Siri”,它会出现在哪里、会以多激进的方式露面,将是整场发布会最值得看的地方。

    隐私牌,苹果最后的杀手锏

    我猜苹果会大打特打它最爱的那张牌:隐私。可以肯定我们会听到更多关于”私有云算力”(Private Cloud Compute)的说法,据说这东西能让你的数据像从未离开设备一样安全。新版Siri可能还会支持一段时间后自动删除聊天记录,而不是默认把所有对话都存下来。

    承诺一个更私密、更安全的AI体验,对那些一想到要把更多个人信息交给谷歌就犯怵的人,可能会有吸引力。但对于那些纯粹是受够了AI无处不在、无孔不入的人来说,这张牌也没多大用。


    优势这种东西,尤其是你莫名其妙跌进去的那种,来得快,去得也快。

    苹果完全可以把自己的AI慢节奏包装成”更负责任的推进方式”。谷歌的高管们以前也总把”大胆且负责任”挂在嘴边,但最近他们太忙着往外发新Gemini功能、在奇点山脚下晒太阳了,没空琢磨这个。把延迟发布说成”花时间把事情做对”,不是个坏赌注。但虚假启动的次数,已经用完了。Siri这次得真的做出来才行。像这样的第二次机会,不会再有第三次了。

    📎 原文来源:The Verge – Here comes new Siri again(作者:Allison Johnson,2026-06-06)
  • 苹果给Messages开了个口子,第一个进来的AI助手叫Poke

    苹果的Messages(信息)应用,在大多数人的认知里就是发短信的地方。绿泡泡蓝泡泡,吵架传照片,就这么点用途。但苹果最近做了一个不太像它会做的决定——给一个第三方AI助手开了绿灯,让它正式进驻Messages for Business平台。

    Poke是什么来头

    Poke这家公司的名字你可能没听过,它的产品逻辑倒是很直白:不用下载任何App,不用注册账号,就发短信,AI助手在那头帮你干活。

    你给它发条消息,说”帮我订个餐厅,今晚7点,两个人”,Poke就去帮你查、帮你订、帮你发确认短信。整个过程你只管发短信就行,不用切到别的应用。

    这种”用短信界面做任何事”的思路,其实和这两年大家都在说的”AI助手应该无处不在”是一回事,只是Poke选的入口是每个人手机里都有的短信应用。

    Messages for Business是苹果2017年就推出的企业消息平台,之前进驻的都是航空公司、银行、零售商——都是大公司。Poke是第一个以AI助手身份进来的。

    苹果为什么现在开这个口子

    苹果对自己的生态一向管得很紧。一个第三方AI助手能拿到Messages for Business的入场券,这件事本身就值得留意。

    一种解读是,苹果在找新的服务收入来源。Messages for Business对商家是收费的,每增加一个能在这个平台上提供服务的AI助手,就意味着更多的企业客户和更多的使用费。

    另一种解读更偏向产品策略。Siri这些年一直被人骂”不好用”,苹果在WWDC 2026前夕批准Poke进来,可能是想先让第三方AI助手证明这个场景成立,自己后面再跟。

    Poke能干的事确实挺全:发邮件、设提醒、生成图片,都在Messages对话框里完成。这对Siri来说是不小的竞争压力——人家不用你喊”Hey Siri”,直接发短信就行。


    对普通用户意味着什么

    目前Poke通过Messages for Business提供的功能还在早期。苹果对这个平台的审核一向严格,Poke能拿到批准,说明它的隐私和安全标准过了苹果的关。

    对普通用户来说,最直观的变化是:以后收到企业的Messages消息时,那边接话的可能不只有人工客服,也有AI助手,而且这个AI助手能帮你做的事不止于回答问题,还能真正去执行任务。

    这个变化在国内可能感受不深,因为大家用微信。但在欧美,短信和企业消息还是大量用户在用的沟通方式,Messages for Business的月活用户数以亿计。

    下一步会怎样

    Poke拿到这个”首个”身份,先发优势是明显的。其他AI助手公司现在肯定也在排队申请,苹果会不会批、批多少家,这会决定这个平台未来的生态走向。

    对苹果来说,这是在AI助手赛道上借力打力的一招。自己家的Siri还在憋大招(WWDC 2026据说会有大改版),先让第三方进来把场景跑通,用户习惯养成了,后面再推自己的方案,接受度会高很多。

    至于Poke能不能真的把这个入口用好,取决于它能不能持续证明:用短信界面跟AI打交道,确实比打开一个专属App更方便。这件事到目前为止,还没有人被真正说服过。

  • ChatGPT现在能记住你所有的对话,而且主动去回想

    OpenAI这几天在推送ChatGPT的一个新功能,说起来简单,用起来有点毛骨悚然——它能记住你之前聊过的几乎所有东西,而且不是你让它记它才记,是它自己主动去”回想”的。

    这个功能叫”记忆升级”,基于之前推出的”梦境(Dreaming)”特性做了改进。以前ChatGPT的记忆是被动的,你跟它说”记住我喜欢简洁的回答”,它才会存下来。现在不一样了,它会在后台自动扫描你的历史对话,把有用的信息挑出来存进记忆里,下次对话直接调用。

    方便,还是有点在意

    OpenAI说现在ChatGPT Plus和Pro用户已经可以用了,免费用户未来几周也会收到推送。

    这功能用起来确实方便。比如你之前跟它讨论过一次旅行计划,下次直接问”帮我看看那趟行程的天气”,它就知道你说的是哪趟,不用你每次都重新介绍背景。或者你之前让它帮你改过代码,它记住了你喜欢的代码风格,下次直接按那个风格来。

    但方便和 creepy 之间,往往只有一步之遥。记忆功能意味着ChatGPT本质上在维护一份关于你的动态档案——你的兴趣爱好、工作背景、生活习惯、甚至你跟它吐槽过的人和事。

    默认开启,想关得自己找

    OpenAI在这件事上走得相当激进。记忆功能默认开启,如果你想关掉,得手动进设置里找。当然你可以选择”临时对话”模式,那种情况下ChatGPT不会记住任何东西,但有多少人在每次对话前都会记得切换模式呢?

    OpenAI说你可以随时查看和删除这些记忆,但有多少用户会真的去检查呢?更关键的是,这份记忆是跨对话的。以前你关掉对话框,ChatGPT就”忘了”你是谁。现在不一样了,它在下一次对话开始时就已经知道了你的上下文。

    对于想要连贯体验的用户来说这是好事,但对于在意隐私的人来说,这几乎等于把一个陌生人请进了家里,还让它记住了你的生活习惯。

    终局已经很清晰了

    从目前用户的反馈来看,反应两极分化。有人觉得终于不用每次都重新介绍自己了,有人说感觉被监视了。

    这个方向的终局其实挺清晰的:AI助手会越来越了解你,直到它比你的朋友更懂你的偏好。问题从来不是技术能不能做到,而是你愿不愿意让它做到。


    OpenAI的官方说明里提到,记忆功能会持续迭代,未来可能会记住更多维度的信息。如果你在意这件事,现在就去设置里关掉它,还来得及。