标签: AI助手

  • ChatGPT语音终于学会闭嘴:OpenAI GPT-Live全双工上线

    ChatGPT语音模式升级示意
    OpenAI 用 GPT-Live 重写 ChatGPT 语音模式,让它学会”边听边说”(图:The Verge)

    用过 ChatGPT 语音模式的朋友大概都经历过这种尴尬:你话才说到一半,正组织下一句,AI 突然插进来”好的,我理解你的意思是……”,而你后面那半句它压根没听见。这不是你表达有问题,是旧版语音模型的底层架构决定的——它只能等你彻底闭嘴,才轮到它开口。

    7 月 8 日,OpenAI 给这个问题从根上动了刀。新发布的 GPT-Live-1 和 GPT-Live-1 mini 两款语音模型,第一次在 ChatGPT 里实现了”全双工”:它能一边听你说话,一边组织自己的回答,你随时可以打断、插话、改口,它都接得住。

    “它终于学会闭嘴了”

    The Verge 给这篇报道起的标题特别传神——”ChatGPT 升级后的语音模式更擅长闭嘴了”。OpenAI 产品负责人 Atty Eleti 在发布会上解释:”这是一个全双工模型,意味着它可以同时说话和听。从模型侧看,它能持续、同时地处理输入流、产出输出流。”

    OpenAI 研究负责人 Kundan Kumar 把 GPT-Live-1 称为公司”迄今最聪明的语音模型”。它会在需要推理或联网搜索时,自动把你的请求转交给 GPT-5.5 这类最强文本模型,再回头把结论用说话的方式讲给你听。

    换句话说,以前语音助手是”听写—理解—朗读”三段流水线,现在声音本身就是输入也是输出,延迟从秒级压到了毫秒级,对话节奏终于像人跟人聊天了。

    几个真实用得上的新花样

    全双工带来的不只是”不打断你”这么简单,还顺手解锁了几个挺实用的能力:

    • 实时翻译:你还在说中文,它已经同步翻成英文,不用等你停下
    • “听口令再开口”:你可以让它先闭嘴,等你喊它才接话
    • 会”嗯、对、收到”:它用这些词告诉你”我在听”,对话更自然
    • 聊天气、股票、赛事时,会顺手生成对应的图片辅助说明

    OpenAI 说,新版语音模式就是为了让人能”更长时间地 Hands-free 聊天”。产品负责人 Eleti 自己就说,他散步时跟语音助手聊过 30 到 40 分钟。看得出来,OpenAI 想让 ChatGPT 从一个”要打字的工具”,变成一个”能一直挂着的对话入口”。


    不是 AI 伴侣,也还有翻车的时候

    OpenAI 特意划了一条线:GPT-Live 不是要做”AI 伴侣”,不打算跟你谈情说爱。它内置了 safeguards,对青少年给年龄合适的回答,聊到自伤这类话题会转接专业危机热线。毕竟 OpenAI 正背着一串”ChatGPT 诱发妄想、伤害用户心理健康”的官司,安全这块不敢马虎。

    不过 demo 也不是完美。展示印地语实时翻译时,助手带着一股浓重的美式口音,印地语说得生硬又书卷气。OpenAI 承认新模型针对”大多数主流语言”做了优化,但没说清到底是哪些。这也是全双工语音要真正好用,还得跨过的一道坎。

    谁能先用上

    GPT-Live-1 已经推到 iOS、安卓和网页端。Go、Plus、Pro 订阅用户默认用更大的 GPT-Live-1,免费用户则是轻量版的 GPT-Live-1 mini。苹果和亚马逊也在把自家的语音助手往”更会接话、更懂上下文”的方向改,Sesame 这类创业公司也在做类似的事。语音这条赛道,下半年只会更挤。

    对普通用户来说,最直观的变化可能就是:以后跟 ChatGPT 打电话,它终于不会在你喘气的功夫抢话了。

  • ChatGPT这次把嗓子和耳朵焊一起了:GPT-Live-1学会边听边插嘴

    OpenAI 这周二给 ChatGPT 换了一套全新的语音内核。新模型叫 GPT-Live-1 和 GPT-Live-1 mini,听着像普通版本号更新,其实改的是最底层的交互逻辑——它第一次让 AI 在跟你说话的时候,也能同时听你说话。

    以前是“你一句我一句”,现在能直接打断

    老版本的高级语音模式本质上是三段流水线:先把你的话转成文字,再丢给大模型想答案,最后用语音合成念出来。这种方式有个老毛病,你话还没说完它就可能抢答,中间停顿一下它又以为你说完了。GPT-Live-1 把这三段压成了一个“语音到语音”的统一模型,声音本身就是输入输出,不用再绕一圈文字。最直观的变化是,你可以在它说话时直接插一句“等一下我说的不是这个”,它能接住你的打断,顺着上下文继续。

    它把“聪明”和“说话”分开了

    OpenAI 在简报里说,新模型遇到要查资料、要推理、要调工具的活儿,会把任务甩给后台的 GPT-5.5,自己只管把对话顺畅地接下去。换句话说,语音层负责“像人一样聊”,脑子层负责“想明白”。产品负责人 Atty Eleti 说他自己遛弯时跟语音助手聊过三四十分钟,模型还能安静地听很久、把上下文攒着等被叫到。

    “我们觉得,语音慢慢会变成人们操作电脑的一种主要入口,甚至是处理那些又长又复杂的智能体任务的方式。”——ChatGPT Voice 负责人 Atty Eleti

    不是来当陪聊的

    虽然话术上强调“更自然”,但 OpenAI 反复划清界限:这不是要做一个 AI 伴侣。模型里内置了针对青少年的适龄回应,以及遇到自残这类话题时给资源引导的护栏。它也顺手支持实时翻译、用视觉卡片甩出天气和股票——代价是,目前优化的是“大多数口语”,具体哪些语言并没列清楚。

    对手们也没闲着

    苹果和亚马逊都在把自家助手往“更会聊”的方向改,Oculus 联合创始人搞的 Sesame 也上线了能边干活边聊天的助手。有意思的是,OpenAI 自己放风说今年可能出一副带 AI 的无线耳机——把语音做成主入口,硬件才是真正的落点。

    • 全双工架构:说话和聆听同步进行,支持中途打断与插话
    • 免费用户默认用 GPT-Live-1 mini,付费档可切到更大的 GPT-Live-1
    • 复杂任务转交后台 GPT-5.5,语音层只负责把对话接顺
    OpenAI GPT-Live-1 全双工语音模型概念图
    GPT-Live-1 让 ChatGPT 的语音交互从“轮流发言”走向“自然对话”

    当然,演示里也露了怯。现场秀印地语实时翻译时,助手带着一股浓重的美式口音,腔调还有点书呆子气。这说明“全双工”的架子搭起来了,但离哪种语言都顺溜还有距离。

  • OpenAI放出GPT-5.6,顺手把Codex做成了人人可用的办公搭子

    OpenAI GPT-5.6 与 ChatGPT Work 概念图
    OpenAI GPT-5.6 与全新的 ChatGPT Work 智能体(配图)

    两周前,GPT-5.6 其实已经”发布”过一次,但那时候普通用户根本摸不到。6 月 26 日那波上线,只向大约 20 家提前报备过的机构开放——因为特朗普 6 月 2 日签的行政令要求,AI 公司在全面公开前沿模型之前,得先把模型交给政府做能力评估。这等于 OpenAI 自己定的发布日,被外部按了暂停键。

    等了两周,才拿到放行条

    美国商务部下属的 AI 标准与创新中心把模型审了两周,7 月 8 日放行,GPT-5.6 这才算真正面向所有人开放。Sam Altman 在 X 上给它的评价是”我们做过的最强模型”。系统卡片里写得挺坦率:Sol 在网络安全、生物这两个领域能找出漏洞和攻击的”零件”,但在测试条件下没能自己拼出一条完整的攻击链。这也解释了为什么管控会下沉到产品层——部分 API 调用可能被拦截,甚至在生成到一半时被暂停,交给安全系统复核。

    ChatGPT Work:把 Codex 塞给普通人

    OpenAI 挑在同一天抛出了另一个东西:ChatGPT Work。简单说,它是把 ChatGPT 和 Codex 揉到了一块儿。Codex 本来是给写代码的人用的,现在 OpenAI 想让不懂编程的普通人也能用它干非编程的活——从你指定的 App、文件和工作流里收集上下文,直接产出文档、表格、演示文稿,甚至网页应用。

    OpenAI 在博客里说,ChatGPT Work 能从你选择的工具里收集上下文,产出文档、表格、演示文稿和网页应用;一个”统一插件目录”让它能连上 Slack、Gmail、Google Drive、日历和各类 CRM。

    说白了,它不再只是一个聊天框,而是想坐到你工作流的正中央。落地范围也够大方:Mac 和 Windows 的桌面端,连免费用户都能立刻用上;手机和网页端先给 Pro、Enterprise、Edu 这几个档位,Plus 和 Business 会在接下来几天陆续放开。OpenAI 的说法是,全球已经开始推送,24 小时内基本铺满。

    一家人,三种打法

    GPT-5.6 不是单个模型,而是一家人。Sol 是旗舰,主打智能和效能;Terra 是均衡的日常工作模型;Luna 走性价比路线,便宜又快。OpenAI 还加了一个 Ultra 模式,默认让四个智能体并行干活,对付复杂任务。

    • Sol 在一项智能体”考试”里比 Anthropic 的 Fable 5 高了 13 分,而且用的 token 更少。
    • Terra 和 Luna 在某些评测里,用大约十六分之一的成本就能打平 Fable 5。
    • 这一家人背后就一个信号:模型不光要比谁聪明,还要比谁便宜。

    顺便给微软递了颗定心丸

    OpenAI 说 GPT-5.6 会成为 Microsoft Copilot 的”首选模型”。这话多少有点针对性:这周彭博刚报道微软为了省钱,开始更多依赖自家 MAI 模型,外界一度猜测两家要闹掰。OpenAI 这波等于公开把”我们还是好搭档”写在脸上,也顺手压了压”分家”的传闻。


    把最近几件事连起来看挺有意思:Codex 并进了 ChatGPT,Atlas 浏览器退场,能力改由 Chrome 扩展承接。模型在 API 里打价格战,产品在桌面上抢入口——OpenAI 的意图很直白,就是想让你电脑上那个”替你干活的东西”只叫一个名字。聊天框时代的 ChatGPT 是个浏览器标签页,智能体时代的 ChatGPT,想变成你电脑里常驻的那一层。

  • Anthropic给Claude加了块「使用报告」,这盘算计比你想的深

    最近AI被骂得挺凶,数据中心抗议、 backlash新闻一个接一个。就在这当口,Anthropic给Claude悄悄推出一个叫Reflect的新功能。表面看,它就是个使用仪表盘——把你跟Claude聊过什么、用AI的习惯、常求助的任务类型,全给可视化出来。

    但这块仪表盘真正想做的事,是悄悄改变你怎么看待AI这件事。它把Claude摆成一个”你天天在用的生产力工具”,一种已经嵌进你工作流里的东西,顺带还把它包装成一项你可以”有觉知地”去用的技术。

    它不只是给你看数据

    Reflect不会真的算你靠AI省了多少时间,但把Claude帮过的活儿一件件摊在你面前,那种感觉会让你越来越把Claude当成离不开的日常。Anthropic还说,Reflect会时不时蹦个问题出来,比如”有什么事,哪怕Claude能更快做完,你也想自己动手?”——这其实是在引导你,怎么”更有意识”地跟AI相处。

    连”防沉迷”都安排上了

    挺有意思的是,这个原本为了让人多用AI的功能,顺手还给了你设置”安静时段”、提醒你该歇会儿的选项。毕竟聊天机器人永远秒回、还主动接话,这种黏性谁用谁知道。Anthropic大概也清楚,得做点姿态出来。

    Claude Reflect AI使用习惯仪表盘概念图
    Claude Reflect把你的AI使用习惯摊在面前,潜移默化地强化依赖

    早在2012年,Google就推过Gmail Meter,把你邮箱的使用数据做成饼图。当年那玩意儿主要是让技术宅自嗨,但也顺带用数字证明了一件事:Gmail已经成了你数字生活的中心。Reflect干的是同一件事,只是往前多走了一步——它还会教你,怎么把AI用得更好。

    隐私怎么说

    Anthropic说,比较敏感的对话也可能出现在Reflect里,但只会以”高层面”呈现;连着健康类整合工具的对话,则完全不进统计。而且这些洞察数据不会被拿去干别的事。


    Reflect目前向开启了记忆功能的Free、Pro、Max用户开放beta,之后还会加上”你到底在Claude上花了多少时间”的视图。一块使用报告而已,但Anthropic打的算盘,显然不止是让你多看一眼。

  • Notion 砍了邮箱 App,转头做了个「Agents」:把 ChatGPT、Gemini、Claude 全塞进一个聊天框

    Notion Agents iPhone 应用界面示意图
    Notion Agents 把 ChatGPT、Gemini、Claude 收编进一个聊天框(配图由 AI 生成)

    Notion 这公司最近有点”拆东墙补西墙”的意思。上个月它刚宣布砍掉做了刚好一年的邮箱 App Notion Mail;这个月,它就端出了一个全新的 iPhone 应用,叫 Agents。

    它不是另一个笔记 App

    7 月 7 日上线的 Notion Agents,和它家那个主力的笔记 App 不是一回事。它不让你写文档,而是专门用来”聊”——跟你自己的 AI 代理聊,也跟接进来的大模型聊。目前支持三个:Anthropic 的 Claude、Google 的 Gemini,还有 OpenAI 的 GPT。换句话说,Notion 自己不下场做模型,而是做了个”代理集散中心”,把别人的模型都接进来。

    用法上挺直白。你可以在里面问代理问题,也可以随手记点东西:打一段文字、录一段语音、拍张照片,代理会自己判断这些内容该归到哪。它连着你真实的 Notion 工作区和你那一整套工具栈,所以回答不是凭空编的,而是从你自己的文档和数据里长出来的。

    Notion 主 App 是个”仓库”,你把东西存进去;Agents 是个”前台”,你动动嘴,它去仓库里翻、去帮你办。

    砍邮箱、做代理,Notion 在赌什么

    把 Notion Mail 的退场和 Agents 的登场放一起看,逻辑就清楚了。做邮箱那一年,Notion 想的是”AI 帮我处理收件箱”;现在它发现,比起替你盯邮件,更值钱的是做一个”你随时能调度的代理中枢”。邮箱是入口之一,但不是非争不可的入口;而”代理能连你的全部工作”这个位置,谁占住谁就掌握主动。

    • “懂你的工作”:接的是你真实的文档和工具,不是凭空编的答案
    • “即时捕捉任何东西”:文字、照片、语音,代理自己决定放哪
    • 能直接干活:建页面、起草周报、跨工具搜东西,全在一个聊天框里

    当然,Agents 现在还是个 iPhone 专属应用(iPad 和 Mac 上能勉强跑,但没专门适配)。对于一个主打”随时随地处理工作”的工具来说,桌面端的缺位有点尴尬。而且它本质上是个聚合层——模型能力好不好,最终还是 Claude、Gemini、GPT 说了算。

    Notion 的护城河,在于它握着你的文档、数据库和项目,也就是”上下文”。代理再聪明,没有你的真实数据也是空转。所以这事挺典型的:大厂做 AI,拼到最后往往不是谁模型最强,而是谁最贴近你的真实工作流。Notion 把赌注压在”上下文”上,砍掉边缘业务、All in 代理,这一步走得够干脆。


  • 亚马逊秘密项目Moonraker曝光:要让Alexa真正像个能办事的Agent

    亚马逊 Alexa AI 代理概念图
    亚马逊秘密项目 Moonraker 旨在让 Alexa 升级为 AI 代理(概念图)

    Amazon 的 Alexa 一直被吐槽”听懂了但办不成事”。最近 Business Insider 翻出一批内部规划文件,曝光了一个此前没对外说过的项目,代号”Moonraker”——亚马逊想让 Alexa 从一个”问答机”变成能一口气跑完多个动作的 AI 代理。

    从”一句话”到”一串动作”

    现在的 Alexa+ 已经能帮用户叫车、买票,不过得靠 Uber、Ticketmaster 这些合作伙伴接好接口,本质上还是”你说一句、它办一件”。Moonraker 要做的,是让一次请求触发一连串操作。文件里举了个例子:”帮我叫辆车,再给我朋友发条消息”——以前 Alexa 大概率会卡在第二步,现在它要自己把这两件事都办了。

    这个方向一点都不新鲜,Google、OpenAI、Anthropic 早就推出了能自己上网、跑多步流程的 agent 产品。亚马逊只是终于坐不住,要把 Alexa 也推进这条赛道。

    代价是真贵

    但让 Alexa 变聪明,烧钱也烧得吓人。内部文件直接把 Moonraker 标成 Alexa+ 这轮升级里”成本最高”的新项目,预计 2026 年光 GPU 费用就要超过 1 亿美元。有文件甚至建议,要么推迟、要么缩水,给成本压力降降温。

    一些亚马逊高管觉得,团队在喂 Alexa 的 AI 模型上花超了,运行这些模型的费用已经成了内部越来越大的心病。这其实不是亚马逊一家的问题——整个硅谷都在经历一场”token 账单”的清醒:当先进 AI 真正铺开,账怎么算都肉疼。

    Alexa 的”成长的烦恼”

    翻翻 Alexa+ 的履历,麻烦一直没断过。助手在美国的铺开被推迟了好几回,年初才扩大可用范围;内部 beta 测试的时候还曝出幻觉、答非所问的问题,有个员工的 Alexa 误把鱼缸过滤器关了,鱼当场没了。CEO 贾西在最新的股东信里倒是很乐观,说大家跟 Alexa+ 聊天翻了一倍、下单频次是以前的三倍,但也没忘补一句:”Alexa 离成为全世界最好的个人助理,还早得很。”

    为了撑起 Moonraker,亚马逊去年底就备好了几百张英伟达 GPU,测试时还用了 Anthropic 的 Sonnet 模型做高级推理和视觉回应。不过面对 BI 的提问,亚马逊选择了不置评。


    说到底,Moonraker 是亚马逊给 Alexa 的一场豪赌:它想让语音助手真正”办成事”,而不只是”聊聊天”。只是这门生意的账,目前怎么看都不便宜。

  • OpenAI放出新语音模型:能随时打断、还能实时翻译,但口音有点出戏

    AI语音助手与声波动画
    GPT-Live-1 让 ChatGPT 的语音对话更接近真人

    OpenAI 今天把 ChatGPT 的「嘴」和「耳朵」换了一套新引擎。新模型叫 GPT-Live-1,还有个轻量版 GPT-Live-1 mini,官方说法是听起来更自然,也更会把握说话的节奏,不会再动不动就抢你的话。

    这次升级最关键的一点,是它变成了「全双工」模型——也就是能边听边说。你可以随时插话打断它,它也能在你说的时候默默听着,而不是像老版那样非得等你彻底说完、停顿一下才开口。实时翻译这种场景,靠的也是这个能力。

    从「三件套」到「一根线」

    之前的语音模式其实是拼起来的:先靠语音转文字把你说的话写成字,再丢给大模型想答案,最后用文字转语音念出来。环节一多,就容易出岔子——要么在你说话时突然打断,要么脑子跟不上、答非所问。

    新模型把这条链路收拢了。OpenAI 说,它会把你的提问交给最新的文字模型(比如 GPT-5.5)去做搜索、推理或者调度 Agent,同时语音对话还在继续,不用停下来等。它甚至能憋着不说话,安静听你讲上一长段,把上下文都接住,等被叫到才接话。

    我们觉得长远来看,语音会成为操作电脑的一种主要方式,也能用来打理那些越来越复杂、跑得很长的 Agent 任务。

    上面这句话出自 ChatGPT Voice 的产品负责人 Atty Eleti。他透露,自己散步时跟语音功能聊过三四十分钟。OpenAI 有意把语音往「能扛长时间复杂工作」的方向推,外界也一直传它今年可能出一副带 AI 的耳机,不过这次公司没提任何硬件。

    不是伴侣,但还在打磨

    默认情况下,免费用户会拿到 mini 版,付费档才能用上更大的 GPT-Live-1,它会逐步替换掉现在的 Advanced Voice Mode。OpenAI 强调,他们并不想把它做成「AI 陪伴」,而是加了护栏:对青少年给适龄的回应,聊到自残这类话题会提供求助资源。

    竞争对手也没闲着。苹果和亚马逊都在把自家的助手改得更会接话、更懂上下文;由 Oculus 联合创始人创办的 Sesame,也在做能边聊边在后台干活的助手。OpenAI 的方向和大家一致:让你能 hands-free 地跟助手聊更久。


    演示翻车的一幕,也值得记住

    新模型当然还有毛糙的地方。现场演示印地语实时翻译时,助手一口浓重的美式口音,说出来的印地语生硬又书面,听起来很出戏。OpenAI 说新模型是针对「大多数常用语言」优化的,但究竟覆盖哪些,它没细说。

    • 全双工 + 随时打断,是这次最实在的进步,聊天不再像在跟自动语音菜单较劲。
    • 接上 GPT-5.5 之后,语音能干的活明显变多,甚至能顺手给你看张图。
    • 口音和少数语言仍是短板,离「全世界都能自然聊」还早。

    OpenAI 透露,现在每个月有超过 1.5 亿人用语音或听写跟 ChatGPT 说话。从「能对话」走到「聊得像个真人在旁边」,GPT-Live-1 算是往前迈了一大步——只是这一步迈得还不够稳,尤其是当你说的不是英语的时候。

    📎 原文来源:OpenAI releases new voice models for more natural live conversations(TechCrunch / Ivan Mehta)
  • 这家「不审查」的AI公司刚拿了6500万美元,估值冲上10亿美元

    这家「不审查」的AI公司刚拿了6500万美元,估值冲上10亿美元

    大多数人用AI聊天机器人时,心里最打鼓的事情是什么?不是AI不够聪明,而是担心自己的对话被记录、被审查,甚至哪天因为问了个「不合适」的问题就把账号给封了。

    这家「不审查」的AI公司刚拿了6500万美元,估值冲上10亿美元
    图片来源:TechCrunch / 网络

    一家叫 Venice AI 的创业公司正是看准了这个痛点。它的卖点很简单:不审查、不记录、让你随便用。结果用户真的买账——这家公司才成立两年,刚刚完成了6500万美元的A轮融资,估值冲上10亿美元,正式跻身独角兽行列。

    两个月300万活跃用户,自己就盈利了

    Venice AI的平台上有超过200个AI模型,既有所谓的「无审查」开源模型,也接入了OpenAI和Anthropic的闭源模型。区别在于:Venice把所有用户输入都加密处理,数据不经过自己的服务器存储,直接从技术层面做到了「无记录」。部分模型还支持端到端加密,不过这个功能要付费订阅才能用。

    用户数增长确实猛。上线才两年,网站独立访客已经超过85万,月活用户破300万,每天平均处理170万次API调用。更夸张的是,公司已经盈利了——CEO Erik Voorhees在接受TechCrunch专访时透露,公司年化营收运行率已经超过7000万美元。

    两年时间,从零到盈利,再到估值10亿美元。在当下AI创业公司普遍还在烧钱的阶段,这个成绩确实让人眼前一亮。

    CEO是比特币老炮,曾因「不核实用户身份」被华尔街日报点名

    Erik Voorhees这个人本身就很有故事。他是早期比特币的倡导者,之前创办过比特币赌博网站Satoshi Dice,还创办过加密货币交易所ShapeShift。这个人一直有个立场:用户隐私权优先于一切。

    当年华尔街日报调查ShapeShift(这家交易最初不要求用户实名),指责它处理了数百万美元的可疑资金,Voorhees的回应是:「我不认为人们需要被记录身份才能使用服务,只是为了抓住极少数犯罪分子。」

    这次面对「AI psychosis」(AI导致用户精神问题)的争议,他的逻辑是一样的:Venice AI是一个中性平台,就像比特币这个中性协议一样,对所有人都一视同仁。他认为,比起AI说了什么「坏话」,让所有人被持续监视才是更危险的事情。

    还发了两个加密货币,但只有8%用户用币支付

    既然CEO是加密老炮,Venice AI搞两个代币出来也就不奇怪了。今年1月,公司推出了VVV代币;去年8月又加了DIEM代币。用户的玩法是:买VVV,质押它来挖DIEM,DIEM每天产生价值1美元的AI积分,可以在平台上消费。

    不过说实话,这套加密玩法对大众用户来说门槛还是太高。Voorhees自己也说,目前只有约8%的用户用加密货币支付。真正驱动用户增长的,还是「隐私」和「无审查」这两个核心卖点。

    Voorhees说,公司刚上线的时候,功能和ChatGPT差得很远,用户愿意用纯粹是因为隐私保护。但到现在,功能差距已经大幅缩小,「它已经成为一个越来越有竞争力的ChatGPT替代品」。


    新钱用来买GPU,要把命脉握在自己手里

    这一轮融资的钱,Venice AI打算用来买GPU、建自己的数据中心。目前公司还是租赁GPU,毛利率受压制。把计算基础设施握在自己手里之后,毛利空间会好看很多。

    投资方阵容也很有意思——领投方Dragonfly是一家专注加密领域的风投,跟投的还有Coinbase Ventures、North Island Ventures等。看得出来,Venice AI在加密圈里已经攒了不少人气。

    但「无审查」这条路能走多远,还是个问号。随着各国对AI监管的收紧,像Venice AI这样明确主打「不审查」的平台,迟早要面临监管压力。Voorhees的态度很明确:他宁愿承担这个风险,也不愿意做一个「替用户做决定」的平台。

    值不值得押注是一回事,但至少现在,愿意为隐私买单的用户确实足够多,多到能把这家公司推到独角兽的位子上。

  • 把 AI 智能体塞进手机键盘,这家新加坡创业公司拿到了 530 万美元

    Acti AI 智能体键盘
    Acti 将 AI 智能体直接嵌入手机键盘界面

    你每天在手机上最频繁用的界面是什么?不是某个 App,而是键盘。打字、发消息、搜索、写邮件——几乎所有操作都从键盘开始。

    新加坡创业公司 Acti 想把这个最基础的入口变成 AI 智能体的主场。他们这几天正式推出了一款”AI 智能体键盘”,有 iOS 和 Android 两个版本。不是那种帮你自动补全下一个词的传统输入法,而是能直接替你执行操作的 AI 工具。

    创始人来自百度

    创始人 Young Wang 此前在百度待了十年,把 Facemoji 键盘做到了 3 亿日活。他的判断是:大模型出现之后,文字不再只是用来”输入”的东西,它变成了”意图”的载体——而你打的每一个字,理论上都可以直接触发一个动作。

    Wang 说:”现在的 AI 智能体从根本上受限,因为用户的上下文分散在各个独立的应用里。Acti 坐在所有应用的上方,这让我们能建立一个真正属于用户——而不是某个平台——的上下文层。”

    Skills 是核心

    Acti 键盘的核心卖点叫”Skills”——可以理解为自定义快捷键。用户在键盘上划一个字母,就能触发一个多步骤任务。比如长按”T”翻译整段消息,按”C”立刻发出一个会议链接。不需要写代码,用自然语言描述想要什么效果,Acti 就能帮你建好这个 Skill。

    这些 Skills 可以私用,也可以发布到 Acti 的”Skill Hub”市场里让别人用。内测期间,用户在不到两周时间里建了超过 1000 个 Skills。

    隐私怎么算

    把 AI 放在键盘这个位置,隐私问题肯定躲不掉。Acti 的说法是”本地优先”——用户的个人上下文默认存在设备上,除非用户主动触发需要云端处理的功能,否则不会把消息内容传出去。

    技术上,Acti 用的是 Google 的 Gemini 模型。Wang 说选 Gemini 是因为它在智能程度、速度、可靠性和多语言表现之间找了个不错的平衡点。


    刚拿了 530 万美元

    Acti 刚刚完成了一轮 530 万美元的种子融资,由 BITKRAFT Ventures 领投。团队阵容不算弱——CTO Mike Sun 之前是百度云相册平台 Yike Album 的创始技术负责人,CSO Junbo Yang 之前在 HashKey Capital 主导消费类投资。

    商业模式还在摸索中,但大致方向是订阅制——免费用户能用基础模型,付费用户能用到更高级的模型、更多的每日调用次数。

    键盘这个赛道已经很久没有大变动了。Acti 想借 AI 的机会重新定义这个最基础的界面——这事能不能成,取决于用户愿不愿意让 AI 在他们的键盘里”常驻”。

  • OpenClaw 终于出了手机版,这下真能在口袋里跑 AI 智能体了

    OpenClaw 终于出了手机版,这下真能在口袋里跑 AI 智能体了

    今年早些时候在网上火了一阵的那个开源 AI 智能体 OpenClaw,这几天悄悄上架了 iOS 和 Android 应用。之前想用只能跑在电脑上,现在手机也能用了。

    OpenClaw 移动应用
    OpenClaw 现在有了官方移动应用

    用起来倒不复杂。手机装上应用之后,跟 OpenClaw Gateway 配对——这东西相当于一个路由层,把你手机上的请求转给后端的 AI 智能体和各种工具。配对好了,你就能在手机上直接跑之前在电脑上配置好的那些智能体了。

    OpenClaw 的用户已经把它玩出了花:写代码、规划餐食,甚至别的一些奇怪用法都有人试过。当然,翻车的人也不少,有人吐槽说结果实在不太行。

    MoltBook 那档子事

    OpenClaw 今年 2 月那波热度,很大程度上是靠 MoltBook 带起来的——当时号称是一个”完全由 AI 智能体组成的社交网络”,闹得挺大。后来被扒出来,里面有不少”智能体”其实是人在扮演,说白了就是一场营销噱头。

    这事说实话挺鸡贼的。用真人冒充 AI 来炒概念,短期确实能吸引眼球,但代价是把口碑搭进去了。不过话说回来,那阵风也确实让大家开始认真想一件事:智能体要是真能靠谱地跑起来,到底能干什么?


    手机上的智能体,到底靠不靠谱

    OpenClaw 上手机这步棋,赶上了智能体遍地开花的节点。你现在能在好多地方看到智能体的影子——键盘插件、各类 App 的集成,甚至系统级的入口也在路上了。

    但问题是,智能体在手机上到底能干多少实际的事,现在还真不好说。桌面端都还没完全跑顺,移动端受限于屏幕、交互方式和后台限制,能发挥的空间更小。OpenClaw 这波先把”能跑”这件事解决了,至于”跑得好不好”,还得靠后面的实际使用来说话。