标签: AI技术

  • 多西带着Buzz杀进协作赛道:人和AI智能体要在同一个群里干活了

    如果你最近觉得公司群聊越来越挤,那杰克·多西(Jack Dorsey)刚刚又给了你一个进群的理由。这位 Twitter 和 Block 的联合创始人,在周二甩出了一个叫 Buzz 的新应用——它瞄准的是 Slack 和 GitHub 的地盘,做的却是一件有点不一样的事:把人和他们手里的 AI 智能体,塞进同一个工作群聊里。

    Buzz 的样子,第一眼看上去就是 Slack 的近亲。左侧频道列表、右侧对话窗、再配上文件和应用,都属于标准配置。但多西在 X 上强调,Buzz 是“模型无关、去中心化、自我主权、开源”的。对一个越来越依赖 AI 智能体干活的公司来说,这一点挺关键——员工不用再在五六个平台之间反复横跳,Buzz 试图把编码、协作、项目管理都收拢到一个窗口里。

    多西在 X 上写道,Buzz 是“model-agnostic, decentralized, self-sovereign, and open source”——模型无关、去中心化、自我主权,并且开源。

    它背后的公司不是什么车库创业,而是多西自己的 Block。Square、Cash App、Afterpay、Tidal 都出自这家公司,Buzz 是它最新的一笔押注。从产品逻辑看,Buzz 想解决的是这样一个尴尬:现在团队用 AI 智能体做任务,但智能体往往散落在不同工具里,人和“数字同事”很难在同一个空间里配合。Buzz 的做法是直接让智能体进驻群聊,你 @ 它一下,它就能在同一个对话里帮你查代码、跑任务、整理信息。

    开源,是它最硬的底牌

    因为代码完全开放,开发者可以把 Buzz 改成最适合自己团队的样子。需要某个功能?自己写、自己部署,不用等厂商排期。这种“自托管”的思路,在企业场景里尤其吃香——数据留在自己手里,权限自己说了算。多西不是唯一盯上这块的人。Paradigm 的合伙人兼 CTO Georgios Konstantopoulos 前不久也开源了一个类似的东西叫 Centaur,他管它叫“虚拟员工”,能跑在 Slack 里,也能通过 API 调用。

    现在上车,可能还早了点

    不过 Buzz 自己也很诚实:它目前还是“早期阶段”。对已经在用 Slack 的成熟团队来说,现在把所有工作流搬过去并不明智。它的免费桌面端已经上线,覆盖 macOS、Windows 和 Linux,代码也传到了 GitHub 上,谁都能去翻、去改。

    Jack Dorsey 与 Buzz 群聊协作平台
    Buzz 把人和 AI 智能体放进同一个工作群聊(图源:TechCrunch)
    • 群聊形态,但原生内置 AI 智能体,而不是事后接个插件
    • 同一窗口里直接管理 GitHub 项目,少切几次屏
    • 开源可自托管,企业能自己把控安全和数据
    • 免费桌面端已上 macOS / Windows / Linux,代码在 GitHub

    说到底,Buzz 想回答的问题其实是:当 AI 智能体变成团队里“编外员工”,我们该把它们安排在哪儿?多西给出的答案是——别另起炉灶,直接进群。至于它能不能真的从 Slack 嘴里抢下肉,现在下结论还太早,但“人和智能体同群办公”这个方向,看起来已经不是会不会发生,而是什么时候普及的事了。

  • 一家叫Natural的初创公司,要替AI智能体重写支付轨道

    Natural 团队
    图片来源:TechCrunch / Natural

    AI 智能体现在已经能帮你找供应商、比价格、联系承运商把货安排妥当。可真到了付钱那一下,它还是得把人类叫过来点头。一家叫 Natural 的初创公司觉得这很别扭,干脆拿了两千万美元(约 3000 万美元)的 A 轮,想从最底层把这套为「人」设计的支付轨道重写一遍。

    问题出在「轨道」本身

    今天金融系统跑的那套基础设施——信用卡、ACH 转账、各种清算网络——每一环都默认有个「人」在授权。可智能体是按机器速度工作的,它没法等月底才出账单,更没办法为了一笔毫秒级的 API 调用去填一张信用卡。支付那一下成了整条自动化链路上唯一的断点。

    Natural 的创始人 Kahlil Lalji 是银行背景出身,本来发誓这辈子不再碰金融——上一家公司卖给了 Earnin,他自称被这个行业「烧」过。但他发现,智能体的进化速度已经甩开了现有的金融架构。「代理式支付会结构性地成为这个赛道里最重要的问题,这一点太明显了,我绕不开它。」

    「世界上发生的支付笔数,可能会比今天多出两三个、甚至四个数量级。」——Natural CEO Kahlil Lalji

    它想做什么,又面临谁

    Natural 把自己定位成一个「智能体编排层」:企业接上它的基础设施,就能让自己的 agent 自主付款、收款,甚至还和其他 agent 互相交易。这轮由 Forerunner 的 Kirsten Green 领投,总融资来到 4000 万美元。团队里已经挖来了曾在 Stripe、Ramp、Square 干过的老兵。

    • 直接对手是 Stripe——它也在抢着给 AI 智能体重做支付轨道,但大公司的转身总归更慢。
    • 其他玩家如 DCVC 支持的 Skyfire,押注用美元稳定币重构这套 backbone;Natural 两条路都接,传统银行支付和稳定币都做。
    • 它不只管「代付」,还打算重新设计纠纷处理这类支付里最麻烦的环节。

  • Hugging Face证实遭入侵:动手的,是个自主AI代理

    Hugging Face 遭入侵
    图片来源:TechCrunch / Anadolu Getty

    上周末,AI 圈里最常被开发者当成「家」的平台之一,被人钻了空子。Hugging Face 在周五承认,他们内部的一部分数据集和服务凭证在一次入侵里失了守。这家托管着海量开源模型和训练数据的平台,到现在还没完全确认有没有客户或合作方的数据被顺走。

    一次从数据流水线发起的入侵

    攻击的起点很不起眼,就藏在 Hugging Face 自己的数据处理管线里。一份被上传的恶意数据集,滥用了两个代码执行路径——一个能远程跑代码的加载器,一个藏在数据集配置里的模板注入——在处理节点上执行了恶意代码。接下来就是教科书式的横向移动:提权到节点级、收割云和集群的凭证、趁着周末悄悄摸进好几个内部集群。

    整场行动不是人敲键盘敲出来的。Hugging Face 把锅甩给了一个「外部 AI 代理」:它在一大堆活不过几分钟的沙盒里跑了几千次独立操作,命令与控制节点还自己迁移到了公共服务上。公司说这正吻合业界预测已久的「代理型攻击者」场景,不过当 TechCrunch 追问证据时,对方没马上拿出来。

    「这正吻合业界此前预测的『代理型攻击者』(agentic attacker)场景。自主、由 AI 驱动的攻击工具不再是理论。」

    讽刺的一幕:防御者被自家模型拦下了

    这次事件最耐人寻味的,是 Hugging Face 怎么把攻击查明白的。它自己的异常检测先发现了动静,然后调了一个 AI 模型去分析记录了整场攻击的服务器日志。有意思的是,它一开始用的是某家商业公司的「前沿模型」,结果分析请求被对方的安全护栏挡了回来——因为要提交大量真实的攻击命令和漏洞载荷,而托管模型的护栏分不清你是防御者还是攻击者。

    最后 Hugging Face 改用自己部署在本地的大模型做取证。这反而带来一个额外好处:敏感的攻击日志和里面提到的凭证,都不用再传到别人的服务器上。换句话说,攻击者被护栏彻底放开手脚,而防御者却被托管模型的护栏卡住了脖子。

    对用户意味着什么

    • 公开、面向用户的模型、数据集和 Spaces 暂未发现被篡改,软件供应链也已验证干净,算不幸中的万幸。
    • Hugging Face 已关闭入口漏洞、重建被感染的节点、轮换了受影响的密钥,并加严了集群准入控制。
    • 平台建议所有用户立刻轮换存在这里的访问令牌,并盯着账户里有没有可疑活动。

  • 腾讯混元放出 Hyra:一个会自己改自己的科研智能体

    腾讯混元 7 月 21 日放出了一个有点特别的东西——Hyra-1.0,全称 Hunyuan Research Agent。说它特别,是因为这是个能自己改进自己的科研智能体,专门冲着那些讲究性能的研究和工程任务去的。

    能自我进化的 AI 科研智能体概念图
    腾讯混元 Hyra:一个会递归自我改进的科研智能体(示意图)

    腾讯说,Hyra 不光能在公开基准上刷分,还能扎进真实的产品系统、AI 研发流水线,甚至自然科学研究和工业场景里边跑边学、边学边进化。这话如果成立,那它就不只是个做题家了。

    “AI 自己改自己”,这一年突然火了

    递归自我改进(RSI)和自动化研究,是过去一年 AI 圈最热闹的前沿话题之一。几个标志性的例子放在一起看就明白热度从哪来:

    • Google DeepMind 的 AlphaEvolve,只用 48 次标量乘法就算完了 4×4 复数矩阵相乘;
    • Together AI 让一群智能体在开放环境里协作,把 11 维 kissing number 的已知下界从 593 推到了 604;
    • Andrej Karpathy 的 autoresearch,用一套精简循环让模型训练研究能自己转起来。

    这些进化型系统一个接一个冒出来,共同点是智能体正在跳出封闭的基准测试,跑到开放的科学发现里去,有些地方已经开始超过人类了。Hyra 想接的就是这一棒。

    框架越轻,动作空间越大

    Hyra 的 Harness 设计遵循 The Bitter Lesson:框架尽量轻、尽量简单,把智能体的动作空间尽量放大。

    具体怎么工作?给它一个任务描述,Hyra 就开始跑一个循环:根据历史经验去探索、提出更好的解法。所谓历史经验,包括过去每个方案跑出来的日志、评估器给的反馈、还有方案本身的源代码。这个循环一直转,直到它自己觉得可以收工,或者预算烧完,最后把历史上最优的那版方案交出来。

    腾讯给了个直观的例子:只给 Hyra 一张 2D 参考图,让它推断物体的三维结构,还得生成一个能直接渲染的 3D 模型。评判用的是基于 rubrics 的 VLM judge,从轮廓、比例、结构完整性、材质、视觉相似度几个维度打分。Hyra 在多轮探索里不断改建模代码、调渲染参数,官方称最后的结果比用 Claude Code 的 goal 模式生成的更贴近参考图,也更符合人的审美。


    从 AlphaEvolve 到 Hyra,能看出一个方向:大厂都在把”让 AI 帮着做研究”往前推。区别在于,腾讯这次强调的是从公开基准走进真实产业场景,让智能体在自家的研发流水线和工业问题上真刀真枪地迭代。这条路能走多远,还得看后面拿出来的活儿。至少 Hyra-1.0 把话说到了这份上。

  • Netflix 5.87 亿美元买下本·阿弗莱克那家藏了三年的 AI 电影公司

    本·阿弗莱克手里那家藏了三年多的 AI 电影公司,到底值多少钱,现在有答案了。Netflix 上周五递交给美国证监会的一份 10-Q 文件里,写着 2026 年 3 月完成的一桩收购,总对价约 5.87 亿美元,全部是现金。文件没点名,但业内一眼就能看出,这说的正是阿弗莱克联合创办的 InterPositive。

    AI 电影后期制作概念图
    Netflix 用 5.87 亿美元买下 AI 电影后期技术公司 InterPositive(示意图)

    收购本身早在 3 月 5 日就官宣了,只是价格一直没公开。彭博当时的报道说,加上业绩对赌,这笔交易最高可能摸到 6 亿美元。RedBird Capital 是 InterPositive 早期的投资方之一。至于阿弗莱克个人到手多少,没人透露。

    它做的不是”凭空生成一部电影”

    很多人一听 AI 拍电影,脑子里冒出来的是输入一段文字、吐出一段视频。InterPositive 偏偏不走这条路。阿弗莱克反复强调,这不是 text-to-video,不是无中生有,而是帮剧组把后期那些又费钱又磨人的活儿做顺。调色、补光、加特效、重新构图、换背景、修穿帮、补缺的镜头——这些原本可能得把演员和剧组重新叫回片场重拍的环节,正是它的主场。

    “我知道自己对同行、对这个行业负有责任,要守住人类创造力的力量,以及创造力背后的人。做 InterPositive,就是想做这件事。”——本·阿弗莱克

    技术上有个挺关键的细节:它的模型只拿每个项目自己的每日拍摄毛片来训练,为的是保持这部片子内部的视觉逻辑和剪辑连贯,而不是拿一堆别人的作品去喂。阿弗莱克 2022 年低调创办这家公司,一支 16 人的工程师、研究员和创意人团队一直闷头干活,这次连人带技术全部并入 Netflix,他本人则出任高级顾问。

    Netflix 已经有 300 个项目在用 AI

    联席 CEO 泰德·萨兰多斯在本周财报电话会上说得很直接:目前大约 300 个片目已经在制作流程里用上了生成式 AI,绝大多数集中在后期,专门啃那些特别复杂的镜头和段落。他举了个例子——汤姆·汉克斯监制的纪录片《美国实验》,里面有 17 分钟是 AI 增强的画面。

    • 这 17 分钟的制作速度是过去的两倍;
    • 成本只有传统方式的一半;
    • 按萨兰多斯的说法,”用老办法根本做不出来的规模,现在做到了”。

    这笔钱花得也不算轻松。Netflix 二季度财报出来后股价一路下挫,周一又跌了 2%,报 67.60 美元,2026 年全年营收指引被收窄到 510 亿到 514 亿美元之间。在这种背景下砸半个多亿美元买一家 AI 公司,说明它对生成式 AV 改造制作流程这件事是真下注了。

    另一边,好莱坞对 AI 的警惕一点没松。阿弗莱克本人是演员工会 SAG-AFTRA 的成员,工会刚跟各大制片厂谈下新合同,专门给生成式 AI 划了红线,明确偏向保护真人表演。就在这个月,一个叫 Tilly Norwood 的 AI”演员”还接到了首个正式角色。让一位以”保住电影的人味儿”为口号的影人来牵头 AI 工具,Netflix 这步棋,多少有点想让创作圈更容易接受 AI 的意思。

  • 英伟达 Agent Toolkit:把 AI 智能体搬上桌面工作站

    英伟达最近给自家最强的台式工作站 DGX Station 塞进了一套新工具:Agent Toolkit。官方说,开发者只要三步、大概半小时,就能在本地把 AI 智能体跑起来——不用连云,模型和数据都留在你自己的机器上。

    本地 AI 智能体工作站概念图
    英伟达把智能体能力带到了桌面级工作站

    DGX Station 本身就不好惹,里面是一颗 GB300「Blackwell Ultra」GPU。Agent Toolkit 的价值,是把原来得靠云 GPU 集群才能玩转的复杂智能体,搬到了桌面端。

    借助 Omniverse 库,智能体可以在本地的安全运行时里调用工具与技能,完全不需要连接互联网。—— NVIDIA

    这一套到底装了什么

    它不是单个软件,而是一整个软件栈:

    • NemoClaw:开源的智能体蓝图,把模型、运行框架和 runtime 打包,方便团队照着自己的业务改
    • Nemotron 3 Ultra:一个 5500 亿参数的开放大模型,专为 DGX Station 优化,可以本地微调
    • Omniverse 库:把智能体接到物理仿真和 3D 工作流,机器人训练、自动驾驶仿真都能本地跑
    • OpenShell:开源的安全运行时,给智能体套上沙箱,按策略管住它碰什么工具、什么数据

    为什么是现在

    硬件底子是 GB300 超级芯片,最高 20 petaflops 的 FP4 算力、748GB 统一内存;网络用 ConnectX-8,带宽到 800GB/s,还能两台 DGX Station 并联扩容。NVIDIA 还拉上 Adobe、Blender、Unreal、Epic、Foundry、Canva 等伙伴做 MCP 接入,让智能体直接进到这些创作工具里干活。

    更关键的是战略转向。当资本市场开始计较 AI 的投资回报,英伟达把 Agent Toolkit 和 Omniverse 绑在一起,等于在说:我不只卖算力硬件,还想在你的工作站上长出一套软件生态。对怕数据出公司、又想快速迭代的企业来说,本地跑智能体确实少了一层顾虑。


  • 索尼再告 Udio:3 万首歌揭开的 AI 音乐版权战

    索尼音乐娱乐这周一在纽约法院又递了一纸诉状,被告是 AI 音乐生成器 Udio。和两年前三大唱片公司联手起诉 Udio、Suno 那场官司不同,这一回索尼把火力对准了一个很具体的数字:超过 3 万首歌。

    AI 音乐版权争议概念图
    AI 音乐生成器的训练数据版权问题持续升温

    从猫王的《Hound Dog》到碧昂丝的《Say My Name》,再到哈里·斯泰尔斯的《As It Was》,索尼列出的清单里既有上个世纪的经典,也有近年的热单。索尼在诉状里直言,这 3 万多首「只是 Udio 侵权作品中的一小部分」。

    索尼称,这份 3 万多首的清单「只是 Udio 所侵权作品中的一小部分」,背后还有更多未被点名的歌曲。

    这些歌是怎么被发现的

    有意思的是,这 3 万首并不是索尼一开始就掌握的。2024 年那场诉讼里,索尼和环球、华纳一起把 Udio 与 Suno 告上法庭。借着证据开示(discovery)的程序,索尼拿到了 Udio 的训练数据,再用一套「音频指纹」技术逐一比对,才揪出这批此前没被点名的歌曲。

    索尼原本想把 3 万多首直接加进原本的案子,但法官驳回了这个请求,原始诉讼的范围因此停留在 333 首。于是索尼换了个打法——单独再提一桩新诉讼。

    对 AI 音乐意味着什么

    这场拉锯把一个老问题又摆到台面:AI 音乐模型到底拿了多少版权音乐当养料。Udio、Suno 这类工具能照着风格生成听起来很「像」的歌,但训练数据是否合规,厂商一直说不清。

    • 2024 年索尼、环球、华纳联手起诉 Udio 与 Suno
    • 证据开示让索尼拿到 Udio 训练数据,音频指纹比对出 3 万首
    • 法官驳回追加请求,索尼改提独立新诉
    • 核心争议仍是 AI 音乐模型的训练数据授权

  • 字节跳动放出 Seed Audio 1.0:给视频配音,AI 不再只会「念稿」

    字节跳动 Seed Audio 1.0 音频创作模型
    Seed Audio 1.0 用统一框架联合建模人声、音效与环境声(概念图)

    做短视频、短剧的人大概都有过这种崩溃:画面拍好了,配一段像样的音效比写脚本还费劲。人声要去录音棚,环境声要现找素材,音效还得一笔笔手动对时间轴。7月20日,字节跳动 Seed 团队丢出一个叫 Seed Audio 1.0 的模型,想把这个流程一口气吞掉。

    它不是拼接,是「一起想」

    过去这类工具大多是各管一摊:一个模型生成人声,一个模型找音效,最后人工混音。Seed Audio 1.0 的卖点在于,它在一个统一框架里同时建模人声、音效和环境声,端到端直接产出一段能拿来叙事的完整声音。官方一句话挺妙:声音不再只是画面的补丁,而是能直接参与讲故事,「听见」即「看见」。

    具体有三个本事。第一是精细的时间编排,按时间线控制对白和音效什么时候进场,精度能到 100 毫秒,做视频配音和广告卡点刚好。第二是音色稳,支持零样本生成和长音频延展,一个角色从头到尾音色不变,还能同一声音演多个角色、带不同情绪。第三是语种全,覆盖中文、英文、日语等 20 多种语言,重音和节奏都按当地习惯来。

    官方评测显示,在影视、短剧、动漫、播客等多数场景里,音频可用率已经跑到 90% 以上;多语言自然度方面,大部分语种 MOS 评分超过 4 分,算优秀水平。

    从「会说」到「会创作」

    这中间的区别挺关键。早几年的语音合成,本质是把文字念出来,语调再自然也还是「读稿」。Seed Audio 1.0 瞄准的是创作——你给一条指令,它自己安排谁说话、什么情绪、背景音怎么铺、什么时候淡入。对短剧和动漫团队来说,这意味着原本要分几个工种、花几天的活,可能压缩到一轮生成。

    • 影视级音频:对白、音效、环境声统一编排,叙事更连贯
    • 可控音色:长音频保持一致,同一声音可演多角色
    • 20+ 语种:自然生成,适配本地表达节奏

    先上体验,后面还有大招

    模型现在已经放在火山方舟体验中心,创作者能直接试。团队放话,接下来会接进视频参考这类多模态输入,还会做可控翻译、长音频和分轨生成,方向是把脑子里的声音构想更快变成能听见的成品。


    大模型从文本、图像一路卷到音频,Seed Audio 1.0 是个信号:AI 音频正从单点工具走向全场景创作平台。对内容创作者,门槛又低了一截;对行业,竞争也从「谁念得真」变成「谁编得巧」。

  • AMD把「太阳神」搬进机房:Helios机架系统正面刚英伟达

    AMD Helios 机架级 AI 系统
    AMD 首款机架级 AI 系统 Helios,集 GPU、CPU、网络与软件于一体(概念图)

    7月20日,AMD 把憋了好久的一张王牌亮了出来——名叫 Helios 的机架级 AI 系统。名字取自希腊太阳神,摆明是要当算力界的「太阳」。这不是一块显卡,而是一整柜子:GPU、CPU、网络、软件全打包,直接对标英伟达那些动辄几百万美元的 AI 机柜。

    微软带头,巨头排队下单

    最让 AMD 长脸的是客户名单。就在发布当天,微软 CEO 纳德拉亲自表态,要在 Azure 数据中心部署 Helios,还顺手推出两款基于 AMD 新「Venice」CPU 的计算实例。更早之前,Meta 已经承诺逐步部署高达 6 吉瓦的 AMD GPU,其中 1 吉瓦今年就通过 Helios 机架交付;OpenAI 和甲骨文也点头要在年内大规模铺开;印度的塔塔咨询服务也在列。

    这背后是 AMD 十年的翻身账。它靠着三代产品路线图的严格执行,加上收购赛灵思、ZT Systems,一步步把 CPU 和 GPU 都做起来了。现在它敢说,Instinct GPU 已经服务全球前十 AI 公司里的八家,包括 OpenAI 和 SpaceX AI。

    苏姿丰此前放话:Helios 在推理、内存带宽和容量上,相比英伟达的机架系统有「显著优势」。

    算的是总账,不是单项性能

    AMD 数据中心业务负责人 Forrest Norrod 反复强调一个词:TCO,也就是总拥有成本。他说 Helios 追求的是最低的「每 token 综合成本」。道理不复杂——对微软、Meta 这种要养几吉瓦算力的巨头来说,单卡跑分高一点,不如整柜更省电、更便宜。

    不过现实也很骨感。研究机构 Futurum Group 估算,一台 Helios 机柜成本大约 500 万到 550 万美元,比英伟达第二代机架 Vera Rubin 的 350 万到 400 万美元还要贵;而且它重达 7000 磅,个头也更大。更要命的是份额:英伟达占数据中心 GPU 市场超过 95%,AMD 只有约 4.5%。

    • 分析师 Daniel Newman 认为,如果 AMD 执行到位,份额有望冲到 20%–25%,对应数千亿美元收入空间
    • AMD 一季度数据中心营收同比增长 57%,已是公司收入主力
    • 公司预计从 2027 年起,数据中心 AI 年收入将达到数百亿美元,大头来自 Helios

    硬件追上了,软件才是硬仗

    Counterpoint 的分析师 Neil Shah 点破了一层窗户纸:AMD 硬件已经和英伟达站到同一水平,但胜负手在软件生态。英伟达的 CUDA 护城河太深,AMD 这几年猛补 ROCm 开源生态,就是想拆这道墙。


    Helios 的早期部署马上就要展开。接下来一两年,市场会检验一件事:AMD 到底是靠真技术赢,还是仅仅因为英伟达产能紧缺捡了漏。对用算力的公司来说,多一个能打的供应商,怎么都不是坏事。

  • 谷歌悄悄研发新 AI 芯片 Frozen v2:要让 Gemini 省下大笔电费

    Google 自研 AI 芯片相关示意图
    大厂自研 AI 芯片已成趋势,Google 的 Frozen v2 瞄准的是推理能效(图源:TechCrunch)

    Alphabet 正在悄悄搞一颗新的服务器芯片,内部代号叫 Frozen v2,专门用来让自家的 Gemini 模型跑得更省、更稳。消息来自 The Information 的爆料,说这颗芯片大概会在 2028 年前后亮相。

    能效说是现在的六到十倍

    按那篇报道的说法,Frozen v2 的衡量标准是「每消耗一单位电力能生成多少 token」,在这个口径下,它要比 Google 现有的 AI 芯片高效 6 到 10 倍。对此 Google 既没承认也没否认,只给了一句四平八稳的回应。

    「我们的团队一直在研究和试验各种新方案,为用户和客户带来极致的性能与效率。」

    大厂为什么都在自己造芯

    把模型训练和推理从通用 GPU 上挪到自己定制的芯片上,已经成了大厂的共同动作。动机很直白:一是让自家模型跑得更划算,二是摆脱对英伟达的依赖——这家公司长期把持着 AI 芯片市场,也让所有大模型厂商都被它的硬件绑住。

    就在今年 6 月,OpenAI 刚亮出第一颗自研推理芯片 Jalapeño;本月初又有消息说,Anthropic 正在和三星谈新的芯片合作。Google 自己本来就有 TPU 这条线,Frozen v2 像是把这条路继续往下走。

    • 代号 Frozen v2,目标 2028 年前后发布,专供 Gemini 使用。
    • 能效按 token / 单位电力计,号称达现有芯片 6 到 10 倍。
    • 背景是 OpenAI、Anthropic 相继布局自研芯片,全行业试图降低对英伟达的依赖。

    股价先涨为敬

    这类消息背后,其实是投资者的算盘。大家一直担心 Alphabet 为了 AI 基建砸下的天价开支——公司年初说今年要花 1800 亿到 1900 亿美元。钱花出去了,得证明能回本。Frozen v2 一旦坐实,等于给市场一个「我们在把成本压下来」的信号。报道出来后,Google 股价周一上午就涨了大约 3%。

    当推理成本变成卖点,AI 的故事就从「大力出奇迹」变成了「谁更会过日子」。