标签: AI技术

  • 一家初创公司声称突破了制约LLM的瓶颈,AI效率竞赛迎来新变量

    一家初创公司声称突破了制约LLM的瓶颈,AI效率竞赛迎来新变量

    大语言模型有个绕不开的数学瓶颈——”二次方爆炸”。处理的文本越长,计算量不是线性增长,而是平方级暴涨。这个瓶颈卡了业界快十年,但现在有家迈阿密的小公司说他们解决了。

    AI模型架构突破
    Subquadratic稀疏注意力机制示意图(AI生成图)

    Subquadratic公司5月从隐身模式走出来,发布了模型SubQ。他们声称用”稀疏注意力”替代了传统Transformer的”密集注意力”,把计算复杂度从二次方降到了——你猜对了——亚二次方。

    “我们希望开启一个效率新时代。几年后,没人会用Transformer搭建模型了。”

    ——Justin Dangel,Subquadratic联合创始人兼CEO

    二次方瓶颈到底卡在哪

    今天所有主流大模型都基于Transformer架构,核心是”密集注意力”机制。处理一段文本时,模型把每个词(token)编码成数字,然后让每个数字和所有其他数字相乘——用来捕捉词与词之间的关系。

    1万个词的文本,要算近5000万次乘法。文本长度翻倍,计算量翻四倍。这就是为什么长文档处理这么烧钱,也是为什么各家公司在拼命堆GPU。

    Subquadratic的思路很简单:不是所有词之间的关系都重要。稀疏注意力只挑重要的词做运算,跳过不相关的。问题难在——怎么判断哪些重要?以前的办法都用固定模式(比如”第1个词总是和第5个词比较”),效果不好。

    SubQ的”秘密酱料”是动态选择——对每段输入的文本,实时判断哪些词之间的关系值得计算。联合创始人Alex Whedon不肯透露具体怎么实现的,只说”这是我们的核心秘密”。

    质疑声:AI界的Theranos?

    第一次发布时,Subquadratic只给了几个自测跑分,没有第三方验证。AI工程师Dan McAteer在X上发文:”SubQ要么是Transformer之后最大突破,要么就是AI界的Theranos。”

    一个月后,Subquadratic找了第三方评测机构Appen来跑分。结果有些惊人:在LiveCodeBench编程测试上,SubQ得分89.7%,和顶级模型在同一个水平线。处理长文本时,SubQ的上下文窗口可达1200万token(主流模型一般是100万)。

    成本数据更夸张。跑同样的测试(从大文档里检索信息),Anthropic的Opus 4.6花了2600美元;SubQ花了8美元。

    但质疑没有完全消散。SubQ的底层权重是用中国开源模型Qwen”启动”的(在Qwen基础上微调),而不是从零训练的。这让一些研究者怀疑:这到底是一个全新架构,还是Qwen的一个高效变种?


    SubQ目前还没开放公测,等候名单上有几万人。在更多人真正用上之前,判断它是突破还是泡沫,还为时过早。但有一点是确定的:效率竞赛已经打响,谁能把大模型的计算成本打下来,谁就掌握了下一个回合的主动权。

  • 为什么韩国人如此热爱AI?从养老机器人到AI算命,这个国家正在全速押注

    为什么韩国人如此热爱AI?从养老机器人到AI算命,这个国家正在全速押注

    从仁川机场落地的那一刻起,你就感觉到韩国和硅谷的AI叙事完全不同。我在旧金山飞了12小时落地首尔,入境用了无人安检通道,机器扫了一下我的脸和护照,几秒钟就过了。坐地铁进市区,全程5G信号满格,连地下都是。车厢里每个人都低头盯着手机——不是在刷短视频,就是在和AI聊天。

    韩国AI应用
    首尔街头的AI服务机器人(示意图)

    首尔江南区公交站配有互动触摸屏,实时显示车次信息。区政府6月刚宣布要升级成”AI公交站”,配备多语言问答服务。走在街上,轮式机器人等在十字路口,给路人送外卖。互联网咖啡馆里坐满了青少年在打游戏——他们中的很多人梦想成为下一个职业选手。

    “韩国人对AI的热爱不是自发产生的,而是政府几十年来持续灌输的结果。从钢铁到半导体,从宽带到智能手机,每一轮技术革命韩国都押对了注,AI只是最新的一轮。”

    只有16%的韩国人担心AI

    皮尤研究中心2025年调查了25个国家,问”你对AI更多感到兴奋还是担忧”。结果:韩国只有16%的人说”更担忧”——25个国家里最低。美国呢?50%的人更担忧。

    韩国文化体育观光部和商工会议所的调查显示,超过一半的韩国人每天使用AI,要么是当个人助手,要么用来干活。这个渗透率在全球范围内都是顶级的。

    韩国人从小被教育:技术是国家现代化的唯一出路。朝鲜战争结束后,韩国从废墟里爬出来,靠的就是钢铁、造船、半导体、宽带、智能手机——每一波都押对了。现在到了AI这一轮,没人想掉队。

    政府全力押注

    李在明总统2025年上任后,誓言要把韩国带进”全球AI三强”,和美国、中国并列。他成立了总统AI战略委员会,砸钱买算力,还搞了一个”主权AI基础模型”项目,资助韩国公司开发自己的大模型。

    2024年韩国通过了《AI基本法》,是全球最早的综合AI立法之一。重点是促发展,监管很轻。斯坦福2026年AI指数报告显示,70%的韩国人认为通过AI推动科学和医疗进步比用监管保护行业更重要。

    三星和SK海力士两家公司撑起了韩国股市KOSPI指数——2026年两家公司市值都突破了1万亿美元,带动指数创历史新高。全球AI训练用高端内存芯片,大半是这两家造的。

    机器人 monk 和 AI 课本

    韩国人愿意尝鲜,政府也愿意在公共场景里部署AI。福祉中心里有了AI养老机器人,学校里开始试点AI课本(虽然因为错误太多被家长骂了一顿)。

    最出圈的是”机器人僧侣”——一家寺庙部署了人形机器人辅助宗教活动,外国媒体跑去拍了一大堆照片。K-pop领域也有AI虚拟偶像,和真人偶像抢饭吃。

    首尔中央市场晚上去吃炒年糕,我表妹掏出手机给ChatGPT输她的生辰八字,让它算命。她说问工作和感情是她每天最喜欢干的事。韩国Gallup的调查说,46%的20多岁韩国人用过聊天机器人算命。

    她还用ChatGPT问炒股建议,把工资全投进去了。她一边说ChatGPT是她的算命先生和财务顾问,一边又担心自己会被AI抢走工作。现代汽车宣布要部署Atlas人形机器人进工厂的时候,工会直接炸了。


    韩国人对待AI的态度,就像是整个国家在做一场豪赌——赌技术能把他们从内卷和衰退的焦虑里拉出来。AI能不能兑现这个期待,几年之内就能看到答案。

  • 英伟达开源MoE微调加速工具,一行import让微调提速3.7倍

    英伟达开源MoE微调加速工具,一行import让微调提速3.7倍

    MoE(混合专家)架构已经成为当前大模型的主流选择。从DeepSeek-V3到Qwen3,再到Google的Gemini,几乎所有最新发布的顶尖模型都在用MoE。但MoE有个麻烦——训练起来比普通Transformer麻烦得多,专家并行、通信融合、kernel优化,这些工程细节没有一个省心的。

    英伟达6月底开源了一个工具,试图让这件事变得简单。叫NeMo AutoModel,基本思路是:站在HuggingFace Transformers v5的肩膀上,不改你原来的代码API,只加一行import,就能把MoE模型的微调速度提升3.7倍,同时把GPU显存占用降低近三分之一。

    英伟达MoE微调加速工具概念图
    英伟达NeMo AutoModel通过一行import实现MoE模型微调加速

    3.7倍加速是怎么来的

    具体数字挺直观的。在单节点8张H100 80GB GPU上,用Qwen3-30B-A3B做微调,原来的Transformers v5每秒每GPU能处理3075个token,换成NeMo AutoModel之后直接拉到11340,提升3.69倍。显存这边,峰值占用从68.2GiB降到48.1GiB,省了29%。

    英伟达 team还测了Nemotron 3 Nano 30B-A3B,结果类似:吞吐提升3.4-3.7倍,显存降低32%。他们甚至拿550B参数的Nemotron 3 Ultra做了全参数微调测试——16个H100节点、128张GPU——这时候Transformers v5已经直接爆显存了,连对比的机会都没有。

    显存省下来的部分不是白给的——你可以拿它去跑更大的batch size,或者处理更长的序列。对于本来就卡显存的大模型训练来说,这两个操作直接决定了你能不能把模型训出来。

    核心技术:三板斧

    NeMo AutoModel在Transformers v5的基础上加了三样东西:专家并行(EP)、DeepEP、TransformerEngine。每一样都针对MoE训练的一个具体瓶颈。

    专家并行解决的是显存问题。MoE模型虽然每次推理只激活部分专家,但训练的时候,所有专家的参数都得放在GPU显存里。专家并行把这些参数分散到多张GPU上,8张GPU就每张只持1/8的专家参数。Qwen3测下来,这项技术能把MoE层的显存占用直接从68.2GiB压到48.1GiB。

    DeepEP解决的是通信开销。MoE训练的时候,每个token得先被路由到对应的专家,这个过程需要跨GPU通信。传统做法是”先分发、再计算”,DeepEP把它融合成了一个优化的GPU内核,”分发”和”计算”在时间上重叠了起来,通信的时间就被藏掉了。

    TransformerEngine提供的是基础运算加速。注意力机制、线性层、RMSNorm这些,都有专门的融合kernel实现。不只加速MoE层,普通Transformer层也能占到好处。

    一行import怎么做到

    用法确实简单。如果你原来就在用Transformers v5,切换到NeMo AutoModel只需要在文件开头加一行:

    • from transformers import AutoModelForCausalLM改成from nemo_automodel import AutoModelForCausalLM
    • 原来的训练代码几乎不用动
    • API完全兼容HuggingFace的接口约定

    这个设计思路很聪明。它不搞”全新框架”,而是在现有生态上做增强。这样用户的迁移成本几乎为零,英伟达那边也能持续从HuggingFace的生态里受益——相当于”我帮你提速,你继续用HuggingFace的接口”。


    为什么这件事值得关注

    MoE架构的普及速度比很多人预期的快。2026年上半年,几乎所有主流大模型发布都用了MoE或者类MoE的稀疏激活架构。原因很简单:在相同参数规模下,MoE的推理成本远低于稠密模型,但训练成本却高得多——因为所有专家的参数都得加载进显存,通信开销也大。

    英伟达这笔账算得很清楚:如果MoE是未来,那么控制MoE训练的工具链,就等于在AI训练基础设施里多插了一脚。HuggingFace占据了模型使用的入口,英伟达则通过NeMo AutoModel占据了”高性能训练”的入口——而且是以兼容HuggingFace的方式,用户几乎没有理由拒绝。

    代码、配置文件和基准测试脚本都已经放在GitHub上了(github.com/NVIDIA-NeMo/AutoModel),文档也在docs.nvidia.com上线了。感兴趣的人现在就能去试试,看看那3.7倍加速在自己的模型上能不能复现。

  • 领英创始人炮轰xAI是「彻底失败」,还说Cursor的巅峰已经过去了

    领英创始人炮轰xAI是「彻底失败」,还说Cursor的巅峰已经过去了

    LinkedIn联合创始人、Anthropic投资人Reid Hoffman最近在Fortune访谈里说了一些很直接的话。他对xAI的评价是”彻底失败”(complete train wreck),对Cursor的说法是”几个月前还星光熠熠,现在正在地平线上褪色”。这些话出自一个AI行业内部人之口,而且Hoffman本身不是旁观者——Anthropic是他的投资组合公司,所以他的话有立场,这点得先说清楚。

    xAI的11位联合创始人全走了

    xAI的问题不是一天两天了。到2026年5月,最初的那批11位联合创始人已经全部离开。这事儿从2026年2月开始加速,当时被认为是最核心运营负责人的Tony Wu宣布辞职,之后其他人陆续走人。

    Hoffman在访谈里没给xAI留任何面子。他说SpaceX收购Cursor这笔交易,恰恰证明了”这里缺的是AI能力,不是什么收购整合能力”。他的逻辑是:如果SpaceX真的是一家AI公司,它就不该用收购的方式来补AI的课。

    Reid Hoffman评论xAI与Cursor
    LinkedIn联合创始人Reid Hoffman(右)对xAI和Cursor的最新评价引发讨论

    xAI的故事从一开始就是马斯克个人意志的延伸。2023年7月官宣成立,2024年12月Grok-3发布,中间换过好几次技术方向。但真正的问题可能是:一个完全围绕单个人运转的AI实验室,到底能不能留住顶尖人才?11个人全走了,这个答案已经写在墙上了。

    Cursor被收购的时机有点巧

    Cursor的处境更有意思。这款AI编程工具在2025年到2026年初风头正劲,是很多开发者日常使用的工具。但Hoffman的说法是,它的巅峰可能已经过去了——”几个月前还星光熠熠,现在正在地平线上褪色”。

    背景是SpaceX在2026年6月16日以全股票方式、600亿美元估值收购了Cursor的母公司Anysphere。这笔交易宣布的时候,SpaceX的股价还在高位。但紧接着,SpaceX股价在一个交易日内跌了16%。这意味着Cursor股东拿到的股票价值已经大幅缩水,而且由于是全股票交易,这个缩水是实打实的。

    Hoffman对这笔收购的解读是:这更像是”IAC模式”——通过连续收购来聚合能力,而不是靠内生增长。他说SpaceX”不是一家AI公司”,xAI则是”彻底失败”。

    Cursor面临的竞争压力是真实的。2026年以来,Claude Code和OpenAI的Codex都在快速蚕食AI编程工具的市场份额。Claude Code尤其强势,很多原来用Cursor的开发者开始切换到Claude Code,原因是Claude的代码生成质量更稳定,而且直接整合在Claude对话框里,不用切换工具。

    Hoffman的AI竞争格局判断

    Hoffman在访谈里也给出了他对当前AI竞争格局的判断。他认为Anthropic在代码领域很强,而且正在往设计和法律方向扩展。ChatGPT的角色更像是消费者搜索的前端入口,而Codex的能力”被谈论得不够多,考虑到它实际上有多强”。

    这些判断有参考价值,但得带着Hoffman的身份一起看。他是Anthropic的投资人,所以强调Anthropic的优势是意料之中的。他贬低xAI和Cursor,某种程度上也是在为Anthropic的市场地位造势。

    但抛开立场不谈,他说的一些现象是客观存在的。xAI的人才流失速度确实异常,11个联合创始人在不到三年时间里全部离开,这在AI行业里是极少见的。Cursor确实面临着Claude Code和Codex的激烈竞争,而且Spotify和Universal Music的AI音乐授权协议(允许粉丝用AI翻唱)也改变了创作者工具的市场预期——这一切都让Cursor的”AI编程工具第一选择”地位不再稳固。


    这件事更大的意义可能是:AI行业的”护城河”到底在哪里?是模型能力,是产品体验,还是用户习惯?Cursor在产品和用户习惯上曾经领先,但现在看来,模型能力的追赶速度比很多人预期的要快。Claude Code背靠Anthropic的顶尖模型,这种组合的长期竞争力可能被低估了。

  • “The Dude”也逃不过:Jeff Bridges用AI生成音乐,说了一句”很吓人”

    杰夫·布里吉斯(Jeff Bridges)在播客上演示AI音乐生成工具Suno的时候,很多老乐迷的心情大概是复杂的。这个人跟Blue Note唱片公司出过专辑,跟T Bone Burnett这样的大师合作过——结果他用来展示音乐创作未来的是一段AI生成的旋律。

    “The Dude”也逃不过AI浪潮

    事情发生在Theo Von的播客《This Past Weekend》上。Bridges在现场用Suno生成了一段音乐,然后说了一句话:”It’s very frightening”——很吓人。这个反应既像感叹AI的创作速度,也像在表达某种不安。毕竟,一个花了几十年打磨音乐手艺的人,看着机器几秒钟就出一段像模像样的曲子,心情不可能毫无波动。

    Jeff Bridges AI音乐生成争议
    杰夫·布里吉斯在播客中演示Suno AI音乐生成工具,引发艺术界讨论

    Suno的商业化脚步没停

    Bridges这次”代言”出现的时间点很微妙。就在2026年6月,Suno刚完成D轮融资4亿美元,估值冲到54亿美元。这个平台已经从”好玩的AI玩具”变成了资本追逐的严肃生意。而一个格莱美级别的音乐人公开用它,释放的信号是:AI音乐生成已经进入主流创作者的工具箱。

    “It’s very frightening.” —— Jeff Bridges 在演示Suno生成音乐后的反应

    争议的核心不是”用不用”,而是”怎么用”

    音乐圈对AI的态度一直分裂。一边是像Bridges这样愿意尝试的创作者,另一边是担心训练数据版权、担心AI稀释创作价值的制作人和词曲作者。Suno过去一年面临多起版权诉讼,包括各大唱片公司联合发起的官司,争议焦点始终是:AI到底”学”了谁的作品,又没有给谁付钱。

    Bridges自己似乎也拿不准。他说”很吓人”的时候,语气里有一种矛盾——既惊叹于技术的力量,又清楚这种力量意味着什么。这种矛盾,其实就是整个创意行业面对AI时的真实心态。


    • Jeff Bridges在播客中用Suno生成音乐,称”很吓人”
    • Suno刚完成4亿美元D轮融资,估值54亿美元
    • AI音乐版权诉讼仍在进行,训练数据合法性是核心争议
    • 创作者的矛盾心态:既惊叹技术,又担忧其影响
  • AI语音越来越像真人,ElevenLabs悄悄给音频打上了「隐形水印」

    AI生成的语音越来越逼真,普通人根本分不清哪些是真人录的、哪些是机器合成的。这个问题不只是”听不听得出来”——当诈骗电话开始用AI克隆亲人的声音,当假新闻用合成语音煽动情绪,你才发现”能分辨”和”不能分辨”之间隔着巨大的安全隐患。

    看不见的水印,埋在声音里

    6月26日,AI音频平台ElevenLabs宣布接入Google DeepMind的SynthID隐形水印技术。这个技术的思路很聪明:不是在外层贴标签,而是把标识信息直接编织进音频信号本身——人耳听不到,但检测器可以准确识别。

    更重要的是,这个水印经得起折腾。剪辑、压缩、换格式、删元数据——这些操作过去能让溯源信息直接消失,但SynthID埋得够深,上述操作基本奈何不了它。

    AI音频水印技术概念图
    SynthID水印直接嵌入音频信号,人耳无法察觉,但可以被检测器识别

    免费用户先用,几周内全覆盖

    ElevenLabs的部署节奏是先覆盖免费用户的文本转语音生成,然后”在未来几周内”扩展到所有音频生成类型。同步推出的还有一个免费工具:ElevenLabs Audio Detector,任何人都可以把一段音频传上去,检测它是不是ElevenLabs生成的。

    根据Google DeepMind的数据,SynthID技术已经在全球范围内标记了超过1000亿条AI生成内容。这次扩展接入ElevenLabs,是继OpenAI、NVIDIA之后的又一重要落地。

    不只是打假,还有版权归属

    水印技术的意义不止于”识别假内容”。对创作者来说,持久的水印意味着他们可以证明某段AI生成音频确实出自自己——即使这段音频被下载、转码、再上传到YouTube或TikTok。内容溯源(provenance)正在成为AI平台的标配能力。

    当然,这套方案也不是万能的。水印标准如果只在少数平台间互通,效果就会打折扣。而且,真正想作恶的人总会想办法绕过检测——这是一场持续的猫鼠游戏。


    • SynthID水印直接嵌入音频信号,剪辑压缩后依然可检测
    • ElevenLabs免费用户率先覆盖,全平台几周内上线
    • Audio Detector免费开放,可检测任意音频是否为AI生成
    • 水印技术同时服务于内容溯源和版权保护两个目标
  • DeepSeek开源提速神器,不换模型就让V4快60%以上






    DeepSeek本月在技术圈投了一枚小炸弹——他们开源了一个叫DSpark的投机解码框架,说可以给现有的DeepSeek-V4模型提速60%到85%,而且不需要换模型、不需要重新训练,提速后的输出质量也无损。

    这件事值得说清楚,因为大多数用户感知不到”推理速度”这个东西,但它其实决定了你用AI产品时等得多久、以及AI公司要花多少钱来跑服务。

    “投机解码把生成拆成两个角色:一个小号的草稿模型先提议一段token,完整的目标模型再一次性验证这段提议。拒绝采样会接受最长有效前缀,再附加一个额外token。因为规则精确保持了目标分布,所以不存在质量损失。”

    AI推理加速概念图
    DeepSeek DSpark推理加速框架概念图

    投机解码是什么东西

    要理解DSpark,得先说清楚”投机解码”(Speculative Decoding)这个技术思路。大语言模型生成内容时,是逐token(可以理解为逐词或逐子词)输出的,每次只生成一个token,这导致推理速度受限于内存带宽,GPU的算力往往吃不满。

    投机解码的思路是:用一个很小的草稿模型,先”猜”一段接下来可能的token(比如一次猜5个),然后让完整的大模型一次性验证这段猜测——对的留下,错的地方截断,再从那个位置继续。因为草稿模型很小,跑得快;大模型验证一串token比逐次生成更快。这样整体速度就提上来了。

    这个技术不是DeepSeek发明的,学术界和工业界已经研究了一阵子。但DSpark的特别之处在于,它解决了一个具体工程问题:草稿模型猜的token,在后半段准确率会快速衰减——前面猜对了,越往后越容易跑偏,导致验证时能接受的长度有限,加速效果打折扣。

    DSpark怎么做的

    DeepSeek团队把草稿生成拆成了两个阶段,这个设计他们叫”半自回归生成”。第一阶段用一个并行的DFlash模块,一次性给每个位置生成基础logits(这是模型内部表示”下一个token可能性”的数值);第二阶段接一个极轻量的顺序头部,在采样每个token之前,加一个依赖前面已采样token的偏置。

    顺序头部默认是”马尔可夫头部”——只往前看一个token,低秩分解让它在词汇量很大的情况下也保持低成本。这个设计让DSpark继承了并行草稿的高首token准确率,又通过顺序头部让接受率在块的深处保持稳定,不会快速衰减。

    另一个工程细节是”置信度调度验证”:DSpark给每个草稿位置输出一个置信度分数,估计这个token通过验证的概率;再结合一个硬件感知的调度器,在GPU空闲时验证更多token,繁忙时验证更少。这个设计减少了高负载下验证被拒绝token造成的算力浪费。

    实际提速多少

    指标分两部分:离线测试和生产环境。

    离线测试里,DSpark在Qwen3各个尺寸模型上的接受长度,比Eagle3高26%到31%,比DFlash高16%到18%。注意这里比较的是”接受长度”(每次验证能接受多少token),不是直接的提速倍数,但因为延迟公式里提速正比于接受长度,所以这个指标直接反映了加速潜力。

    生产环境的数据更有说服力。DeepSeek-V4-Flash和V4-Pro在他们的真实流量下,用DSpark-5配置(5个token的草稿块+马尔可夫头部),相比之前的MTP-1基线(一次猜2个token的固定方案),每用户生成速度分别提升了60%到85%和57%到78%。这个提升是在相同吞吐量(即相同GPU资源)下测得的,意味着用同样的硬件可以服务更多用户,或者同样多的用户等着的时间更短。


    为什么这件事值得关注

    第一,这是”不换模型就能提速”的方案。大多数AI公司提速的思路是训练更大的模型、或者用更多GPU,这都意味着更多的钱。DSpark这种在推理层面做优化的思路,是花小钱办大事——尤其对已经在跑DeepSeek-V4的服务来说,换上DSpark的检查点就能直接提速,不需要重新训练。

    第二,DeepSeek把检查点和训练代码都开源了,用MIT许可证。这意味着其他公司和研究机构可以直接用,也可以基于这个框架做自己的优化。这种开源技术基础设施的打法,和OpenAI、Anthropic的闭源路线形成鲜明对比。

    第三,推理速度的提升会传导到终端用户。AI聊天产品的响应速度、AI编程助手的代码生成延迟、AI搜索的返回时间——这些用户体验指标,背后都是推理速度。DSpark如果被广泛采用,意味着用同等质量的模型,用户能感受到更快的响应。

    最后说一句实际的:DSpark目前是和DeepSeek-V4的权重绑定的,不是通用框架(虽然DeepSpec训练代码库支持在其他模型上训练草稿模块)。如果你想在自己的项目里用,得跑训练——官方配置假设单机8块GPU,目标缓存可能非常大(Qwen3-4B设置下接近38TB),这个门槛不低。但对已经有大模型服务的团队来说,这个方向值得跟进。


  • 前商务部长攒了5亿美元,说AI抢走的工作得有人管






    2026年6月25日,华盛顿的发布会现场坐着两个不太可能同台的人——前美国商务部长吉娜·雷蒙多(Gina Raimondo)和前印第安纳州长埃里克·霍尔科姆(Eric Holcomb)。一个民主党,一个共和党,两人共同宣布了一件事:他们攒到了5亿美元,专门用来应对AI给就业市场带来的冲击。

    这个组织叫”Raise Us”,定位很明确:无党派、非营利、不碰政治。雷蒙多在采访里说得很直白——美国现在拼命在AI技术上跟全球竞争,但少了关键一块,那就是”人”的策略。技术跑得飞快,可那些被AI替代的工人怎么办,没人认真想过。

    “AI是一个令人兴奋的技术,我们希望美国在全球AI竞争中领先。但我认为转型期真的会有阵痛——数百万美国人可能得换工作,或者他们的工作直接没了。现在就得行动起来,想办法让这个过渡不至于让底层的人摔得太惨。”

    AI就业应对基金概念图
    前商务部长雷蒙多联合共和党前州长发起AI就业应对基金(概念图)

    5亿美元从哪来?

    雷蒙多不是空手开张。她在宣布之前就已经锁定了5亿美元的承诺资金,目标是要筹到10亿。出钱的有亚马逊、Anthropic、微软、OpenAI这些AI圈的大玩家,也有大型企业和慈善基金。

    这个阵容本身就很说明问题——AI公司愿意掏钱,说明它们也意识到:如果AI替代工人的速度太快、又没有缓冲机制,整个社会对AI的反推力量会越来越大。与其等政府强行监管,不如主动拿出解决方案。

    雷蒙多警告说,能行动的时间窗口比大多数人想的都要窄。等大规模的AI失业真的来了再动手,就太晚了。

    四个支柱,先在四个州试点

    Raise Us的具体做法分四个方向,他们叫”四个支柱”:

    • AI职业导航——用AI工具帮工人识别自己的技能可以转移到哪些新岗位,而不是让每个人自己去瞎琢磨。
    • 服务年计划扩展——扩大已有服务年项目的规模,让更多人在转型期有事情做、有收入。
    • 工资保险——如果工人换工作后工资下降了,这个机制可以补一部分差额。这个概念在美国讨论了很多年,但一直没大规模落地。
    • 与州政府和大学校合作——在地方层面设计培训项目,不是华盛顿拍脑袋搞一套全国通用的方案。

    目前已经有四个州同意参与试点:阿肯色、康涅狄格、马里兰、犹他。选择这四个州本身也体现了跨党派思路——有红州也有蓝州,看看哪种模式在不同政治环境下能跑通。

    为什么是雷蒙多?

    雷蒙多这个人有意思。她当过罗得岛州长,后来被拜登提名为商务部长,在任内深度参与了芯片法案(CHIPS Act)的实施——也就是美国政府拿出数百亿美元补贴本土半导体制造的那项政策。她既懂技术政策,又有实际操盘大规模政府项目的经验。

    离开政府后,她没有回华尔街或者去某家AI公司当顾问,而是搞了这个专注于工人转型的非营利组织。她在接受Fast Company采访时说,美国现在对AI的投资疯狂地集中在技术和基础设施上,但”人”这一侧的投入严重滞后。

    霍尔科姆的加入也很关键。作为前州长,他理解州层面的政策落地有多难——联邦政府可以出钱,但最终执行是在州和地方层面。两人组合相当于覆盖了”联邦政策+地方执行”的完整链条。


    这件事为什么值得关注

    AI失业这个话题已经讨论了好几年,但大多数讨论停留在”会不会发生”和”有多严重”的层面。Raise Us的不同之处在于,它试图在问题大规模爆发之前就建立应对机制,而不是等乱象丛生后再去补救。

    另一个值得注意的点是,这个倡议是AI公司主动出钱支持的。这和过去科技公司面对外部性问题时的典型反应不太一样——通常他们会先否认问题存在,等舆论压力太大再被动应对。Raise Us至少说明部分AI公司管理层已经意识到,主动管理社会影响比被动挨打要划算。

    当然,5亿美元听起来很多,放到全国范围的工人再培训需求里,这个数字其实挺小的。Raise Us更像是一个示范项目——如果在四个州能跑通,后续才会有更大规模的公共资金投入。雷蒙多很清楚,光靠慈善钱是解决不了系统性问题的。

    最后说一句,这件事发生的时间点很有意思。2026年正好是美国中期选举年,AI对就业的影响已经开始在数据中显现(参考SignalFire的工程岗位数据),但还没有成为全国性的政治议题。Raise Us选择在这个时间点上宣布,很难说没有为未来政策讨论设定议程的意图。


  • Meta把Ray-Ban摘了:智能眼镜不搞联名了,要自己单干

    Meta把Ray-Ban摘了:智能眼镜不搞联名了,要自己单干

    过去三年,在美国提到Meta智能眼镜,大家脑子里第一个蹦出来的词就是”Ray-Ban”。两家联名款卖得不错,Ray-Ban的文化背书帮Meta在智能眼镜这个” Geek专属”的品类里打开了局面。

    但这个局面6月23日变了。Meta正式推出不带有Ray-Ban品牌的新款智能眼镜——三种款式、七种颜色,比Ray-Ban联名款便宜80美元。其中一款还是跟Kylie Jenner(就是那个社交名媛、真人秀明星)合作的。

    Meta智能眼镜概念图
    Meta智能眼镜走向独立品牌

    为什么现在”摘掉”Ray-Ban?

    这件事某种程度上是意料之中的。Meta跟EssilorLuxottica(Ray-Ban的母公司)的合作,当初是一个很聪明的市场进入策略——智能眼镜之前看起来都像科幻片道具,或者nerd专属,普通人大概率不会戴出门。

    Ray-Ban借给Meta的是:经典的镜框造型、品牌认知度、文化上的”正当性”。消费者买一副Meta智能眼镜,某种程度上是因为”这副眼镜看起来就是Ray-Ban,就算带摄像头我也不介意”。

    但联名永远意味着分润,也意味着Meta对自己的硬件品牌始终没有百分百的掌控。现在Meta觉得时机到了——它要试试,智能眼镜能不能靠”Meta”这个牌子自己卖。

    便宜80美元,但隐私这道坎还在

    新款眼镜比Ray-Ban联名款便宜80美元,这个定价策略很明显:Meta想扩大用户群,把智能眼镜从”早期采用者”往”主流消费者”推。

    但Meta面临的最大障碍,可能不是价格,而是隐私。过去几年,Meta在隐私方面的”前科”太多了,用户对它的信任度一直不高。

    最近《纽约时报》和《Wired》都报道了同一件事:Meta正在为智能眼镜开发面部识别功能。这意味着什么呢?你戴着Meta眼镜在街上走,眼镜可能 silently 在识别路过的人脸。

    这条新闻出来之后,很多人对Meta智能眼镜的隐私担忧又升了一级。Meta可穿戴设备副总裁Alex Himel在接受The Verge采访时说”隐私改进正在进行中”,但这个承诺在Meta的历史记录面前,说服力有限。

    没有Ray-Ban背书,Meta眼镜还能卖得动吗?

    这是真正的问题。Ray-Ban联名款的成功,很大程度上是因为Ray-Ban的品牌让人”愿意戴”。如果换成Meta自己的品牌,消费者会不会觉得”这是在脸上戴了一个Meta的数据采集器”?

    从另一个角度看,Meta也在押注:智能眼镜这个品类已经足够成熟了,用户买它不再是因为”这是Ray-Ban”,而是因为”这东西真的有用”。如果Meta是对的,那摘掉Ray-Ban就是一个正确的决定——为什么要跟别人分钱呢?

    跟Kylie Jenner的合作款也透露了Meta的策略:用社交名人背书来替代传统品牌背书。Jenner在Instagram上有数亿粉丝,她戴什么,她的粉丝就会想买什么。这可能比Ray-Ban的标志更值钱——至少对年轻消费者来说。


    Meta智能眼镜摘掉Ray-Ban,是一次战略豪赌。赌的是智能眼镜品类已经成熟到可以靠产品本身(而不是联名品牌)来卖;赌的是消费者已经不在意Meta的隐私黑历史;赌的是便宜80美元比一个经典品牌标志更有吸引力。

    这把赌注能不能赢,可能未来半年就能看出来。如果新款卖得好,其他科技公司(Google、Apple、Samsung)估计也会加速自己的智能眼镜计划。如果卖不动,Meta可能还得回去找Ray-Ban续约。

  • AI写出一堆垃圾,谁来打假?Superhuman收购GPTZero背后的信任之战

    AI写出一堆垃圾,谁来打假?Superhuman收购GPTZero背后的信任之战

    如果你最近在网上读东西,有个感觉可能越来越强烈:怎么这么多文章读起来都是一个味儿,四平八稳,没有破绽,也没有灵魂。这不是错觉。有数据显示,现在互联网上50%的内容已经是AI生成的——跟人类写的一比一了。

    更吓人的是,按这个速度,五年之内互联网100%会变成AI内容。到那时候,”网上查资料”基本上就是在让AI读AI写的东西,然后吐给你。

    AI内容检测概念图
    AI内容检测已成为新的战场

    一个毕业论文项目,三年做到3000万美元年收入

    6月23日,Superhuman(就是那个前身是Grammarly的公司)宣布收购AI内容检测平台GPTZero。这笔交易的金额没披露,但GPTZero联合创始人Edward Tian对外说的是:累计1900万注册用户,年度经常性收入(ARR)3000万美元。

    这个公司的起源有点意思。Tian在Princeton读大四的时候,把AI内容检测作为毕业论文课题,做着做着就做成了一家公司的原型。2024年,他告诉TechCrunch公司已经盈利了。三轮融资加起来才1350万美元——350万种子轮、1000万A轮——但收入规模已经很可观了。

    “我们创立GPTZero是因为相信内容信任至关重要,而这个信念只会随着AI无处不在而变得更强烈。”——Edward Tian,GPTZero联合创始人

    AI写作工具和AI检测工具,终于成了一家人

    这里有个挺讽刺的事。Grammarly(现在叫Superhuman)是做AI辅助写作起家的,帮助用户把文章写得更好。结果它现在把AI内容检测工具买下来了。

    Superhuman的说法是”两个AI检测器比一个好”。其实背后的逻辑很清楚:随着AI生成内容泛滥,光帮人写得好不够了,还得帮人证明”这是我写的”或者”这篇文章是不是AI写的”。

    这就是Superhuman在推的”真实性层”(authenticity layer)。它要做的不是单一的AI检测,而是一整套工具:检测AI内容、追溯内容来源、发现AI幻觉(假引用、假数据)、防止无意抄袭。

    收购之后,GPTZero的功能会整合进Superhuman Go——一个号称能在100万个应用和网站上工作的AI助手。用户在写东西的时候,实时就能看到”这段像不像AI写的”、”有没有假引用”、”是不是无意中抄了别人的东西”。

    “AI slop”成了年度词汇,信任危机不是开玩笑的

    “AI slop”(AI垃圾内容)被Merriam-Webster选为2025年”年度词汇”。这个词本身就说明问题了——人们对AI生成内容的负面情绪已经到了一个临界点。

    GPTZero推出的AI Vision功能(2026年2月上线)已经能在用户刷社交媒体、看邮件、读文章的时候,实时标记出哪些是AI生成的内容。这个功能的存在本身,就是对互联网内容生态的一个巨大讽刺。


    对写作者来说,这场信任危机也有好的一面:大家开始更在意”这是我写的”这个标签了。对读者来说,能知道”这是人写的”或者”这是AI写的”,至少有了选择的权利。

    Superhuman和GPTZero并到一起之后,能做的事情是:你在100万个网站和App里写任何东西,都有一套工具在帮你证明”这是我的原创”。五年之内互联网如果真的100%变成AI内容,这套工具可能就是人类写作者最后的救命稻草了。