标签: AI芯片

  • Snowflake砸600亿美元绑定AWS自研芯片,AI算力战争打到CPU了

    云计算的芯片战争,又烧到了一个新量级。数据仓库巨头Snowflake本周三宣布,与AWS签署了一份为期五年、总价值600亿美元的新协议。作为参照,Snowflake自2012年成立以来,通过AWS Marketplace销售的服务总额也就70亿美元。这份新合同几乎等于它过去十几年在AWS上赚到的所有钱。

    Snowflake为什么愿意掏这么多钱

    数字背后的驱动力并不复杂——AI。Snowflake的客户在AWS上的花费正在加速膨胀,2025年一年就翻倍到了20亿美元。这让Snowflake有信心锁定未来五年的算力资源。

    Snowflake这几年一直在推自己的AI构建工具Cortex AI,逻辑很顺:企业的数据存在Snowflake里,直接在上面接AI能力,比把数据搬来搬去省事得多。Cortex AI能提供文本界面查数据库(用自然语言问就行)、摘要报告生成等功能。

    数据中心与AI芯片
    AI 算力需求推动云巨头加码自研芯片(来源:TechCrunch)

    这份协议里有一个特别值得关注的细节:Snowflake签约的核心目的,是为了获取更多AWS自研的ARM架构CPU芯片Graviton的使用权。

    CPU在AI时代为什么突然值钱了

    训练大模型靠GPU,这没人反对。但当AI从训练走向日常推理、再走向Agent自动化之后,CPU的用量会急剧上升——因为Agent执行任务时的大部分工作(调度、I/O、业务逻辑)都是由CPU完成的。

    AWS的自研CPU芯片Graviton相比Nvidia的方案有价格优势。亚马逊向来对成本敏感,它也确实把这部分节省传递给了客户。需求旺盛到什么程度?AWS正在以最快速度部署这些芯片,但还是跟不上。

    上个月,AWS刚跟Meta签了一份供应数百万颗Graviton芯片的协议,以满足Meta日益增长的AI算力需求。而就在几个月前,Meta才刚刚跟Google Cloud签了一份100亿美元的云服务协议。AWS能从Google手里抢到Meta的订单,Graviton芯片的价格优势显然是重要原因。


    云巨头芯片军备竞赛

    AWS签下Snowflake这个级别的长期大单,也是在向Nvidia释放信号:云巨头的自研芯片正在抢食你的午餐。

    • Google的TPU已经自研多年,支撑着Gemini大模型的训练和推理
    • 微软今年1月刚发布了自研AI加速芯片Maia 200,专门针对推理场景
    • AWS的Graviton已经迭代多代,在性价比上确实对一部分客户有吸引力

    Nvidia CEO黄仁勋上周在财报会上显然也感受到了压力。他宣称Nvidia新推出的Vera CPU专为AI设计,将为公司打开一个「规模2000亿美元的全新市场」,而且已经拿到了200亿美元的订单。话说得很满,但云巨头们分散供应链的战略意图已经很明确了。

    不管这场芯片战争最后谁占上风,有一点可以确定:AI热潮里最稳赚不赔的,永远是把算力当自来水卖的那几家云厂商。

  • 白宫申请90亿美元买AI芯片,给间谍们用

    说美国政府在AI上”押重注”,已经不算新闻了。但最近这个数字还是让人倒吸一口凉气——《纽约时报》披露,白宫已经批准了一项高达90亿美元的预算申请,专门用来给CIA、NSA这些情报机构买最先进的AI芯片,以及搭建配套的基础设施。

    情报机构的算力焦虑

    事情的起因挺简单:CIA和NSA发现自己的算力不够用了。具体来说,他们缺乏足够的计算能力来运行最新的AI模型,导致在AI技术的推进速度上”跟不上节奏”。

    这听起来可能有点反直觉——情报机构不是一向技术最先进的部门吗?但AI大模型对算力的需求是指数级增长的,顶尖的模型训练一次要烧掉数千万美元的计算资源。情报机构虽然有预算,但采购流程繁琐,等芯片到位,可能新一代架构又出来了。

    据《纽约时报》报道,这项预算申请专门针对英伟达Grace Blackwell超级芯片的采购和配套基础设施建设。

    Grace Blackwell是什么来头

    英伟达的Blackwell架构是2024年发布的下一代GPU,专门为大模型训练和推理设计。Grace则是英伟达自研的CPU,搭配Blackwell GPU组成超级计算平台。这个组合是目前AI训练领域最顶尖的硬件配置,价格自然也不菲。

    一块Blackwell架构的B200芯片,公开市场的单价就在3万到4万美元之间。如果按”90亿美元”的规模来算,这笔采购可能涵盖数万块芯片,加上数据中心制冷、供电、网络配套,确实是个天文数字。


    钱还没到位,国会那关不好过

    白宫虽然已经批准了这项申请,但钱还没法马上花出去——还需要美国国会点头。90亿美元不是小数目,任何一笔巨额国防或情报预算,在国会都会经历一轮激烈的辩论。

    支持者会说,这是国家安全的必要投资,中国在AI领域的投入同样巨大,美国不能掉队。反对者则可能质疑:情报机构到底要用这些算力做什么?有没有监督机制?会不会进一步加剧AI军备竞赛?

    这件事的另一层背景是,AI已经深度渗透进情报工作。从卫星图像分析、信号拦截解码,到开源情报的自动化处理,AI工具正在改变 spy game 的玩法。谁能拥有更强的算力,谁就能更快地从海量数据里捞出有价值的情报。

    90亿美元买的不只是芯片,更是一张”未来情报优势”的入场券。这张入场券贵不贵?肯定贵。但这场竞赛里,不买票的人,可能连参赛资格都没有。

  • Nvidia季度营收创纪录达816亿美元,初创投资持仓暴增至430亿

    2026年5月20日,Nvidia发布了截至4月26日的最新季度财报,营收达到816亿美元,环比增长20%,再度刷新历史纪录。数据中心业务更是贡献了752亿美元,同样是历史新高。

    Nvidia CEO Jensen Huang
    Nvidia CEO Jensen Huang在GTC大会上(图源:Getty Images)

    Blackwell架构全面铺开,但增长将放缓

    Nvidia CFO Colette Kress在财报电话会上说:”我们的Blackwell架构无处不在,所有主流超大规模计算厂商、云服务商和头部大模型开发商都在用。”基于这份强劲业绩,公司授权了800亿美元的股票回购计划。

    不过Nvidia也给出了增长放缓的预期:下一季度营收指引为910亿美元,环比增速将降至12%。这算是给市场提前打了预防针。

    “我们今年和明年为Anthropic上线的算力规模将非常可观。此前Nvidia对Anthropic的算力覆盖几乎为零。”—— Jensen Huang


    430亿美元初创持仓,投资布局大扩张

    这份财报里最让人意外的,是Nvidia持有的非上市公司股权在1-4月之间近乎翻倍:季度初是220亿美元,季度末飙到430亿美元。光是本季度就砸了185亿美元收购,上一季度同类投入才6.49亿美元。

    这430亿还不包括对康宁、IREN等上市公司的投资,也不包含尚未交割的承诺。今年2月Nvidia承诺向OpenAI投300亿美元,具体交易结构到现在还没披露。

    中国市场依然悬而未决

    出口管制这事儿暂时还没对公司盈利产生明显影响。H200芯片虽然已经拿到美国出口许可,但Nvidia还没靠它在中国赚到一分钱,也不确定以后能不能卖进去。

    Kress的原话是:”我们还没有产生任何收入,也不确定是否会被允许进口到[中国]。”这话听起来,短期内外围市场这块还是个问号。

  • AI驱动交换芯片二次成长:2028年市场空间可达242亿元

    说到AI芯片,大家第一反应都是英伟达的GPU。但华泰证券最近一份研报提醒了一件容易被忽略的事:交换芯片作为数据中心互联的核心组件,2026年起要在AI驱动下开启”二次成长”了。

    交换芯片是干什么的?简单说,它负责处理数据交换和报文转发,是交换机的”大脑”。成本占比不低——占交换机成本30%以上。当AI集群从千卡迈向万卡级,网络系统必须更稳定可靠,这就推动数据中心Scale out交换机向更高容量、更高速度发展。

    万卡集群的”血管系统”

    你可以把AI集群想象成一个超大型工厂。GPU是工人,交换芯片就是工厂里的传送带系统——负责把数据快速、准确地从一个”工人”(GPU)传到另一个。

    当集群规模从1000张GPU扩展到10000张,这个”传送带系统”的压力不是线性增长,而是指数级增长。数据包要在成千上万个计算节点之间高速穿梭,任何瓶颈都会导致整个系统变慢。这时候,交换芯片的性能就成了关键。

    测算显示,2028年国产交换芯片市场空间有望达到242亿元,2026-2028年复合增长率(CAGR)高达96%。

    超节点架构:国产算力的破局之道?

    研报里提到一个有趣的观点:超节点架构可能是国产算力追赶海外算力的破局之道。

    这里的逻辑是:超节点架构放大了集群内Scale up(纵向扩展)的作用,而交换芯片的配比通常高于传统的Scale out(横向扩展)架构。换句话说,如果国产算力采用超节点架构,未来会催生大量交换芯片需求。

    这对国内交换芯片厂商来说,是个值得关注的机会。华泰证券的建议是:关注海外龙头及国内自研技术领先的芯片商。

    为什么是”二次成长”?

    第一次成长,是云计算和数据中心的传统需求驱动的。那时候交换芯片主要服务云服务商、大型企业。

    第二次成长,驱动力换成了AI。万卡集群、超节点架构、更高的数据交换速率需求——这些都让交换芯片从”配角”变成了”关键基础设施”。

    96%的三年复合增长率,放在任何行业都是夸张的数字。当然,这只是测算,实际能不能兑现,还得看AI集群建设的实际进度。


    最后提醒一句:研报是研报,投资是投资。96%的增长预测很美好,但交换芯片这个市场,最终谁能吃到蛋糕,还得看技术迭代速度和客户绑定能力。