标签: AI数据中心

  • 英伟达说它的AI数据中心可以不用水了

    英伟达说它的AI数据中心可以不用水了

    AI数据中心耗水这件事,过去一年里被翻来覆去地骂过了。从美国中西部 farmers 抱怨地下水被抽干,到环保组织把数据中心称为”数字吸血鬼”,舆论的压力终于让产业链里最有话语权的人坐不住了。

    英伟达在本周的一篇博客里给出了自己的答案:把数据中心的设计改成100%液冷,同时让服务器运行在更高的温度——最高到45摄氏度(113华氏度)。两套组合拳打下来,英伟达说,传统冷却塔系统每兆瓦每年要耗掉约260万加仑水,而新设计可以”把用水量降到接近零”,最高减少100%。

    热一点,反而省水

    这套设计的核心逻辑其实不难理解。传统数据中心用冷却塔把热量排到水里,水被加热后蒸发,带走热量——但这也意味着大量的水就这么没了。英伟达的Rubin代参考设计改用了全液冷:热量在芯片上就被”抓住”,通过液体回路传递出去,而且液体本身可以跑很高的温度。

    温度越高,室外的干式冷却器就越容易把热量排出去——因为温差大了。结果是,一年里有大部分时间,根本不需要用水来冷却。英伟达的可持续发展负责人乔什·帕克说,从传统冷却塔系统的约260万加仑/兆瓦/年,可以降到”接近零”。

    “热量在芯片上被直接捕获,通过液体回路以高得多的温度传输,让室外干式冷却器在一年中的大部分时间里都能高效排热。”——英伟达官方博客

    不是所有人都买账

    当然,英伟达的这篇博客出来之后,质疑的声音也不少。Gizmodo的文章就指出了一个很现实的问题:英伟达没有提这套液冷数据中心的建设成本比传统风冷贵多少。如果贵到大部分公司不愿意改,那”参考设计”再好也就是个参考。

    另一个更根本的问题是,数据中心耗水只是它环境足迹的一部分。建设过程中混凝土和钢材的碳排放、运行时的耗电量(哪怕水冷更有效率,AI训练本身还是要吃大量电力)、还有为这些数据中心配套的新增发电能力——这些都没有因为液冷而消失。

    换句话说,英伟达解决了一个真实但局部的问题。至于整个AI基础设施是不是在一条不可持续的发展路径上狂奔,那是另一篇文章的话题了。


    亚马逊也在做类似的事

    英伟达不是唯一一个在这个方向上发力的人。亚马逊最近也高调宣传了自己数据中心的”更高耐热 tolerance”设计,通过让服务器允许运行在更高温度,减少冷却所需的能量和水。只不过亚马逊的数据中心大部分还是风冷的,改进幅度没有英伟达的100%液冷那么激进。

    有意思的是,英伟达在博客里说”每一个为Rubin代建设云服务和数据中心的运营商都在做这个转型”。如果这是真的,那意味着从2026年开始,新建的大型AI数据中心会大规模转向液冷——这对那些还在用老设计的公司来说,可能会面临越来越大的舆论和客户压力。

    Nvidia液冷AI数据中心设计
    英伟达Rubin代参考设计,100%液冷方案 | 图源:Nvidia

    这件事的真正意义

    把这件事放在更大的背景里看,它其实标志着AI基础设施竞争的一个新阶段。过去大家比的是谁的芯片快、谁的模型准,现在开始有人比谁的数据中心更”干净”了。

    这对消费者来说可能是无感的——你不会因为你用的AI服务跑在液冷数据中心里就觉得它更好用。但对那些正在被数据中心”围困”的社区来说,这是一个实实在在的差异。如果英伟达的说法经得起独立验证,那它至少给行业指出了一条路——AI不一定非要以耗尽当地水资源为代价。

    当然,路有了和大家都走,是两回事。成本、标准、监管,这些才是决定液冷能不能真正普及的关键。英伟达开了口,接下来要看云服务商们跟不跟了。

  • 数据中心不想等电网扩容了,它们开始学会「看脸色」用电

    数据中心不想等电网扩容了,它们开始学会「看脸色」用电

    当几百万英国人同时在世界杯期间烧水泡茶,电网会经历什么?答案是:一场突如其来的用电高峰。但2025年12月的一次模拟实验显示,如果伦敦的一台数据中心当时装了一款叫Conductor的软件,它会在千钧一发之际自动给芯片降速,把电让出来。

    这听着像科幻,但已经是真实产品在测试了。Emerald AI在做的事很简单——让数据中心变成电网的「好邻居」,而不是永远张嘴要电的贪吃蛇。

    等等,电网怎么了?

    AI boom来了,数据中心想上网,电网说:排队吧您内。美国最大电网运营商PJM处理新发电项目并网要8年。数据中心盖好了,电接不进来,这生意怎么做?

    传统思路是:建更多电厂。xAI在孟菲斯搞燃气轮机,微软和Oracle提议搞超大型离线数据中心。问题是:燃气轮机不够用,新的电厂环评和建设又要好几年。这条路走不通。

    数据中心电网灵活性示意图
    科技公司在数据中心能源问题上开始寻找新出路(配图由AI生成)

    灵活性:给电网留点余地

    有一派人说:换个思路。电网其实有闲力,只是你不会用。2025年Duke大学的研究发现,如果数据中心愿意一年只让电0.25%的时间(大约22小时),美国电网能多挤出76GW——够到2030年的数据中心增长需求了。

    普林斯顿大学和两家电网现代化公司给PJM区域做了个测算:一个500MW的数据中心如果能做到一年99%以上的时间不拉闸,并网速度可以快3到5年。这就是「灵活性」(flexibility)的核心逻辑。

    数据中心不再要求「随时给我满电」,而是跟电网商量:「我可以在用电高峰时少拿一点,你让我早点并网行不行?」

    几家公司在做的事

    Emerald AI的产品Conductor就是干这个的。它在2025年12月做了那个「英德足球赛」模拟:AI程序在几百万个电热水壶同时启动的瞬间,给数据中心发指令降速。CEO Josh Parker说:「AI工厂的灵活性,是AI需求和电网局限之间的桥梁。」

    GridCare的思路更激进一些。这家硅谷创业公司用生成式AI给电网建「数字孪生」,把发电厂、输电线、变电站、家庭用电全部建模,然后找到在不牺牲可靠性的前提下解锁容量的方案。CEO Amit Narayan打了个比方:电网的平均利用率只有30%左右,如果你是个航空公司,飞机利用率30%,你不会去买新飞机。

    灵活性并网的好处

    • 电网更稳定。数据中心在用电高峰时让电,能避免拉闸限电。
    • 少建电厂。如果现有容量能挖潜,就不需要为了AI狂建天然气电厂。
    • 电费可能更低。Duke大学2026年2月的研究发现,灵活性能让电价降低0.5%到2.8%。

    为什么科技巨头们还在搞燃气轮机?

    听起来很美好,但为什么微软、Oracle、xAI还在搞离线电厂和燃气轮机?一个字:惯性。电网的设计哲学是「保守」——必须按照最高需求来建设,宁可闲置也不能掉链子。

    数据中心的传统做法也是「我要全功率」,因为每一秒的算力都可能意味着钱。xAI在孟菲斯的做法就是典型案例:等不了电网扩容,直接把燃气轮机用卡车拉过来。结果?当地居民和监管机构不干了,排放和污染问题一堆。

    但变化在发生。Emerald AI的首席科学家Ayse Coskun观察到一个趋势:「运营商越来越愿意用某种程度的灵活性,来换取更快的并网速度。」

    这不是一个「技术能不能做到」的问题,而是一个「谁先迈出第一步」的问题。2026年,这笔账会被算清楚的。

  • 联邦能源监管委员会给AI数据中心开了绿灯,电网接入不再排队

    联邦能源监管委员会给AI数据中心开了绿灯,电网接入不再排队

    联邦能源监管委员会给AI数据中心开了绿灯,电网接入不再排队

    电网与AI数据中心连接概念图
    AI数据中心电力接入成为美国基础设施新战场(配图由AI生成)

    在美国建AI数据中心,最大的瓶颈已经不是芯片,也不是钱,是电。

    准确说,是”接电”——把数据中心连上电网这个动作。这个过程慢到什么程度?排队时间经常以年计算。等到你接上电,竞争对手可能已经把模型训练完三代了。

    FERC出手了

    本周四,美国联邦能源监管委员会(FERC)终于出手了。他们向六大电网运营商下达命令:数据中心的并网请求,必须走”快速通道”。

    命令写得相当直接:电网运营商必须证明,数据中心能够”及时且有条理地”接入输电系统。当然,接电的钱还是数据中心自己出。但这条规定的重要意义在于,它从监管层面把”数据中心并网”这件事的优先级提上来了。

    六大电网运营商现在有两个死线:30天内,提交报告说明自己还有多少富余发电容量(如果有的话);60天内,”辩护或修改”自己辖区内的电价。

    FERC还专门提到了”替代输电技术”——虽然没有点名,但固态变压器、超导输电线路这些新技术,理论上现在都有机会进入电网运营商的采购清单了。

    电网快被AI”吃”掉了

    这件事的背景是:美国电网已经快被AI”吃”掉了。

    到2035年,数据中心的电力需求预计将增长近三倍。而电网运营商过去二十年已经习惯了需求近乎零增长,突然被砸过来这么一个增量,直接懵了。一些电网运营商——最典型的是美国最大的电网运营商PJM——已经陷入某种接近混乱的状态,大型公用事业公司甚至威胁要退出。

    排队接电网的不只是数据中心。截至2023年底,发电厂并网申请的总容量,已经超过了美国现有发电厂总装机量。也就是说,排队的队伍比电网本身能承载的还要长。

    电费在疯涨

    在这种背景下,科技公司和开发者等不及了,开始转向”表后发电”(behind-the-meter)——在自己数据中心园区里自建电站。这种做法通常更贵、也更复杂,但没办法,等不起。

    代价是电费在疯涨。根据彭博社的数据,批发电价相比五年前最高涨了267%。数据中心密集的地区,居民电费也在跟着涨,这也是为什么各地开始出现反对数据中心扩建的声浪。

    • 数据中心用电需求2035年前将增长近三倍
    • 批发电价五年最高涨幅267%
    • 电网并网排队已超过电网总容量
    • 科技公司已转向”表后发电”自救

    清洁能源在退潮

    FERC这次出手,背后有能源部长Chris Wright的推动。他去年十月就说过,数据中心并网延误已经威胁到美国在AI领域的竞争力。

    但讽刺的是,就在FERC为数据中心”开绿灯”的同一周,公众对AI和数据中心的态度已经明显转冷。斯坦福大学的一份报告今年四月指出,AI圈内人和圈外所有人之间,存在越来越大的认知鸿沟。

    而特朗普政府的动作则更加直接——本周三,政府宣布将支付7.65亿美元,让开发商Invenergy取消加州、缅因州和纽约附近的海上风电租约。Invenergy说,这笔钱将用来在中西部建天然气电厂,在西部建地热项目。

    算下来,特朗普政府现在已经花了大约26亿美元,用来”搞掉”海上风电项目。

    所以现在的情况是:一边是联邦层面为AI数据中心”开绿灯”接电,另一边是同样级别的联邦政府出钱拆清洁能源项目。AI数据中心的电从哪儿来?答案可能越来越偏向化石燃料。

    FERC的命令能在多大程度上加速数据中心并网,还得看电网运营商怎么执行。但方向已经很清楚了:AI基础设施被上升到了”国家竞争力”的高度,监管在为它让路。


  • 在亚马逊支持数据中心监管,三个工程师被叫去HR「喝茶」了

    在亚马逊支持数据中心监管,三个工程师被叫去HR「喝茶」了

    三个亚马逊软件工程师上个月跑去西雅图市议会听证会上发言,支持对数据中心建设加一道监管。一周后,他们每人都被叫去和HR开了一次”即兴会议”——会上告诉他们:公司正在调查你们,处罚随时可能来,包括解雇。

    这件事发生在6月10日。刚好是市议会通过数据中心暂停令(moratorium)的第二天。

    亚马逊员工因支持数据中心监管面临解雇
    亚马逊员工在数据中心监管问题上的处境(配图由AI生成)

    他们说了什么?

    这三个工程师分别叫Patrick Schloesser、Darius Irani和Liesl Wigand。他们在听证会上发言时,开场白引用了西雅图本地一条法律——这条法律禁止雇主因为员工的政治言论而歧视他们。

    他们发言支持的内容,是西雅图市议会正在讨论的一项紧急禁令:暂停新建功率超过20兆伏安的大型数据中心,时限一年。这个禁令背后是当地居民和环保团体对数据中心能耗和用水压力的担忧。

    西雅图是全美AI基础设施扩张最激烈的城市之一。亚马逊总部就在这里,数据中心建设直接关系到这家公司的核心业务扩张能力。

    HR说了什么?

    6月10日,三个人各自被叫去和亚马逊的”员工关系部”(Employee Relations)开会。HR代表告诉他们,公司正在调查,可能会有纪律处分,最严重的后果是解雇。

    一周后,他们正式向西雅图民权办公室提交了法律申诉,指控亚马逊违反了禁止基于政治活动进行就业歧视的地方法律。

    Patrick Schloesser对外媒说了一句挺硬的话:”我不愿意接受这样一种现实——亚马逊或者任何一家公司,可以因为我在行使自己的权利就把我噤声。我们不会乖乖回去排队。”

    亚马逊怎么说?

    亚马逊发言人Margaret Callahan的回应相当标准:员工当然可以自由谈论工作环境,但公司有政策规定,任何以公司代表身份对外发言的行为都必须走流程——他们现在正在调查这三个工程师是否违反了这个政策,至于会不会真的开除,现在还说不准。

    亚马逊还特别否认了”已经决定开除这几个人”的说法。

    但 timing 确实很微妙。听证会是6月3日开的,市议会6月9日全票通过禁令,而 HR 约谈刚好是6月10日。工程师们觉得这不是巧合。

    这件事为什么值得关注?

    往小了说,这是一个劳动纠纷。往大了说,这件事把AI基础设施扩张和本地社区利益之间的张力,用一种非常直接的方式暴露了出来。

    数据中心不是抽象概念——它们消耗大量电力和水,对周边社区的基础设施造成压力。在西雅图这个问题尤其尖锐,因为亚马逊的总部就在这里,它是这座城市最大的雇主之一,也是数据中心建设的主要推手。

    员工站出来支持对雇主不利的监管政策,然后疑似遭到报复——这个剧本在美国科技行业其实不新鲜。但放在2026年这个AI基础设施大扩张的背景下,这件事有了更多的象征意义。

    • AI公司对算力的渴求,正在把数据中心建设推向前所未有的规模
    • 各地社区开始意识到:这些数据中心的能耗和用水,代价是本地居民在承担
    • 科技公司的员工,正在试图用政治参与的方式影响公司的扩张行为
    • 而公司如何回应”不乖”的员工,将成为一个越来越敏感的问题

    这件事目前还在法律程序初期,西雅图民权办公室是否正式立案调查,还需要一段时间才能知道。但这三个工程师愿意站出来公开指控,本身就已经把”科技公司员工能否自由表达对雇主不利的政治立场”这个问题,摆到了台面上。

    数据中心的争议不会只有这一回。随着AI算力需求继续膨胀,会有更多城市面临和西雅图一样的选择题:要科技公司的税收和就业,还是要对能耗、用水和社区影响的监管权。而员工在这场博弈里站在哪一边,也会变得越来越复杂。

  • 西雅图紧急叫停新建数据中心:AI热潮下,这座城市选择先停下来想想

    西雅图紧急叫停新建数据中心:AI热潮下,这座城市选择先停下来想想

    西雅图数据中心
    西雅图市议会通过紧急禁令,暂停新建大型数据中心(配图由AI生成)

    6月9日,西雅图市议会做了一件在全美范围内都相当罕见的事——针对大型数据中心的建设,全票通过了一项紧急禁建令,立刻生效,先停一年再说。

    这个禁令针对的是功率容量超过20兆伏安的大型设施。说白了,就是那些为训练大模型而建的AI数据中心,普通的服务器机房不在此列。

    369兆瓦,相当于30万户家庭的用电量

    禁令背后有一组很具体的数字。今年4月,有四家公司接洽西雅图城市照明局(Seattle City Light),提出建设五座大型数据中心的计划。这五座设施的最大电力需求加起来是369兆瓦——够30万户普通家庭用。

    西雅图全市才多少人口?大约75万人。也就是说,这几座数据中心如果全建起来,消耗的电力相当于全市相当一部分居民用电的总和。电价会怎么变?市政电网扛不扛得住?没人知道,因为还没有人认真算过。

    “大型AI数据中心正在全美各地冒出来,推高了居民和小企业的公用事业成本,同时还制造了空气、水和噪音污染。西雅图人不应该用自己的钱包去补贴AI热潮中大型企业的创纪录利润。”
    ——市议员Eddie Lin(第2选区,土地使用委员会主席)

    连亚马逊的员工都站出来支持禁令

    这件事最耐人寻味的地方在于,支持禁令的最积极的一群人里,居然包括亚马逊的员工。

    亚马逊在西雅图是最大雇主之一,而亚马逊本身就是数据中心的最大使用者之一。按理说,员工应该站在公司一边,帮公司争取更多的数据中心建设空间。但这一次,亚马逊员工选择站在了居民这一边,多次出席市议会听证会,表态支持禁令。

    他们的逻辑并不复杂:数据中心的电力和冷却成本,最终会摊到所有用电户头上,包括他们自己。AI热潮带来的收益归科技公司,账单却寄到了每个居民的邮箱里。这笔账,算不过来。

    禁令不是永久的,但信号很明确

    这次通过的禁令时限是一年,必要时可以再延长六个月。在此期间,西雅图市政府会做一件事:把大型数据中心对电网、水资源、电价、土地使用、就业和公共健康的影响,系统地研究一遍。

    陪同禁令一起通过的还有一项政策框架决议(Resolution 32204),由第5选区市议员Debora Juarez牵头,明确要求以”西雅图价值观”来审视任何未来的数据中心提案。

    市议长Joy Hollingsworth说得很直白:”技术跑得很快,但我们的责任是确保增长不会以居民和电力用户的利益为代价。这一年给我们机会在做出永久性决定之前,先把影响搞清楚。”


    这件事为什么值得关注

    西雅图不是第一个面对数据中心扩张压力的城市,但它是第一个以全市议会全票通过的方式,正式按下暂停键的主要科技城市。

    这个先例一旦立起来,其他城市——尤其是那些同样在被数据中心”找上门”的地方——很可能会跟进。俄勒冈、弗吉尼亚、得克萨斯,各地都在面对同样的问题:科技公司要建数据中心,电从哪来?水从哪来?账单谁付?

    西雅图给出的答案是:先别急,让我们先弄明白再说。

  • SpaceX把AI算力租给了Anthropic和谷歌,年收150亿美元

    SpaceX刚刚完成史上最大规模的IPO,马斯克也借此成为全球首位万亿富翁,公司另一边却在悄悄处理一件相当尴尬的事——原本打算用来训练前沿AI模型的算力集群,因为延迟和硬件问题,现在租给了Anthropic和谷歌。

    算力蓝图撞上了现实墙

    据彭博社援引匿名消息人士报道,SpaceX原计划使用一个由三个数据中心园区组成的算力集群来训练自己的最前沿AI模型。这个计划的核心是把Colossus 1和另外两个距离超过10英里的站点连在一起,组成一个超级算力池。

    问题从连接开始。三个站点之间超过10英里的物理距离导致了不可忽视的网络延迟,而园区里老化的网络基础设施让情况雪上加霜。再加上不同站点之间硬件配置存在差异,整个集群没办法按照预期那样协同工作。

    SpaceX Colossus AI数据中心
    SpaceX的Colossus 1数据中心园区(The Verge)

    算力租出去了,价格不菲

    遇到这些问题之后,SpaceX没有继续死磕,而是把算力租了出去。两笔租赁协议都是在与硬件差异和延迟问题打交道之后才达成的。

    • Anthropic:年租金150亿美元,用SpaceX的算力训练Claude模型
    • 谷歌:月租金9.2亿美元,用于谷歌自己的AI训练需求

    这两笔交易加在一起,意味着SpaceX的算力集群每年至少能带来超过250亿美元的收入。但对于一家刚刚把AI作为核心战略的公司来说,把最先进的算力租给竞争对手,怎么看都有点无奈。

    Grok也在孟菲斯碰了壁

    SpaceX在孟菲斯开发和运行Grok AI的过程也遇到了麻烦。据报道,公司在那里的运营并不顺利,这也是促使它将算力对外出租的另一个背景因素。

    SpaceX虽然有卫星AI服务器的宏大规划,但现实中的算力基础设施挑战比预想的要复杂得多。延迟、硬件差异、老化设备——这些问题不会因为你是SpaceX就自动消失。

    AI算力的门槛比想象中高

    这件事其实折射出一个更大的问题。现在各家科技公司都在疯狂砸钱建AI算力,但真正能把算力用好的门槛非常高。网络架构、硬件一致性、冷却系统、供电能力——任何一个环节掉链子,整个集群的效率就会大打折扣。

    SpaceX把算力租给Anthropic和谷歌,至少能保证这些昂贵的设备不停着吃灰。至于SpaceX自己的AI野心什么时候能落地,目前看来还得再等等。