
过去两年,科技圈聊算力短缺,默认指的都是 GPU——训练大模型要用、跑推理也要用,英伟达的卡一卡难求。但《The Information》8 月 7 日捅出的一件事有点反直觉:亚马逊云(AWS)内部现在开始缺 CPU 了。不是显卡,是那颗支撑了互联网二十年的普通处理器。
等一台 CPU 服务器,要从几小时拖到好几天
据知情人士透露,AWS 高管今年 5 月就把工程师叫来开了个会,传达的口风相当直白:为了确保 EC2 业务将来能接住所有客户需求,大家得想尽办法省算力,而且省的不只是 AI 芯片,连传统 CPU 服务器也明确点名了。此后 AWS 给各个团队下了截止期限,要求今年晚些时候砍掉闲置的计算占用,把腾出来的资源挪给外部客户。
一位在 AWS 干了多年的工程师说,过去申请一台 CPU 服务器几小时就能拿到,如今要等上好几天,这是他职业生涯里头一回遇到。他直言这种等待已经影响到项目交付节奏。AWS 对外回应倒是很淡定,说即便需求很大,也还能满足“绝大多数”内外部客户,指导方针没变。但一个细节很说明问题:原本靠折扣甩卖、两分钟就能收回的“竞价实例”(Spot Instances),最近越来越难成批拿到了。
AI 咨询机构 Elendil Labs 的联合创始人 Jing Xie 观察到,客户的人均 IT 支出直接翻倍,背后的推手正是 AI Agent 的大规模使用。
AI Agent 成了隐藏的 CPU 吞噬者
这事的根子,是 Agentic AI 正在大面积铺开。越来越多公司的员工开始用 AI 智能体帮自己写软件、跑流程,而一个 Agent 干活时调用的云资源远比人想像的多,而且对 CPU 是持续性的渴求。哪怕在模型训练的准备阶段,也得靠 CPU 从文档、图片和视频里把原始数据读出来。
换句话说,GPU 负责“思考”,CPU 负责“打杂”——喂数据、管调度、跑周边服务。当 Agent 数量暴涨,打杂的活儿也跟着塌方,压力就从显卡一路漫到了整座机房。
- 外部客户目前受影响还有限,合同承诺的算力基本没出问题;
- 但竞价实例越来越紧,说明 AWS 整体供需缺口在收窄,弹性空间被压薄;
- 除了 CPU,配套的内存芯片和数据中心物理空间也在添乱。
芯片厂的数据也在印证这件事
英特尔给出的数字很直观:今年 4 月,CEO 陈立武(Lip-Bu Tan)说 AI 推理里 CPU 和 GPU 的用量比是 1 比 4;到了 7 月,CFO David Zinsner 改口说这个比例已经接近 1 比 1。AMD 和 Arm 的高管也表达了类似判断。短短三个月,CPU 的存在感翻了好几倍。
算力在内外部分配上的拉扯,其实不是 AWS 一家的事。谷歌去年专门拉了个高管委员会,在云业务、DeepMind 和消费者业务之间协调算力,明星研究员 Noam Shazeer 夏天就因为拿不到足够算力而离职;微软那边则是另一个故事,CFO 把 Azure 的增长部分归功于 CPU 和 GPU 机群管理上的“效率提升”。








