标签: Neocloud

  • 16.5亿美元买下Ray背后的团队,这家算力公司想把整条链吃掉

    Nscale以16.5亿美元收购Anyscale
    卖算力的公司,开始往软件层爬。图片来源:TechCrunch

    英国算力新贵 Nscale 掏了 16.5 亿美元,把软件公司 Anyscale 买了下来。金额来自彭博社援引匿名信源的报道。

    这笔交易本身不算特别大,但它透露的意图挺清楚:单纯出租 GPU 已经不够看了,算力厂商想把客户那笔 AI 预算里更多的部分留在自己口袋。

    Anyscale 是谁?答案藏在 Ray 里

    做 AI 工程的人对 Ray 这个名字应该不陌生。它是伯克利那边出来的开源分布式计算框架,用 Python 写,专门解决”一台机器跑不动,那就把活儿拆到一堆机器上”这类问题。Anyscale 就是 Ray 原班团队创立的公司。

    公司最早的定位是给那些需要海量算力的项目提供运行平台。2022 年 GPT-3 把大模型推到聚光灯下之后,Anyscale 转了个弯,业务重心挪到围绕大模型的训练与推理服务、数据清洗整理、强化学习这些活儿上。平台整个建在 Ray 之上,对外提供开发工具、可观测性和调度编排。

    Anyscale 在声明里说:合在一起之后,我们可以和 Nscale 一起设计软件层以及底下的基础设施,而这件事任何一方单独优化自己那一层都做不到同样的效果。

    Nscale 想要的是一整条链

    Nscale 属于业内所说的 neocloud——不做通用云,专门围着 AI 算力做生意的新一代云厂商。它的打法一直是往上下游延伸,能自己干的绝不外包。

    目前它已经铺开的业务线包括:

    • 能源:从电这一端就开始掌控成本;
    • 数据中心:自建自营,不租别人的机房;
    • 编排软件:管好机器和任务的调度;
    • 吃下 Anyscale 之后新增的一层:工作负载管理与弹性扩缩。

    这条链拼完,客户从插上电到跑起模型,理论上都能在 Nscale 体系内完成。对于一家靠卖算力起家的公司来说,往软件层走意味着毛利结构会好看不少,客户黏性也完全是另一个量级。


    钱从哪来:一年之内融资、发债、买公司

    Nscale 今年 3 月刚拿到 20 亿美元 C 轮,估值 146 亿美元。投资方名单挺能说明问题:英伟达、诺基亚、Blue Owl、戴尔,还有挪威工业集团 Aker。此外它还做了多笔债务融资——循环信贷、7.9 亿美元的挪威项目贷款、14 亿美元的延迟提取定期贷款。

    这些钱一直在花出去。它先后和微软、英国电信(BT)、Nordcraft 签下算力与数据中心合作。这次收购 Anyscale,是同一套思路的延续。

    被收购方的成绩单也不差。Anyscale 在 2022 年 C 轮时估值 13.8 亿美元,公司称最近一个季度的营收环比增长了 70%。换句话说,16.5 亿美元的价格相对四年前的估值只是小幅溢价,但买到的是一条正在加速的增长曲线。

    200 人全部过去,牌子不摘

    Nscale 表示 Anyscale 会继续以自有品牌运营,现有客户照常服务,大约 200 名员工全员加入 Nscale。这种”保留品牌 + 全员留任”的安排,通常说明买方要的是团队和技术栈本身,而不是想把客户名单吸干后关掉。

    对开源社区来说,短期内 Ray 的走向可能是个值得留意的点——一个被算力厂商收编的商业公司,会怎么平衡开源项目的中立性和母公司的硬件偏好,这事儿以前在别的项目上有过不少前车之鉴。

    放大一点看,这几年 AI 基础设施领域的并购逻辑正在从”抢机器”变成”抢那层把机器变好用的软件”。谁能让客户少踩坑、少浪费卡,谁就能在下一轮价格战里活得舒服些。

  • 帮AI云提速的网络自动化公司Netris,刚拿了a16z的1500万美元

    AI neocloud网络自动化概念图
    Netris平台提供数据中心网络抽象与硬件加速自动化(图源:Netris)

    AI热潮之下,人人都想开数据中心。问题是,GPU买到了,机房租好了,真正能把集群跑起来、开始对外提供算力服务,中间还有很长一段路。

    网络配置、存储对接、多租户隔离——这些脏活累活能把一支工程师团队耗上好几个月。而GPU这东西,闲着就是烧钱。谁先上线,谁就能先产生收入。

    不是SDN,是硬件加速的”SDN”

    Netris做的事情很简单:让数据中心网络配置自动化。他们的软件跑在网络交换机上,把设置、配置、日常运维全部自动跑起来,帮neocloud运营商把上线周期从几个月压缩到几周甚至几天。

    CEO Alex Saroyan说了一句很实在的话:AI场景下的网络,纯软件方案不够用,流量太大了,必须硬件加速。传统数据中心用的SDN(软件定义网络)在AI时代已经跟不上了。Netris提供的就是”像SDN一样灵活、但是完全硬件加速”的方案。

    “AI不是确定性的,它有时候会自己’发挥’,做创意工作很好,但改几千条交换机配置的时候,你不需要它有创意,你需要它非常稳定、可重复。”——Netris CEO Alex Saroyan

    Nvidia先成了他们的推销员

    这个故事最有意思的部分在这里:两年前,Nvidia看到Netris的演示后印象深刻,主动把这家公司推荐给了自己的好几个客户。

    目前Netris已经在全球35个以上的GPU集群上线,涵盖约100万颗GPU,客户名单里有Lightning AI、Foxconn、HPE、Tensorwave、Telus等。Nvidia自己不做这块,但它知道客户有这个痛点,所以帮Netris打开了门。

    Netris的平台是供应商中立的,不管用的是Nvidia还是AMD的服务器,都能跑。这对neocloud运营商来说是个实用的卖点——他们往往同时跑多种硬件。

    a16z为什么要投

    Neocloud这个概念火了以后,市场上冒出了不少玩家——专门做AI推理或训练的云服务商,跟AWS、Azure这种大厂错位竞争。但这些玩家很多是AI或算力公司出身,网络这块并不是他们的强项。

    Netris相当于给这些neocloud提供了一套”开箱即用”的网络自动化平台。a16z合伙人Guido Appenzeller将加入Netris董事会,他在声明里提到,AI基础设施的下一波竞争,很大程度上会落在谁能更快、更高效地把算力交付给客户。

    顺便说一句,Netris成立已经8年了,做网络自动化比AI boom早得多。他们用的都是自研算法,没有往里面堆大模型。Saroyan的态度很明确:改交换机配置不需要AI来”创意”,需要的是稳定和执行力。


    • Netris此轮融资1500万美元,由a16z领投
    • 平台已在35+个GPU集群、约100万颗GPU上部署
    • 核心差异化:硬件加速网络自动化,适配Nvidia和AMD环境
    • Nvidia曾主动向客户推荐Netris