标签: AI融资

  • MiniMax一轮融了160亿港元,创始人说AGI之前不领工资

    国产大模型公司 MiniMax 在 7 月 10 日甩出一颗「资本炸弹」:完成一轮总规模约 160 亿港元(约合人民币 138 亿元)的融资。放在港股,这是个相当吓人的数字——而且它距离今年 1 月登陆港交所,才过去半年。

    钱从哪来,又去哪了

    这轮融资拆成两部分:配售 3560 万股新 A 类股份,每股 268 港元,募资约 95.4 亿;再发一笔 65 亿港元、2027 年到期的零息可转债券。两笔加一起,净募资差不多 159.6 亿港元。认购相当火爆,机构申购倍数达到 7 倍,主权基金、长线机构、中资机构和多策略基金都挤了进来。

    「从我写下这封信起,到公司实现 AGI 的那一天,我将不再从公司领取任何薪酬。」——MiniMax 创始人闫俊杰内部信

    创始人把身家也押上了

    更抓眼球的是闫俊杰那封内部信。他宣布 AGI 实现前零薪酬,还拿出个人名下相当于总股本 5% 的股份——4% 给核心团队做激励,1% 设成开源社区专项基金。对一个刚上市半年的创始人来说,这更像是给市场和团队的一颗定心丸。

    • 募资净额里约 80%(127 亿港元)砸向 AI 基础设施和模型研发
    • 约 10% 用于 AI 原生产品 Harness 的全球化商业落地
    • 到 6 月底,IPO 时那笔钱里用于基建和研发的已经花掉 77%

    大模型这场仗,烧钱速度比谁都快。MiniMax 手里现金更厚了,但对手也没闲着——同一赛道里智谱的市值已经冲到七千多亿港元。160 亿能让 MiniMax 多跑一阵,但真正决定胜负的,还是模型本身好不好用。

    MiniMax完成160亿港元融资
    MiniMax 完成 160 亿港元融资,创始人宣布 AGI 前不领薪
  • 一家「原生 AI 律所」拿到 12 亿美元估值:不按小时收费,按结果算账

    法律 AI 这条赛道又冒出一只独角兽。一家叫 Norm 的公司把律师和 AI 智能体塞进同一个平台,还让 AI 去监督别的 AI,本周拿下了 12 亿美元的估值。它最反传统的做法,是不按小时收费,而是按结果算账。

    一笔带着「跨界钱」的融资

    Norm 这周宣布完成 1.2 亿美元 C 轮,由 Khosla Ventures 领投——这家机构也是 OpenAI 最早的机构投资方。成立不到三年,估值已经冲到 12 亿美元,正式跻身独角兽行列。投资方阵容很特别:黑石前总裁 Tony James、Kirkland & Ellis 前主席 Jeff Hammes 以个人身份入局,Bain、Coatue、Vanguard、纽约人寿、TIAA 这些金融和老牌律所背景的机构也跟了。算上这轮,Norm 累计融资已经超过 2.6 亿美元。

    它到底在做什么

    Norm 搭了一家叫 Norm Law 的「原生 AI 律所」,底层跑的是自家研发的 AI 智能体,再配真人律师在旁边盯着、校准。企业客户把法律活儿交给它,它用智能体去起草、审阅、跑流程。更往前一步的是,Norm 还在做能监督其他 AI 智能体的「上层智能体」——当别的公司把 AI 放到越来越要紧的岗位上,Norm 的 Agent 可以替你看看它们干得合不合规。

    「随着 AI 能力往前冲,最大的机会之一,是搭起 AI 与法律——人类价值观最权威的载体——之间的接口。」—— Norm 创始人兼 CEO John Nay

    AI 智能体监督法律工作的概念图
    AI 智能体彼此监督:当 AI 接管要紧岗位,谁来替企业把关合规

    不按小时,按结果

    最反传统的其实是收费方式。整个行业都在按小时计费,Norm 偏要按「结果」收费。它创始人说,这样 AI 带来的效率和质量提升,能直接落到客户头上,而不是变成律所和模型厂商的计时小费。目前它的客户管理着超过 30 万亿美元的资产,把 Norm 的 AI 智能体直接用在自家法务团队里。


    法律赛道为什么突然挤破头

    Norm 不是孤例。Harvey、Legora 这两年都冒了出来,盯着同一块肥肉:把合同审阅、尽调、合规这些又繁琐又烧钱的活儿自动化。但 Norm 的打法更激进——它不只是在工具层面帮忙,而是干脆自己下场开了一家 AI 律所,把「人机协作 + 结果计费」做成了整套运营模式。在监管越来越重、企业又怕 AI 乱来的当口,这种「既用 AI、又有人兜底」的叙事,恰好戳中了大买家最在意的信任问题。

  • 14个人服务890万开发者:Ollama拿下6500万美元B轮,押注开源模型随处跑

    先说个数字:14个人,撑起890万开发者每月都在用的工具。这不是哪家巨头的内部团队,而是开源AI工具Ollama的全部家当。就在这周,这家公司拿到了6500万美元的B轮融资,领投方是Theory Ventures。

    Ollama开源AI工具融资示意图
    Ollama让开源模型在任何地方都能跑起来

    算上之前Benchmark领投的1500万美元A轮,Ollama目前累计融资8800万美元。当年领投A轮的Peter Fenton这次也进了董事会。创始人兼CEO的Jeff Morgan把话说得很直白:开源模型就该好跑、好用、随处可用——你自己的电脑上、云端,或者两头都用。

    从Docker到开源模型,这俩人干的是同一件事

    Ollama是2023年上线的,干的活很简单:帮开发者在自己的PC上跑开源权重模型,几分钟就能装好用起来。GitHub上攒了17.6万颗星、近1.7万个fork,各种教程、视频、博客里都在夸它。

    这种”把复杂的东西变简单”的路数,Morgan和联合创始人Michael Chiang早就玩过一遍。他们之前做的Kitematic被Docker收购,两人随后帮着做出了Docker Desktop——那个如今每天有一千多万开发者在用的工具。Docker当年把云应用从繁琐的硬件配置里解放出来,Ollama现在对开源AI做的是同一件事。

    “2023年开源模型开始冒出来,但真的很难用。它们当时是给研究员准备的,不是给程序员的,想跑起来特别费劲。”——Jeff Morgan

    免费工具怎么变成生意

    现在Ollama每月有890万开发者在用,比今年1月翻了差不多一倍,每周还新增将近100万次安装,社区做出来的集成超过6.7万个,覆盖了《财富》500强里85%的公司,连医疗、金融、政府这些强监管行业都在用。而这一切,团队只有14个人。

    光靠免费的本地工具当然赚不了钱。Ollama的商业化藏在云端:本地机器扛不住更大的模型时,可以直接切到它的云上跑,同一套操作,按GPU时长计费而不是按token。这套逻辑跟主流按token收费的做法明显不一样。

    • 免费版:本地运行 + 一定的云端GPU时长
    • Pro版:每月20美元,可同时跑3个云端模型,云用量是免费版的50倍
    • Max版:每月100美元,可同时跑10个云端模型

    Morgan说,Ollama作为一门生意的转折点大概在今年1月,OpenClaw火起来那阵子——更大的开源模型突然能干agentic的活了,比如写代码。这也踩中了整个行业的大趋势:据Grand View Research,AI推理市场2024年约970亿美元,到2030年预计冲到2540亿美元,年复合增速约17.5%。随着Meta、Mistral、DeepSeek这些开源模型和闭源系统的差距越缩越小,越来越多的钱正流向”开发者选择在哪里跑模型”这件事上,而这正是Ollama想占的位置。


    当然,这条赛道并不空。Hugging Face融了超过3.95亿美元,主要做模型仓库;Together AI最近以83亿美元估值拿了8亿美元,扩云端训练和推理。Ollama和Morgan都没透露这轮的估值和收入。但14个人对890万开发者这个比例本身,可能才是这轮融资背后最值得琢磨的故事。

  • Etched走出隐身:50亿美元估值、10亿美元订单,专打AI推理芯片

    一家芯片公司从隐身模式里走了出来

    Etched这家公司以前低调得很,但最近它直接把成绩单摊在了桌上:芯片已经由台积电成功制造出来,累计拿下了10亿美元的系统订单,整体估值也到了50亿美元。它的方向很专注——做Transformer推理专用的芯片和整机系统,专门帮前沿模型更快、更便宜地跑推理。

    所谓推理,就是用户输入问题后模型真正生成答案的那一步。对今天的AI公司来说,这一步既是用户体验的瓶颈,也是最大的成本中心。谁能把推理成本压下去,谁就能让大模型服务更便宜、响应更快。Etched赌的正是这一点。

    Etched已签10亿美元客户订单,累计融资8亿美元,最新一轮由Stripes领投,投后估值50亿美元。

    这家公司2022年成立,创始人Gavin Uberti和Robert Wachen都是哈佛辍学生,后来拿了Peter Thiel的Thiel Fellowship。其实他们早在2024年就跟TechCrunch聊过芯片计划。那时候他们已经从Primary Venture Partners等投资人手里拿到超过1.25亿美元。不过据他们在Patrick O’Shaughnessy的播客里回忆,2023年最初融资时非常艰难,他们拿着30页备忘录讲“AI未来需要专用芯片,而不是通用GPU”,结果几乎每个大投资人都拒绝了。

    投资人名单豪华,但市场考验才刚开始

    现在融资环境完全是另一个世界。Etched披露的累计融资额是8亿美元,其中去年12月那轮未公开的融资由Stripes领投,金额约5亿美元,估值50亿美元。参与方包括VentureTech Alliance、Jane Street、Hudson River Trading、Two Sigma、Ribbit Capital,以及Andrej Karpathy、Geoffrey Hinton、Fei-Fei Li、Arthur Mensch、Scott Wu等AI界名人。Peter Thiel和Stanley Druckenmiller也在股东名单里。

    不过融资热归融资热,芯片能不能真正兑现性能,还需要独立测试。Etched目前在做的是“前沿推理集群”——把芯片、定制机柜和软件打包成一套系统。它说自己比Nvidia的GPU更快、更省电、更便宜,但这些数字来自公司自己,真实世界表现还得等客户大规模部署后才能验证。

    AI推理芯片概念图
    专用AI推理芯片正试图从通用GPU手中抢走推理市场。

    在这个赛道里,Etched不是孤例。Cerebras今年率先IPO,Groq刚刚完成6.5亿美元融资,亚马逊、Google、微软都在做自己的AI芯片,OpenAI也推出了和Broadcom合作的首款定制芯片。推理芯片的竞赛正在升温,每家公司都在赌自己的路线。


    对AI行业来说,推理芯片的稀缺性正在被放大。训练一度是最大难题,但现在越来越多公司发现,真正烧钱的其实是服务用户时的推理。Etched的崛起说明,资本市场已经把这个环节视为下一个主战场。至于它能不能撼动Nvidia,还要看第一批客户订单交付后的实际表现。

  • 一家AI代理公司让自家Agent去拉融资:130个投资人,它一个人都没见

    AI代理自主融资概念图
    AI代理SivaClaw主导Lyzr的1亿美元融资路演(概念图)

    这事儿巧得有点剧本感。据彭博的报道,一家叫Lyzr的新泽西创业公司,干了件挺绝的事:它自己是帮企业搭AI代理的,结果这一轮融资,它让自己的AI代理去拉。系统叫SivaClaw, reportedly 对接了130多个投资人,起草投资备忘录,甚至还能追踪哪些slide投资人停留得久。

    它把自家产品的路演,变成了产品演示

    Lyzr是个成立三年、base 在新泽西Jersey City的公司。这一轮是1亿美元的B轮,估值大概5亿美元。SivaClaw基本扛起了整个融资的”前锋”角色——回答问题、写材料、盯数据,一条龙跑完。对一家卖AI代理的公司来说,没有比”用自家代理融到钱”更顺滑的广告了。

    最耐人寻味的不是它干了多少活,而是创始人几乎没费腿脚。Lyzr对彭博说,他们从硅谷、中东和金融圈捞到了4亿美元的意向,全程没有哪个创始人飞出去,去Sand Hill Road挨家挨户喝咖啡、找人暖场介绍。

    真正的主线,是钱多到追着AI跑

    把这事单独看,是个很酷的产品故事;放到大环境里看,它其实在说另一件事。当下追着AI下注的资本实在太多,以至于一个有真实traction的创始人,连办公室椅子都不用离开,就能把九位数的钱聊下来。SivaClaw只是把这种”钱追项目”的失衡,用一种戏剧化的方式演了出来。

    AI代理正在一口口吃掉过去的白领工作,这点我们已经听了很多遍。但融资这件事,历来靠的是人脉、信任和一次次面对面磨出来的化学反应。当一个代理能代创始人去应对投资人、起草备忘录,说明连这块高度依赖”人”的地盘,边界也在往后退。

    但拍板的那一下,AI还替不了

    冷静一点看,这里头也有需要打个问号的地方。SivaClaw能写材料、能问答、能统计slide停留时长,可投资人最终掏钱,靠的是对创始团队的信任——这种信任往往是酒会、邮件往来和一次次坦诚沟通攒出来的,暂时还不是代理能生成的。

    资本愿意为”AI替我跑融资”这个故事买单,本身就已经说明市场热到了什么程度。比起 agent 真的解放了多少劳动力,更值得盯的是:这股热钱会不会把”会讲故事”和”真有产品”混为一谈。

    对Lyzr来说,最值钱的不是那1亿

    回到公司本身,这笔融资最划算的地方,是把它”产品能真干活”这件事,变成了活生生的案例。一个帮企业造代理的平台,自己先用代理跑通了最难的融资关,这套叙事拿去敲任何企业客户的大门都好使。


    不管你信不信”代理能替人融资”,Lyzr这波操作都给所有AI公司提了个醒:在资本这么拥挤的赛道里,最好的产品演示,可能就是你拿它把自己最头疼的那件事给办了。

  • 巴黎一家语音AI公司,拿了英伟达的钱,还要跑去湾区抢人

    AI语音这条赛道,最近又冒出一笔不小的融资。巴黎初创公司Gradium这周宣布,把原本关掉的种子轮重新打开,新拉进来英伟达等投资人,整轮累计融到1亿美元。

    钱要花在刀刃上

    Gradium自己说,这笔钱主要用来在旧金山湾区开个办公室、就近抢人——原话挺直白,叫”把自己摆在全世界最领先AI生态圈的正中心”。这话挺有意思:巴黎明明是欧洲AI的重镇,可真要拼人才,还是得贴着Anthropic、Google、Meta、OpenAI这几家巨头才踏实。

    从实验室里长出来的公司

    Gradium并不是凭空冒出来的。它去年12月才结束隐身状态,最初那7000万美元,投资方名单就相当豪华:FirstMark Capital、Eurazeo、DST Global Partners,还有Eric Schmidt和法国电信大亨Xavier Niel。再往前,它是从法国AI实验室Kyutai分拆出来的——两家公司的联合创始人Neil Zeghidour,早年在Google Brain、DeepMind、Facebook都待过。

    AI语音技术与神经网络融合概念图
    Gradium主打超低延迟的AI语音模型,背后站着英伟达

    他们做的事,说白了就是”让AI说话不卡顿”。Gradium做的语音模型主打超低延迟,声音几乎秒回,没有那种在AI对话里经常冒出来的、让人尴尬的停顿。听着简单,可对语音代理来说,这几毫秒的差距,往往就是”像真人”和”露馅了”的分界线。

    对手可不弱

    这条赛道早就挤满人了。光是ElevenLabs,今年2月就靠着红杉的5亿美元把估值冲到110亿;更别提Google Gemini这种自带语音基因的巨头。不过Gradium好像还真撕开了口子——从去年12月发布到现在,它已经拿下包括雷诺在内的几个大客户。


    1亿美元对一家还叫”种子轮”的公司来说不算小,但在语音AI这场仗里,能不能靠低延迟真正站稳,才刚开场。

  • Ollama 又融了 6500 万美元:让开发者在自己电脑上跑大模型,这门生意成了

    在个人电脑上运行开源大模型的 Ollama
    在个人电脑上跑开源大模型,Ollama 想做成 AI 时代的「Docker」

    Ollama 这家公司的名字,做 AI 开发的人基本都听过,圈外知道的不多。最近它宣布完成 6500 万美元的 B 轮融资,领投方是 Theory Ventures。加上之前 Benchmark 的 Peter Fenton 领投的 1500 万 A 轮,这家公司前后总共融了 8800 万美元。

    从 Docker 出来的团队,给 AI 干了件类似的事

    Ollama 在 2023 年上线,做的事情其实很朴素:让开发者在自己的电脑上,几分钟就把开源大模型跑起来。它在 GitHub 上攒了 17.6 万颗 star、将近 1.7 万个 fork,被无数教程、视频和博客拿来当范例。

    创始人 Jeff Morgan 和 Michael Chiang 之前都在 Docker 干过,做过 Docker Desktop,后来公司被 Docker 收购。所以 Ollama 对 AI 模型干的事,基本就是 Docker 当年对云计算干的事——把那些麻烦的硬件配置、环境差异全给你屏蔽掉,开发者只管跑。

    「2023 年开源模型就出来了,但那时候真的很难用,都是给研究人员准备的,不是给程序员用的。想把它们跑起来特别费劲。」Morgan 说。

    近 900 万月活,团队却只有 14 个人

    上线三年,Ollama 现在每个月有 890 万开发者在用,85% 的财富 500 强公司都在用,而背后撑起这一切的团队,只有 14 个人。它能长到这么快,靠的就是「在本地电脑上更顺手地搭 AI」这件事本身的需求。

    商业模式上,桌面免费版一点没变,赚钱靠的是云端订阅,从免费到每月 100 美元分几档,按 GPU 时长而不是 token 计费。那些太大、在自己电脑上跑不动的开源模型,Ollama 就帮你在它的云上找算力跑。

    企业开始认真考虑「用便宜的,留贵的」

    Morgan 把 Ollama 真正像个生意跑起来,归因于今年 1 月 OpenClaw 爆火。那之后,开源模型突然能做 agentic 任务了,比如写代码,企业开始认真琢磨:是不是能把日常活儿交给更便宜的开源模型,只在必要时才掏钱用 Anthropic 那种闭源模型。

    Fenton 的观点是,开源和闭源不是二选一,两边都有的赚。但他也点出一个现实:凡是推理成本高、也就是用模型烧钱烧得狠的公司,都有一股「生存级」的动力往开源权重模型上搬。


    免费的还免费,但「开发工具堕落」的骂声已经有了

    不是所有粉丝都买账。大概一年前,就有一批博客和论坛帖子吐槽 Ollama 的云服务,说它把精力从心爱的免费项目上挪走,把这股风气叫「开发工具的 enshittification(逐渐变烂)」。

    Morgan 不这么看,他说云端是开源使命的延伸——那些顶尖的大模型你自家电脑跑不动,「那我们就帮你把算力找来」。Fenton 也补了一句:桌面上的免费核心产品,前提一点没变,该发现模型、该跑本地模型,还是那个地方。

    不管争议怎么走,Ollama 都算是 AI 催生出来的那一拨「开源项目长成公司」里的最新样本。和它差不多的还有做推理的 Inferact(vLLM)、RadixArk(SGLang),以及从零训自己开源模型的 Arcee。AI 这波浪潮,正在把一批本来免费的工具,一点点变成正经生意。

  • Prime Intellect融资1.3亿美元,帮企业逃离OpenAI和Anthropic

    1.3亿美元、估值10亿,背后站着英伟达和英特尔

    Prime Intellect这家公司做的事听起来有点硬核:它给企业提供算力和一整套专门软件,让这些公司能自己动手训练AI代理。最新一笔钱是1.3亿美元A轮,估值直接站上10亿美元。领投的是Radical Ventures,跟投名单里躺着英伟达创投、英特尔资本、戴尔科技资本、Iconiq,还有一长串创始人天使——Perplexity的Aravind Srinivas、Box的Aaron Levie、Harvey的Winston Weinberg、Cognition的Jeff Wang都来了。

    公司2024年成立,核心念头就一个:让组织不用再依赖那些前沿实验室,也能训出自己的代理系统。这事搁几年前几乎不可能,但强化学习这套”做对了就奖励、做错了就惩罚”的法子成熟之后,企业确实有机会把自己的业务模型打磨成专属的”AI实验室”。

    企业AI代理基础设施概念图
    把算力、强化学习框架和评估工具打包成”全栈”,企业按模块取用

    真正卖点:帮你绕开OpenAI和Anthropic

    底层基础设施那摊事太复杂,绝大多数公司根本没本事把它拼成能上生产的系统,这正好是Prime Intellect切进去的缝。它做的”全栈”包含算力接入、强化学习框架和评估工具,平台像个集市,客户挑自己要的模块,不会被绑死在一整套里。

    Radical Ventures的合伙人David Katz说,别人都只给零碎零件,Prime Intellect的特别之处在于,它把顶级AI实验室的本事做成了”一站式商店”,而且价格企业付得起。

    钱花得值不值,看客户就知道。Ramp、Zapier、Flapping Airplanes都在付钱用它的托管版,这一波 adoption 已经把公司年化收入推到了1亿美元。Ramp拿它搭了个在电子表格里找答案的代理,Ramp联合CEO Karim Atiyeh的说法是:精度压过了前沿模型,速度更快,成本只有零头。


    企业为什么突然想”自己掌握智能”

    • 数据主权:把专有信息喂给OpenAI、Anthropic,企业怕失去对数据的控制权。
    • 断供风险:模型说关就关,上个月Anthropic的Fable就是活例子。
    • 竞争焦虑:Katz反问,我怎么知道合作方不会反过来把我这摊事也做了。

    创始人兼CEO Vincent Weisser把话挑得更明:企业正在集体离开闭源前沿模型,而他的公司就是那个让转型能落地的底座。”不该只有旧金山玻璃塔里那几个极客才配训AI模型,”他说,”每一家企业、每一个国家,都该有这个能力。”

  • 成立不到三年估值翻倍到132亿美元,Lovable做对了什么

    Lovable 氛围编程创业公司
    用大白话描述需求,软件自己就长出来了——这正是氛围编程的卖点

    一家瑞典的”vibe-coding”(氛围编程)创业公司 Lovable,正在谈一轮 3 亿美元的融资,估值直接冲到 132 亿美元——正好是他们去年 12 月 66 亿美元估值的两倍。据 Sifted 报道,领投的是 Menlo Ventures,就是上个月刚宣布募了 30 亿美元新基金的那家。不到一年估值翻一倍,这速度在 AI 应用层里也算扎眼。

    收入跑得比名气还快

    这家成立还不到三年的公司,今年 6 月年化收入跑到了 5 亿美元。它的用户群挺杂:有创始人、独立设计师、做销售的人,拿它来搭网站和电商落地页;它也把工具卖给大公司,Workday、Asana、英伟达都在客户名单里。既有散客又有大单,这让它跟那些只靠个人开发者撑场面的竞品拉开了身位。

    “用大白话描述一下,软件就自己长出来了”——这大概就是氛围编程最直白的注脚。

    为什么”氛围编程”这么值钱

    氛围编程说白了就是用户用自然语言描述想要什么,AI 就把软件给搭出来。这目前是 AI 最火、也最赚钱的应用场景,没有之一。同赛道里早就挤满了高估值玩家:

    • Replit:今年 3 月估值到 90 亿美元
    • Factory:帮企业做 AI 代理,4 月拿了 1.5 亿融资、估值 15 亿
    • Cursor:给开发者做氛围编程,上个月刚被 SpaceX 以 600 亿美元股票收购

    Lovable 这波估值翻倍,本质上是市场在给”AI 让人人都能写软件”这个故事重新定价。当收入跑得快、大企业也愿意买单,投资人自然愿意把赌注加倍。不过氛围编程这行的护城河到底有多深,会不会被大厂自家的 AI 工具一点点稀释,到现在还是个没人能答清楚的问题。


    回头看,Lovable 从去年底 66 亿到如今 132 亿,踩中的是 AI 从”聊天”走向”真把东西做出来”的那股劲。接下来要看的是,它能不能在 Cursor 被巨头收编、大厂工具免费化的夹击下,守住自己的那块地盘。

  • SambaNova再融10亿美元、估值110亿:AI芯片烧到了银行金库

    SambaNova AI推理芯片与本地数据中心
    SambaNova 押注「本地推理」,把大模型放进企业的自有机柜里(配图由 AI 生成)

    AI 芯片公司 SambaNova 又拿到钱了。这轮 F 轮融资刚完成「首关」,金额 10 亿美元,估值冲到 110 亿美元,领投方是 General Atlantic。公司 CEO 兼联合创始人 Rodrigo Liang 跟 TechCrunch 说,接下来几周还会有更多投资人进来,第二关很快收尾。距离上一轮 3.5 亿美元的 E 轮,才过去五个月。

    这家 2017 年在加州帕罗奥图成立、如今九岁的公司,节奏明显在加快。今年 2 月它刚发布了新一代芯片 SN50,当时顺手拿了 E 轮的钱;现在 F 轮又来了。Liang 对「要不要一直独立」这个问题打起了太极——他说公司一直有人来打听收购,门没关死,但眼前的势头和增长「大概率会把它推向上市」。

    和英特尔越绑越紧

    SambaNova 跟英特尔的关系,比外界以为的更深。英特尔从 C 轮就是股东,这一轮也跟进了,两边还签了多年的合作,基于英特尔的至强(Xeon)芯片一起做 AI 推理产品,共同开发、共同卖。「这让我们能借英特尔的体量,放大自己的技术」,Liang 是这么说的。去年底彭博还报过英特尔想以约 16 亿美元收购 SambaNova 的消息,谈判最后黄了。

    「摩根大通决定用 SambaNova 做推理方案,这是件大事。它给银行业放了句话:是时候别完全依赖云服务了,这些银行想要的是异构的基础设施。」

    这话说的是一桩新买卖:摩根大通选了 SambaNova 当「推理基础设施伙伴」,用它的 SN40L 和 SN50 系统在银行内部跑安全、私有的 AI 推理。在 Liang 看来,像摩根大通这种级别的银行开始自建私有、安全的推理环境,是一个会超出金融业本身的信号——企业和政府「才刚刚踏上 AI 这条路」,之前的增长都集中在模型公司和前沿实验室手里,剩下的「大把收入」还在桌上。

    把万亿参数模型塞进一个机柜

    SambaNova 给自己找的差异化定位是「高端推理」——专门跑最大的模型,而且跑得快。现在的前沿模型动辄上万亿参数,SambaNova 的卖点就是能把多万亿参数的模型装进单个机柜,从而跑出速度。SN40L 在 2023 年 9 月发布,云上和本地都能用;SN50 今年 2 月亮相,计划 2026 年下半年开始给客户发货,软银是它的第一个部署伙伴。


    Liang 把客户分成三类:一是主权云(政府出钱扶本地伙伴建私有云),二是新锐云(neocloud),三是自己搭设施用的企业。除了摩根大通,沙特阿美、英特尔和一些日本企业也在客户名单上。

    这 10 亿美元主要用来两件事:把生意做大规模,以及在这波「难以置信的需求浪潮」里把供应链锁住。Liang 的原话是,钱要用来确保供应链,好兑现订单、买齐未来 12 个月要交付的材料。本轮跟投的名单很长,Seligman Ventures、T. Rowe Price、Capital Group,还有黑石、卡塔尔投资局(QIA)、Vista Equity Partners 等等都在里面。

    看下来,SambaNova 赌的其实是一个正在发生的转向:当云上的通用算力越来越贵、也越让人不放心,大机构开始想把最关键、最敏感的模型搬回自己的机房。芯片、合作、客户订单,都朝着这个方向摆。至于它最后是被收购还是敲钟上市,Liang 留了个活口——但这个市场里,「总有人来敲门」本身就是一种底气。