标签: AI模型独立性

  • 微软不再只靠OpenAI了,它悄悄练出了一套自己的AI模型

    Microsoft MAI AI模型
    微软在Build 2026上发布的MAI模型家族,标志着AI战略的重要转向(配图由AI生成)

    Microsoft和OpenAI这对搭档,这几年几乎绑定在一起。Copilot用的是OpenAI的模型,Azure上跑的是OpenAI的API,连Windows里的AI功能都离不开GPT的底层支持。但这种关系正在起变化。

    在上个月的Build 2026大会上,微软悄悄干了一件大事——它发布了一套完全自研的AI模型家族,名字叫MAI(Microsoft AI)。其中最值得说的是MAI-Thinking-1,这是微软第一个自己从头训练的推理模型。

    说”从头训练”很重要。现在很多公司做模型都是拿别人的前沿模型来蒸馏,相当于抄作业。微软这次说的是,他们的训练数据是干净的,没有从第三方前沿模型里蒸馏,是自己从零开始训的。

    MAI-Thinking-1:350亿参数,MoE架构

    MAI-Thinking-1有多大?微软给的数字是350亿活跃参数。这里说的是”活跃参数”,因为模型用了MoE(混合专家)架构——每次推理只激活需要的部分,不用把整个模型都跑一遍。这样做的好处是效率高、成本低。

    性能方面,微软说它在SWE-Bench Pro上的表现跟Claude Opus 4.6差不多,但成本要低很多。GitHub的运营负责人Kyle Daigle说这个模型是冲着”高性能高效率”去的,token价格会很有竞争力。

    一口气发了7个模型

    但光有一个推理模型还不够。微软这次一口气发了7个模型,覆盖了文本推理、代码生成、图像生成、语音转文字、文字转语音整个链路。

    • MAI-Code-1-Flash:专门给GitHub Copilot和VS Code用的代码模型,主打推理效率高,适合大规模跑
    • MAI-Image-2.5:做文生图和图像编辑,在Arena.ai的图像榜单上排第二,微软说它是市面上性价比最高的图像模型
    • MAI-Voice-2:多语言语音合成,支持15种语言,还能保留说话人的声音特征
    • MAI-Transcribe-1.5:语音识别,支持43种语言,速度是同类模型的5倍

    为什么要独立?三个原因

    这些模型现在有的已经上线Microsoft Foundry,有的还在私人预览阶段。但方向已经很清楚了:微软要把AI的每一层都掌握在自己手里。

    这件事的背后是微软和OpenAI合作条款的重新谈判。新协议签下来,微软访问OpenAI模型和技术授权到2032年,但这个授权变成了非独占的——OpenAI可以卖给别人,微软也可以自己搞。

    微软为什么这时候要独立?有三个原因说得通。第一,不能把命门捏在一个外部供应商手里。第二,自己的模型可以针对自己的产品、硬件、企业客户做优化,不用迁就别人的路线图。第三,也是实在的,跑自己的模型可以省掉一大笔给第三方模型提供商的分成。

    AI操作系统的一步棋

    更值得关注的是,微软还在做一个叫Scout的永远在线的AI助手,基于OpenClaw开源项目。这东西能帮你准备会议、管日程、起草邮件,是往”AI操作系统”方向走的一步棋。有意思的是,微软之前一直把自主AI智能体当成安全风险来看,现在直接把它做成了产品功能。

    硬件端也在布局。微软发布了Surface RTX Spark开发者盒子,用Nvidia的芯片,让开发者可以在本地跑和测试模型。还有能在Windows PC上直接跑的Aion小模型,以及跟高通一起做的基于Android的AI设备原型。

    这些动作串在一起,看得出来微软的算盘:它不想只当OpenAI的分销渠道,它要自己做模型、自己做智能体、自己做硬件、自己做企业AI平台。对用微软产品的公司和开发者来说,这意味着以后会有更多选择,也可能用上更便宜的AI能力。

  • 两个Datadog老兵不信大厂AI,拉了700万美元自己做编程工具

    AI编程工具这事,大厂和新贵打得不可开交。Cursor、GitHub Copilot、Claude Code、Codex——个个都说自己是最好的编程助手。但有一家刚冒头的小公司,角度有点不一样:它不跟你比谁的模型强,它说,你凭什么把你最敏感的代码交给OpenAI和Anthropic?

    大厂做AI,顺手把客户端了

    Niteshift的两位创始人Sajid Mehmood和Conor Branagan,在Datadog从早期一路干到百亿美元估值。他们亲历了当年亚马逊做AWS、顺手把一众电商客户逼到墙角的”零售末日”——现在他们说,AI圈正在上演同一出戏。

    Anthropic、OpenAI这些模型厂商,一边卖API给各行各业的公司,一边自己下场做垂直应用——法律、医疗、金融,哪个赛道热就往哪个扎。Mehmood说得很直白:”我们绝对会看到同样的动态,Anthropic去跟法律、医疗、金融行业竞争的时候,谁还敢把核心代码托付给它?”

    “在Datadog我们看得非常清楚。一大块多云业务就是从那些不想跑在亚马逊上的电商公司来的。现在AI领域正在发生一模一样的事情。”
    ——Sajid Mehmood,Niteshift CEO

    700万美元种子轮,Greylock领投

    Niteshift刚完成700万美元种子轮融资,领投方是Greylock的Jerry Chen。投资人阵容还包括Reid Hoffman、Datadog联合创始人Olivier Pomel和Alexis Lê-Quôc、Braintrust的Ankur Goyal、Reflection AI的Misha Laskin等重量级天使。

    Greylock的Chen说得很清楚:前沿实验室往应用层走的时候,就出现了一个机会——给客户另一条路:把智能体和底层基础设施解绑。Niteshift做的就是这个平台,让客户可以深度投入自己的开发工具链,而不被锁死在单个模型或单个智能体厂商上。

    不做下一个Claude Code,做模型之间的”路由器”

    Niteshift不是要取代Claude Code或Codex。它的定位是”AI编程云”——根据不同的项目需求,在GPT、Claude、开源模型之间做路由调度。收费方式也不是卖Token,而是像云厂商一样按分钟计费。

    Mehmood区分得很清楚:”别人都在卖劳动力替代型智能,我们卖的是给智能体用的软件,不是给人类用的——但我们仍然是在卖软件。”这个定位在AI编程工具里确实少见。

    Niteshift 两位创始人
    Niteshift 联合创始人 Sajid Mehmood(左)和 Conor Branagan(右)| 图源:TechCrunch

    竞争对手个个都是巨无霸

    这个赛道已经挤得水泄不通。Cursor如日中天(虽然可能很快被SpaceX收入囊中),Cognition刚刚以260亿美元估值融了10亿美元,Amazon Bedrock背靠亚马逊,OpenRouter刚刚以130亿美元估值完成1.13亿美元融资。Niteshift作为后来者,压力不小。

    Mehmood的回答是:团队深度。他和Branagan不是研究过这些问题——他们是亲身经历过。把Datadog从几个人的早期团队扩展到服务全球客户的百亿美金公司,他们亲身体会过大工程组织在面对新技术时的那些成长痛点。AI生成代码的测试、验证、自主运行,需要在真实生产环境里跑起来,而这正是他们做过的事情。


    模型独立这条路并不新鲜,Niteshift能跑出来吗?答案可能要等一阵子。但它提出的问题值得每个用AI编程工具的团队想想:你把代码交给谁了?