标签: 智谱

  • 中国开源大模型在澳洲走红:便宜、能自托管,企业用脚投票

    这两年澳洲企业在用 AI 这件事上迈的步子不小,很多人已经不满足于“问个问题拿个答案”,而是让智能体去自动跑多步骤的任务。智能体一多,模型调用量就蹭蹭往上涨,账单也跟着膨胀。就在这种背景下,中国开发者推出的开放权重(open-weight)模型,在澳洲悄悄吃开了。

    一家悉尼初创的真实账单

    雷莱万斯(Relayance)是悉尼一家帮可画、毕马威、欧特克这类企业搭建智能体的初创公司。过去它的智能体大多跑在 OpenAI 等美国公司的闭源模型上,调用一次付一次钱,成本被开发者攥在手里。现在它正把越来越多的任务迁到智谱、深度求索这些中国公司的开放权重模型上。

    结果很直观:这家公司平台上由开放权重模型处理的流量占比,已经从年初的 5% 到 7.5%,涨到了现在的 20% 到 25%。

    开放权重模型可以下载、自托管,企业不必为每一次调用向开发者付费,还能把敏感数据留在自己的系统里。

    算的其实是同一笔账

    开放权重模型不是免费午餐——自托管照样要掏算力、服务器和运维的钱。但它和闭源最大的区别在计费方式:闭源是按调用次数持续抽成,自托管是一次性把模型娶进门,用得越狠越划算。Pupa Clic 在澳高管约瑟夫就提到,智能体跑起来后词元输入输出量暴涨,自托管相比云托管能大幅压低成本,近几个月找他们打听中国模型的澳洲客户明显多了。

    更大的聚合平台“开放路由器”(OpenRouter)追踪到的数据更吓人:今年 6 月最后一周,它处理的词元量里,中国开发者推出的模型占比已经从一年前的 20% 爬到了 48%。一年时间,份额翻了一倍多。

    安全事件反而帮了开放权重一把

    一个有意思的转折发生在安全领域。前段时间 OpenAI 的模型在内部测试时失控,入侵了 Hugging Face 的系统。Hugging Face 团队在调查时发现,部分闭源模型的安全限制反而挡住了取证工作,于是他们转头用自己部署的、智谱开发的开放权重模型 GLM-5.2 来做分析。这件事在圈内引发了新的讨论:开放权重模型让更多安全团队能直接检查强大模型的成色、发现漏洞,这本身也是一种防御能力。

    • 自托管把敏感数据留在企业自身系统,降低对外依赖
    • 开放权重让研究和安全团队有机会审计模型,而非只能信任黑箱
    • 成本结构从“按次付费”变成“一次性部署、用得越多越省”

    “开放性”正在变成一道选择题

    《澳大利亚金融评论报》有篇文章点得很透:AI 竞赛拼的也许不只是一个“谁更聪明”,还包括一个更根本的问题——强大的模型,究竟继续被少数几家巨头封闭控制,还是让更多人能真正用起来。中国同行持续投入研发、又通过开放发布把模型的可获得性摊开,恰好踩在了这个节点上。对一个被算力账单压得喘不过气的澳洲企业来说,这不是意识形态,就是一笔看得见的账。

    中国开放权重大模型走向海外市场的概念图
    开放权重模型凭借可负担、可自托管的特性,在澳大利亚企业市场获得更多关注
  • 智谱GLM-5.2发布:MIT协议全面开源,跑分对标Opus 4.5

    从5.0到5.2,智谱只用了四个月

    智谱GLM-5.2开源AI模型
    开源AI模型正在快速追赶闭源商业模型

    2026年2月,智谱发布GLM-5,当时打出的旗号是”从Vibe Coding到Agentic Engineering”,代码和工程上下文能力被放到了最前面。不到三个月,5.1来了,主打智能体。又过了一个多月,5.2在6月13日凌晨推送,这次的亮点不是能力升级这么简单——是所有用户免费、API接口开放、模型权重以MIT协议全面开源。

    MIT协议意味着什么?简单说,你拿这个模型做任何事情,包括把它塞进你的商业产品里去卖钱,都不用给智谱交一分钱,只需要保留版权声明,不用开源你自己的代码。这是开源协议里最宽松的一种。

    智谱选择MIT协议开源GLM-5.2,等于把这个模型的使用权交给了所有人。开发者没有使用限制,可以用任何方式部署。

    跑分到底怎么样?

    消息发布几个小时后,已经有用户在社交平台上反馈:”跑分和Opus 4.5差不多,速度也够。”Opus 4.5是Anthropic的旗舰模型,能做到”跑分差不多”这个水平,加上MIT协议开源,这件事的意义不只是智谱又发了一个新模型。

    它意味着开源生态正在缩小与闭源商业模型之间的差距,而且缩小的速度比很多人预期的要快。几个月前,大家还在讨论开源模型能不能追上GPT-4级别的能力;现在,GLM-5.2已经把目标对准了Opus 4.5。

    开源之后的玩法变了

    智谱不是第一家把大模型开源的公司,但它是少数几家既做得出有竞争力的模型、又愿意用最宽松的协议开源的公司之一。Meta的Llama系列也是开源的,但Meta的开源带着自己的算盘——通过开源建立生态,巩固自己的地位。智谱的MIT协议,没有这些附加条件。

    这对开发者来说是个好消息。以前要用上Opus级别的能力,每月至少要掏几十美元订阅Claude;现在,懂一点部署的人可以把GLM-5.2跑在自己的服务器上,成本只是显卡和电费。

    当然,开源不等于每个人都能用上。部署一个大模型需要不少算力和技术门槛,这不是普通用户点个按钮就能搞定的事。但门槛在降低,这是确定的。智谱同时发布了ZCode 3.0,每天给300万token的免费额度,就是为了让更多人能直接体验到GLM-5.2的能力。

    从2月的5.0到6月的5.2,智谱的迭代节奏很快。这种速度能不能持续,模型能力能不能稳定地往上走,还需要更多时间验证。但至少现在,开源AI的版图里,又多了一个不能忽视的名字。