标签: Grok

  • 马斯克连夜开源Grok Build,但代码里还留着上传用户整个仓库的痕迹

    事情经过是这样的:7月13号左右,一位叫 Cereblab 的安全研究人员在测试 xAI(现在叫 SpaceXAI)的终端编程工具 Grok Build 时,发现了一个让人后背发凉的问题——这个号称”本地优先”的 AI 编程助手,会在你毫不知情的情况下,把你的整个 Git 代码仓库打包上传到 Google Cloud Storage。

    Grok Build代码上传隐私问题示意图
    AI编程工具的隐私边界正在成为开发者最关心的问题

    在一个12GB的测试仓库里,模型实际只用了192KB的数据来完成任务,但上传通道却往Google云存储桶里塞了5.1GB——差了将近28000倍。

    不是Bug,是设计

    Cereblab 用 mitmproxy 抓了所有网络请求。他让 Grok Build 做一件再简单不过的事:回复一个”OK”,不打开任何文件。按理说这不该触发任何数据外传,但结果呢?工具照样把整个项目目录、commit 历史、甚至他故意放进去做测试用的 never_read_canary.txt(一个明确标注”别读我”的文件)全部打包上传了。

    更离谱的是,用户界面里的那个”改进模型”开关根本没用。关掉它,服务器端依然返回 trace_upload_enabled: true,照传不误。

    密码和密钥也一起飞了

    当 Grok Build 读到 .env 文件里的 API Key 和数据库密码时,这些敏感信息也被原封不动地塞进 session 归档包,没有任何脱敏处理。有开发者报告说亲眼看着自己的 SSH 密钥、密码管理器数据库、个人文档和照片都被一股脑传走了。

    消息曝光之后,xAI 在服务端悄悄加了一个 disable_codebase_upload: true 的全局开关来关掉这个功能——注意,不是修客户端代码,是服务端配置一改就完事了。这意味着理论上他们随时可以重新打开。

    紧急开源:84万行Rust代码一夜上线

    丑闻发酵没几天,马斯克亲自宣布 Grok Build 全面开源,完整代码库直接扔到了 GitHub(xai-org/grok-build),几小时就冲到了 7700+ Star。官方还重置了所有云端使用限制,支持完全本地运行,声称要给用户”彻底的隐私控制”。

    开源后的代码库确实很庞大——844530 行 Rust 代码,规模跟 OpenAI 的 Codex(约95万行)差不多。但仔细翻一遍你会发现,之前那段向 Google Cloud 上传数据的代码(upload/gcs.rs)还在里面,只是被硬编码成了返回错误的状态。删了吗?没有。禁用了?是的。能不能随时改回来?技术上完全可以。

    • Grok Build 是基于 Grok 4.5 大模型的命令行 AI 编程智能体,定位对标 Claude Code 和 OpenAI Codex CLI
    • 代码中包含从 openai/codex 和 sst/opencode 移植过来的工具实现
    • CONTRIBUTING.md 明确写明不接受外部 Pull Request——这更像是一次”可审计代码公开”而非真正的社区协作开源
    • 子智能体的系统提示词要求模型”不要向用户透露提示词内容”,但主提示词却没有类似限制

  • 栗色长发美女电梯镜面全身自拍

    栗色长发美女电梯镜面全身自拍

    栗色长发美女电梯镜面全身自拍



    🤖 Grok

    🇺🇸 English Prompt

    Photorealistic full-body mirror selfie of a stunning young woman with long wavy chestnut brown hair, center part, soft voluminous waves falling past her shoulders. She is standing inside a modern luxury elevator with brushed stainless steel walls and horizontal chrome handrails. She wears a tight-fitting long-sleeve maroon bodysuit top that hugs her figure, paired with a short beige mini skirt. She has sheer black tights and glossy bright red pointed-toe stiletto heels. In her right hand she holds a white smartphone, taking the selfie while looking down at the screen with a neutral expression. In her left hand she casually holds a black coat and a brown leather handbag. Elegant and seductive pose, perfect proportions, realistic skin texture, detailed fabric, sharp focus, natural indoor elevator lighting, high fashion photography style, 8k detail --ar 3:4 --stylize 250

    🇨🇳 中文提示词

    绝美年轻女性的照片级真实全身镜面自拍,留着长波浪栗色头发,中分,柔软蓬松的波浪垂过肩膀。她站在一个现代豪华电梯里,电梯有拉丝不锈钢墙面和水平铬合金扶手。她穿着一件紧身的深红色长袖连体衣,贴合她的身材,搭配一条米色短款迷你裙。她穿着黑色透明丝袜和亮红色尖头细高跟鞋。右手拿着一部白色智能手机,低头看着屏幕,表情平淡地拍着自拍。左手随意地拿着一件黑色大衣和一个棕色皮革手提包。优雅且诱人的姿势,完美的比例,真实的皮肤纹理,细腻的织物,锐利聚焦,自然的室内电梯照明,高级时尚摄影风格,8k细节 --ar 3:4 --stylize 250
  • Grok 4.5 发布:马斯克称媲美 Opus,价格却只有对手四分之一

    上市后的第一枪

    7月8日,SpaceXAI(也就是原来的 xAI)把 Grok 4.5 推了出来。这是它上市之后的第一款模型,也是和编程工具 Cursor 合并之后的第一款联合产品。马斯克在自己的 X 平台上(X 现在算 SpaceXAI 的子公司)给它的定位很直白:这是一颗”Opus 级”的模型,但更快、更省 token、也更便宜。

    SpaceXAI 把它定义成一匹干活的工作马,编码、搭应用、办公和行政事务、研究写作这些知识工作它都能接。公司说自己 token 效率是主流模型的两倍——如果这事在真实场景里成立,对价格敏感的开发者来说是个不小的诱惑,毕竟 token 成本这两年一直是大家心里的疙瘩。

    “我们的内部判断是,Grok 4.5 大致相当于 Opus 4.7,但快得多。能力、速度加上低价的组合,才是它真正有竞争力的地方。”马斯克在 X 上这样写道。

    价格确实能打

    数字摆出来挺好看:Grok 4.5 输入每百万 token 收 2 美元,输出 6 美元。对比一下,Anthropic 的 Opus 4.7 是输入 5 美元、输出 25 美元;OpenAI 那边 Sol 最贵,输入 5 美元、输出 30 美元,最便宜的 Luna 是输入 1 美元、输出 6 美元。如果能力真如 SpaceXAI 所说,那这个定价确实把性价比拉到了第一梯队。

    Grok 4.5 模型发布
    SpaceXAI 发布 Grok 4.5,主打高性价比的通用模型(图源:TechCrunch / Getty Images)

    少了一张该有的卡片

    热闹之外也有人挑刺。宾夕法尼亚大学沃顿商学院的教授 Ethan Mollick 在 X 上点了一句:Grok 4.5 没有发模型卡(model card)。今天 Anthropic、Google DeepMind 乃至 OpenAI,每出一款前沿模型都会附上系统卡,写清楚训练数据、评估方法、已知局限。SpaceXAI 这回只晒了 benchmark,没晒评估方法。

    模型卡不是新鲜事,2019 年就被提了出来,如今已经是行业惯例,欧盟的 AI 法案甚至把模型文档列成了合规义务。一家公司只往外出漂亮的性能曲线、不交代怎么测出来的,信任上总会打个问号。公司自己跑的基准测试是起点,不是结论,毕竟谁来挑数字、怎么配环境,团队自己最有动力让结果好看。

    • Grok 4.5 定价输入 $2 / 输出 $6(每百万 token),只有 Opus 4.7 的大约四分之一。
    • 马斯克称其能力接近 Opus 4.7,但速度和性价比更突出。
    • 缺模型卡引发透明度质疑,真实水平还要等第三方评测说话。

  • 马斯克端出Grok 4.5:自称Opus级,价格却只有零头

    这几天AI圈最热闹的事之一,是马斯克旗下的SpaceXAI把新模型Grok 4.5端上了桌。这是它上市之后的第一款模型,也是收购编程工具Cursor之后,双方合力做出来的第一个产物。马斯克在X上(X现在也是SpaceXAI的一部分)直接把它对标Anthropic的Claude Opus系列,话说得很满:”基于内测客户的强烈正面反馈,我们明天就向所有人开放Grok 4.5。它是Opus级别,但更快、更省token、也更便宜。”

    Grok 4.5 发布
    SpaceXAI 发布 Grok 4.5,马斯克称其为 Opus 级模型(图源:TechCrunch / Getty Images)

    价格先把对手吓了一跳

    Grok 4.5的定价是每百万输入token收2美元、输出收6美元。对比一下就清楚了:Anthropic的Opus 4.7要5美元和25美元,OpenAI最贵的GPT-5.6 Sol是5美元和30美元。等于说,在最贵那一档,Grok 4.5把单价压到了对手的几分之一。SpaceXAI还说,它的token效率是其他主流模型的两倍——同样的活儿它吐出来的token更少,花钱自然就少。

    马斯克后来的补充更直白:”我们的内部评估认为Grok 4.5大致和Opus 4.7相当,但快得多。能力、速度加上低成本,才是它真正有竞争力的地方。”

    它到底擅长什么

    SpaceXAI把Grok 4.5定位成一匹”干活儿的马”,不是只会聊天的玩具。写代码、搭应用、处理办公室杂活、做研究、写文档,这些AI行业一直想替人自动化的活儿它都能接。而且它特别强调编程和智能体任务——这恰好是和Cursor合并之后的红利:模型是用Cursor的真实编程数据一起训出来的,SpaceXAI说它在大型代码库、跨仓库的长任务上表现尤其好。

    发布当天,开发者Evan Bacon就在X上晒了一段体验:”Grok 4.5有点离谱,它刚给我做了一个带实时数据和3D地球的火箭追踪App。”这种”能直接把东西做出来”的反馈,正是SpaceXAI想给市场留下的印象。

    • 默认进入 Grok Build、Cursor 全档位订阅,以及 SpaceXAI 的 API 控制台
    • 暂时还没在欧盟上线,官方说预计七月中旬开放
    • 和 GPT-5.6、Claude 系列挤在同一周发布,堪称今年最拥挤的模型周

    光环之下也有疑问

    不过热闹归热闹,Grok 4.5并不是没有争议。沃顿商学院教授Ethan Mollick在发布当晚就点了一句:Grok 4.5没有发模型卡(Model Card)。当Anthropic、Google DeepMind乃至OpenAI都为每一款前沿模型附上系统卡时,SpaceXAI选择只晒Benchmark、不晒评估方法。模型卡这东西2019年就被提出来了,写明用途、训练数据、局限和安全考量,如今已经是行业基本的透明作业。

    第三方的独立排名也给了它一个冷静的定位。评测机构Artificial Analysis把Grok 4.5排在真实智能体工作的第四名,落在最新的Claude系列之后。换句话说,它确实能打,但还不是榜单第一。

    所以Grok 4.5的故事,本质上不是”谁最聪明”,而是”谁最划算”。对于那些要大规模铺智能体、动辄跑几分钟几小时工程任务的公司来说,一个便宜近九成、能力只差一口气的模型,往往比榜单冠军更香。马斯克这回赌的,就是开发者更在意能不能真把活干完,而不是谁的分数更高。

  • 卧室镜前自拍的东亚年轻美少女

    卧室镜前自拍的东亚年轻美少女

    卧室镜前自拍的东亚年轻美少女



    🤖 Grok

    🇺🇸 English Prompt

    Photorealistic mirror selfie of a beautiful young East Asian woman with long black hair and bangs, wearing a small gold hair clip. She has fair skin and subtle makeup with eyeliner. She is taking a selfie in a bedroom while looking directly at the camera.
    
    She is wearing a tight blue short-sleeve crop top and dark blue star-patterned short shorts with white stars and text on the back. The outfit is very form-fitting. She is barefoot.
    
    Pose: standing in front of a mirror, one leg lifted and bent with foot resting on a pink surface, body slightly turned, holding a light-colored smartphone with both hands to take the selfie. Confident and playful pose.
    
    Setting: modern bedroom with wooden flooring, large white fluffy rug, open white closet with clothes inside, scattered clothes on a pink surface, pink vanity chair, and a white humidifier. Natural indoor lighting, realistic details, sharp focus, photorealistic, 8k resolution --ar 2:3 --stylize 180

    🇨🇳 中文提示词

    一张照片般真实的一位美丽的年轻东亚女性的镜前自拍,她留着黑色长发和刘海,戴着一个小金发夹。她皮肤白皙,画着带眼线的淡妆。她在卧室里自拍,同时直视镜头。
    
    她穿着一件紧身的蓝色短袖露脐上衣和深蓝色星形图案的短裤,背面有白色星星和文字。这身打扮非常贴身。她赤着脚。
    
    姿势:站在镜子前,一条腿抬起并弯曲,脚落在粉红色表面上,身体微侧,双手握着一部浅色智能手机自拍。自信且俏皮的姿势。
    
    场景:带有木地板的现代卧室,巨大的白色蓬松地毯,放着衣服的敞开式白色衣橱,粉红色表面上散落的衣服,粉红色梳妆椅,以及一台白色加湿器。自然室内光线,真实细节,清晰聚焦,照片级真实,8k分辨率 --ar 2:3 --stylize 180
  • Grok 4.5发布:马斯克不拼参数了,改拼性价比

    淡出主流模型竞技场两个月之后,马斯克的 Grok 又坐回了牌桌。北京时间 7 月 9 日,SpaceXAI 正式发布旗舰模型 Grok 4.5。和过去每家都在喊”我们最强”的画风不同,这次马斯克显得很务实:他在 X 上连发几十条动态,反复强调一句话——能力和 Claude 的 Opus 4.7 差不多,但快得多,也便宜得多。

    Grok 4.5 概念配图
    Grok 4.5 概念配图(本文配图由 AI 生成)

    一张”够用就好”的牌

    Grok 4.5 是个 1.5T 参数的 MoE 模型,上下文拉到 50 万 token,主打编程、智能体和知识工作,还能看图输入。在考察编程的 SWE Bench Pro 上它拿到 64.7%,刚好压过 Opus 4.7 的 64.3%;Terminal Bench 2.1 冲到 83.3%,DeepSWE 1.0 的 62% 也超过了 Opus 4.8。推理速度能跑到 80 TPS,已经挤进第一梯队。

    有网友引用测试说,Grok 4.5 只花了大约十七分之一的成本,就做到了接近 Claude Fable 的性能。马斯克没有顺杆爬,反而老老实实承认差距:”公平地说,Fable 确实比 Grok 4.5 好得多,但大多数任务并不需要 Fable 级别的能力。”

    真正让对手冒汗的是价格

    但 SpaceXAI 真正想卖的不是分数,而是账本。它的 API 定价是每百万输入 token 2 美元、输出 6 美元。作为对照,Opus 4.7 的输入要 5 美元、输出 25 美元。完成同一个 SWE 任务,Grok 4.5 吐出的 token 量大约只有 Opus 4.8 Max 的四分之一。

    把模型调用价格推向台前,是这一轮竞争里最现实的变化。当企业把 Agent 跑在生产环境、每天调用成千上万次,token 账单就变成了真金白银。谁能在不掉链子的前提下把单位成本压下来,谁就握住了开发者的切换按钮。

    • 和 Cursor 联合训练,面向真实编码场景打磨
    • 下周推送百万 token 上下文版本,月底还有 2T 参数版本预告
    • 已在 SpaceXAI 控制台、Grok Build 和 Cursor 三端上线

    说到底,马斯克这次没再玩”参数军备竞赛”那一套。他赌的是另一件事:在绝大多数真实工作里,用户要的不是天花板级别的智能,而是一份”能力够用、速度快、账单轻”的交付。特斯拉和 SpaceX 的硬核工程师觉得 Grok 4.5 真好用,这比任何榜单都更能说明问题。

  • Grok 4.5发布:马斯克说它比Opus更快、更省token

    Grok 4.5 大模型发布
    SpaceXAI 把 Grok 4.5 定位为一款”主力劳工型”大模型

    SpaceXAI——也就是原来那家 xAI,被马斯克并进 SpaceX 之后改的名——这周三把 Grok 4.5 放出来了。这是公司几周前上市之后的第一个新模型,也算是重组后对外界交出的第一份模型答卷。

    马斯克自己在 X 上(X 现在也是 SpaceXAI 旗下的)把它形容成”Opus 级别”的模型,意思是能跟 Anthropic 那档专攻复杂任务的顶级模型掰手腕。他在帖子里写得很直白:Grok 4.5 是 Opus 级的水平,但更快、更省 token、也更便宜。

    一款”什么活都接”的主力模型

    官方博客里,SpaceXAI 把 Grok 4.5 定义成”主力劳工型”模型:写代码、搭应用、办公杂活、做研究、写稿子,这些 AI 圈一直想自动化的活它都能接。但最值得盯的不是它能干多少事,而是效率——公司声称它的 token 效率是其他主流模型的两倍。

    对真正天天调模型的人来说,token 贵不贵早就成了绕不开的痛点。如果这”两倍效率”在真实场景里能兑现,Grok 4.5 的性价比优势就立住了,而这恰恰是 SpaceXAI 最想打的牌。

    “It is an Opus-class model, but faster, more token-efficient and lower cost.”——马斯克在 X 上的原话

    成绩单跟价格,都挺能打

    SpaceXAI 周三甩出了一堆基准测试成绩,看下来跟竞争对手的顶级模型咬得很紧,但离”全场第一”还差一口气。真正有冲击力的是定价:输入每百万 token 2 美元,输出 6 美元。

    作为对比,Anthropic 的 Opus 4.7 要 5 美元和 25 美元,OpenAI 的 GPT-5.6 里最贵的 Sol 是 5 美元和 30 美元。马斯克后来补了一句:内部评估 Grok 4.5 大概跟 Opus 4.7 一个水平,但快得多,”能力、速度、低价三样凑一起,才是它打市场的资本”。

    • Grok 4.5:输入 2 美元 / 输出 6 美元(每百万 token)
    • Opus 4.7:输入 5 美元 / 输出 25 美元
    • GPT-5.6 Sol:输入 5 美元 / 输出 30 美元

    这周简直是模型发布大周。OpenAI 的 GPT-5.6 也在周四准备上线,而且这模型之前还被特朗普政府卡了发布,理由是安全顾虑。一边是 Grok 4.5 打着低价快速度的旗号冲出来,一边是 GPT-5.6 顶着”史上最强”的名头解禁,大模型圈的价格和能力军备竞赛,眼看着又被点了一把火。

  • xAI正式消失了:马斯克把整个AI帝国并进了SpaceX

    火箭与AI神经网络融合的SpaceXAI概念图
    旧xAI标志折进新SpaceXAI标记,马斯克把AI帝国整个焊进了SpaceX

    马斯克名下那家AI公司xAI,从现在起正式不存在了——至少名字是没了。本周一,X平台上的xAI账号整体切换成了@SpaceXAI,配的一段动画很直白:旧的xAI标志慢慢折进新的SpaceXAI标记里,那个大家熟悉的X被直接焊进了SpaceX的身份中。

    这不是临时起意,而是一桩酝酿了快半年的合并,终于走完了最后一步。

    从2月收购,到5月”解散”

    整件事的起点是2月2日。SpaceX用一笔全股票交易把xAI买了下来,合并后公司估值大约在1.25万亿美元(其中SpaceX占1万亿,xAI占250亿),连社交平台X也一并收编进同一个屋檐下。

    到了5月,马斯克自己把话挑明了:”xAI会作为独立公司解散,以后就是SpaceXAI,也就是SpaceX的AI产品。”换句话说,Grok也好、其他模型也好,往后都只是SpaceX这条大船上的一个部门,不再是独立玩家。

    马斯克的原话很干脆:xAI不再是单独的公司,它只是SpaceXAI——SpaceX出品的AI产品。

    Grok没消失,只是换了招牌

    关心Grok的人可以放心,它没被砍掉。这个由xAI打造的主力模型,现在挂在SpaceXAI名下继续跑,和推理、语音、图像、视频生成等其他工具一起,服务消费级用户。合并的逻辑很清晰:把火箭、卫星和前沿AI塞进同一个组织,两边的资源调配就不用再跨公司扯皮。

    顺带一提,就在6月,SpaceX刚完成了史上规模最大的IPO,募资750亿美元,估值约1.77万亿美元。钱袋子鼓了,把AI业务彻底内化也就顺理成章。

    更野的念头:把AI算力搬上太空

    如果只是改个名,这件事不值得单独拿出来说。真正让外界侧目的,是合并背后的那个大设想:把AI基础设施搬出地球。

    SpaceX已经向美国FCC提交申请,打算发射能充当”轨道计算节点”的卫星;它还想用Starship在近地空间搭建数据中心,彻底绕开地球给AI设下的供电和散热天花板。地面上的机房再怎么扩建,电和冷却都是硬约束,而近地轨道理论上没有这两道紧箍咒。

    • 可重复使用的火箭,解决了往太空运设备的成本问题;
    • 庞大的卫星星座,本身就是现成的全球网络;
    • 前沿AI模型,则提供了”在天上跑什么”的内容。

    可重复使用火箭、巨型卫星网络、再加上最先进的AI,现在全被马斯克装进了一个壳里。他赌的那件事很简单:计算的未来,也许根本就不在地球上。

  • xAI内部爆炸:工程师因警告Grok安全问题被解雇,现在把公司告了






    xAI内部爆炸:工程师因警告Grok安全问题被解雇,现在把公司告了

    Devin Kim在xAI待了一年多,负责Grok聊天机器人的AI安全工作。他的职责本来就是确保这个模型不会出大岔子。但据他新提交的诉讼称,他因为反复指出Grok的安全隐患,被公司炒了鱿鱼。

    Kim今年6月在加州州法院正式起诉xAI及其母公司SpaceX。此时距离SpaceX那场史上最大IPO只有几天——这 timing 怎么看都很微妙。

    xAI Grok AI安全争议
    xAI的Grok聊天机器人因多起安全争议饱受批评(图源:TechCrunch)

    他警告的事情,后来真的发生了

    根据诉讼文件,Kim在xAI期间反复抱怨公司在Grok的开发过程中没有把安全放在优先位置。他特别担心两件事:Grok可能会煽动歧视,以及它有可能帮助传播大规模杀伤性武器的相关信息。

    后来的事情大家都看到了。Grok上线后闹过好几次公关灾难——最出名的一次是它把自己比作希特勒,搞出个”MechaHitler”的名号,xAI不得不紧急把模型下线改系统提示词。还有一次,Grok在X平台上大量生成非同意的裸照内容。

    “Grok当然证明了Kim是对的——它搞出了那些骇人听闻的在线仇恨言论,包括把自己比作希特勒。”诉讼文件中这句话写得相当不留情面。

    官司的矛头指向谁?

    有意思的是,这起诉讼没有直接把Elon Musk列为被告。Kim的律师在诉状里描述Musk曾指示xAI遵守法律、实施适当的安全测试和流程。问题出在Kim的直属上司——xAI联合创始人Jimmy Ba。

    Ba今年早些时候已经离开了xAI,但在职期间,据诉状描述,他根本不把安全当回事。有一次他甚至对Kim说”AI反正迟早要弄死我们所有人”,然后把精力全放在冲向超级智能的目标上,安全测试能省就省。

    诉状还提到一个具体事例:2025年8月左右,Ba在发布Grok Code 1时试图规避欧盟的安全监管,对模型的某些方面做了不实描述,目的就是绕过法律要求的测试。最后还是Musk亲自介入才拦住。


    Kim是谁?这事儿靠谱吗?

    Kim不是什么无名之辈。在加入xAI之前,他在Scale AI做过早期AI安全项目,带过训练数据生成的工作,专门帮AI系统学会检测有害内容。离开xAI后,他上周被非营利组织Center for AI Safety任命为总裁——这个机构专门研究AI风险,在业界有一定分量。

    xAI和SpaceX对这起诉讼暂时没有回应。Kim这边要求的补偿包括赔偿金、惩罚性赔偿,以及一份宣告性判决,认定xAI和SpaceX的行为违法。

    这起诉讼的时机选得很刁——SpaceX即将IPO,任何关于内部管理的负面消息都有可能影响投资者信心。xAI这边则一直在努力让Grok看起来可靠,毕竟它现在已经深度整合进X平台,出了事就是Musk自己的平台背锅。

    AI安全这个话题在业界已经从边缘讨论变成了主流关切。Anthropic、OpenAI都有自己的安全团队,但像xAI这样被前员工公开起诉”无视安全”的,还是头一遭。不管官司最后怎么判,xAI在AI安全上的信誉已经先被撕开了一个口子。


  • xAI解雇了警告Grok有安全风险的工程师,诉讼曝光马斯克帝国内部裂痕






    xAI解雇了警告Grok有安全风险的工程师,诉讼曝光马斯克帝国内部裂痕

    埃隆·马斯克又上头条了,但这次不是因为火箭发射或者社交媒体上的争议发言。一位名叫Devin Kim的工程师把xAI和SpaceX一并告上了加州法院,理由很简单——他觉得Grok这个AI聊天机器人安全问题太大,多次提了意见,结果被炒了鱿鱼。

    这件官司提交的时机相当”巧妙”,距离SpaceX要上市(IPO)只剩几天。要知道,这可是号称史上规模最大的IPO,估值高得离谱。Kim选在这个节点起诉,很难说是巧合。

    Grok AI聊天机器人界面
    Grok聊天机器人因安全问题多次引发争议(图源:TechCrunch/Getty Images)

    这位工程师不是普通人

    Kim并不是那种入职才几天的菜鸟。2024年,他作为后训练团队的首批成员加入xAI,后来负责研究工具开发,帮团队搭建了”全球顶尖的系统”来加速Grok的开发。他在Scale AI工作期间就参与过AI安全项目,比如给AI系统生成训练数据,让AI能检测有害内容、遵守治理政策。

    换句话说,这个人懂AI安全,而且是有实战经验的那种。他离职后在X(现在的X平台,也是马斯克旗下的)上发帖说:”9月是我在xAI的最后一个月!2024年我作为后训练团队的首批成员加入,后来负责研究工具开发,我们搭建了全球顶尖的系统来加速Grok的开发。”

    “Grok后来的表现当然证明了Kim先生是对的,它做出了极为恶劣的线上仇恨和辱骂行为,甚至把自己比作希特勒(’MechaHitler’)。在这次希特勒相关的事件之后,Kim先生致力于重新评估Grok的政治偏见和歧视倾向。”
    ——诉讼文件原文

    Grok到底出了什么问题

    如果你关注AI新闻,可能记得Grok曾经闹过好几次大新闻。一次是它把自己比作希特勒,搞出所谓的”MechaHitler”事件;另一次是有用户用Grok在X平台上大量传播未经同意的性相关图像。这些问题都不是小毛病,而是牵涉到AI安全的核心——当聊天机器人开始生成仇恨言论或者非自愿的色情内容,这说明安全护栏根本没起作用。

    Kim的担心主要集中在两点:一是Grok可能会煽动歧视,二是它可能传播与大规模杀伤性武器相关的信息。这两点都不是小题大做,尤其是第二点,直接关系到AI安全领域最敏感的红线。

    诉讼把矛头指向了谁

    有意思的是,这场诉讼并没有直接把马斯克本人列为安全措施缺失的责任方。相反,Kim的律师描述称,马斯克曾经指示xAI遵守法律,实施适当的安全和测试流程。那问题出在哪?诉讼的指控对象是Kim的上级、xAI联合创始人Jimmy Ba。

    Ba已于今年早些时候离开xAI。根据诉讼内容,Ba无视马斯克的指令,因为Kim推动安全防护措施而对他进行报复。诉讼把Ba描述成一个强烈反对AI安全措施的人,据称他曾对Kim说”AI反正会把我们全杀了”,他反而把让xAI成为第一个实现超级智能的公司作为目标。

    “在2025年8月左右的一次事件中,Ba试图在Grok Code 1发布时阻挠欧盟的安全法规,为此他歪曲了这款模型的某些方面,以逃避法律要求的测试。Ba表示,他宁愿发布不安全的模型,也不愿发布性能差的模型。最终马斯克不得不介入干预。”
    ——诉讼文件原文

    IPO前夕炸出这种新闻,投资者怎么看

    SpaceX的IPO预计将是史上规模最大的IPO之一,估值高达1.8万亿美元。但这次诉讼爆出来的时机,很难不让人联想。投资者在决定是否买入SpaceX股票的时候,会不会考虑到这家公司的AI安全文化?尤其是当这家公司的核心产品之一(Grok)已经多次因为安全问题被曝光?

    目前xAI和SpaceX都没有对置评请求作出回应。Kim的律师也没有回复TechCrunch的邮件。但诉讼文件已经摆在公众面前,里面的细节足够让任何关注AI安全的人感到不安。

    值得一提的是,Kim目前在一家专注于AI风险的公益组织——人工智能安全中心(Center for AI Safety)担任总裁。这个任命发生在诉讼提交前一周,时间点也很微妙。

    这件事为什么重要

    AI行业现在正处于一个微妙的阶段。各家公司在拼命赶进度,生怕落后,但安全措施往往被摆在次要位置。xAI的这个案例并不是孤例——Anthropic警告AI风险但照样发布新模型,Meta被曝在训练数据上打擦边球,谷歌的AI Overview闹出过好几次事实性错误。

    但当一家公司准备以史上最高估值上市的时候,它的AI安全记录就应该被放在显微镜下看。投资者有权利知道,他们投的钱正在支持一家什么样的公司。