作者: hiyoho

  • 穆拉蒂的 Thinking Machines 发布开源模型 Inkling,赌定制 AI 胜过万能模型

    Thinking Machines 创始人 Mira Murati
    Mira Murati 离开 OpenAI 后创办的 Thinking Machines Lab(图源:TechCrunch / Getty Images)

    Mira Murati 离开 OpenAI 后创办的 Thinking Machines Lab,憋了一年半,终于在周三把第一个自家模型拿了出来,名字叫 Inkling。它最特别的地方不是有多强,而是”开放权重”——外面的人能直接下载、修改、自己拿去用,不必永远挂在别人的服务器上按次付费。

    一个 9750 亿参数的”混合专家”

    Inkling 用的是混合专家架构(MoE),总参数 9750 亿,但每次只调动其中约 410 亿来干活。这种”大身子小身段”的设计现在很常见,好处是模型够大、跑起来又不至于太贵太慢。它在 45 万亿 token 的文字、图片、音频、视频上训过,四种模态它都能原生推理,不过目前只吐文字——代码、带格式的卡片、结构化数据都行。

    不跟你比谁最强,只求”哪都能凑合”

    公司自己都说了,Inkling”现在不是最强的模型,开源闭源都不是”。那它图什么?图的是”全面发展”。它会给你有把握的答案,没把握就明说”我不确定”,而不是硬编;你还能自己调”思考力度”,想快就轻一点,想深就重一点。官方说在代码 benchmark 上,它用的 token 只有英伟达 Nemotron 3 Ultra 的三分之一,就能达到同样的水平。

    由一家公司集中训练、然后定死的 AI,往往不如组织自己塑形的 AI——因为太多专业知识只属于掌握它的人。

    上面这句话,是 Thinking Machines 上周那篇博客的核心论点,也是这次发布想撑起的背景。

    真正的赌注:企业自己改的,比万能模型更好用

    Inkling 现在的定位不是成品,而是”起点”。组织可以用它的 Tinker 平台自己微调,把它变成贴合自己业务的东西。代价是:安全和合规得你自己负责,微调也确实要正经的机器学习人才。这和 OpenAI、Anthropic、Google 的打法正好反过来——那三家先把 ChatGPT、Claude、Gemini 当通用聊天机器人卖,再把智能体能力叠上去。


    为什么”自己养模型”突然成了潮流

    这个方向不是 Thinking Machines 一个人在喊。微软 CEO 纳德拉上周就警告企业,用闭源模型等于”付两遍钱”:一遍订阅费,一遍把你 prompt 和纠正里藏着的业务机密,喂进了人家的下一代模型。Hugging Face 的 Clem Delangue 也判断,前沿模型以后只留给试验和高价值任务,真正跑生产的活会挪到私有或开源模型上——这正是 Thinking Machines 押注的路线。

    最有说服力的一仗,是它和全球最大对冲基金 Bridgewater 的合作。两边用现成的开源模型,喂上 Bridgewater 自己的金融经验再训一轮,据说在金融推理测试里拿到 84.7%,干翻了一堆顶级闭源模型,而成本只有大概十四分之一。不过这分数两家自己评的,还没独立验证。

    九年还是九个月

    OpenAI 从技术面世到赚钱花了约五年,Anthropic 约三年,Thinking Machines 说自己只用了九个月。至于钱从哪来,公司一贯讳莫如深——三月它和英伟达签了部署一吉瓦 Vera Rubin 算力的合作,Inkling 全在 GB300 NVL72 上训出来的,但怎么 cover 这笔开销,它没说。

    团队现在大约 200 人,比年初一波离职(包括两位联合创始人跳回 OpenAI)后稳住了。公司的文化刻意不捧个人,按理说谁走都不算大新闻——虽然它整个故事到现在都还绑在那位知名联合创始人的名字上。

  • herdr:17.3K Stars 的终端 Agent 复用器,在命令行里同时”放养”一群 AI 编程智能体

    herdr:17.3K Stars 的终端 Agent 复用器,在命令行里同时”放养”一群 AI 编程智能体

    herdr logo

    herdr 是一款用 Rust 写成、直接跑在你现有终端里的「Agent 复用器(agent multiplexer)」——把 Claude Code、Codex、Cursor、Copilot 等一众 AI 编程智能体并排塞进真实的终端面板,统一监视、分屏、脱离与重连,让你在命令行里就能”放养”一整群 Agent。

    一、项目简介

    herdr = terminal agent multiplexer。它不是一个封装 AI 的 Web 界面,而是一个单文件 Rust 二进制(无 Electron),把多个 AI 编程智能体的真实终端会话聚合到同一个 TUI 里:每个 Agent 的工作状态(阻塞 / 进行中 / 已完成)一目了然,你可以像用 tmux 一样分屏、点击、脱离,而 Agent 们还在后台继续干活。

    二、安装要求和过程

    环境要求

    • 任意现代终端(macOS / Linux / Windows 终端均可),无需图形界面;
    • 单个 Rust 静态二进制,无 Electron、无运行时依赖
    • 支持通过 ssh 远程接入,会话在重启后依然存活;
    • 可选:本地有 Claude Code / Codex / Cursor 等任一 AI 编程助手即可配合工作。

    快速安装

    # macOS / Homebrew
    brew install herdr
    
    # 一键安装脚本(Linux / macOS)
    curl -fsSL https://herdr.dev/install.sh | sh
    
    # 版本管理器
    mise use -g herdr
    
    # Windows(测试版)
    powershell -ExecutionPolicy Bypass -c "irm https://herdr.dev/install.ps1 | iex"
    
    # 或直接从 GitHub Releases 下载对应平台的预编译二进制
    # https://github.com/ogulcancelik/herdr/releases
    

    启动与使用

    # 在代码目录直接启动
    herdr
    
    # Ctrl+B Q 脱离(Agent 继续跑)
    # 之后任意终端再输入 herdr 即可重连
    

    源码构建:git clone https://github.com/ogulcancelik/herdr && cd herdr && cargo build --release

    三、核心功能

    • 一眼掌控所有 Agent:阻塞 / 工作中 / 已完成,展示的是真实终端视图,而非被封装过的”解释版”界面。
    • 脱离不中断:Agent 在后台继续运行,可随时从任意终端或 ssh 重连,会话在系统重启后依然存活。
    • Agent 也能用 herdr:提供纯 Socket API,Agent 可以自己起面板、读输出、彼此等待,官方还配了 agent skill。
    • 键鼠并重:tmux 风格前缀键 鼠标点击 / 拖拽 / 分屏同时是一等公民,按当下场景随时切换。
    • 插件生态:可扩展面板与工作流,官方维护插件市场(herdr.dev/plugins)。

    四、典型使用场景

    • 多 Agent 并行开发:在同一个项目目录里同时跑 Claude Code、Codex、Cursor,分屏对照、统一监管进度,谁卡住一眼看清。
    • 远程 / 后台长跑任务:ssh 登录服务器起 herdr,下班时脱离,第二天从任意终端重连查看结果,会话不丢、无需 nohup 折腾。
    • Agent 自组织协作:主 Agent 通过 Socket API 派生子 Agent 到不同面板,让它们互相等待产出,搭出多智能体流水线。

    五、推荐理由

    我自己用下来最打动的三点:

    • 够轻、够原生:一个 Rust 二进制、无 Electron,和你现有的终端 / ssh 工作流无缝融合,不像某些”AI 终端”还要起一套 Web 服务。
    • 真实终端视图:Agent 的报错、进度、交互提示都是原样可见的,而不是被二次渲染成温和的摘要——排错时这点太重要了。
    • 脱离 / 重连体验极佳:长任务的”离开—回来”几乎零成本;而 Socket API 让 Agent 反过来调度 herdr,是迈向真正 agent runtime 的一步,想象空间很大。

    六、下载地址

    许可证:AGPL-3.0(双许可,商业用途需购买商业许可)。当前约 17.3K Stars,Rust 实现,2026 年 GitHub Trending 常驻热门。

  • Google Photos 上线 Video Remix:几秒把废片改成水彩画

    谷歌给 Google 相册塞进了一个新玩具,叫 Video Remix。它背后是 Gemini Omni 模型,用法简单到有点离谱:在”Create”标签页里挑一段视频,选个模板,剩下的交给 AI。

    Google Photos Video Remix
    Video Remix 把视频编辑变成几步点击的模板游戏(图源:TechCrunch)

    它能干啥

    最核心的三类玩法:一是电影级重新打光,把拍暗了的片段自动提亮;二是换背景,把平淡的墙换成咖啡馆或者海滩日落;三是艺术滤镜,把视频涂成水彩、素描本或者油画的样子。你不用碰时间轴,也不用调色轮,点几下就出片。

    “做出好看的视频片段,不该需要专业技能,也不该耗费几个小时。”谷歌在博客里这么写,”现在用 Photos 里的 Video Remix,几步点击就能把普通视频变成值得分享的瞬间。”

    实际限制也挺明确:视频总长得在 60 秒以内,而且你只能挑其中 1 到 10 秒的片段来做变换;素材还得已经备份到 Google 相册里。

    门槛藏在订阅里

    这个功能只对成年人开放,而且不是免费用户能碰的——它绑在 Google AI Plus、Pro、Ultra 这几个付费档上,首批开放的市场包括美国、日本、韩国、印度等 14 个国家。免费相册用户暂时和它无缘。

    • AI Plus 每月 4.99 美元(今年 6 月刚从 7.99 降下来),带 400GB 存储,能用 Video Remix;
    • AI Pro 每月 19.99 美元,5TB 存储;
    • AI Ultra 每月 100 到 200 美元,面向重度用户。

    把”生成式视频”关在付费墙后面,说明谷歌的算盘和存储费一个逻辑:好用,但跑在云端烧钱,所以按量计费。此前 Magic Eraser、背景虚化这些相册 AI 工具都是免费的,这次是个明显的转向。

    谷歌想把相册变成创作入口

    Video Remix 不是孤立的。谷歌近半年往 Photos 里塞了一连串 AI:照片转动图、Photo Remix 把静图变成 3D 动画和漫画风、AI 修图、甚至一个数字衣橱帮你试穿搭。它的野心很清楚——相册不该只是备份仓库,而要成为你不用跳出谷歌生态就能修图、生成、玩创意的地方。这跟苹果 iOS 的回忆视频、Adobe 的 AI 剪辑、Meta 的 Muse Image,抢的是同一批想偷懒又想出片的人。

    顺带一提,用 Gemini Omni 生成的视频会打上 SynthID 水印,方便溯源是不是 AI 做的。


  • Apple Intelligence 中国获批:阿里千问打底,百度同场参演

    苹果的生成式 AI 终于要进中国了。这事儿从 2024 年 Apple Intelligence 发布那天起就被卡着,整整拖了快两年,直到本周三(7 月 15 日),网信办正式完成了备案放行。

    苹果与中国市场
    苹果的生成式 AI 服务终于拿到中国市场的入场券(图源:TechCrunch)

    阿里千问成了底座,百度也没缺席

    据路透社报道,这次过审的关键是苹果和阿里的合作——把通义千问(Qwen)模型接进 iOS、iPadOS、macOS 和 visionOS。阿里早前向 CNBC 确认了这件事,说 Qwen 会”集成进 Apple Intelligence 体验”,能力覆盖文本和图像的理解与生成,但没给具体时间表。

    百度这边也松了口。周三晚上,一位百度发言人向 TechCrunch 确认,他们同样在和苹果合作,为中国用户开发 Apple Intelligence 功能,重点放在 AI 搜索和 Siri 的中文能力上。

    也就是说,国行苹果设备上的 AI,大概率会是”阿里千问打底、百度补搜索和语音”的组合,而不是苹果自己的模型。

    为什么这一步拖了这么久

    苹果不是没努力过。此前传出过和百度谈合作,但据报道卡在了模型适配中国用户的环节;之后又先后看了 DeepSeek 和字节的模型,兜兜转转才落定阿里。监管这关没过,Apple Intelligence 的国产版本就一直挂着,眼看华为、小米、OPPO 这些安卓阵营的端侧大模型全都完成备案、铺到了各个价位的机型上,苹果在核心体验上反而和竞品拉开了代差。

    • 大中华区第二季度营收 205 亿美元,同比增长 28%,刚在近期促销后夺回中国手机市场第二的位置;
    • 国行 AI 迟迟不来,让苹果在高端市场最该讲的故事讲不出口;
    • 阿里美股在消息后盘前一度涨约 4%,盘中涨幅超过 6%。

    别高兴太早的几个问号

    备案过了是事实,但苹果和阿里都没承诺上线时间。更实在的问题是:这些推理到底有多少跑在设备本地、多少要走阿里的云?苹果一贯强调的隐私立场,又怎么和中国的内容合规要求对上?这些目前都没有答案,而它们恰恰决定了国行用户最终摸到的是个什么样的 AI。


  • DeepTutor:把 AI 变成陪伴你终身的专属私教(HKUDS 开源)

    DeepTutor:把 AI 变成陪伴你终身的专属私教(HKUDS 开源)

    在 AI 辅导工具层出不穷的今天,大多数产品要么只做”问答”,要么只做”出题”,上下文在每次对话后便归零。香港大学数据科学团队 HKUDS(LightRAG、Vibe-Trading、nanobot 同门)开源的 DeepTutor,想解决的是更本质的问题——如何让 AI 真正”认识”你,并陪你长期、系统地学习。

    一、项目简介

    DeepTutor 是一个智能体原生(agent-native)的终身学习工作台:它将辅导对话、解题、出题测验、文献研究、可视化与掌握度训练整合进同一个可扩展系统,并用一套三层可审计记忆把”个性化”变得可见、可编辑、可追溯。

    DeepTutor Chat 工作台
    Chat 是默认入口:单条对话即可调用工具、挂载知识库、生成图片、咨询子智能体,并在多轮间保持同一上下文。

    二、安装要求与过程

    环境要求:Python 3.11+、Node.js 20+(PyPI 安装方式),或 Node.js 22 LTS(源码方式);Docker 方式无需本地 Python/Node。需要自备一个 LLM 提供商的 API Key,也支持 Ollama / LM Studio / vLLM / llama.cpp 等本地模型。

    官方提供 4 种安装路径,最推荐的是 PyPI 一键安装(完整本地 Web 应用 + CLI,无需克隆仓库):

    mkdir -p my-deeptutor && cd my-deeptutor
    pip install -U deeptutor
    deeptutor init     # 交互式设置端口、LLM 提供商与可选 embedding
    deeptutor start    # 启动后端+前端,默认访问 http://127.0.0.1:3782

    想要一条命令跑起来,也可以用官方 Docker 镜像(仅需暴露 3782 端口):

    docker run --rm --name deeptutor \
      -p 127.0.0.1:3782:3782 \
      -v deeptutor-data:/app/data \
      ghcr.io/hkuds/deeptutor:latest

    此外还有”源码安装(便于二次开发)”与”仅 CLI(无界面)”两种路径,且均可从同一工作区平滑升级到完整 Web 应用。配置全部以 JSON/YAML 形式存放在 data/user/settings/ 下,浏览器里的 Settings 页面即推荐编辑器。

    三、核心功能

    • 一个运行时,覆盖所有学习模式:Chat、Quiz、Research、Visualize、Solve、Mastery Path 共用同一个 Agent Loop,切换的是目标而非引擎,学习上下文始终跟随你。
    • 可连接的学习上下文:知识库、书籍、Co-Writer 草稿、笔记本、题库、人格(Persona)与记忆在各类工作流间共享,不再散落在彼此孤立的工具里。
    • 子智能体与 Partner 伙伴:可在任意对话中实时调用本地 Claude Code / Codex,或导入它们过往的对话记录;也能运行常驻 IM 伙伴(飞书、Telegram、Slack、Discord、钉钉、QQ、企业微信、WhatsApp、Matrix 等)。
    • 多引擎知识库(RAG):可选 LlamaIndex、PageIndex、GraphRAG、LightRAG,或直接挂载 Obsidian vault;文档解析引擎可切换(MinerU / Docling / markitdown 等),并支持版本化、可回滚的索引。
    • 可检视的三层记忆:L1 原始轨迹、L2 表层摘要、L3 跨面综合,层层引用溯源;配套的”记忆图谱”让任何一条个性化结论都能追溯到背后的原始依据。
    DeepTutor 知识中心
    知识中心支持多种检索引擎,每个知识库可独立选择引擎并版本化管理。
    DeepTutor 活书 Book
    Book 把资料一键编译成带测验卡、时间线、交互模块乃至 Manim 动画的”活书”。
    DeepTutor 伙伴 Partner
    Partner 是”有性格、有联系方式”的常驻伙伴,共享同一套大脑与记忆工具。

    四、典型使用场景

    1. 学生个性化辅导:把教材 PDF 建为知识库,让 DeepTutor 按”同伴 / 助教 / 老师”不同人格讲解难点,自动出测验题并给出带解析的参考答案;错题与偏好会沉淀进三层记忆,越用越懂你。

    2. 研究者 / 工程师的文献与写作助手:用 Research 生成带引用的综述,用 Co-Writer 做”选择即改写”的精准编辑(每次改动都是可接受的 diff),用 Book 把资料编译成带交互模块与动画的”活书”。

    3. 团队 / 班级的共享知识中枢:开启多用户鉴权后,一个 data 目录即可托管管理员工作区、彼此隔离的每用户工作区与伙伴工作区;管理员统一分配模型、知识库与技能,普通用户只看到被授权的只读选项,不暴露原始 API Key。

    五、推荐理由(个人使用心得)

    我最看重 DeepTutor 的,是它把”个性化”从一句营销话术变成了可看见、可审计、可编辑的东西。大多数 AI tutor 的记忆是个黑盒,而 DeepTutor 的三层记忆 + 记忆图谱让你能清楚看到”它为什么这么认为你”。对自学者来说,知识库多引擎可选 + 本地模型支持意味着敏感资料不必出网;对开发者来说,MCP、子智能体、CLI 与 EduHub 技能社区又留下了充足的二次创作空间。它不是一个”开箱即用的玩具”,而是一套能陪你长期生长的”学习操作系统”。

    六、下载地址

  • 孩子跟AI聊到想自残,家长会被通知:Meta给青少年对话装上预警

    如果你家孩子半夜睡不着,跟 AI 聊天机器人吐露了想伤害自己的念头,你希望第一时间知道吗?Meta 现在替家长做了这个决定。周四它宣布,一旦青少年在跟 Meta AI 对话时聊到自杀或自残,家长会收到通知;如果对话显示有人可能面临紧急风险,Meta 还在研究直接联系急救部门的功能。

    Meta 应用与青少年 AI 安全
    Meta 给青少年与 AI 的对话加了一道自伤预警。图片来源:NurPhoto / Getty Images(TechCrunch)

    这事的背景并不轻松。这段时间,AI 聊天机器人到底该怎么回应处于危机中的用户,尤其是青少年,正被监管机构和家长盯得很紧。这早就不只是产品体验问题,而是一个越来越绕不开的法律责任问题,直接影响着各家 AI 公司怎么设计、怎么宣传自己的产品。

    先由人工复核,再发提醒

    Meta 说,他们专门建了一套 AI 系统,用来识别青少年明确提到想伤害自己的对话。但它没有让机器直接触发警报,而是加了一道人工关卡——所有被系统标记的聊天,都会先经过人工复核,再决定要不要通知家长。

    “如果青少年的意图比较模糊,我们宁可谨慎一点,也要提醒家长。这意味着有时可能会在其实没什么大事的情况下发出通知,但我们觉得这是一个正确的起点。”——Meta 官方博客

    这套预警目前已经在美国、英国、澳大利亚和加拿大上线,接入的是 Instagram 的家长监督功能,Meta 计划年底前推向全球。

    这是一整套动作里的新一步

    其实这不是 Meta 头一回在这件事上动手。早前它就已经会在青少年反复搜索自杀或自残相关内容时提醒家长,还上线过一个功能,让家长能看到孩子过去一周跟 Meta AI 聊过哪些话题。这次的自伤预警,算是在原有基础上又往前走了一步。

    与此同时,Meta 还把”限制内容”设置的管辖范围扩大到了 Meta AI。这个设置本来是让家长把孩子放进一个更受限的 Instagram 环境里。Meta AI 原本就被训练成不跟青少年聊性、恋爱或酒精相关的话题,而开启”限制内容”后,聊天机器人会拒绝回应更大范围的敏感提问。


    几个关键信息

    • 触发范围:青少年在 Meta AI 对话中明确提及自杀或自残。
    • 流程:AI 标记 → 人工复核 → 通知家长,意图模糊时倾向于宁可多提醒。
    • 覆盖地区:美、英、澳、加已上线,年底前推向全球。
    • 更进一步:无论成人还是青少年,若对话显示有自杀风险,Meta 会联系急救部门——这和它此前对 Facebook、Instagram 帖子的处理方式是一致的。

    把青少年的私密对话交给机器去判断危机,再决定要不要告诉家长,这本身就是个两难。管得太松,可能错过真正的求救信号;管得太严,又容易把孩子的隐私和信任一起挤掉。Meta 选了”宁可误报”这条线,至于这条线画得对不对,恐怕得等它真正跑起来之后,才有答案。

  • 黑石和Anthropic合押15亿美元:这次赌的不是谁家模型强,而是谁能让AI真落地

    这两年大模型一个比一个能打,可真到了企业里,很多人反而更迷糊了:模型是买回来了,钱也花了,然后呢?大部分公司折腾半天,AI 试点项目最后都卡在”演示很惊艳、上线遥遥无期”这一步。现在有人押了一大笔钱,赌的就是解决这个”最后一公里”。

    企业级 AI 落地服务示意
    押注 AI 落地服务,而不是继续卷模型本身。图片来源:TechCrunch

    这家公司叫 Ode with Anthropic,估值 15 亿美元,今年五月悄悄成立,背后是 Anthropic 联手黑石(Blackstone)、Hellman & Friedman、高盛等一票资本搞的合资公司。它的定位不是再造一个更强的模型,而是专门帮别的企业把 AI 真正用起来。有意思的是,OpenAI 早前也干了同样的事,成立了自己的 The Deployment Company。两家顶级大模型公司不约而同地承认了同一件事:想拿下企业客户,光有更好的模型远远不够。

    这门生意是怎么长出来的

    Ode 最早的点子来自黑石。黑石在给自己投资组合里的公司铺 AI 时发现了一个大坑——请来的大型咨询公司太笨重,小的 AI 服务作坊又不够专业,中间是空的。其中一家叫 Fractional AI 的工程服务创业公司格外能打,于是合资公司干脆把它买了下来,当成整个 Ode 的地基。顺带一提,Fractional 被收购时,正好结束了和 OpenAI 长达 11 个月的合作。

    如今 Ode 手上有 100 名工程师,跟 Anthropic 的应用 AI 团队紧密配合,专门去摸清 AI 能在哪些业务环节真正产生价值,再为每家公司量身搭系统。Anthropic 自己的内部团队则继续盯着那些战略级、使命相关的大客户。

    “如果我们执行得好,把它想象成一家万亿美元的公司其实并不难。”——Ode CEO、Fractional 联合创始人 Chris Taylor

    “特种部队”,而不是一支人海大军

    Ode 挑客户有个硬标准:老板得是真信这套东西的人。Taylor 说,他们接的活儿往往是某家公司 CEO 排在前一两位的头等大事,要么是未来两年最重要的产品功能,要么是要重做公司最核心的业务流程。这活儿不轻,所以团队配置也很讲究——超过一半的工程师本身就是前创业者,被内部叫做”成年人级别的工程师”,是精挑细选的特种部队,而不是靠人头堆出来的前线部署工程师(FDE)大军。

    Ode 走的是”Claude 优先”路线,能用 Anthropic 的技术就用,比如 Slack 里的 Claude Tag,但也不排斥在必要时上竞品模型。首席技术官 Eddie Siegel 的比喻挺到位:选模型就像写软件时选编程语言,重要,但绝不是花力气最多的地方。

    “我不会用一家企业选了 Python 还是 Java,去定义它的转型成不成功。”——Ode 首席技术官 Eddie Siegel


    值得盯着的几个点

    • Ode 的核心信念是:那些非 AI 公司,只要用对方法,反而可能成为这波 AI 浪潮里最大的赢家。
    • 背后的私募资本会把自己投的公司源源不断介绍给 Ode,但业务并不只做这些内部客户。
    • 对手不只有 OpenAI 的 The Deployment Company,还有德勤、埃森哲这些也组建了 FDE 团队的咨询巨头。
    • 最大的软肋是人:顶尖工程人才本就稀缺,想一边扩张一边保住”精品”水准,几乎是道解不完的题。

    说到底,模型这几年跑得太快,企业却没跟上。Ode 赌的不是谁家的模型更聪明,而是有没有人能把这块”会魔法但也会胡说八道”的原料,稳稳嵌进真实业务里。这个判断对不对,接下来两年就能见分晓。

  • 纳德拉给用AI的公司提了个醒:你正把家底一点点喂给对手

    硅谷这阵子最让 AI 拥护者睡不着的,不是模型会不会取代人,而是另一件更微妙的事:企业天天把机密数据喂给 OpenAI、Anthropic 这些大厂的模型,会不会等于亲手养大了自己未来的对手。这话以前多是投资人和 Palantir 的老板 Alex Karp 在说,现在,微软 CEO 纳德拉也加入了这个阵营。

    让人意外的是提醒的人是他。要知道微软在 OpenAI 和 Anthropic 身上都下了重注,自家 CEO 却公开叫客户小心模型厂商,这份分量就不一样了。他把这套逻辑写进一篇叫《逆向信息悖论》的博客里,核心就一句话:你用 AI,其实付了两遍钱。

    “你实际上为智能付了两次费,一次用钱,另一次用更宝贵的东西:为了让它真正好用,你不得不交出去的专有知识。你越想让模型表现好,就得喂给它越多这样的知识。” —— 萨提亚·纳德拉

    微软CEO纳德拉警告企业使用AI的隐性成本
    纳德拉的这篇博客被看作对前沿实验室数据“双标”的一次开炮 · 图片来源:TechCrunch

    真正贵的不是 token,是你交出去的经验

    纳德拉说,token 的钱是明码标价的,你知道自己在花;可另一笔支出你根本没察觉。企业为了让模型更懂自己的业务,会一点点把经营诀窍教给它。模型从”使用痕迹”里学习——你写的提示词、智能体调用的工具,尤其是模型犯错时你给的纠正。每一次纠正,都会沉淀成一份企业级的经验。

    而这种经验,恰恰是竞争对手花再多钱也买不来的。问题就在这儿:你在用模型的过程中,主动把它送了出去。时间一长,卖方越来越懂你,你却对它一无所知,信息差只会越拉越大。这就是他说的”逆向信息悖论”——传统市场里是卖方担心白送知识,AI 时代反过来了,轮到买方在白送。

    凭什么你能爬全网,我却不能”蒸馏”你

    纳德拉还顺手点了 AI 公司的双标。这些公司一边主张自己能”合理使用”全网的公开内容来训练模型,一边又在条款里禁止别人”蒸馏”它们的模型——所谓蒸馏,就是分析一个模型的输出,摸清它怎么工作,再据此训练一个通常更便宜的新模型。他觉得很讽刺:既然你能拿全世界的数据训练,那企业反过来研究你的模型,也该是公平的。

    他最警惕的,是模型厂商在服务条款里”保留从客户使用和交互数据中学习的权利”这一条。今年 2 月 Anthropic 还指控过中国的开源模型给 Claude 发了数百万条提示词来改进自己,转头呼吁政府收紧出口管制。纳德拉的意思很直白:这事不能只许一方做。


    他开的药方,顺便也是微软的生意

    当然,作为一家云巨头的老板,纳德拉给的解法也很”云巨头”。他建议企业把数据的所有权攥在自己手里——提示词、反馈这些都算,然后在云上搭一个”专属学习环境”(数据反正大概率已经存在云上,顺理成章可以是微软的 Azure)。他还主张加一层”编排层”,让企业能在不同厂商的模型之间随时切换,别被一家锁死。

    这套话里没直接说”开源”,但潜台词很明显。很多大公司已经在把开源模型部署到自己机房里跑。做 AI 网络与安全的 Solo.io 创始人 Idit Levine 就说,她的客户试完专有模型后,开始琢磨一个问题:能不能用开源模型在本地跑,做到前沿模型近九成的活,成本还低得多。数据也在佐证这股风——上个月经 Vercel 的 AI 网关传输的流量里,已经有 29% 流向了开源模型。这早就不是小圈子的实验,而是一条正在成形的采购趋势。

    • 诊断值得每个 CTO 认真对待:先盘一下哪些系统在把原始客户数据、定价逻辑、运营手册喂给第三方模型;
    • 在生产环境的 AI 前面加一层网关,保证随时能换供应商;
    • 别再把”我们用了 Claude/GPT”当成战略,它更像一件带着数据泄露面的租来的商品。

    纳德拉的诊断和药方,一个偏公心,一个偏私利——Azure 依然是把数据留在云上、只换模型这套逻辑的赢家。但诊断本身没毛病,值得任何一家正在大规模用 AI 的公司拿去对照一遍。

  • 苹果把OpenAI告上法庭:41页诉状里全是“太搞笑了”式的实锤

    两年前的那场 WWDC,苹果还把 OpenAI 请上台,软件工程高级副总裁当着全场夸对方是 AI 领域的”先驱和领导者”,Sam Altman 就坐在台下。谁能想到,两年后苹果会亲手写下一份 41 页的诉状,把 OpenAI 告到加州北区联邦法院,罪名是窃取商业机密外加违约。

    最扎眼的地方不是苹果用词有多重,而是那些被写进诉状的聊天记录太随意了——一位前苹果工程师居然给还在苹果的同事发消息炫耀:”笑死,我发现自己居然还能访问公司内部的网络存储,太搞笑了。”这句话现在原封不动躺在联邦法院的卷宗里。

    “OpenAI 刚起步的硬件业务,如今建在最不牢靠的地基上,靠盗用来的商业机密撑着,从里到外都烂透了。” —— 苹果诉状原文

    苹果起诉 OpenAI 窃取商业机密
    从台上的合作伙伴到法庭上的对手,苹果与 OpenAI 翻脸只用了两年 · 图片来源:TechCrunch

    一台没还的电脑,牵出一串聊天记录

    诉状里点名的这位工程师叫 Chang Liu,在苹果干了八年,做高级系统电气工程师,参与过 iPhone 的硬件研发,今年初跳槽去了 OpenAI。按苹果的说法,人走了,离职流程一样没走——离职面谈不去,保密协议提醒不回,连公司发的笔记本都没还。

    苹果指控,Liu 入职 OpenAI 之后,钻了苹果企业系统里一个此前没人发现的认证漏洞,用那台没归还的电脑继续访问云端文件。他还留下一句”我还有另一台电脑”,苹果是在同事的工作笔记本上翻到这条消息的。而那位同事,被苹果描述成两边之间的”传话人”,收到炫耀消息后回了句”我准备好了”。

    面试要求”自带零件”,还教你怎么躲安检

    更离谱的是硬件负责人这条线。OpenAI 首席硬件官 Tang Tan 在苹果待了 24 年,最后的职位是 iPhone 和 Apple Watch 的产品设计副总裁。苹果说,他在招人时会用上苹果内部的项目代号,还要求那些还在苹果上班的候选人,把”真实零部件””CAD 设计稿””原型机”带到 OpenAI 的面试现场做”展示”。有个候选人当场懵了,说自己都不知道这些东西能带出办公室。

    苹果还翻出一份标着”仅限知情人”的内部文件,指控 OpenAI 把它发给新人,专门教大家怎么躲开苹果的”闪电离职”机制——正常员工提离职后通常还能干两周,趁这段时间正好能多摸点机密;而这份指南教人如何避免被当场清出公司。甚至有交代:万一离职面谈时苹果让你签字,”立刻通知 OpenAI”,别签。


    四百多人只是冰山一角?

    诉状里还甩出一个数字:已经有超过四百名前苹果员工在 OpenAI 工作。苹果用这个数字暗示问题的规模,也顺带把矛头指向 Jony Ive 那家被 OpenAI 以 65 亿美元收购的硬件公司 io,指控它用误导供应商的方式,偷用了苹果的金属表面处理工艺。苹果说这只是”冰山一角”,等进入证据开示环节,会挖出规模大得多的东西。

    • 苹果要求:赔偿、禁止 OpenAI 使用相关机密、销毁所有涉密材料,并保留全部证据;
    • 苹果称去年就在传 OpenAI 要做一款挑战 iPhone 的硬件,可能是靠 AI 智能体而非 App 的设备;
    • 苹果说今年 2 月已私下发函提醒,OpenAI 一直没回应,这才走上法庭。

    OpenAI 这边目前只在 X 上回了一句话:”我们对别家的商业机密没有兴趣,我们专注于打造赋能所有人的创新技术。”这场从合作伙伴变成对簿公堂的戏,接下来大概率还有得看。真要走到证据开示那一步,双方的邮件、短信、服务器日志都会被摆到台面上,谁的地基更稳,到时候自然见分晓。

  • 桥本有菜春日樱花Codex皮肤概念图

    桥本有菜春日樱花Codex皮肤概念图

    桥本有菜春日樱花Codex皮肤概念图



    🤖 ChatGPT

    🇺🇸 English Prompt

    A high-end Codex desktop application skin concept map with Arina Hashimoto as the character theme, fully displaying the Windows desktop software interface, front eye-level screenshot composition, no perspective tilt. The overall integration of fresh Japanese-style photography, spring cherry blossoms, light luxury fashion magazines, and modern digital creative spaces presents a gentle, bright, exquisite, and romantic but not overly sweet visual temperament; this is an unofficial tribute-style concept design, and official authorization logos do not appear.
    
    The overall color scheme uses cherry blossom pink, cream white, champagne gold, light gray purple, and soft rose brown. Interface materials combine delicate washi paper, translucent tulle, mother-of-pearl, frosted acrylic, and light-colored metal. The background uses soft-focus cherry blossom branches, light pink watercolor smudges, light petals, small starlight, and elegant curves as decorations, paired with the soft natural light of a spring afternoon. All floral elements remain sparse and restrained, highlighting the characters and interface information, without forming a wedding poster or cheap pink sticker style.
    
    A gradient navigation bar of cream white and very light cherry blossom pink is set on the left, with the concise word "Codex" and an abstract icon composed of cherry blossom petals and code brackets displayed at the top. The navigation items are "New Inspiration", "Schedule", "Creation Plugins", "Photo Archives", "Version Records", and "Collaboration Space" in order. The project list below includes "Spring Photos", "Styling Inspiration", "Lens Notes", "Color Collection", and "Travel Snippets", and the task list includes "Organize Photos", "Select Styling", "Record Inspiration", and "Complete Layout". Icons uniformly adopt slender rose gold lines, including cameras, petals, hangers, picture frames, starlight, and folders.
    
    The top of the main content area displays "Arina Hashimoto's Exclusive Creative Space", with "Unofficial Concept Skin" marked in small text next to it. A large horizontal main visual welcome area is set in the center, using soft rounded corners, with the background naturally transitioning from cream white, light pink, and light gray purple, adding tulle light and shadow, bokeh spots, and a small amount of falling petals. The left side retains the title and functional information, and the right side displays a high-quality realistic character portrait of Arina Hashimoto.
    
    The character presents the image of an adult East Asian woman, with recognizable exquisite facial features, black or dark brown long hair, soft bangs, clear natural makeup, and a gentle and confident expression. Wearing a dignified and elegant light pink tulle dress or champagne-colored fashion dress, the neckline and skirt design are appropriate, not exposing, not transparent, paired with small pearl earrings. The character's body is slightly turned toward the camera, hands naturally folded near the chin or lightly supporting the side of the face, the posture is elegant and relaxed, gazing at the camera. Using high-end Japanese fashion magazine photography, soft window light, natural skin texture, delicate hair strands, and shallow depth of field, the character naturally integrates with the interface background.
    
    The left side of the main visual welcome area displays a striking Chinese title "What do you want to create today?", and the subtitle "Collect inspiration, let every moment glow gently". Elegant abstract English handwritten lines are added above the title as decoration, but do not copy real signatures or proprietary wordmarks. The text uses deep rose brown to ensure clear contrast with the light background.
    
    Four cream-white rounded functional cards are arranged horizontally at the bottom of the main visual welcome area, using rose gold fine outlines, light pink icons, and soft shadows. The first card uses a camera icon with the text "Organize Images"; the second uses a picture frame icon with the text "Collect Inspiration"; the third uses a palette icon with the text "Explore Color Matching"; the fourth uses starlight and tool icons with the text "Perfect Works". The cards are uniform in size and evenly spaced, with only a small number of petals and tiny starlight added at the corners, not obscuring the text and icons.
    
    Directly below the main visual welcome area, an independent large horizontal rounded creative panel is set, strictly aligned with the left and right edges of the main content area, close to the full width of the content area, with a height of about one-fourth of the main content area. It must rest stably at the bottom of the page and be a complete, clear, and operable input panel, not a floating chat bubble, narrow search bar, capsule input box, terminal, or independent pop-up window.
    
    The outer background of the creative panel is designed as a gradient from cream white to very light cherry blossom pink according to the character theme, with very subtle washi fibers, pearl soft light, and tulle textures. The edges use slender rose gold outlines and soft light brown pink shadows. The overall color is quieter and less decorated than the main visual welcome area, which is consistent with the Japanese photography and spring cherry blossom themes while keeping the input area clear and legible.
    
    A small folder icon and the partition text "Images" are set in the upper left corner of the outer panel. A wide rounded input area is embedded inside the panel, with clear, slender light rose gold outlines all around, and the internal background is a clean warm cream white, retaining ample white space for writing. The placeholder text is located in the upper left of the input area, content is "Write down an inspiration, a scene, or a moment you want to record...". Only a very light petal watermark and a slender curve are kept in the background of the input area, and decorations cannot enter the main text area.
    
    In the same input panel, a complete bottom control bar is set: on the far left is a circular plus button with a rose gold fine border; next to it are "Full Access" mode controls and a favorite icon; on the right are the model status "5.6 Sol Mid", a down arrow, and a microphone icon; on the far right is a solid circular send button, using a soft rose pink to coral pink gradient, with a clear cream white upward arrow inside. The corners of the panel are only decorated with a small sprig of light pink cherry blossoms, two or three petals, and a small amount of pearl starlight, not obscuring the placeholder text, model selector, or send button.
    
    A slightly tilted vintage Polaroid photo can be stacked in the lower right corner, showing a half-length photo of the character in soft window light, fixed with a short piece of light pink ribbon tape; the photo cannot obscure the important controls of the input panel.
    
    The interface must maintain a real, complete, and operable desktop application structure, rather than a character promotional poster. The character occupies about one-third of the right side of the main visual welcome area, and the left title, four functional cards, and the bottom input panel are clear and complete. Using high-end commercial UI/UX design, precise grids, clear visual hierarchy, loose white space, uniform rounded corners, delicate outlines, restrained shadows, real materials, and Japanese magazine-level color grading. All specified Chinese text is clearly discernible and presents short texts such as "New Inspiration", "Schedule", "Photo Archives", "What do you want to create today?", "Organize Images", "Collect Inspiration", "Explore Color Matching", "Perfect Works", and "Images" as accurately as possible. Ultra-high detail, 4K product display quality, complete window borders, without cropping any important components.
    
    Aspect ratio 16:10
    
    Negative constraints: low resolution, blurred, pixelated, over-sharpened, overexposed, over-saturated colors, cheap pink filters, gaudy studio style, wedding poster style, cartoon idol style, excessive roses, heart stickers, piled up petals, cluttered background, messy interface hierarchy, misaligned components, cropped window, severe perspective distortion, repeated cards, repeated characters, overlapping text, garbled Chinese, random English letters, wrong menu text, bottom input box size too small, input box becomes narrow search bar, capsule-shaped input box, floating chat bubble, input panel detached from the page, input panel becomes terminal or pop-up, missing outer large panel, missing inner input outline, missing bottom control bar, missing circular plus or send button, input area filled with floral decorations, input box uses pure black smoked glass, sexual hints, nude clothing, transparent clothing, lingerie styling, suggestive poses, character face drift, wrong hairstyle, wrong age performance, exaggerated expressions, waxy feeling, plastic skin, wrong body proportions, hand deformities, extra fingers, extra arms, fused fingers, hard edges between character and background, copying real signatures, forging official logos, presenting as official cooperation or officially authorized product, watermark.

    🇨🇳 中文提示词

    一张以桥本有菜为人物主题的高端 Codex 桌面应用皮肤概念图,完整展示 Windows 桌面软件界面,正面平视截图构图,无透视倾斜。整体融合清新日系写真、春日樱花、轻奢时尚杂志与现代数字创作空间,呈现温柔、明亮、精致、浪漫但不过度甜腻的视觉气质;这是非官方致敬型概念设计,不出现官方授权标识。
    
    整体采用樱花粉、奶油白、香槟金、浅灰紫和柔和玫瑰棕配色。界面材质结合细腻和纸、半透明薄纱、珍珠母贝、磨砂亚克力与浅色金属。背景使用柔焦樱花枝、淡粉水彩晕染、轻盈花瓣、细小星光和优雅曲线作为装饰,搭配春日下午的柔和自然光。所有花卉元素保持疏朗克制,重点突出人物和界面信息,不形成婚礼海报或廉价粉色贴纸风格。
    
    左侧设置奶油白与极浅樱花粉渐变导航栏,顶部显示简洁的“Codex”字样以及由樱花花瓣和代码括号组成的抽象图标。导航项目依次为“新建灵感”“日程安排”“创作插件”“写真档案”“版本记录”“协作空间”。下方项目列表包括“春日写真”“造型灵感”“镜头笔记”“色彩收藏”“旅行片段”,任务列表包括“整理照片”“选择造型”“记录灵感”“完成排版”。图标统一采用纤细玫瑰金线条,包含相机、花瓣、衣架、画框、星光和文件夹。
    
    主内容区顶部显示“桥本有菜专属创作空间”,旁边以小号文字标注“非官方概念皮肤”。中央设置大型横向主视觉欢迎区域,使用柔和圆角,背景由奶油白、浅粉和淡灰紫自然过渡,加入薄纱光影、散景光斑与少量飘落花瓣。左侧保留标题和功能信息,右侧展示桥本有菜的高品质写实人物肖像。
    
    人物呈现成年东亚女性形象,具有可识别的精致面部特征、黑色或深棕色长发、柔和刘海、清透自然妆容和温柔自信的神情。身穿端庄优雅的浅粉色薄纱礼服或香槟色时尚连衣裙,领口与裙身设计得体,不暴露、不透明,搭配小巧珍珠耳饰。人物身体微微侧向镜头,双手自然交叠靠近下颌或轻扶脸侧,姿态优雅放松,凝视镜头。采用高端日系时尚杂志摄影、柔和窗边光、自然皮肤纹理、细腻发丝和浅景深,人物与界面背景自然融合。
    
    主视觉欢迎区域左侧显示醒目中文标题“今天想创造什么?”,副标题“收藏灵感,让每个瞬间温柔发光”。标题上方加入优雅的抽象英文手写线条作为装饰,但不复制真实签名或专有字标。文字使用深玫瑰棕色,保证与浅色背景之间具有清晰对比。
    
    主视觉欢迎区域下部横向排列四张奶油白圆角功能卡片,使用玫瑰金细描边、浅粉图标和柔和阴影。第一张使用相机图标,文字“整理影像”;第二张使用画框图标,文字“收藏灵感”;第三张使用调色盘图标,文字“探索配色”;第四张使用星光与工具图标,文字“完善作品”。卡片尺寸统一、间距均匀,仅在边角加入少量花瓣和细小星光,不遮挡文字与图标。
    
    主视觉欢迎区域正下方设置一个独立的大型横向圆角创作面板,与主内容区左右边缘严格对齐,接近内容区全宽,高度约占主内容区域的四分之一。它必须稳定落在页面底部,是完整、清晰、可操作的输入面板,不是悬浮聊天气泡、狭窄搜索栏、胶囊输入框、终端或独立弹窗。
    
    创作面板外层背景根据人物主题设计为奶油白至极浅樱花粉渐变,带有非常细微的和纸纤维、珍珠柔光和薄纱纹理。边缘使用纤细玫瑰金描边与柔和浅棕粉阴影。整体颜色比主视觉欢迎区域更安静、装饰更少,既与日系写真和春日樱花主题一致,又保持输入区域清晰易读。
    
    外层面板左上角设置小型文件夹图标和分区文字“影像”。面板内部嵌入一个宽大的圆角输入区域,四周具有清晰、纤细的浅玫瑰金描边,内部背景为干净的暖奶油白,保留充足空白书写空间。占位文字位于输入区域左上方,内容为“写下一段灵感、画面或想记录的瞬间……”。输入区背景只保留极淡的花瓣水印和一条纤细曲线,装饰不能进入主要文字区域。
    
    在同一个输入面板内部设置完整的底部控制栏:最左侧是带玫瑰金细边框的圆形加号按钮;旁边依次是“完全访问”模式控制和收藏图标;右侧依次放置模型状态“5.6 Sol 中”、下拉箭头和麦克风图标;最右端设置一个实心圆形发送按钮,采用柔和玫瑰粉至珊瑚粉渐变,内部为清晰的奶油白向上箭头。面板边角仅点缀一小枝淡粉樱花、两三片花瓣和少量珍珠星光,不遮挡占位文字、模型选择器或发送按钮。
    
    右下角可以叠放一张略微倾斜的复古拍立得照片,内容为人物在柔和窗光中的半身写真,使用一小段浅粉色丝带胶带固定;照片不能遮挡输入面板的重要控件。
    
    界面必须保持真实、完整、可操作的桌面应用结构,而不是人物宣传海报。人物约占主视觉欢迎区域右侧三分之一,左侧标题、四张功能卡片和底部输入面板清晰完整。采用高级商业UI/UX设计、精确网格、明确视觉层级、宽松留白、统一圆角、细腻描边、克制阴影、真实材质和日系杂志级色彩分级。所有指定中文清晰可辨,并尽可能准确呈现“新建灵感”“日程安排”“写真档案”“今天想创造什么?”“整理影像”“收藏灵感”“探索配色”“完善作品”“影像”等短文本。超高细节,4K产品展示品质,完整窗口边界,不裁切任何重要组件。
    
    宽高比 16:10
    
    负面约束:低清晰度,模糊,像素化,过度锐化,过度曝光,颜色过饱和,廉价粉色滤镜,俗艳影楼风,婚礼海报风,卡通偶像画风,过量玫瑰,爱心贴纸,花瓣堆砌,杂乱背景,界面层级混乱,组件错位,窗口被裁切,严重透视畸变,重复卡片,重复人物,文字重叠,乱码中文,随机英文字母,错误菜单文字,底部输入框尺寸过小,输入框变成狭窄搜索栏,胶囊形输入框,悬浮聊天气泡,输入面板脱离页面,输入面板变成终端或弹窗,缺少外层大面板,缺少内层输入描边,缺少底部控制栏,缺少圆形加号或发送按钮,输入区域被花卉装饰占满,输入框使用纯黑烟雾玻璃,色情暗示,裸露服装,透明服装,内衣造型,挑逗姿势,人物脸部漂移,错误发型,错误年龄表现,夸张表情,蜡像感,塑料皮肤,身体比例错误,手部畸形,多余手指,多余手臂,手指融合,人物与背景边缘生硬,复制真实签名,伪造官方Logo,呈现为官方合作或官方授权产品,水印。