标签: AIGC

  • 谷歌把Gemini Omni的免费体验又延了一周,AI视频这扇门正越开越大

    想玩AI视频又不想掏钱的人,谷歌又给了你一周机会。多家外媒报道,Google把Gemini Omni的免费体验期从原定的8月4日,延长到了太平洋时间8月11日中午。也就是说,只要你有个Gemini账号,不用订阅任何Google AI付费套餐,就能免费生成最多10条视频。

    它和普通文生视频工具有什么不一样

    大多数AI视频工具的逻辑是”写一句提示词、出一段片子”,不满意就得整段重写。Gemini Omni不一样,它把文字、图片和现成视频都当成输入,你先生成一段,然后可以接着用自然语言改:换风格、重剪、围绕同一段素材反复调,角色和画面连贯性还能保住。这种”对话式”的连续编辑,才是它真正有意思的地方。

    谷歌把Omni定义成”世界模型”,而不是单纯的视频生成器——它要理解物理规律和场景的连贯性,而不只是吐出一段好看的片子。

    背后是谷歌把工具收进一个入口

    这件事的另一层意思,是谷歌在把原本分散的几个工具合到一起。过去你想做图要用Imagen,做视频用Veo,修图用Nano Banana Pro,配乐用Lyria——现在Omni一个模型把这些活儿都揽了。它走的是和Gemini 3.5不同的路线:3.5负责agentic那种长任务执行,Omni专门做内容创作。

    免费入口也给得相当大方:除了Gemini App和Google Flow,它还通过YouTube Shorts和YouTube Create免费开放,所有生成视频都打了SynthID隐形水印,方便溯源是不是AI做的。

    为什么突然延期

    谷歌没解释延期的具体原因。但一个很直接的信号是:第一轮免费开放时,不少人在X上晒出自己用Omni做的片子,从把旅行片段改成超现实风,到给社交帖做视觉实验,五花八门。让人先免费用、先玩起来、先往外传,本身就是最好的推广——等大家习惯了这种创作方式,再谈付费就顺多了。

    对普通用户来说,这周是最好的上手窗口。10次额度不算多,但足够你把一个想法从文字或多张图,变成一段会动的视频,看看AI到底能把你的脑洞撑多大。等8月11日一过,这扇免费门大概率就要关上了。

    Gemini Omni 用图文视频生成AI视频
    文字、图片、视频都能当输入,对话式连续编辑是Omni的核心差异

    • Gemini Omni免费期延至8月11日,普通用户可免订阅生成最多10条视频
    • 支持文字/图片/视频混合输入,可对话式连续编辑,角色连贯
    • 谷歌把Veo/Imagen/Lyria等工具收进统一入口,视频带SynthID水印
  • Canva把AI野心撑太大了:营收预期砍掉三分之一,根子在第三方模型太贵

    Canva最近给投资人交了一份有点尴尬的成绩单。这家估值420亿美元、连续九年盈利的设计平台,把2026年的营收增长预期从年初定的30%下调到了20%——一口气砍掉三分之一。二季度营收其实还在涨,9.219亿美元,同比增25.2%,账上躺着14.7亿美元现金。问题不在需求,在于AI太烧钱。

    CEO梅兰妮·珀金斯在股东信里说得很直白:公司“过度依赖前沿模型”,自家的一批模型还没准备好上线,定价和消费模型又没跟上暴涨的用量。说白了,Canva想借OpenAI这些外部大模型把AI功能快速铺开,结果发现每次调用都在亏钱。

    “我们决定放慢铺开节奏,一边重建架构、压低单位成本,一边把商业模式做扎实。”——梅兰妮·珀金斯

    这事儿其实戳中了不少SaaS公司的痛点。Atlassian前不久就给员工AI支出设了上限。当“AI优先”从口号变成真金白银的账单,大家才意识到:用户每点一下生成按钮,背后都是实打实的算力开销。Canva有2.65亿月活、3100万付费用户,一个月生成的设计超过10亿张,这种体量下,每次调用的成本差一点,季度账单就能差出几千万。

    Canva的AI成本与自建模型
    AI功能铺得太快,算力账单先一步到来(配图由AI生成)

    过去三个月Canva没闲着。它重写了AI架构,把更多活儿交给2024年收购的Leonardo.AI和自研模型。效果挺猛:单个AI任务的服务成本降了将近九成,自家视频模型比前沿模型便宜17倍,图像模型便宜30倍。2.1版本已经在路上,珀金斯说会“审慎铺开”。

    一场给行业的刹车提醒

    这场“刹车”说明一件事:生成式AI的功能谁都能加,但要把单位经济算平,终究得自己掌握模型。外采省事,代价是利润被算力一点点吃掉。Canva用九成降本换来的经验,值得所有想做AI功能的SaaS公司记一笔。


    • 营收增长预期从30%降到20%,二季度营收9.219亿美元仍同比增25.2%
    • 根因:过度依赖OpenAI等前沿模型,单次AI服务成本过高
    • 自建模型+收购Leonardo.AI,AI任务成本降约90%,图像模型便宜30倍
    • 估值420亿美元、连续九年盈利,正考虑纳斯达克上市
  • 领英上线“这看着像AI垃圾”按钮,让用户亲手举报满屏水文

    刷领英的人这两年应该都有同感:动态里的帖子越来越像一个人写的。开头必是一句反问,中间三段排比,结尾再来一句”你怎么看?”——那股塑料味的职场感悟,八成不是人敲出来的。现在领英终于承认这事儿了,而且给了用户一个出气口:看到疑似AI灌水的帖子,直接点一个”这看着像AI垃圾”的按钮。

    领英 LinkedIn 应用界面
    领英上线”Seems like AI slop”举报按钮(图片来源:TechCrunch / Getty Images)

    把判断权交回给刷动态的人

    这个功能是周四官宣的。逻辑很朴素:机器分不清的东西,人一眼就能看出来。你读到一篇八股味浓得化不开的”深度思考”,点一下按钮,这条信号就进了领英的模型训练池。

    领英首席产品官 Hari Srinivasan 自己在领英上发帖说这事,措辞相当直白,没有那种打太极的公关腔。

    “AI 垃圾内容是我们所有人的头号优先事项,我们是真的在意这件事。人们来领英,是想跟真实的人建立连接、分享真实的观点、想法和专业经验。”

    不只是多了个按钮

    举报键只是摆在明面上的那一层。Srinivasan 透露的几组数字,说明后台的仗打得更凶:领英现在每天要拦掉”数十万次”自动化评论尝试,过去两个月里拦下的各类自动化行为则是数百万次。

    配套动作还有几项:

    • 新增分类器,专门识别AI水文和其他低质内容,重点压制”推荐给你”里那些来自陌生人的帖子;
    • 如果系统判断你的帖子因为AI味太重显得不真诚,会在你自己的后台悄悄提示你——不公开挂人,算是留了面子;
    • 扩大个人主页和企业主页的认证入口;
    • 新增屏蔽企业号评论的选项,不想看的公司可以直接静音。

    那条私下提示的设计其实挺聪明。领英区分了两种人:一种是拿AI润色自己想法的,另一种是整篇甩给模型生成的。前者只是需要提醒收一收腔调,后者才是要治的病。

    连自己的AI写作功能都撤了

    最值得玩味的一步在这里:领英把自家那个”优化你的帖子”功能下线了。这个功能当初就是用AI帮你改写文案的,现在换成了一个只做校对的工具——改错别字和语法,但不动你说话的调调。

    平台一边推AI写作助手,一边抱怨满屏都是AI味,这个循环本来就闭不上。领英至少认了这笔账。


    整个互联网都在跟水文较劲

    领英不是孤例。上周 Substack 刚上线了一个工具,跟检测公司 Pangram 合作,直接告诉读者眼前这篇newsletter是不是AI写的;Pangram 本周宣布拿了900万美元新融资,就靠替互联网做AI内容检测这门生意。更惨的是 Digg——今年3月它那个对标 Reddit 的产品直接关停,官方说法是机器人多到管不过来。

    Cloudflare 给出的判断更狠:网络上的机器人流量已经超过了人类发出的请求,而且这个临界点来得比他们自己预测的还早。

    所以领英这个按钮,与其说是个产品功能,不如说是一次公开表态:内容平台开始意识到,真人写的东西正在变成稀缺品。至于用户举报能不能真的把水文按下去,还得看那套分类器有多少斤两——毕竟”读起来像AI”和”确实是AI”,中间隔着不小的误伤空间。

  • Netflix 5.87 亿美元买下本·阿弗莱克那家藏了三年的 AI 电影公司

    本·阿弗莱克手里那家藏了三年多的 AI 电影公司,到底值多少钱,现在有答案了。Netflix 上周五递交给美国证监会的一份 10-Q 文件里,写着 2026 年 3 月完成的一桩收购,总对价约 5.87 亿美元,全部是现金。文件没点名,但业内一眼就能看出,这说的正是阿弗莱克联合创办的 InterPositive。

    AI 电影后期制作概念图
    Netflix 用 5.87 亿美元买下 AI 电影后期技术公司 InterPositive(示意图)

    收购本身早在 3 月 5 日就官宣了,只是价格一直没公开。彭博当时的报道说,加上业绩对赌,这笔交易最高可能摸到 6 亿美元。RedBird Capital 是 InterPositive 早期的投资方之一。至于阿弗莱克个人到手多少,没人透露。

    它做的不是”凭空生成一部电影”

    很多人一听 AI 拍电影,脑子里冒出来的是输入一段文字、吐出一段视频。InterPositive 偏偏不走这条路。阿弗莱克反复强调,这不是 text-to-video,不是无中生有,而是帮剧组把后期那些又费钱又磨人的活儿做顺。调色、补光、加特效、重新构图、换背景、修穿帮、补缺的镜头——这些原本可能得把演员和剧组重新叫回片场重拍的环节,正是它的主场。

    “我知道自己对同行、对这个行业负有责任,要守住人类创造力的力量,以及创造力背后的人。做 InterPositive,就是想做这件事。”——本·阿弗莱克

    技术上有个挺关键的细节:它的模型只拿每个项目自己的每日拍摄毛片来训练,为的是保持这部片子内部的视觉逻辑和剪辑连贯,而不是拿一堆别人的作品去喂。阿弗莱克 2022 年低调创办这家公司,一支 16 人的工程师、研究员和创意人团队一直闷头干活,这次连人带技术全部并入 Netflix,他本人则出任高级顾问。

    Netflix 已经有 300 个项目在用 AI

    联席 CEO 泰德·萨兰多斯在本周财报电话会上说得很直接:目前大约 300 个片目已经在制作流程里用上了生成式 AI,绝大多数集中在后期,专门啃那些特别复杂的镜头和段落。他举了个例子——汤姆·汉克斯监制的纪录片《美国实验》,里面有 17 分钟是 AI 增强的画面。

    • 这 17 分钟的制作速度是过去的两倍;
    • 成本只有传统方式的一半;
    • 按萨兰多斯的说法,”用老办法根本做不出来的规模,现在做到了”。

    这笔钱花得也不算轻松。Netflix 二季度财报出来后股价一路下挫,周一又跌了 2%,报 67.60 美元,2026 年全年营收指引被收窄到 510 亿到 514 亿美元之间。在这种背景下砸半个多亿美元买一家 AI 公司,说明它对生成式 AV 改造制作流程这件事是真下注了。

    另一边,好莱坞对 AI 的警惕一点没松。阿弗莱克本人是演员工会 SAG-AFTRA 的成员,工会刚跟各大制片厂谈下新合同,专门给生成式 AI 划了红线,明确偏向保护真人表演。就在这个月,一个叫 Tilly Norwood 的 AI”演员”还接到了首个正式角色。让一位以”保住电影的人味儿”为口号的影人来牵头 AI 工具,Netflix 这步棋,多少有点想让创作圈更容易接受 AI 的意思。

  • 字节跳动放出 Seed Audio 1.0:给视频配音,AI 不再只会「念稿」

    字节跳动 Seed Audio 1.0 音频创作模型
    Seed Audio 1.0 用统一框架联合建模人声、音效与环境声(概念图)

    做短视频、短剧的人大概都有过这种崩溃:画面拍好了,配一段像样的音效比写脚本还费劲。人声要去录音棚,环境声要现找素材,音效还得一笔笔手动对时间轴。7月20日,字节跳动 Seed 团队丢出一个叫 Seed Audio 1.0 的模型,想把这个流程一口气吞掉。

    它不是拼接,是「一起想」

    过去这类工具大多是各管一摊:一个模型生成人声,一个模型找音效,最后人工混音。Seed Audio 1.0 的卖点在于,它在一个统一框架里同时建模人声、音效和环境声,端到端直接产出一段能拿来叙事的完整声音。官方一句话挺妙:声音不再只是画面的补丁,而是能直接参与讲故事,「听见」即「看见」。

    具体有三个本事。第一是精细的时间编排,按时间线控制对白和音效什么时候进场,精度能到 100 毫秒,做视频配音和广告卡点刚好。第二是音色稳,支持零样本生成和长音频延展,一个角色从头到尾音色不变,还能同一声音演多个角色、带不同情绪。第三是语种全,覆盖中文、英文、日语等 20 多种语言,重音和节奏都按当地习惯来。

    官方评测显示,在影视、短剧、动漫、播客等多数场景里,音频可用率已经跑到 90% 以上;多语言自然度方面,大部分语种 MOS 评分超过 4 分,算优秀水平。

    从「会说」到「会创作」

    这中间的区别挺关键。早几年的语音合成,本质是把文字念出来,语调再自然也还是「读稿」。Seed Audio 1.0 瞄准的是创作——你给一条指令,它自己安排谁说话、什么情绪、背景音怎么铺、什么时候淡入。对短剧和动漫团队来说,这意味着原本要分几个工种、花几天的活,可能压缩到一轮生成。

    • 影视级音频:对白、音效、环境声统一编排,叙事更连贯
    • 可控音色:长音频保持一致,同一声音可演多角色
    • 20+ 语种:自然生成,适配本地表达节奏

    先上体验,后面还有大招

    模型现在已经放在火山方舟体验中心,创作者能直接试。团队放话,接下来会接进视频参考这类多模态输入,还会做可控翻译、长音频和分轨生成,方向是把脑子里的声音构想更快变成能听见的成品。


    大模型从文本、图像一路卷到音频,Seed Audio 1.0 是个信号:AI 音频正从单点工具走向全场景创作平台。对内容创作者,门槛又低了一截;对行业,竞争也从「谁念得真」变成「谁编得巧」。

  • Google Photos 上线 Video Remix:几秒把废片改成水彩画

    谷歌给 Google 相册塞进了一个新玩具,叫 Video Remix。它背后是 Gemini Omni 模型,用法简单到有点离谱:在”Create”标签页里挑一段视频,选个模板,剩下的交给 AI。

    Google Photos Video Remix
    Video Remix 把视频编辑变成几步点击的模板游戏(图源:TechCrunch)

    它能干啥

    最核心的三类玩法:一是电影级重新打光,把拍暗了的片段自动提亮;二是换背景,把平淡的墙换成咖啡馆或者海滩日落;三是艺术滤镜,把视频涂成水彩、素描本或者油画的样子。你不用碰时间轴,也不用调色轮,点几下就出片。

    “做出好看的视频片段,不该需要专业技能,也不该耗费几个小时。”谷歌在博客里这么写,”现在用 Photos 里的 Video Remix,几步点击就能把普通视频变成值得分享的瞬间。”

    实际限制也挺明确:视频总长得在 60 秒以内,而且你只能挑其中 1 到 10 秒的片段来做变换;素材还得已经备份到 Google 相册里。

    门槛藏在订阅里

    这个功能只对成年人开放,而且不是免费用户能碰的——它绑在 Google AI Plus、Pro、Ultra 这几个付费档上,首批开放的市场包括美国、日本、韩国、印度等 14 个国家。免费相册用户暂时和它无缘。

    • AI Plus 每月 4.99 美元(今年 6 月刚从 7.99 降下来),带 400GB 存储,能用 Video Remix;
    • AI Pro 每月 19.99 美元,5TB 存储;
    • AI Ultra 每月 100 到 200 美元,面向重度用户。

    把”生成式视频”关在付费墙后面,说明谷歌的算盘和存储费一个逻辑:好用,但跑在云端烧钱,所以按量计费。此前 Magic Eraser、背景虚化这些相册 AI 工具都是免费的,这次是个明显的转向。

    谷歌想把相册变成创作入口

    Video Remix 不是孤立的。谷歌近半年往 Photos 里塞了一连串 AI:照片转动图、Photo Remix 把静图变成 3D 动画和漫画风、AI 修图、甚至一个数字衣橱帮你试穿搭。它的野心很清楚——相册不该只是备份仓库,而要成为你不用跳出谷歌生态就能修图、生成、玩创意的地方。这跟苹果 iOS 的回忆视频、Adobe 的 AI 剪辑、Meta 的 Muse Image,抢的是同一批想偷懒又想出片的人。

    顺带一提,用 Gemini Omni 生成的视频会打上 SynthID 水印,方便溯源是不是 AI 做的。


  • Meta上线AI绘图工具Muse Image:@一下就能拿别人的照片生成图,隐私雷区炸了

    Meta 新推出的 AI 绘图工具 Muse Image
    Meta 的 AI 绘图工具 Muse Image,上线即引发隐私争议(图源:TechCrunch)

    Meta 刚把自家的 AI 图片生成器 Muse Image 端上台面。这个由 Meta Superintelligence Labs(就是那个”超级智能实验室”)打造的工具,内部代号叫 Mango,现在能通过 Meta AI App、Instagram Stories 和 WhatsApp 免费使用。听起来挺普通的一次产品发布,结果上线没多久就踩到了用户最敏感的神经。

    一个让人后背发凉的设定

    大多数 AI 绘图工具干的活都差不多——输入提示词,生成点卡通化、搞怪的图片。Muse 也给了”预设提示词”帮没灵感的人起头。但真正惹火的,是它的一项功能:只要对方的 Instagram 是公开账号,你只要在生成时 @ 一下这个人,就能直接拿 ta 的照片去生成一张全新的 AI 图。

    “把真实用户拉进未经明确同意的生成图片里,就是一颗等着引爆的隐私地雷。”——一位 X 用户在该功能被指出潜在侵权后这样写道。

    更要命的是 Meta 的政策白纸黑字写着:别人”可以用你的 Instagram 内容,借助 Meta 的 AI 功能去创作内容”,而且”你不会收到任何关于用 AI 生成内容的通知”。也就是说,这个功能默认是 opt-out——你不主动关,你的照片就可能被拿去用。

    争议之后,功能被连夜撤下

    用户的不满迅速发酵,连经纪公司(比如 CAA)也站出来反对。压力下,Meta 在周五发了一篇博文,正式移除了这个 @ 提及生成的功能。官方承认初衷是提供创作工具、让用户能控制公开内容的引用方式,但市场反馈表明它”没能达到预期效果”。一次上线、一次撤回,前后不过几天。

    它本来还能做不少正经事

    • 用预设或自定义提示词做图,还能对接 Facebook Marketplace 帮你”脑补”二手沙发摆进自家车库的模样;
    • 基于提示词修图——把背景里的路人干净擦掉,或者生成一个能用的二维码;
    • 给 Instagram Stories 推出一批由 Muse 驱动的新特效和滤镜;
    • 日常创作免费,超过一定额度要订阅;顺带提一句,Muse Video 也已经在开发中。

    这些用法其实都不算出格,甚至挺有想象力。可惜被那个默认开启的 @ 生图功能盖过了风头。

    为什么大家的反应这么大

    说到底,是 Meta 自己的隐私旧账让人信不过。2019 年它因为 Cambridge Analytica 事件被 FTC 开了 50 亿美元的天价罚单——对方在用户不知情的情况下,抓走了数千万 Facebook 用户的数据去建选民画像。2021 年,Meta 又在一片诉讼和监管声里关停了会自动识别照片中人脸的人脸识别系统。Muse 这个”默认 opt-out、除非你关否则数据照用”的套路,正好踩在用户和监管早就标记过的那根红线上。


  • TIDAL对AI音乐下手了,完全AI生成的曲目直接切断变现

    流媒体平台TIDAL本周宣布了一项新政策:完全由AI生成的音乐,将在平台上被标识、去 monetization(切断变现)。这项政策将于2026年7月15日正式生效,是迄今主流音乐流媒体平台中对AI音乐最严厉的限制之一。

    AI音乐,打上标签,不能赚钱

    根据TIDAL的说法,完全AI生成的曲目将被自动识别并打上”AI”标识,这些曲目无法获得版税收入,也不能参与粉丝直接销售(direct-to-fan sales)。同时,TIDAL将使用自动化工具移除那些试图冒充真歌手或乐队的AI生成音乐。

    TIDAL AI音乐监管
    TIDAL推出新政策,完全AI生成的音乐将被标识并切断变现

    TIDAL执行副总裁兼主编Tony Gervino在公告中写道:”我们致力于保护和奖励有机创意(organic creativity),避免损害艺术家与TIDAL订阅者建立和扩大粉丝群体的能力。很多人告诉我们,他们不想被暴露——或者被推荐——完全AI生成的音乐。”

    “We are committed to protecting and rewarding organic creativity… Many have told us they do not want to be exposed to — or prompted to listen to — wholly AI-generated music.” —— Tony Gervino,TIDAL执行副总裁

    不是反对技术进步,是要保护真人创作者

    Gervino特别澄清,这项政策不是为了”抨击技术进步”,而是专注于保护和奖励艺术家的”有机创意”。这个表态其实是必要的——如果话说得太死,容易被人解读成保守倒退。但实际上,TIDAL的策略比看上去更精细:它针对的是”完全AI生成”的音乐,而不是用AI作为辅助工具的创作。

    现实是,AI音乐工具已经成了很多音乐人的创作辅助——就像摄影师用Photoshop一样。TIDAL要打击的,是那些纯粹用AI批量生成、试图冒充人类创作者来赚钱的”垃圾内容”。

    各家平台都在表态,但做法不一样

    TIDAL并不是第一个对AI音乐表态的流媒体平台。过去一年多,Spotify、Apple Music、Deezer、Qobuz都推出了各自的政策。

    • Spotify:2025年更新政策,要求标识AI音乐,加强垃圾内容过滤
    • Apple Music:2026年3月宣布将为AI音乐添加透明度标签
    • Deezer:态度最强硬——44%的新上传音乐是AI生成的,所以主动把AI曲目移出推荐、排除出编辑歌单,还把自己的AI检测技术开放给竞争对手使用

    Deezer的数据其实是最让人震惊的:每天上传到平台的新音乐里,近一半是AI生成的。这才是TIDAL们真正担心的事情——如果AI音乐的量继续爆发,人类艺术家的作品会被淹没,平台的”音乐发现”功能也会失效。


    切断变现,能不能刹住AI音乐的洪流?

    TIDAL的政策最有意思的地方在于,它选择用”切断变现”而不是”完全封禁”来对付AI音乐。这个思路值得玩味——完全封禁会引来言论自由/创作自由的争议,但切断变现至少能让批量生产AI音乐的人失去经济动力。

    Gervino自己也说:”无论你在别处读到什么,AI接管音乐产业(和你的推荐列表)并不是不可避免的,只要我们现在采取更大的步骤来监控和控制它。”

    这项政策被设计成”活文档”(living document),会随着AI技术的发展不断调整。对音乐人来说,这至少是个积极的信号:平台方开始在商业利益和艺术保护之间选边站了。

  • Gemini个性化图像生成向美国用户免费开放,7.5亿人都在用

    谷歌这周一(6月29日)悄悄改了一条规则:Gemini 的个性化图像生成功能,现在对所有符合条件的美国用户免费开放。在此之前,这套由 Nano Banana 驱动的工具只给付费订阅用户使用。

    这件事看起来只是一次”降费”,但背后有点意思。个性化图像生成的意思是,Gemini 会参考它对你的了解——比如你平时在 Gmail、Google Photos、YouTube、搜索里的痕迹——然后直接生成”像你的”图片。你不用在提示词里写”我喜欢咖啡和烘焙”,只要说”画一张我和我喜欢的东西在一起”,它就知道该画什么。

    Gemini个性化AI图像生成
    Gemini 个性化图像生成功能现已向美国用户免费开放

    “个人智能”铺了三个月,终于到免费这一步

    这套功能的正式名字叫”个人智能”(Personal Intelligence),谷歌今年3月就向全美用户推开了,但图像生成这块一直锁给付费用户。4月的时候,谷歌先把这套能力开放给了印度和日本市场,现在终于回到美国本土,把图像生成这层墙也拆了。

    用起来其实挺直接的。Gemini 可以从你的 Google Photos 里直接拉取你的照片,所以不用手动上传参考图,它知道你长什么样。当然,这一切的前提是你主动打开了”个人智能”开关——这是个需要手动开启的功能,不是默认打开的。打开之后,它会在每次对话里默认启用,但你随时可以在工具菜单里关掉。

    谷歌在公告里说,Gemini 月度活跃用户已经突破7.5亿。这个数字让它稳住了”ChatGPT 之外第二大 AI 聊天工具”的位置。

    不止是图像生成

    图像生成免费只是这次更新的一部分。上个月,谷歌还给 Gemini 应用塞了一堆新东西:一个叫”每日简报”(Daily Brief)的功能、重新设计的界面、AI 视频模型 Gemini Omni 的接入权限,还有一个叫 Gemini Spark 的个人 AI 代理。

    把这些动作连起来看,谷歌的思路其实很清楚:它想把 Gemini 从”一个可以聊天的 AI”变成”一个真正了解你、能主动帮你的 AI 助手”。个性化图像生成是这块拼图里很小的一块,但它是让用户”感受到”AI 了解自己的那种功能——比单纯聊天要直观得多。


    目前这个功能只向美国用户开放。谷歌没有说其他市场什么时候能跟上,但考虑到印度和日本已经在4月用上了”个人智能”的其他功能,估计不会等太久。

  • TIDAL对AI音乐下手了:完全由AI生成的歌,一分钱也别想赚

    流媒体平台TIDAL本周宣布了一项新政策:完全由AI生成的音乐,将在平台上被禁止变现。换句话说,如果你的一首歌100%是AI写的、AI唱的,那它在TIDAL上能上线,但别想从中赚到一分钱。

    TIDAL AI音乐检测
    TIDAL的新政策要求标识AI生成音乐并禁止其变现 | 图片来源:AI生成

    这项政策将于2026年7月15日正式生效。TIDAL的执行副总裁兼主编Tony Gervino在公告里写得很清楚:”我们承诺保护和奖励有机创造力,避免损害艺术家与TIDAL订阅者建立和扩大粉丝群体的能力。很多人告诉我们,他们不想接触——或者被推荐——完全由AI生成的音乐。”

    具体怎么执行?

    根据TIDAL的说明,完全AI生成的曲目将被标识出来,在平台显示”AI”标记。这些曲目将无法:

    • 参与任何变现计划(不能赚版税)
    • 进行直接面向粉丝的销售
    • 获得平台的推荐权重

    此外,TIDAL还会使用自动化工具,移除那些试图冒充真人艺术家的AI生成音乐。也就是说,如果你用AI生成了一首”假Taylor Swift”的歌,TIDAL会主动把它删掉。

    “无论你在别处读到什么,AI接管音乐产业(和你的推荐列表)并不是不可避免的,只要我们现在采取更有力的措施来监控和控制它。”
    —— Tony Gervino,TIDAL执行副总裁兼主编

    其他平台也在行动

    TIDAL并不是第一个对AI音乐出手的平台。事实上,这场”AI音乐监管战”已经打了快两年了:

    • Spotify:去年更新了政策,要求标识AI音乐,同时加强垃圾内容过滤
    • Apple Music:今年3月宣布将为AI音乐添加透明标签
    • Deezer:态度最强硬,主动把AI曲目从推荐列表中移除,并不让其进入编辑精选歌单。Deezer还说过,平台上每天新增的音乐里有44%是AI生成的
    • Qobuz:也推出了类似的AI内容识别政策

    44%的新歌是AI生成的?

    Deezer今年4月公布的数据让人有点震惊:他们平台上每天上传的新歌里,有44%是AI生成的。这意味着,如果你随机打开一个音乐流媒体平台,你听到的歌,可能快有一半跟人类创作没什么关系。

    这个比例为什么这么高?原因很简单——AI音乐生成工具(比如Suno、Udio)已经足够好用了,一个人可以在几分钟内生成几十首风格各异的歌,然后批量上传到所有流媒体平台,指望碰上一两首能跑量的。这种”AI音乐垃圾邮件”式的做法,正是各家平台想要遏制的。

    TIDAL的新政策里有一个关键点:他们强调这不是要”打压技术进步”,而是要把”有机创作”和”AI生成”区分开来。用AI辅助创作(比如在作曲时用AI生成灵感、或者用AI做母带处理)应该是被允许的,但完全由AI端到端生成的音乐,不应该和人类创作的音乐在同一个变现体系里竞争。

    这个界限在哪里,执行起来可能会很有挑战性。一首歌里有多少比例是AI生成的,才算”完全AI生成”?这个问题,TIDAL可能需要在实际执行中不断调整标准。这也是为什么他们把这项政策称为”living document”——会随着行业发展而更新。