标签: Reddit

  • Reddit 告 Perplexity 有了进展:法官说,AI 抓取不能这么干

    过去这一年,Reddit 跟一帮 AI 公司较上劲了。最新一站,是 7 月 31 日曼哈顿联邦法院的一纸裁决:法官 Paul A. Engelmayer 拒绝了 Perplexity AI 要求撤案的请求,让 Reddit 最核心的那条版权指控活了下来,案子正式进入取证阶段。

    不是普通的版权官司

    这起诉讼最早在去年 10 月就递到了纽约南区法院。被告不止 Perplexity 一家,还包括做搜索结果聚合的 SerpApi、立陶宛的代理服务商 Oxylabs,以及俄罗斯的 AWMProxy。Reddit 的打法很特别:它没有只说”你抄了我的内容”,而是搬出了《数字千年版权法》(DMCA)里的反规避条款,说这些公司绕开了技术和平台设下的访问门槛,把用户帖子成规模地扒了出去。

    Reddit 讲的故事是这样的:中介们并不直接从 Reddit 服务器上抓,而是从 Google 的搜索结果页里把内容捞出来,再伪装来源、绕开防护。Perplexity 买了这些数据,喂进自己的 AI 答案引擎。Reddit 把这套操作比作”劫匪进不了银行金库,就先去抢运钞车”——金库进不去,那就打运钞车的主意。

    Reddit 把这套操作比作”劫匪进不了银行金库,就先去抢运钞车”——平台自己的防护绕不过,就改从 Google 搜索结果里把用户帖子扒出来。

    法官为什么站 Reddit 这边

    Engelmayer 法官写得挺直白:Reddit 这个平台,恰恰就是 DMCA 想保护的那种”受版权作品的全球数字在线市场”。更关键的一点是,他认可 Google 的 SearchGuard 反爬系统,可以算作”控制访问的技术措施”——这就意味着,绕过它去拿背后的用户帖子,落进了反规避条款的射程。

    不过法官也不是全给 Reddit 面子。同一份裁决里,他驳回了对 SerpApi 的”兜售规避工具”指控,也把双方州法层面的”不正当竞争”和”不当得利”诉求给砍了。所以准确说,这是一次”核心保住、边缘削掉”的中间胜利,离定输赢还早。

    Reddit 诉 Perplexity 数据抓取版权案
    当社交平台的内容遇上 AI 答案引擎,版权与抓取的边界正在法庭上被重新划定

    同一个屏障,两种相反结局

    最有意思的对照发生在 11 天前。7 月 20 日,加州北区法院刚驳回了 Google 对 SerpApi 几乎一模一样的诉讼——同一道 SearchGuard,同一个被告,结果却相反。差别在哪?Google 没主张自己的搜索结果受版权保护,也没证明 SearchGuard 是”经版权人许可”实施的,法官认为那道屏障护的是广告收入,而 DMCA 护的是版权,不是营收。Reddit 聪明在换了个角度:屏障后面站着的不是无关结果,而是真人写的帖子,版权归 Reddit 授权运营。

    • 对平台方:以后可以拿反规避条款去挑战 AI 抓取,路比之前清楚了不少。
    • 对 AI 公司:如果 Reddit 最终赢下更多筹码,全行业的”白嫖式”数据抓取会越来越难,授权谈判躲不掉了。
    • 对普通用户:你的帖子值不值钱、归谁管,这件事正在法庭上被重新定义。

    Reddit 首席法务官 Ben Lee 把这形容为对抗一种工业级”数据洗白”经济。Perplexity 这边估值约 200 亿美元,回应依旧是那套:我们遵守 robots.txt,内容是公开的,诉讼就像当年出版商对抗广播、电视、互联网一样,到最后都没成。

    这场仗还长。但它已经给所有做 AI 搜索、AI 答案引擎的公司提了个醒:免费把别人的内容吸进自己的系统,这条路在 2026 年已经不像过去那么好走了。

  • Reddit 给版主配了 AI 助手:关键词过滤时代要翻篇

    Reddit 最近给版主们发了个新工具,名字叫 Rules Hub。说白了,就是让大语言模型替人工版主去判断一条帖子或评论是不是踩了版规——不是死板地看有没有某个词,而是去理解这句话的“意思”到底违不违规。

    这事放在 Reddit 十几年的历史上挺关键。过去版主靠的是 Automoderator(大家都叫它 Automod),那套东西本质上是关键词和正则匹配:你写一条规则“标题里出现某某词就删”,它才动。规则一多,配置文件就成了只有两三个人看得懂的天书,换人就断档。

    从“匹配词”到“理解意图”

    Rules Hub 的逻辑不一样。Reddit 在博客里写,它用 LLM 去评估“一条内容是否符合某条规则的本意”,这样就能处理那些模棱两可、带口语、踩在边缘的情况,同时把最终决定权留在版主手里。版主可以自己设哪些规则自动执行、触发后怎么办,AI 只做“判断”这一环。

    “It’s also hard to learn, hard to maintain, and heavily dependent on brittle keyword matching, regex, and inherited configurations that only a few people on a mod team, if any, understand. We can do better.” —— Steve Huffman,Reddit CEO

    这个新工具已经悄悄测了几个月,拉了 700 多个社区的新老版主进来试,包括 Reddit 版主委员会的人。现在它开始向“所有新建社区”放开,预计到 2026 年晚些时候全面铺开。对新社区来说是可选的,但 Reddit 话里话外的意思很清楚:Automod 那套执行功能,迟早要被 Rules Hub 以及配套的“发帖评论引导”“安全过滤器”替掉。


    同一天 Reddit 还甩出了更大的一揽子变动,矛头指向第三方开发者和老 Reddit。以后新的第三方 App 不能再走公开 API,得搬到 Reddit 自家的开发者平台上跑。Huffman 的理由很直接:公开 API 当初不是为今天的规模、自动化滥用和商用抓取设计的,他们想要好用的机器人,但不想要有人把整个论坛 indiscriminately 扒走、转卖、不负责任地用。

    老 Reddit 也要动刀

    为了堵住内容被乱抓,Reddit 对老版界面(old Reddit)也要下手了。这之前他们已经干过不少事:屏蔽不付钱的搜索引擎、起诉 Anthropic 和 Perplexity、封掉互联网档案馆的抓取。六月起用老 Reddit 还得先登录。具体怎么改 Huffman 没明说,只说在“探索不同选项”,短期会先限制登录用户访问、把关键机器人和版主流程迁走。

    • Rules Hub 用 LLM 判违规意图,取代 Automod 的关键词硬匹配
    • 已测 700+ 社区,新社区先可选,2026 年内全面开放
    • 第三方 App 将强制迁到 Reddit 开发者平台,老 Reddit 限制登录

    Huffman 也知道用户对这类改动有心理阴影——2023 年那轮 API 收费闹出过大规模抗议,一堆熟面孔 App 因此关张。所以他这次特意说了“信任我们不够,得在实践里真的更好用才行”,承诺不会在靠谱替代出来之前就砍掉主要功能。话是这么讲,Reddit 想把治理和抓取都收进自家院子的方向,已经没有回头路了。

    Reddit 引入 AI 版主工具 Rules Hub(图源:The Verge)
    Reddit 引入 AI 版主工具 Rules Hub(图源:The Verge)
  • Reddit成AI SEO新战场,版主开始围剿软广机器人

    Reddit 上的品牌软广正被 AI 批量制造
    Reddit 上的品牌软广,正被 AI 批量制造(图源:The Verge)

    一个护肤版块的”真人推荐”翻车了

    今年早些时候,一个护肤爱好者论坛里有人问大家试没试过某款次氯酸喷雾。底下几十条回复里,有个叫 Primary-Taro4254 的账号说得挺实在:自己没试过那个牌子,但一直在用 Honeydew Labs 的类似喷雾,感觉不错,还顺手补了一句这个牌子浓度 0.02%、拿到了湿疹协会的认可。乍一看,就是个热心网友。

    可有人较真去翻了翻他的主页,发现这位”热心网友”对 Honeydew Labs 的爱有点过头——他不只在一条帖子里夸,在好几个毫不相关的产品讨论里都冒出来安利同一款喷雾,还跨了好几个护肤子版块。在一个有着上百万周活用户的版块里,很快有网友发帖提醒大家:当心,这大概率是营销机器人。

    “提醒一下大家,注意 Honeydew Labs 的次氯酸产品,那大概率是营销机器人。”——被网友识破后,r/SkincareAddiction 里的警示帖

    品牌为什么盯上了 Reddit 的评论区

    这件事小的方面是个别品牌的骚操作,大的方面却和 AI 搜索有关。过去一年,Google 的 AI Overview、ChatGPT 这类工具在回答问题时,大量直接引用 Reddit 里的讨论。Reddit 的群众智慧和真实语气,恰恰是 AI 答案最爱抓的内容。

    这就导致一个变化:在 Reddit 上被提及,不再只是社区荣誉,而是能左右 AI 搜索结果的新资产。品牌方很快发现,只要让”真实用户”在相关版块铺一些体验帖,就有机会被 AI 搜索引擎当成答案喂给用户——等于用接近零的成本,做了一轮精准广告。

    版主靠什么揪出机器人

    Reddit 的版主大多是志愿者,他们没有算法黑盒,靠的是最朴素的人肉模式识别。

    • 同一个账号跨版块、跨话题只推一个产品,话术还出奇一致;
    • 推荐的”专业细节”过于工整,像提前写好的卖点而非随口分享;
    • 在不同产品的帖子里插入同一段体验,语境对不上。

    这次 Honeydew Labs 的账号就是栽在”太专一”上——真人很少会对一款喷雾爱到逢帖必提。


    这股风气不会只停在一个版块

    真正值得警惕的,是 AI 把”水军”的成本压到了地板。过去养一批人写软文要花钱,现在用模型批量生成看似真人的评论,边际成本几乎为零。一种叫 GEO(生成式引擎优化)的新行当正在冒头:品牌不再只优化搜索引擎的排名,而是想办法让自己想推的内容,出现在 AI 给用户的答案里。论坛、问答区、商品评论,全成了新的投放位。

    Reddit 眼下还能靠社区自治勉强挡一挡,可一旦规模上来,靠志愿者肉眼识别注定跟不上。更深的难题是:当内容既能由 AI 生成、又能被 AI 搜索引用,”这条评论到底是不是人写的”这个问题,平台、品牌和用户三方都很难自证。信任的锚点,正在从”谁说的”滑向”能不能溯源”。

  • Reddit财报大超预期股价却跌10%:AI正在动搜索流量的奶酪

    Reddit 周四交出的这份二季度财报,账面上挑不出什么毛病:总营收 8.05 亿美元,同比大涨 61%;净利润 2.53 亿美元,暴增 183%,双双超出华尔街预期。下季度指引也给得漂亮,营收预计 8.6 亿到 8.7 亿美元,照样高于分析师预测。

    按常理,这种”业绩超预期、指引再超预期”的剧本,股价应该应声上涨。结果盘后交易里,Reddit 股价跌了超过 10%。

    Reddit 财报与AI冲击
    Reddit 业绩亮眼,股价却在盘后大跌(图源:TechCrunch)

    一个词吓崩了股价

    祸根出在 CEO 史蒂夫·赫夫曼写给股东的那封信里。他提到,本季度来自搜索引擎的引荐流量变得”起伏不定”(choppy),季度后段流量波动更大。虽然他紧跟着补了一句”大局未变,商业业务依然强劲”,但投资者只记住了前半句。

    AI 正在重塑搜索引擎的格局——投资者担心的正是,当用户的问题在谷歌的 AI 摘要里就被直接回答掉,还有多少人会点进 Reddit?

    这个担忧不是空穴来风。2024 年 Reddit 和谷歌签了内容授权协议,把社区内容供给谷歌做 AI 训练。可如今谷歌铺开的 AI 摘要,反过来正在分走 Reddit 的访问量。Reddit 已经放话,明年是否续约还不一定。

    美国用户数据露出裂缝

    另一个扎眼的数字是用户结构。Reddit 全球用户还在涨,但美国的日活跃独立用户从一季度的 5350 万滑到了 5320 万。跌幅很小,位置很要命——美国是 Reddit 广告变现的核心市场。

    财报电话会上,分析师问得毫不客气。有人直接说:”恕我直言,你们的股价大跌,是因为投资者觉得你们有用户问题,尤其在美国。随着搜索转向 AI,未登录流量会持续承压,把游客转化成注册用户也会越来越难。”接着抛出那个尖锐的问题:明年有没有可能不再向谷歌和 OpenAI 授权数据?

    赫夫曼的底牌:人味儿

    赫夫曼的回应分两层。讲社区时他很笃定:Reddit 的本质是社区和对话,社区是普世的,美国用户需要的内容这里都有,关键是让人发现它们。讲谷歌时他就模糊多了:”我们跟谷歌的关系早于正式的数据授权协议,我不认为结局是非黑即白的……我们会确保 Reddit 的价值最大化。”

    • 营收 8.05 亿美元,同比增长 61%,超预期;
    • 净利润 2.53 亿美元,同比增长 183%;
    • 下季度指引 8.6 亿-8.7 亿美元,高于市场预测;
    • 美国日活从 5350 万微降至 5320 万,搜索引荐流量”起伏不定”。

    财报季里,Reddit 一直被视为”AI 时代内容金矿”的代表——它的语料是各家大模型抢着买的稀缺品。但这份财报提醒所有人:卖数据赚的钱,可能正是用自己的流量换来的。这笔账怎么算,才是 Reddit 接下来一年真正的考题。

  • Last 30 Days —— 由点赞、转发和真金白银评分的 AI 全网搜索引擎

    Last 30 Days —— 由点赞、转发和真金白银评分的 AI 全网搜索引擎

    项目简介

    /last30days 是一个 AI Agent 技能(Agent Skill),它能在 Reddit、X(Twitter)、YouTube、Hacker News、Polymarket、TikTok、arXiv、小红书等 19+ 个平台并行检索任意话题,按真实用户互动(点赞、转发、交易量)评分,再由 AI Agent 合成一份带引用的 30 天情报简报。

    它的核心理念是:“Google 聚合编辑,/last30days 搜索人”——每个平台都是围墙花园,但你可以自带钥匙,让一个 Agent 同时搜索所有平台,告诉你什么真正重要。

    工作流与安装

    核心功能

    • 19+ 信息源并行检索:Reddit(免 API Key)、X/Twitter、YouTube 全文转写、Hacker News、Polymarket 预测市场、GitHub API 实时数据、TikTok、Instagram Reels、arXiv 论文、Techmeme 科技新闻、Digg AI 1000 账号聚合、LinkedIn、Threads、Bluesky、StockTwits、小红书、Pinterest 等。社区贡献者持续添加新源。
    • 真实互动评分:1500 赞的 Reddit 帖 > 没人读的博客;$66K 交易量的 Polymarket 赔率 > 专家猜测;360 万播放的 TikTok > 新闻稿。社交相关性优先于 SEO 相关性。
    • 发现模式(Discovery Mode):输入 /last30days what's exploding in AI agents? 自动切换为话题发现引擎,扫描 Reddit 分类、HN 热帖、Digg AI 1000 feed 和 X,由 Agent 评审后输出 5-10 个动量排名话题。
    • 跨平台对比/last30days OpenClaw vs Hermes vs Paperclip 输出架构/记忆/安全/适用场景的并排对比表,Star 数实时从 GitHub API 拉取。
    • 零配置开箱即用:Reddit / HN / Polymarket / GitHub 无需任何 Key 即可使用;首次运行设置向导在 30 秒内解锁 X、YouTube、TikTok、arXiv 等更多源。
    19+ 信息源总览

    安装要求与过程

    环境要求:

    • Claude Code(推荐):自动通过 marketplace 更新
    • Node.js 18+(用于 npx skills 安装)
    • Python 3.10+(可选,用于脚本模式)
    • Grok Build CLI / OpenClaw(对应宿主)

    快速安装步骤:

    Claude Code(推荐):

    /plugin marketplace add mvanhorn/last30days-skill

    Codex / Cursor / Copilot / Gemini CLI 等 50+ Agent Skills 宿主:

    npx skills add mvanhorn/last30days-skill -g

    Grok Build CLI:

    grok plugin install mvanhorn/last30days-skill

    OpenClaw:

    clawhub install last30days-official

    安装后在任意项目中运行 /last30days <话题> 即可开始研究。首次运行会弹出配置向导,引导你解锁更多需要认证的信息源。

    典型使用场景

    • 会议前调研/last30days Peter Steinberger —— 不只是 LinkedIn 2023 年的旧资料,而是他本月加入 OpenAI Codex 团队、23 个 PR 以 85% 合并率合并、r/ClaudeCode 上 227 赞讨论的最新动态。
    • 招聘信号分析/last30days Listen Labs --hiring-signals —— 从招聘页面变化推断公司战略方向:是否在扩张企业安全、客户成功或基础设施团队。
    • 热点追踪/last30days what's exploding in AI agents? —— 发现模式下输出动量排名的新兴话题,每条附带跨平台数据和 /last30days "<话题>" 一键跟进命令。
    • 工具选型决策/last30days OpenClaw vs Hermes vs Paperclip —— 并排对比表 + 架构差异 + 适用场景,Star 数实时拉取而非过时博客数据。
    • 旅行规划/last30days Universal Epic Universe —— 社区真实反馈:哪些项目在建、排队时间多长、年票何时开放。

    推荐理由

    这个项目解决了一个 Google 和 ChatGPT 都无法解决的问题:跨平台的实时社会信号聚合。Google 不碰 Reddit 评论和 X 帖子;ChatGPT 有 Reddit 合作但搜不了 X 或 TikTok;Gemini 有 YouTube 但没有 Reddit。每个平台都是孤岛,而 /last30days 用 Agent 把它们桥接起来。

    54K+ Stars、175 个合并 PR(其中 122 个来自 52 位社区贡献者)、支持 50+ 编程助手宿主——这已经从一个个人工具成长为社区基础设施。对于需要快速了解任意领域最新动态的人来说,这是目前最全面的开源方案。

    下载地址