Reddit向AI爬虫宣战:关停RSS,收紧公共API

Reddit向AI爬虫宣战:关停RSS,收紧公共API

编者按:当一家平台开始关停RSS,它关掉的不只是一个订阅按钮,而是互联网“开放互联”这份古老契约的一角。Reddit的最新动作,再次把内容平台与AI爬虫之间的博弈推向台前。

Reddit又一次收紧大门

据TechCrunch记者Sarah Perez报道,Reddit正在终止对RSS订阅源(RSS feeds)的支持,同时结束公共API的开放访问。这意味着,第三方开发者、阅读器应用、学术研究者乃至普通用户,都将更难通过自动化方式获取Reddit上的内容。

Reddit方面将这一决定归因于AI爬虫的泛滥。随着大模型训练对高质量语料的需求激增,Reddit这类由真人用户逐字敲出的讨论内容,成为了最有价值的“数据金矿”之一。而RSS与公共API恰恰是最容易被大规模、低成本抓取的入口。

RSS曾是互联网的公共水管,如今却成了AI数据管道的免费接口。

这不是Reddit第一次关闸

回顾过去几年,Reddit在内容访问上的收紧路线清晰可见:2023年,Reddit大幅调整API定价策略,直接引爆了数千个版块参与的“黑色停电”抗议;此后,平台更新robots.txt、封禁未授权爬虫,并与谷歌达成每年约6000万美元的内容授权协议,把用户数据明码标价地摆上谈判桌。2025年,Reddit更对数家AI公司提起诉讼,指控其未经许可抓取内容。

从这个角度看,关停RSS并非突发事件,而是这条“内容护城河”战略的自然延伸。Reddit的逻辑很直接:如果内容可以被自由抓取,那么授权协议的价值就无从谈起。

AI爬虫:压垮开放协议的最后一根稻草

Reddit并非孤例。过去两年,Cloudflare默认拦截AI爬虫,多家媒体集团起诉大模型公司,维基百科等公共知识库频繁遭遇异常流量——整个互联网正在上演一场“数据主权”的集体觉醒。

但问题在于,防御AI爬虫的技术手段(如User-Agent识别、IP限流、登录墙)往往是无差别的。RSS之所以被牺牲,正是因为它太“开放”:没有登录验证,没有身份识别,任何人都可以订阅。当平台决定“宁可错杀”,最先倒下的往往是那些最无害、最理想主义的用途——无障碍阅读、个人知识管理、学术研究、新闻聚合。

开放网络的又一次退潮

对普通用户而言,失去RSS的现实影响可能有限——毕竟在算法推荐的时代,RSS早已是小众工具。但对开发者社区和开放网络的支持者来说,这无疑是一个刺眼的信号:互联网正在从“默认开放”滑向“默认封闭”。

更深层的矛盾在于商业模式。用户生成的内容由用户创造,平台负责聚合与分发;当这批内容成为AI时代的稀缺资源,平台自然想把它变成可计价的资产。Reddit的选择,本质上是在“公共社区”与“数据资产持有者”两种身份之间,明确地站到了后者一边。

结语

Reddit关停RSS,或许只是这场漫长拉锯战中的一个节点。真正值得追问的是:在一个AI可以吞噬一切公开内容的世界里,“公开”本身还剩多少生存空间?平台的围墙越高,AI训练数据的来源就越集中,最终受影响的,可能不只是开发者,还有整个互联网知识的多样性与可及性。

本文编译自TechCrunch