这个时间点尤其值得注意。2025 年 5 月,CEO 史蒂夫·霍夫曼曾公开表示,Reddit 会“只要人们还在使用”,就保留旧版 Reddit 。然而,2026 年 6 月的管理员帖子直接收回了这一说法。Reddit 现在表示,“无法承诺”旧版 Reddit “会永远存在”
。登录强制令被广泛解读为最终弃用旧版界面的前奏,这是迄今为止最清晰的信号,表明公司认为这个遗留界面是一个日益增长的负担,而不再是一个永久的承诺
。
对爬虫问题的担忧贯穿了 Reddit 2026 年的整个平台政策调整,而 old.reddit.com 的登录墙只是其一。以下是一整套重塑平台数据访问规则的协同策略:
2026 年 5 月 28 日,Reddit 宣布将弃用未认证的 .json 访问——这是另一个获取结构化数据的免费途径 。几天之内,匿名请求就开始返回 403 禁止访问错误,且没有缓冲期。Reddit 自己的帖子写道:“这些接口可以被用来在无问责的情况下爬取 Reddit”
。
Reddit 在 2025 年 3 月更新了其 robots.txt 文件,阻止除谷歌和必应之外的所有爬虫 。2025 年 8 月,它更进一步,阻止了 Wayback Machine 索引大部分 Reddit 页面,原因是发现 AI 公司通过存档副本抓取 Reddit 数据
。目前,互联网档案馆只能索引 Reddit.com 的主页
。
2026 年 3 月 25 日,霍夫曼宣布,对于被发帖速度等行为信号标记的账户,将强制要求人工验证 。验证方式包括通行密钥、人脸识别,在某些情况下甚至需要政府 ID
。这并非全站推行,而是由技术检测触发,但这标志着对自动化操作的遏制措施显著升级
。
Reddit 平均每天移除 10 万个机器人账号,这个速度在整个 2026 年保持稳定 。2026 年 5 月推出的 BotPrints 取证工具,能沉默地提取每个用户的行为元数据,并通过计算 5 分钟发帖时间窗口内的杰卡德相似系数来检测机器人团伙
。
每项措施都针对不同的切入点——API、HTML、存档、账户行为——但它们都服务于同一个目标:阻止未经授权的爬虫行为,尤其是 AI 公司利用 Reddit 上的人类生成内容训练模型 。
old.reddit.com 的登录强制令关闭了最容易的匿名爬取通道,确保即使是依赖旧版界面的用户也必须经过身份验证,从而变得可被追责。