Reddit 认定纯 HTML 不安全,旧版需登录,新旧版安全性谁更高?

📅 2026/7/23 19:05:50 👤 编程新知 🏷️ 技术资讯
Reddit 认定纯 HTML 不安全,旧版需登录,新旧版安全性谁更高? Reddit 公司概况据悉Reddit 基本上是许多热门论坛的托管平台该公司似乎致力于从这些论坛中榨取尽可能多的价值同时又不完全毁掉它们。毕竟仅仅培育社区对于新科技来说并非崇高目标。而在大语言模型LLM时代真正由人类生成的数据如今就像黄金一样珍贵。Reddit 搜索结果价值虽然有人不再想与 Reddit 互动但在 LLM 时代仍会偶尔访问它。因为在搜索查询中添加 site:reddit.com 基本上能确保找到由真人撰写的结果且这样的结果很有价值。旧版 Reddit 需登录情况进行搜索后有人惊讶地发现 Reddit 现在要求登录才能使用其旧版设计。此人使用的是 Reddit 的原始前端 old.reddit.com认为它是更适合 Reddit 的设计。其作为小众用户使用 Firefox 浏览器并安装了 NoScript 插件早已习惯因某些人决定不再支持仅有的几个用户而被迫放弃原本运行良好的产品如用了 8 年的手机、用了 10 年的平板电脑以及旧版 Stack Exchange 应用所使用的 API。Reddit 称这一切是为了“保障 Reddit 的安全”但令人疑惑的是到底要让 Reddit 免受谁的侵害。安全原因探究从公告可知旧版 Reddit 的游客模式体验是平台上大量恶意爬虫和自动化流量的主要来源。但有人质疑为什么新版 Reddit 游客模式仍可访问。管理员回复称恶意流量的形式一直在变事后容易发现恶意流量但提前预防很难且旧版 Reddit 没有现代安全防护体系这可能更是个大挑战。旧版与新版 Reddit 对比旧版 Reddit登录后测试发现旧版 Reddit 珍贵的用户生成内容是以纯 HTML 形式呈现的除非加载更多评论否则甚至不需要 JavaScript。它下载约 1MB 的数据上传约 0.5MB 的数据加载单个 HTML 页面需要 2 秒感觉像是被限流。加载更多评论时过程简洁又迅速未发现隐私被窥探但可能正因如此显得不安全。新版 Reddit没有 JavaScriptJS新版 Reddit 除了帖子本身什么都加载不出来这可能是它更安全的原因。它进行 112 次请求在约 3 秒内加载的内容约为旧版的 5 倍。屏蔽部分请求后页面仍能加载点击加载更多评论虽会转圈圈但能收到包含评论内容的响应推测运行 JavaScript 是阻止爬虫的方法。不使用请求过滤器加载评论时页面显得很臃肿。测试中多次刷新页面、加载评论和回复都未失败有一次出现验证码字段但未复现且每次滚动页面或移动鼠标时会向 Reddit 发送一个约每 0.5 秒一次的心跳包。安全性判断所谓前端“安全”问题其实是公关说辞。实际上Reddit 是不想让人们爬取数据认为牺牲一些旧版 Reddit 用户就能有效阻止爬取行为。但不确定是否真能阻止爬取虽然新版 Reddit 被爬取难度更大但爬虫更喜欢使用更简洁的旧版 Reddit。而且旧版 Reddit 默认加载的评论数量是新版的 8 倍。Reddit 把原本简洁的 HTML 页面重写成臃肿 5 倍的网页组件之类的东西以模糊的安全或反爬理由抛弃用户令人恼火。后续思考有人担心自己的博客会不会也有类似风险毕竟它和旧版 Reddit 一样核心功能是以纯 HTML 形式提供文本内容。不过也许没问题因为博客内容是自己的价值没那么高。使用选择疑问登录问题有人可能会登录但想为必须登录这件事生气。使用新版问题说不定最后只能用新版也不确定他们是否还会继续支持旧版且如果可行他们可能会对未登录的新版 Reddit 用户关闭大门。使用大语言模型问题有人想怀念曾经的互联网认为只是想看看人们对某个随机问题的看法没必要去问世界上最智能、最昂贵的计算机读人类写的文字并非奇怪之事。评论情况有人已将相关文章发布到 Lobste.rs 并会去查看评论也欢迎他人直接联系。很久以前此人减少使用 Reddit 时Stack Exchange 的热门新队列是手机端完美的替代品现在浏览维基百科。