# 匿名观看突然变得非常高

**URL:** <https://meta.discourse.org/t/anonymous-views-suddenly-very-high/251826>\
**Category:** Data & reporting\
**Created:** [2023年一月15日 12:43 UTC](https://meta.discourse.org/t/anonymous-views-suddenly-very-high/251826 "2023-01-15T12:43:20Z")\
**Posts on this page:** 9\
**Page:** 3

<div class="post-metadata">

**Author:** ![agemo](https://avatars.discourse-cdn.com/v4/letter/a/ac91a4/32.png) [@agemo](https://meta.discourse.org/u/agemo)\
**Post date:** [2025年六月27日 10:42 UTC](https://meta.discourse.org/t/anonymous-views-suddenly-very-high/251826/42 "2025-06-27T10:42:37Z")

</div>

一个附带的观察结果提出了一个问题：使用 Cloudflare 是否也有助于 Google 索引？

我昨天注意到了一些改进，索引和展示次数呈积极趋势，但这可能只是巧合。🤔

---

<div class="post-metadata">

**Author:** ![agemo](https://avatars.discourse-cdn.com/v4/letter/a/ac91a4/32.png) [@agemo](https://meta.discourse.org/u/agemo)\
**Post date:** [2025年十一月27日 23:34 UTC](https://meta.discourse.org/t/anonymous-views-suddenly-very-high/251826/43 "2025-11-27T23:34:44Z")

</div>

注意到十月底出现大幅激增。这些一定是通过了 CF **阻止人工智能机器人** 的缓解功能。

CF 现在建议使用 AI Labyrinth：

> AI Labyrinth 通过添加包含人工智能生成内容的 nofollow 链接来修改您的网页，以扰乱忽略抓取标准的机器人。添加的 nofollow 链接不会改变您网页的内容，并且仅对机器人可见。

用人工智能对抗人工智能？😬

人工智能军备竞赛？

---

<div class="post-metadata">

**Author:** ![Ed\_S](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/ed_s/32/134015_2.png) [@Ed\_S](https://meta.discourse.org/u/Ed_S)\
**Post date:** [2025年十一月29日 17:19 UTC](https://meta.discourse.org/t/anonymous-views-suddenly-very-high/251826/44 "2025-11-29T17:19:50Z")

</div>

这是一场军备竞赛，和垃圾邮件发送者一样，我怀疑它将永远是这样。

---

<div class="post-metadata">

**Author:** ![agemo](https://avatars.discourse-cdn.com/v4/letter/a/ac91a4/32.png) [@agemo](https://meta.discourse.org/u/agemo)\
**Post date:** [2025年十二月1日 19:27 UTC](https://meta.discourse.org/t/anonymous-views-suddenly-very-high/251826/45 "2025-12-01T19:27:54Z")

</div>

除了 Cloudflare（避难所）作为中间人来缓解这种情况的选项外，还有别的选择吗，还是说这是唯一的选择？

看起来要么全盘接受，要么全盘拒绝，而全盘拒绝 = 表现得像 DDoS 的 AI 流量！☹

---

<div class="post-metadata">

**Author:** ![agemo](https://avatars.discourse-cdn.com/v4/letter/a/ac91a4/32.png) [@agemo](https://meta.discourse.org/u/agemo)\
**Post date:** [2025年十二月3日 09:37 UTC](https://meta.discourse.org/t/anonymous-views-suddenly-very-high/251826/46 "2025-12-03T09:37:12Z")

</div>

这次流量激增真是个大麻烦（PITA），最有效的措施是完全地理封锁除目前大部分流量来源以外的所有地理区域的流量。

有太多自治系统编号（ASN）可能参与了这次流量激增，逐一排查是一个缓慢的过程。

这使得从中长期来看，情况变得非常不可行。

---

<div class="post-metadata">

**Author:** ![Ed\_S](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/ed_s/32/134015_2.png) [@Ed\_S](https://meta.discourse.org/u/Ed_S)\
**Post date:** [2025年十二月3日 15:52 UTC](https://meta.discourse.org/t/anonymous-views-suddenly-very-high/251826/47 "2025-12-03T15:52:16Z")

</div>

对我来说，最重要的是真实用户的体验——无论是会员还是潜水者。只要我的论坛响应速度可以，并且我不会因为额外的流量而被收费，或者存储空间被日志填满，这种额外的非必要流量就不是我真正关心的问题。

当然，如果我需要增加内存、存储或CPU，或者需要为过多的流量付费，我的成本可能会上升。对我来说，这种情况还没有发生。

---

<div class="post-metadata">

**Author:** ![agemo](https://avatars.discourse-cdn.com/v4/letter/a/ac91a4/32.png) [@agemo](https://meta.discourse.org/u/agemo)\
**Post date:** [2025年十二月3日 19:14 UTC](https://meta.discourse.org/t/anonymous-views-suddenly-very-high/251826/48 "2025-12-03T19:14:13Z")

</div>

是的，用户体验至关重要，这也是本主题的全部意义所在。我们之所以存在，完全是因为“用户”，但有时我怀疑开发者和类似的人是否忘记了这一点。🤔

这些人工智能（AI）东西给服务器带来了巨大的负载，以至于你开始出现 50x 错误。特别是如果你尝试搜索。该平台可以承受大量流量并保持稳定，但它开始变得有点卡顿。

我想知道你正在处理什么样的规格，它是否在 Cloudflare (CF) 或其他 Web 应用防火墙 (WAF) 后面？

我见过这种 AI 激增冲击 4vCPU 8Gb 160+Gb 硬盘的“液滴”（droplets），这些“液滴”可以轻松应对数十个真实独立访客激增带来的独特用户访问，但开始在 AI 吞噬的拉力下真正挣扎。

在入门级的“液滴”上运行 Discourse，比如说 2GB 的“液滴”，平台会非常快地开始屈服和崩溃，如果它没有被 CF 之类的东西保护的话。

在 AI 出现之前，这种情况不会发生，除非你有一个热门话题。我见过这种情况发生，但只是事后，因为性能上没有明显的差异，Discourse 很好地处理了服务。

查看 CF 的平均每日服务数据约为 2GB/天，持续一个月，当这次“蜂群”来临时，它跳到了 14GB，并且没有停止的迹象，直到一些 WAF 规则对这次攻击进行了限制。

不得不增加进入的摩擦力意味着那些真正想进来的人进来了，你必须重视这些人，但或多或少，额外的自然流量等等，那将不会受到影响。

正如我所说，中长期来看，这里的可行性构成了非常严重的问题。

现在它需要时间和金钱，或者两者兼有。我不知道除了目前的姿态之外还有什么其他方法可以解决这个问题，然后就是“核选项”——拔掉插头。我见过网站因为更小的事情而关闭。

开放互联网在设计时没有考虑到这种类型的“游戏”。

---

<div class="post-metadata">

**Author:** ![Ed\_S](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/ed_s/32/134015_2.png) [@Ed\_S](https://meta.discourse.org/u/Ed_S)\
**Post date:** [2025年十二月3日 19:34 UTC](https://meta.discourse.org/t/anonymous-views-suddenly-very-high/251826/49 "2025-12-03T19:34:59Z")

</div>

当然，如果你发现自己正在遭受 50x 错误，那说明情况很严重。

我以前使用 Cloudflare 作为反向代理，如果遇到问题我还会再用它：我的想法是他们对所有恶意流量都有一个中心视图，可以快速集中响应。我相信他们有专门的服务来阻止行为不端的 AI 爬虫。我不认为本地方法在这种军备竞赛中会很有效。

就像我为处理邮件向 Mailgun 支付少量费用一样，在某种理想情况下我本不需要这样做，我也会接受可能需要向某人支付少量费用来阻止这种不必要的流量。

---

<div class="post-metadata">

**Author:** ![agemo](https://avatars.discourse-cdn.com/v4/letter/a/ac91a4/32.png) [@agemo](https://meta.discourse.org/u/agemo)\
**Post date:** [2025年十二月10日 12:20 UTC](https://meta.discourse.org/t/anonymous-views-suddenly-very-high/251826/50 "2025-12-10T12:20:55Z")

</div>

正在测试仅登录模式，因为流量水平很高。

我担心 Cloudflare (CF) 缓存会成为一个问题，即它仍然会提供缓存的内容？

AI 机器人正在访问许多直接路径，例如：

`...stylesheets/docker_manager_abc123.css`

所提供的文本、.js 文件等，事实上我认为这些东西正在绕过\*\*\*“托管挑战”\*\*\*，我在 reddit 上也读到了一些类似的疑虑。

**是否有所有目录等的有用列表，可以通过某些规则进行阻止或管理，而不会破坏所有内容？**

所以，我理解在使用 CF 时，仅登录模式并不代表完全拒绝匿名流量的访问，但在不使用缓存时则会拒绝，有人能证实这一点吗？

[上一頁](https://meta.discourse.org/t/anonymous-views-suddenly-very-high/251826.md?page=2)
