# OneBox在Bookshop.org失败 - 抓取被阻止了吗？

**URL:** <https://meta.discourse.org/t/onebox-fails-for-bookshop-org-crawl-blocked/353663>\
**Category:** Support\
**Tags:** onebox\
**Created:** [2025年二月21日 18:54 UTC](https://meta.discourse.org/t/onebox-fails-for-bookshop-org-crawl-blocked/353663 "2025-02-21T18:54:16Z")\
**Posts on this page:** 1\
**Showing post:** 1

<div class="post-metadata">

**Author:** ![ToddZ](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/toddz/32/328350_2.png) [@ToddZ](https://meta.discourse.org/u/ToddZ)\
**Post date:** [2025年二月21日 18:54 UTC](https://meta.discourse.org/t/onebox-fails-for-bookshop-org-crawl-blocked/353663/1 "2025-02-21T18:54:16Z")

</div>

应该要求不允许 OneBox 抓取的网站做什么？

尝试对 Bookshop.org 的图书列表进行 OneBox 会导致：_“抱歉，我们无法为此网页生成预览，因为找不到以下 oEmbed / OpenGraph 标签：description、image”_ — 尽管目标页面存在所需的 OG 标签。

（发布时，此处元页面上的结果与我的网站相同）：

[https://bookshop.org/p/books/parable-of-the-sower-octavia-e-butler/19767724?ean=9781538732182](https://bookshop.org/p/books/parable-of-the-sower-octavia-e-butler/19767724?ean=9781538732182)

> **OG 详情**
>
> 页面上确实存在 OG 标签：
> 
> ![image](https://global.discourse-cdn.com/meta/original/4X/5/1/8/51877e6ba33fd9070a85bb5ca48a1c861d5c2e2a.png)

我尝试了几个 OpenGraph 验证器：

- 大多数报告 URL 无法访问。
- 其中一些从 Bookshop.org 检索到了一些 OG 字段，但没有特定于所请求的页面。
- [iFramely 调试器](https://debug.iframely.com/) 和 [Facebook 共享调试器](https://developers.facebook.com/tools/debug/) 可以进行完整预览。

我了解到 Bookshop.org 正在拒绝某些抓取。如果有什么可以恰当地询问 [Bookshop.org](http://Bookshop.org) 的，例如“请允许 Discourse 用户代理进行抓取？”，我宁愿不引入[插件解决方法](https://meta.discourse.org/t/onebox-assistant-crawl-for-those-previews-reliably/107405/161)。

---

_[View the full topic](https://meta.discourse.org/t/onebox-fails-for-bookshop-org-crawl-blocked/353663)._
