# 关于存档一个网站的建议

**URL:** https://meta.discourse.org/t/advice-on-archiving-a-site/329893
**Category:** Community Building
**Created:** [2024年十月8日 15:56 UTC](https://meta.discourse.org/t/advice-on-archiving-a-site/329893 "2024-10-08T15:56:38Z")
**Posts on this page:** 6
**Page:** 1

<div class="post-metadata">

### Author: ![jbrains](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/jbrains/32/208183_2.png) [@jbrains](https://meta.discourse.org/u/jbrains)
#### Post date: [2024年十月8日 15:56 UTC](https://meta.discourse.org/t/advice-on-archiving-a-site/329893/1 "2024-10-08T15:56:38Z")

</div>

我想要的不是“如何做”的建议，而是策略建议。

我打算归档博客的评论。我一直在使用 Discourse 为该博客提供评论。我有一些不想丢失的评论，但也不想仅仅将现有评论转换为静态 HTML 并与帖子一起包含。我打算重写旧帖子，将评论中的内容整合到新版本中，并逐步进行。

我推断我想要归档 Discourse 站点，以便之后可以本地部署它，并以“按需”的方式浏览和获取内容，以重写或编辑帖子。我想知道是否有人对如何以后挖掘这些评论内容有什么“更好”的建议。我将“更好”的解释留给你们，因为我想利用大家的创造力。请不要问我心中“更好”是什么样的；我想要你们未经筛选的想法。🙂

非常感谢。

---

<div class="post-metadata">

### Author: ![lindsey](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/lindsey/32/318210_2.png) [@lindsey](https://meta.discourse.org/u/lindsey)
#### Post date: [2024年十月8日 17:09 UTC](https://meta.discourse.org/t/advice-on-archiving-a-site/329893/2 "2024-10-08T17:09:20Z")

</div>

嘿 @jbrains —— 我把这个话题移到了 #Community Building（社区建设），因为我觉得这个分类更适合。

---

<div class="post-metadata">

### Author: ![NateDhaliwal](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/natedhaliwal/32/313494_2.png) [@NateDhaliwal](https://meta.discourse.org/u/NateDhaliwal)
#### Post date: [2024年十月9日 00:06 UTC](https://meta.discourse.org/t/advice-on-archiving-a-site/329893/3 "2024-10-09T00:06:54Z")

</div>

也许是 Wayback Machine？

---

<div class="post-metadata">

### Author: ![twofoursixeight](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/twofoursixeight/32/574822_2.png) [@twofoursixeight](https://meta.discourse.org/u/twofoursixeight)
#### Post date: [2024年十月9日 00:10 UTC](https://meta.discourse.org/t/advice-on-archiving-a-site/329893/4 "2024-10-09T00:10:57Z")

</div>

这可以用于归档您的网站吗？

> [@A basic Discourse archival tool](https://meta.discourse.org/t/a-basic-discourse-archival-tool/62614/57?u=twofoursixeight):
>
> For what it’s worth, I’ve written a minimum viable Python script that performs simple backup of post content using the API: [GitHub - jamesob/discourse-archive: Provides a simple archive of Discourse content](https://github.com/jamesob/discourse-archive) It’s pretty barebones, but should give someone a rough idea of how to generate a suitbable-for-public archive.

这可能不是最佳选择，但这个旧的讨论似乎是一个有用的起点。

---

<div class="post-metadata">

### Author: ![rishabh](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/rishabh/32/179446_2.png) [@rishabh](https://meta.discourse.org/u/rishabh)
#### Post date: [2024年十月16日 06:01 UTC](https://meta.discourse.org/t/advice-on-archiving-a-site/329893/5 "2024-10-16T06:01:24Z")

</div>

这让我想起了 [https://meta.discourse.org/t/create-a-read-only-mailing-list-mirror/77990，但没有邮件列表部分。](https://meta.discourse.org/t/create-a-read-only-mailing-list-mirror/77990%EF%BC%8C%E4%BD%86%E6%B2%A1%E6%9C%89%E9%82%AE%E4%BB%B6%E5%88%97%E8%A1%A8%E9%83%A8%E5%88%86%E3%80%82)

> [@jbrains](#):
>
> 我推断我想存档 Discourse 站点，以便之后可以在本地运行它，并以“按需”方式浏览和抓取内容来重写或编辑帖子。

也许在您的网络上以只读模式或开发模式运行该站点是可行的方法？

另外，如果您只需要筛选帖子内容而不需要 Discourse UI，一个简单的 [Discourse Data Explorer](https://meta.discourse.org/t/discourse-data-explorer/32566) 查询就可以让您下载一个包含数据的 csv/json 文件，您可以使用其他应用程序进行搜索。

---

<div class="post-metadata">

### Author: ![jbrains](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/jbrains/32/208183_2.png) [@jbrains](https://meta.discourse.org/u/jbrains)
#### Post date: [2024年十月23日 19:06 UTC](https://meta.discourse.org/t/advice-on-archiving-a-site/329893/6 "2024-10-23T19:06:42Z")

</div>

> [@NateDhaliwal](#):
>
> 也许是 Wayback Machine？

我觉得这个想法很有趣也很有创意，但我还是希望能够轻松地离线浏览评论。

> [@twofoursixeight](#):
>
> 这能用于归档你的网站吗？
> 
> > [@](#):
> >
> > 就我所知，我写了一个最小可行性 Python 脚本，使用 API 来执行简单的帖子内容备份：[GitHub - jamesob/discourse-archive: Provides a simple archive of Discourse content](https://github.com/jamesob/discourse-archive) 它相当基础，但应该能让人们大致了解如何生成一个适合公开的归档。
> 
> 这可能不是最好的选择，但这个旧的讨论似乎是一个有用的起点。

也许吧。感谢你的想法。我相信我曾用它来归档过一个社区 Discourse，我将其用作培训课程的一部分。然后，我将归档分发给学员供他们参考。

> [@rishabh](#):
>
> 这让我想起了 [在 Discourse 中镜像只读邮件列表](https://meta.discourse.org/t/create-a-read-only-mailing-list-mirror/77990)，但没有邮件列表部分。
> 
> > [@jbrains](#):
> >
> > 我推断我想归档 Discourse 网站，以便我可以在本地访问它，并以“按需”的方式浏览和获取内容来重写或编辑帖子。
> 
> 也许在你的网络上以只读模式或开发模式运行该网站是可行的方法？
> 
> 另外，如果你只需要浏览帖子内容而不需要 Discourse UI，一个简单的 [Discourse Data Explorer](https://meta.discourse.org/t/discourse-data-explorer/32566) 查询就可以让你下载一个包含数据的 CSV/JSON 文件，你可以使用其他应用程序来搜索。

啊哈！这正是我想要的。感谢你向我指出这一点。我会看看的。
