# 数据提取的短网址是如何生成的？

**URL:** https://meta.discourse.org/t/how-are-the-short-urls-for-data-extraction-generated/241713
**Category:** Development
**Created:** [2022年十月12日 16:45 UTC](https://meta.discourse.org/t/how-are-the-short-urls-for-data-extraction-generated/241713 "2022-10-12T16:45:49Z")
**Posts on this page:** 4
**Page:** 1

<div class="post-metadata">

### Author: ![glorentz1](https://avatars.discourse-cdn.com/v4/letter/g/35a633/32.png) [@glorentz1](https://meta.discourse.org/u/glorentz1)
#### Post date: [2022年十月12日 16:45 UTC](https://meta.discourse.org/t/how-are-the-short-urls-for-data-extraction-generated/241713/1 "2022-10-12T16:45:49Z")

</div>

我已阅读 GitHub 上的代码，到目前为止，我所能理解的是，_某个东西_ 被哈希处理，然后进行 base62 编码。但是，通过代码分析，我无法弄清楚最初被哈希处理的是什么。

有人能指点一下吗？

---

<div class="post-metadata">

### Author: ![pfaffman](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/pfaffman/32/120154_2.png) [@pfaffman](https://meta.discourse.org/u/pfaffman)
#### Post date: [2022年十月12日 18:45 UTC](https://meta.discourse.org/t/how-are-the-short-urls-for-data-extraction-generated/241713/2 "2022-10-12T18:45:07Z")

</div>

您想做什么？您为什么关心？

我认为这是您的答案：

> <https://github.com/discourse/discourse/blob/main/app/models/upload.rb#L427-L429>

如果您正在寻找上传文件的文件名，它是一个内容的哈希值。这是查看文件是否仅上传一次的方法。

但是，了解您想完成什么将有助于您获得真正问题的答案。

---

<div class="post-metadata">

### Author: ![glorentz1](https://avatars.discourse-cdn.com/v4/letter/g/35a633/32.png) [@glorentz1](https://meta.discourse.org/u/glorentz1)
#### Post date: [2022年十月12日 22:27 UTC](https://meta.discourse.org/t/how-are-the-short-urls-for-data-extraction-generated/241713/3 "2022-10-12T22:27:34Z")

</div>

谢谢你，Jay。我正在尝试看看是否有一种方法可以猜测给定用户的提取数据终结点。当我请求数据提取时，我需要向 /uploads/short-url/{something}.zip 发送一个 GET 请求。我的目标是找出是否有办法猜测特定帐户的 {something} 值。

---

<div class="post-metadata">

### Author: ![pfaffman](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/pfaffman/32/120154_2.png) [@pfaffman](https://meta.discourse.org/u/pfaffman)
#### Post date: [2022年十月13日 12:18 UTC](https://meta.discourse.org/t/how-are-the-short-urls-for-data-extraction-generated/241713/4 "2022-10-13T12:18:21Z")

</div>

除非你有文件，否则你无法猜测网址，因为哈希是基于文件内容的。

人们是如何发布数据的？你需要从他们上传文件的帖子中提取它。
