# 이미지 텍스트 자동 인식으로 Alt-Text 생성

**URL:** https://meta.discourse.org/t/autorecognize-text-in-image-for-alt-text/292985
**Category:** Feature
**Created:** [1월 25, 2024, 11:25오후 UTC](https://meta.discourse.org/t/autorecognize-text-in-image-for-alt-text/292985 "2024-01-25T23:25:52Z")
**Posts on this page:** 4
**Page:** 1

<div class="post-metadata">

### Author: ![cogdog](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/cogdog/32/116536_2.png) [@cogdog](https://meta.discourse.org/u/cogdog)
#### Post date: [1월 25, 2024, 11:25오후 UTC](https://meta.discourse.org/t/autorecognize-text-in-image-for-alt-text/292985/1 "2024-01-25T23:25:52Z")

</div>

Discourse에는 미리보기 패널에서 대체 텍스트 이미지 설명을 편집할 수 있는 멋진 기능이 있지만(마크다운 편집에 익숙하지 않은 사람들을 위해), 우리 커뮤니티의 1,800명 이상의 회원 중 대체 텍스트를 작성하는 사람은 거의 없습니다. 파일명은 제 기준에서 사실상 쓸모가 없습니다.

AI가 1차 초안을 작성할 수 있다는 가능성은 있지만, 저에게는 최소한의 기준일 뿐입니다. 저는 저시력 사용자가 읽을 수 있도록 사람이 직접 작성한 대체 텍스트를 선호합니다. 이는 문제를 완전히 "해결"하지는 않지만, Mastodon에서 이미지의 텍스트를 OCR로 인식하여 편집 패널에 삽입할 수 있는 옵션을 볼 때 그 기능에 대해 궁금해집니다.

여기에는 텍스트가 포함된 이미지가 Mastodon에 업로드된 상태이며, 대체 텍스트를 작성하기 위해 준비하고 있습니다.

 ![Mastodon의 대체 텍스트 작성 인터페이스. 오른쪽에는 텍스트가 포함된 이미지가 있고, 편집 패널에는 '이미지에서 텍스트 감지' 링크가 있습니다](https://global.discourse-cdn.com/meta/original/4X/4/0/3/4036175fbadf319c3edfc81d21545f579a2b02f7.jpeg)

`이미지에서 텍스트 감지` 링크를 클릭하면 텍스트 입력 필드에 내용이 채워지는 데 몇 초밖에 걸리지 않습니다:

 ![이미지에서 텍스트 감지 링크를 클릭한 후, 대체 텍스트 편집 필드에 이미지와 동일한 텍스트가 채워진 모습](https://global.discourse-cdn.com/meta/original/4X/2/b/a/2ba9694ebc27322a72c99cca18aa7904612d7753.jpeg)

작은 편집이 필요할 수는 있지만, 많은 시간을 절약해 줍니다. 그리고 스크린 리더가 이 부분을 만나서 "Screen Shot 59.jpg"라고 읽어주는 것보다는 훨씬 낫습니다.

---

<div class="post-metadata">

### Author: ![EricGT](https://avatars.discourse-cdn.com/v4/letter/e/f1d935/32.png) [@EricGT](https://meta.discourse.org/u/EricGT)
#### Post date: [1월 26, 2024, 11:33오전 UTC](https://meta.discourse.org/t/autorecognize-text-in-image-for-alt-text/292985/2 "2024-01-26T11:33:02Z")

</div>

감사합니다!

OpenAI Discourse 포럼에서 이 기능 요청을 참조했습니다.

> **[How are blind people using OpenAI technology?](https://community.openai.com/t/how-are-blind-people-using-openai-technology/591018/18?u=ericgt)**
>
> Related feature request on the Discourse Meta forum that could be of use on this forum as this is a Discourse forum, use of alternative text for images.

---

<div class="post-metadata">

### Author: ![awesomerobot](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/awesomerobot/32/142900_2.png) [@awesomerobot](https://meta.discourse.org/u/awesomerobot)
#### Post date: [1월 26, 2024, 6:28오후 UTC](https://meta.discourse.org/t/autorecognize-text-in-image-for-alt-text/292985/3 "2024-01-26T18:28:14Z")

</div>

이미지에 대한 텍스트 설명을 AI로 생성하는 기능을 개발 중입니다. 따라서 당분간 OCR 단계를 생략할 예정입니다. 기능이 출시되면 Meta를 통해 공지하겠습니다!

---

<div class="post-metadata">

### Author: ![awesomerobot](https://sea3.discourse-cdn.com/meta/user_avatar/meta.discourse.org/awesomerobot/32/142900_2.png) [@awesomerobot](https://meta.discourse.org/u/awesomerobot)
#### Post date: [2월 22, 2024, 6:12오후 UTC](https://meta.discourse.org/t/autorecognize-text-in-image-for-alt-text/292985/4 "2024-02-22T18:12:02Z")

</div>

자막 기능이 이제 AI 플러그인에서 사용 가능한 옵션으로 제공됩니다: [AI Image Captioning Feature in Discourse AI Plugin - #6](https://meta.discourse.org/t/ai-image-captioning-feature-in-discourse-ai-plugin/296087/6)

또한, 이것이 진정한 OCR 대체재는 아니라는 점도 주목할 만합니다:

> [@sam](#):
>
> 예를 들어 OCR을 사용하면 노트 사진을 찍은 뒤 그대로 업로드하고 정확하게 인쇄할 수 있습니다. AI 자막 기능은 훨씬 더 정교하지만, 텍스트 한 페이지 전체를 인쇄할 때와 같은 수준의 정확도를 제공하지는 않습니다.
> 
> 언제 OCR 작업에 시간을 쓸 수 있을지 확실하지 않지만, 약간 다른 기능인 것 같습니다.
