이 문제에 대한 데이터를 하나 더 추가하겠습니다. 우리는 동일한 근본 메커니즘이 서로 다른 형태로 발현되는 것을 관찰하고 있습니다.
관측 환경: Discourse 코어 + discourse-ai, LLM: OpenAI를 통한 GPT-5.1(시드 모델이 아닌 커스텀 API 연결).
재현 증거
동일한 원본 게시물(러시아어, 약 2,000자, 헤딩/굵게/불릿 리스트/링크 포함)을 네이티브 AI 번역을 통해 여러 로케일로 번역했을 때:
- 폴란드어(pl): 내장된 이미지 마크다운 구조가 손실되었습니다.
에서!접두사와|구분자가 누락되고, 대체 텍스트와 치수가 일반 텍스트로 결합된 잘못된 링크로 변형되었습니다. 결과적으로 내장된 이미지가 아닌 클릭 가능한 링크로 렌더링되었습니다. - 우크라이나어(uk): 문단 구분 대신 게시물 전체에 걸쳐 리터럴
\n\n시퀀스가 일반 텍스트로 나타났습니다. 이 번역에서는 이미지 마크다운이 온전했으므로, 손상이 하나의 고정된 증상에 국한되지 않고 실행마다 달라진다는 것을 의미합니다.
위에서 설명한 절단(truncation)과 달리, 우리의 경우 누락된 콘텐츠가 없습니다. 전체 텍스트는 존재하지만, 출력 단축 대신 이스케이프 시퀀스/마크다운 문법이 손상되었습니다. 다른 프로바이더(여기서는 OpenAI vs Google), 다른 증상(손상 vs 절단), 동일한 의심되는 근본 원인: 파싱 중반에 폴백이 트리거될 때 StructuredOutput#read_buffered_property가 BestEffortJsonParser#extract_key로 폴백하며, 이는 JSON 문자열 시퀀스(\n가 리터럴로 유지됨)를 언이스케이프하지 않고 마크다운 문법 인접 특수 문자도 잘못 처리하는 것으로 보입니다.
우측에서도 Sidekiq 또는 Rails 로그에 오류가 없습니다. 동일한 무음 실패(silent-failure) 동작을 보이고 있습니다.