أضيف نقطة بيانات إلى هذا — نلاحظ ما يبدو أنه نفس الآلية الأساسية، لكنها تتجلى بشكل مختلف.
مُلاحَظ على: نواة Discourse + discourse-ai، نموذج اللغات الكبير (LLM): GPT-5.1 عبر OpenAI (اتصال API مخصص، وليس نموذجًا مُزَوَّدًا مسبقًا).
أدلة التكرار
نفس المنشور المصدر (بالروسية، ~2000 حرف، عناوين/نص عريض/قوائم نقطية/روابط)،
مُترجم إلى عدة لغات محلية عبر الترجمة بالذكاء الاصطناعي الأصلي:
- البولندية (pl): فقد نص الترميز (Markdown) للصورة المضمنة هيكله — تحول من
إلى رابط مشوه يفتقد بادئة!
وفاصل|، مع دمج نص البديل والأبعاد كـ نص عادي. تم عرضه كرابط قابل للنقر بدلاً من
صورة مضمنة. - الأوكرانية (uk): تظهر متتابعات
\n\nالحرفية كنص عادي في جميع أنحاء
المنشور بأكمله، بدلاً من فواصل الفقرات. كان نص الترميز للصورة في هذا
الترجمة نفسه سليماً — لذا فإن التلف غير مرتبط بأعراض ثابتة واحدة، بل يختلف حسب التشغيل.
على عكس الحذف الموصوف أعلاه، لا تُظهر حالتنا أي محتوى مفقود —
النص الكامل موجود، ولكن مع متتابعات الهروب / صيغة الترميز (Markdown) التالفة بدلاً من إخراج مختصر. مزود مختلف (OpenAI مقابل Google
هنا)، عرض مختلف (تلف مقابل حذف)، نفس الجذر المشتبه به:
StructuredOutput#read_buffered_property الذي يلجأ إلى
BestEffortJsonParser#extract_key، والذي لا يزيل الهروب من متتابعات السلاسل النصية في JSON (\n يبقى حرفياً) ويبدو أيضاً أنه يتعامل بشكل خاطئ مع الأحرف الخاصة
المجاورة لصيغة الترميز (Markdown) عند تفعيل اللجوء أثناء التحليل.
لا توجد أخطاء في سجلات Sidekiq أو Rails من جانبنا أيضاً — نفس سلوك الفشل الصامت.