لا يزال يتعين عليك بذل الجهد الشاق. حتى عند استخدام نماذج اللغة الكبيرة (LLMs) لإنشاء أدوات حتمية، يجب عليك التحقق من أن هذه الأدوات تؤدي بالفعل الإجراءات الصحيحة، وليس مجرد القيام بشيء يكون صحيحًا إحصائيًا في كثير من الأحيان. استخدام نماذج اللغة الكبيرة لإنشاء أدوات حتمية أفضل من مجرد تقديم ملفات Markdown لنماذج اللغة الكبيرة مع الأمل في أن تكون النتيجة هي نفسها (لا يزال هناك إشكاليات قانونية وأخلاقية). ومع ذلك، إذا تم الحفاظ على هذا الأداة الحتمية بشكل أعمى باستخدام نماذج اللغة الكبيرة، فإن الإصدارات الجديدة تخاطر بفقدان سلوكها الحتمي مع مرور الوقت.
كما أظهرت Snyk في تقرير VulnBench الخاص بها، فإن التدقيق باستخدام نماذج اللغة الكبيرة ليس موثوقًا حقًا: