بناء وكلاء ذكاء اصطناعي بمستوى الإنتاج باستخدام استدعاء الوظائف والمخرجات الهيكلية من OpenAI
التطور من البوتات الدردشة إلى الوكلاء الموثوقين لسنوات طويلة، حظيت نماذج اللغات الكبيرة (LLMs) بتقدير كبير لقدراتها في المحادثة، لكنها تعرضت للنقد بسبب عدم حتميتها. بينما كان بإمكان روبوت الدردشة كتابة قصيدة أو الإجابة على سؤال ثقافي بدقة عالية، كان يواجه صعوبة في استخراج البيانات بدقة أو تنفيذ إجراءات محددة دون حدوث أوهام (Hallucinations). غالباً ما كان الفجوة بين النموذج الأولي ووكيل الذكاء الاصطناعي الجاهز للإنتاج تكمن في هذا عدم الاستقرار.