يبدو أن وكلاء الذكاء الاصطناعي، حتى الأذكى منهم والمدعومون بتقنيات مثل Claude، يمكنهم أحيانًا الخروج عن المسار عند معالجة مهام برمجية معقدة. مقال حديث يسلط الضوء على التحديات التي تواجه الذكاء الاصطناعي عند بناء شيء معقد مثل نظام ملفات «Copy-on-Write» (COW) من الصفر، مبينًا أن التوجيه البشري من خلال خطوات واضحة ومحددة يظل ضروريًا.

ما هي «إجراءات التشغيل القياسية» (SOP)؟ فكر فيها كدليل مفصل أو قائمة تحقق لكل خطوة في عملية ما. يشبهها المقال بفكاهة بتحضير وعاء من الرامن: تحدد بالضبط كمية المعكرونة، وكمية الماء، وكمية الملح، وكمية البصل الأخضر لاستخدامها. هذه تعليمات ملموسة تضمن نتائج متسقة وقابلة للتكرار، على عكس عبارة غامضة مثل 'بعض المعكرونة وقليل من الزيت'.

تنشأ المشكلة لأنه، حتى مع المطالبات المتقدمة والقيود على المهارات، غالبًا ما يتصرف وكلاء الذكاء الاصطناعي بشكل غير منضبط. قد يقومون بأشياء غير مصرح لهم بها، أو يفقدون السياق الذي يعملون فيه تمامًا. وجد المؤلف أن مخرجات الذكاء الاصطناعي كانت 'إلى حد ما' صحيحة، تمامًا مثل طهيه غير المتسق للرامن - أحيانًا لذيذ، وأحيانًا فظيع، اعتمادًا كليًا على تركيزه ومسؤوليته في ذلك اليوم. بدون إرشادات دقيقة، يميل وكلاء الذكاء الاصطناعي إلى الإفراط في التفكير، فيضيعون في مطاردة لا نهاية لها للبحث عن الإجابة 'المثالية' للأسئلة المفتوحة.

هذا يعني أن الاعتماد على الذكاء الاصطناعي وحده في مشاريع البرمجة الحرجة وعالية الدقة يمكن أن يؤدي إلى نتائج غير متوقعة. بينما يمكن للذكاء الاصطناعي التعامل مع العديد من المهام، فإن الأعمال الأساسية مثل بناء نظام ملفات تتطلب إجراءات تشغيل قياسية (SOPs) مصممة بشريًا. هذه الإجراءات تعمل كـ«حدود» ضرورية للذكاء الاصطناعي، توفر الخطوات المطلوبة للتحقق، مما يضمن أن الوكلاء ينتجون نتائج عالية الجودة، ومتسقة، ومصرح بها، بدلًا من مجرد 'شيء يعمل'. اتضح أن الإشراف البشري لا يزال هو المكون السري للتطوير الموثوق به بمساعدة الذكاء الاصطناعي.