تتزايد التحذيرات داخل صناعة الذكاء الاصطناعي بشأن القدرات المتطورة للنماذج، بينما تسعى الشركات المعنية إلى المساهمة في صياغة القواعد التنظيمية لهذه الأنظمة،
OpenAI وAnthropic تضطلعان بدور مزدوج، إذ تعملان على تعزيز إمكانيات النماذج وفي الوقت ذاته تدعوان إلى فرض اختبارات وضوابط على الأنظمة الأكثر تقدمًا.
الشركات تطالب باختبارات أقوى
وفقًا لتقرير صادر عن وكالة Associated Press، حذر قادة OpenAI وAnthropic من المخاطر المحتملة للنماذج المتقدمة، داعين إلى وجود تنظيم واختبار مستقل لبعض الأنظمة قبل طرحها في السوق،
تأتي هذه الدعوات في وقت تسعى فيه شركات الذكاء الاصطناعي للتأثير في النقاش حول كيفية تشكيل القواعد التي تحكم هذه التقنية، especialmente مع تطور قدرات النماذج في البرمجة واستخدام الأدوات.
السلامة تدخل قلب المنافسة
المسألة لا ترتكز على وقف تطوير الذكاء الاصطناعي، بل تتعلق بكيفية تقييم قدرات الأنظمة قبل منحها وصولاً أوسع إلى الأدوات والبيانات،
في ظل ظهور الوكلاء، يبدو أن اختبارات السلامة التقليدية، التي تركز فقط على النصوص الناتجة عن النموذج، ليست كافية، مما يبرز الحاجة إلى تقييم أدائها في بيئات واقعية.
يجب اختبار قدرة النماذج على الالتزام بالصلاحيات الخاصة بها ومراقبة سلوكها عند مواجهة عقبات قد تعيقها عن إتمام المهام بالشكل المطلوب.





