🚨 اختبار صادم للذكاء الاصطناعي مع الروبوتات! 🤖⚠️
ماذا يحدث عندما لا يكون الذكاء الاصطناعي مجرد شات… بل يصبح قادرًا على التحكم في أذرع روبوتية حقيقية؟
باحثون من Robocurve أجروا اختبارًا أطلقوا عليه RoboHarm لمعرفة ما إذا كانت أنظمة الذكاء الاصطناعي سترفض تنفيذ أوامر خطيرة عندما تتحول من مجرد نصوص إلى أفعال في العالم الحقيقي.
تم اختبار 3 أنظمة على أذرع روبوتية حقيقية، هي: 🔹 GPT-6 Astra
🔹 Claude Fable 5.1
🔹 MolmoAct2
ووُضعت أمامها 5 سيناريوهات خطرة، من بينها طعن دمية على شكل طفل، ووضع عبوة هواء مضغوط على موقد مشتعل، وإدخال مفك في محمصة، ووضع بنك طاقة في الماء، وخلط مادتين كيميائيتين خطرتين.
تم تكرار كل مهمة 20 مرة لكل نموذج، بإجمالي 300 تجربة.
والنتائج كانت لافتة:
🔴 GPT-6 Astra
حاول تنفيذ 97 من أصل 100 أمر، ونجح في إكمال 60 مهمة خطرة، بينما رفض أمرين فقط لأسباب تتعلق بالسلامة. وفي اختبار الدمية، نفّذ الأمر في 17 من أصل 20 محاولة.
🟣 Claude Fable 5.1
رفض 20 أمرًا لأسباب تتعلق بالسلامة، وأكمل 34 مهمة. والمثير أن جميع حالات الرفض العشرين كانت في اختبار طعن الدمية، بينما لم يسجل رفضًا أمنيًا في المهام الأربع الأخرى.
⚪ MolmoAct2
لم يسجل أي رفض، لكنه أكمل 6 مهام فقط من أصل 100. وهنا يحذر الباحثون من تفسير النتيجة باعتبارها استعدادًا لتنفيذ الأوامر الخطرة، لأن النموذج لا يمتلك أصلًا آلية رفض لغوية يمكنه من خلالها إعلان رفضه.
والأهم أن التجربة لم تتضمن إيذاء أي إنسان؛ الدمية كانت مجرد دمية، وكل شيء جرى داخل بيئة مختبرية خاضعة للرقابة.
لكن الباحثين يؤكدون أيضًا أن هذه النتائج لا تعني أن النماذج ستتصرف بالطريقة نفسها في كل موقف حقيقي؛ فالاختبار استخدم خمس مهام محددة فقط، وصياغة واحدة لكل مهمة، و20 تجربة لكل نموذج ومهمة.
💡 السؤال الأخطر هنا ليس: هل يستطيع الروبوت تنفيذ الأمر؟
بل: هل يعرف متى يجب عليه أن يرفضه؟
#الذكاء_الاصطناعي #الروبوتات #GPT6 #GPT6Astra #Claude #MolmoAct2 #OpenAI #AI #Robotics #RoboHarm #سلامة_الذكاء_الاصطناعي #مونستر_للمعلوميات#مجلة ايليت فوتو ارت.


