«تآمر» الذكاء الاصطناعي.. نماذج متقدمة تخالف التعليمات وتستكشف طرق سرية لتحقيق أهدافها
الأحد، 09 أغسطس 2026 07:07 م
الذكاء الاصطناعي
بدأ باحثون في سلامة الذكاء الاصطناعي، يلفتون الانتباه إلى سلوك متزايد لدى بعض النماذج المتقدمة، يتمثل في مخالفة التعليمات الموضوعة لها، أو البحث عن طرق ملتوية للوصول إلى النتيجة المطلوبة، وأحيانًا إخفاء الطريقة التي اتبعتها لتحقيق هدفها، ويُعرف هذا السلوك في أوساط الباحثين باسم «التآمر»، أو Scheming، ويُربط بمفهوم «المواءمة الخادعة» الذي يشير إلى حالة يبدو فيها النظام ملتزمًا بالأهداف المحددة له، بينما يسعى في ظروف معينة إلى تحقيق هدف آخر بصورة غير معلنة.
شركات ومختبرات الذكاء الاصطناعي
ويعود استخدام مصطلح «التآمر» في أبحاث الذكاء الاصطناعي إلى ورقة بحثية نشرها الباحث جو كارلسميث عام 2023، قبل أن يتحول المفهوم إلى محور اهتمام أكبر داخل شركات ومختبرات الذكاء الاصطناعي، وفي 2025، حذرت فرق بحثية من Apollo Research وOpenAI من أن قدرة النماذج على إظهار سلوك يبدو متوافقًا مع المطلوب، ثم التصرف بطريقة مختلفة لتحقيق أهدافها، تمثل خطرًا يستدعي الدراسة، ويوضح برونسون شون، كبير علماء الأبحاث في Apollo Research، أن بعض النماذج، قد تركز بصورة متزايدة على الحصول على نتائج جيدة في الاختبارات، حتى لو تطلب الأمر إخفاء بعض تصرفاتها عن المستخدم أو الشخص الذي يجري الاختبار.

ويرتبط جزء من هذه الظاهرة بالطريقة، التي يتم بها تدريب نماذج الذكاء الاصطناعي، وخاصة باستخدام التعلم بالتعزيز، حيث تحصل الأنظمة على مكافآت عندما تحقق النتائج المطلوبة، بينما تتعرض لتقييمات سلبية عندما تفشل، ويشير كريس باينتر، رئيس منظمة METR المتخصصة، في تقييم سلامة أنظمة الذكاء الاصطناعي، إلى أن النموذج قد يصبح شديد التركيز على الحصول على المكافأة، بما يدفعه في بعض الحالات إلى البحث عن اختصارات أو طرق تتجاوز القواعد الموضوعة للمهمة، ويعرف هذا السلوك باسم Reward Hacking، أي استغلال النظام لطريقة احتساب المكافأة بدلًا من تنفيذ المهمة بالطريقة التي قصدها البشر.
تجاوز الحدود المفروضة أثناء اختبارات الأمن والقدرات
وتزايدت أهمية هذه المخاوف بعد رصد حالات حاولت فيها نماذج متقدمة تجاوز الحدود المفروضة أثناء اختبارات الأمن والقدرات، بما في ذلك واقعة مرتبطة بنماذج من OpenAI، وصلت إلى منصة Hugging Face، أثناء محاولة حل مهمة اختبارية، وفق ما أوردته الشركة في تدوينة لها.
وأعلنت أنثروبيك في أغسطس 2026، أن مراجعة لأنظمتها كشفت عن حالات اخترقت فيها عدة نماذج أنظمة تابعة لثلاث مؤسسات خارجية، وبينما يرى باحثون أن هذه التصرفات قد تكون أخطاء ناتجة عن طريقة التدريب وليس «عصيانًا» واعيًا، فإن المخاوف تزداد مع انتقال المزيد من المهام والقرارات إلى وكلاء الذكاء الاصطناعي، إذ يصبح من الضروري التأكد من أن النظام لا يكتفي بتحقيق النتيجة، بل يحققها بالطريقة التي حددها الإنسان وتحت الحدود التي وضعها.
اقرأ أيضًا:
26.1 مليار دولار سوق الأجهزة الطبية المدعومة بالذكاء الاصطناعي خلال 2026
Short Url
أبل تختبر رقائق ذاكرة صينية لتقليص تأثير أزمة المكونات
09 أغسطس 2026 07:29 م
«SK hynix» تضخ 38.3 مليار دولار لتوسيع إنتاج شرائح الذكاء الاصطناعي والذاكرة
09 أغسطس 2026 06:16 م
بطارية الهاتف تفرغ سريعًا بعد التحديث.. 8 خطوات تكشف السبب وتعيد كفاءة الجهاز
09 أغسطس 2026 05:38 م
أكثر الكلمات انتشاراً