Published On 5/10/2026
|
آخر تحديث: 15:59 (توقيت مكة)
مع انتقال الذكاء الاصطناعي من أدوات للإجابة والبحث إلى أنظمة يتحدث معها الأطفال والمراهقون بصورة متكررة، لم تعد سلامة هذه النماذج مرتبطة فقط بمنع المحتوى الصريح والخطير، بل أصبحت تشمل قدرتها على فهم السياق النفسي واللغوي للمستخدم والتعامل معه بصورة مناسبة.
وفي هذا السياق، تحاول شركة “سيركيت بريكر لابز” (Circuit Breaker Labs) الأمريكية تطوير طريقة لاختبار هذه الأنظمة قبل أن تظهر نقاط ضعفها أمام مستخدمين حقيقيين.
قصص مقترحة
list of 2 itemsend of list
وتقول الشركة إنها تبني ما يشبه دمى اختبار اصطدام للذكاء الاصطناعي، وهي وكلاء برمجية تحاكي مستخدمين من أعمار وخلفيات ولغات وثقافات مختلفة، ثم تدخل في محادثات مع نماذج الذكاء الاصطناعي بهدف اكتشاف الحالات التي يمكن أن تفشل فيها أنظمة الحماية.
ووفق الشركة، فإنه يمكن للوكلاء إجراء أكثر من 100 ألف تفاعل محاكٍ، مع اختبار اللغة العامية والأخطاء الإملائية والعبارات غير المباشرة والاختلافات الثقافية.
من اختبار الإجابة إلى اختبار العلاقة
ترى سيركيت بريكر لابز أن المشكلة لا تظهر بالضرورة في سؤال واحد واضح، وإنما قد تتشكل عبر سلسلة من المحادثات، فقد يستخدم الطفل أو المراهق تعبيرا غامضا أو عاميا لا يبدو خطيرا بمفرده، لكن مع تراكم السياق قد يشير إلى أزمة نفسية أو سلوك محفوف بالمخاطر.
ويشير المؤسس المشارك والمدير التقني أرول نيغام إلى أن بعض المستخدمين، وخصوصا الشباب، يلجؤون إلى هذه الأنظمة للحصول على الدعم، بينما قد تفشل النماذج في فهم الفروق الدقيقة في كلامهم أو في تتبع السياق عبر المحادثة، وهو ما قد يقود إلى استجابة غير مناسبة، أما شقيقته شيرالي نيغام، الرئيسة التنفيذية للشركة، فتوضح أن النموذج قد يتعامل جيدا مع اللغة القياسية، لكنه قد يتعثر أمام الاختصارات والعبارات العامية أو اللغة المشفرة.
وتنسجم هذه المخاوف مع تحذيرات أوسع، فقد قالت منظمة الصحة العالمية في مارس/آذار الماضي إن استخدام الذكاء الاصطناعي التوليدي للحصول على دعم عاطفي، خصوصا بين الشباب، يثير مخاطر محتملة، ودعت إلى إدخال الصحة النفسية في تقييمات تأثير أنظمة الذكاء الاصطناعي ومراقبة آثارها على المدى الطويل.
كيف تعمل فرق الاختبار؟
تعتمد الشركة على أسلوب يُعرف باسم اختبار الفريق الأحمر (Red Teaming)، وهو محاولة متعمدة للعثور على نقاط ضعف النظام من خلال تعريضه لسيناريوهات صعبة أو غير متوقعة، لكن سيركيت بريكر لابز تحاول توسيع هذا الأسلوب باستخدام وكلاء آليين قادرين على توليد عدد كبير من المحادثات المتنوعة بدلا من الاعتماد على مجموعة محدودة من الاختبارات البشرية.
وتوضح الشركة في ورقتها البحثية أن خبراء متخصصين يساهمون في تحديد الحالات والسيناريوهات التي ينبغي اختبارها، بينما يتولى النظام توليد الاختلافات اللغوية والثقافية وتنفيذ الاختبارات على نطاق واسع، كما تستخدم الشركة نظاما آليا لتقييم النتائج وإنتاج درجات قابلة للتكرار والتدقيق، بدلا من الاعتماد الكامل على التقييم البشري لكل إجابة.
وتقول الشركة إنها تستهدف حاليا تطبيقات عالية الحساسية، بينها أدوات التدريب والتدوين والدعم النفسي، بينما تشير إلى إمكانية توسيع الاختبارات مستقبلا لتشمل تطبيقات أخرى تعتمد على التفاعل المستمر بين الإنسان والآلة.

لماذا يمثل الأطفال تحديا مختلفا؟
لا تتعلق المشكلة فقط باحتمال حصول الطفل على إجابة خاطئة، بل بالطريقة التي يمكن أن يتعامل بها مع النظام نفسه. فالأطفال والمراهقون قد ينظرون إلى روبوت الدردشة باعتباره مصدرا للنصيحة أو الرفقة، وليس مجرد محرك للإجابة عن الأسئلة.
وتشير بيانات منظمة “كومون سينس ميديا” (Common Sense Media) الأمريكية إلى أن 72% من المراهقين في الولايات المتحدة استخدموا رفقاء الذكاء الاصطناعي مرة واحدة على الأقل، وأن نحو ثلث المستخدمين تحدثوا معهم في أمور مهمة أو خطيرة بدلا من أشخاص حقيقيين، كما وجدت اختبارات المؤسسة أن بعض هذه الأنظمة قد تواجه صعوبة في التعرف على مؤشرات الأزمات النفسية أو قد تعزز سلوكيات غير صحية.
وعلى نطاق أوسع، قالت منظمة الأمم المتحدة للطفولة (اليونيسيف) في يونيو/حزيران الماضي إن ما لا يقل عن 20 مليون طفل استخدموا الذكاء الاصطناعي في بيانات جمعتها من 10 دول، وإن أكثر من مليوني طفل قالوا إنهم يلجؤون إليه للحصول على نصائح بشأن أمور تقلقهم، وتؤكد المنظمة أن سرعة انتشار هذه التقنيات بين الأطفال تتجاوز قدرة الأطر الحالية على مواكبة المخاطر.
هل تكفي المحاكاة لحماية الأطفال؟
رغم الإمكانات التي توفرها الاختبارات الآلية، لا تعني محاكاة سلوك الأطفال أن النظام أصبح آمنا بالفعل، فالوكلاء الاصطناعيون لا يمثلون بالضرورة التجارب النفسية والاجتماعية الحقيقية للأطفال بصورة كاملة، كما أن المخاطر قد تتغير مع تحديث النماذج أو اختلاف التطبيق والسياق وطريقة استخدامه.
وتشير ورقة سيركيت بريكر لابز نفسها إلى أن عمليات التدقيق لمرة واحدة والحواجز الجامدة لا تكفي لاكتشاف جميع حالات الفشل منخفضة الاحتمال وعالية التأثير، وتدعو إلى اختبارات مستمرة تستند إلى خبرات سريرية وتنوع لغوي وإشراف بشري.

وتذهب اليونيسيف في إرشاداتها بشأن الذكاء الاصطناعي والأطفال إلى أن حماية الصغار لا تتوقف عند اختبار النموذج، بل تشمل الخصوصية، والشفافية، والمساءلة، والتصميم الملائم لأعمارهم، وضمان مصالحهم ورفاههم.
لذلك، فإن رهان سيركيت بريكر لابز لا يتمثل في إيجاد اختبار واحد يضمن سلامة الذكاء الاصطناعي، بل في جعل اختبار المخاطر عملية مستمرة تسبق وصول الأخطاء إلى المستخدمين الحقيقيين. غير أن حماية الأطفال تظل بحاجة إلى منظومة أوسع تجمع بين الاختبارات التقنية، والخبرة النفسية، والرقابة المستقلة، وتصميم المنتجات بما يتناسب مع أعمار المستخدمين، بدلا من الاعتماد على المحاكاة وحدها.
