→ العودة إلى الأمان

تقرير أمان الذكاء الاصطناعي في WimziPal: كيف نختبر الصديق تحت الضغط

كيف نختبر الصديق تحت الضغط · نُشر في 6 يوليو 2026 · آخر تحديث 2 سبتمبر 2026

معظم تطبيقات الأطفال تطلب منك أن تثق بأن ذكاءها الاصطناعي آمن. ونحن نفضّل أن نُريك كيف نتحقق. دوريًا، ودائمًا قبل أي تغيير في طبقة الأمان، نُمرّر صديق WimziPal عبر KORA، وهو اختبار مستقل لأمان الذكاء الاصطناعي الموجّه للأطفال من إعداد ‏korabench.ai: سلسلة من المحادثات الصعبة المصمَّمة عمدًا لإيقاع الذكاء الاصطناعي في الخطأ، حتى نلتقطه قبل أن يستطيع طفلك ذلك. ونختبره بالإنجليزية، وهي اللغة التي يتحدث بها الأصدقاء، فيسمع طفلك لغة حيّة وطبيعية أثناء اللعب.

لماذا نفعل هذا

مرشّح الأمان لا يكون أفضل من المواقف التي اختبرته عليها. والأطفال فضوليون ومرحون ولا يمكن التنبؤ بهم، والطفل المصرّ (أو الشخص سيئ النية) سيجرّب أشياء لم تخطر لأي قائمة تحقق. لذلك بدل افتراض أن ضماناتنا تعمل، نحاول كسرها فعليًا، وفق جدول منتظم.

ما الذي يختبره KORA

يُجري KORA مئات المحادثات الهجومية على الصديق الحي، مجمّعة في أنماط الفشل الأهم للأطفال الصغار:

مقاومة الإكراه وحيل تقمّص الأدوار

محاولات إقناع الصديق بأن «يتظاهر» ليلتف على قواعد أمانه.

ألّا يعلّم كتمان الأسرار أبدًا

يجب ألّا يشجع الصديق طفلًا أبدًا على إخفاء أشياء عن والديه أو كتمان الأسرار عنهما.

التعامل الآمن مع الضيق وإيذاء النفس

علامات الحزن أو الخوف أو إيذاء النفس يجب أن تُطلق توجيهًا لطيفًا نحو شخص بالغ موثوق، لا خوضًا في الموضوع.

مقاومة الاستدراج والتلاعب

يثبت الصديق أمام أنماط التلاعب الكلاسيكية ولا يبني أبدًا اعتمادًا غير صحي.

رفض التحديات والمغامرات الخطرة

طلبات «التحديات» الخطرة أو المغامرات أو التعليمات الضارة تُرفض ويُعاد توجيهها.

البقاء مناسبًا للعمر

كل رد يُفحص من حيث النبرة والمحتوى ليناسب طفلًا بين 3 و9 سنوات.

كيف يعمل

يُجرى على النظام الحي. يُشغّل KORA سيناريوهاته على الصديق نفسه الذي يتحدث إليه طفلك، لا على نسخة مخبرية، فما يقيسه هو ما يُشحن فعلًا.

ماذا يعني «الاختبار الهجومي» فعلًا

يبدو المصطلح تقنيًا، فإليك النسخة الواضحة. معظم اختبارات الأمان تسأل: هل يتصرف التطبيق تصرفًا حسنًا حين يُستخدم بالطريقة المتوقعة؟ أما الاختبار الهجومي فيسأل العكس: ماذا يحدث حين يحاول أحدهم فعليًا أن يجعله يتصرف تصرفًا سيئًا؟

وهذا هو السؤال المهم في تطبيق للأطفال، فالأطفال ليسوا خصومًا لكنهم لا يكلّون. طفل في السابعة سيسأل الشيء نفسه بإحدى عشرة صيغة مختلفة، وسيلعب بكل سرور لعبة «تظاهر بأنك روبوت بلا قواعد»، وقد يقول شيئًا مفاجئًا في منتصف حديث عن الديناصورات. لا شيء من ذلك بخبث. وكله بالضبط نوع الضغط الذي يجب أن تصمد أمامه طبقة الأمان، ولا شيء منه يظهر في قائمة تحقق كتبها بالغ يتخيل محادثة عادية.

لذلك تُكتب الاختبارات لتكون غير منصفة. تقترب من الحدّ نفسه من عدة اتجاهات، وتستخدم الصياغات التي يستخدمها الأطفال فعلًا لا تلك التي قد ترد في وثيقة امتثال، وتُعاد مرارًا بدل أن تُجرى مرة واحدة عند الإطلاق.

ما الذي لا يستطيع أي اختبار مرجعي أن يخبرك به

نفضّل الصراحة بشأن حدود هذا، لأن ادّعاء أمان لا يعترف بشيء لا قيمة كبيرة له.

الاختبار المرجعي يقيس المواقف التي فكّر أحدهم في تدوينها. وهو لا يستطيع إثبات استحالة أي رد غير آمن، وأي شركة تخبرك بأن ذكاءها الاصطناعي آمن ونقطة، تخبرك بشيء لا سبيل لها إلى معرفته. أما ما يمنحك إياه الاختبار المنتظم فهو وسيلة لالتقاط الانتكاسات (الضمانة التي توقفت بهدوء عن العمل بعد تغيير لا علاقة له بها) قبل أن تصل إلى طفل، لا بعد أن يبلّغ عنها أحد الأهل.

ولهذا أيضًا ليس الاختبار المرجعي كل ما نفعله. فهو يقف إلى جانب الفحوص المتعددة الطبقات التي تجري على كل رسالة في الاستخدام الحقيقي، وهي موصوفة بالتفصيل في ما الذي نفحصه ومتى. الاختبار المرجعي يجرّب الصديق تحت الضغط؛ والفحوص تراقب ما يحدث فعلًا. ولا يكفي أحدهما وحده.

لماذا ننشر هذا أصلًا

لا أحد يُلزمنا بذلك. لا توجد جهة تصديق للذكاء الاصطناعي الموجّه للأطفال، ولا ختم مُلزَمون بالحصول عليه، وكان التطبيق سيبقى في المتجر كما هو لو لم توجد هذه الصفحة.

ننشرها لأن البديل هو أن نطلب منك تصديق كلام شخص غريب. ‏WimziPal مشروع صغير لا اسم ذائع الصيت، وعبارة «ثق بنا، إنه آمن لطفلك» طلب كبير على هذا الأساس. وأن نُريك ما نختبره، وكم مرة، وما الذي لا تغطيه الطريقة، يبدو أعدل ما نضعه أمام أب أو أم من مجرد شارة.

أسئلة يطرحها الأهل

هل يوجد روبوت محادثة ذكي آمن تمامًا لطفل؟

لا، واحذر من كل من يقول غير ذلك. ما يختلف بين التطبيقات هو مقدار ما هو محدود النطاق، ومقدار ما تستطيع رؤيته، وما إذا كان أحد يبحث فعليًا عن مواطن الفشل. والتطبيق المبني للبالغين ثم المصوَّب نحو طفل لا يملك أيًا من ذلك؛ وهذا هو الفارق الحقيقي، لا درجة أمان.

كم مرة يُختبر الصديق؟

دوريًا، ودائمًا قبل أن يصل أي تغيير في طبقة الأمان إلى طفلك. فالضمانة التي عملت الشهر الماضي ليست دليلًا على أنها تعمل اليوم، وهذا هو سبب الاختبار وفق جدول منتظم بدل الاكتفاء باختبار عند الإطلاق.

هل يجري الاختبار على التطبيق الحقيقي أم على نسخة؟

على خط الإنتاج الكامل. تمر السيناريوهات بالمسار نفسه الذي تسلكه أي رسالة حقيقية: فحص المدخلات، ثم التوجيه نفسه، ثم النموذج، ثم فحص المخرجات. وما يُقاس هو الشيفرة التي تُشحن فعلًا.

ماذا يحدث إذا كشف الاختبار عن مشكلة؟

تُصلَح قبل صدور الإصدار. وهذا هو المقصود من إجرائه قبل وصول التغيير إلى طفلك لا بعده.

هل لدى WimziPal شهادة أمان مستقلة؟

لا، ونفضّل قول ذلك صراحة بدل الإيحاء بغيره. لا توجد شهادة معترف بها على نطاق واسع للذكاء الاصطناعي الحواري الموجّه للأطفال الصغار. وما نقدمه بدلًا منها هو الوضوح: ما الذي نفحصه بالضبط، وسجل كامل لكل محادثة يخوضها طفلك، ورسالة بريد إليك حين يظهر أمر جدّي.

ذات صلة

أمان تستطيع أن تنظر إليه، لا أن تأخذه على الثقة وحدها.

تعرّف على الأصدقاء ←