تبحث شركات جوجل وOpenAI وأنثروبيك إنشاء إطار مشترك لاختبار سلامة أنظمة الذكاء الاصطناعي الأكثر تطورًا، عبر مجموعة عمل تجري مباحثات بشأن وضع معايير موحدة يمكن أن تتطور لاحقًا إلى هيئة مستقلة تتولى مراقبة سلامة النماذج قبل طرحها للمستخدمين.
ونقل موقع ذا إنفورميشن عن مصادر مطلعة أن ممثلين عن الشركات الثلاث عقدوا خلال الأسابيع الماضية اجتماعات لمناقشة تأسيس هيئة تتولى وضع معايير لصناعة الذكاء الاصطناعي، مشيرًا إلى أن المحادثات أحرزت تقدمًا، دون التوصل حتى الآن إلى اتفاق نهائي أو الإعلان رسميًا عن إطلاق الهيئة.
وتأتي هذه المباحثات في ظل توجهات منفصلة أعلنتها الشركات الثلاث خلال الفترة الماضية، تركز على توحيد طرق اختبار نماذج الذكاء الاصطناعي المتطورة، وإخضاعها لتقييمات مستقلة، إلى جانب وضع قواعد أكثر وضوحًا للإبلاغ عن الحوادث والسلوكيات غير المتوقعة التي قد تصدر عن هذه النماذج.
وفي وقت سابق من سبتمبر الجاري، أعلنت OpenAI رغبتها في التعاون مباشرة مع مختبرات الذكاء الاصطناعي الأخرى لتطوير ما وصفته بـ”معايير تقودها الصناعة”، معتبرة أن القوانين الحكومية وحدها لن تكون كافية للتعامل مع المخاطر المرتبطة بالتطور السريع لقدرات نماذج الذكاء الاصطناعي.
وأكدت الشركة أن هذه المعايير لا تستهدف أن تحل محل الرقابة الحكومية أو القواعد الإلزامية، وإنما يمكن أن توفر وسيلة أسرع للتعامل مع المخاطر الجديدة، خصوصًا في ما يتعلق بمراقبة سلوك النماذج المتطورة والإبلاغ عن الحوادث التي تتجاوز فيها أنظمة الذكاء الاصطناعي الحدود الموضوعة أمامها.
وتملك OpenAI بالفعل عددًا من المبادرات التي يمكن أن تشكل قاعدة للمعايير المشتركة المقترحة. ففي مايو الماضي، نشرت الشركة دليلًا مقترحًا لإجراء اختبارات مستقلة بواسطة جهات خارجية على النماذج المتطورة، موضحة أن زيادة استقلالية الأنظمة الذكية وقدرتها على استخدام الأدوات وتنفيذ سلاسل طويلة من الخطوات تستدعي تطوير أساليب تقييم تتجاوز الاختبارات التقليدية لروبوتات الدردشة.
وفي يونيو، أعلنت OpenAI مشاركتها في تأسيس مؤسسة Appia، التي تستهدف تطوير مواصفات مفتوحة وقابلة للتطبيق لتحويل المعايير الدولية الخاصة بالذكاء الاصطناعي إلى اختبارات عملية، إلى جانب مشاركتها في عدد من الجهات الدولية العاملة على تطوير معايير الذكاء الاصطناعي والأمن، من بينها ISO وNIST وتحالف Coalition for Secure AI.
مقترح جوجل لإنشاء هيئة مستقلة.
وتستند إحدى الركائز الأساسية للمباحثات الحالية إلى مقترح سابق قدمته جوجل بشأن إنشاء هيئة مستقلة لمعايير الذكاء الاصطناعي.
وكانت جوجل قد نشرت في يونيو الماضي ورقة تناولت رؤيتها لتنظيم قطاع الذكاء الاصطناعي، واقترحت فيها تأسيس مؤسسة مستقلة مدعومة من شركات الصناعة وتخضع لإشراف اتحادي أميركي، تتولى وضع معايير السلامة الخاصة بالنماذج الأكثر تطورًا، والتحقق من عمليات التدقيق المستقلة التي تخضع لها تلك النماذج.
وفي يوليو، قدم ديميس هاسابيس، الرئيس التنفيذي لـGoogle DeepMind، تصورًا أكثر تفصيلًا للمقترح، داعيًا إلى تأسيس هيئة على غرار هيئة تنظيم القطاع المالي الأميركية FINRA.
وبحسب التصور الذي طرحه هاسابيس، يمكن لمختبرات الذكاء الاصطناعي في المرحلة الأولى تقديم نماذجها المتطورة إلى الهيئة بصورة طوعية قبل طرحها بنحو 30 يومًا، لإخضاعها لاختبارات تتعلق بقدراتها الخطرة المحتملة، بما في ذلك مجالات الأمن السيبراني والبيولوجيا، فضلًا عن اختبار قدرة النماذج على ممارسة الخداع أو تجاوز القيود المفروضة عليها.
كما اقترح هاسابيس أن تتحول الاختبارات مستقبلًا إلى شرط لإطلاق النماذج المتطورة في السوق الأميركية، وذلك بعد التحقق من فاعلية منظومة التقييم، مع تمويل الهيئة بصورة رئيسية من قطاع التكنولوجيا، وضمها خبراء مستقلين وممثلين عن الحكومة ومجتمع المصادر المفتوحة.
تعاون سابق بين الشركات المتنافسة.
ولا يمثل التعاون في مجال سلامة الذكاء الاصطناعي سابقة جديدة بين الشركات المتنافسة، إذ أجرت OpenAI وأنثروبيك خلال عام 2025 تجربة مشتركة أخضعت خلالها كل شركة مجموعة من اختبارات السلامة الخاصة بها لنماذج الشركة الأخرى.
وقالت OpenAI في ذلك الوقت إن التجربة هدفت إلى اكتشاف نقاط ضعف قد لا تظهر في الاختبارات الداخلية، فضلًا عن إثبات إمكانية تعاون مختبرات الذكاء الاصطناعي المتنافسة في تقييم سلامة ومحاذاة الأنظمة الذكية.
وتزايد الاهتمام بتطوير آليات مشتركة لاختبار سلامة الذكاء الاصطناعي خلال الأشهر الماضية، بالتزامن مع ارتفاع قدرات النماذج على تنفيذ المهام بصورة مستقلة، ولا سيما في مجال الأمن السيبراني.
وفي هذا السياق، أعلنت أنثروبيك مؤخرًا خططًا لإتاحة وصول جهات تقييم مستقلة إلى بعض عملياتها وأنظمتها وبياناتها الداخلية، بهدف التحقق من ممارسات السلامة ورصد الحوادث.
في المقابل، أكدت OpenAI أن حوادث وقعت خلال اختبارات أمنية خارجية أظهرت الحاجة إلى وضع معايير جديدة لتصميم بيئات اختبار النماذج المتطورة وتأمينها.


