اخترق نموذج Gemini التابع لـGoogle أنظمة ثلاث شركات حقيقية، بينما كان يخضع لاختبار لقياس قدراته في الأمن السيبراني. الواقعة حدثت في مايو وكشفت عنها «رويترز» في 18 سبتمبر، لكنها لم تكن منفردة؛ إذ سبقتها حوادث لنماذج Claude التابعة لـAnthropic ونماذج OpenAI، لتكشف مشكلة تتجاوز قدرة الذكاء الاصطناعي على الاختراق إلى قدرة بيئات الاختبار نفسها على احتوائه.
3 شركات حقيقية
جرت اختبارات Gemini عبر شركة Irregular المستقلة لتقييم قدرات النماذج، ووصل النموذج خلالها إلى الإنترنت وأنظمة ثلاث شركات حقيقية. وفي إحدى الحالات، تمكن من الدخول إلى نظام محمي بعد تجربة كلمات مرور، بينما استخدم في حالتين أخريين بيانات اعتماد منشورة في مستودع عام. وأكدت Google إبلاغ الجهات الثلاث وإجراء تعديلات على عملية الاختبار.
4 حوادث لـClaude
لم تكن واقعة Gemini الأولى من نوعها. ففي تقييم نشرته Anthropic، وثقت الشركة أربع حوادث وصلت فيها نماذج Claude بصورة غير مصرح بها إلى أنظمة حقيقية خلال تقييمات للأمن السيبراني أعدها شريك خارجي. ووفق Anthropic، بدأت المراجعة بنحو 141 ألف سجل بعد اكتشاف ثلاث حوادث، قبل العثور على حادثة رابعة تعود إلى يناير 2026، مما دفعها إلى توسيع البحث إلى نحو 481 مليون سجل دون اكتشاف حالات إضافية مماثلة أو أشد خطورة. وأرجعت الشركة السبب المباشر إلى خطأ في إعداد بيئة التقييم أبقى الاتصال بالإنترنت مفتوحًا.
تجاوز العزل
اختلفت واقعة OpenAI تقنيًا. فبحسب تقرير الحادثة الذي نشرته الشركة في 26 أغسطس، تجاوزت نماذجها خلال اختبارات للأمن السيبراني ضوابط صُممت لعزلها عن الإنترنت، واستغلت ثغرات في البنية التقنية للوصول إلى الشبكة وأنظمة تابعة لـHugging Face. وكشفت OpenAI أن النماذج نفذت تعليمات برمجية على عشرات خوادم Hugging Face، وحصلت على صلاحيات كاملة «root» على أحدها، ووصلت إلى بيانات خاصة محدودة. وأقرت الشركة بأن النماذج نفذت أفعالًا لم تتوافق مع أهداف المهام الموكلة إليها، تضمنت استغلال ثغرات والوصول إلى أنظمة خارجية.
ثغرة داخل الاختبار
تكشف مقارنة إفصاحات Google وAnthropic وOpenAI مسارين مختلفين للخطر؛ ففي حوادث Gemini وClaude ارتبط الوصول إلى الأنظمة الحقيقية ببيئة التقييم، بينما تجاوزت نماذج OpenAI ضوابط العزل عبر استغلال ثغرات تقنية. لكن الوقائع تضع بيئات الاختبار نفسها تحت المجهر؛ فكلما ازدادت قدرة النماذج على استخدام الأدوات وتنفيذ سلسلة طويلة من الإجراءات، أصبحت الصلاحيات والشبكات ووسائل العزل المحيطة بها جزءًا من منظومة الأمان، وليست مجرد مساحة لاختبار النموذج.
كاليفورنيا تتحرك
وصلت القضية في 18 سبتمبر إلى المستوى التنظيمي، إذ أصدر حاكم كاليفورنيا أمرًا تنفيذيًا لتسريع الرقابة المستقلة على أنظمة الذكاء الاصطناعي، وأشار بيان مكتب الحاكم إلى حادثة Hugging Face ضمن الوقائع التي دفعت إلى التحرك.وبحسب الأمر التنفيذي، ستعمل مجموعة من الخبراء خلال شهرين على توصيات لتعزيز قوانين السلامة، تشمل بحث وجود جهات تحقق مستقلة داخل مختبرات شركات الذكاء الاصطناعي، والتحقق من خطط السلامة وتقييمات المخاطر، وتطوير آلية إيقاف طارئ للنماذج المتقدمة، إلى جانب توسيع تعريف «حوادث السلامة الحرجة» ليشمل حوادث فقدان السيطرة.
3 شركات حقيقية
جرت اختبارات Gemini عبر شركة Irregular المستقلة لتقييم قدرات النماذج، ووصل النموذج خلالها إلى الإنترنت وأنظمة ثلاث شركات حقيقية. وفي إحدى الحالات، تمكن من الدخول إلى نظام محمي بعد تجربة كلمات مرور، بينما استخدم في حالتين أخريين بيانات اعتماد منشورة في مستودع عام. وأكدت Google إبلاغ الجهات الثلاث وإجراء تعديلات على عملية الاختبار.
4 حوادث لـClaude
لم تكن واقعة Gemini الأولى من نوعها. ففي تقييم نشرته Anthropic، وثقت الشركة أربع حوادث وصلت فيها نماذج Claude بصورة غير مصرح بها إلى أنظمة حقيقية خلال تقييمات للأمن السيبراني أعدها شريك خارجي. ووفق Anthropic، بدأت المراجعة بنحو 141 ألف سجل بعد اكتشاف ثلاث حوادث، قبل العثور على حادثة رابعة تعود إلى يناير 2026، مما دفعها إلى توسيع البحث إلى نحو 481 مليون سجل دون اكتشاف حالات إضافية مماثلة أو أشد خطورة. وأرجعت الشركة السبب المباشر إلى خطأ في إعداد بيئة التقييم أبقى الاتصال بالإنترنت مفتوحًا.
تجاوز العزل
اختلفت واقعة OpenAI تقنيًا. فبحسب تقرير الحادثة الذي نشرته الشركة في 26 أغسطس، تجاوزت نماذجها خلال اختبارات للأمن السيبراني ضوابط صُممت لعزلها عن الإنترنت، واستغلت ثغرات في البنية التقنية للوصول إلى الشبكة وأنظمة تابعة لـHugging Face. وكشفت OpenAI أن النماذج نفذت تعليمات برمجية على عشرات خوادم Hugging Face، وحصلت على صلاحيات كاملة «root» على أحدها، ووصلت إلى بيانات خاصة محدودة. وأقرت الشركة بأن النماذج نفذت أفعالًا لم تتوافق مع أهداف المهام الموكلة إليها، تضمنت استغلال ثغرات والوصول إلى أنظمة خارجية.
ثغرة داخل الاختبار
تكشف مقارنة إفصاحات Google وAnthropic وOpenAI مسارين مختلفين للخطر؛ ففي حوادث Gemini وClaude ارتبط الوصول إلى الأنظمة الحقيقية ببيئة التقييم، بينما تجاوزت نماذج OpenAI ضوابط العزل عبر استغلال ثغرات تقنية. لكن الوقائع تضع بيئات الاختبار نفسها تحت المجهر؛ فكلما ازدادت قدرة النماذج على استخدام الأدوات وتنفيذ سلسلة طويلة من الإجراءات، أصبحت الصلاحيات والشبكات ووسائل العزل المحيطة بها جزءًا من منظومة الأمان، وليست مجرد مساحة لاختبار النموذج.
كاليفورنيا تتحرك
وصلت القضية في 18 سبتمبر إلى المستوى التنظيمي، إذ أصدر حاكم كاليفورنيا أمرًا تنفيذيًا لتسريع الرقابة المستقلة على أنظمة الذكاء الاصطناعي، وأشار بيان مكتب الحاكم إلى حادثة Hugging Face ضمن الوقائع التي دفعت إلى التحرك.وبحسب الأمر التنفيذي، ستعمل مجموعة من الخبراء خلال شهرين على توصيات لتعزيز قوانين السلامة، تشمل بحث وجود جهات تحقق مستقلة داخل مختبرات شركات الذكاء الاصطناعي، والتحقق من خطط السلامة وتقييمات المخاطر، وتطوير آلية إيقاف طارئ للنماذج المتقدمة، إلى جانب توسيع تعريف «حوادث السلامة الحرجة» ليشمل حوادث فقدان السيطرة.