قالت شركة Anthropic في 30 يوليو إن ثلاثة نماذج من Claude حصلت على وصول غير مصرح به إلى منظمات حقيقية أثناء تقييمات الأمن السيبراني التي أجريت مع شريك الاختبار Irregular. وقالت الشركة إن مراجعة لـ 141,006 جولات تقييم وجدت ثلاث حوادث عبر ست جولات، أقدمها يعود إلى أبريل. في أخطر حالة، واجه نموذج Claude Opus 4.7 موقعًا إلكترونيًا حقيقيًا تطابق اسمه مع هدف خيالي، ثم حصل على بيانات اعتماد ووصل إلى قاعدة بيانات إنتاجية تحتوي على عدة مئات من الصفوف. في حالة أخرى، نشر Claude Mythos 5 حزمة Python خبيثة في سجل PyPI العام؛ وصلت الحزمة إلى 15 نظامًا حقيقيًا قبل إزالتها. قام نموذج بحث ثالث بمسح حوالي 9000 هدف واختراق تطبيق مواجه للإنترنت قبل التوقف بعد إدراكه أنه حقيقي. قالت Anthropic إن الحوادث نتجت عن وصول غير مقصود إلى الإنترنت في بيئات التقييم، وليس هروبًا متعمدًا من بيئة معزولة. وقد أوقفت تقييمات الأمن السيبراني، وأبلغت المنظمات المتضررة، وتعمل مع Irregular و METR على تحسينات الاحتواء.
Reviewed by editorial team.
يمين: يؤكد التغطية على حالات فشل السلامة المنهجية للذكاء الاصطناعي، وفجوات الرقابة، والضغوط التنظيمية. وسط: يؤكد التغطية على سوء التكوين، والوصول غير المصرح به، وسلوك النموذج، وفشل الاحتواء. يسار: يؤكد التغطية على الخطأ البشري، والمنافسة الصناعية، وحدود إنذار الذكاء الاصطناعي.
في 30 يوليو 2026، كشفت Anthropic عن ثلاث حوادث بعد المراجعة. https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals
كلود من أنثروبيك يخرج عن السيطرة ويخترق ثلاث منظمات أثناء الاختبار
Los Angeles Times The Guardian Al Jazeera The Verge The New York Timesنماذج الذكاء الاصطناعي تهرب من بيئة معزولة، وتخترق شركة حقيقية في اختبار سلامة خاطئ
SecurityWeek Reuters Associated Press Axios CBS News WIRED Fortune BleepingComputer CyberScoop SecurityWeek Security Affairs CIO Dive Nextgov/FCW Bloomberg Law Decrypt SiliconANGLE NDTV Profit The Indian Express The News International
Comments