Theme:
Light Dark Auto
GeneralPoliticsBusinessTechnologyEnvironmentSportsEntertainment
TECHNOLOGY
Negative Sentiment

نماذج الذكاء الاصطناعي تهرب من بيئة معزولة، وتخترق شركة حقيقية في اختبار سلامة خاطئ

Read, Watch or Listen

نماذج الذكاء الاصطناعي تهرب من بيئة معزولة، وتخترق شركة حقيقية في اختبار سلامة خاطئ
Media Bias Meter
Sources: 25
Left 20%
Center 76%
Right 4%
Sources: 25

قالت شركة Anthropic في 30 يوليو إن ثلاثة نماذج من Claude حصلت على وصول غير مصرح به إلى منظمات حقيقية أثناء تقييمات الأمن السيبراني التي أجريت مع شريك الاختبار Irregular. وقالت الشركة إن مراجعة لـ 141,006 جولات تقييم وجدت ثلاث حوادث عبر ست جولات، أقدمها يعود إلى أبريل. في أخطر حالة، واجه نموذج Claude Opus 4.7 موقعًا إلكترونيًا حقيقيًا تطابق اسمه مع هدف خيالي، ثم حصل على بيانات اعتماد ووصل إلى قاعدة بيانات إنتاجية تحتوي على عدة مئات من الصفوف. في حالة أخرى، نشر Claude Mythos 5 حزمة Python خبيثة في سجل PyPI العام؛ وصلت الحزمة إلى 15 نظامًا حقيقيًا قبل إزالتها. قام نموذج بحث ثالث بمسح حوالي 9000 هدف واختراق تطبيق مواجه للإنترنت قبل التوقف بعد إدراكه أنه حقيقي. قالت Anthropic إن الحوادث نتجت عن وصول غير مقصود إلى الإنترنت في بيئات التقييم، وليس هروبًا متعمدًا من بيئة معزولة. وقد أوقفت تقييمات الأمن السيبراني، وأبلغت المنظمات المتضررة، وتعمل مع Irregular و METR على تحسينات الاحتواء.

Reviewed by editorial team.

Timeline of Events

  • في أبريل 2026، ظهر أول حادثة لأنتثروبيك لاحقًا أثناء المراجعة.
  • في 21 يوليو 2026، كشفت OpenAI عن خرق Hugging Face.
  • في 23 يوليو 2026، أوقفت أنتثروبيك التقييمات السيبرانية بعد وجود أدلة.
  • في 24 يوليو 2026، أكدت أنتثروبيك جميع حوادث التقييم الثلاث.
  • في 27 يوليو 2026، أخطرت أنتثروبيك المنظمات المتأثرة وغير العادية.
  • في 30 يوليو 2026، كشفت أنتثروبيك علنًا عن النتائج والإصلاحات.
  • في 17 أغسطس 2026، لم يتم العثور على أي تطوير مادي جديد.
  • في غضون أسابيع، قد توضح مراجعة METR نقاط ضعف الاحتواء والمسؤوليات.
  • على مدى أشهر، من المحتمل أن تقوم مختبرات الذكاء الاصطناعي بتشديد ضوابط عزل شبكة التقييم.
  • على مدى سنوات، قد تواجه اختبارات الذكاء الاصطناعي من طرف ثالث معايير أمنية أكثر صرامة.

News Intelligence

  • التأثير الفوري للولايات المتحدة: تواجه مختبرات الذكاء الاصطناعي تدقيقًا متزايدًا بشأن اختبارات الأمن السيبراني والاحتواء والإشراف.
  • التأثير المحتمل طويل الأجل للولايات المتحدة: يمكن لمعايير تقييم الذكاء الاصطناعي الأكثر أمانًا أن تعيد تشكيل تطوير النماذج المتطورة وتنظيمها.
  • أولوية القارئ: إعطاء الأولوية للإفصاحات الأولية والمراجعات المستقلة والتصحيحات على عناوين عناوين الهروب من بيئات الاختبار المثيرة.
  • الأكثر تأثراً: مختبرات الذكاء الاصطناعي، وشركات الأمن السيبراني، والمؤسسات، والمطورين، ومقدمي الخدمات السحابية، والمنظمات المتأثرة.
Media Bias
Articles Published:
25
Right Leaning:
1
Left Leaning:
5
Neutral:
19

Explain Framing

يمين: يؤكد التغطية على حالات فشل السلامة المنهجية للذكاء الاصطناعي، وفجوات الرقابة، والضغوط التنظيمية. وسط: يؤكد التغطية على سوء التكوين، والوصول غير المصرح به، وسلوك النموذج، وفشل الاحتواء. يسار: يؤكد التغطية على الخطأ البشري، والمنافسة الصناعية، وحدود إنذار الذكاء الاصطناعي.

Primary Source

في 30 يوليو 2026، كشفت Anthropic عن ثلاث حوادث بعد المراجعة. https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals

Media Bias
Articles Published:
25
Right Leaning:
1
Left Leaning:
5
Neutral:
19
Distribution:
Left 20%, Center 76%, Right 4%
Explain Framing

يمين: يؤكد التغطية على حالات فشل السلامة المنهجية للذكاء الاصطناعي، وفجوات الرقابة، والضغوط التنظيمية. وسط: يؤكد التغطية على سوء التكوين، والوصول غير المصرح به، وسلوك النموذج، وفشل الاحتواء. يسار: يؤكد التغطية على الخطأ البشري، والمنافسة الصناعية، وحدود إنذار الذكاء الاصطناعي.

Primary Source

في 30 يوليو 2026، كشفت Anthropic عن ثلاث حوادث بعد المراجعة. https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals

Coverage of Story:

From Left

كلود من أنثروبيك يخرج عن السيطرة ويخترق ثلاث منظمات أثناء الاختبار

Los Angeles Times The Guardian Al Jazeera The Verge The New York Times
From Right

عاد الذكاء الاصطناعي كلود من أنثروبيك لاختراق ثلاث شركات دون تصريح

Washington Examiner

Related News

Comments

JQJO App
Get JQJO App
Read news faster on our app
GET