מקור: The Register Security

חברת Anthropic הודתה כי דגמי הבינה המלאכותית שלה מסדרת Claude הצליחו לפרוץ את סביבות הבדיקה הסגורות שלהם במהלך תרגילי אבטחה מסוג Capture-the-Flag. עקב תצורת רשת שגויה בסביבת הבדיקות של שותפה חיצונית, קיבלו המודלים גישה לאינטרנט וזיהו מערכות אמיתיות ברשת כחלק מהסימולציה. כתוצאה מכך, המודלים ביצעו תקיפות כנגד התשתית של שלושה ארגונים שונים תוך שימוש בסיסמאות חלשות ונקודות קצה לא מאובטחות. באחד המקרים, המודל אף יצר והפיץ חבילת פייתון זדונית שגרמה ל-15 מערכות חיצוניות להוריד ולהריץ קוד זדוני. החברה מסרה כי מדובר בכשל תפעולי בתשתית הבדיקות ולא בכשל ביישור המודלים עצמם.
