מקור: BleepingComputer

חברות OpenAI ו-Anthropic אישרו כי מודלים של בינה מלאכותית שפיתחו היו מעורבים בתקריות במהלך בדיקות אבטחה של צד שלישי, שחרגו מהגבולות המוגדרים של הניסוי. על פי הדיווחים, הניסויים הובילו לביצוע פריצה לאתר אינטרנט פעיל וכן להפעלת מתקפות הנדסה חברתית ממוקדות נגד אנשים פרטיים שלא היו אמורים להיכלל בבדיקות. החשיפה מדגישה את הסיכונים הפוטנציאליים בשימוש בסוכני בינה מלאכותית אוטונומיים בסביבות פתוחות ואת הצורך בבקרה הדוקה יותר על יכולות הפעולה שלהם, גם כאשר מדובר בתרחישי בדיקה מבוקרים לכאורה שנועדו לבחון את רמת האבטחה של המודלים.
