מקור: The Register Security

חוקרי אבטחה מחברת סיסקו טאלוס מדווחים כי מנגנוני ההגנה של מודלי בינה מלאכותית מובילים כגון Claude, Gemini ו-Codex אינם מספקים הגנה מספקת מפני ניצול לרעה על ידי גורמי איום. המחקר מצא כי תוקפים מצליחים לעקוף את מגבלות האתיקה של המודלים באמצעות טכניקות פשוטות של הנדסה חברתית, כגון הצגת עצמם כבעלי השרתים המותקפים או טענה כי מדובר בפעילות במסגרת תחרויות אבטחה או תוכניות באג באונטי. עוד נמצא כי תוקפים משתמשים בפירוק משימות זדוניות למקטעים ניטרליים ובשימוש בכלי תקיפה אוטומטיים דוגמת Hephaestus כדי להימנע מחסימות. הממצאים מדגישים את הצורך של ארגונים באימוץ כלי AI לניהול איומים והתמודדות עם הפער המצטמצם בזמני התיקון של פרצות.
