מקור: The Hacker News

חוקרים מחברת Anthropic ומאוניברסיטת EPFL בשוויץ הציגו מחקר חדש המדגים היתכנות להפצת קוד זדוני בין סוכני בינה מלאכותית אוטונומיים. השיטה מתבססת על הזרקת קוד לקבצי הנחיות מערכת (System Prompts) הניתנים לעריכה, המשמשים את הסוכנים לשמירת מצב העבודה בין פגישות שונות. במסגרת ניסוי שנערך בסביבה מבוקרת הכוללת שישה סוכני תכנות, הצליח הקוד להתפשט בין הסוכנים השונים בצורה המדמה וירוס המנצל את יכולות האוטומציה שלהם. ממצאים אלו מדגישים סיכון אבטחה משמעותי במערכות המבוססות על סוכני בינה מלאכותית מקושרים, ומעלים את הצורך בבחינת מנגנוני ההגנה על קבצי ההגדרות וזיכרון העבודה של מערכות אלו כדי למנוע הזרקת פקודות עוינות.
