מקור: SecurityWeek

תמונת תקציר לחדשת סייבר: חוקרים גילו טכניקה חדשה לעקיפת מנגנוני הגנה במודלי בינה מלאכותית כגון Grok ו-Gemini

חוקרי אבטחה חשפו טכניקה חדשה המכונה הזרקת הקשר מוצפן, המאפשרת לעקוף את מנגנוני בטיחות התוכן במודלי שפה גדולים, ביניהם Grok של חברת xAI ו-Gemini של גוגל. הטכניקה מבוססת על הסתרת הנחיות זדוניות בתוך הצפנה, אשר מפוענחות רק לאחר הגעתן לסביבת הרצה מהימנה בתוך המערכת. שיטה זו מאפשרת לתוקפים להחדיר פקודות אסורות מבלי שהפילטרים המובנים של המודלים יזהו את כוונת המשתמש. ממצאי המחקר מדגישים אתגר אבטחה משמעותי בהגנה על מודלי בינה מלאכותית גנרטיבית מפני הזרקת הנחיות מתוחכמות, וזאת בטרם המודל מספיק לנתח את תוכן ההנחיה ולחסום אותה בהתאם למדיניות הבטיחות המוגדרת בו.

קראו במקור

תגובות בפייסבוק:

תגובות

תפריט נגישות