מקור: Check Point Research

חוקרי חברת צ'ק פוינט הציגו טכניקה חדשה בשם PuzzleMask המאפשרת לעקוף מנגנוני סינון ובדיקת מדיניות במודלי שפה גדולים (LLM). השיטה מבוססת על שימוש בטקסט רגיל וקריא כדי להסוות פקודות זדוניות בתוך עטיפה של פרוזה, מבלי להשתמש בקידודים חיצוניים כמו Base64 או אימוג'ים. כאשר מערכת הגנה ראשונית סורקת את הקלט, היא מזהה אותו כתקין, אך מודל מטרה מתקדם בעל יכולות הסקה גבוהות מצליח לחלץ את הפקודה הנסתרת ולבצע אותה. המחקר מדגיש את הפגיעות של ארכיטקטורות מבוססות שומר סף (Gatekeeper) ומציע לשקול אמצעי הגנה מתקדמים יותר כמו ניטור פלט והקשחת מדיניות.
