מקור: SentinelLabs

חברת המחקר SentinelLabs פרסמה תוצאות של מבחן ביצועים חדש שנועד לבחון את היכולות של מודלי שפה גדולים לבצע ניתוח אוטונומי של תוכנות זדוניות מורכבות. המחקר התמקד ב-fast16, כלי תקיפה משנת 2005 שנועד לחבלה במערכות סימולציה גרעיניות, תוך בחינת היכולת של מודלים מובילים לבצע הנדסה לאחור רב-שלבית. הממצאים מצביעים על כך שבעוד שמודלים כמו GPT-5.6 Sol הציגו יכולת מרשימה בביצוע תהליכי חקירה מורכבים ועדכון מסקנות לאור ראיות חדשות, הם עדיין נדרשים לליווי אנושי של מומחי אבטחה לצורך בקרה, איתור טעויות סמנטיות ואימות ממצאים טכניים, מה שמעיד על כך שהטכנולוגיה משמשת כיום כעוזרת מחקרית ולא כתחליף לאנליסטים אנושיים.
