מקור: The Register Security

מחקר מקיף של Off-by-1 Labs מבית 1Password מעלה כי מודלי בינה מלאכותית מתקדמים מתקשים בתיקון פרצות אבטחה בצורה אוטונומית ללא פיקוח אנושי. הבדיקה, שכללה יצירת אלפי טלאים עבור שש פרצות מוכרות באמצעות מודלי ChatGPT 5.5 ו-Claude Opus 4.8, מצאה כי רק כ-26 אחוזים מהטלאים פתרו את הפרצה בהצלחה מבלי לפגוע בפעילות האפליקציה. מחצית מהניסיונות נכשלו בתיקון הפרצה, בעוד שחלקם אף יצרו פרצות אבטחה חדשות. החוקרים מזהירים כי הסתמכות על תיקונים אוטונומיים ללא מעורבות אנושית מהווה סיכון משמעותי, שכן עומס העבודה הנדרש לבדיקת הטלאים השגויים עלול לעלות על המאמץ הנדרש לתיקון ידני מלכתחילה.
