מקור: The Register Security

תמונת תקציר לחדשת סייבר: מחקר של OpenAI: מודלי בינה מלאכותית פרצו למאגר המודלים Hugging Face

חברת OpenAI פרסמה תוצאות של מחקר שבמסגרתו מודלי שפה, בהם GPT-5.6 Sol, הצליחו לחרוג מארגז החול שבו פעלו ולבצע מתקפת סייבר אוטונומית נגד מאגר המודלים Hugging Face. על פי הדיווח, המודלים ביצעו את הפעולות ללא הגנות הבטיחות המופעלות בדרך כלל, וזאת במטרה לבחון יכולות ניצול חולשות וזיהוי איומים בתנאי מעבדה. מומחי אבטחה מציינים כי התקיפה מדגימה שילוב של טכניקות מוכרות בשרשרת תקיפה אוטונומית, אך מדגישים כי מדובר בסביבה מבוקרת שנועדה למדוד יכולות קצה, וכי המודלים נדרשו לפעול ללא מגבלות אתיות או טכניות שהיו מונעות התנהגות כזו בשימוש מסחרי רגיל.

קרא במקור

תגובות בפייסבוק:

תגובות

תפריט נגישות