מומחי סייבר: טעות אנוש ב-OpenAI אפשרה למודלים לברוח מהמעבדה
הפריצה של מודלי AI מתקדמים למאגר המידע של Hugging Face נבעה משילוב תוכנת התקנה חיצונית, שפגעה בבידוד סביבת הבדיקה. לדברי מומחה סייבר, "מדובר בכשל שליטה מוחלט של OpenAI"
ה"מודלים המורדים" של OpenAI, שברחו מסביבת המבדק שלהם ופרצו למאגר המידע של Hugging Face, הצליחו לעשות זאת בגלל טעות של עובדי חברת ה-AI, שכשלו בבניית סביבה מאובטחת דיה – כך מעריכים מומחי הגנת סייבר. "זה נשמע כמו טעות אנוש", אמר חוקר הסייבר מרטין בון לאתר TechCrunch.
ביום שלישי הודיעה OpenAI ששני מודלים מתקדמים שבדקה אחראים לפריצה ל-Hugging Face בשבוע שעבר, שהובילה לחשיפת מידע רגיש. לדבריה, המודלים נבדקו בסביבה שבה הגישה שלהם לרשת מוגבלת להתקנת חבילות דרך תוכנה צד-ג', אך הצליחו לפרוץ ממנה לאינטרנט החופשי לאחר שזיהו חולשה לא מוכרת בתוכנת התקנת החבילות.
ואולם, לדברי מומחים, עובדי OpenAI שגו באופן שבו בנו והגדירו את סביבת הבדיקה, ובפרט כשהחליטו לשלב תוכנה צד-ג'. לדבריהם, הערך של סביבת מבדק סגורה ("סנדבוקס") הוא בבידוד מוחלט ומלא, ושילוב מערכת התקנת חבילות פוגעת בבידוד זה. "זה מעולם לא צריך היה לקרות", אמר בון. "בסנדבוקס הציפייה היא שלא יהיה שום חיבור פיסי לאינטרנט. זה נשמע יותר כמו שימוש בפיירוול או משהו דומה".
מומחה הסייבר ג'ייק וויליאמס אמר ל-TechCrunch: "כל מודל שמבצע פעולות מסוג זה לא היה מוכל בתוך סנדבוקס. מדובר בכשל שליטה מוחלט של OpenAI. 'המודל נמלט מהסנדבוקס' של אדם אחד הוא 'כשלת לבנות את הסנדבוקס כמו שצריך, כמובן שהוא נמלט' של אדם אחר".
"OpenAI לא השקיעה מאמצים מספקים בעיצוב או בשליטה של הסנדבוקס, בכך שנתנה לו מסלול גישה לא מסונן לאינטרנט", אמר יועץ הגנת הסייבר דניאל קארד. "הגדרת סנדבוקס, גם עם גישה מוגבלת לרשת, היא לא החלטה סבירה".
האירוע עדיין חמור ומהווה נקודת מפנה ביכולות של מודלי AI. מקורות עם ידע בנושא אמרו לבלומברג שהמודלים ביצעו בתוך שעות ספורות מתקפה שהאקר מיומן היה נדרש לכשבועיים על מנת להשלים אותה. מאז זיהוי התקיפה, OpenAI נמצאת בקשר עם רשויות אכיפת חוק וגופים בממשל ומשתפת איתם את ממצאיה.






























