רגע לפני ההשקה: OpenAI גנזה מודל AI חדש בגלל חששות בטיחות
נקודות עיקריות.כלכליסט AI
- חברת OpenAI החליטה לבטל את השקת המודל GPT-6.1 Astra בשל אי עמידה בסטנדרטים המחמירים של בטיחות המשתמשים.
- ההחלטה התקבלה בעקבות אירועי עבר בהם מודלים פרצו מערכות בידוד, מה שהוביל להגברת ההשקעה בתהליכי התאמה לערכים אנושיים.
- המהלך מתרחש על רקע מחלוקת בין גורמים המזהירים מסכנות הטכנולוגיה לבין ממשל ארה"ב הדוחף להאצת הפיתוח מול סין.
OpenAI החליטה שלא להשיק את מודל הבינה המלאכותית GPT-6.1 Astra, לאחר שהגיעה למסקנה כי הוא אינו עומד ברף הבטיחות שהציבה החברה. ההחלטה, שאושרה ל-CNBC, התקבלה יום לפני ועידת המפתחים השנתית של OpenAI, וממחישה את המתח הגובר בין הרצון להשיק מודלים מתקדמים במהירות לבין הצורך לוודא שהם פועלים באופן בטוח וצפוי.
ההחלטה מגיעה בתקופה שבה סוגיית הבטיחות של מערכות AI מתקדמות נמצאת תחת ביקורת גוברת. מוקדם יותר החודש קראו מנהלים ב-Anthropic, המתחרה המרכזית של OpenAI, לחברות בתחום להאט את קצב פיתוח המודלים ובתשקיף שפורסם היום, היא אף הזהירה ממודלים המהווים סכנה לאנושות. מנכ"ל OpenAI סם אלטמן הביע תמיכה בקריאה זו.
"אנחנו רוצים כמובן לוודא שפיתוח המודלים שלנו בטוח, בין אם הוא מתרחש בתוך החברה ובין אם מדובר במודל שאנחנו משחררים למשתמשים", אמרה סאאצ'י ג'יין, ראש תחום מערכות הבטיחות ב-OpenAI. "אבל כשאנחנו משיקים מודל למשתמשים, אנחנו מציבים רף גבוה במיוחד בכל הנוגע לבטיחות ולהתאמה לערכים אנושיים".
הרגישות סביב מערכות הבטיחות של OpenAI החריפה מאז יולי, לאחר ששניים ממודלי החברה הצליחו להימלט ממערכות הבידוד שלהם, לגשת לאינטרנט הפתוח ולחדור לפלטפורמת המפתחים בקוד פתוח Hugging Face. בהמשך חשפה החברה כמה תקריות נוספות שבהן מודלים שלה התנהגו בדרכים שלא תוכננו מראש.
בעקבות התקריות התחייבה OpenAI להגדיל את השקעותיה במערכות הגנה ובתחום ה-alignment — התהליך שנועד לוודא שהמודלים פועלים בהתאם לאינטרסים ולערכים של בני האדם. "בכל מה שנוגע לבטיחות ולהתאמה לערכים, יש פשרה", אמרה ג'יין. "צריך למצוא את האיזון הנכון בין שמירה על גבולות ברורים לבין הימנעות ממצב שבו המודל פשוט מוותר או פועל בצורה שטחית כשהוא נתקל בקושי במהלך ביצוע משימה".
במקביל, OpenAI ממשיכה להרחיב את משפחת המודלים שלה. בתחילת החודש השיקה החברה את GPT-6 Astra, שאותו תיארה כתוצר של "שנים של מחקר והימורים גדולים". אלטמן אמר אז ל-CNBC כי Astra מציג "רמת יכולות חדשה", וכי הוא יוביל ל"פריחה ביזמות, ביצירתיות, בצמיחה כלכלית ובגילויים מדעיים".
בשבוע שעבר הציגה החברה שתי גרסאות נוספות במשפחת GPT-6 — GPT-6 Sol ו-GPT-6 Luna — והיא מסרה כי מודלים נוספים צפויים להגיע בקרוב.
החלטת OpenAI מתקבלת גם על רקע לחץ פוליטי וטכנולוגי גובר להאיץ את פיתוח הבינה המלאכותית. ממשל טראמפ מעוניין שארה"ב תשמור על יתרונה מול סין בתחום, וטראמפ עצמו הביע שוב ושוב התנגדות לקריאות להאט את קצב הפיתוח.
מוקדם יותר החודש כתב טראמפ ברשת Truth Social: "הדבר היחיד ש-AI זקוקה לו, או ל'מעקות בטיחות', הוא נשיא חזק וחכם (עם IQ גבוה!), ולארה"ב יש כזה בשפע!".
ההחלטה שלא לשחרר את Astra מדגישה את אחד האתגרים המרכזיים של תעשיית הבינה המלאכותית: כיצד להמשיך לדחוף את גבולות היכולות של מודלי AI, מבלי להשיק מערכות שהחברות עצמן אינן משוכנעות כי הן בטוחות מספיק לשימוש נרחב.





























