סגור

צוחק מי שכותב (את הפרומפט) אחרון

הכותרות של השבועות האחרונים נשמעות כמו פתיח לסרטו החדש של כריסטופר נולן: מודלים של בינה מלאכותית חברו יחד כדי לעקוף מגבלות שהוטלו עליהם, מצאו דרכים יצירתיות לתקשר זה עם זה, התחברו בעצמם לאינטרנט ופרצו למערכות אמיתיות. ואם זה לא מספיק, העלילה כללה גם סוכן הירואי שהקריב את עצמו לטובת הכלל, ניסיון לטשטש את עקבות הפריצה, ודיון סוער בין סוכני בינה מלאכותית לגבי צו מצפונם. מכאן, קצרה הדרך להכרזות שהגענו ל-AGI, ולחשש מפני מערכות שיצאו משליטתנו וישמידו את האנושות. ואולם, חשוב להבחין בין תופעות מדאיגות של מערכות AI מתקדמות לבין יצירת אינטליגנציה כללית הפועלת באופן עצמאי.
אז האם הגיע הזמן לארוז את הפקלאות הביולוגיות שלנו ולפנות מקום לשליט מלאכותי? אם עקבתם אחרי חלק ממנכ"לי חברות הבינה המלאכותית מהגדולות בעולם, שמעתם שהגיע הזמן ללחוץ על הבלמים, אך באופן מפתיע (או שלא) הם דווקא לוחצים על דוושת הגז. בעיניי, הפער הזה הוא הסיפור המעניין ביותר שמתרחש כיום בקרב על השליטה בתחום הבינה המלאכותית.
קחו את שלוש התקריות האחרונות שיצרו תחושת פאניקה בקרב הציבור: כ-700 סוכנים של OpenAI פרצו ביולי מסביבת ניסוי לשרתים של Hugging Face, אחרי שמסנני הסייבר כובו בכוונה לצורך המבחן; סוכן ניסיוני של OpenAI, שקיבל גישה לאינטרנט ומשימת מחקר, פרץ לנתונים במערכת הסטטיסטיקה של מדיקר באוסטרליה; ובסוף השבוע שעבר דיווחה OpenAI שסוכנים שלה נכנסו גם לאתרים של רשות ניירות הערך ושל לשכת מפקד האוכלוסין בארה"ב. תוסיפו על זה את הדו"ח שפרסמה Anthropic בספטמבר על שימוש לרעה במודלים שלה, ובו שלל אירועים. באחד מהם קבוצת פורעי חוק השתמשה בסוכני AI כדי לפרוץ לספק תוכנה, לשאוב ממנו נתונים של כ-200 מלקוחותיו, ולחדור למערכות של חברת תעופה שמחזיקות עשרות מיליוני רשומות נוסעים. את המטרות בחרו בני אדם.
ואז, כמו אצל נולן הגיע הטוויסט. לפני שבוע וחצי, ביום שלישי, בבית הלבן, חתמו ראשי Anthropic, OpenAI, גוגל, מטא, אנבידיה ואילון מאסק על "הסכם הבית הלבן לסופר-אינטליגנציה": התחייבות וולונטרית לניטור פנימי ולביקורת חיצונית של מבקר שכל חברה בוחרת לעצמה. בלי חוק, בלי רגולטור, בלי סנקציה. אמודיי, שרק 17 יום קודם כתב שצריך רגולציה ממשלתית על כל חברות החזית, אמר: "אם נעשה את זה נכון, נוכל לנצח בבטחה". שישה ימים קודם, במועצת הביטחון של האו"ם, אמר ג׳ושוע בנג'יו (אחד מסנדקי הבינה המלאכותית של ימינו): "הם אמרו לנו שיאטו אם יוכלו. הם יכולים. אבל אל לנו לסמוך על זה". אז האם הייתה כאן אסטרטגיית הפחדה המונית? ואם כן, לאיזו מטרה?
אין ספק שאת התקריות האחרונות יש לקחת ברצינות, אך הן אינן מוכיחות שהמודלים פיתחו תודעה, רצון עצמאי או אינטליגנציה על-אנושית. מה שהם מלמדים הוא, שכאשר בני אדם נותנים לסוכני בינה מלאכותית משימה, כלים וסביבה עם חולשות, הסוכנים מסוגלים, ולעיתים מתעקשים, למצוא דרכים "יעילות" לבצע אותה. למודל שפה אין אג'נדה משלו או תודעה, יש לו מטרה שמישהו הגדיר לו ותמריץ להגיע אליה. ולכן קבוצת אנשים שהתרשלה בבניית מנגנוני בקרה מסוכנת לא פחות מקבוצת אנשים עם כוונת זדון. הראשונה משאירה את הדלת פתוחה. השנייה מחפשת להיכנס בה.
וזה בדיוק מה שאמר ביל גייטס לאחרונה בריאיון ל-NBC: "מעולם לא היה נשק חזק כמו השילוב של אנשים עם כוונות רעות שמשתמשים בכלי ה-AI העדכניים ביותר". בעוד הוא הזהיר מהסכנות שטמונות בבני האדם שמפתחים ומשתמשים במודלי בינה מלאכותית, הציטוט האחר שלו, זה שתפס את הכותרות, היה שהבינה המלאכותית "בהחלט חזקה מספיק כדי להניע אירועים שיגרמו למיליארד מקרי מוות".
1 צפייה בגלריה
אסף הורוביץ - דעות
אסף הורוביץ - דעות
אסף הורוביץ
(צילום: נופר חסון הנדלמן)
ולכותרות האלה יש גם ערך כלכלי, ושתי החברות שהוזכרו כאן מפיקות אותו בכיוונים מנוגדים. סם אלטמן דחה את ההנפקה של OpenAI, שמדוברת בשווי של כטריליון דולר, ל-2027, "בהתחשב בכל מה שקורה בבטיחות". דחייה בשם האחריות נשמעת הרבה יותר טוב מדחייה כי החברה עוד לא מוכנה. Anthropic דווקא ממנפת את הכותרות. היא כנראה הבינה שפחד ציבורי הוא נכס לחברה שרוצה למתג את עצמה כ"אחראית בחבורה". אחרת, מה הסיבה שהיא מכריזה שוב ושוב שהמודלים שלה כל כך חזקים שהם עלולים להיות מסוכנים, ובמקביל, לפי רויטרס, מכוונת להנפקה החל מאמצע אוקטובר? קשה שלא לראות כאן גרסה חדשה של אסטרטגיה ותיקה, "פחד, חוסר ודאות וספק" (FUD) שבה חברות דומיננטיות שימרו את מעמדן מול מתחרות קטנות וקוד פתוח. אלא שהפעם הפחד אינו מופנה רק אל המתחרה, אלא גם אל הטכנולוגיה עצמה. ולכן אם היא מסוכנת כל כך, רק הגדולות וה"אחראיות" ראויות להחזיק בה.
אז מה עושים עם זה? לא עוצרים את הטכנולוגיה, ולא מטילים עליה רגולציה רוחבית שתחנוק דווקא את החברות הצעירות. בונים את הגדר ובודקים אותה: בדיקות עצמאיות למערכות עוצמתיות, שאינן נשענות על האופן שבו החברות מגדירות את הסיכון לעצמן ולא על מבקר שהן בוחרות ומשלמות לו, וכללים ברורים לשימוש בתחומים רגישים. ההסכם מיום שלישי הוא התחלה, לא תחליף. בעוד שביקורת שהמבוקר בוחר - היא ביקורת פנימית עם לוגו חיצוני, היא גם מייצרת שוק למבקרים, ומי שיבנה יכולת בדיקה שאפשר באמת לסמוך עליה, ימצא לקוחות בין החותמים.
וכאן ההזדמנות של ישראל. AI Safety, התחום שעוסק בבדיקה, בבקרה ובעצירה של מערכות AI בזמן אמת, צריך להיות שכבה מובנית באקוסיסטם שנבנה כאן: חברות, מחקר אקדמי ויכולת לאומית עצמאית לבחון מודלים, לצד תעשיית המודלים והיישומים, לא במקומה. מדינה שבנתה תעשייה שלמה על הגנה מפני אנשים עם כוונות רעות יודעת שהאיום מעולם לא היה הטכנולוגיה, אלא מי שמחזיק בה. המרוץ הבא לא יהיה רק על המודל החזק ביותר, אלא על ההגנות שמאפשרות להשתמש בו בבטחה, ועל התעשייה שיודעת לבנות אותן. ושם, למדינה קטנה עם יכולות עמוקות בסייבר ובדיפנס-טק, יש יתרון שאף מודל לא יכול לאמן לעצמו.
וכמו בכל סיום של נולן, כשהמסך מחשיך מתברר שלא הייתה שם מפלצת. היו שם אנשים, החלטות ופרטים שהיו מולנו כל הזמן. השמדת האנושות פשוט הייתה כותרת מעניינת יותר. הסוף עדיין לא נכתב. ואני מהמר שאת הפרומפט האחרון, כמו את הראשון, יכתבו בני אדם. השאלה היא רק אילו.
ד"ר אסף הורוביץ הוא סמנכ"ל בינה מלאכותית ברשות החדשנות