סגור
באנר דסקטופ כלכליסט טק
אפליקציית ג'מיני של גוגל
אפליקציית ג'מיני של גוגל (צילום: mundissima/shutterstock)

תחזור להובלה? גוגל השיקה מודל חדש של ג'מיני - אך רק לשותפים נבחרים

נקודות עיקריות.כלכליסט AI
  • גוגל השיקה את Gemini 4 Argon, מודל בינה מלאכותית עוצמתי המיועד למשימות מורכבות בדגש על יכולות מתקדמות בתחום אבטחת הסייבר.
  • המודל החדש מציג תקרת פלט חסרת תקדים של מיליון טוקנים, המאפשרת רצף עבודה ארוך משמעותית בהשוואה למודלים המתחרים בשוק.
  • בשלב זה הגישה למודל מוגבלת למומחי סייבר ולממשל הארה"ב, על רקע דיווחים סותרים בנוגע ליעילותו במשימות תכנות יומיומיות.
גוגל השיקה אמש (ד') את ג'מיני 4 ארגון (Gemini 4 Argon), הדור החדש של מודל הבינה המלאכותית שלה, שאותו היא מציגה כמודל החזק והמתקדם ביותר שפיתחה עד כה. המודל מיועד לביצוע משימות מורכבות בתחומים כמו תכנות, מחקר וכתיבה, אך בחברה מדגישים במיוחד את יכולותיו בתחום אבטחת הסייבר. בשלב הראשון הגישה אליו מוגבלת לקבוצה נבחרת של מומחי וארגוני סייבר במסגרת תוכנית Fairwind של החברה. במקביל, גוגל מאפשרת גם לממשל האמריקאי לקבל גישה מוקדמת למודל במסגרת תוכנית וולונטרית לבחינת מודלי AI מתקדמים לפני הפצתם הרחבה.
לפי גוגל, Argon השיג תוצאות גבוהות בשורה של מבחני ביצועים בתחומי התכנות, הפיננסים, המשפטים ואבטחת הסייבר. בין היתר הוא הגיע למקום הראשון במדד של Vals, שמנסה למדוד ביצועים של מודלים במשימות מקצועיות, ולציון של 77.9% ב-DeepSWE, מבחן למשימות הנדסת תוכנה ארוכות ומורכבות.
אחת הבשורות הגדולות של המודל החדש היא שתקרת הפלט שלו עומדת על מיליון טוקנים. טוקן הוא יחידת הטקסט הבסיסית שבה מודל AI קורא וכותב - בדרך כלל מילה, חלק ממילה או סימן. המשמעות אינה שהצ'טבוט צפוי להתחיל לענות למשתמש רגיל במאות אלפי מילים, אלא שהוא יכול להמשיך לעבוד זמן רב הרבה יותר במהלך משימה אחת בלי להגיע לתקרה שמאלצת אותו לעצור. לשם השוואה, המתחרות OpenAI ואנתרופיק מגבילות את הפלט המרבי במודלי הדגל שלהן ל-128 אלף טוקנים.
אלא שמאחורי ההכרזה החגיגית מסתתרת תמונה מורכבת יותר. לפי דיווח בבלומברג, בקרב חלק מעובדי גוגל שקיבלו גישה ישירה למודל קיימת ספקנות בנוגע לביצועיו בפועל. מקורות בעלי גישה למודל אמרו כי אף שהוא משיג תוצאות גבוהות במבחנים המקובלים בתעשייה, בחלק ממשימות התכנות היומיומיות התוצאות פחות מרשימות. גוגל דחתה טענה זו וטוענת כי שיפרה את המבחנים הפנימיים שלה, כך שהם מספקים תמונת מצב אמיתית לגבי איכות המודל. בכל מקרה, בשלב זה לא ניתן לבדוק טענה זו מאחר שכאמור המודל זמין רק לקבוצה מצומצמת של ארגונים. גל נגלי, בכיר בוויז (שנרכשה ע"י גוגל), כתב בפוסט ב-X כי מדובר ב"מודל נהדר למשימות אבטחת סייבר".
גוגל מסבירה את הבחירה לפתוח את המודל רק לקבוצה מצומצמת של ארגונים בכך שיכולות הסייבר של המודל הגיעו לרמה שבה הוא מסוגל לאתר באופן אוטונומי חולשות תוכנה קריטיות, לוודא שהן ניתנות לניצול ואף לייצר עבורן תיקון. במובן הזה גוגל הולכת בדרך שכבר אימצו שתי המתחרות המרכזיות שלה: אנתרופיק מגבילה את הגישה לקלוד מיתוס 5.1, המודל המתקדם שלה למשימות סייבר וביולוגיה, לקבוצה של ארגונים שנבדקו מראש במסגרת פרויקט גלאסווינג (Project Glasswing); וגם OpenAI בחרה להגביל את מודל הסייבר הייעודי שלה רק לשותפים נבחרים במסגרת תוכנית Daybreak Red.
ומה לגבי המחיר? עם פתיחת המודל ללקוחות API הוא יוצע במחיר היכרות של 2 דולר למיליון טוקנים של קלט ו-10 דולר למיליון טוקנים של פלט. לאחר תקופת ההיכרות מתכננת גוגל לתמחר את המודל ב־4 דולר למיליון טוקנים של קלט וב־20 דולר למיליון טוקנים של פלט. בכך יהיה מחירו זהה לזה של Claude Opus 5.5, כפול מזה של GPT-6.1 Sol, אך נמוך ב־60% ממחירם של GPT-6 Astra ושל Claude Fable 5.1.
עבור גוגל, ההשקה היא גם פרק נוסף בניסיון להחזיר לעצמה את ההובלה בתחום. בשנה שעברה, עם השקת ג'מיני 3, היא מיצבה את עצמה בקדמת המרוץ, אך מאז לא רשמה השקה משמעותית, ונראה כי היא מדדה מאחורי המתחרות. אם הנתונים שגוגל פרסמה יתורגמו גם לביצועים בעולם האמיתי, היא עשויה להחזיר לעצמה את הבכורה.