באירופה בלבד, בינתיים: OpenAI תסמן טקסטים שנוצרו ב-ChatGPT
נקודות עיקריות.כלכליסט AI
- חברת OpenAI תוסיף חתימות מים בלתי נראות לטקסטים המג'ונרטים באיחוד האירופי בהתאם לדרישות חוק ה-AI החדש.
- טכנולוגיית textGrain מוסיפה אות סטטיסטי לבחירת המילים של המודל, המאפשר לכלי זיהוי ייעודיים לזהות תוכן שנוצר על ידי בינה מלאכותית.
- יעילות הסימון מוגבלת בטקסטים קצרים, בתכנים מתמטיים או לאחר עריכה ידנית הכוללת החלפת מילים נרדפות.
OpenAI תוסיף חתימות מים בלתי נראות לטקסטים שהמודלים שלה מג'נרטים בעבור משתמשים באיחוד האירופי – כך הודיעה החברה אתמול (ב'). המהלך עשוי להתרחב בהמשך למדינות נוספות, אך כרגע אין אינדיקציה לכך.
חברת ה-AI מבצעת את המהלך בהתאם לדרישות חוק ה-AI של האיחוד, שמחייב לזהות בבירור תכנים שנוצרו על ידי מודלים. חתימות המים יצורפו לטקסטים של ChatGPT ו-Codex (כלי התכנות של החברה) באיחוד האירופי בשבועות הקרובים כברירת מחדל. לקוחות API בכל העולם יוכלו לבחור האם להפעיל את הפיצ'ר.
לדברי OpenAI, טכנולגיית הסימון שלה, שמכונה textGrain, עובדת באמצעות הוספת אות סטטיסטי בלתי-נראה לבחירת המילים של המודל. "כלי הזיהוי שלנו מחפש את האות הזה כדי להעריך האם פסקה כוללת חתימת מים של OpenAI", הסבירה החברה בהודעה שפרסמה. "בבדיקות שלנו, textGrain סיפקה ביצועים זהים או טובים יותר מאלו של גישות אחרות שבחנו".
עם זאת, בחברה מסייגים תרחישים שונים בשטח שיכולים לפגוע ביעילות של המודל, ולהוביל לזיהוי שווא של טקסט אנושי כטקסט AI (חיובי כוזב), או להחמצת זיהוי של טקסט ככזה שנוצר על ידי AI (שלילי כוזב). הראשון, טקסט קצר קשה יותר לזיהוי. "עם יעד שלילי כוזב של 1%, המאתרים שלנו זיהו חתימת מים ב-80% מהפסקאות של 200 טוקנים (יחידת מידה לתפוקה של מודל AI, ע"כ), לעומת 95% מהפסקאות של 400 טוקנים, בתכנים כמו פסיכולוגיה. שיעורי הזיהוי היו נמוכים משמעותית בתכנים כמו מתמטיקה, שם בחירת המילים פחות גמישה".
שנית, עריכת טקסט יכולה להחליש את חתימה המים. "בהערכה של פסקת של 400 טוקנים, החלפת 10% מהמילים במילים נרדפות הפחיתה את שיעורי הזיהוי מ-92% ל-66%. החלפת 25% מהמילים הפחיתה אותם ל-17%", הסבירה החברה. "מגבלות אלו תרמו להחלטתנו לספק גישה ראשונית לכלי הזיהוי רק לחוקרים ולארגונים מאושרים, שיכולים לסייע לנו להעריך את האמינות ושימושים אחראיים. טכנולוגיות לסימון וזיהוי טקסטים של AI עדיין נמצאות בשלבים מוקדמים, והדעות לגבי התועלות והאחריות שלהן מתפתחות".
המהלך של OpenAI מתבצע כחודשיים לאחר מהלך דומה של אנתרופיק, שגם הוא בוצע במענה לחוק ה-AI של האיחוד (אם כי במקרה זה ההשקה היתה גלובלית). הסימון שלה עובד בדומה לזה של OpenAI, על ידי בחירת מילים סטטיסטית שמאפשרת לזהות רצף של מילים ככזה שנבחרו על ידי קלוד לצורך חתימת המים.































