המהלך שיגרום לכם לחשוב פעמיים לפני שתשתמשו בבינה המלאכותית
הידיעה ב-5 שורות · תקציר של baba
- OpenAI מטמיעה "סימני מים" בלתי נראים בטקסטים מ-ChatGPT ו-Codex.
- המהלך נועד לאפשר זיהוי ממוחשב של תכנים סינתטיים, בהתאם לחוק האיחוד האירופי.
- הטכנולוגיה textGrain אינה פוגעת באיכות הטקסט אך יעילותה מוגבלת.
- עריכה אנושית מפחיתה משמעותית את יכולת הזיהוי של סימני המים.
- הגלאי לא ייפתח לציבור הרחב בשלב זה, והטמעתו תתחיל באירופה בלבד.
חברת OpenAI החלה להטמיע מנגנון "סימני מים" דיגיטליים ובלתי נראים בטקסטים המופקים על ידי ChatGPT ו-Codex, בהתאם לדרישות חוק הבינה המלאכותית של האיחוד האירופי (EU AI Act). הטכנולוגיה, המכונה textGrain, שותלת אותות סטטיסטיים המבוססים על מפתח סודי, המשפיעים על בחירת המילים של המודל ויוצרים חתימה ייחודית המאפשרת זיהוי ממוחשב של תכנים סינתטיים.
המנגנון החדש פועל באופן סמוי ואינו משפיע על מבנה המשפט או איכות התוכן. מבחנים שערכה OpenAI על מודל GPT-6 Astra הראו כי הטמעת textGrain אינה פוגעת בביצועים במשימות מורכבות בתחומי תכנות, אוטומציה ארגונית, רפואה ומתמטיקה. עם זאת, ב-OpenAI מודים כי ליעילות הזיהוי יש מגבלות, והיא תלויה באורך הטקסט ובגמישות השפתית. לדוגמה, בתחומי הפסיכולוגיה יעילות הזיהוי עומדת על 95% בפסקאות ארוכות, אך יורדת ל-80% בפסקאות קצרות. בתחומים כמו מתמטיקה, בהם יש פחות חופש בבחירת מילים, הזיהוי נמוך יותר.
עריכה אנושית של הטקסט, כמו החלפת מילים נרדפות, מפחיתה משמעותית את יכולת הזיהוי. החלפה של 10% מהמילים הורידה את רמת הזיהוי מ-92% ל-66%, והחלפה של רבע מהמילים הורידה את היכולת ל-17%. בשל הסיכון לזיהוי שגוי של טקסטים אנושיים כטקסט AI, OpenAI לא תפתח את הגלאי לציבור הרחב בשלב זה, אלא תעניק גישה מבוקרת לחוקרים ולארגוני בדיקה מוסמכים.
ב-OpenAI יאפשרו לחברות צד-שלישי המשתמשות במנועי החברה להטביע את סימני המים בממשק ה-API שלהן על בסיס בחירה (Opt-in), כדי לעמוד בדרישות החוק האירופי. נכון לעכשיו, הטמעת סימני המים תופעל בשבועות הקרובים רק עבור משתמשים במדינות האיחוד האירופי. עבור משתמשים בישראל, הטקסטים המופקים באפליקציה אינם כוללים את החותמת בשלב זה, אך אימוץ התקן באירופה עשוי לסמן מגמה עולמית של רגולציה ושקיפות שעשויה לחלחל בעתיד גם לישראל.