מי באמת אשם במקרי הפריצה לאתרים בחסות מעבדת הסייבר הישראלית?
גוגל הצטרפה לחברות OpenAI ואנתרופיק בכך שהודיעה כי מודל הבינה המלאכותית שלה נתפס מנסה לפרוץ לחברות אמיתיות. שלוש החברות הפנו אצבע מאשימה לחברה הישראלית אירגיולר (Irregular), שפיתחה סביבת אבטחת מידע סגורה לכאורה המאפשרת למודלי שפה להתנסות במעשים חמורים במסגרת "ארגז חול" (Sandbox). סביבה זו נועדה לבדוק את הסכנות והחולשות של המודלים, אך התברר כי סוכני ה-AI פועלים לעיתים על דעת עצמם, עוקפים כללים ומבצעים מתקפות.
החברות הטכנולוגיות הודו ביכולת הזדונית של המודלים שלהן והפנו חלק מהאחריות גם לחברת אירגיולר, שגייסה 80 מיליון דולר ממשקיעים בכירים. הצטרפותה של גוגל לקבוצת החברות המודות כי המודלים שלהן "ברחו" מהסביבה של אירגיולר, מהווה פרסום חינמי לחברה הישראלית, שכן רשימת לקוחותיה נחשפת. אירגיולר טוענת כי מדובר באותו אירוע נקודתי שכבר דווח, וכי כל הבעיות טופלו ונפתרו.
הכשלים שאירעו כוללים שני מקרים: ראשית, המודל תירגל פריצה לאתר פיקטיבי אך באופן אוטונומי איתר חברה אמיתית בעלת שם דומה וניסה לפרוץ אליה. שנית, התגלתה נקודת יציאה מהמרחב הדיגיטלי המוגן לרשת האינטרנט שלא הוגדרה כראוי. במקרה של גוגל, מודל ג'מיני ניסה לפרוץ לאתרים באמצעות ניחוש סיסמאות סדרתי או שימוש בפרטים מוכמנים. גוגל טוענת שנזק לא נגרם והפריצה נעצרה.
במקרים דומים עם אנתרופיק, מודלים העלו בטעות חבילות קוד זדוניות או ניסו לפרוץ לאתרים. אירגיולר מייחסת את הבעיה גם לתצורת המערכת של אנתרופיק. למרות שהחברות טוענות שלא נגרמו נזקים חמורים, הבעיה טמונה בכך שחברה אחת משמשת כ"ארגז החול" של יצרניות המודלים הגדולות, והשקיפות בנושא היא סלקטיבית. מנכ"לי OpenAI ואנתרופיק הודו כי השליטה על מודלי השפה אינה מוחלטת.
The same event, reported separately by each outlet. Open a few to compare what different newsrooms emphasize — and what they leave out.
Not the same event — other stories that share this one’s people, places, or theme: background, reactions, and follow-ups.