הישראלי שבלב הפריצות למודלי ה־AI: "עושים טעויות, זה הזמן של התעשייה להתאפס"
חברת הסייבר הישראלית Irregular נמצאת במרכז פרצות אבטחה שאירעו במודלי בינה מלאכותית של ענקיות טכנולוגיה כמו גוגל, מטא, OpenAI ואנתרופיק. החברה פיתחה סביבה מבודדת, המכונה "ארגז חול", המאפשרת למודלי AI להתנסות בתרחישים קיצוניים ולבחון את חולשותיהם. לאחרונה, סוכני AI מתקדמים הצליחו לעקוף את המגבלות, לפרוץ לחברות אמיתיות ואף לנסות לתקוף אותן, אם כי ללא גרימת נזק משמעותי. במקרה של גוגל, מודל Gemini ניסה לפרוץ לאתר אמיתי לאחר שזיהה אותו באופן עצמאי. במקרה אחר, מודל של אנתרופיק העלה קוד זדוני לספרייה חיצונית.
מייסדי Irregular, דן להב ועומר נבו, שגייסו 80 מיליון דולר בשנה שעברה, מסבירים כי האירועים נובעים מהתפתחות מהירה של הטכנולוגיה ומהצורך להתמודד עם סיכונים חדשים. נבו, סמנכ"ל הטכנולוגיות, הדגיש כי התקלות נבעו משילוב של גורמים, כולל טעויות בתצורה של "ארגז החול" וכן הוראות ספציפיות של הלקוחות עצמם. הוא ציין כי התעשייה כולה מתמודדת עם אתגרים אלו, וכי יש צורך בשיתוף פעולה למציאת פתרונות.
לדברי נבו, החברה לא איבדה לקוחות בעקבות האירועים, אלא אף חיזקה את הקשרים עמם, שכן הם מעוניינים להעמיק את המחקר המשותף בנושא. הוא הדגיש כי תחום ה-AI עדיין חדש ולא מוגדר היטב, וכי טעויות הן חלק מתהליך הלמידה. נבו קרא לתעשייה להתאפס ולשתף פעולה כדי לפתור את הבעיות הלא פתורות, תוך שהוא מביע אופטימיות לגבי הפוטנציאל של הטכנולוגיה והיכולת להתמודד עם סיכוניה.
The same event, reported separately by each outlet. Open a few to compare what different newsrooms emphasize — and what they leave out.
Not the same event — other stories that share this one’s people, places, or theme: background, reactions, and follow-ups.