ענקית הטכנולוגיה גוגל אישרה לראשונה כי מודל הבינה המלאכותית שלה, ג'מיני (Gemini), פרץ למערכות האבטחה של שלוש חברות בחודש מאי האחרון. הגילוי מגיע בעקבות דיווחים על פריצות דומות שביצעו לאחרונה המודלים של OpenAI ואנתרופיק, ומגביר את החששות הגוברים בעולם הטכנולוגיה ובמערכת הפוליטית בארה"ב מפני אובדן שליטה על מערכות בינה מלאכותית מתקדמות.
האירוע התרחש במהלך הערכת אבטחת סייבר שביצעה חברת Irregular הישראלית, המתמחה בבחינת עמידותם של מודלי AI חזקים. לפי דיווח ב"וול סטריט ג'ורנל", הבדיקה הייתה אמורה להתנהל בסביבה סגורה ומבודדת מרשת האינטרנט, כשהמודל מתרגל פריצה לחברות פיקטיביות בלבד. אולם, עקב תקלה, החיבור לרשת הופעל בשוגג, והמודל החל לפעול מול חברות אמיתיות בשטח.
מנכ"ל גוגל, סונדאר פיצ'אי, מציג את השדרוגים של ג'מיני בכנס המפתחים של החברה השנה
מנכ"ל גוגל, סונדאר פיצ'אי, מציג את השדרוגים של ג'מיני בכנס המפתחים של החברה השנה
מנכ"ל גוגל, סונדאר פיצ'אי, מציג את השדרוגים של ג'מיני בכנס המפתחים של החברה
(רויטרס)

ניחש סיסמה, ופרץ

מפרטי המקרים עולה כי באחד המבחנים התבקש ג'מיני לחלץ מידע מתוכנה של חברה פיקטיבית, שנשאה שם זהה לחברה קיימת. ברגע שהתחבר לרשת, המודל ניחש בהצלחה את הסיסמה ופרץ לשירות של החברה האמיתית. בשני מקרים נוספים, המודל סרק את הרשת, איתר מאגרים ציבוריים שכללו פרטי גישה, והשתמש בהם כדי לחדור למערכות של חברות אמיתיות.
חברת Irregular, שביצעה בדיקות סייבר גם עבור OpenAI ואנת'רופיק ועמדה במרכזם של אירועים נפרדים שבהם מודלי AI הצליחו לצאת מסביבות בדיקה ולגשת למערכות אמיתיות, חשפה את הממצאים בפני גוגל בסוף חודש יולי. בניגוד ל-OpenAI ולאנת'רופיק, שבחרו לדווח לציבור מרצונן על אירועים דומים, בגוגל החליטו שלא לצאת בגילוי פומבי - בטענה שלא נגרם נזק ושאין צורך בכך. עם זאת, בחברה ציינו כי דאגו ליידע את שלוש החברות שנפרצו.
"בבדיקה שגרתית, המודל מצא מידע פומבי ברשת וניחש פרטי גישה לאתרים שחשב שהם חלק מהמבחן", מסרה הת'ר אדקינס, סגנית נשיא להנדסת אבטחה בגוגל. "בשלושת המקרים הללו, המודל עצר. אירועים אלו מדגישים את החשיבות של אימון מודלי בינה מלאכותית חזקים לפעול באחריות".
מחברת Irregular נמסר ל"וול סטריט ג'ורנל": "מדובר באותו אירוע נקודתי שכבר דווח בעבר, ולא בתקרית נפרדת באופן מהותי. כל מעבדות המחקר הרלוונטיות עודכנו בסוף יולי, והגורמים שנפגעו קיבלו הודעה במסגרת החקירה. כפי שכבר ציינו, Irregular פעלה באופן מיידי, וכל הבעיות הידועות לנו בצד שלנו טופלו ונפתרו כבר לפני מספר שבועות".
החשיפה מעוררת סערה בוושינגטון. הסנאטור ברני סנדרס דרש מחברות הטכנולוגיה להקפיא מיידית את פיתוח המודלים המתקדמים, בטענה כי האירועים מוכיחים שהחברות אינן מסוגלות עוד לשלוט בטכנולוגיה שהן מייצרות. הלחץ הציבורי והפוליטי כבר מוליד צעדים בשטח: חברת OpenAI הודיעה על הקפאת פיתוח המודלים שלה למשך שבועיים, ואילו מנכ"ל אנת'רופיק, דריו אמודיי, קרא להאטה קולקטיבית ומתוכננת של פיתוח ה-AI בתעשייה כדי להבטיח שילוב מנגנוני הגנה מספקים.