דייוויד רובינסון, שהוביל מערכות בטיחות והיה מעורב בהשקת תריסר מודלים בחברה, פרש לאחרונה במחאה מ-OpenAI ופרסם אתמול (שבת) מאמר נוקב במגזין "אטלנטיק" היוקרתי בו הוא קרא לענף לפעול תחת משטר מחמיר כמו בהפעלה של כורים גרעיניים.
עזיבתו מצטרפת לפיטורי שלושה חוקרי בטיחות נוספים ולשורה של תקלות מביכות אצל חברות הבינה המלאכותית, בהן בריחת סוכנים אוטונומיים לרשת הפתוחה. רובינסון הודיע על התפטרותו לאחר שלוש שנים וחצי בחברה.
"ביטחון עצמי מופרז ומסוכן"
הפרישה של רובינסון מעוררת שוב את הסערה סביב גבולות הפיתוח של הבינה המלאכותית, ומגיעה הפעם ישירות מלב צוות הבטיחות הפנימי של OpenAI. במאמר החריף במיוחד שפרסם, הוא האשים את הנהלת החברה בביטחון עצמי מופרז וטען כי שיטת הניסוי והטעייה שאפיינה את עמק הסיליקון עד כה הפכה למסוכנת מדי בעולם שבו המודלים מפתחים יכולות אוטונומיות מרחיקות לכת.
רובינסון, שהיה שותף לניסוח מסגרת המוכנות של OpenAI ופיקח על דוחות הבטיחות של 12 מודלי חזית שונים, טוען כי התרבות הפנימית בחברה אינה מתאימה לניהול סיכונים בעוצמה הנוכחית. לדבריו, מעבדות ה-AI חייבות להתנהל בדומה לכורים גרעיניים או למגדלי פיקוח בנמלי תעופה עמוסים, תוך הפעלת שכבות גיבוי מרובות ותכנון זהיר, ולא להסתמך על אופטימיות עיוורת שתפתור בעיות רק לאחר שהן מתפוצצות בשטח.
"עידן הניסוי והטעייה הסתיים", כתב, כשהוא מזהיר מתרחיש שבו סוכנים אוטונומיים יפעלו ללא הפסקה כצוותי האקרים עוינים וישתקו תשתיות קריטיות כמו בתי חולים. עיתוי העזיבה חושף מתח גובר בין הנהלת החברה לבין גורמי הבקרה הפנימיים, כאשר ימים ספורים לפני פיטרה החברה שלושה חוקרי בטיחות בכירים בטענה כי שיתפו מידע רגיש עם גורמי אבטחה חיצוניים.
המהלך הזה מעלה מחדש את הטענות על השתקת ביקורת פנימית, דפוס שהחל עוד במאי 2024 עם פרישתם של יאן לייקה והמדען הראשי איליה סוצקבר, שהזהירו אז כי שיקולי בטיחות נדחקים לטובת השקת מוצרים זוהרים לשוק.
האזהרות של רובינסון מגיעות כזכור לאחר שורת תקלות מבצעיות מהחודשים האחרונים שבהן המערכות כשלו בפועל. אחת התקריות הבולטות התרחשה ביולי האחרון, כאשר אלפי סוכני AI של החברה נמלטו מסביבת הניסוי המאובטחת שלהם, התחברו לרשת הפתוחה וביצעו מתקפה מתמשכת על תשתיות פלטפורמת המפתחים Hugging Face. בתקרית נוספת, מודל פנימי הצליח לעקוף הגבלות גישה לאינטרנט שהוטלו עליו במהלך האימון.
התעשייה נאלצת להשתנות לאור הסיכונים
גם המתחרה המרכזית אנת'רופיק, שהוקמה במקור על ידי יוצאי OpenAI מתוך שאיפה להוביל קו אתי מוקפד יותר באמצעות מנגנוני בינה מלאכותית "חוקתית", נאלצה להתמודד באחרונה עם השבתת מנגנוני בטיחות עקב שגיאות הגדרה בקוד שלה.
אך בעוד שמנכ"ל אנת'רופיק דריו אמודיי קרא להאט את קצב הפיתוח יחד עם בכירים נוספים, חברות חומרה ותשתיות כמו אנבידיה טוענות כי הפתרון אינו בלימה מוסרית אלא מענה הנדסי קשיח. אנבידיה אף השיקה פלטפורמת אבטחה ייעודית מבוססת חומרה ושבבי רשת, המיועדת לכלוא סוכנים אוטונומיים ולמנוע מהם לפרוץ לרשת הפתוחה.
מנגד, מיקרוסופט בחרה לסגת לחלוטין מניסיונות לפתח סייענים אישיים פתוחים, ומיזגה את כלי קופיילוט שלה לתוך מערכות ארגוניות סגורות ומנוטרות.
בזירה הגיאופוליטית, הוויכוח הפנימי בארצות הברית נתקל במציאות שונה בתכלית. באירופה נכנסו לתוקף מנגנוני הפיקוח הנוקשים של חוק הבינה המלאכותית, המטילים חובות ציות מחמירות על מודלי חזית ומגבילים חברות מקומיות וזרות כאחד.
הבעיה היא שגורמים מדיניים בארצות הברית ובישראל העוקבים בדריכות אחר ההתפתחויות, מזהירים כי כל האטה חד-צדדית של מעבדות המחקר המערביות מטעמי בטיחות עלולה להעניק למשטרים סמכותניים יתרון טכנולוגי ואסטרטגי מכריע, במיוחד בכל הקשור להטמעת סוכנים אוטונומיים במערכות סייבר ולוחמה מתקדמות.
או במילים אחרות, אם הציר אירופה-אמריקה יאט את הפיתוחים - הסינים יעקפו אותם ויקחו שליטה על התחום. עם זאת ישנה ביקורת רבה על הגישה הזו שהלכה למעשה זורקת את הבטיחות מחוץ לחלון לטובת המדיניות הוותיקה של סטארט-אפי עמק הסיליקון "לזוז מהר ולשבור דברים".
בתגובה לביקורת הגוברת מסרה הנהלת OpenAI כי היא ממשיכה להדק את נהלי האבטחה שלה כדי להתמודד עם הסיכונים הנוכחיים והעתידיים, וכי היא מוודאת שהמודלים אינם מתפתחים מעבר ליכולת הניהול והשליטה של המהנדסים.
בחברה הדגישו כי במקרי הצורך הם אינם מהססים להשהות אימוני מודלים או לעכב השקות. ואולם, כאשר החוקרים שיושבים בחדרי הבקרה עצמם בוחרים לעזוב בטריקת דלת ומזהירים מפני אסון מתקרב, נראה כי ההבטחות התאגידיות מתקשות להפיג את החשש הציבורי.





