ימים ספורים לאחר שענקית הבינה המלאכותית OpenAI הודתה שכמה מדגמי ה-AI שלה "ברחו" מסביבת בדיקה סגורה ויצאו למתקפות סייבר על חברות אחרות – גם ענקית AI אחרת, אנת'רופיק, הודתה בסוף השבוע כי כמה ממודלי הבינה המלאכותית המתקדמים שלה "יצאו מסביבה מבודדת של בדיקות צד שלישי", ניגשו לאינטרנט הפתוח "וקיבלו גישה עצמאית" (כלומר פרצו) למערכות של שלושה ארגונים אחרים.
עוד כותרות:
אנת'רופיק: "אי הבנה"
לפי אנת'רופיק, מדובר בשלושה אירועים נפרדים שהתרחשו מאז חודש אפריל. החברה הבהירה כי באף אחד מהמצבים הללו, המודלים שלה לא "יצאו מעצמם או ניסו בכוונה לברוח מסביבת הניסוי"; לדבריה, הסיבה ליציאתם מסביבת הבדיקה המבוקרת היא "אי הבנה" בין החברה לבין אחד ממשתתפי הבדיקות שלה: טעות אנוש גרמה לכך, שסביבת הבדיקות נותרה מחוברת לאינטרנט.
אנת'רופיק טוענת, כי גילתה את הפעילות המסוכנת של המודלים שלה במהלך אלפי ניסויים שביצעה להערכת יכולות הסייבר של הטכנולוגיה המתקדמת. הניסויים הללו הפכו חשובים במיוחד לאור גילויי OpenAI בשבוע שעבר, לפיהם שניים מדגמי ה-AI החזקים ביותר שלה יצאו משליטה, "ברחו" מסביבת בדיקה ופרצו למספר חברות, כולל פלטפורמת הבינה המלאכותית Hugging Face ופלטפורמת הענן Modal Labs.
לפי אנת'רופיק, בתקריות היו מעורבים מודל מחקר פנימי, וגם המודלים אופוס 4.7 ומיתוס 5. מיתוס 5, הנחשב לעוצמתי ביותר, הופץ רק בחודש שעבר לקהל מצומצם ביותר של חברות טכנולוגיה וחוקרי סייבר, מה שידוע גם כ"פרויקט גלאסווינג".
לעומת OpenAI, אנת'רופיק לא ציינה אלו חברות נפרצו על-ידי הדגמים שלה, אך אמרה כי שלושתן קיבלו הודעה על כך. עוד נודע, כי אף שהחברה ציינה בהנחיות שלה למודלים כי לסביבת הבדיקה אין גישה לאינטרנט, התברר שהמצב שונה לחלוטין.
כחלק מהבדיקות, המודלים התבקשו - נסיונית - "לפרוץ ולשחזר" פריט "מידע סודי" המאוחסן במכונה אחרת ברשת הבדיקות. מדובר בתרגיל מוכר בחברות סייבר, הידוע גם כאתגר "לכידת הדגל".
לפי אנת'רופיק, המודלים הצליחו לגשת לאינטרנט כדי לפגוע בארגונים מחוץ לסביבת הבדיקה באמצעות "טכניקות בסיסיות", כולל עקיפת סיסמאות חלשות. "החברה לא מצאה או ניצלה חולשות מורכבות, ובכל מקרה, המערכת המשיכה לעבוד כדי להשלים רק את משימת 'לכידת הדגל' הספציפית שהוטלה עליה".
המחוקקים רוצים "מתג כיבוי" ל-AI
הפרסום של אנת'רופיק מצטרף לתגובות הנרחבות שעוררה התקרית ב-OpenAI. זו גררה קריאות נזעמות בארה"ב לרגולציות מחמירות יותר בתחום הבינה המלאכותית ולהאטה בפיתוח הבינה המלאכותית.
בין השאר, הסנטורים טד ליו (דמוקרטי מקליפורניה) ונייתניאל מורן (רפובליקני מטקסס) הציעו "חוק מתג השמדה" לבינה המלאכותית, שיקנה למשרד לביטחון המולדת את הסמכות להורות על כיבוי מודלים של בינה מלאכותית שנחשבים למסוכנים מדי.
במקביל, הסנאטור מארק וורנר (דמוקרטי מווירג'יניה) הציג בשבוע שעבר סדרת חוקים בתחום הבינה המלאכותית, כולל הצעת חוק שתחייב חברות בינה מלאכותית להגיש את המודלים שלהן לממשלה הפדרלית לצורך בדיקות ביטחון לאומיות לפני שחרורן לציבור.





