חברות הבינה המלאכותית הבטיחו לנו במשך שנים סוכנים אוטונומיים שיפתרו בעיות מורכבות, ינהלו עבורנו משימות מקצה לקצה ויחליפו צוותי תכנות שלמים. אלא שהבטחות לחוד ומציאות לחוד: OpenAI הודיעה בימים האחרונים על הקפאה ובחינה מחדש של פעילויות פיתוח פנימיות הקשורות ב"אסטרה" (Astra), מודל הסוכנים המתקדם הבא של החברה.
הסיבה? הערכות פנימיות יחד עם בדיקות של מומחים חיצוניים הצביעו על קפיצת מדרגה דרמטית ביכולות התכנות והסייבר ההתקפי של המודל, עד כדי כך שבחברה לא יכולים לשלול כי הוא חצה את הרף שהוגדר כ"קריטי" במדדי הבטיחות הרשמיים.
סם אלטמן מנכ"ל OpenAI
סם אלטמן מנכ"ל OpenAI
סם אלטמן מנכ"ל OpenAI
(צילום: Shelby Tauber/Reuters)

איום אמיתי, או כלי שיווקי?

משמעותו של הרף ה"קריטי", על פי מתווה הבטיחות והמוכנות שהציגה החברה, רחוק מלהיות סמנטי בלבד. מודל שנכנס לקטגוריה הזו מוגדר כבעל יכולת לזהות ולנצל באופן עצמאי לגמרי, ללא תיווך או הנחיה אנושית, פרצות אבטחה חמורות מסוג Zero-Day במערכות מחשוב מוגנות, ואף לתכנן ולהוציא לפועל אסטרטגיות תקיפה מורכבות ומלאות.
אם הדגמים הקודמים של החברה, כמו GPT-5.6 Sol, סווגו בדרגת סיכון "גבוהה", הרי שאסטרה מטפס ישירות למדרגה העליונה של סולם האיומים. כעת, החברה מעבירה את המשך הבדיקות לסביבות ניטור מבודדות לחלוטין (Sandboxes) ללא גישה לרשת החופשית, תוך הפעלת מנגנוני ניטור רציפים אחר שרשרת החשיבה (Chain of Thought) של המודל כדי לאתר חריגות בזמן אמת.
ובעוד הבית הלבן והתעשייה כולה נכנסים לדריכות, נשאלת השאלה האם מדובר באזהרת אמת מפני סוכנים שברחו מהמעבדה, או שמא בעוד מהלך שיווקי שמטרתו להזכיר למשקיעים למי יש את המודל החזק בשכונה.
הצעד של OpenAI מתבצע לאחר שבשבועות האחרונים עלו שלל דיווחים על מקרים שבהם סוכני בינה מלאכותית הצליחו "לברוח" מסביבות הניסוי שלהם. תקרית בולטת שאירעה לאחרונה, שבה סוכן אוטונומי שלה פרץ למערכות של פלטפורמת הלמידה Hugging Face, עוררה דאגה עמוקה בוושינגטון ובאירופה.
גם המתחרות, בהן אנת'רופיק ומטא, דיווחו על אירועים שבהם דגמים ניסיוניים חרגו מההרשאות שהוקצו להם במהלך בדיקות אבטחה. באנת'רופיק, למשל, בחרו לשחרר לאחרונה את המודל "מיתוס" (Mythos) תחת מגבלות אבטחה מחמירות במיוחד, תוך שהם מזהירים מפני מודלים בעלי יכולת שיפור עצמי וקוראים לעצירה מתואמת של האימונים בתעשייה.
מנכ"ל אנתרופיק, דריו אמודיי
מנכ"ל אנתרופיק, דריו אמודיי
מנכ"ל אנת'רופיק, דריו אמודיי
(צילום: Denis Balibouse/Reuters)

נקודת מפנה טכנולוגית

מהזווית הטכנולוגית, מדובר בנקודת מפנה של ממש. אם בתחילת דרכה של המהפכה הסתפקנו במודלי שפה שייצרו טקסט קולח, כתבו שירים והזו מתכונים, הרי שכיום התעשייה נשלטת על ידי אדריכלות של סוכנים (Agentic AI) בעלי יכולת פירוק משימות, זיכרון מתמשך והפעלת כלים חיצוניים.
בעוד גוגל מפתחת פתרונות מקבילים המתמקדים בשילוב עמוק בסביבות עבודה ארגוניות ובתקני תקשורת בין סוכנים, OpenAI מכוונת לאוטונומיה מלאה. אלא שכאשר מעניקים למערכת כזו את היכולת לכתוב קוד, להריץ אותו ולבחון את תוצאותיו בלולאה סגורה, הגבול בין עוזר דיגיטלי שמפתח תוכנה לבין כלי פריצה אוטונומי הופך דומה באופן מסוכן.
עם זאת, קשה להתעלם שימים ספורים בלבד לפני הדיווח על איום הסייבר ה"קריטי", דאגה OpenAI להשוויץ בהישג יוקרתי של אטסרה: פתרון עשר בעיות מתמטיות פתוחות שעמדו ללא מענה במשך עשרות שנים, כולל הוכחות מאומתות על ידי מחשב.
עם זאת, הטקטיקה הזו לא חדשה - מציגים לעולם מודל כה עוצמתי שהוא מסוגל להביס מתמטיקאים דגולים, ומיד לאחר מכן מודיעים בחרדה קיומית שהוא "מסוכן מדי לשחרור", דרך מצוינת לאותת למשקיעים בארצות הברית, באירופה ובסין למי יש את הטכנולוגיה המתקדמת והעוצמתית ביותר בשוק.