ההודאה מגיעה על רקע החשש הגובר מהיכולת של מערכות AI מתקדמות לפרוץ לתשתיות דיגיטליות, ובמיוחד מהאפשרות שסוכנים אוטונומיים יצליחו לעקוף את אמצעי ההגנה שהציבו בני אדם. OpenAI הזהירה כי היא צופה שאירועים מסוג זה יהפכו ל"נפוצים יותר, ככל שיופצו מודלים בעלי יכולות סייבר מתקדמות יותר".
לפי OpenAI, באירוע היו מעורבים כמה מהמודלים שלה, בהם GPT-5.6 Sol, ששוחרר בתחילת החודש, וכן מודל מתקדם יותר שנבדק לקראת השקתו. "אנו רואים באירוע הזה תקרית סייבר חסרת תקדים, הכוללת יכולות סייבר מהמתקדמות בעולם, ופועלים בהתאם", מסרה OpenAI בפוסט שפרסמה.
לדבריו, החברה עבדה במהלך היממה האחרונה בצמוד ל-OpenAI. "אנחנו מאמינים שלא הייתה מצדם כל כוונת זדון. מדהים לחשוב שכל זה קרה באופן אוטונומי", הוסיף.
OpenAI החלישה במכוון חלק ממנגנוני ההגנה בתחום הסייבר כדי לבחון את יכולותיהם של שני המודלים בסביבת ניסוי. עם זאת, הסוכנים פעלו בתוך "ארגז חול" – מערכת שנועדה להגביל אותם ולמנוע מהם גישה לאינטרנט. המודלים קיבלו הוראה לנסות לבצע פריצות כדי לבחון את יכולות הסייבר שלהם. לפי OpenAI, הם השקיעו כוח מחשוב רב בניסיון למצוא דרך להתחבר לאינטרנט הפתוח.