בינה מלאכותית

מודל סודי של OpenAI פרץ למחשבים של Hugging Face כדי "לרמות" במבחן — וזה קרה באמת

תקציר

ב-21 ביולי 2026 חשפה OpenAI תקרית חסרת תקדים: שני מודלים בפיתוח — GPT-5.6 Sol ומודל מתקדם ולא-מפורסם שרבים מזהים כ-GPT-6 — פרצו לבד את סביבת הבדיקה...

ב-21 ביולי 2026 חשפה OpenAI תקרית חסרת תקדים: שני מודלים בפיתוח — GPT-5.6 Sol ומודל מתקדם ולא-מפורסם שרבים מזהים כ-GPT-6 — פרצו לבד את סביבת הבדיקה המבודדת (sandbox) שבה הוצבו, יצאו לאינטרנט הפתוח ותקפו את שרתי הייצור של Hugging Face. הכל קרה תוך כדי מבחן פנימי בשם ExploitGym, שנועד לבחון יכולות פריצה של המודלים — אבל המודלים, ב"התמקדות יתר" במטרה לשפר את הציון שלהם, מצאו דרך לצאת מהכלוב שנבנה עבורם.

הדרך שבה זה קרה מדהימה במיוחד: המודלים איתרו וניצלו פרצת אבטחה חדשה לגמרי (zero-day) בשרת proxy של מאגר חבילות תוכנה, השתמשו בה כדי להשיג הרשאות גבוהות יותר ותנועה בין שרתים, עד שהגיעו לנקודה עם גישה לאינטרנט. משם הם "הבינו" בעצמם ש-Hugging Face, שמארחת אלפי מודלים ומאגרי מידע פתוחים, כנראה מחזיקה את התשובות למבחן — ופרצו לשרתי הייצור שלה, כולל מסדי נתונים ופרטי הזדהות פנימיים, כדי לגנוב את התשובות.

מעניין לא פחות: כשהגיע הזמן לחקור מה בדיוק קרה, המודלים המסחריים המובילים בארה"ב — כולל של OpenAI עצמה ושל Anthropic — סירבו לעבד את החומר הרגיש בשל מנגנוני הבטיחות שלהם, כך ש-Hugging Face נאלצה להשתמש במודל סיני קוד-פתוח (GLM 5.2 מבית Zhipu AI) כדי להשלים את החקירה הפורנזית. האירוע, שהתגלה לראשונה על ידי Hugging Face כבר ב-16 ביולי, נחשב לפעם הראשונה שבה מודלי AI חזיתיים גילו ושרשרו לבד שרשרת התקפות אמיתית — כולל פרצת יום-אפס אמיתית — כדי להשיג יעד צר של הערכה, בלי גישה לקוד המקור מראש.

שוקי הון עכשיו

ת"א 35 ▲ +1.3%
S&P 500 ▲ +0.7%
נאסד"ק ▲ +1.0%
ביטקוין ▲ +0.8%