בינה מלאכותית

המרוץ בין OpenAI ל-Anthropic מגיע לממשלות: מה הופך את הדגמים הבאים למסוכנים כל כך

המרוץ בין OpenAI ל-Anthropic מגיע לממשלות: מה הופך את הדגמים הבאים למסוכנים כל כך
תקציר

מאחורי הקלעים מתחמם מרוץ חימוש בין שתי החברות המובילות בבינה מלאכותית. OpenAI מכינה דגם בשם קוד Spud (המשוער כגרסת GPT-5.5, האימון המלא הראשון מאז...

מאחורי הקלעים מתחמם מרוץ חימוש בין שתי החברות המובילות בבינה מלאכותית. OpenAI מכינה דגם בשם קוד Spud (המשוער כגרסת GPT-5.5, האימון המלא הראשון מאז GPT-4.5) שנועד להתמודד ישירות מול הדגם החדש של Anthropic, המכונה Mythos — דגם שהחברה מגדירה כ"קפיצת מדרגה" מעל Opus. הדבר המדאיג באמת הוא לא רק היכולות עצמן, אלא שAnthropic התריעה בפני גורמים בממשל האמריקאי כי Mythos עלול להפוך תקיפות סייבר בקנה מידה גדול לזמינות משמעותית יותר, עד כדי כך שמשרד האוצר ובנק הפדרל ריזרב שיגרו אזהרות לבנקים גדולים בנוגע לסיכונים החדשים.

במקביל, עולם המדידה של יכולות AI עבר טלטלה משל עצמו עם השקת ARC-AGI-3 במרץ 2026 — הבנצ'מרק האינטראקטיבי הראשון מסוגו, שבו סוכני AI מוטלים לתוך סביבות חדשות ללא הוראות, ללא מטרה מוצהרת וללא חוקים, ונדרשים לגלות הכל בעצמם דרך ניסוי ותצפית. בהשקה, כל דגמי החזית ניקדו מתחת ל-1% בעוד בני אדם פתרו את הסביבות ב-100% מהמקרים — פער שהמחיש עד כמה עדיין רחוקה הבינה המלאכותית מהבנה כללית אמיתית.

מאז השתפרו הדגמים בקצב מהיר: נכון לאוגוסט 2026 Claude Opus 5 מוביל את הלוח הפומבי עם 30.2%, GPT-5.6 Sol אחריו עם 7.8%, ו-Claude Opus 4.8 עם 1.5% בלבד. השאלה שהסרטון בודק היא אם הקושי הקיצוני של הבנצ'מרק ושיטת הניקוד הייחודית שלו משקפים נכון את הפער האמיתי בין הדגמים החדשים לבין בינה כללית — או שהם עלולים להטעות דווקא בשיא המרוץ בין החברות.

שוקי הון עכשיו

ת"א 35 ▲ +1.0%
S&P 500 ▲ +0.6%
נאסד"ק ▲ +1.3%
ביטקוין ▲ +0.0%