בתחילת יולי 2026 קרה משהו שלא רואים כל שבוע בעולם הבינה המלאכותית: שלוש חברות ענק שיגרו מודלים מתחרים כמעט באותו שבוע ממש — מטא עם Muse Spark 1.1 (9...
בתחילת יולי 2026 קרה משהו שלא רואים כל שבוע בעולם הבינה המלאכותית: שלוש חברות ענק שיגרו מודלים מתחרים כמעט באותו שבוע ממש — מטא עם Muse Spark 1.1 (9 ביולי), xAI עם Grok 4.5 (8 ביולי) ו-OpenAI עם משפחת GPT-5.6 ובראשה הדגל Sol. התוצאה: מלחמת מחירים ותכונות שמכריחה כל ספק להצדיק כל דולר שהוא גובה על טוקן.
מה שמעניין הוא שכל חברה בחרה להתמקד ביתרון אחר לגמרי. לפי ניתוחים שפורסמו בשבוע שלאחר ההשקות, Claude Fable 5 עדיין מוביל בבנצ'מרקים של יכולת גולמית, עם 95% ב-SWE-bench Verified — הציון הגבוה ביותר שנרשם אי פעם למודל ציבורי — בעוד ש-GPT-5.6 Sol מתהדר במהירות ביצוע משימות אוטונומיות (agentic), Grok 4.5 מתמקד ביחס אינטליגנציה-למחיר, ו-Muse Spark 1.1 של מטא מתחרה על שימוש בכלים (tool use) במחיר נמוך במיוחד — 1.25 דולר למיליון טוקנים קלט.
גם חלון ההקשר הפך לזירת תחרות: רוב המודלים החדשים כבר מתקרבים למיליון טוקנים של הקשר, כשגרוק 4.5 נשאר החריג עם 500 אלף טוקנים בלבד. עבור מפתחים ישראלים שבוחרים API לפרויקט הבא, המשמעות היא שהשאלה כבר לא "איזה מודל הכי חכם" אלא איזה מודל מתאים למשימה הספציפית — ביצוע אוטונומי, עלות, או יכולת גולמית.
המספרים מאחורי ההשקות חושפים תמונה מורכבת יותר מ"מי הכי חכם". לפי מדד האינטליגנציה המשולב של Artificial Analysis, GPT-5.6 Sol ברמת המאמץ המקסימלית שלו מפגר בנקודה אחת בלבד אחרי Claude Fable 5 — אך עושה זאת במחיר של כשליש בלבד, כשהתמחור הבסיסי עומד על 5 דולר למיליון טוקנים קלט ו-30 דולר לפלט (ומכפיל את עצמו כשההקשר חורג מ-272 אלף טוקנים). זו בדיוק האסטרטגיה שהובילה את OpenAI להשיק את Sol בשלוש רמות נפרדות — Sol, Terra ו-Luna — כדי לתת למפתחים לבחור בעצמם בין עוצמה לחיסכון.
ב-xAI הימרו על כיוון אחר לגמרי: Grok 4.5, שיצא לדרך ב-16 ביולי, תומחר על 2 דולר למיליון טוקנים קלט ו-6 דולר לפלט, עם הנחה תלולה של 85% על טוקנים שמגיעים ממטמון (cache) — ירידה ל-30 סנט בלבד למיליון. xAI מתארת את Grok 4.5 כמודל הראשון שלה שאומן במיוחד על נתוני שימוש אמיתיים מסביבת הפיתוח Cursor, מה שמסביר את המיקוד המוצהר במשימות קידוד ועבודה אוטונומית של סוכני AI, גם אם חלון ההקשר שלו — 500 אלף טוקנים — נשאר המצומצם מבין הארבעה.
מטא, מצידה, בחרה לתקוף זווית שלישית: היא הציבה את Muse Spark 1.1 במחיר של 1.25 דולר קלט ו-4.25 דולר פלט למיליון טוקנים — כרבע מהתעריף של הדגלים המובילים של OpenAI ו-Anthropic — תוך שהיא מספקת ל-Muse Spark 1.1 חלון הקשר של מיליון טוקנים ותאימות מלאה ל-API של OpenAI, כולל קריאות כלים מקבילות (parallel tool calling). זו הפעם הראשונה שמטא מתמחרת מודל שפה כמוצר סוכן (agent) בתשלום ולא כפיצ'ר חינמי בתוך המוצרים הצרכניים שלה, מה שמסמן שינוי אסטרטגי של החברה מול מפתחים ולא רק מול משתמשי קצה.
ההשקה המשולשת גם חושפת פער שקט אך משמעותי בין ה"אינטליגנציה הגולמית" של המודלים לבין הביצועים שלהם במשימות אוטונומיות בפועל. בבנצ'מרק Terminal-Bench 2.1, שבוחן יכולת סוכנים לתפעל טרמינל ולבצע משימות מרובות-שלבים, המודל Sol Ultra של OpenAI רשם 91.9% — לפני Claude Fable 5 (88.0%) ולפני הגרסה הרגילה של Sol עצמו (88.8%). המשמעות המעשית למפתח ישראלי: המודל עם הציון הגבוה ביותר בבנצ'מרק "כללי" לא בהכרח המודל שיצליח הכי טוב במשימת אוטומציה ספציפית, ולכן שווה לבדוק ביצועים לפי סוג המשימה ולא רק לפי טבלת דירוג אחת.