ב-13 באוגוסט 2026 שחררה החברה הסינית DeepSeek את הגרסה הרשמית של DeepSeek V4 Pro 0813, מודל ענק מבוסס Mixture-of-Experts עם 1.6 טריליון פרמטרים (49...
ב-13 באוגוסט 2026 שחררה החברה הסינית DeepSeek את הגרסה הרשמית של DeepSeek V4 Pro 0813, מודל ענק מבוסס Mixture-of-Experts עם 1.6 טריליון פרמטרים (49 מיליארד פעילים בכל טוקן), שמחליף את גרסת הפריוויו מאפריל ומביא שיפור דרמטי ביכולות אג'נטיות ובביצועי ייצור בפועל — כולל קפיצה מ-72.1 ל-87.9 בבנצ'מרק Terminal-Bench 2.1 של החברה עצמה.
מה שהופך את השחרור לכותרת היא ההשוואה למודלים הסגורים של החברות המערביות: ב-LiveCodeBench, DeepSeek V4 Pro במאמץ חשיבה מקסימלי משיג ציון Pass@1 של 93.5 — הציון הגבוה ביותר מבין כל המודלים שנבדקו, לפני Gemini 3.1 Pro (91.7) ו-Claude Opus 4.6 Max (88.8). זאת בשעה שהמחיר לטוקן אצל DeepSeek נמוך פי כמה מונים מהמתחרות, מה שמחריף את השאלה מה בעצם מצדיק את התג המחיר הגבוה של החברות הסגורות.
עדיין, אין מדובר בניצחון מוחלט: במתמטיקה (HMMT 2026) Claude וגם GPT-5.4 עדיין מקדימים את DeepSeek, ובבדיקות ידע עובדתי כמו SimpleQA-Verified יש פער ניכר מול Gemini. מצד שני, DeepSeek כן פרסמה את משקלי גרסת אוגוסט ב-Hugging Face תחת רישיון MIT — יתרון שקוף ומשמעותי מול ענקיות הבינה המלאכותית האמריקאיות, גם אם מודל של 1.6 טריליון פרמטרים רחוק מלהיות משהו שרוב המפתחים יכולים להריץ על המחשב.