בינה מלאכותית

נמוטרון 3 אולטרה: המודל של NVIDIA שמאתגר את GPT וג'מיני - וחינם לגמרי

נמוטרון 3 אולטרה: המודל של NVIDIA שמאתגר את GPT וג'מיני - וחינם לגמרי
תקציר

NVIDIA הפתיעה השבוע עם נמוטרון 3 אולטרה (Nemotron 3 Ultra), מודל שפה ענק בגודל 550 מיליארד פרמטרים שרק כ-55 מיליארד מהם פעילים בכל רגע נתון, בזכות...

NVIDIA הפתיעה השבוע עם נמוטרון 3 אולטרה (Nemotron 3 Ultra), מודל שפה ענק בגודל 550 מיליארד פרמטרים שרק כ-55 מיליארד מהם פעילים בכל רגע נתון, בזכות ארכיטקטורת Mixture-of-Experts היברידית המשלבת Transformer ו-Mamba. התוצאה: קפיצה של פי חמישה במהירות ההיסק וחיסכון של כשליש בעלויות תפעול, לעומת המודלים הפתוחים המובילים שהיו קיימים עד כה.

מה שהופך את המהלך לחריג במיוחד הוא רמת הפתיחות. NVIDIA לא הסתפקה בשחרור המשקלים בלבד, אלא חשפה גם את נתוני האימון המלאים ואת מתכוני הפיתוח, תחת רישיון פתוח חדש. זו בשורה משמעותית לחוקרים ולמפתחים שרגילים לקבל ממעבדות כמו OpenAI וגוגל גישה מוגבלת בלבד למודלים סגורים - כאן אפשר לפרק את המודל לגורמים, להבין איך הוא אומן, ואפילו להתאים אותו מחדש לצרכים ספציפיים.

מבחינה טכנית, המודל תומך בחלון הקשר של עד מיליון טוקנים, מה שהופך אותו למתאים במיוחד לסוכני AI שפועלים לאורך זמן ממושך - תכנון משימות מורכבות, מחקר מעמיק, וכתיבת קוד בפרויקטים גדולים. ערוץ Two Minute Papers, שמתמחה בסיקור מאמרי מחקר פורצי דרך בתחום הבינה המלאכותית והגרפיקה הממוחשבת, הציג את המודל ככלי שמצמצם משמעותית את הפער בין מודלים פתוחים לקנייניים - התפתחות שצפויה להאיץ תחרות בשוק ה-AI הארגוני.

ההשקה, שהוצגה לראשונה בכנס Computex ביוני 2026, כוללת גם מהלך פחות מדובר אך משמעותי לא פחות: NVIDIA שחררה יחד עם המודל למעלה מ-10 טריליון טוקנים של נתוני אימון פתוחים, ביניהם מאגר Nemotron-CC-v2.1 בן 2.5 טריליון טוקנים מ-Common Crawl ומאגר קוד ייעודי בשם Nemotron-CC-Code-v1 עם 428 מיליארד טוקנים. זוהי כמות נתונים עצומה שנחשפת בפומבי, בזמן שמעבדות מתחרות כמו OpenAI וגוגל ממשיכות להסתיר את מקורות האימון של המודלים המובילים שלהן. הרישיון החדש, הידוע כ-NVIDIA Nemotron Open Model License, מתיר שימוש, שינוי והפצה מסחרית של המודל וגזירותיו ללא צורך באישור או תשלום תמלוגים ל-NVIDIA.

מבחינת ביצועים בפועל, התמונה מורכבת יותר מהצגה שיווקית פשוטה של "המודל הטוב בעולם". בלוח הדירוג של Artificial Analysis Intelligence Index, נמוטרון 3 אולטרה השיג ציון 48 - הגבוה ביותר בין מודלים פתוחים שפותחו בארצות הברית, אך הוא עדיין נמוך משמעותית מהמודלים הסיניים המתחרים: Kimi K2.6 של Moonshot AI (54 נקודות), וכן GLM-5.1 ו-Qwen 3.5. כלומר, נמוטרון 3 אולטרה לא סוגר את הפער מול הטובים בעולם, אלא בעיקר מציב סוף-סוף מודל אמריקאי תחרותי בזירה שבה סין הובילה בחודשים האחרונים. מה שכן בולט לטובתו הוא היתרון בקצב עיבוד: מדידות עצמאיות של Artificial Analysis מצביעות על פי כשלושה יותר תפוקת היסק לעומת GLM-5.1, יתרון שמתורגם ישירות לחיסכון בעלויות הרצה בקנה מידה ארגוני.

לפני ההשקה הרשמית כבר הספיקו כמה שמות גדולים לאמץ את המודל, ביניהם Accenture, CrowdStrike ו-Perplexity, שהשתמשו בגרסאות מוקדמות שלו לבניית סוכני AI פנימיים. מהלך כזה של אימוץ מוקדם על ידי חברות אנטרפרייז מוכרות הוא לרוב סימן אמין יותר להצלחה מסחרית מאשר ציוני בנצ'מארק בלבד, מכיוון שהוא מעיד על כך שהמודל עומד במבחן העמידות והיציבות הנדרש בסביבות ייצור אמיתיות, לא רק במעבדה. NVIDIA משווקת את הגישה הזו כחלק מאסטרטגיה רחבה יותר של מתן תשתית NIM (Nvidia Inference Microservices) שמאפשרת לארגונים להריץ את המודל בענן הפרטי שלהם, בלי תלות בממשקי API חיצוניים.

מעבר לנתונים היבשים, המהלך מסמן שינוי בכללי המשחק שבו NVIDIA כבר לא מסתפקת בלמכור את החומרה שמריצה מודלי AI, אלא הופכת בעצמה לשחקנית מרכזית גם בצד התוכנה והמודלים. עבור NVIDIA, מודל פתוח וחינמי כמו נמוטרון הוא בראש ובראשונה מנוע מכירות לשבבים - ככל שיותר מפתחים וארגונים יאמצו אותו, כך יגדל הביקוש לתשתית ה-GPU הנדרשת להרצתו בקנה מידה. זהו הסבר מרכזי לכך שהחברה מוכנה לוותר על הכנסות רישוי ישירות מהמודל עצמו, בניגוד ל-OpenAI וגוגל שהמודלים הסגורים שלהן מהווים מקור הכנסה עצמאי.

שוקי הון עכשיו

ת"א 35 ▼ 0.9%
S&P 500 ▼ 0.4%
נאסד"ק ▼ 0.8%
ביטקוין ▼ 3.2%