בינה מלאכותית

אנתרופיק מבטיחה ביצועי Fable במחיר נמוך יותר — אבל ה־40% דורשים הסבר

אנתרופיק מבטיחה ביצועי Fable במחיר נמוך יותר — אבל ה־40% דורשים הסבר
תקציר

Opus 5.5 מגיע עם תעריפים נמוכים יותר ופחות צריכת טוקנים, והשאלה המעניינת היא כמה יעלה לסיים איתו משימה אמיתית.

📌 תקציר: אנתרופיק השיקה את Claude Opus 5.5, שלדבריה משתווה ל־Fable 5.1 ברוב המשימות וזול ב־40% להפעלה מ־Opus 5 בעומסי עבודה טיפוסיים. ההוזלה במחיר טוקני הקלט והפלט היא 20%; יתר החיסכון תלוי ביעילות המודל ובאופן השימוש בו.

🔗 קישור למוצר: Claude Opus 5.5

עוד השקת מודל, עוד הבטחה לביצועים משופרים. אלא שבמקרה של Claude Opus 5.5, הסיפור המעניין נמצא דווקא בחשבון: אנתרופיק מציגה מודל שלדבריה מגיע לרמתו של Fable 5.1 ברוב המשימות, ובמקביל עולה פחות להפעלה מקודמו, Opus 5. ההשקה, שעליה דיווח TechCrunch, מכוונת לנקודה רגישה אצל מי שבונים מוצרים עם בינה מלאכותית: יכולת מרשימה היא התחלה טובה, אבל צריך גם להיות מסוגלים לשלם עליה כשמספר המשתמשים גדל. עבור חברות שמפעילות סוכני תכנות או מעבדות מסמכים בהיקף גדול, ההפרש הזה עשוי להיות משמעותי יותר מעוד ניצחון בטבלת מבחנים.

לפי פירוט התמחור מהודעת החברה, שצוטט בדיון ההשקה, המחיר הוא 4 דולרים למיליון טוקני קלט ו־20 דולר למיליון טוקני פלט — ירידה של 20% לעומת Opus 5. קריאה ממטמון, שמאפשרת להשתמש שוב בקלט שנשמר, עולה 0.20 דולר למיליון טוקנים, ירידה של 60%. מכאן מגיעה ההבחנה החשובה: 40% פחות בעלות ההפעלה אינם הנחה אחידה של 40% במחירון. החברה אומרת שבבדיקותיה, בהגדרות ברירת המחדל ובעומסי עבודה טיפוסיים, השילוב בין תמחור נמוך יותר לצריכת טוקנים מצומצמת יותר מניב את החיסכון הזה. היא גם מדווחת על יצירת פלט מהירה ביותר מ־30% לעומת הדגם הקודם. אלה נתוני החברה, והחשבון של כל לקוח יהיה תלוי בתמהיל העבודה שלו.

אפשר להמחיש את הפער בלי לנחש איך המודל יתנהג: מיליון טוקני קלט ומיליון טוקני פלט, בתעריפים הרגילים וללא מטמון או חיובים נוספים, עולים כעת 24 דולר במקום 30 דולר. זו דוגמה חשבונית להוזלה של 20%, לא מדידה של משימה אמיתית. כדי להגיע לחיסכון גדול יותר צריך שגם השימוש ישתנה — למשל, שהמודל יפיק פחות טוקנים בדרך לתוצאה, או שחלק גדול יותר מהקלט ייקרא מהמטמון. מבחינת מנהל מוצר, המשמעות היא שתקציב המבוסס רק על המחיר למיליון טוקנים עלול לפספס חלק מהתמונה. המדד השימושי יותר הוא כמה עולה לקבל תוצאה שאפשר להשתמש בה, כולל ניסיונות חוזרים ותיקונים.

בהודעת ההשקה שפורסמה בקהילת Anthropic, החברה טוענת שהמודל עוקף את Opus 5 ואת Fable 5.1 כמעט בכל מבחני ההשוואה שהיא מפרסמת, עם דגש על תכנות באמצעות סוכנים ועבודת ידע. היא מציינת גם כתיבה טבעית יותר והקפדה משופרת על הוראות ניסוח. ויש דיוק חשוב בכותרת הנלווית להשקה: התיאור של המודל כבעל הביצועים החזקים ביותר שנבדקו מתייחס בהודעה למבחן ההתאמה ההתנהגותית המקיף של החברה, ולא להוכחה שהוא הטוב ביותר בכל משימה. לפי ההודעה, גם METR ו־Frontier Design בחנו אותו לפני ההשקה. עצם הבדיקה החיצונית אינה הופכת כל טענה שיווקית לאישור גורף.

המשמעות לצוותים בישראל היא בעיקר כלכלית ותפעולית — וזו כבר פרשנות: אם בונים עוזר שירות בעברית או כלי שעובר על מסמכים בעברית ובאנגלית, שיפור במבחני תכנות לא מספיק כדי להחליט על מעבר. כדאי להשוות את הדגמים על אוסף קבוע של משימות מהמערכת עצמה ולמדוד עלות, זמן המתנה וכמות תיקונים אנושיים. מודל זול יותר שדורש עוד סבב בדיקה יכול למחוק את החיסכון; מודל שמסיים משימה בפחות צעדים יכול להגדיל אותו. בפרט, אין בנתוני ההשקה שהובאו כאן מדידה ייעודית לעברית שמאפשרת להסיק שהשיפור יהיה זהה גם אצל משתמש ישראלי.

אנתרופיק הודיעה גם על העלאת מכסות השימוש בחלונות של חמש שעות למנויי Pro, Max ו־Team. זו בשורה נפרדת מהוזלת השימוש דרך ממשק הפיתוח: יותר מרחב עבודה במנוי אינו בהכרח מחיר מנוי נמוך יותר. עבור המשתמשים, ההשקה מציעה הזדמנות לבדוק אם משימות שהיו יקרות או איטיות מדי נעשות מעשיות יותר. עבור חברות שמוכרות מוצר מבוסס AI, היא מעלה שאלה נוספת: האם לשמור את החיסכון ברווחיות, להעביר אותו ללקוחות או לאפשר שימוש נרחב יותר באותו מחיר. את התשובה לא נמצא בטבלת הביצועים — אלא בחשבונית שאחרי חודש עבודה.

אהבתם? עקבו אחרינו

כל עדכוני ה-AI הכי חמים, ישר לפיד שלכם

שוקי הון עכשיו

ת"א 35 ▲ +0.4%
S&P 500 ▼ 0.0%
נאסד"ק ▲ +0.5%
ביטקוין ▼ 0.3%