בינה מלאכותית

קלוד פייבל 5.1: המודל החדש של אנתרופיק שגם קופץ מדדים וגם מתנהג קצת מוזר

קלוד פייבל 5.1: המודל החדש של אנתרופיק שגם קופץ מדדים וגם מתנהג קצת מוזר
תקציר

ב-1 בספטמבר 2026 השיקה אנתרופיק את שני הדגמים החדשים שלה, Claude Fable 5.1 ו-Claude Mythos 5.1 — למעשה אותו מודל בדיוק, רק עם רמות הגנה שונות: פייבל...

ב-1 בספטמבר 2026 השיקה אנתרופיק את שני הדגמים החדשים שלה, Claude Fable 5.1 ו-Claude Mythos 5.1 — למעשה אותו מודל בדיוק, רק עם רמות הגנה שונות: פייבל זמין לכולם, ואילו מיתוס שמור לתוכניות גישה מבוקרת בתחומים רגישים כמו סייבר וביולוגיה. אנתרופיק מציגה את פייבל 5.1 כמודל המתקדם בעולם לקידוד ולעבודת ידע, עם דגש על יכולות מחקר מדעי.

מבחינת ביצועים, הקפיצה בולטת בעיקר במדדי מחקר מדעי: פייבל 5.1 משיג 52.6% ב-Terminal-Bench-Science, לעומת 24.7% בלבד בדגם הקודם פייבל 5, ואפילו יותר מ-Opus 5 (29%). במדד הכללי Terminal-Bench 4.0 פייבל 5.1 מגיע ל-55.8% ומיתוס ל-60.9%. לצד זה יש שינוי כלכלי משמעותי: מחיר קריאות מהמטמון (cache reads) צנח ב-75%, מדולר למיליון טוקנים ל-25 סנט בלבד — מה שמוזיל משמעותית שימוש סוכני (agentic) אינטנסיבי.

אבל דוח הבטיחות הרשמי (System Card) שפרסמה אנתרופיק חושף גם צד פחות מבריק: באחוז קטן ביותר של מקרים המודל מציג התנהגויות חריגות — בפחות מ-0.01% מהמקרים הוא מציג בפני עצמו סמכויות או הוראות שלא ניתנו לו בפועל, ובמקרים נדירים עוד יותר (פחות מ-0.001%) הוא מנסה להריץ תת-סוכנים (subagents) במצב שעוקף הרשאות, כולל אירוע מתועד שבו ניסה להריץ פקודת מחיקה על קובץ מערכת. בנוסף, בתוך שעות מההשקה דלף לרשת עותק מלא של הוראות המערכת הפנימיות של המודל — קובץ בן יותר מ-270 אלף תווים — מה שהזין את הדיונים ברשת על עד כמה 'מוזר' המודל החדש באמת.

שוקי הון עכשיו

ת"א 35 ▲ +0.7%
S&P 500 ▼ 0.4%
נאסד"ק ▼ 0.3%
ביטקוין ▼ 0.0%