בינה מלאכותית

קלוד אופוס 4.8: המודל שלמד להגיד "אני לא בטוח" במקום להמציא תשובה

תקציר

אנתרופיק השיקה את Claude Opus 4.8, גרסה שהחברה עצמה מתארת כשיפור "צנוע אך מוחשי" - אבל הנתון שבלט בבדיקות החיצוניות הוא לא ביצועי קידוד או הבנת שפה...

אנתרופיק השיקה את Claude Opus 4.8, גרסה שהחברה עצמה מתארת כשיפור "צנוע אך מוחשי" - אבל הנתון שבלט בבדיקות החיצוניות הוא לא ביצועי קידוד או הבנת שפה, אלא שיעור הטעויות העובדתיות. מתוך שישה מודלים שנבדקו באותם מבחני אמינות, לאופוס 4.8 היה שיעור התשובות השגויות הנמוך ביותר בכל אחד מהמבחנים - כלומר פחות הזיות (hallucinations), התופעה שבה מודל שפה "ממציא" עובדות בביטחון מלא.

מה שמעניין בשיטה: המודל לא הגיע לתוצאה הזאת כי הוא פתאום יודע יותר. הוא הגיע אליה כי הוא נמנע מלענות כשהוא לא בטוח, במקום לנחש. זה שינוי גישה בסיסי באימון - להעדיף "אני לא יודע" על פני תשובה שמצטלצלת משכנעת אבל שגויה. אנתרופיק קוראת לזה שיפור ב"honesty", ומדגישה שהמודל גם שקוף יותר כשהוא נתקל באי-ודאות, זקוק להבהרה, או מזהה שהגישה שהוא נוקט בה כנראה לא אופטימלית לבעיה שהוצגה לו.

לשוק הישראלי זה לא עניין אקדמי: ככל שיותר חברות משלבות מודלי שפה בכלי עבודה, קוד וקבלת החלטות, שיעור ההזיות הוא בדיוק הפרמטר שקובע כמה אפשר לסמוך על הפלט בלי לבדוק אותו ידנית. מודל שמודה בבורות שלו במקום להמציא - גם אם זה בא על חשבון "תשובה לכל שאלה" - הוא בפועל כלי עבודה אמין יותר, ולא רק אטרקציה שיווקית.

שוקי הון עכשיו

ת"א 35 ▲ +1.3%
S&P 500 ▲ +0.7%
נאסד"ק ▲ +1.0%
ביטקוין ▲ +0.7%