החלפתם לפייבל 5.1? רמת המאמץ הישנה כבר לא אומרת אותו דבר
מאת ירון דויטשר עודכן לאחרונה:
הרגע מוכר לכל מי שהחליף מודל אי פעם: עוברים לפייבל 5.1, משאירים את כל השאר בדיוק כפי שהיה, וממשיכים לעבוד. רמת המאמץ שכיוונתם בזמנו בעמל רב נשארת על מקומה, והכול נראה תקין.
מה שלא נראה: אותה מילה עצמה מבקשת עכשיו כמות חשיבה אחרת.
הכלל: רמת מאמץ אינה מידה אבסולוטית. אנתרופיק כותבת במפורש ששמות רמות המאמץ אינם מייצגים את אותה כמות חשיבה בין מודלים שונים, ובצ׳ק-ליסט המעבר לפייבל 5.1 היא מבקשת לכוונן מחדש מברירת המחדל — גם ממי שכבר עשה בדיוק את הסריקה הזאת על פייבל 5.
למה זה לא רק ניואנס
הכיוונון של רמת המאמץ הוא מהדברים הבודדים שאנשים באמת עושים ברצינות: מריצים את אותה משימה בכמה רמות, מסתכלים על התוצאה ועל החשבון, ומחליטים. ההשקעה הזאת יוצרת תחושה שהתוצאה נכונה מעכשיו והלאה.
היא נכונה למודל שעליו נמדדה, וזה הכול. המספרים שקיבלתם על פייבל 5 אינם עוברים בירושה לפייבל 5.1, בדיוק כפי שאינם עוברים לאופוס 5 או לסונט 5. שם הרמה משותף, מה שהוא מפעיל מתחת לא.
איפה זה מחזיר כסף
השיפור של פייבל 5.1 מול פייבל 5 מורגש בכל הרמות, והפער רחב יותר דווקא ברמות הגבוהות. המסקנה המעשית הפוכה ממה שזה נשמע: כשהפער גדל למעלה, אפשר לרדת למטה בלי לשלם על זה באיכות.
- ברמת medium: התוצאות של פייבל 5.1 מקבילות בערך לאלה של פייבל 5, בעלות נמוכה יותר
- ברמת low: אנתרופיק מציינת שפייבל 5.1 לרוב תחרותי מול מודלי אופוס וסונט בעלות למשימה, ובאותה נשימה מקבל ציון גבוה יותר מהם
מכאן נובעת בדיקה אחת ששווה להריץ השבוע: כל מקום שבו הרגל הישן אומר “המשימה הזאת בינונית, נריץ אותה על מודל קטן במאמץ גבוה” הוא מועמד להשוואה מחדש.
שתי מלכודות, אחת בכל קצה
לרדת ברמות זה לא מהלך חינם, ולכל קצה יש התנהגות מתועדת שכדאי להכיר לפני שמזיזים את המחוון:
- למטה, ב-low: פייבל 5.1 קורא לכלי חיפוש ואחזור פחות מפייבל 5, ונוטה יותר לענות מהזיכרון. לכל משימה שתלויה במידע טרי — תיעוד שהתעדכן, גרסה שיצאה אתמול, מספר שמשתנה — זו הרמה הלא נכונה, וההמלצה הרשמית היא להעלות מאמץ לתורים האלה במקום להישאר למטה ולקוות
- למעלה, ב-xhigh וב-max: לפני תוצר ארוך המודל עלול לחשוב זמן רב, לנסח חלק ניכר מהתוצר כבר בתוך החשיבה, ואז לכתוב אותו שוב בתשובה עצמה. התוצאה היא המתנה ארוכה וטוקנים כפולים על אותו טקסט. לתוצרים ארוכים אנתרופיק ממליצה להישאר על high, ולעלות רק במקום שבו מדדתם שיפור אמיתי
איך מכווננים בלי לשרוף את ה-cache
הבדיקה עצמה עולה משהו, ולכן שווה לעשות אותה בסדר הנכון. הכלל הרחב הוא שרמת המאמץ היא חלק ממפתח ה-cache, כך ששינוי באמצע שיחה גורם לבקשה הבאה לקרוא את כל ההיסטוריה מחדש. המקום הבטוח לכוונן הוא תחילת סשן:
claude --model fable --effort medium
בתוך שיחה, לפתיחת מחוון ובחירה ידנית:
/effort
עדכון, 4 בספטמבר 2026: בפייבל 5.1 זה כבר לא כך. מגרסה 2.1.260 של קלוד קוד שינוי מאמץ באמצע סשן על פייבל 5.1 אינו מפיל את ה-cache, כך שאפשר לכוונן תוך כדי עבודה. על שאר המודלים /effort ממשיך לאפס את התחילית כרגיל, והחלפת מודל יקרה כמו שהייתה. הפירוט: שלושה תיקוני cache בפייבל 5.1, ומה עוד מאפס ומה בטוח: החלפת מודל באמצע שיחה.
שורה תחתונה
מעבר מודל אינו רק שורה אחת בבורר. הוא מאפס את התוקף של הכיוונון שעשיתם מסביבו, ורמת המאמץ היא הכיוונון הראשון שכדאי להריץ מחדש — פעם אחת, בתחילת סשן, על משימה אמיתית משלכם ולא על דוגמה.
שווה לזכור שזה עובד גם בכיוון השני: הבדיקה עשויה להסתיים בהחלטה לרדת רמה, ולא לעלות. זה עדיין הכפתור הנכון — קלוד התרשל? העלו מאמץ מסביר מתי מסובבים אותו ומתי מחליפים מודל, ומודל ורמת מאמץ בקלוד קוד מכסה את שני הכפתורים יחד.
ומה בכלל השתנה בפייבל 5.1 עצמו: פייבל 5.1 יצא.