
כך חוסכים 54% בעלויות Claude בלי לפגוע באיכות
אנתרופיק בדקה את עצמה ופרסמה מספרים לא מחמיאים: מודל שעולה פי 2.5 יותר לא שווה את זה ברוב המשימות. הנה בדיוק איך מרכיבים את הצוות הזול שמבצע כמעט אותו דבר.
- אנתרופיק פרסמה בעצמה בנצ'מארק שמראה שהמודל היקר שלה, Fable 5, מיותר ברוב המשימות
- כש-Fable 5 מתכנן ו-Sonnet 5 מבצע: 86.8% דיוק ב-18.53$ למשימה, מול 90.8% ב-40.56$ עם Fable 5 לבד ב-BrowseComp – כלומר 96% מהביצועים ב-46% מהמחיר
- דוגמה מהקוקבוק הרשמי: אימות 20 עובדות על פארקים לאומיים עלה 1.61$ ב-194 שניות בצוות המשולב, מול 4$ ו-608 שניות עם Fable 5 לבד
- אפשר להרכיב את התבנית הזו כבר היום ב-Claude Code, בלי לחכות לשום עדכון
בשבוע שעבר אנתרופיק עשתה משהו שחברות טכנולוגיה כמעט אף פעם לא עושות מרצון: היא פרסמה נתונים שמראים שהמוצר הכי יקר שלה הוא בזבוז כסף ברוב המקרים. לא מתחרה פרסמה את זה, לא בלוגר עוין – אנתרופיק בעצמה, בדוקומנטציה הרשמית של Claude Managed Agents.
הטענה: אם אתם משתמשים ב-Fable 5 לכל שלב בתהליך העבודה שלכם, אתם משלמים על אינטליגנציה שרוב הזמן לא צריכה. הפתרון שהם מציעים – ושמראים עליו מספרים – הוא לגרום ל-Fable 5 לתכנן ולפקח, ולתת למודלים זולים יותר לבצע את העבודה בפועל.
שתי תבניות, לא אחת
אנתרופיק בדקה שני מבנים. הראשון נקרא "אורקסטרטור": Fable 5 מתכנן משימה שלמה ומחלק אותה בין כמה worker agents מבוססי Sonnet 5, שרצים במקביל ומבצעים. השני נקרא "יועץ": Sonnet 5 מבצע את כל העבודה בעצמו, ופונה ל-Fable 5 רק כשהוא נתקע או צריך אישור על החלטה קריטית.
ההבדל בין השתיים הוא כמה פעמים אתם "מזמינים" את המודל היקר. באורקסטרטור הוא מעורב תמיד, אבל רק בשכבת התכנון. ביועץ הוא כמעט לא מעורב – בממוצע פעם אחת למשימה שלמה.

המספרים המלאים
על בנצ'מארק BrowseComp (משימות חיפוש ואיסוף מידע מורכבות): התבנית האורקסטרטור הגיעה ל-86.8% דיוק במחיר של 18.53$ למשימה. Fable 5 לבד הגיע ל-90.8% דיוק – אבל במחיר של 40.56$. כלומר 96% מהביצועים במחיר של 46% בלבד.
על SWE-bench Pro (משימות תכנות אמיתיות): תבנית היועץ הגיעה ל-92% מהציון של Fable 5 העצמאי, במחיר של 63% מהעלות שלו.
אבל המספר המעניין באמת הוא השלישי, שכמעט לא דיברו עליו: הרצה של Sonnet 5 בלבד, בלי שום מעורבות של Fable 5, עלתה 16.01$ – רק 2.50$ פחות מהצוות המשולב. אבל הדיוק שלה צנח ל-77.8%.
הצוות ההיברידי לא באמת מוזיל את ההגדרה היקרה – הוא מתקן את הזולה.
הדוגמה שממחישה את זה הכי טוב
בקוקבוק הרשמי של אנתרופיק יש דוגמה פשוטה: משימה לאמת 20 עובדות על הפארקים הלאומיים הגדולים בארה"ב. עם Fable 5 לבד: 4$ ו-608 שניות. עם הצוות המשולב – Fable 5 מתכנן, Sonnet 5 מבצע: 1.61$ ו-194 שניות. פי 2.5 יותר זול, פי 3 יותר מהיר, ותוצאה כמעט זהה.

מה זה אומר לכם
אם אתם בונים workflow עם ה-API של Claude – סוכן שירות לקוחות, כלי מחקר פנימי, מערכת שמייצרת תוכן – זו לא המלצה תיאורטית. זו ארכיטקטורה שאפשר להרכיב היום: מודל חזק ויקר שמתכנן ובודק, ומודלים זולים שמבצעים. כבר כתבתי כאן על ההאק שחתך 70% מחשבון ה-API של Claude – וזה בדיוק אותו כיוון: לא לוותר על האיכות, אלא להפסיק לשלם עליה במקומות שהיא לא נדרשת.
ואם אתם לא מתכנתים אלא משתמשים ב-Claude Code או בכלים דומים לעבודה יומיומית – הלקח פשוט יותר: תפסיקו לבחור אוטומטית במודל הכי חזק לכל בקשה. תשאלו את עצמכם אם המשימה דורשת שיפוט מורכב, או שהיא בעיקר ביצוע – ותנו למודל הזול לעשות את החלק הזה.
בפעם הבאה שאתם נותנים ל-Claude Code משימה מרובת שלבים – נסו לתת לו הנחיה מפורשת להפריד תכנון מביצוע, במקום לתת לו לרוץ הכל במודל אחד:
תני לי תוכנית עבודה מפורטת למשימה הבאה: [תיאור המשימה שלכם]. אל תבצעי את השלבים בעצמך - האצילי כל שלב לתת-סוכן (subagent) נפרד, ושמרי את עצמך רק לבדיקת איכות, תיקון כיוון והחלטות שדורשות שיקול דעת מורכב. בסוף, תני לי סיכום קצר של מה עלה יותר ומה פחות משוער.
אם אתם ארגון שרוצה לבנות תהליכי AI אמיתיים ולא רק להריץ פרומפטים – אנחנו עוזרים בדיוק עם זה בליווי הארגוני שלנו. אפשר לקרוא עוד בשירותים שלנו.
תחרות AI בפרס מיליון דולר: איך מגישים עד 15 באוגוסט
קזחסטן פותחת תחרות סרטים שכולם AI, עם קופה של מיליון דולר וג'קפוט של 450 אלף דולר לזוכה הראשון. הנה מה שצריך לדעת…
איך הופכים משפט לסרט אנימה עם Claude ו-Higgsfield MCP
שורה אחת של טקסט, ותוך דקות יש סצנת אנימה עם דמות עקבית ורקע מותאם. בדקתי מה קורה מתחת למכסה המנוע – ומה…
באוניברסיטה הזאת מקבלים ציון על שבירת Claude
51 סטודנטים קיבלו ציון לפי כמה שהצליחו להפיל את Claude, DeepSeek ו-MiniMax. אף אחד לא שבר את קלוד עד הסוף - והמספרים…