דלגו לתוכן
Opus 5 של אנתרופיק: כפול ביצועים, אותו מחיר
כלים וטיפים

Opus 5 של אנתרופיק: כפול ביצועים, אותו מחיר

אנתרופיק שחררה ארבעה מודלים תוך שמונה שבועות. האחרון שבהם עולה בדיוק כמו קודמו - אבל עובד כמעט פי שניים יותר טוב. מה זה משנה בפועל למי שכבר עובד עם Claude.

TL;DR

  • אנתרופיק השיקה ב-24 ביולי את Claude Opus 5 – המודל הרביעי שלה תוך כשמונה שבועות בלבד.
  • המחיר נשאר בדיוק אותו דבר (5$ למיליון טוקני קלט, 25$ לפלט), אבל הציון ב-Frontier-Bench כמעט הוכפל לעומת הדור הקודם.
  • המודל הפך לברירת המחדל ב-Claude Max ולחזק ביותר שזמין ב-Pro – מי שכבר משלם, שודרג בלי לעשות כלום.

ב-24 ביולי, בלי חצי שנה של ציפייה ובלי כנס השקה, אנתרופיק הודיעה שהיא משיקה את Claude Opus 5. זה נשמע כמו עוד עדכון גרסה. זה לא. זה המודל הרביעי שהחברה משחררת מתחילת יוני: קודם Fable 5, אחריו Sonnet 5, עכשיו Opus 5, ובקרוב גם Mythos 5. ארבעה דורות בכשמונה שבועות. מי שבנה תהליך עבודה סביב מודל ספציפי לפני חודש – כבר מיושן.

קצב שחרור שלא ראינו קודם

עד לפני שנה אנתרופיק שחררה מודלים חדשים פעם ברבעון, בערך. עכשיו זה קצב של פעם בשבועיים-שלושה, על רקע מלחמת מחירים ישירה מול GPT-5.6 של OpenAI ועיכובים ב-Gemini 3.5 Pro של גוגל. זה לא שינוי טכני – זו החלטה עסקית. כל שחרור שומר על אותה נקודת מחיר של הדור הקודם, אבל עם קפיצה בביצועים. המסר לשוק ברור: לא לתמחר לפי "כמה חכם המודל", אלא לגרום לתחרות לרדוף כל הזמן אחרי נקודת מחיר שכבר זזה.

המספרים מאחורי הכותרות

ב-Frontier-Bench, מבחן שבודק אם מודל יכול לבנות תוכנה עובדת מתוך שרטוטי הנדסה, Opus 5 יותר מהכפיל את הציון של Opus 4.8 – ועקף את כל המתחרים, כולל Fable 5. ב-ARC-AGI 3, מבחן פתרון בעיות, הציון גבוה פי שלושה בערך מהמודל הכי טוב הבא בתור, וב-Zapier AutomationBench, מבחן שרלוונטי ישירות לכל מי שמריץ אוטומציות שיווקיות, הוא עובר יותר משימות מכל מתחרה – גם כשמריצים אותו במצב החיסכון הכי נמוך. בתחומי מחקר מדעי המודל השתפר ב-10.2 נקודות אחוז במשימות כימיה אורגנית וב-7.7 נקודות בחיזוי חלבונים לעומת הדור הקודם. חלון ההקשר עומד על מיליון טוקנים – מספיק כדי להזין לו ספר שלם או ארכיון תכתובות שלם בפעימה אחת. וכל זה באותו מחיר בדיוק: 5$ למיליון טוקני קלט, 25$ לפלט – בדיוק כמו Opus 4.8. יש גם מצב מהיר (Fast) שרץ פי 2.5 מהר יותר תמורת כפול מהמחיר, לתהליכים שבהם זמן תגובה קריטי יותר מעלות.

מאזני ברונזה עם מטבע אדום בודד מול ערימת משקולות אבן, מסמל אותו מחיר תמורת פי שניים ביצועים
אותו מחיר, פי שניים תוצאה – זו הכלכלה של Opus 5

הבטיחות שאף אחד לא מדבר עליה

בביקורת ההתנהגות האוטומטית הפנימית של אנתרופיק, Opus 5 קיבל את הציון הכי נמוך של התנהגות מטעה מבין המודלים האחרונים – כלומר הכי "ישר" עד כה, לפי המדדים של החברה עצמה. מנגד, המסננים לנושאי סייבר של Opus 5 מתערבים בערך 85% פחות מאשר אצל Fable 5, והמודל עדיין נשאר מאחורי Mythos 5 במשימות ניצול פרצות אבטחה. וכשהמודל מסרב בקשה מטעמי בטיחות, ה-API מנתב אוטומטית לבקשה למודל אחר במקום פשוט לחסום אותה.

המודל הזה לא מנצח כי הוא יותר חכם. הוא מנצח כי אנתרופיק מפסיקה לגבות פרימיום על אינטליגנציה.

המספר שחשוב: הציון של Opus 5 ב-Frontier-Bench יותר מכפול מזה של Opus 4.8 – והמחיר לא זז מילימטר: עדיין 5$ למיליון טוקני קלט ו-25$ לפלט.
רשת קווי לייזר אדומים מינימליסטית, קו אחד חורג מהתבנית הגאומטרית המושלמת
רשת הבטיחות מחזיקה – חוץ מקו אחד

מה זה אומר לכם

אם אתם כבר משלמים על Claude Pro או Max – לא צריך לעשות כלום, כי Opus 5 כבר שם, בברירת המחדל. אבל השאלה המעניינת יותר היא מה זה משנה בפועל: משימות שהעברתם ל-Sonnet כי Opus היה יקר מדי בשבילן, שווה לבדוק שוב – כי עכשיו אותו תקציב קונה פי שניים יותר תוצאה. בדיוק על זה כתבתי לפני שבועיים על שילוב מודלים לחיסכון בעלויות – וההמלצות שם צריכות עדכון: המיפוי בין "מודל יקר ואיטי" ל"מודל זול ומהיר" כבר לא אותו דבר.

ולסוכנויות ומותגים שמריצים תהליכי תוכן או אוטומציה על Claude: זה הזמן לבדוק מחדש workflow-ים שנתקעו בגלל תקציב או ביצועים חלשים מדי. לא כי "המודל החדש משנה הכל" – אלא כי המחיר של הפתרון הטוב ביותר, פשוט, ירד. ואם אתם עובדים עם API ובנוי אצלכם ניתוב אוטומטי בין מודלים לפי סוג המשימה, שווה לבדוק את הטבלה הזו מחדש כל חודש-חודשיים – בקצב הזה, מה שהיה נכון בחודש שעבר כבר לא בהכרח נכון היום.

נסו את זה היום

עברו ל-Claude.ai או Claude Code, ודאו שהמודל מוגדר על Opus 5, ותנו לו משימה עסקית אמיתית ומבולגנת – לא שאלת הדגמה. למשל: תנו לו קישור לדף נחיתה שלכם ובקשו ניתוח מול שני מתחרים, עם המלצות קונקרטיות לשינוי בכותרות ובקריאה לפעולה.

נתח את דף הנחיתה בקישור [URL] מול שני המתחרים הישירים שלי: [URL 1] ו-[URL 2].
תן לי טבלה השוואתית של: הבטחת הערך בכותרת, האורך והטון של הטקסט, והקריאה לפעולה.
לאחר מכן הצע לי 5 שינויים קונקרטיים לדף שלי, כל אחד עם הסבר קצר למה הוא אמור לעבוד טוב יותר.

אם אתם מנהלים ארגון או צוות שמריץ כמה תהליכי AI במקביל ורוצה למפות מחדש מה כדאי להריץ על איזה מודל – אפשר לדבר.

שיתוף
גיא אגא
גיא אגא

מלמד AI מעשי בארגונים מובילים, בכנסים ובאקדמיה. מייסד AI Academy — הזרוע המעשית של bestguy.ai ל-AI יצירתי, שיווק ותוכן.

עוד עליי →
→ חזרה לבלוג
עוד מהבלוג

מוכנים לחתוך את הרעש?

בין אם אתם ארגון, צוות או יוצר עצמאי — בואו נמצא בדיוק מה יזיז אתכם קדימה.