
Opus 5 של אנתרופיק: כפול ביצועים, אותו מחיר
אנתרופיק שחררה ארבעה מודלים תוך שמונה שבועות. האחרון שבהם עולה בדיוק כמו קודמו - אבל עובד כמעט פי שניים יותר טוב. מה זה משנה בפועל למי שכבר עובד עם Claude.
- אנתרופיק השיקה ב-24 ביולי את Claude Opus 5 – המודל הרביעי שלה תוך כשמונה שבועות בלבד.
- המחיר נשאר בדיוק אותו דבר (5$ למיליון טוקני קלט, 25$ לפלט), אבל הציון ב-Frontier-Bench כמעט הוכפל לעומת הדור הקודם.
- המודל הפך לברירת המחדל ב-Claude Max ולחזק ביותר שזמין ב-Pro – מי שכבר משלם, שודרג בלי לעשות כלום.
ב-24 ביולי, בלי חצי שנה של ציפייה ובלי כנס השקה, אנתרופיק הודיעה שהיא משיקה את Claude Opus 5. זה נשמע כמו עוד עדכון גרסה. זה לא. זה המודל הרביעי שהחברה משחררת מתחילת יוני: קודם Fable 5, אחריו Sonnet 5, עכשיו Opus 5, ובקרוב גם Mythos 5. ארבעה דורות בכשמונה שבועות. מי שבנה תהליך עבודה סביב מודל ספציפי לפני חודש – כבר מיושן.
קצב שחרור שלא ראינו קודם
עד לפני שנה אנתרופיק שחררה מודלים חדשים פעם ברבעון, בערך. עכשיו זה קצב של פעם בשבועיים-שלושה, על רקע מלחמת מחירים ישירה מול GPT-5.6 של OpenAI ועיכובים ב-Gemini 3.5 Pro של גוגל. זה לא שינוי טכני – זו החלטה עסקית. כל שחרור שומר על אותה נקודת מחיר של הדור הקודם, אבל עם קפיצה בביצועים. המסר לשוק ברור: לא לתמחר לפי "כמה חכם המודל", אלא לגרום לתחרות לרדוף כל הזמן אחרי נקודת מחיר שכבר זזה.
המספרים מאחורי הכותרות
ב-Frontier-Bench, מבחן שבודק אם מודל יכול לבנות תוכנה עובדת מתוך שרטוטי הנדסה, Opus 5 יותר מהכפיל את הציון של Opus 4.8 – ועקף את כל המתחרים, כולל Fable 5. ב-ARC-AGI 3, מבחן פתרון בעיות, הציון גבוה פי שלושה בערך מהמודל הכי טוב הבא בתור, וב-Zapier AutomationBench, מבחן שרלוונטי ישירות לכל מי שמריץ אוטומציות שיווקיות, הוא עובר יותר משימות מכל מתחרה – גם כשמריצים אותו במצב החיסכון הכי נמוך. בתחומי מחקר מדעי המודל השתפר ב-10.2 נקודות אחוז במשימות כימיה אורגנית וב-7.7 נקודות בחיזוי חלבונים לעומת הדור הקודם. חלון ההקשר עומד על מיליון טוקנים – מספיק כדי להזין לו ספר שלם או ארכיון תכתובות שלם בפעימה אחת. וכל זה באותו מחיר בדיוק: 5$ למיליון טוקני קלט, 25$ לפלט – בדיוק כמו Opus 4.8. יש גם מצב מהיר (Fast) שרץ פי 2.5 מהר יותר תמורת כפול מהמחיר, לתהליכים שבהם זמן תגובה קריטי יותר מעלות.

הבטיחות שאף אחד לא מדבר עליה
בביקורת ההתנהגות האוטומטית הפנימית של אנתרופיק, Opus 5 קיבל את הציון הכי נמוך של התנהגות מטעה מבין המודלים האחרונים – כלומר הכי "ישר" עד כה, לפי המדדים של החברה עצמה. מנגד, המסננים לנושאי סייבר של Opus 5 מתערבים בערך 85% פחות מאשר אצל Fable 5, והמודל עדיין נשאר מאחורי Mythos 5 במשימות ניצול פרצות אבטחה. וכשהמודל מסרב בקשה מטעמי בטיחות, ה-API מנתב אוטומטית לבקשה למודל אחר במקום פשוט לחסום אותה.
המודל הזה לא מנצח כי הוא יותר חכם. הוא מנצח כי אנתרופיק מפסיקה לגבות פרימיום על אינטליגנציה.

מה זה אומר לכם
אם אתם כבר משלמים על Claude Pro או Max – לא צריך לעשות כלום, כי Opus 5 כבר שם, בברירת המחדל. אבל השאלה המעניינת יותר היא מה זה משנה בפועל: משימות שהעברתם ל-Sonnet כי Opus היה יקר מדי בשבילן, שווה לבדוק שוב – כי עכשיו אותו תקציב קונה פי שניים יותר תוצאה. בדיוק על זה כתבתי לפני שבועיים על שילוב מודלים לחיסכון בעלויות – וההמלצות שם צריכות עדכון: המיפוי בין "מודל יקר ואיטי" ל"מודל זול ומהיר" כבר לא אותו דבר.
ולסוכנויות ומותגים שמריצים תהליכי תוכן או אוטומציה על Claude: זה הזמן לבדוק מחדש workflow-ים שנתקעו בגלל תקציב או ביצועים חלשים מדי. לא כי "המודל החדש משנה הכל" – אלא כי המחיר של הפתרון הטוב ביותר, פשוט, ירד. ואם אתם עובדים עם API ובנוי אצלכם ניתוב אוטומטי בין מודלים לפי סוג המשימה, שווה לבדוק את הטבלה הזו מחדש כל חודש-חודשיים – בקצב הזה, מה שהיה נכון בחודש שעבר כבר לא בהכרח נכון היום.
עברו ל-Claude.ai או Claude Code, ודאו שהמודל מוגדר על Opus 5, ותנו לו משימה עסקית אמיתית ומבולגנת – לא שאלת הדגמה. למשל: תנו לו קישור לדף נחיתה שלכם ובקשו ניתוח מול שני מתחרים, עם המלצות קונקרטיות לשינוי בכותרות ובקריאה לפעולה.
נתח את דף הנחיתה בקישור [URL] מול שני המתחרים הישירים שלי: [URL 1] ו-[URL 2]. תן לי טבלה השוואתית של: הבטחת הערך בכותרת, האורך והטון של הטקסט, והקריאה לפעולה. לאחר מכן הצע לי 5 שינויים קונקרטיים לדף שלי, כל אחד עם הסבר קצר למה הוא אמור לעבוד טוב יותר.
אם אתם מנהלים ארגון או צוות שמריץ כמה תהליכי AI במקביל ורוצה למפות מחדש מה כדאי להריץ על איזה מודל – אפשר לדבר.
איך גוגל שחזרה בווידאו רגע שאף מצלמה לא תפסה
ב-2 באוגוסט 1959 פלה בעט את השער הכי יפה בקריירה שלו, ואף מצלמה לא הייתה שם. גוגל דיפמיינד בילתה חודשים בארכיונים כדי…
Emergent הפך ליוניקורן — ומה זה אומר לעסק שלכם
סטארטאפ הודי של שני אחים תאומים גייס 130 מיליון דולר ונסק לשווי 1.5 מיליארד תוך חצי שנה — ברגע שסוכן AI כותב…
Reflect: הפיצ'ר החדש שמראה לכם כמה אתם תלויים בקלוד
אנתרופיק בנתה דשבורד שסופר לכם כל שיחה עם קלוד ומראה בדיוק כמה זמן השקעתם בו - אבל מאחורי מסך ה'מיינדפולנס' מסתתרת אסטרטגיית…