Anthropic השיקה את Claude Opus 5 לעבודה ארוכה ורב־שלבית. המחיר הבסיסי לא השתנה, אך מבחן עצמאי מראה שהביצועים הגבוהים מגיעים עם זמני ריצה ארוכים.
Anthropic השיקה ב־24 ביולי את Claude Opus 5, דגם חדש שמיועד בעיקר למשימות תוכנה, מחקר ועבודה משרדית שנמשכות לאורך צעדים רבים. הדגם זמין ב־Claude, ב־Claude Code וב־API תחת השם claude-opus-5. מחיר הבסיס נשאר זהה לזה של Opus 4.8: חמישה דולר למיליון טוקנים בקלט ו־25 דולר למיליון טוקנים בפלט.
מה השתנה בפועל
החידוש השימושי ביותר למפתחים הוא בחירה בין חמש רמות מאמץ. רמה נמוכה צורכת פחות זמן וטוקנים, ורמת max מאפשרת לדגם לבצע יותר סבבים של בדיקה ותיקון. Anthropic מציגה את Opus 5 כדגם שמסוגל להחזיק רצף עבודה ארוך, לאתר כשל בשורש שלו ולוודא שהתוצאה עובדת לפני מסירה. לצד ההשקה נוספו בבטא שתי יכולות API: שינוי רשימת הכלים הזמינים באמצע שיחה בלי לבטל את מטמון הפרומפט, והעברה אוטומטית לדגם חלופי כאשר מסווג בטיחות חוסם בקשה.
יש גם מצב Fast, שמספק לפי החברה מהירות גבוהה בערך פי 2.5, במחיר כפול מהתעריף הבסיסי. המשמעות היא שאין לדגם מחיר אחד במובן התפעולי. העלות תלויה ברמת המאמץ, במשך המשימה ובבחירה אם להפעיל את המסלול המהיר.
הבדיקה העצמאית מוסיפה הקשר
Artificial Analysis בדקה מראש את כל חמש רמות המאמץ במבחן AA-Briefcase שלה, שמודד ביצוע משימות ידע מורכבות על בסיס אלפי קבצים. ברמת max הגיע Opus 5 לציון 1,720 Elo, 146 נקודות מעל Claude Fable 5, בעלות ממוצעת של 17.79 דולר למשימה. ברמת high הוא עדיין עבר את Fable 5 במבחן הזה, בעלות של 10.41 דולר למשימה.
המספרים האלה שייכים למבחן קנייני אחד, ולכן הם אינם תחליף לבדיקה על קוד ונתונים אמיתיים של ארגון. הם כן חושפים מחיר נסתר: שלוש רמות המאמץ הגבוהות נמשכו בממוצע יותר מ־25 דקות למשימה. ברמת max הממוצע היה 36.2 דקות ו־103 סבבי פעולה. צוותים שמכניסים את הדגם לצינור פיתוח צריכים למדוד גם זמן המתנה, שיעור הצלחה חוזר ועלות תיקון אנושי, ולא להסתפק במחיר לטוקן.
למי זה משנה
עבור מפתחים, הבחירה המעניינת היא פחות בין שמות דגמים ויותר בין סוגי משימות. תיקון קטן או חיפוש מהיר לא בהכרח מצדיקים רמת מאמץ גבוהה. מיגרציה גדולה, איתור תקלה חמקמקה או הפקת מסמך שמחייב הצלבה בין מקורות עשויים ליהנות מהסבלנות הנוספת. ארגונים יוכלו לבנות מדיניות ניתוב: משימות רגילות לרמה בינונית, ומשימות יקרות או רגישות למסלול עמוק עם בדיקות אנושיות.
Anthropic פרסמה גם תוצאות בטיחות פנימיות ולפיהן Opus 5 נמצא מאחורי Mythos 5 ביכולות ביולוגיות והתקפיות בסייבר. אלה נתוני החברה, ועדיין חסרה הערכה חיצונית רחבה של ההתנהגות בעולם האמיתי. גם הטענה ליכולת עבודה ממושכת צריכה להיבדק לאורך שבועות, במיוחד במאגרים גדולים שבהם שינוי נכון מקומית עלול ליצור נזק במקום אחר.
מקורות
- Anthropic24.7.2026
- Artificial Analysis24.7.2026
VibeTech
כתב/ת טכנולוגיה ב-VibeTech

