ב־30 שניות
- Anthropic אומרת ש-Opus 5.5 מגיע לביצועי Fable 5.1 ברוב המשימות ועולה 40% פחות להרצה מ-Opus 5.
- המחיר ב-API הוא 4 דולר למיליון טוקני קלט ו-20 דולר למיליון טוקני פלט, והמודל זמין ב-AWS, Google Cloud, Azure ו-GitHub Copilot.
- המעבר אינו drop-in מלא: תיעוד Anthropic מפרט שינויים ב-thinking, forced tool use, computer use ומבנה התשובה.
מה חשוב להבין
הזמינות והמחיר אומתו מול Anthropic, AWS ו-GitHub ובדיווחי TechCrunch ו-The Verge. טענות היעילות והביצועים הן נתוני ספק; אין כאן אימות עצמאי ל-40% חיסכון בכל workload.
מה Anthropic השיקה
Anthropic הציגה את Claude Opus 5.5 כחבר הראשון במשפחת 5.5. לפי החברה, הוא מגיע לרמת Claude Fable 5.1 ברוב העבודה ועולה 40% פחות להרצה מ-Opus 5 במשימות טיפוסיות.
המודל זמין ב-Claude API בשם claude-opus-5-5, וכן ב-AWS, Google Cloud ו-Microsoft Azure. AWS ו-GitHub פרסמו הודעות זמינות נפרדות, ו-GitHub מציעה אותו למנויי Copilot בתוכנות הפיתוח ובסוכן הענן.
המחיר והביצועים דורשים בדיקה נפרדת
Anthropic מפרסמת מחיר של 4 דולר למיליון טוקני קלט ו-20 דולר למיליון טוקני פלט. TechCrunch ו-The Verge דיווחו על ההשקה ועל טענת החיסכון, אך נתוני היעילות וה-benchmarks מגיעים בעיקר מהספק ומכרטיס המודל.
לכן אין להסיק שעלות כל משימה תרד ב-40%. סוכן עשוי להשתמש בפחות טוקנים אך לבצע יותר קריאות כלים, או להפך. הבדיקה הנכונה היא עלות למשימה מוצלחת, כולל retry, latency ועבודת תיקון אנושית.
ארבע נקודות תאימות לפני מעבר
תיעוד Anthropic מציין שב-Opus 5.5 אי אפשר לכבות thinking, ש-forced tool use מחזיר שגיאה, וש-blocks של thinking קשורים למודל ולשיחה. בנוסף, ב-Claude API וב-Google Cloud לא מתקבלת גרסת computer use הישנה computer_20251124.
גם מבנה התשובה משתנה: טקסט בין קריאות כלים עשוי להופיע בתוך thinking blocks ולהיות ריק בהגדרת display ברירת המחדל. ממשק שמציג את הטקסט הזה כעדכון התקדמות עלול להיראות שקט בלי שנוצרה תקלה.
הקשחת סייבר והמשמעות לארגון
The Verge מדווחת ש-Anthropic הוסיפה שכבת safeguards לבקשות סייבר מורכבות. במקרים מסוימים המשתמש עשוי להידרש לאישור נוסף, והחברה מציגה זאת כאמצעי לצמצום שימוש לרעה בלי לחסום עבודה לגיטימית.
ארגון צריך לבדוק מה קורה במשימות red-team, ניתוח קוד זדוני ותגובה לאירוע: האם הבקשה נעצרת, האם יש מסלול אישור, ומה נרשם בלוגים. יש להפריד בין יכולת המודל לבין מדיניות הגישה בפועל בכל ספק ענן.
המשמעות שמעבר לכותרת
השקה של מודל חזק וזול יותר יכולה לשנות בחירת ספק ועיצוב סוכנים, אבל מחיר לטוקן לבדו אינו עלות משימה. שינויי API והגבלות סייבר משפיעים על תאימות, ניטור וחוויית משתמש ולכן דורשים ניסוי מבוקר.
צעד יישומי אחד
לפני החלפה, הריצו סט משימות אמיתי מול Opus 5 ו-5.5, מדדו איכות, זמן, מספר צעדים ועלות כוללת. בדקו במיוחד flows שמכבים thinking, כופים tool call, משתמשים ב-computer use או מציגים טקסט בין קריאות כלים.





