ב־30 שניות

  • Anthropic אומרת ש-Opus 5.5 מגיע לביצועי Fable 5.1 ברוב המשימות ועולה 40% פחות להרצה מ-Opus 5.
  • המחיר ב-API הוא 4 דולר למיליון טוקני קלט ו-20 דולר למיליון טוקני פלט, והמודל זמין ב-AWS, Google Cloud, Azure ו-GitHub Copilot.
  • המעבר אינו drop-in מלא: תיעוד Anthropic מפרט שינויים ב-thinking, forced tool use, computer use ומבנה התשובה.
ההקשר של מערכת AI NEWS IL

מה חשוב להבין

הזמינות והמחיר אומתו מול Anthropic, AWS ו-GitHub ובדיווחי TechCrunch ו-The Verge. טענות היעילות והביצועים הן נתוני ספק; אין כאן אימות עצמאי ל-40% חיסכון בכל workload.

מה Anthropic השיקה

Anthropic הציגה את Claude Opus 5.5 כחבר הראשון במשפחת 5.5. לפי החברה, הוא מגיע לרמת Claude Fable 5.1 ברוב העבודה ועולה 40% פחות להרצה מ-Opus 5 במשימות טיפוסיות.

המודל זמין ב-Claude API בשם claude-opus-5-5, וכן ב-AWS, Google Cloud ו-Microsoft Azure. AWS ו-GitHub פרסמו הודעות זמינות נפרדות, ו-GitHub מציעה אותו למנויי Copilot בתוכנות הפיתוח ובסוכן הענן.

המחיר והביצועים דורשים בדיקה נפרדת

Anthropic מפרסמת מחיר של 4 דולר למיליון טוקני קלט ו-20 דולר למיליון טוקני פלט. TechCrunch ו-The Verge דיווחו על ההשקה ועל טענת החיסכון, אך נתוני היעילות וה-benchmarks מגיעים בעיקר מהספק ומכרטיס המודל.

לכן אין להסיק שעלות כל משימה תרד ב-40%. סוכן עשוי להשתמש בפחות טוקנים אך לבצע יותר קריאות כלים, או להפך. הבדיקה הנכונה היא עלות למשימה מוצלחת, כולל retry, latency ועבודת תיקון אנושית.

ארבע נקודות תאימות לפני מעבר

תיעוד Anthropic מציין שב-Opus 5.5 אי אפשר לכבות thinking, ש-forced tool use מחזיר שגיאה, וש-blocks של thinking קשורים למודל ולשיחה. בנוסף, ב-Claude API וב-Google Cloud לא מתקבלת גרסת computer use הישנה computer_20251124.

גם מבנה התשובה משתנה: טקסט בין קריאות כלים עשוי להופיע בתוך thinking blocks ולהיות ריק בהגדרת display ברירת המחדל. ממשק שמציג את הטקסט הזה כעדכון התקדמות עלול להיראות שקט בלי שנוצרה תקלה.

הקשחת סייבר והמשמעות לארגון

The Verge מדווחת ש-Anthropic הוסיפה שכבת safeguards לבקשות סייבר מורכבות. במקרים מסוימים המשתמש עשוי להידרש לאישור נוסף, והחברה מציגה זאת כאמצעי לצמצום שימוש לרעה בלי לחסום עבודה לגיטימית.

ארגון צריך לבדוק מה קורה במשימות red-team, ניתוח קוד זדוני ותגובה לאירוע: האם הבקשה נעצרת, האם יש מסלול אישור, ומה נרשם בלוגים. יש להפריד בין יכולת המודל לבין מדיניות הגישה בפועל בכל ספק ענן.

למה זה חשוב

המשמעות שמעבר לכותרת

השקה של מודל חזק וזול יותר יכולה לשנות בחירת ספק ועיצוב סוכנים, אבל מחיר לטוקן לבדו אינו עלות משימה. שינויי API והגבלות סייבר משפיעים על תאימות, ניטור וחוויית משתמש ולכן דורשים ניסוי מבוקר.

מה עושים עכשיו?

צעד יישומי אחד

לפני החלפה, הריצו סט משימות אמיתי מול Opus 5 ו-5.5, מדדו איכות, זמן, מספר צעדים ועלות כוללת. בדקו במיוחד flows שמכבים thinking, כופים tool call, משתמשים ב-computer use או מציגים טקסט בין קריאות כלים.

מקורות ובדיקת עובדות

גילוי AI ושקיפות: כלי AI עשויים לסייע בניטור, תרגום, טיוטה ויצירת איור. ברשומת האתר אין לגרסה זו אישור אנושי מתועד; שם הכותב או המערכת מציין ייחוס תוכן ואינו מוצג כחותמת אישור. המקורות מוצגים לעיון ואפשר לדווח על טעות למערכת.
על המערכת

מערכת AI NEWS IL

שם מערכת לתוכן שנאסף או נוסח בסיוע אוטומציה. הפריטים עשויים להסתמך על מקורות ראשוניים ועיתונאיים גלויים; בכל עמוד מוצגת רשימת המקורות ומצב האישור האנושי המתועד של אותה גרסה.

לפריטים המשויכים ל־מערכת AI NEWS IL
מצאתם טעות? שלחו דיווח למערכת