ב־30 שניות
- Haiku 5.5 מיועד לפי Anthropic למשימות קצרות ורבות, וזמין גם ב-AWS ובפתיחה הדרגתית ב-Copilot.
- מחיר הבסיס ב-Claude Platform חל עד 100 אלף טוקנים בקלט; מעל הסף המחיר בקלט ובפלט עולה פי חמישה.
- מאמץ חשיבה גבוה, מנגנון טוקנים חדש והיקף הפלט יכולים לשנות את העלות למשימה; שיפור במדד אינו ניצחון בכל עבודה.
מה חשוב להבין
מבוסס על הודעת Anthropic, הערכת Artificial Analysis ודיווחי Simon Willison, AWS ו-GitHub. הנתונים מיוחסים למפרסמים; לא ביצענו מבחן עצמאי או בדיקת זכאות בחשבון.
מודל קטן למשימות קצרות, עם מדרגת מחיר ברורה
Anthropic הציגה ב-7 באוקטובר את Claude Haiku 5.5, מודל שמיועד לפי החברה למשימות רבות, קצרות ורגישות לעלות: סיכום, מיון, שאילתות ושלבי עבודה מוגדרים בתוך תהליך גדול. החברה מדגישה מהירות ושיפור מול Haiku 4.5. אין בכך הבטחה שהמודל מתאים לכל החלטה עסקית או שהוא מחליף את Sonnet ו-Opus במשימות מורכבות.
ב-Claude Platform המחיר לבקשות עם קלט של עד 100 אלף טוקנים הוא 0.10 דולר למיליון טוקנים בקלט ו-0.50 דולר למיליון טוקנים בפלט. מעל הסף, המחירים הם 0.50 דולר בקלט ו-2.50 דולר בפלט: פי חמישה. טוקן הוא יחידת טקסט לחישוב, ולא מילה או עמוד קבועים.
המחיר הנמוך מתאים במיוחד לבקשות קצרות. חלון הקשר גדול אינו אומר שכל שימוש בו נשאר במחיר הבסיס. ארגון שמסכם מסמכים ארוכים צריך לבדוק את גודל הקלט ואת כמות הפלט, ולא להשוות כלים רק לפי מחיר התחלתי למיליון טוקנים.
פחות במחיר לטוקן, לא בהכרח אותה הנחה למשימה
החברה אומרת ש-Haiku 5.5 עולה בממוצע כ-75% פחות להפעלה לעומת 4.5. ההערה בהודעה מפרידה בין מחיר הנמוך ב-90% לבקשות עד הסף לבין מחיר הנמוך ב-50% מעליו, ומביאה בחשבון שינוי במספר הטוקנים שמשימה צורכת. אלה חישובי החברה, לא חיסכון שנמדד אצל כל לקוח.
Haiku 5.5 משתמש במנגנון חלוקת טקסט לטוקנים מעודכן. סיימון וויליסון מדווח שהקלט הארוך שבדק הפך לכ-25% יותר טוקנים לעומת 4.5. זו התנסות מסוימת שלו, לא יחס קבוע לכל שפה או מסמך. הנחה במחיר ליחידה אינה זהה להנחה בעלות של עבודה שלמה.
Artificial Analysis מציין שמחירי העלות הזמניים באתר שלו עדיין אינם כוללים את מדרגת המחיר מעל 100 אלף טוקנים. לכן אין להשתמש בהם כאומדן שלם לבקשות ארוכות. צריך לכלול גם חזרות, שימוש בכלים וזמן תיקון אנושי.
מאמץ חשיבה גבוה יכול לשנות את החשבון
זהו מודל Haiku הראשון עם הגדרת מאמץ מתכווננת. לפי Anthropic, אפשר לבחור איזון בין עלות ליכולת. לפי Artificial Analysis, ברמת מאמץ מרבית הוא מקבל 43 במדד Intelligence Index, לעומת 17 לדור Haiku הקודם ו-56 ל-Sonnet 5.5 במאמץ מרבי. אלה נתוני ההערכה של הגוף המפרסם, ולא בדיקה שערכנו.
Artificial Analysis מדווח שבמאמץ מרבי Haiku 5.5 משתמש בכ-162 אלף טוקנים בפלט למשימת מדד, לעומת כ-50 אלף ל-GPT-6 Luna במאמץ מרבי. במאמץ גבוה Haiku מקבל 38 עם כ-55 אלף טוקנים, מול 38 עם כ-50 אלף אצל Luna. אלה תוצאות במסלול הבדיקה, לא תחזית לכל משימה של לקוח.
הנתונים מראים למה ״מודל מהיר וזול״ אינו הבטחה שכל הגדרה תהיה מהירה או זולה באותה מידה. וויליסון מתאר יצירת איור במאמץ מרבי שנמשכה יותר מחמש דקות. בדיקת ציור אחת אינה מבחן מקיף, אך היא ממחישה את הצורך למדוד את ההגדרה שבה מתכוונים לעבוד.
שיפור במדדים, לצד פערים וסירובים
בהודעת Anthropic מופיעים 39.2% במבחן Terminal-Bench 4.0, בעוד Artificial Analysis מדווח על 33% בבדיקה שלו. אלה תוצאות של הערכות נפרדות; אין להציג אותן כנתון אחיד או לבחור את הגבוה בלי לציין מי מדד. בשתי ההערכות הדור הקודם מופיע עם אפס באותו מבחן.
Artificial Analysis מציין שבמבחן AutomationBench-AA המודל קיבל 35%, ושבעיית סירוב-יתר בבדיקות המוקדמות כנראה פגעה בציון. הגוף אומר שיבדוק מחדש לאחר תיקון. אין לראות בציון עתידי צפוי תוצאה שכבר הושגה, ואין להסיק ממנו ששימוש אוטומטי בכל אתר יהיה אמין.
Anthropic אומרת שהגנות הסייבר של Haiku 5.5 מחמירות מאלה של 4.5 ושחלק ממשימות בדיקת החדירה חסומות. גישה לכלי או למודל אינה אישור לבדוק מערכת של צד אחר. משימות ארגוניות עדיין צריכות הרשאות מוגדרות, נתונים מתאימים ובדיקת תוצאה לפני פעולה חיצונית.
AWS ו-Copilot: ההרשאות והפתיחה אינן זהות
Anthropic אומרת שהמודל זמין ב-Claude Platform ובפלטפורמות ענן ובהן AWS, Google Cloud ו-Microsoft Azure. AWS מפרטת זמינות ב-Bedrock דרך פרופילי הסקה אזוריים וגלובליים ומציינת הרשאות חשבון ו-IAM. אין להסיק מהכרזה כללית שהמודל פתוח בכל חשבון או בכל אזור שבחרתם.
GitHub הודיעה על זמינות כללית ב-Copilot למנויי Pro, Pro+, Max, Business ו-Enterprise, אבל מדגישה פתיחה הדרגתית. מנהלי Business ו-Enterprise יכולים לנהל גישה דרך מדיניות המודלים. העובדה שהמודל הוכרז אינה עוקפת החלטה ארגונית או מבטיחה שהוא כבר מופיע בבורר שלכם.
לפי GitHub, החיוב הוא לפי מחירון הספק במסגרת חיוב מבוסס שימוש. אל תניחו שמחיר המנוי עצמו מכסה כל שימוש במודל. בדקו את מסלול החשבון ואת תנאי החיוב בפלטפורמה שבה מתבצעת העבודה.
הרחבות תמחור נוספות אינן כסף שכבר נמצא בחשבון
במקביל Anthropic הודיעה על הורדת מחיר קריאת מטמון של Sonnet 5.5 מ-0.20 ל-0.10 דולר למיליון טוקנים. החברה מעריכה שהשינוי מפחית בכ-20% את העלות ברוב עבודות הסוכנים שלה. זו הערכה התלויה בשימוש במטמון, לא הנחה אחידה לכל בקשה.
החברה גם מבטיחה לפתוח במהלך השבוע זיכוי API חודשי למנויי Max ו-Team: 100 דולר ל-Max 5x, 200 דולר ל-Max 20x ועד 500 דולר משותפים למשתמשי Team. ״עד״ ו״במהלך השבוע״ חשובים כאן: לא בדקנו יתרה, זכאות או תנאים בחשבון של קורא, ואין להציג את הזיכוי כסכום שכבר זמין לכולם.
להחלטה מעשית, בחרו משימה מוגדרת עם דוגמאות שאינן רגישות, השוו תוצאה ועלות כוללת לכלי הנוכחי ובדקו היכן צריך מודל חזק יותר. Haiku 5.5 מוסיף אפשרות זולה יותר למשימות קטנות; מחיר ההקשר הארוך והמאמץ, תיקון טעויות והרשאות נשארים חלק מהבחירה.
המשמעות שמעבר לכותרת
מחיר נמוך יכול לאפשר יותר סיכומים ומיון, אבל ארגון צריך לבדוק עלות של תוצאה תקינה ולא רק מחיר לטוקן. מדרגת ההקשר והגדרת המאמץ חשובות במיוחד בעבודה עם מסמכים ארוכים.
צעד יישומי אחד
בדקו משימה קצרה על חומר לא רגיש, עם מאמץ שמתאים לה. מדדו את הטוקנים, זמן התיקון והדיוק; אל תניחו שהזיכוי החדש כבר פעיל בחשבון או שהפתיחה ב-Copilot הושלמה.
שאלות נפוצות
מה המחיר של Haiku 5.5?
ב-Claude Platform עד 100 אלף טוקנים בקלט:0.10 דולר בקלט ו-0.50 דולר בפלט למיליון טוקנים. מעל הסף:0.50 ו-2.50 דולר בהתאמה.
האם ההנחה למשימה היא תמיד 90%?
לא. מדרגת המחיר, מספר הטוקנים, מאמץ החשיבה ותיקון התוצאה משפיעים על העלות. החברה מדווחת על כ-75% פחות בממוצע.
האם זיכוי API למנויים כבר זמין לכולם?
החברה אומרת שהפתיחה תתבצע במהלך השבוע. לא בדקנו זכאות או יתרה בחשבון אישי.





