- מה: Claude Sonnet 5.5, המודל האמצעי במשפחת Claude 5.5, הושק ב-28 בספטמבר 2026. מזהה API: claude-sonnet-5-5.
- מחיר: 2 דולר קלט, 10 דולר פלט, 0.20 דולר קריאת מטמון למיליון טוקנים. זהה ל-Sonnet 5.
- מהירות ועלות: פלט מהיר ב-30% ומעלה, ועד 30% פחות עלות למשימה ברוב העבודה ברמת מאמץ בינונית.
ב-Sonnet 5.5 אי אפשר יותר לכבות חשיבה. בקשה עם thinking מסוג disabled מחזירה שגיאת 400, והתחליף הוא הגדרה חדשה בשם between_tools: המודל לא חושב לפני התשובה, רק בין קריאה לכלי לקריאה הבאה. לפי אנתרופיק, זמן התגובה הכולל נשאר זהה או קצר יותר.
אנתרופיק השיקה את Claude Sonnet 5.5, והמחיר שלו לא זז בסנט: 2 דולר למיליון טוקני קלט, 10 דולר לפלט.
ובכל זאת, לפי אנתרופיק, משימה ממוצעת תעלה לכם עד 30% פחות מאשר ב-Sonnet 5, והפלט יגיע מהר ב-30%.
וזה בכלל לא החלק שהכי ישפיע על מי שכבר עובד עם Sonnet. החלק הזה נמצא בתיעוד למפתחים, ומי שידלג עליו יגלה אותו דרך שגיאת 400.
בקצרה
- מה: Claude Sonnet 5.5, המודל האמצעי במשפחת Claude 5.5, הושק ב-28 בספטמבר 2026. מזהה API:
claude-sonnet-5-5. - מחיר: 2 דולר קלט, 10 דולר פלט, 0.20 דולר קריאת מטמון למיליון טוקנים. זהה ל-Sonnet 5.
- מהירות ועלות: פלט מהיר ב-30% ומעלה, ועד 30% פחות עלות למשימה ברוב העבודה ברמת מאמץ בינונית.
- ביצועים: 70.6% ב-Terminal-Bench 4.0 ו-1844 ב-GDPval-AA, קרוב מאוד ל-Opus 5.5 בחצי מחיר.
- למפתחים: אי אפשר לכבות חשיבה (יש
between_toolsבמקום), אין בחירת כלי כפויה, ובלוקי חשיבה קשורים לשיחה ולחשבון. - מעבר: בקלוד קוד (Claude Code) מריצים
/claude-api migrate.
מה זה Claude Sonnet 5.5?
Claude Sonnet 5.5 הוא מודל שפה של אנתרופיק (Anthropic), השכבה האמצעית במשפחת Claude 5.5. בתיעוד הרשמי הוא מתואר כ"שילוב הטוב ביותר של מהירות ואינטליגנציה". חלון ההקשר שלו מיליון טוקנים, הפלט המקסימלי 128 אלף טוקנים, וסף הידע שלו יוני 2026.
הוא יושב בין Opus 5.5, שיצא שבוע קודם, לבין Haiku 4.5, שעדיין לא קיבל גרסת 5.5. אנתרופיק ממצבת אותו כמשלים מהיר וזול ל-Opus 5.5, לא כמחליף שלו.
אם אתם רוצים את התמונה המלאה של כל המשפחה, ריכזתי את כל המודלים של קלוד בעמוד השוואה אחד.
מה חדש ב-Sonnet 5.5 לעומת Sonnet 5?
ארבעה שינויים מרכזיים: קפיצה ביכולת, פלט מהיר ב-30%, עלות למשימה נמוכה בעד 30%, וכתיבה ברורה יותר. המחיר לטוקן נשאר זהה, כך שכל השיפור מגיע ליעילות ולא לתמחור.
- יכולת: אנתרופיק מגדירה אותו כשדרוג ברור על Sonnet 5, והטבלה למטה מראה שהפער גדול במיוחד בקוד סוכני ובשימוש במחשב.
- מהירות: הפלט מהיר ב-30% ומעלה מ-Sonnet 5, וזה מה שהופך אותו למתאים לעבודה איטרטיבית מהירה.
- עלות: עד 30% פחות למשימה ברוב העבודה ברמת מאמץ בינונית (Medium), בעיקר כי הוא צורך פחות טוקנים ופחות קריאות לכלים.
- כתיבה: לפי אנתרופיק, כמו Opus 5.5 הוא כותב בבהירות רבה יותר מהדור הקודם, ובודקים מוקדמים תיארו אותו כשותף טוב יותר לעבודה משותפת.
מה הביצועים של Sonnet 5.5 מול Sonnet 5 ו-Opus 5.5?
ברוב המדדים Sonnet 5.5 נמצא במרחק של נקודות בודדות מ-Opus 5.5, ובמדד הקוד בטרמינל הוא אף מקדים אותו. מול Sonnet 5 הפער עצום. כל המספרים מתוך עמוד ההכרזה של אנתרופיק:
| מדד | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 (קוד סוכני) | 70.6% | 10.3% | 66.4% |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% |
| FrontierCode 1.1 (מאמץ Xhigh) | 46.2% | 42.4% | 54.4% |
| GDPval-AA v2.1 (עבודת ידע) | 1844 | 1449 | 1846 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 |
| Humanity's Last Exam (עם כלים) | 64.5% | 54.9% | 67.7% |
| OSWorld 2.1 (שימוש במחשב) | 80.1% | 57.0% | 81.8% |
| Chartography (קריאת גרפים, בלי כלים) | 61.6% | 15.6% | 64.4% |
איפה קל לטעות בקריאת הטבלה?
בשורה הראשונה. הקפיצה מ-10.3% ל-70.6% ב-Terminal-Bench נראית כמו טעות הקלדה, אבל כך היא מופיעה בהכרזה הרשמית. מה שכדאי לקרוא הוא את ההערה: הציון של Opus 5.5 (66.4%) מדווח ברמת מאמץ Xhigh, הציון הגבוה ביותר שלו.
כלומר, המסקנה "Sonnet עוקף את Opus בקוד" נכונה למדד אחד בלבד. ב-FrontierCode הפער לטובת Opus הוא 8 נקודות, ושם בדיוק נמצאת העבודה המורכבת שאנתרופיק ממליצה להשאיר לו.
כמה זה חוסך בפועל?
אנתרופיק פרסמה גם השוואות עלות למשימה, וארבע מהן בולטות:
- Terminal-Bench 4.0 במאמץ בינוני: עוקף בהרבה את הציון הטוב ביותר של Sonnet 5, בפחות מעשירית העלות למשימה.
- CursorBench במאמץ נמוך: עוקף את הציון הטוב ביותר של Sonnet 5, בפחות מעשירית העלות.
- AA-Briefcase במאמץ בינוני: מנצח את הציון הטוב ביותר של Sonnet 5 בכתשיעית מהעלות.
- FrontierCode במאמץ גבוה: משתווה לציון הטוב ביותר של GPT-6 Sol בכחמישית מהעלות למשימה.
כמה עולה Claude Sonnet 5.5?
2 דולר למיליון טוקני קלט ו-10 דולר לפלט, בדיוק כמו Sonnet 5. המחירים לפי עמוד התמחור הרשמי, בדולרים למיליון טוקנים:
| Sonnet 5.5 | Sonnet 5 | Opus 5.5 | Haiku 4.5 | Fable 5.1 | |
|---|---|---|---|---|---|
| קלט | $2 | $2 | $4 | $1 | $10 |
| פלט | $10 | $10 | $20 | $5 | $50 |
| כתיבה למטמון (5 דקות) | $2.50 | $2.50 | $5 | $1.25 | $12.50 |
| קריאת מטמון | $0.20 | $0.20 | $0.20 | $0.10 | $0.25 |
| Batch (קלט/פלט) | $1 / $5 | $1 / $5 | $2 / $10 | $0.50 / $2.50 | $5 / $25 |
שתי הערות שחשוב להכיר:
- המחיר של Sonnet 5 נשאר 2/10 לצמיתות. בהשקה הוא הוצג כמחיר היכרות עד 31 באוגוסט, אבל לפי התיעוד העלייה ל-3/15 שתוכננה ל-1 בספטמבר בוטלה.
- קריאת המטמון זהה ב-Sonnet 5.5 וב-Opus 5.5. ב-Opus 5.5 היא 5% ממחיר הקלט, ב-Sonnet 5.5 היא 10%. בפועל שניהם עולים 0.20 דולר.
מתי לבחור ב-Sonnet 5.5, ב-Opus 5.5 או ב-Haiku?
Sonnet 5.5 למשימות מוגדרות היטב שחוזרות על עצמן, Opus 5.5 לעבודה מורכבת שדורשת שיקול דעת, Haiku 4.5 להיקפים גדולים ורגישים לעלות. זו החלוקה שאנתרופיק עצמה מציעה, בתרגום לעבודה יומיומית:
| המשימה | המודל המומלץ | למה |
|---|---|---|
| תיקון באג מוגדר, רפקטור קטן | Sonnet 5.5 | מהיר, זול, ובקוד סוכני קרוב מאוד ל-Opus |
| מסמך, מצגת או גיליון מלוטשים | Sonnet 5.5 | זו בדיוק ההתמחות שאנתרופיק מציינת |
| איטרציות מהירות מול לקוח או צוות | Sonnet 5.5 | פלט מהיר ב-30% מקצר כל סבב |
| ארכיטקטורה, החלטה עם השלכות, ביקורת קוד רחבה | Opus 5.5 | לעבודה שדורשת שיקול דעת זהיר |
| סוכן שרץ שעות על פרויקט ארוך | Opus 5.5 | מיועד לקידוד סוכני ולעבודת ידע ארוכה |
| חשיבה קשה במיוחד, כשגם Opus לא מספיק | Fable 5.1 | ההמלצה של אנתרופיק לעבודה התובענית ביותר |
| סיווג, תיוג, מענה ראשוני בהיקף גדול | Haiku 4.5 | הזול והמהיר ביותר, עד ש-Haiku 5.5 יגיע |
כלל אצבע פשוט: מתחילים ב-Sonnet 5.5, ועוברים ל-Opus 5.5 רק כשהתוצאה לא מספיק טובה. בחצי מחיר, הרבה יותר משתלם לגלות את הגבול מאשר לשלם עליו מראש. לשם ההגינות: בסקירת המודלים הרשמית, אנתרופיק ממליצה למי שלא בטוח להתחיל דווקא מ-Opus 5.5. במשימות מורכבות אני מסכים; בעבודה יומיומית מוגדרת, החשבון נוטה ל-Sonnet.
להשוואה המלאה של Opus 5.5 ומה הוא עושה טוב, כתבתי סקירה נפרדת על Claude Opus 5.5.
מה צריך לדעת לפני שמחליפים? חמשת השינויים השוברים
חמישה שינויים ב-Sonnet 5.5 שוברים קוד שעובד היום על Sonnet 5. אם אתם רק משתמשים בצ'אט או בקלוד קוד, זה לא נוגע לכם. אם בניתם משהו על ה-API, זה החלק החשוב ביותר במאמר. המקור: מה חדש ב-Sonnet 5.5 ומדריך המעבר.
1. אי אפשר לכבות חשיבה: מה זה between_tools?
between_tools היא הגדרת חשיבה חדשה ב-Sonnet 5.5 שמחליפה את כיבוי החשיבה. המודל לא חושב לפני התשובה, אלא רק בין קריאה לכלי לקריאה הבאה. לפי אנתרופיק, זמן התגובה הכולל נשאר זהה או מהיר יותר.
בקשה בלי שדה thinking רצה ב-Sonnet 5.5 עם חשיבה אדפטיבית. בקשה עם disabled מחזירה שגיאת 400:
// לפני (Sonnet 5)
{ "model": "claude-sonnet-5", "thinking": { "type": "disabled" } }
// אחרי (Sonnet 5.5)
{ "model": "claude-sonnet-5-5", "thinking": { "type": "between_tools" } }
שלוש מגבלות של between_tools שכדאי לדעת:
- עובד רק ברמות מאמץ low, medium ו-high. ב-xhigh או max הוא מחזיר שגיאה, ושם צריך חשיבה אדפטיבית.
- לא מקבל שדות נוספים.
displayאוbudget_tokensלצדו מחזירים שגיאה. - רמת המאמץ לא משתנה באמצע שיחה. מי שצריך לשנות מאמץ בין תורות עובר לחשיבה אדפטיבית.
2. אין בחירת כלי כפויה: מה עושים במקום?
tool_choice מסוג any או tool מחזיר שגיאת 400. נתמכים רק auto (ברירת המחדל) ו-none. כדי לקבל קלט שתואם סכמה, משאירים auto ומוסיפים strict: true להגדרת הכלי, או מעבירים את הסכמה ל-structured outputs:
# לפני: tool_choice={"type": "tool", "name": "extract_invoice"}
# אחרי:
response = client.messages.create(
model="claude-sonnet-5-5",
max_tokens=4000,
tools=[{**extract_invoice_tool, "strict": True}],
tool_choice={"type": "auto"},
messages=[{"role": "user", "content": "חלץ את פרטי החשבונית. השתמש בכלי extract_invoice."}],
)
שימו לב לשורה האחרונה: כשאי אפשר לכפות כלי, אומרים למודל בפרומפט מתי להשתמש בו. זו ההמלצה הרשמית.
3. חשיבה שמורה: מה זה אומר לשיחות שלכם?
חשיבה שמורה (Preserved thinking) פירושה שבלוקי החשיבה ש-Sonnet 5.5 מייצר קשורים למודל, לשיחה ולחשבון שיצרו אותם, וצריך להחזיר אותם בדיוק כפי שהתקבלו.
שלושה כללים מעשיים:
- חשבונות API שנוצרו ב-31 באוגוסט 2026 ואילך (Claude API, Bedrock ו-Google Cloud): אם שיניתם משהו שקודם לבלוק חשיבה (ה-system prompt, הכלים או הודעה קודמת), הבקשה תחזיר שגיאת 400. הפתרון: לשמור את השיחה append-only, ולשנות הוראות דרך הודעות system באמצע שיחה.
- החשיבה נשארת בחשבון שיצר אותה. בלוק שנשלח מחשבון אחר נזרק בשקט לפני שהמודל רואה אותו.
- מעבר בין מודלים: Sonnet 5.5 קורא בלוקים של Sonnet 5, אבל אף מודל אחר לא קורא את הבלוקים של Sonnet 5.5.
4. כלי השימוש במחשב הישן לא עובד
ב-Claude API וב-Google Cloud, הכלי computer_20251124 מחזיר שגיאה, ועוברים ל-computer_toolset_20260801. ב-Amazon Bedrock הכלי הישן עדיין מתקבל.
5. שילובי advisor מסוימים נחסמו
מי שמשתמש בכלי ה-advisor (בטא) עם Opus 4.8, Opus 4.7 או Sonnet 5 כיועץ, יקבל שגיאה. Sonnet 5.5 מקבל כיועצים את Opus 5.5, Opus 5, משפחות Fable ו-Mythos, או את Sonnet 5.5 עצמו.
ומה עם הטקסט שנעלם בין קריאות לכלים?
זה לא שינוי שובר, אבל הוא ישבור לכם את הממשק בשקט. הערות שהמודל כותב בין קריאות לכלים חוזרות עכשיו כבלוקי thinking, ובברירת המחדל הטקסט שלהן ריק. אפליקציה שמציגה למשתמש "מה הסוכן עושה עכשיו" פשוט תשתוק. הפתרון: להגדיר thinking.display, או לעבור ל-between_tools, שבו הטקסט חוזר.
מה זה סירוב ומנגנון נפילה (fallback)?
מנגנון נפילה (Fallback) הוא יכולת בטא ב-Messages API: כשמסווג הבטיחות של Sonnet 5.5 מסרב לבקשה בתחום הסייבר, ה-API מנסה אותה אוטומטית על Sonnet 5.
Sonnet 5.5 הוא ה-Sonnet הראשון שהושק עם מסווגי סייבר ומנגנוני נפילה כמו במודלים החזקים של אנתרופיק. בקשות סייבר בסיכון גבוה מקבלות סירוב, אבל לפי אנתרופיק מציאת ותיקון באגים כחלק מפיתוח תוכנה רגיל בדרך כלל לא מושפעים.
סירוב מגיע כתשובה רגילה (HTTP 200) עם stop_reason: "refusal". כדי להפעיל נפילה אוטומטית:
response = client.beta.messages.create(
model="claude-sonnet-5-5",
max_tokens=4000,
messages=[{"role": "user", "content": "..."}],
fallbacks="default",
betas=["server-side-fallback-2026-07-01"],
)
print(response.model) # יראה על איזה מודל הבקשה רצה בפועל
לפי התיעוד, הנפילה האוטומטית מטפלת בסירובים מסוג cyber ו-frontier_llm בלבד. סירובים בתחומי ביולוגיה, חילוץ חשיבה ונזקים כלליים נשארים סירובים.
איך מעבירים פרויקט ל-Sonnet 5.5 בקלוד קוד?
מריצים בקלוד קוד (Claude Code) את הפקודה /claude-api migrate עם שם המודל. הסקיל המובנה עושה את רוב העבודה:
/claude-api migrate this project to claude-sonnet-5-5
מה הסקיל עושה, לפי התיעוד הרשמי:
- שואל על ההיקף לפני שהוא נוגע בקבצים: כל התיקייה, תת תיקייה או רשימת קבצים.
- מחליף את מזהה המודל בכל הקוד.
- מתקן פרמטרים שבורים, כמו
disabledו-tool_choiceכפוי. - מכייל את רמת המאמץ למודל החדש, כי אותה רמה לא מייצרת אותה כמות חשיבה כמו ב-Sonnet 5.
- מזהה לקוחות של Bedrock ו-Claude Platform on AWS ומתאים את פורמט המזהה.
- מפיק רשימת בדיקות ידניות לסיום.
אחרי ההרצה, תריצו את הבדיקות שלכם בשתיים או שלוש רמות מאמץ. אנתרופיק ממליצה להתחיל ב-medium למשימות קוד מוגדרות, ב-high למשימות ארוכות וקשות, וב-medium או low לצ'אט.
ואם עוד לא עבדתם עם קלוד קוד, המדריך המלא לקלוד קוד הוא המקום להתחיל, ומי שבונה על ה-API ימצא הסבר מסודר במדריך ל-Claude API.
איפה Claude Sonnet 5.5 זמין?
בכל הפלטפורמות המרכזיות מהיום הראשון. המזהים לפי סקירת המודלים הרשמית:
| פלטפורמה | מזהה המודל |
|---|---|
| Claude API | claude-sonnet-5-5 |
| Amazon Bedrock | anthropic.claude-sonnet-5-5 |
| Claude Platform on AWS | claude-sonnet-5-5 |
| Google Cloud (Vertex AI) | claude-sonnet-5-5 |
| Microsoft Foundry | claude-sonnet-5-5 |
המודל זמין גם באפליקציות של Claude. רמת המאמץ המוגדרת כברירת מחדל היא בינונית בקלוד קוד ובאפליקציות, וגבוהה ב-API. אנתרופיק מתחייבת לא להוציא אותו משימוש לפני 28 בספטמבר 2027.
מה אומרים מספרי הבטיחות?
לפי אנתרופיק, Sonnet 5.5 משתפר על Sonnet 5 או משתווה לו ברוב המדדים בביקורת ההתנהגות האוטומטית, שכוללת כ-1,850 תרחישים. החברה גם כותבת שלא מצאה ראיות לכך שהמודל רודף אחרי מטרות שמתנגשות בכוונת המשתמש.
- סייבר: היכולות השתפרו מאוד לעומת Sonnet 5, ולכן נוספו מסווגים ונפילה ל-Sonnet 5. מגיני סייבר יכולים להגיש בקשה לתוכנית האימות המורחבת.
- ביולוגיה: אותן הגנות כמו ב-Sonnet 5. רוב המחקר, ההוראה והעבודה הקלינית לא מושפעים, אבל חלק מבקשות המיקרוביולוגיה והווירולוגיה עלולות להיחסם בטעות.
- הגנה מזיקוק: זה ה-Sonnet הראשון עם מסווגים שמונעים חילוץ של תהליך החשיבה.
שווה לומר בכנות: אלה מדידות של היצרן עצמו. אימות חיצוני עצמאי יגיע, אם בכלל, בשבועות הקרובים.
מה זה אומר לעסק שלכם?
החשבון של "איזה מודל להריץ בייצור" השתנה. כש-Sonnet 5.5 מגיע ל-1844 ב-GDPval-AA מול 1846 של Opus 5.5, ועולה חצי, רוב העבודה העסקית השוטפת כבר לא מצדיקה את המודל היקר.
שלוש המלצות מעשיות:
- מסמכים, מצגות וגיליונות: עברו ל-Sonnet 5.5. זו ההתמחות המוצהרת שלו, ו-30% מהירות בכל סבב מצטברים מהר כשצוות עובד עליו כל היום.
- אוטומציות קיימות על Sonnet 5: חשבו מחדש, אבל בדקו לפני. אותו מחיר לטוקן ועד 30% פחות למשימה, רק אם הקוד עבר את חמשת השינויים השוברים. זה בדיוק המקום שבו מעבר חפוז שובר תהליך שעבד.
- השאירו את Opus 5.5 להחלטות שעולות כסף כשהן שגויות. ארכיטקטורה, ניתוח חוזים, ביקורת קוד רחבה. שם 8 נקודות ב-FrontierCode הן לא פרט טכני.
אם אתם רוצים למפות אילו תהליכים בארגון שלכם מתאימים לאיזה מודל, ההרצאות והסדנאות שאני מעביר בארגונים בנויות סביב המיפוי הזה ואם הצוות שלכם עובד עם קלוד קוד, יש גם סדנאות מעשיות לקלוד קוד (Claude Code).
ומה עוד מחכה?
Claude Haiku 5.5 בדרך. אנתרופיק כתבה שהוא מיועד ליישומים בהיקף גבוה ורגישים לעלות, ויצטרף למשפחת 5.5 בשבועות הקרובים. עד אז, Haiku 4.5 ב-1 ו-5 דולר למיליון נשאר האפשרות הזולה.
למי שרוצה לחזור אחורה ולהבין מאיפה Sonnet הגיע, הסקירה שכתבתי על Sonnet 5 בהשקה שלו מראה כמה השתנה בשלושה חודשים. ומי שרוצה להבין למה עברית עולה יותר טוקנים, כתבתי על המודלים והטוקנים בנפרד.
בשורה התחתונה
לפני שנה, מודל שמתקרב לצמרת בחצי מחיר היה נשמע כמו הבטחה שיווקית. היום זו שורה בטבלת התמחור.
השאלה כבר לא "האם להשתמש במודל הזול". השאלה היא איפה בדיוק עובר הגבול שבו Opus מצדיק את עצמו, ואת הגבול הזה כל עסק צריך למדוד על המשימות שלו.
יעקב צדק, מרצה, יועץ ומטמיע AI בארגונים, ומוביל קהילות בתחומי ה-AI, ה-GEO והטמעות AI, עם מעל 150,000 אנשים.
קורס במתנה עם ברכה אישית מכם, מסירה מיידית או בתאריך שתבחרו, וגישה לכל החיים.


