[ ARTICLE · 18.07.2026 ]

Claude Sonnet 5: הקשר של מיליון טוקנים, וה'מס הטוקנייזר' הסמוי שמאחורי הנחת המחיר

ב-30 ביוני 2026 הודיעה אנתרופיק על Claude Sonnet 5, הדור החדש בקו המודלים המאוזן שלה מבחינת מחיר-לביצועים, ותוך פחות משבוע הוא כבר הפך לברירת המחדל ב-Claude Code עבור מושבי Pro, Team Standard ו-Enterprise (החל מגרסה v2.1.197), ולברירת המחדל למנויי Free ו-Pro באתר Claude.ai. זה לא מודל שיושק בשקט - הוא הוגדר במפורש כמודל שאמור לצמצם את הפער מול Opus 4.8 היקר יותר, תוך שהוא נשאר במחיר של Sonnet. אבל כמו שקורה לא פעם עם הכרזות שיווקיות סביב מודלי AI, הפרטים הטכניים שמתחת לכותרת מספרים סיפור מורכב יותר - ובמקרה הזה, מי שחשף את זה הוא לא אנתרופיק עצמה אלא בודק עצמאי.

מה חדש בפועל: הקשר, פלט וחשיבה אדפטיבית

השינוי הבולט ביותר במפרט הטכני הוא חלון ההקשר: Sonnet 5 תומך כברירת מחדל - וגם כמקסימום - בחלון של מיליון טוקנים, בלי גרסת 'חלון קטן' נפרדת כפי שהיה קיים לדורות קודמים. לצד זה, המודל תומך בעד 128 אלף טוקני פלט מקסימליים, וחשיבה אדפטיבית (adaptive thinking) פועלת כברירת מחדל - כלומר המודל מקצה יותר 'מחשבה' באופן דינמי למשימות שדורשות זאת, בלי שהמפתח צריך להפעיל זאת במפורש. אנתרופיק מתארת שיפור מהותי ביחס לגרסה הקודמת, Sonnet 4.6, בתחומי קידוד, נימוק, שימוש בכלים ועבודת ידע כללית, וטוענת שהביצועים מתקרבים לאלו של Opus 4.8 - המודל היקר והמתקדם יותר בקו המוצרים - במחיר נמוך משמעותית.

בהודעה הרשמית מתוארת המטרה של Sonnet 5 בבירור: 'שכבת ביצוע חזקה לעבודת הנדסת תוכנה רב-שלבית' - כלומר מודל שמכוון בעיקר לזרימות עבודה אגנטיות, שבהן סוכן AI מתכנן, מריץ כלים, מנפה שגיאות ומתקן את עצמו לאורך זמן, ולא רק עונה על שאלה בודדת. אנתרופיק מציגה אותו כ'המודל הכי אגנטי בקו ה-Sonnet' עד כה.

מבחינת עלות בפועל, אנתרופיק לא מסתפקת רק בהודעה על מחיר לטוקן: היא מציינת שאפשר לחסוך נוסף באמצעות prompt caching (שמירת חלקים חוזרים של הפרומפט כדי לא לשלם עליהם בכל קריאה מחדש) ועיבוד batch (הרצת כמות גדולה של בקשות באצווה, בתעריף מוזל, כשאין צורך בתשובה מיידית). אלה כלים שקיימים כבר לדורות מודלים קודמים, אבל הופכים משמעותיים יותר במיוחד לאור הממצא של ויליסון שמתואר בהמשך - אם הטוקנייזר החדש מייצר יותר טוקנים לאותו תוכן, שמירה על הקשר קבוע בין קריאות דרך caching יכולה לקזז חלק ניכר מהעלות הנוספת.

אינטגרציה כהחלפה ישירה - עם תפס קטן

מבחינת מפתחים שכבר בנו על Sonnet 4.6, אנתרופיק מציגה את Sonnet 5 כהחלפה ישירה (drop-in): פשוט משנים את מזהה המודל בקריאות ה-API, בלי צורך לבנות מחדש את שאר האינטגרציה. ב-Claude Code, המעבר עוד יותר פשוט - אפשר לבחור אותו מתפריט הבחירה או פשוט להריץ את הפקודה /model claude-sonnet-5 בתוך כל שיחה קיימת.

אבל 'החלפה ישירה' לא אומר 'זהה מבחינת עלות בפועל' - וכאן נכנס הממצא המעניין באמת של השבוע הראשון להשקה.

המס הסמוי: מה חשף סיימון ויליסון בטוקנייזר

סיימון ויליסון, מפתח ובלוגר טכני מוכר שעוקב בעקביות אחרי מודלי שפה גדולים, לא הסתפק בהודעה הרשמית - הוא פנה ישר לתיעוד הטכני, ולדבריו זה נותן 'מידע הרבה יותר שמיש' ממה שמופיע בהכרזה השיווקית. הבדיקה שהוא ביצע, באמצעות הכלי שלו למניית טוקנים, השוותה כמה טוקנים מייצר הטוקנייזר החדש של Sonnet 5 מול הטוקנייזר של הדור הקודם, על אותם מסמכים אמיתיים בדיוק - כולל ההצהרה לכל באי כוח האדם בכמה שפות, וקטעי קוד פייתון אמיתיים.

התוצאה: הטוקנייזר החדש מייצר משמעותית יותר טוקנים לאותו תוכן בדיוק - בערך פי 1.4 לטקסט אנגלי, פי 1.33 לספרדית, ופי 1.28 לקוד פייתון. במנדרינית פשוטה ההבדל כמעט ולא קיים. המשמעות המעשית: אם אנתרופיק מציגה ירידה במחיר לטוקן - מ-3/15 דולר ל-2/10 דולר למיליון בתקופת ההיכרות - אבל כל בקשה זהה עכשיו 'עולה' יותר טוקנים כדי לייצג את אותו תוכן, ההנחה בפועל על העלות הכוללת קטנה בהרבה ממה שהמספרים לבד מרמזים - ולפעמים, לפי הניתוח של ויליסון, Sonnet 5 יוצא בפועל יקר יותר מהמחיר המפורסם היה גורם לצפות. ויליסון מציין גם שינוי טכני נוסף: ה-API הסיר תמיכה בפרמטרים מוכרים לדגימה כמו temperature ו-top_p שהיו זמינים בגרסאות קודמות.

בטיחות סייבר ומיצוב רגולטורי

מעבר לשאלת המחיר, אנתרופיק מדגישה גם היבט בטיחותי: לדבריה, ל-Sonnet 5 יש שיעור נמוך יותר של התנהגויות בלתי רצויות בהשוואה ל-Sonnet 4.6, וכולל אמצעי הגנת סייבר מופעלים כברירת מחדל. אבל יש כאן ניואנס שוויליסון טורח להצביע עליו: הביצועים של Sonnet 5 במשימות סייבר מסוכנות נמוכים משמעותית לעומת מודלי Opus. הוא מפרש את השילוב הזה - יכולת קידוד גבוהה מאוד, לצד יכולת סייבר-פוגעני מוגבלת בכוונה - כמהלך שמאפשר לאנתרופיק לקבל מיצוב רגולטורי נוח יותר עבור המודל, בהשוואה למודלים מתקדמים ומסוכנים יותר פוטנציאלית כמו Mythos.

מה זה אומר בפועל למפתחים

השורה התחתונה עבור מי ששוקל לעבור ל-Sonnet 5, בין אם דרך Claude Code ובין אם דרך ה-API ישירות: השדרוג בחלון ההקשר וביכולות האגנטיות אמיתי ומורגש, וההחלפה הטכנית קלה במיוחד. אבל לפני שסומכים על הכרזת המחיר בלבד לצורך תכנון תקציב, כדאי להריץ בדיקת עלות אמיתית על התוכן הספציפי שלכם - קוד, פרומפטים, מסמכים - ולא להניח שירידת המחיר המוצהרת לטוקן מתורגמת אוטומטית לירידה זהה בעלות הכוללת. זה בדיוק סוג הפער שקל לפספס כשקוראים רק את כותרת ההכרזה.

מקורות

נקודות עיקריות

  • Claude Sonnet 5 יצא ב-30 ביוני 2026 עם חלון הקשר קבוע של מיליון טוקנים (זהו גם ברירת המחדל וגם המקסימום - אין גרסת חלון קטן יותר) ועד 128 אלף טוקני פלט
  • המודל הפך לברירת המחדל עבור מנויי Free ו-Pro באתר Claude.ai, וגם עבור מושבי Pro, Team Standard ו-Enterprise ב-Claude Code, החל מגרסה v2.1.197
  • מחיר היכרות של 2 דולר למיליון טוקני קלט ו-10 דולר למיליון טוקני פלט תקף עד 31 באוגוסט 2026, ואז עולה למחיר הרגיל של 3 דולר/15 דולר למיליון
  • אנתרופיק מתארת שיפור משמעותי לעומת Sonnet 4.6 בקידוד, נימוק, שימוש בכלים ועבודת ידע, עם ביצועים שמתקרבים ל-Opus 4.8 במחיר נמוך משמעותית
  • בדיקה עצמאית של סיימון ויליסון חשפה שהטוקנייזר החדש מייצר כ-1.4 פי יותר טוקנים לטקסט אנגלי, כ-1.33 לספרדית וכ-1.28 לקוד פייתון בהשוואה לגרסה הקודמת - מה שמייצר עלייה סמויה במחיר בפועל למרות ההנחה המוכרזת
  • המודל כולל בטיחות סייבר מוגברת כברירת מחדל, עם ביצועים נמוכים משמעותית ממודלי Opus במשימות סייבר מסוכנות - שילוב שוויליסון מפרש כמהלך למיצוב רגולטורי
  • המעבר ל-Sonnet 5 מתואר כהחלפה ישירה (drop-in) ל-Sonnet 4.6, כך שמפתחים יכולים לשנות את מזהה המודל בלי לבנות מחדש את האינטגרציה הקיימת שלהם

שאלות נפוצות

מתי Claude Sonnet 5 יצא ומה חלון ההקשר שלו?

Claude Sonnet 5 יצא ב-30 ביוני 2026. חלון ההקשר שלו הוא מיליון טוקנים קבוע - זהו גם ברירת המחדל וגם המקסימום, ואין לו גרסה עם חלון קטן יותר כפי שהיה למודלים קודמים. הוא תומך גם עד 128 אלף טוקני פלט מקסימליים, וחשיבה אדפטיבית (adaptive thinking) פועלת כברירת מחדל.

כמה עולה Claude Sonnet 5 ואיפה הוא זמין?

מחיר היכרות של 2 דולר למיליון טוקני קלט ו-10 דולר למיליון טוקני פלט תקף עד 31 באוגוסט 2026, ואז המחיר עולה ל-3 דולר/15 דולר למיליון - עם אפשרות לחיסכון נוסף דרך prompt caching ועיבוד batch. המודל הפך לברירת מחדל למנויי Free ו-Pro ב-Claude.ai, וזמין גם למנויי Max, Team ו-Enterprise, ל-Claude Code (כברירת מחדל למושבי Pro, Team Standard ו-Enterprise), ול-Claude Platform (ה-API).

מה זה 'מס הטוקנייזר' שסיימון ויליסון מדבר עליו?

ויליסון בדק את הטוקנייזר החדש של Sonnet 5 מול הישן, והשוואה על מסמכים אמיתיים (כמו ההצהרה לכל באי כוח האדם בשפות שונות וקוד פייתון) הראתה שהטוקנייזר החדש מייצר משמעותית יותר טוקנים לאותו תוכן: כ-1.4 פי לטקסט אנגלי, כ-1.33 לספרדית וכ-1.28 לקוד פייתון, כשלמנדרינית פשוטה כמעט אין הבדל. המשמעות היא שגם אם המחיר הרשמי לטוקן ירד, מכיוון שכל בקשה עכשיו 'שוברת' לטוקנים רבים יותר, העלות בפועל על אותו תוכן יכולה להיות גבוהה יותר ממה שהמחיר המוכרז מרמז - ולכן ויליסון קורא לזה 'מס טוקנייזר' סמוי.

האם Claude Sonnet 5 הוא החלפה ישירה ל-Sonnet 4.6?

כן, אנתרופיק מתארת אותו כהחלפה ישירה (drop-in replacement) ל-Sonnet 4.6 - כלומר מפתחים יכולים לשנות את מזהה המודל בקריאות ה-API הקיימות שלהם בלי לבנות מחדש את האינטגרציה. עם זאת, כדאי לשים לב שה-API כבר לא תומך בפרמטרים מסוימים לדגימה כמו temperature ו-top_p שהיו זמינים בגרסאות קודמות, לפי הבדיקה של סיימון ויליסון.

מה ההבדל בהתנהגות הבטיחותית בין Sonnet 5 לדגמי Opus?

לפי אנתרופיק, ל-Sonnet 5 יש שיעור נמוך יותר של התנהגויות בלתי רצויות בהשוואה ל-Sonnet 4.6, וכולל אמצעי הגנת סייבר מופעלים כברירת מחדל. יחד עם זאת, הביצועים שלו במשימות סייבר מסוכנות נמוכים משמעותית לעומת מודלי Opus - הבדל שסיימון ויליסון מציין כמהלך שמאפשר לאנתרופיק לקבל מיצוב רגולטורי נוח יותר עבור Sonnet 5 ביחס למודלים מתקדמים יותר כמו Mythos.