המערכת של YUV.AI

חדשות

Claude Sonnet 5: המודל הזול שהשיג את הדגל - ועדכן בשקט את המחשבון

אנתרופיק שחררה את Claude Sonnet 5, מודל-הביניים החדש שלה, והוא כבר ברירת המחדל בחינם וב-Pro. במבחן של עבודת ידע הוא עקף בנקודה את Opus 4.8, הדגל, בשליש מהמחיר. אבל הטוקנייזר שלו התחלף בשקט, אז מחיר המדבקה הוא לא מחיר הקופה. פירקנו את המספרים.

אהבתם? שתפו
Claude Sonnet 5: המודל הזול שהשיג את הדגל - ועדכן בשקט את המחשבון

אמ;לק

5 הדברים שצריך לדעת

Claude Sonnet 5 (שם ה-API: claude-sonnet-5) יצא ב-30.6.2026 עם חלון הקשר של מיליון טוקנים. במדד עבודת הידע GDPval-AA v2 הוא קיבל 1,618 - נקודה מעל Opus 4.8 (1,615), הדגל היקר פי כמה.

מחיר היכרות עד 31.8.2026: 2 דולר למיליון טוקני קלט, 10 למיליון פלט. אחר כך זה עולה ל-3 ו-15. לשם השוואה: Sonnet 4.6 עולה 3 ו-15, ו-Opus 4.8 עולה 5 ו-25.

Sonnet 5 עבר לטוקנייזר החדש (זה שהוצג עם Opus 4.7). אותו טקסט בדיוק ממופה עכשיו ל-1.0 עד 1.35 יותר טוקנים - כך שמחיר לטוקן ירד, אבל מספר הטוקנים לאותה בקשה עלה. החיסכון האמיתי קטן מהמובטח.

ב-SWE-bench Pro (משימות קוד אמיתיות) הוא קיבל 63.2%, בין Sonnet 4.6 (58.1%) ל-Opus 4.8 (69.2%). ב-Terminal-Bench 2.1 הוא קפץ ל-80.4% מ-67.0% של הדור הקודם.

אנתרופיק מדווחת על שיעור נמוך יותר של התנהגויות לא רצויות מ-Sonnet 4.6, ויכולת סייבר נמוכה משמעותית מ-Opus. הגנות סייבר דלוקות כברירת מחדל.

הכתבה ב־5 שניות · נבנה עם HyperFrames

אנתרופיק שחררה את Claude Sonnet 5, ובמבחן של עבודת ידע הוא כבר לא רק מתקרב ל-Opus 4.8, הדגל היקר שלה - הוא עוקף אותו בנקודה, ומשלמים עליו שליש מהמחיר. המודל (שם ה-API שלו הוא claude-sonnet-5) יצא ב-30 ביוני 2026, והוא כבר מודל ברירת המחדל לכל מי שנכנס ל-claude.ai בחינם או ב-Pro. אבל מתחת לכותרת ה"מהיר וזול" מסתתר פרט אחד ששווה לנו לעצור עליו: המחשבון של הטוקנים התחלף בשקט, ולכן מחיר המדבקה הוא לא מחיר הקופה.

בואו נפרק את זה לאט, כי זה בדיוק סוג ההשקה שקל לפספס בה את מה שבאמת חשוב.

מה זה Sonnet, ולמה דווקא "הביניים" זה המקום המעניין

לאנתרופיק יש שלוש דרגות מודלים, והשמות שלהן עקביים כבר כמה דורות. Haiku הוא הקטן והזריז, זה שרץ כמעט בחינם על משימות פשוטות. Opus הוא הדגל - הכי חכם, הכי יקר, הכי כבד. ו-Sonnet הוא באמצע. Sonnet הוא מודל-הביניים של אנתרופיק, זה שנועד לעשות את רוב העבודה היומיומית: מהיר וזול מספיק כדי להריץ אותו כל היום, חכם מספיק כדי לסמוך עליו. תחשבו על זה כמו על הרכב המשפחתי מול מכונית הספורט: רוב הקילומטרים שלנו נעשים ברכב המשפחתי, לא בפרארי.

הקטע המדליק בהשקה הזו הוא שהפער בין "המשפחתי" ל"ספורט" הצטמצם דרמטית. במדד GDPval-AA v2, שבודק כמה טוב מודל עושה מטלות של עבודת ידע אמיתית (לנסח, לסכם, להסיק), Sonnet 5 קיבל 1,618 - נקודה שלמה מעל Opus 4.8, שקיבל 1,615. זו לא טעות: מודל-הביניים החדש שווה, בעבודת ידע יומיומית, לדגל של אותה חברה.

המספרים: איפה הוא באמת עומד

בואו נהיה מדויקים, כי "עוקף את הדגל" נכון רק בחלק מהמבחנים. הנה התמונה המאומתת, לפי טבלת ההשוואה של MarkTechPost ודף ההשקה של אנתרופיק:

גרף · נתונים מאומתים

Sonnet 5 מול הדור הקודם והדגל (מאומת, יולי 2026)

SWE-bench Pro: Sonnet 4.658.1% הצלחה
SWE-bench Pro: Sonnet 563.2% הצלחה
SWE-bench Pro: Opus 4.869.2% הצלחה
Terminal-Bench: Sonnet 4.667% הצלחה
Terminal-Bench: Sonnet 580.4% הצלחה
HLE (כלים): Sonnet 557.4% הצלחה
HLE (כלים): Opus 4.857.9% הצלחה

בנצ'מרקים מאומתים לפי טבלת ההשוואה של MarkTechPost (13.7.2026) ודף ההשקה של אנתרופיק. SWE-bench Pro = תיקון באגים אמיתיים במאגרי קוד. Terminal-Bench 2.1 = תפעול טרמינל אוטונומי. Humanity's Last Exam = שאלות קשות במיוחד, עם כלים. הערכים של Opus 4.8 ב-Terminal-Bench לא פורסמו. נכון ל־2026-07.

בעבודת ידע ובחשיבה עם כלים הוא צמוד ל-Opus: ב-Humanity's Last Exam עם כלים (מבחן שאלות קשות במיוחד) הוא קיבל 57.4%, כשה-Opus קיבל 57.9% - הבדל של חצי נקודה. אבל בקוד הפער נשאר. ב-SWE-bench Pro, מבחן שנותן למודל באג אמיתי במאגר קוד ומבקש ממנו לתקן, Sonnet 5 קיבל 63.2%, בין Sonnet 4.6 (58.1%) ל-Opus 4.8 (69.2%). כלומר לכתיבת קוד אוטונומית וכבדה, הדגל עדיין מוביל.

גרף · נתונים מאומתים

רבע-הערך: אינטליגנציה מול מחיר

Sonnet 4.6Sonnet 5 (היכרות)Opus 4.8
מחיר קלט ($ למיליון טוקנים) ◄ (זול מימין)Humanity's Last Exam עם כלים (%)
פינה ימנית-עליונה = הכי משתלם (איכות גבוהה, מחיר נמוך)

ציר Y = ציון Humanity's Last Exam עם כלים (מדד אינטליגנציה). ציר X = מחיר קלט למיליון טוקנים. Sonnet 5 במחיר ההיכרות (2$) יושב גבוה-ומשמאל, אזור הערך הטוב: כמעט כמו Opus באיכות, בפחות מחצי המחיר. מקורות: MarkTechPost, Anthropic. לא המלצת רכישה - למדוד על העומס האמיתי שלכם. נכון ל־2026-07.

איפה כן קפיצה ענקית? ב-Terminal-Bench 2.1, שבודק כמה טוב המודל מתפעל טרמינל בעצמו (מריץ פקודות, קורא פלט, מתקן), הוא זינק ל-80.4% מ-67.0% של Sonnet 4.6. זה בדיוק סוג היכולת שהופך מודל-ביניים לסוכן ששווה להריץ שעות רצופות: לא הכי חכם בעולם, אבל עקבי, זריז וזול מספיק כדי לתת לו לעבוד לבד.

המחיר: וכאן צריך לקרוא את האותיות הקטנות

הנה הסיבה שכולם מדברים על ההשקה. מחיר ההיכרות, בתוקף עד 31 באוגוסט 2026, הוא 2 דולר למיליון טוקני קלט ו-10 דולר למיליון טוקני פלט. אחרי התאריך הזה זה עולה ל-3 ו-15. לשם השוואה, Sonnet 4.6 עלה 3 ו-15, ו-Opus 4.8 עולה 5 ו-25. במילים אחרות, בזמן ההיכרות אנחנו מקבלים איכות שקרובה מאוד ל-Opus, בפחות מחצי מהמחיר שלו.

מנוע אמיתי · חשבו בעצמכם

מחשבון: כמה יעלה לכם באמת

קלט מהמטמון $0.00512 קלט מלא $0.013 פלט $0.010
לבקשה$0.028$0.074
לחודש$2.79$7.40
חיסכון מהמטמון62%

מחירים רשמיים למיליון טוקנים (USD). Sonnet 5 במחיר היכרות עד 31.8.2026 (2/10), אחריו 3/15. שימו לב: Sonnet 5 משתמש בטוקנייזר חדש שממיר אותו טקסט ל-1.0-1.35 יותר טוקנים, כך שהחשבון בפועל גבוה ממה שמחיר-לטוקן לבדו מרמז. מקור: Anthropic. נכון ל־2026-07. שימו לב: כתיבה ראשונה למטמון עולה מעט יותר מקלט רגיל (פרמיית כתיבה), והחיסכון מגיע מהקריאות שאחריה.

בואו נשחק עם המחשבון למעלה רגע. אם אנחנו מריצים סוכן שקורא הרבה קוד ומחזיר מעט, Sonnet 5 בזמן ההיכרות זול פי שניים וחצי מ-Opus. זה ההבדל בין להריץ סוכן על עשרה טיקטים ביום לבין להריץ אותו על מאה.

הטוקנייזר ששינה בשקט את החשבון

אבל כאן מגיע החלק שאף כותרת לא מדגישה, ובעיניי הוא הכי חשוב. Sonnet 5 עבר לטוקנייזר החדש של אנתרופיק, זה שהוצג לראשונה עם Opus 4.7 - ואותו טקסט בדיוק ממופה עכשיו ל-1.0 עד 1.35 יותר טוקנים.

טוקנייזר (tokenizer) הוא הרכיב שחותך את הטקסט שלנו לחתיכות קטנות שנקראות טוקנים, והחיוב הוא לפי מספר הטוקנים, לא לפי מספר המילים. תחשבו על זה כמו על מונית שגובה לפי מקטעים ולא לפי קילומטרים: אם הנהג מקצר את המקטעים, אותה נסיעה בדיוק פתאום עולה יותר, גם אם המחיר למקטע ירד.

זה בדיוק מה שקרה כאן. המחיר לטוקן ירד יפה, אבל מספר הטוקנים לאותה בקשה עלה. אצלנו בניוזרום כבר מדדנו את התופעה הזו על עברית, ששם היא קשה במיוחד - מילה אחת בעברית יכולה לעלות פי כמה טוקנים ממקבילתה באנגלית. השורה התחתונה פשוטה: אי אפשר להשוות מחירים לפי מחיר-לטוקן בלבד. צריך למדוד את החשבון על הטקסט האמיתי שלנו. החיסכון קיים, הוא פשוט קטן מ"שליש מהמחיר" שהכותרת מבטיחה.

בטיחות: מה שאנתרופיק בחרה להדגיש

אנתרופיק, שבנתה את המותג שלה על בטיחות, מדווחת ש-Sonnet 5 מראה שיעור נמוך יותר של התנהגויות לא רצויות מ-Sonnet 4.6, ושהיכולת שלו לבצע משימות סייבר נמוכה משמעותית ממודלי ה-Opus. ההגנות בתחום הסייבר דלוקות כברירת מחדל. בעיניי זה חלק מהסיפור: מודל שנועד לרוץ אוטונומית שעות, על טרמינלים ודפדפנים, הוא בדיוק המקום שבו "פחות התנהגויות מפתיעות" שווה כסף אמיתי, לא רק כותרת יחסי-ציבור.

בדקו את עצמכם

Sonnet 5 זול יותר לטוקן מ-Sonnet 4.6. למה החיסכון האמיתי קטן מהמובטח?

שורה תחתונה

בעיניי, ההשקה הזו היא הדגמה מושלמת למגמה של 2026: "ההתאמה הטובה ביותר" מנצחת את "המודל הכי חזק". לא כל משימה צריכה את הדגל. לרובן, מודל-ביניים שעולה שליש, רץ מהר, ומתפעל כלים בעקביות, הוא הבחירה הנכונה. אבל שתי הסתייגויות: לקוד כבד ואוטונומי Opus עדיין מוביל, והטוקנייזר החדש אומר שהחיסכון על הנייר גדול מהחיסכון בקופה. שווה למדוד לפני שמעבירים פרודקשן שלם.

אז אם מודל-הביניים כבר נוגע בדגל, ובשליש מהמחיר - מה בעצם נשאר ל-Opus לעשות, חוץ מהמשימות הכי קשות שיש?

מקורות ואימות

כל טענה עובדתית בכתבה נבדקה מול המקורות הבאים.

  1. Introducing Claude Sonnet 5 - Anthropicanthropic.com
  2. Anthropic Claude Sonnet 5 vs Sonnet 4.6 vs Opus 4.8 - MarkTechPostmarktechpost.com
  3. Claude Sonnet 5: Benchmarks, Pricing & How It Compares - Coderseracodersera.com
  4. Anthropic launches Claude Sonnet 5 for cheaper AI agent tasks - Quartzqz.com

אהבתם את הכתבה? ספרו לי

הקורס המוביל שלי

Practical AI with Claude

הקורס הכי מקיף בעברית לשליטה מלאה ב-Claude — מ-Claude Desktop לעבודה יומיומית, ועד בניית סוכנים ואוטומציות אמיתיות.

למידע והרשמה

פניות תקשורת

לראיונות, שיתופי פעולה והרצאות, נשמח לדבר.

info@yuv.ai