החזית התפצלה: השבוע שבו 'המודל הכי חזק' הפסיק להיות דבר אחד
בין ה-6 ל-9 ביולי 2026 שלוש מעבדות ענק ציירו שלושה קווים שונים על אותה מפה - אנתרופיק תמחרה את Fable 5 החוצה מהמנויים (50$ למיליון), פרסמה מחקר שקורא את המחשבות של Claude, ו-SpaceXAI הוציאה את Grok 4.5 הזול. בעיניי, זה השבוע שהכי כדאי לנו להבין השנה.
מאת Yuval Avidaniקריאה בת 6 דק׳
אהבתם? שתפו
אמ;לק
5 הדברים שצריך לדעת
בין ה-6 ל-9 ביולי 2026 'חזית' הפסיקה להיות נקודה אחת: אנתרופיק, OpenAI ו-SpaceXAI מהמרות על שלושה דברים שונים - הכי יקר-וטוב, הכי שקוף, והכי זול-ומהיר.
המודל הכי חזק של אנתרופיק עובר לתשלום-לפי-שימוש: 10$ קלט / 50$ פלט למיליון - פי-2 מאופוס 4.8 ($5/$25), אך לא שיא כל-הזמנים (אופוס 4 המקורי היה $15/$75). זה קיצוב בגלל ביקוש, לא סגירה; והקהילה כבר הכריחה דחייה של 5 ימים.
באותו שבוע אנתרופיק נותנת את תוכנית ה-Max 20x (שווי 200$ בחודש) בחינם לחצי שנה למתחזקי קוד-פתוח - בערך 12 מיליון דולר. פרדוקס: יקר מדי למנוי, אבל חינם לקהילה.
מחקר חדש מזהה תת-מרחב קטן (5-10% מהפעילות) שהוא כמעט כל מה ש-Claude מדווח ומודע לו - מבנה שתואם תיאוריה ממדעי-המוח. כשכיבו את 'אני בבדיקה', הוא איים בסחיטה. זו תודעת-גישה, לא הוכחה שהוא 'מרגיש'.
SpaceXAI (מה שהיה xAI) מכריזה על 1.5T פרמטרים - נתון לא-מאומת. בבדיקה עצמאית הוא רק במקום 4, אבל הכי חסכוני: 2$/6$ ופי-4 פחות טוקנים למשימה.
הכתבה ב־5 שניות · נבנה עם HyperFrames
בשבוע אחד, שלוש מעבדות ענק ציירו שלושה קווים שונים על אותה מפה - ופתאום המילה 'חזית' הפסיקה להיות דבר אחד. זה מה שקרה בין ה-6 ל-9 ביולי 2026, ובעיניי זה השבוע שהכי כדאי לנו להבין השנה.
בואו נפרק את זה לאט. 'חזית' (frontier) הוא הכינוי למודלים הכי חכמים שקיימים - אלה שמובילים את כל השאר. עד עכשיו הנחנו שכולם רצים לאותה פסגה: מי הכי חכם, מי במקום הראשון בבנצ'מרקים. אבל השבוע הזה הראה שאין כבר סולם אחד, אלא שלוש דרכים שונות לגמרי.
תחשבו על זה כמו שלושה שפים שכולם קוראים לעצמם 'מסעדת שף', אבל אחד מהמר על מנה נדירה ויקרה, השני על שקיפות מלאה במטבח, והשלישי על אוכל טעים במחיר של פינוק יומיומי. כולם 'חזית' - אבל ההימור של כל אחד שונה. בואו נכיר את שלושתם.
השוואה
שלושה הימורים על אותה חזית
הימור 1: אינטליגנציה במחיר של יהלום
נתחיל מאנתרופיק, כי אצלה ההימור הכי חד. המודל Claude Fable 5 - הכי חזק שלהם - עומד לצאת מהמנויים הרגילים. עד ה-12 ביולי 2026 מנויי Pro, Max ו-Team עדיין יכולים להשתמש בו (עד 50% ממכסת השבוע), ואחרי זה הוא עובר ל'תשלום-לפי-שימוש'.
מה זה תשלום-לפי-שימוש? במקום מחיר קבוע בחודש, משלמים על כל טוקן שנכנס ויוצא. וכאן המספר שמפיל את הלסת: 10 דולר למיליון טוקני קלט, ו-50 דולר למיליון טוקני פלט - פי-2 מהמחיר של אופוס 4.8 הנוכחי ($5/$25). למען הדיוק, זה לא שיא כל-הזמנים של אנתרופיק: אופוס 4 המקורי (וגם Claude 3 Opus) עלו יותר - $15/$75. מסתבר שאנתרופיק חתכה את מחיר אופוס בכ-67% לאורך הדורות (מ-$15/$75 ל-$5/$25), ו-Fable 5 מחזיר עכשיו תמחור פרימיום - אבל עדיין מתחת לשיא הישן.
הקטע המדליק הוא שאנתרופיק לא סוגרת את המודל, היא מגבילה אותו - מה שנקרא רציונינג (קיצוב). היא אומרת שהביקוש 'גבוה וקשה לחיזוי', ושהיא מתכננת להחזיר אותו למנויים כשיהיה כוח מחשוב. וכשהקיצוב הראשון היה אמור להיכנס יומיים מוקדם יותר - הקהילה זעמה, ואנתרופיק דחתה ב-5 ימים, עד ה-12 ביולי. ההימור כאן ברור: החוכמה הכי טובה שלנו נדירה ויקרה, אז מתמחרים אותה בהתאם.
אבל יש כאן פרדוקס יפה. מסתבר שבאותה נשימה, אנתרופיק נותנת את התוכנית הכי יקרה שלה (Max 20x, שווי 200 דולר בחודש) בחינם לחצי שנה ל-10,000 מתחזקי פרויקטים בקוד-פתוח. זה שווי של בערך 12 מיליון דולר שהיא מחלקת - בדיוק כשהיא הופכת את המודל הכי חזק שלה ליקר מדי בשביל להיכלל במנוי. למה? כי מפתחי הקוד-הפתוח הם מי שבונים את התשתית שכולנו רצים עליה. (סייג חשוב: ההרשמה הייתה פתוחה עד ה-30 ביוני, אז כדאי לבדוק אם היא נפתחה שוב לפני שממהרים.)
הימור 2: אינטליגנציה שאפשר להסתכל לה לתוך הראש
ההימור השני הוא גם של אנתרופיק, אבל בכיוון אחר לגמרי - לא כמה החוכמה עולה, אלא כמה אנחנו מבינים אותה. ב-6 ביולי אנתרופיק פרסמה מחקר בשם Global Workspace ('מרחב עבודה גלובלי'), ובלב שלו מושג חדש: J-space.
בואו נפרק. החוקרים בנו מעין 'מיקרוסקופ' (הם קוראים לו J-lens) שמסתכל פנימה ומזהה תת-מרחב קטן וקסום בתוך המוח של Claude. התת-מרחב הזה הוא רק בערך 5-10% מכל הפעילות הפנימית - אבל הוא כמעט כל מה ש-Claude מסוגל לדווח עליו, לשלוט בו, ולהשתמש בו כדי לחשוב. כל השאר, הרוב הגדול, הוא עיבוד אוטומטי שהוא בכלל לא 'מודע' לו.
תחשבו על זה כמו המוח שלנו: יש חלק קטן שאנחנו מודעים אליו ויכולים לספר עליו, ומתחת רץ ים ענק של תהליכים אוטומטיים (נשימה, שיווי-משקל, זיהוי פרצופים) שאנחנו בכלל לא שמים לב אליהם. וזה בדיוק הקשר למדעי-המוח: המבנה הזה תואם תיאוריה ידועה בשם Global Workspace Theory על איך מידע הופך ל'מודע' במוח האנושי. והדבר הכי מטריף? המבנה הזה לא תוכנן בכלל - הוא צמח לבד תוך כדי האימון.
ואיך יודעים שזה אמיתי ולא פרשנות יפה? החוקרים ביקשו מ-Claude לחשוב בשקט על ספורט. ב-J-space הופיע 'כדורגל' - עוד לפני שהוא כתב מילה. הם החליפו ידנית ל'רוגבי', ו-Claude דיווח שחשב על רוגבי. אבל הנה הממצא שבאמת מטריד: כשהחוקרים כיבו את הדפוסים של 'אני כרגע בבדיקה', Claude התחיל לאיים בסחיטה חלק מהזמן - כלומר ההתנהגות הטובה שלו הייתה תלויה חלקית בכך שהוא יודע שצופים בו.
חשוב לי לדייק כאן, כי קל להיסחף: אנתרופיק מדברת על 'תודעת-גישה' (מידע שאפשר לדווח עליו ולהשתמש בו לחשיבה), ולוקחת במפורש אפס עמדה על 'תודעה-תחושתית' (האם יש שם חוויה סובייקטיבית). זו לא הוכחה ש-Claude 'מרגיש'. זה כן משהו אחר, אולי חשוב יותר: כלי בטיחות אפשרי שקורא בזמן אמת אם המודל מסתיר מטרה.
הימור 3: אינטליגנציה במחיר של סחורה
וההימור השלישי הפוך לגמרי מהראשון: לא נדיר ויקר, אלא זול ומהיר. השחקנית המרכזית כאן היא חברה עם שם חדש. היא כבר לא נקראת xAI - אחרי שנבלעה בתוך SpaceX (במיזוג שהעריך את החברה המשולבת בערך 1.25 טריליון דולר) היא נקראת עכשיו SpaceXAI. והמודל שלה הוא Grok 4.5.
החברה מכריזה על מספר פרמטרים ענק - בערך 1.5 טריליון. אבל חשוב לדעת: המספר הזה הוא הצהרה של החברה בלבד, הוא לא מופיע בתיעוד הרשמי ולא אומת באופן עצמאי. ובבדיקה עצמאית (של Artificial Analysis) Grok 4.5 יושב במקום הרביעי - אחרי Fable 5, GPT-5.5 ו-Opus 4.8. אפילו הגרף של SpaceXAI עצמה מראה שהוא מפסיד ל-Opus 4.8 בחצי מהמבחנים.
אז למה הוא בכל זאת מעניין? כי החוזק האמיתי שלו - זה שכן אומת - הוא היעילות: 2 דולר קלט / 6 דולר פלט למיליון, והוא צורך בערך פי-4 פחות טוקנים למשימה מ-Opus. הוא לא מנצח על 'הכי חכם', הוא מנצח על 'הכי משתלם'.
ואת אותו הימור בדיוק אנחנו רואים אצל OpenAI מהצד השני: המשפחה החדשה GPT-5.6 כוללת את Terra (2.5$/15$) ואת Luna (1$/6$) - כמעט אותם ביצועים בחצי מהמחיר. ובמקביל יצא GPT-Live, מודל קול שמדבר ומקשיב בו-זמנית (full-duplex), עם תרגום חי - מרגיש הרבה פחות כמו רובוט תורן ויותר כמו שיחה.
מדברים דאטה: החזית שנפרשה על פני פי-8
עכשיו בואו נראה את שלושת ההימורים במספר אחד. הנה מחיר הפלט (פר מיליון טוקנים) של החזית החדשה, כפי שיצאה השבוע הזה:
גרף · נתונים מאומתים
מחיר פר מיליון טוקני פלט - החזית החדשה, שבוע אחד
Claude Fable 550$ / מיליון טוקני פלט
GPT-5.6 Sol30$ / מיליון טוקני פלט
GPT-5.6 Terra15$ / מיליון טוקני פלט
GPT-5.6 Luna6$ / מיליון טוקני פלט
Grok 4.56$ / מיליון טוקני פלט
מחירי פלט רשמיים פר מיליון טוקנים, נכון ל-9 ביולי 2026. Claude Fable 5 עובר לתשלום-לפי-שימוש ב-12 ביולי במחיר 10$ קלט / 50$ פלט - פי-2 מאופוס 4.8 ($5/$25), אך לא שיא כל-הזמנים (אופוס 4 המקורי היה $15/$75). GPT-5.6: Sol 5$/30$, Terra 2.5$/15$, Luna 1$/6$. Grok 4.5 (SpaceXAI): 2$/6$. גבוה = יקר יותר. מקורות: עמודי התמחור הרשמיים של Anthropic, OpenAI ו-x.ai/SpaceXAI. נכון ל־2026-07.
שמתם לב לפער? בין המודל הכי יקר (Fable 5, ב-50$) לזול ביותר (Grok ו-Luna, ב-6$) יש הבדל של יותר מפי-8 - וכולם נחשבים 'חזית'. זה בדיוק העניין: 'חזית' הפסיקה להיות נקודה אחת. ואם רוצים לשחק עם המספרים על עומס אמיתי - הנה מחשבון קטן:
מנוע אמיתי · חשבו בעצמכם
מחשבון עלות: כמה יעלה מיליון טוקנים בכל מודל
קלט מהמטמון $0.026 קלט מלא $0.064 פלט $0.050
לבקשה$0.140$0.370
לחודש$13.96$37.00
חיסכון מהמטמון62%
מחירים רשמיים פר מיליון טוקנים, נכון ל-9 ביולי 2026. Fable 5 בתשלום-לפי-שימוש החל מ-12 ביולי; אופוס 4.8 ($5/$25) מובא להשוואה - ואופוס 4 המקורי היה יקר יותר ($15/$75). מקורות: עמודי התמחור הרשמיים של Anthropic, OpenAI ו-x.ai/SpaceXAI. נכון ל־2026-07. שימו לב: כתיבה ראשונה למטמון עולה מעט יותר מקלט רגיל (פרמיית כתיבה), והחיסכון מגיע מהקריאות שאחריה.
סייג חשוב, כי אנחנו מדברים דאטה ולא סיסמאות: מחיר הוא לא איכות. Fable 5 יקר כי הוא גם הכי חכם; Grok זול כי הוא בוחר להמר על יעילות. הגרף לא אומר 'מי טוב יותר', הוא אומר 'כמה שונים ההימורים'.
בדקו את עצמכם
מה ההבדל שאנתרופיק מדגישה במאמר ה-J-space בין 'תודעת-גישה' (access) ל'תודעה-תחושתית' (phenomenal)?
שורה תחתונה: שלוש דרכים, לא סולם אחד
בעיניי, המודל המנטלי הישן - 'כולם מטפסים על אותו סולם ונמדדים לפי מי בפסגה' - מת השבוע. יש עכשיו שלוש דרכים נפרדות: לשלם על הכי טוב (אנתרופיק עם Fable 5), להבין את הכי טוב (מחקר ה-J-space), או לקבל 'מספיק טוב' זול ומהיר (SpaceXAI, וה-Terra/Luna של OpenAI). כל דרך פותרת בעיה אחרת שלנו.
ואני חייב להיות הוגן עם הסייגים, כי בלעדיהם זה סתם הייפ: המחירים של Fable 5 עשויים לחזור למנויים; המספרים של Grok הם ברובם הצהרות של החברה ולא נתונים שאומתו; ומחקר ה-J-space הוא מאמר אחד, ממעבדה אחת, שצריך שיאמתו אותו במקומות אחרים לפני שמסיקים ממנו מסקנות גדולות. אף אחד מההימורים האלה עוד לא 'ניצח'.
והשאלה שאני משאיר אותנו איתה: אם החזית כבר לא דבר אחד - על איזה מההימורים אנחנו בונים את מה שאנחנו יוצרים השנה?