אם צריך לסכם את Grok 4.6 במשפט אחד: הוא לא ניצח בכל גרף - הוא עשה משהו שעשוי להיות חשוב יותר. הוא הוריד את המחיר של אינטליגנציית קצה לרמה שעד עכשיו נראתה כמו מחיר של מודל ביניים.
Grok 4.6 הושק ב-12 באוגוסט 2026, בפיתוח משותף של Cursor ו-SpaceXAI. במדד העצמאי של Artificial Analysis הוא כמעט זהה ל-GPT-5.6 Sol, מעט מאחורי Claude Fable 5, אבל המחיר הרשמי שלו הוא 2 דולר למיליון טוקנים בקלט ו-6 דולר בפלט. זה לא עוד שיפור של כמה נקודות בבנצ'מרק. זו התקפה ישירה על כלכלת שוק המודלים.
המספר שמסביר למה ההשקה הזאת חריגה
בצילום המצב של Artificial Analysis מ-13 באוגוסט, Grok 4.6 High קיבל 60.923 נקודות. GPT-5.6 Sol Max קיבל 60.930. ההפרש זעיר מכדי לבנות עליו סיפור אמיתי; בתצוגה המעוגלת שניהם מקבלים 61. Fable 5 Max נמצא נקודה אחת מעליהם, עם 62.
הפער המשמעותי מופיע בשורת המחיר. Artificial Analysis מעריכה את עלות המודל למשימת מדד ב-0.84 דולר ל-Grok, לעומת 1.23 דולר ל-Sol ו-3.14 דולר ל-Fable. כלומר, באותה מעטפת מדידה, Grok זול בכ-32% למשימה מ-Sol ובכ-73% מ-Fable.
אותו ציון מעוגל, אבל מחיר ה-API של Grok נמוך ב-60% בקלט וב-80% בפלט: $2/$6 לעומת $5/$30.
נקודה אחת פחות במדד, אבל 80% פחות בקלט ו-88% פחות בפלט: $2/$6 לעומת $10/$50.
חשוב להפריד בין מחיר לטוקן לבין מחיר למשימה. המחירון והבנצ'מרקים הפומביים מציגים את Grok כאפשרות זולה, אבל במבחן הסוכן הארוך שלנו התוצאה התהפכה: Grok עלה $18.624284, לעומת $17.421161 ל-SOL. רוב העלות של Grok הגיעה מ-28.98 מיליון טוקנים שנקראו מהמטמון. מחיר נמוך לטוקן אינו מבטיח מחיר נמוך למשימה.
אבל "2 ו-6 דולר" מגיעים עם כוכביות
מחירון SpaceXAI קובע 0.50 דולר לקלט שמור, 2 דולר לקלט ו-6 דולר לפלט למיליון טוקנים בבקשות שמתחת ל-200 אלף טוקנים. כאשר הפרומפט מגיע ל-200 אלף טוקנים, כל הבקשה מחויבת במחיר כפול: 1, 4 ו-12 דולר. עיבוד בעדיפות גבוהה עולה גם הוא פי שניים, וכלי חיפוש ברשת, חיפוש ב-X והרצת קוד מחויבים בנפרד.
ב-Cursor, הגרסה הרגילה מופיעה באותו מחיר של $2/$6, וגרסת Fast עולה $4/$12. ההטבה של שימוש כלול כפול בשבוע ההשקה היא זמנית. גם חלון ההקשר תלוי במוצר: ה-API של SpaceXAI מציע 500 אלף טוקנים, בעוד Cursor מגישה אותו עם 256 אלף. מי שמשווה הצעת מחיר אמיתית צריך להשוות את הנתיב שבו המודל ירוץ, לא רק את המספר הגדול בכותרת.
האם Grok 4.6 באמת מהיר?
כן, ביחס למודלי הקצה שמולו - אבל לא במובן של תגובה מיידית. Artificial Analysis מדדה קצב פלט של 65.5 טוקנים בשנייה, לעומת 61.5 ל-Sol ו-63.1 ל-Fable. זה יתרון נחמד בזמן שהמודל כבר מייצר תשובה.
מצד שני, 65.5 טוקנים בשנייה נמצא בערך סביב חציון ההשוואה של האתר, והזמן לטוקן הראשון נמדד ב-31.18 שניות. נכון ליום הפרסום גם אין עדיין מדידה עצמאית לגרסת Fast. לכן הניסוח המדויק הוא: Grok מהיר מעט מיריביו הישירים בזמן הפלט, ובעיקר יעיל מאוד כלכלית למשימה. "מהיר בטירוף" בלי ההבחנה הזאת יהיה הייפ, לא ניתוח.
הבנצ'מרקים: קרוב מאוד לחזית, עם חורים ברורים
טבלת ההשקה של Cursor ו-SpaceXAI מציגה תמונה מרשימה. Grok 4.6 High קיבל 69.9% ב-CursorBench 3.2, מול 67.2% ל-Sol Max ו-70.5% ל-Fable Max. הוא מקדים מעט את Sol ב-FrontierCode וב-APEX-Agents, ומקבל 1,753 נקודות ב-GDPVal-AA v2 - יותר מ-Sol ומ-Fable בטבלה.
אבל זו לא הקפה עם דגל ניצחון. ב-DeepSWE 1.1 הוא מקבל 65.9%, לעומת 73% ל-Sol ו-70% ל-Fable. ב-Terminal-Bench 3.0 הפער ברור עוד יותר: 26% ל-Grok, מול 34.6% ו-34.1%. ב-SWE-Marathon הוא מגיע ל-31.9%, הרחק מהתוצאות הטובות ביותר. וצריך לזכור שהשורה של Grok היא ברמת מאמץ High, בעוד היריבים מופיעים בדרך כלל ב-Max, ושתוצאות היריבים הן הנתונים העצמיים או הציבוריים הטובים ביותר שנאספו להשקה - לא הרצה אחידה אחת.
הנתון הכי מפתה מגיע מ-CursorBench החי: Grok 4.6 xhigh קיבל 70.8% בעלות ממוצעת של 2.81 דולר למשימה, לעומת 70.5% ו-17.32 דולר ל-Fable 5 Max. זה פער עלות של כ-84% לטובת Grok עם ציון מעט גבוה יותר. זה גם מבחן של Cursor למודל ש-Cursor סייעה לפתח, ולכן צריך לסמן אותו בבירור כנתון של Cursor ולא כמדידה עצמאית.
כרטיס המודל הרשמי מראה חוזקה מעניינת גם בהנדסה וב-CAD: למשל 60 ב-EEBench ברמת xhigh מול 39.4 ל-Sol, ו-40.9 ב-CadGen מול 37.1. אלה סימנים ש-Grok אינו רק מודל קוד זול, אבל גם כאן מדובר בנתוני ההשקה של הספקים, לא באימות שלנו.
אז מה כאן באמת פורץ דרך?
לא עצם העובדה שמודל חדש מתקרב למקום הראשון. זה קורה כמעט בכל חודש. השינוי הוא שמודל ברמת החזית מגיע במחיר שמאפשר להשתמש בו אחרת.
יותר ניסיונות לפני שהתקציב נגמר
סוכני קוד ומחקר ארוכים צורכים מיליוני טוקנים, כולל ניסיונות כושלים, קריאות כלים ו-review. הורדה חדה במחיר מאפשרת להריץ יותר ענפים, ביקורת נוספת ו-fallback בלי להפוך כל משימה להחלטה תקציבית.
מודל קצה כברירת מחדל
עד עכשיו ארגונים רבים שמרו את המודל החזק ביותר למקרים חריגים. אם Grok שומר על האיכות גם בעומסי production, הוא יכול לעבור משכבת escalation למנוע ברירת המחדל של workflow שלם.
לחץ מחירים על כל השוק
כאשר ציון 61 נמכר ב-$2/$6, המתחרים צריכים להצדיק פרמיה דרך איכות, הקשר, latency, בטיחות או מוצר טוב יותר. גם מי שלא ישתמש ב-Grok עשוי ליהנות מהלחץ הזה.
זו הסיבה שאנחנו קוראים להשקה פורצת דרך גם בלי להכריז על "המודל הטוב בעולם". Grok 4.6 לא מנצח בכל משימה. הוא משנה את המחיר שבו אפשר לקנות ניסיון רציני לנצח אותה.
ואז הגיע Grok Bot - יום לפני המודל
Grok Bot הושק בבטא ב-11 באוגוסט כסוכן ענן מתמשך: הוא יכול להתחבר לכלים, לעבוד ברקע ולהמשיך משימות גם כשהמחשב של המשתמש סגור. ההפצה הראשונית היא דרך אפליקציות שולחן העבודה ו-iOS, עם גישה למנויי SuperGrok Heavy, Cursor Ultra ו-Cursor Teams Premium.
החיבור ל-Cursor אמיתי, אבל חשוב לדייק: מנוי Cursor רגיל אינו שווה אוטומטית למנוי Grok, והתוכניות עדיין מתומחרות ומחויבות בנפרד. רק שכבות פרימיום מסוימות מקבלות כרגע הרשאה חופפת ל-Grok Bot. אין הודעה על חשבון מאוחד, חיוב מאוחד או גישה הדדית לכל מוצר.
יש כאן גם שאלה תפעולית. סוכן שנכנס לכלים ועובד ברקע זקוק להרשאות מינימליות, לוג ביקורת, גבולות הוצאה ונקודות אישור. המחיר הנמוך של המודל יכול להפוך אותו למשתלם; הוא לא הופך סוכן אוטונומי לבטוח כברירת מחדל.
Cursor ו-SpaceXAI לא רק "מתקרבות" - יש עסקה חתומה
ההשערה הטבעית היא ש-Grok Bot מרמז על מיזוג עתידי בין Cursor ל-xAI. אלא שהמציאות כבר התקדמה מעבר להשערה. לפי דיווח 8-K של SpaceX ל-SEC, ב-16 ביוני 2026 חתמו SpaceX, חברת מיזוג ו-Anysphere - החברה שמאחורי Cursor - על הסכם מיזוג מחייב בשווי הון משתמע של 60 מיליארד דולר. אם העסקה תושלם, Cursor תישאר כחברה שורדת בבעלות מלאה של SpaceX. נכון לדיווח הרבעוני מ-4 באוגוסט, העסקה עדיין המתינה לאישורים ולסגירה.
מכיוון ש-SpaceX כבר רכשה את xAI בפברואר 2026, המבנה המסתמן מחבר תחת אותה קבוצה שלוש שכבות: תשתית המחשוב וההון של SpaceX, המודלים של SpaceXAI, וסביבת העבודה וההפצה של Cursor. Grok Bot אינו הוכחה לכך שהעסקה תיסגר; הוא כן נראה כמו ביטוי מוצרי מוקדם של האינטגרציה שהחברות כבר מנסות לבנות.
העובדה: יש הסכם מיזוג חתום, Grok 4.6 פותח במשותף, ומנויי פרימיום מסוימים של Cursor מקבלים Grok Bot. הפרשנות שלנו: המוצרים נעים לכיוון של מערכת אחת. עדיין אין מנוי אחיד, והעסקה טרם דווחה כסגורה.
לולאת הנתונים שיכולה להיות היתרון הגדול ביותר
באפריל Cursor הודיעה שהיא משתמשת ב-Colossus של SpaceXAI לאימון מודלים. כרטיס Grok 4.6 אומר שהאימון המשלים כלל נתוני workflow אנונימיים של Cursor. עכשיו אותו מודל מופץ חזרה בתוך Cursor ודרך Grok Bot.
זו מסקנה אנליטית, לא הבטחה של החברות: אם הלולאה הזאת עובדת כפי שהן מקוות, Cursor מספקת למודל משימות אמיתיות, SpaceXAI מספקת מחשוב ומודל זול, והמוצר מחזיר את השיפור למשתמשים ול-workflows. היתרון התחרותי כבר אינו רק "למי יש יותר GPU", אלא מי מחזיק את הקשר הקצר ביותר בין שימוש אמיתי, אימון והפצה.
מה היינו עושים עכשיו כמפתחים וכמנהלי מוצר
- בודקים על המשימות שלנו. מריצים 20-50 משימות מייצגות, כולל מקרי כשל, ולא בוחרים לפי מדד יחיד.
- מודדים עלות למשימה, לא מחיר לטוקן. כוללים טוקנים, קריאות כלים, ניסיונות חוזרים, זמן קיר וזמן review אנושי.
- מתחילים בגרסה הרגילה. Fast מכפילה את המחיר, ועדיין אין לה מדידת latency עצמאית. מפעילים אותה רק במקום שבו זמן ההמתנה באמת עולה יותר מהפרמיה.
- מגדירים מסלול fallback. Grok יכול להיות ברירת המחדל הזולה, ו-Sol או Fable לקבל את המשימות שבהן בדיקות פנימיות מוכיחות יתרון.
- מתייחסים ל-Grok Bot כמערכת בעלת הרשאות. מפרידים סביבות, מגבילים גישה וכסף, ושומרים אישור אנושי לפעולות בלתי הפיכות.
מבחן מבוקר של DevShift
Grok זול בבנצ'מרקים. אצלנו הוא היה יקר יותר
השווינו בין Grok 4.6 Extra High, Claude Opus 5 Max ו-GPT-5.6 SOL Max. כל אחד מהם קיבל בדיוק את אותו פרומפט ב-Cursor Agent CLI, ללא שינוי בין ההרצות. המשימה הייתה לבנות תאום דיגיטלי תפעולי רספונסיבי, עם WebGL אמיתי, סימולציה דטרמיניסטית ולוגיקה לתכנון התאוששות. שלוש ההרצות התחילו בהפרש של 0.13925 מילישנייה בלבד.
Grok 4.6 Extra High
- משך ההרצה: 1h 28m 00.186s
- 185 פניות למודל
- 30,536,204 טוקנים בסך הכול
- $18.624284 לפי המחירון הרגיל
Grok סיים בריצה אחת והציג WebGL אמיתי, אבל נכשל בבדיקות הלוגיקה הסמויות, בשינוי דירוג התוכניות, בתצוגת הגיבוי הדו-ממדית וב-lint. לכן התוצאה הוגדרה DNF.
לפתיחת התוצאה המלאהClaude Opus 5 Max
- משך ההרצה: 1h 15m 25.846s
- 114 פניות למודל
- פירוט הטוקנים המלא של החלק הראשון חסר
- $22.78 לפי המחירון הרגיל
הריצה המקבילית נעצרה בגלל resource_exhausted. המשכנו אחר כך מאותו session ב-Cursor והיא הסתיימה, אבל ריצה שהושלמה בשני חלקים אינה שקולה לריצה רציפה. לכן גם Opus הוגדר DNF.
לפתיחת התוצאה המלאהGPT-5.6 SOL Max
- משך ההרצה: 44m 45.942s
- 88 פניות למודל
- 24,044,659 טוקנים בסך הכול
- $17.421161 לפי המחירון הרגיל
SOL סיים את הריצה הרציפה בזמן הקצר ביותר והציג WebGL פעיל. עם זאת, הקוד המקורי לא עבר build ונכשל בבדיקות הלוגיקה, שינוי הדירוג, תצוגת הגיבוי ו-lint. לכן גם הוא הוגדר DNF.
לפתיחת התוצאה המלאהאין מנצח שעומד בתנאי המבחן. שלושת התוצרים הציבוריים עובדים, אבל אף אחד מהם לא עבר את מערך הבדיקות שהוגדר מראש. במשימה הזאת Grok היה יקר יותר בפועל: $18.624284 לעומת $17.421161 ל-SOL - פער של $1.203123, כלומר 6.9%. זו תוצאה הפוכה מ-CursorBench 3.2, שבו Grok 4.6 Extra High מוצג בעלות של $2.81 למשימה ו-SOL Max בעלות של $5.69. אצלנו Grok צבר 28,980,224 טוקנים שנקראו מהמטמון, והם עלו לבדם $14.490112 - 77.8% מהעלות הכוללת.
טוקנים מהמטמון זולים יותר מטוקנים חדשים, אבל הם לא בחינם. בסשן ארוך, אותו הקשר גדול נטען מהמטמון ומחויב שוב ושוב; במקרה הזה Grok פנה למודל 185 פעמים. מחירון Grok עדיין אטרקטיבי למשימות קצרות או למשימות שלא סוחבות הרבה הקשר, אבל היתרון עלול להיעלם בעבודה ארוכה. זו מלכודת שקל לפספס במחירון, אבל המדידה אינה מוכיחה שהמנגנון נועד להטעות ואינה חושפת את שולי הרווח של Cursor. אלה ערכי שימוש לפי המחירון הרגיל, לא חיובים נוספים; תוספת הטוקנים בתוכנית Individual Ultra הייתה $0. בכרטיס של Opus מוצג מחיר של $22.78. חילקנו את העלות שנמדדה בשלב ההמשך - $10.59219775 על פני 53 פניות - והכפלנו אותה ב-114 הפניות שנעשו בשני חלקי ההרצה. זה אינו סכום מחשבונית. לא הושלם ציון אנושי עיוור של שלושה בודקים.
זה היה מבחן בנייה מבוקר אחד, ואינו דירוג אוניברסלי של מודלים. אפשר לקרוא את נתוני ההרצה המסוננים או לפתוח את שלושת היישומים השמורים למעלה.
פסק הדין: פריצת דרך כלכלית, לא ניצחון אוניברסלי
Grok 4.6 הוא אחת ההשקות החשובות של 2026 מפני שהוא מביא מודל חזית במחירון נמוך בהרבה. בבנצ'מרקים הפומביים הוא כמעט משתווה ל-SOL ועולה פחות למשימה. במבחן הסוכן הארוך שלנו זה לא קרה: Grok עלה $18.624284, לעומת $17.421161 ל-SOL. החידוש הוא פוטנציאל המחיר, לא הבטחה ש-Grok יהיה הזול ביותר בכל סוג של עבודה.
הוא עדיין חלש יותר בכמה מבחני סוכנים וקוד, ה-latency הראשוני שלו אינו נמוך, חלון ההקשר ב-Cursor קטן משל ה-API, והמחיר מוכפל בבקשות ארוכות או ב-Fast. אלה לא הערות שוליים; הן הדרך להשתמש במודל נכון.
במקביל, Grok Bot וההרשאות שמגיעות עם Cursor Ultra מראים לאן המוצר הולך. לא למנוי מאוחד שכבר קיים, אלא ל-stack משולב של מודל, סביבת פיתוח וסוכן ענן - סביב עסקת מיזוג שכבר נחתמה ועדיין מחכה לסגירה. אם החיבור הזה יעבוד, המחיר של Grok 4.6 יהיה רק החלק הראשון של הסיפור.
הגישה הזאת ממשיכה את הניתוח שלנו על Claude Fable 5 מול GPT-5.6 Sol: לא בוחרים לוגו, בוחרים מערכת שמתאימה לעבודה. אם אתם בונים מוצר או workflow מבוסס AI, ספרו לנו מה אתם רוצים להעביר ל-production - נבנה השוואה על המשימות והכלכלה שלכם.





