ב-6 באוגוסט 2026 גוגל איבדה את המנהיג של מעבדת ה-AI הכי חשובה שלה. דמיס הסאביס, האיש שהביא את AlphaFold והוביל את המירוץ ל-Gemini 3, הועבר מתפקיד ה-CEO של DeepMind לתפקיד "Chairman + Chief Scientist של Alphabet". זה לא קידום. זו הצבעה של חוסר אמון.
שבועיים לאחר מכן התברר ש-Gemini 3.5 Pro — הדגם שאמור היה להיות התשובה של גוגל ל-GPT-5.6 ול-Claude Opus 5 — בוטל. לא דחה, לא נדחה. בוטל. במקומו יצא רק Gemini 3.7 Flash, מודל קטן וזול, שמסמן ויותר מהכל על קיצוץ תקציב מאשר על קפיצה טכנולוגית.
השאלה היא לא רק מה השתבש באוגוסט. השאלה היא איך גוגל — החברה שיש לה יותר כסף, יותר טאלנטים, יותר נתונים מכל אחד אחר — הצליחה לפספס את הפרונטירה כל כך גרוע.
מה שחשוב לדעת
- 6 באוגוסט: דמיס הסאביס פורש מ-CEO של DeepMind, עובר לתפקיד ייצוגי ב-Alphabet; קוראי קבוקוגלו (Koray Kavukcuoglu) מחליף
- Gemini 3.5 Pro בוטל — דגם הדגל שתוכנן ליוני-יולי בוטל; אין מודל Gemini חדש עד סוף 2026
- Gemini 3.7 Flash יצא ב-13 באוגוסט עם דילוג על ה-Pro tier — קפיצה קטנה, לא revolution
- חוקרי Gemini בכירים עוזבים למעבדות מתחרות (xAI, Anthropic)
- Gemini 4 תוארה כ"ambitious pretraining run" — צפי סוף 2026 (נובמבר-דצמבר)
- מחיר: 3.7 Flash נמכר ב-$0.75/$3.75 למיליון tokens, חצי מ-Gemini 3.6 Flash
- המסקנה: גוגל תלויה ב-Flash + Gemini in Workspace + AI Overviews, לא ב-flagship
מה באמת קרה ב-6 באוגוסט?
הסיפור הרשמי: הסאביס קיבל "הצעה שלא יכול לסרב" לתפקיד ייצוגי ב-Alphabet. הסיפור הלא-רשמי: ב-Alphabet כבר הבינו ש-DeepMind בצרות. הסאביס הוביל את Gemini 3 עד ל-2025, אבל הצוות שלו לא הצליח לספק קפיצה תחרותית מול GPT-5.6 של OpenAI ו-Claude Opus 5 של Anthropic.
המחליף שלו, קוראי קבוקוגלו, הוא איש טכני מצוין — היה מנכ"ל ב-Cerebras, הוביל את TensorFlow — אבל הוא לא מגיע עם "halo" של הסאביס. בעולם ה-AI, כשאתה מחליף את האיש שזכה בפרס נובל לכימיה ב-2024, אתה שולח מסר.
המסר הזה הגיע: גוגל כבר לא רואה ב-AI את העתיד שלה. היא רואה בו עוד מוצר.
למה Gemini 3.5 Pro בוטל?
שאלה טובה. הדיווחים מצביעים על כמה סיבות שמצטברות:
- כשל טכני: training-data refresh השאיר את ה-pipeline חודשים מאחור. המודל פיספס את היעד של Google I/O (יוני), את יולי, ואת תחזית תחילת אוגוסט.
- בעיות ביצועים: גם כשעבד, 3.5 Pro לא הצליח לעבור את ה-GenAI Quality Bar הפנימי של גוגל במדדים קריטיים (קידוד agentic, multi-step reasoning).
- trade-off תקציב: ה-training run עלה מעל $200M. גוגל החליטה שעדיף לקצץ ב-flagship ולהשקיע ב-Flash tiers.
- תחרות קשה: גם אם 3.5 Pro היה יוצא, הוא היה צריך להתחרות ב-GPT-5.6 Sol (88.8 ב-Terminal-Bench 2.1) וב-Claude Opus 5 (43.3% ב-Frontier-Bench). הפער אולי היה גדול מדי.
הסימנים שלא ראינו
חשוב להבין שהביטול לא הגיע בהפתעה גמורה. כבר ברבעון השני של 2026 היו דיווחים פנימיים על כך שצוותי Gemini post-training לא מצליחים לעבור את ה-rubicon של "פי 2 שיפור על פני הדור הקודם" במדדי ה-agentic. גוגל עצמה הציבה לעצמה סטנדרט פנימי גבוה מדי, והפתרון שבחרה היה לא לפרסם את הכישלון.
הסימן הראשון היה בכנס Google I/O ביוני, אז גוגל הציגה רק את 3.6 Flash והצהירה ש-Pro "בקרוב". שבועיים אחר כך, אנליסטים מ-The Information דיווחו שה-pre-training run היה חצי מוצלח בלבד. גוגל הכחישה. ביולי, כבר לא ניתן היה להסתיר.
ההיבט התקציבי — למה $200M זה הרבה
כדי להבין את גודל הכישלון, צריך להבין את המספרים: training run של Gemini 3.5 Pro דרש כ-25,000 H100 שעלו כ-$200M רק בחישוב. זה לא כולל את עלויות הצוות, הנתונים, או האנרגיה. ההחלטה לבטל את המודל אחרי השקעה כזו היא החלטה נדירה בתעשייה — Anthropic ו-OpenAI מעדיפות לשחרר מודל חלש מאשר לבטל אותו, כי ההחזר על API קיים גם אם הוא נמוך.
המשמעות: גוגל הגיעה לנקודה שבה היא מוכנה לספוג $200M הפסד כדי לא לפגוע במותג. זה חישוב ארוך-טווח שמעדיף את Gemini 4 על פני Gemini 3.5 Pro חצי-אפוי. השאלה היא אם החישוב הזה צודק — או אם הוא רק דוחה את הבעיה בשנה.
Gemini 3.7 Flash — הדגל החדש? באמת?
זה החלק הכי מביך. גוגל שחררה את 3.7 Flash ב-13 באוגוסט עם טענה לשיפור גדול:
| מדד | Gemini 3.6 Flash | Gemini 3.7 Flash |
|---|---|---|
| DeepSWE v1.1 | 49.0% | 65.3% |
| מחיר (input) | $1.50 | $0.75 |
| מחיר (output) | $7.50 | $3.75 |
אבל זה עדיין Flash. זה לא Pro. זה לא Ultra. זה המודל הזול והמהיר שאמור להיות ה"sidekick" של הדגם הראשי. כשגוגל מוכרת לכם את ה-Flash כתחליף ל-Pro, זה אומר ש-prompt של ה-Pro נמחק.
הקפיצה במחיר (50% הנחה על 3.6 Flash) גם היא סימן מדאיג: גוגל מתחילה להיכנס למלחמת המחירים ש-DeepSeek פתחה. רק שהפעם זה לא על frontier — זה על הדגם הקטן.
Pro vs Flash — למה זה משנה לכם
הפער בין Flash ל-Pro לא תמיד ברור למי שלא בתעשייה. הנה ההבדלים המעשיים:
- context window: Flash תומך עד 1M tokens, Pro תומך עד 2M עם caching חכם יותר
- multimodal: Flash עובד עם תמונות ווידאו קצר; Pro מקבל עד 6 שעות וידאו ו-PDFs מורכבים
- tool use: Pro מבצע 3-4 פעולות יותר לפני שהוא נשבר; Flash נשבר מהר יותר על multi-step
- reasoning: Pro מציג chain-of-thought ארוך ומדויק יותר במשימות קשות
בקיצור: אם האפליקציה שלכם עושה RAG פשוט או chat — Flash מספיק. אם אתם בונים agent שמבצע פעולות ארוכות — צריך Pro.
מי הם החוקרים שעוזבים?
לפי דיווחים ב-Axios וב-VentureBeat, לפחות 8 חוקרי Gemini בכירים עזבו ל-xAI, Anthropic, ולפחות אחד ל-Mistral. שמות שמסתובבים:
- Nikhil Naik — לשעבר ראש צוות RLHF ב-DeepMind, עבר ל-Anthropic
- Lili Chen — מהצוות של Gemini Robotics, עברה ל-xAI לפרויקט Optimus
- Barret Zoph (לא אושר רשמית, אבל הוא כבר לא רשום ב-Google Scholar) — היה VP ל-Strategy
זה לא מוביל לקריסה מיידית. אבל זה הזרם המתמשך. הסאביס עצמו אמר ב-2024 ש"אנחנו מפסידים את הקרב על הטאלנטים" — והוא צדק.
למי זה משנה — סטארטאפים ישראליים
אם אתם בונים מוצר AI בישראל, המשבר של גוגל הוא הזדמנות מעשית, לא רק חדשה תעשייתית:
גיוס כוח אדם: חוקרים יוצאים מ-DeepMind מחפשים פרויקטים מעניינים. סטארטאפים ישראליים שיכולים להציע equity + mission יכולים לגייס top-tier talent במחיר נמוך מהשוק. תל אביב והרצליה הם יעד טבעי לאנשים שעוזבים את לונדון.
מעבר למתחרים: עד אוגוסט 2026, הרבה סטארטאפים ישראליים השתמשו ב-Gemini API בגלל ה-Workspace integration והמחיר הנמוך של Flash. עכשיו ה-Flash הוזל עוד יותר — מה שטוב לכם — אבל Pro לא זמין. תכננו multi-model: routing בין Gemini Flash ל-DeepSeek V4-Pro או Claude Opus 5.
בניית תשתית על Gemini: לא. אל תבנו product שתלוי ב-Gemini Pro שיגיע בסוף 2026. תכננו כאילו הוא לא יגיע בזמן. אם הוא כן יגיע — בונוס.
AI Overviews ו-Search: גוגל עדיין שולטת ב-90% מהחיפושים בישראל. ה-AI Overviews משתמשים ב-3.7 Flash וזה יציב. אם המוצר שלכם תלוי ב-SEO — אתם בסדר. אם הוא תלוי ב-API Pro ל-agentic — תזיזו.
פתיחת weights: גוגל לא פתחה את ה-weights שלה, אבל התחרות (Meta, DeepSeek, Alibaba) פתחה. זה הזמן לחשוב על self-hosting של Muse Glimmer (30B, 24GB GPU) לפרויקטים שלא צריכים frontier.
עלות ה-API של Flash: עכשיו 3.7 Flash ב-$0.75/$3.75 למיליון tokens — חצי ממה שהיה לפני חודשיים. אם המודל שלכם עושה RAG על מסמכים או סיכום טקסטים, זה המחיר הכי אטרקטיבי בשוק כרגע עבור closed API.
Gemini 4 — מה גוגל צריכה לעשות נכון?
אם גוגל רוצה לחזור לתחרות, היא צריכה:
- להוציא מודל שעובר את GPT-5.6 Sol ב-Terminal-Bench 2.1 (88.8) וב-HLE (64.5%)
- לעצור את ה-Flash-first mindset — חזרה ל-Pro tier אמיתי
- לאחד את הצוות תחת מנהיג טכני אחד (קבוקוגלו הוא הבחירה הנכונה, אבל הוא צריך סמכות מלאה)
- לפתוח את ה-weights לפחות של המודל הקטן יותר — דוגמת Meta Muse Glimmer שעשתה זאת עם Apache 2.0
- לחתוך את ה-bureaucracy — הסאביס התלונן שהוא בילה 40% מהזמן שלו באישור מ-Alphabet
ההשלכות לשוק
החולשה של גוגל היא הזדמנות ענקית ל:
- xAI: Grok 4.7 צפוי תוך שבועות, ויש לו 1,753 Arena ELO. פער בינו לבין גוגל רק יגדל.
- OpenAI: ה-IPO של ספטמבר 2026 יגיע עם סיפור של "מובילי השוק". גוגל איבדה את המומנטום.
- Anthropic: Claude Opus 5 ב-Frontier-Bench 43.3% נראה כמו בדיחה לעומת גוגל שאמורה להוביל. היא מובילה.
- DeepSeek + Alibaba: הן מילאו את החלל ב-frontier + open-source. כל חודש שגוגל מתעכבת הוא נחלה שלהן.
טבלת סיכום — ההתרסקות של גוגל
| תאריך | אירוע | משמעות |
|---|---|---|
| יוני 2026 | Gemini 3.5 Pro מפספס Google I/O | רמזים ראשונים לבעיה |
| יולי 2026 | 3.5 Pro נדחה שוב | הצוות במשבר |
| 6 באוג' | הסאביס פורש → Kavukcuoglu | אובדן מנהיגות |
| 13 באוג' | Gemini 3.7 Flash בלבד | Pro tier בוטל |
| 24 באוג' | Anthropic מודיעה על Opus 5 benchmarks | גוגל לא יכולה לענות |
| ספט' 2026 | OpenAI IPO | גוגל נכנסת ל-IPO עם מוצר AI מוחלש |
| נוב'-דצ' 2026 | Gemini 4 יוצא? | אולי מאוחר מדי |
מה הלאה — ספטמבר-אוקטובר 2026
הנה מה שאנחנו צופים בחודשיים הקרובים:
ספטמבר 2026:
- OpenAI IPO (אמצע החודש) — גוגל תצטרך לענות ב-press cycle. הציפייה: הכרזה על תאריך יעד ל-Gemini 4, לפחות הבטחה ל-flagship חדש.
- xAI Grok 4.7 — צפוי תוך שבועות, עם טענה ל-Arena ELO מעל 1,800. אם זה יקרה, גוגל תיפול למקום 4 או 5 במדד.
- Kavukcuoglu יערוך את הופעת הבכורה שלו בכנס — כנראה הצהרה זהירה על "Gemini 4 בדרך", בלי תאריך.
אוקטובר 2026:
- חוקרים נוספים עוזבים — סביר שעוד 4-6 יעזבו עד סוף אוקטובר, במיוחד אם Anthropic תכריז על גל גיוס חדש.
- Workspace + AI Overviews ימשיכו להתפתח על בסיס 3.7 Flash — זה ה-product שמכניס כסף, לא ה-flagship.
- אם Gemini 4 לא יוכרז עד סוף אוקטובר, השוק יפסיק להאמין שהוא בכלל בפיתוח.
תרחיש אופטימי לגוגל: Gemini 4 יוצא בנובמבר עם Terminal-Bench 2.1 מעל 89, beats GPT-5.6 Sol ב-2-3 נקודות, ומחזיר את ה-Arena ELO ל-1,800+. הסיכוי לכך: 20%.
תרחיש ריאלי: Gemini 4 נדחה ל-Q1 2027, יוצא בפברואר עם ביצועים דומים ל-GPT-5.6 אבל לא עוקף. גוגל ממשיכה להיות "second-tier" ל-12 חודשים נוספים.
תרחיש פסימי: Gemini 4 בוטל, וגוגל עוברת ל-strategy של "fast follower" — מחכה שאחרים יוציאו, אז משחררת גרסה זולה יותר. זה מה שעשתה עם ה-Flash עד עכשיו.
שאלות נפוצות
למה הסאביס פרש דווקא עכשיו? כנראה שילוב של לחץ מ-Alphabet (שרוצה לשלוט יותר בכיוון) והצעה לתפקיד "visionary" שנותנת לו חופש מהצד התפעולי. הוא עדיין ייעץ, אבל לא יוביל ישירות.
האם Gemini 4 יצליח? אם ייצא בנובמבר-דצמבר 2026, עם post-training משמעותי, ואם יעבור את GPT-5.6 Sol — יש סיכוי. אם יידחה ל-2027 — גוגל כבר לא תהיה בתחרות.
האם עליי לעבור ל-Gemini 3.7 Flash? תלוי. אם אתה משתמש ב-Workspace, Gemini in Docs ו-Search AI Overviews יעברו אוטומטית. אם אתה מפתח API — תחכה ל-Pro.
למה גוגל לא פותחת את ה-weights של Gemini? שאלה של מיליארד דולרים. גוגל מכרה Workspace + Cloud על בסיס ה-API של Gemini. פתיחת weights עלולה לפגוע ב-revenue. אבל גם לסגור אותם זה מסוכן — Meta Muse Glimmer כבר הוכיח ש-open-source עובד.
למי זה משנה? לכל מי שבונה מוצר AI ב-2026. מי שמוביל ב-AI ב-2026-2027 יקבע את התקן של כל התעשייה. גוגל שלא תוביל — תהיה ה-Foxconn של ה-AI, לא Apple.
האם כדאי לגייס חוקרי DeepMind עכשיו? אם אתם סטארטאפ בשלב seed/Series A עם mission ברורה — כן. ה-window window פתוח כרגע. החוקרים האלה לא יחכו עד 2027, הם יחפשו את הבית הבא תוך 6 חודשים. equity + autonomy + תקציב מחקר סביר = תוכלו להחתים top-tier.
מה ההבדל בין Gemini Flash לבין GPT-5.6 Luna? שניהם מודלים זולים. Flash טוב יותר ב-multimodal (וידאו, תמונות מורכבות) וב-context length. Luna טוב יותר ב-chat latency וב-tool calling פשוט. ל-production עם agents — Luna עדיף. לעיבוד מסמכים ו-PDFs — Flash.
למה ה-DeepSWE של Flash קפץ כל כך הרבה? המספרים מראים 49.0% ל-65.3% — קפיצה של 16.3 נקודות. זה לא רק "שיפור של הדגם". זה סימן שגוגל שינתה את גישת ה-post-training: יותר RL על coding, יותר synthetic data. החיסרון: ייתכן שהמודל overfitted לבנצ'מרק.
סיכום
החודש הגרוע ביותר של גוגל מאז הקמת DeepMind הוא לא תאונה — זה סימפטום. הסאביס לא הצליח לבנות ארגון שעובד ב-velocity של OpenAI. Kavukcuoglu יצטרך לבנות אותו מאפס, ויש לו 3-4 חודשים עד Gemini 4.
השאלה האמיתית לא תהיה "האם Gemini 4 יהיה טוב". השאלה תהיה "האם גוגל תסכים לשלם את המחיר של היותה השנייה הכי טובה למשך 12 חודשים". היסטורית, תשובתה של גוגל היא לא.
מקורות
- Axios, 6 באוגוסט 2026: https://www.axios.com/
- 9to5Google, 13 באוגוסט: https://9to5google.com/
- Google Official Blog, 13 באוגוסט: https://blog.google/
- DeepMind Blog: https://deepmind.google/
- VentureBeat, 24 ביולי: https://venturebeat.com/
- QZ, 31 ביולי: https://qz.com/
- Yotta Labs: https://yottalabs.ai/
- AI Apps Recap: https://www.aiapps.com/blog/ai-news-august-breakthroughs-launches-trends-cant-miss/
- NoloWiz, 23-30 באוגוסט: https://nolowiz.com/top-ai-news-of-the-week-august-23-august-30-2026/
- MindStudio, 4 באוגוסט: https://mindstudio.ai/
content: article-1-google-deepmind-crisis.md
מאמרים קשורים
מהקריאה לבנייה
יש לכם מערכת שצריכה לעבוד עם AI?
אני עוזר לעסקים להפוך מודלים, אוטומציות ותשתיות מאובטחות למערכות שאפשר להפעיל בפרודקשן.
בואו נדבר על הפרויקט