ב-2 בספטמבר 2026 השיקה גוגל את Gemini 3.8 Flash — העדכון השלישי בשכבת Flash בתוך שישה שבועות, ושלושה שבועות בלבד אחרי 3.7 Flash. לצידו הגיעה Gemini 3.8 Flash Cyber, גרסה ייעודית לאבטחה שהגישה אליה סגורה לחלוטין.
שני המודלים באים מאותו בסיס. מה שמפריד ביניהם אינו גודל, מחיר או קצב — אלא מי מורשה להשתמש בהם. זו נקודה שכדאי להתעכב עליה, כי היא חוזרת השבוע אצל שלוש המעבדות הגדולות.
מה שחשוב לדעת
- מחיר פותח: 0.75 דולר לקלט, 3.75 דולר לפלט — מוכפל ב-1 בינואר 2027
- חלון הקשר: 1,048,576 טוקנים, פלט עד 64 אלף
- מולטימודלי: טקסט, תמונה, אודיו, וידאו ו-PDF
- בנצ'מרקים: HLE-Verified 54.9%, CWE-Bench 47.2% pass@1, מעל 70% בגילוי חולשות אמיתיות
- קצב: שלושה עדכוני Flash בשישה שבועות
- Flash Cyber: סגור, בגישה דרך תוכנית Fairwind בלבד
מה חדש
גוגל מתארת את 3.8 Flash כמודל העבודה החכם ביותר שלה, עם שיפורים משמעותיים על פני 3.7 Flash בהנדסת תוכנה, משימות סוכניות וחשיבה רב-שלבית בתחומים מקצועיים. המודל תומך בטקסט, תמונה, אודיו, וידאו ו-PDF, עם חלון הקשר של מיליון טוקנים ופלט של עד 64 אלף טוקנים.
המיקוד המוצהר הוא קידוד ארוך טווח וסוכנים אוטונומיים — אותה קטגוריה שאליה מכוונים גם GPT-6 Astra ו-Claude Fable 5.1. ההבדל הוא שכאן מדובר בשכבת מחיר נמוכה בסדר גודל.
תמחור — והמלכודת שבו
| תקופה | קלט (למיליון טוקנים) | פלט (למיליון טוקנים) |
|---|---|---|
| עד 31 בדצמבר 2026 | 0.75 דולר | 3.75 דולר |
| מ-1 בינואר 2027 | 1.50 דולר | 7.50 דולר |
זו הנקודה החשובה ביותר במאמר הזה: המחיר הפותח הוא מבצע היכרות, והוא מוכפל בתחילת 2027. אם אתם בונים תחזית עלויות לשנה הבאה, השתמשו במספר הגבוה. קל ליפול בטעות הזאת, ויקר לגלות אותה בדיעבד — צוות שמתכנן תקציב שנתי לפי 0.75 דולר יגלה באמצע ינואר שהחשבון קפץ פי שניים.
עם זאת, גם אחרי ההכפלה התמונה נשארת אטרקטיבית. 1.50 דולר לקלט הוא עדיין 15% ממחיר מודלי הדגל, שעומדים על 10 דולר. זו בדיוק הנקודה של שכבת Flash: לא להתחרות בקצה היכולת, אלא להיות מספיק טובה לרוב העבודה במחיר שמאפשר להריץ אותה בקנה מידה.
הבנצ'מרקים
| בנצ'מרק | תוצאה | מה הוא בודק |
|---|---|---|
| HLE-Verified | 54.9% | שאלות ברמת מומחה בתחומים רחבים |
| CWE-Bench (תיקון) | 47.2% pass@1 | תיקון אוטומטי של חולשות אבטחה |
| DeepSWE v1.1 | עולה על רוב מודלי הדגל הגדולים | פתרון בעיות הנדסה אוטונומי |
| גילוי חולשות בעולם האמיתי | מעל 70% הצלחה | נבדק על פני 20 שפות תכנות |
הנתון המעניין ביותר כאן הוא DeepSWE. מודל בשכבת "workhorse" שמנצח מודלים גדולים ויקרים בהרבה במשימות הנדסיות מחזק מגמה שמסתמנת כבר כמה חודשים: לרוב עומסי העבודה, השכבה הזולה מספיקה.
הנתון של 47.2% בתיקון חולשות ראוי גם הוא לתשומת לב מעשית. זה אומר שכמעט אחת מכל שתי חולשות מתוקנת נכון בניסיון הראשון — מספיק טוב כדי לשלב את המודל כשלב סריקה ראשוני בצנרת CI, גם בלי הגרסה הסגורה.
Flash Cyber ותוכנית Fairwind
הגרסה השנייה, Flash Cyber, מחליפה את 3.5 Flash Cyber ומציגה מה שגוגל מכנה "ביצועים ברמת חזית בגילוי חולשות אוטונומי ותיקון אוטומטי". היא אינה זמינה לציבור.
הגישה עוברת דרך תוכנית Fairwind, שנותנת עדיפות לשלוש קבוצות: רשויות ממשלתיות מהימנות, מפעילי תשתיות קריטיות, ומתחזקי תוכנה. גוגל ניסחה את המבנה במפורש — מודל ליבה אחד, שתי מעטפות גישה שונות.
זה אינו מקרה בודד. באותו שבוע בדיוק שחררה OpenAI את Astra דרך תוכנית Daybreak, ו-Anthropic הגבילה את Mythos 5.1 לארגונים מסוננים ב-Project Glasswing. ניתחנו את הדפוס הזה בנפרד — הוא השינוי המבני האמיתי של השבוע.
הקצב: שלושה עדכונים בשישה שבועות
הקצב עצמו הוא הצהרה. גוגל שחררה שלושה עדכוני Flash בשישה שבועות, אחרי תקופה שבה נתפסה כמפגרת אחרי OpenAI ו-Anthropic בתודעה הציבורית.
המשמעות המעשית למי שבונה היא לא טריוויאלית: אל תקבעו את הארכיטקטורה סביב גרסה ספציפית. השתמשו במזהה מודל מפורש בקוד ובקונפיגורציה, החזיקו מערך בדיקות שאפשר להריץ מול גרסה חדשה תוך שעות, ותכננו החלפת מודל כשגרה תפעולית ולא כפרויקט.
הצד השני של הקצב הוא עומס. צוות שמנסה להעריך כל גרסה חדשה ברצינות יבזבז את כל זמנו על הערכות. הגישה המעשית היא להגדיר מראש סף — למשל, שדרוג רק אם יש שיפור מדיד בעומס הספציפי שלכם או ירידת מחיר משמעותית.
למי זה מתאים
- מתאים מאוד: עיבוד מסמכים בהיקף גדול, סוכני קידוד, משימות מולטימודליות, וכל עומס שבו העלות למיליון טוקנים היא השיקול המרכזי
- מתאים חלקית: סריקת אבטחה בסיסית בצנרת CI — 47.2% בתיקון חולשות זה שימושי כשלב ראשון, לא כתחליף לביקורת אנושית
- פחות מתאים: משימות שדורשות את קצה היכולת המוחלט — שם מודלי הדגל עדיין מובילים בפער מורגש
- לא רלוונטי: Flash Cyber, אלא אם אתם מפעילי תשתית קריטית או גוף ממשלתי שיכול לעבור את סינון Fairwind
איך זה מסתדר מול שאר השחרורים של אותו שבוע
שלוש המעבדות הגדולות שחררו מודל באותם שלושה ימים. ההשוואה מלמדת בעיקר על מיצוב, לא על "מי מנצח":
| מודל | תאריך | קלט למיליון | המיצוב |
|---|---|---|---|
| Claude Fable 5.1 | 1 בספטמבר | 10 דולר | דגל — מדע וסוכנים ארוכי טווח |
| Gemini 3.8 Flash | 2 בספטמבר | 0.75 דולר | מודל עבודה — נפח ומחיר |
| GPT-6 Astra | 3 בספטמבר | 10 דולר | דגל — שימוש במחשב וסייבר |
הפער במחיר בין השכבות הוא פי 13. השאלה המעשית לכל צוות אינה איזה מודל הכי חכם, אלא איזה חלק מהעומס באמת דורש מודל דגל. בפועל, אצל רוב הצוותים התשובה היא חלק קטן — סיווג, חילוץ, סיכום ותרגום עובדים מצוין בשכבת Flash.
הדפוס המומלץ הוא ניתוב: מודל זול כברירת מחדל, הסלמה למודל דגל רק כשהמשימה נכשלת או כשהיא מזוהה מראש כמורכבת. זה דורש קצת תשתית, אבל ההפרש בחשבון מצדיק אותה במהירות.
שאלות נפוצות
המחיר באמת יוכפל בינואר? כן. גוגל הצהירה במפורש שהתמחור תקף עד 31 בדצמבר 2026, ומ-1 בינואר 2027 יעלה ל-1.50 ו-7.50 דולר. תכננו תקציב לפי המספר הגבוה.
איך זה משתווה למודלי הדגל? בקטגוריות מסוימות — במיוחד הנדסת תוכנה אוטונומית — הפער קטן מאוד ביחס לפער המחיר. במשימות שדורשות חשיבה עמוקה במיוחד, מודלי הדגל עדיין מובילים.
אפשר להצטרף ל-Fairwind מישראל? התוכנית מכוונת לרשויות ממשלתיות, תשתיות קריטיות ומתחזקי תוכנה. חברה ישראלית בתחומים אלה יכולה לנסות, אבל הניסוח של גוגל מרמז על עדיפות לגופים אמריקאיים.
מה קורה עם 3.7 Flash? גרסאות קודמות ממשיכות לעבוד. בקצב הנוכחי, כדאי לבנות מערכת שמאפשרת החלפת מזהה מודל בקונפיגורציה במקום בקוד.
שורה תחתונה
Gemini 3.8 Flash הוא ברירת מחדל הגיונית לרוב עומסי הייצור: מחיר נמוך, חלון הקשר של מיליון טוקנים, תמיכה מולטימודלית רחבה, וביצועים הנדסיים שמתחרים במודלים יקרים בהרבה.
שני דברים לזכור לפני שמתחייבים. המחיר מוכפל בינואר 2027, ואת הגרסה החזקה באמת לגילוי חולשות אתם כנראה לא תקבלו. שניהם לא סיבה לוותר — רק סיבה לתכנן נכון.
מאמרים קשורים
מהקריאה לבנייה
יש לכם מערכת שצריכה לעבוד עם AI?
אני עוזר לעסקים להפוך מודלים, אוטומציות ותשתיות מאובטחות למערכות שאפשר להפעיל בפרודקשן.
בואו נדבר על הפרויקט