
ג׳מיני של גוגל: כל המודלים, המחירים והיתרון שאף מתחרה לא מחזיק
מיליארד משתמשים חודשיים, שני דורות מודלים שמוגשים במקביל ומחירון API שנע פי חמישה עשר בין הזול ליקר. מה גוגל באמת נותנת בכל מדרגת מנוי, כמה זה עולה בשקלים לשימוש עסקי, ואיפה המודל שלה עדיין מאכזב
מיליארד משתמשים חודשיים באפליקציית ג׳מיני, זה המספר שגוגל הציגה בקיץ 2026, והוא הפך אותה למוצר שצמח הכי מהר בהיסטוריה של החברה. מצב הבינה המלאכותית בתוך מנוע החיפוש מגיע לכ-75 מיליון משתמשים ביום, וסיכומי ה-AI שמופיעים מעל תוצאות החיפוש נחשפים לכ-2.5 מיליארד משתמשים בחודש.
ההבדל המרכזי בין גוגל למתחרות מתחיל בהפצה ולא באיכות המודל. OpenAI ואנתרופיק זקוקות למשתמש שיחליט להיכנס לאתר שלהן, ואילו ג׳מיני יושב כברירת מחדל בתוך החיפוש, בג׳ימייל, ב-Docs, בכרום, במפות ובמערכת ההפעלה אנדרואיד. ישראלי שמעולם לא נרשם לשום מנוי בינה מלאכותית כבר מקבל תשובות מהמודל של גוגל כמה פעמים ביום, בלי שהתכוון לכך. מפת החברות המלאה, כולל מי מממן את מי, מרוכזת במדריך הגג על חברות הבינה המלאכותית.
בצד העסקי גוגל מדווחת על יותר משמונה מיליון מושבים בתשלום ב-Gemini Enterprise, ביותר מ-2,800 חברות. אלפבית, חברת האם, היא חברה ציבורית הנסחרת בבורסה האמריקאית בשווי שנע סביב 4.8 טריליון דולר, והיא מתחרה על התואר החברה היקרה בעולם. המשמעות למשתמש פשוטה: מאחורי המודל עומדת מכונת מזומנים של פרסום וענן, ולא סבב גיוס שצריך להוכיח את עצמו.
שני דורות חיים במקביל, והשמות מבלבלים
שני דורות שלמים מוגשים בו זמנית, וזה מקור לבלבול אמיתי אצל מי שמנסה לבחור. דור 3 הוא החזית, ודור 2.5 עדיין פעיל ונתמך עבור מי שבנה עליו מוצר. בתוך המשפחה, מספר גבוה יותר מסמן דור חדש של אותה סדרה ולא בהכרח מודל חזק יותר: 3.6 Flash חדש מ-3.5 Flash, אבל 3.1 Pro חזק משניהם בכל מדד חשיבה.
| מודל | למה הוא מיועד | סטטוס |
|---|---|---|
| Gemini 3.1 Pro | המודל החזק במשפחה: חשיבה מורכבת, קוד וסוכנים | Preview |
| Gemini 3.6 Flash | סוס העבודה: מהיר, זול ורב-מודאלי | יציב |
| Gemini 3.5 Flash | הדור הקודם של סוס העבודה, יקר יותר בפלט | יציב |
| Gemini 3.5 Flash-Lite | מהירות גבוהה, כ-350 טוקנים בשנייה | יציב |
| Gemini 3.1 Flash-Lite | המחיר הנמוך במשפחת דור 3 | יציב |
| Gemini 2.5 Pro / Flash / Flash-Lite | הדור הקודם, נתמך למי שכבר בנה עליו | יציב |
| Nano Banana Pro | יצירת תמונות ועריכתן עד רזולוציית 4K | יציב |
| Nano Banana 2 | תמונות מהירות וזולות לשימוש המוני | יציב |
| Veo 3.1 | וידאו עם פסקול מסונכרן | Preview |
| Gemini Omni Flash | יצירה ועריכה של וידאו בתוך שיחה | Preview |
| Lyria 3 | יצירת מוזיקה, קליפ קצר או שיר מלא | Preview |
| Live ו-TTS | קול בזמן אמת ותרגום דיבור ביותר מ-70 שפות | Preview |
Gemini 3.6 Flash הוא הסוס העובד של גוגל היום, והוא הושק במחצית השנייה של 2026 כשדרוג יעילות ולא כקפיצת יכולת. הוא צורך כ-17% פחות טוקני פלט מקודמו על אותה משימה, מגיע ל-49% במבחן הקוד DeepSWE מול 37% של 3.5 Flash, ומחיר הפלט שלו ירד מתשעה דולר לשבעה וחצי דולר למיליון טוקנים. עדכון הידע הפנימי שלו הוזז קדימה לתוך 2026, אחרי שהדורות הקודמים נתקעו בתחילת 2025.
Gemini 3.1 Pro הוא המודל החזק במשפחה, והוא עדיין נושא את התווית Preview חודשים ארוכים אחרי שיצא. במבחן החשיבה ARC-AGI-2 הוא הגיע ל-77.1%, יותר מכפול מהציון של הדור הקודם גם במצב החשיבה המעמיקה Deep Think. מנגד, המודל שגוגל הבטיחה תחת השם 3.5 Pro התעכב ועדיין נבדק מול שותפים, וזו החמצה שמראה שגם ענק בגודל הזה מפספס לוחות זמנים שהוא עצמו קבע.
מרכז המידע: בינה מלאכותית
- חברות ומודלים של בינה מלאכותית: מי מוביל ומי מממן
- ChatGPT של OpenAI: המשפחה המלאה והתמחור
- קלוד של אנתרופיק: המודלים, המחירים ולמה הוא נבחר לקוד
- גרוק של xAI: מה הוא נותן בחצי מחיר
- מיקרוסופט, אמזון ומי שמוכר את התשתית
- איזה צ'אט AI מתאים לאיזו משימה
- איך עובדים עם צ'אט AI בפועל: ממשיחה ועד סוכנים
- חלון ההקשר: מה המודל זוכר ומה הוא שוכח
מעבר לצ׳אט גוגל מוכרת מודלים ייעודיים שלמתחרות אין להם מקבילה מסחרית. Antigravity הוא סוכן כללי שגולש ומריץ קוד, Deep Research ו-Deep Research Max מבצעים מחקר רב שלבי, Computer Use מפעיל דפדפן ומסכים כמו אדם, וסדרת Robotics ER עוסקת בחשיבה מרחבית לרובוטים. גוגל גם משיקה מודל אבטחת סייבר בשם 3.5 Flash Cyber שמוגש לממשלות ולשותפים נבחרים בלבד, ובכוונה איננו פתוח לציבור.
המחיר בשני צירים: מנוי חודשי מול טוקנים
ארבע מדרגות מנוי פתוחות לצרכן הישראלי, וההפרש ביניהן גדול. השכבה החינמית נותנת גישה מלאה ל-3.6 Flash, גישה מוגבלת ל-3.1 Pro, יצירת תמונות ועריכתן, מחקר עומק, שיחה קולית וסביבת Canvas לעבודה על מסמך. Google AI Plus מכפילה את המכסה ומוסיפה 400 ג׳יגהבייט אחסון, קרדיטים לכלי הווידאו Flow, שילוב ג׳מיני בג׳ימייל וב-Docs ושיתוף משפחתי עד חמישה אנשים, במחיר שנע סביב 19 עד 30 שקלים לחודש בהתאם למבצע הפעיל.
- 15 תרחישי שימוש בבינה מלאכותית: מהתלמיד ועד מנהל הכספים
- איך עובדים עם צ׳אט AI בפועל: משיחה פשוטה ועד סוכנים
Google AI Pro עולה כ-75 שקלים לחודש, וזו המדרגה שרוב המשתמשים הכבדים מגיעים אליה. היא נותנת מכסה גדולה פי ארבעה מהחינמית, גישה מלאה ל-3.1 Pro, חיפוש עומק, אלף קרדיטים ב-Flow, שימוש בסיסי ב-Antigravity ובסוכן הקוד Jules, חמישה טרהבייט אחסון ועשרה דולר קרדיט חודשי ב-Google Cloud. Google AI Ultra מתחילה סביב 390 שקלים לחודש במדרגת פי חמישה ומטפסת לכ-750 שקלים במדרגת פי עשרים, ומוסיפה את מצב Deep Think, את סביבת Project Genie ומנוי YouTube Premium.
המחירון ב-API עובד בהיגיון אחר לגמרי, והוא נמדד בטוקנים במקום בזמן. טוקן הוא פיסת מילה, והמודל סופר בנפרד את מה שנכנס אליו ואת מה שיוצא ממנו. כך נראה המחירון של המודלים המרכזיים, למיליון טוקנים:
| מודל | קלט למיליון טוקנים | פלט למיליון טוקנים |
|---|---|---|
| Gemini 3.1 Pro (עד 200 אלף טוקנים) | 2 דולר | 12 דולר |
| Gemini 3.1 Pro (מעל 200 אלף) | 4 דולר | 18 דולר |
| Gemini 3.6 Flash | 1.5 דולר | 7.5 דולר |
| Gemini 3.5 Flash | 1.5 דולר | 9 דולר |
| Gemini 3.5 Flash-Lite | 0.3 דולר | 2.5 דולר |
| Gemini 3.1 Flash-Lite | 0.25 דולר | 1.5 דולר |
| Gemini 2.5 Pro (עד 200 אלף) | 1.25 דולר | 10 דולר |
| Gemini 2.5 Flash-Lite | 0.1 דולר | 0.4 דולר |
הפלט יקר פי חמישה עד שישה מהקלט, וזו איננה גחמה שיווקית. הקלט נבלע במקביל בבת אחת, בעוד הפלט נוצר טוקן אחרי טוקן, ולכן כל מילה שהמודל כותב עולה הרבה יותר מכל מילה שהוא קורא. עברית מייצרת יותר טוקנים מאנגלית על אותו תוכן בדיוק, וזה מייקר את החשבון הישראלי בעשרות אחוזים מעל התחשיב האמריקאי. הרחבה על המנגנון הזה יש במדריך מה זה טוקן, ולמה הוא קובע כמה תשלמו.
בשקלים החשבון נראה כך. עסק ששולח 50 בקשות ביום, כל אחת בת אלפיים טוקני קלט ושמונה מאות טוקני פלט, צובר בחודש כשלושה מיליון טוקני קלט ומיליון ומאתיים אלף טוקני פלט. ב-3.6 Flash זה כ-13.5 דולר, סביב 40 שקלים בחודש. ב-3.1 Pro זה כ-20 דולר, סביב 61 שקלים. ב-3.1 Flash-Lite זה פחות משמונה שקלים. שער הדולר עומד סביב שלושה שקלים, ולכן ההמרה קלה: מחיר דולרי כפול שלוש.
שלושה סעיפים מזיזים את החשבון מעלה ומטה. מצב Batch, שמחזיר תשובות בהמתנה במקום מיידית, חוצה את המחיר בכל המודלים ומתאים לעיבוד קבצים בלילה. חיפוש ברשת מתומחר בנפרד בכ-14 דולר לאלף בקשות במודלי דור 3, וזה מצטבר מהר במוצר שמחפש בכל שאלה. יצירת מדיה מתומחרת ליחידה: תמונה ב-Nano Banana Pro עולה בין 0.13 ל-0.24 דולר לפי הרזולוציה, כלומר 40 עד 72 אגורות, וקליפ וידאו של שמונה שניות ב-Veo 3.1 באיכות מלאה עולה כ-3.2 דולר, קרוב לעשרה שקלים.
- חברות ומודלים של בינה מלאכותית: מי מוביל, מי מפגר ומי מממן את כולם
- גרוק של xAI: המודל שנבלע לתוך ספייס אקס, ומה הוא נותן בחצי מחיר
מול המודלים הסיניים המחיר של גוגל עדיין גבוה, וזה שווה בדיקה לפני שבונים מוצר שמריץ מיליוני בקשות. משפחות כמו דיפסיק וקוואן מגישות מודלים בשבריר מהמחיר, ולעיתים במשקולות פתוחות שאפשר להריץ על שרת פרטי, כפי שמפורט במדריך המודלים הסיניים: דיפסיק, קימי, קוואן וזעזוע המחירים. המשפחה המקבילה אצל OpenAI מפורטת במדריך על ChatGPT.
יכולות לפי תחום, ומה עדיין חסר
בכתיבה ג׳מיני מהיר, מסודר ופונקציונלי, והוא נופל מקלוד כשמדובר בטקסט מלוטש. הפרוזה שלו תקינה ומרגישה מכנית, ומי שמייצר תוכן שיווקי, מכתבים אישיים או מאמרי דעה מזהה את זה כבר בפסקה השנייה. לצרכים של תקצירים, טבלאות, מיילים ותשובות ענייניות הפער הזה כמעט חסר משמעות. אותה שאלה נבחנת מהצד של אנתרופיק במדריך על קלוד.
בקוד התמונה השתנתה השנה, ולא לטובת המפתחים הוותיקים. גוגל סגרה את Gemini CLI באמצע 2026 והפנתה את המשתמשים ל-Antigravity CLI, כתיבה מחדש סגורה שלא הגיעה עם מלוא היכולות של הכלי הקודם. Antigravity 2.0 שהוצג בכנס המפתחים כולל אפליקציית דסקטופ, כלי שורת פקודה וערכת פיתוח, ומאפשר להריץ כמה סוכנים במקביל, לבנות תתי סוכנים ולתזמן משימות שרצות ברקע. Jules הוא סוכן ענן נפרד שמחובר ל-GitHub, מרים מכונה נקייה לכל משימה ומחזיר בקשת מיזוג מוכנה. מה מבדיל סוכן כזה משיחה רגילה מוסבר במדריך העבודה עם צ׳אט.
בתמונה ובווידאו גוגל מובילה בפער גדול, וזה התחום החזק שלה. Nano Banana Pro מייצר ועורך תמונות עד רזולוציית 4K, Veo 3.1 מייצר וידאו עם פסקול מסונכרן, וכלי Flow מארגן את הקליפים לרצף סצנות עם המשכיות. Gemini Omni Flash מאפשר ליצור ולערוך וידאו בשיחה במקום בתפריטים, ו-Lyria 3 מייצר שיר שלם בשמונה סנט. אנתרופיק איננה מציעה יצירת תמונות או וידאו כלל, ו-xAI מייצרת קליפים קצרים יותר וברזולוציה נמוכה יותר. הפירוט על גרוק של xAI יושב במדריך משלו.
בקול גוגל מגישה מודלים בזמן אמת עם השהיה מתחת לשנייה, מודלי הקראה בשליטה על טון, ותרגום דיבור חי ביותר משבעים שפות. בניתוח מסמכים היתרון הוא חלון ההקשר: חלק מהמודלים בולעים מיליון טוקנים בבקשה אחת, מה שמאפשר להעלות דוח שנתי שלם או תיק חוזים ולשאול עליו שאלות צולבות. בחיפוש ברשת העיגון בנוי לתוך ה-API, ולכן מפתח מקבל תשובות עם מקורות עדכניים בלי לבנות מנגנון חיצוני.
מה שחסר הוא יציבות המוצר. חלק גדול מהיכולות המעניינות נושא את התווית Preview, ומודלים בסטטוס הזה משתנים, מתייקרים או נסגרים בהתראה קצרה. גוגל כבר קבעה מועדי כיבוי למודל התמונות Imagen 4 ולדורות הקודמים של Veo, וסגרה כלי שורת פקודה שמפתחים בנו עליו תהליכי עבודה שלמים. מי שמקים מוצר מסחרי על גוגל צריך לתכנן החלפת מודל כחלק מהתחזוקה השוטפת, ולא כאירוע חד פעמי.
האינטגרציה והשבבים: היתרון שאין למתחרים
גוגל מחליפה את Google Assistant בג׳מיני בכל מכשירי אנדרואיד הנתמכים, מהלך שיוצא לדרך בחודשים הקרובים. משמעותו שמיליארדי מכשירים עוברים ממנוע פקודות פשוט למודל שפה מלא, בלי שהמשתמש בחר בכך ובלי שהוא מוריד אפליקציה. אותו מהלך כבר קרה במחשבי Chromebook, שם קריאה לעוזר הישן מפנה אוטומטית לאפליקציית ג׳מיני.
בתוך מוצרי גוגל האינטגרציה כבר עובדת ביום יום. אפשר לבקש מג׳מיני לסכם שרשור מיילים בג׳ימייל, לנסח טיוטה ב-Docs, למצוא תמונה ב-Photos לפי תיאור מילולי, לתכנן מסלול במפות או לשלוף קובץ מ-Drive, והכול בשפה חופשית ובלי לצאת מהמוצר. עסק קטן שכבר עובד על Workspace מקבל שכבת בינה מלאכותית בלי פרויקט הטמעה, בלי חיבור מערכות ובלי עלות נוספת מעבר למנוי עצמו.
Gemini Spark הוא הצעד הבא, והוא סוכן שרץ מסביב לשעון במקום לחכות לשאלה. אפשר לשלוח לו מייל לכתובת ג׳ימייל ייעודית, הוא מבצע משימות רב שלביות, גולש ברשת דרך כרום ומדווח בחזרה, והוא נכלל במנוי Pro. עבור עצמאי זה אומר שהעוזר יושב בתוך תיבת הדואר במקום להיות אתר נפרד שצריך לזכור להיכנס אליו. תרחישים מעשיים לפי מקצוע מרוכזים במדריך התרחישים.
השבבים הם החלק שאי אפשר להעתיק בכסף. גוגל מריצה את ג׳מיני על מעבדי TPU מדור שביעי בשם Ironwood, שמגיעים ל-42.5 אקסה-פלופ במקבץ של 9,216 שבבים, עם 192 ג׳יגהבייט זיכרון מהיר לכל שבב ופי ארבעה ביצועים לשבב מול הדור הקודם. היא היחידה בחזית שמאמנת ומגישה מודלים על שבבים שהיא עיצבה בעצמה, בזמן שכל שאר המעבדות עומדות בתור לאנבידיה ומשלמות מרווח יצרן.
ההשקעה מאחורי המהלך הזה עצומה. אלפבית העלתה את תחזית ההשקעות ההוניות שלה לשנת 2026 לכ-205 מיליארד דולר, והיא כבר מוכרת את השבבים גם החוצה: הכנסות התשתית סביב ה-TPU נאמדות בכשלושה מיליארד דולר בשנת 2026 ובכ-25 מיליארד בשנה שאחריה. השליטה בשבב מסבירה איך גוגל מתמחרת מודל חזית בשני דולר לקלט ונשארת רווחית, בזמן שמתחרות שורפות הון על שכירת מחשוב.
איפה ג׳מיני נופל
שלוש תלונות חוזרות ונשנות עולות אצל משתמשים כבדים ואצל מפתחים. הראשונה היא נטישת הוראות בשיחות ארוכות: המודל מקבל כללים בפתיחה וסוטה מהם אחרי כמה סבבים. השנייה היא חוסר עקביות, כלומר אותה שאלה בדיוק מחזירה תשובות שונות בהרצות שונות. השלישית היא יציבות: משתמשים דיווחו על לולאות חשיבה שאינן נגמרות, שגיאות שרת ותקלה גלובלית שהשביתה את השירות.
הזיות נשארות בעיה גם בדור הזה, והן מגיעות בביטחון מלא. המודל ממציא מחקרים שלא קיימים, מייחס ציטוטים לאנשים הלא נכונים ומדייק פחות בנתונים היסטוריים ובמספרים. מי שמשתמש בו לעבודה מקצועית חייב מנגנון בדיקה, כפי שמוסבר במדריך הזיות: למה המודל ממציא, ואיך מזהים את זה בזמן.
איכות הכתיבה היא החולשה שהכי קשה למדוד והכי מורגשת בפועל. יש גם עלות נסתרת בריבוי המודלים: משתמש שאיננו מפתח מתקשה להבין מה ההבדל בין 3.6 Flash ל-3.5 Flash-Lite, ובאפליקציה עצמה הבחירה נעשית לרוב עבורו לפי מדרגת המנוי ולפי העומס על השרתים.
ההמלצה המעשית משתנה לפי סוג המשתמש. מי שחי בתוך ג׳ימייל ו-Docs ורוצה עוזר שכבר יושב שם ישלם 75 שקלים ל-Pro ויקבל את התמורה הגבוהה בשוק לכסף הזה. מי שמייצר תמונות, וידאו או מוזיקה ימצא אצל גוגל את הארגז הרחב ביותר בפער. מי שכותב טקסט שיווקי או מריץ פרויקטי קוד ארוכים כדאי שיבדוק מודל מתחרה במקביל לפני שהוא מתחייב לשנה מראש. איזה כלי מתאים לאיזו עבודה מפורט בחמישה עשר תרחישי השימוש.