
OpenAI ו-Anthropic הוזילו מודלים באותו יום - עד 50%
שתי מעבדות ה-AI הגדולות השיקו מודלים חדשים בהפרש של פחות משעתיים, ושתיהן שמו את המחיר במרכז; השאלה היא אם טוקנים זולים יורידו את חשבון ה-AI של החברות - או פשוט יגרמו להן להשתמש הרבה יותר
התחרות בשוק מודלי הבינה המלאכותית עוברת מהשאלה מי חכם יותר לשאלה כמה עולה לבצע איתו עבודה אמיתית. ביום שלישי השיקה OpenAI את GPT-6 Sol ו-GPT-6 Luna במחירים נמוכים משמעותית מהדורות שהם מחליפים, כשעה וחצי בלבד אחרי ש-Anthropic השיקה את Claude Opus 5.5. בשני המקרים המסר דומה: יותר יכולת בפחות כסף.
Sol מתומחר ב-2 דולר למיליון טוקנים של קלט ו-10 דולר למיליון טוקנים של פלט, לעומת 4 ו-20 דולר קודם לכן. Luna ירד ל-0.10 דולר לקלט ו-0.50 דולר לפלט, לעומת 0.20 ו-1.20 דולר. המחיר של מודל הדגל GPT-6 Astra, שעומד על 10 דולר לקלט ו-50 דולר לפלט, לא השתנה.
Anthropic מתמחרת את Opus 5.5 ב-4 דולר למיליון טוקנים של קלט ו-20 דולר לפלט, ירידה של 20% לעומת Opus 5. המחיר של קריאות מתוך cache, רכיב משמעותי במיוחד במשימות תכנות ובמערכות שמפעילות סוכנים לאורך זמן, ירד ל-0.20 דולר למיליון טוקנים. לפי Anthropic, בעומסי עבודה טיפוסיים המודל זול בכ-40% מקודמו ומייצר פלט מהר יותר בכ-30%. ההשקה מגיעה כחודשיים בלבד אחרי Opus 5.
טוקנים הם יחידות הטקסט שעליהן נגבית העלות, כאשר מילה יכולה להיות מורכבת מטוקן אחד או מכמה טוקנים. בתרחיש של 10 מיליון טוקנים של קלט ומיליון טוקנים של פלט בחודש, העלות מגיעה לכ-60 דולר ב-Opus 5.5, לכ-30 דולר ב-Sol ולכ-1.5 דולר ב-Luna, לפני הנחות או שימוש במטמון.
המדד החדש: כמה עולה לסיים משימה
עבור חברות שבונות מוצרים על גבי המודלים, המחיר למיליון טוקנים הוא רק חלק מהתמונה. מה שמעניין אותן יותר הוא כמה עולה להגיע לתוצאה. מודל זול מאוד שלא מצליח לבצע את המשימה עלול להיות יקר יותר ממודל יקר שמסיים אותה בניסיון אחד.
OpenAI בנתה חלק גדול מהצגת Sol סביב המדד הזה. במבחן AutomationBench של Zapier, שבודק אם סוכן מסוגל לבצע תהליך עסקי מלא באמצעות עשרות כלים, Sol השיג 33.2% בעלות של 0.27 דולר למשימה. לפי הנתונים שהציגה OpenAI, Opus 5 הגיע ל-26.9% בעלות גבוהה משמעותית. Anthropic מציגה מצדה מבחנים שבהם Opus 5.5 מוביל על GPT-6 Astra במספר קטגוריות. אלה נתונים של החברות עצמן, ולכן הם בעיקר מלמדים כיצד כל אחת מהן בוחרת להציג את היתרון שלה.
הלחץ על המחירים לא מגיע רק מ-OpenAI ו-Anthropic. בתוך 48 שעות פורסמו עדכוני מודלים גם מצד xAI, שהשיקה את Grok 4.7 במחיר של 2 דולר למיליון טוקנים של קלט ו-6 דולר לפלט, ומצד שיאומי, שהציגה את סדרת MiMo-V2.6 ברישיון MIT וטוענת לביצועים תחרותיים במשימות של סוכנים.
מחיר הטוקן יורד, החשבון לא בהכרח
הוזלת המודלים לא מבטיחה שהוצאות ה-AI של החברות ירדו. ייתכן שיקרה בדיוק ההפך. כשמחיר השימוש יורד, ארגונים יכולים להרשות לעצמם להפעיל יותר סוכנים, לבצע יותר ניסיונות ולהעביר ל-AI משימות שבעבר נעשו על ידי עובדים או כלל לא בוצעו. חברה שמשלמת חצי מחיר לטוקן אבל משתמשת פי ארבעה עלולה לסיים את החודש עם חשבון גבוה יותר.
יש גם אותיות קטנות. ב-Sol וב-Luna המחיר עולה בבקשות ארוכות במיוחד, כאשר הפרומפט עובר 272 אלף טוקנים. עבור ארגונים שמריצים ניתוחי מסמכים גדולים, קוד בהיקף גדול או סוכנים ששומרים הקשר ארוך, הפער הזה יכול להיות משמעותי.
- דיברו על האטה - ועשרה ימים אחר כך השיקו דור חדש: הקרב ב-AI עובר למחיר
- המשותף לסוכני ה-AI שתקפו אתרים אמיתיים: חברה ישראלית שאמורה הייתה להגן על סביבת הבדיקה
לחברות ישראליות שבונות מוצרים על גבי המודלים, ירידת המחירים יכולה לשפר ישירות את שיעור הרווח הגולמי. מצד שני, היא גם מקלה על מתחרים חדשים להיכנס לשוק. מוצר שדרש בעבר תקציב משמעותי להפעלת מודלים יכול להיבנות היום בעלות נמוכה בהרבה, ולכן היתרון יעבור בהדרגה מהיכולת לשלם על המודל ליכולת לבנות סביבו מוצר שהלקוחות באמת צריכים.