
1.4 יחידות מ-OpenAI ובשביעית מהמחיר: כך מצטמצם הפער מול סין
גל שחרורים של Kimi K3, GLM-5.3 ו-Qwen3.8 מקרב את החברות הסיניות למדדי הביצועים של OpenAI ואנתרופיק, ומחירוני הטוקנים שלהן נמוכים בהרבה. דווקא בשכבת המחיר הזולה ביותר המודלים האמריקאים שומרים על היתרון
במדד האינטליגנציה של Artificial Analysis, שמשקלל תשע בחינות עצמאיות בקידוד, בשימוש בכלים, בהסקה מדעית ובהקשר ארוך, Claude Opus 5 של אנתרופיק מוביל עם 63.1. המודל הסיני הגבוה ביותר, Kimi K3 של מונשוט, רשום על 59.7, ומיד אחריו GLM-5.3 של Z.ai עם 59.5. GPT-5.6 Sol של OpenAI יושב ביניהם עם 60.9, כך שהמרחק בין המודל האמריקאי הזה למודל הסיני הבא בתור מסתכם ב-1.4 יחידות.
Qwen3.8-Max של עליבאבא נמדד על 58 באותו מדד, ו-DeepSeek V4 Pro על 53.2. ארבע החברות שחררו דורות חדשים בתוך חודשים ספורים, וחלקן פרסמו גם את משקלי המודל לשימוש חופשי. מתוך 162 מודלים שנבחנו, 86 מגיעים עם משקלים פתוחים, ו-Kimi K3 עומד בראש הקבוצה הזאת. משקלים פתוחים מאפשרים לארגון להריץ את המודל על תשתית משלו, במקום לשלם לספק על כל קריאה בנפרד.
המדד בגרסתו הנוכחית כולל בין השאר את GDPval-AA, מבחן של משימות עבודה אמיתיות, את Terminal-Bench לעבודת קידוד בטרמינל, את GPQA Diamond להסקה מדעית ואת AA-LCR להקשר ארוך. הרכב כזה נותן משקל גבוה להתנהגות סוכנית, כלומר ליכולת של המודל להפעיל כלים ולהתקדם לבד במשימה מרובת שלבים, וזה בדיוק התחום שבו החברות הסיניות התקדמו הכי מהר.
המחירון הרשמי של Z.ai עומד על 1.4 דולר למיליון טוקני קלט ו-4.4 דולר למיליון טוקני פלט. אצל OpenAI, GPT-5.6 Sol מתומחר ב-5 דולר לקלט ו-30 דולר לפלט, ובאנתרופיק Claude Opus 5 עומד על 5 ו-25 דולר בהתאמה. כלומר פער של קרוב לפי שבעה בצד הפלט, מול הבדל של 1.4 יחידות ביכולת המדודה. להרחבה: בינה מלאכותית כמעט בחינם: המתחרות הסיניות מכרסמות בשוליים של OpenAI ואנת'רופיק
Kimi K3, שמוביל את הטבלה הסינית, מתומחר דווקא ב-3 דולר לקלט וב-15 דולר לפלט, בדיוק בשכבה של מודל הביניים של אנתרופיק. גם דיפסיק נעה בכיוון ההפוך והעלתה מחירים: V4 Pro עומד כעת על 1.32 דולר לקלט ו-3.96 דולר לפלט בשעות העומס, ובשעות הפנויות התעריף יורד למחצית. מנגד, קריאה חוזרת על הקשר שכבר עובד אצל מונשוט מתומחרת ב-0.30 דולר למיליון טוקנים, ומוזילה מאוד עבודה חוזרת על אותם מסמכים. הזלות הסינית מתפרסת אפוא באופן סלקטיבי ומשתנה מחברה לחברה. להרחבה: דיפסיק מעלה מחירים: מודלי V4 מתקרבים לרמות התמחור של המתחרות
העלות הממוצעת למשימה בודדת במדד ממחישה את ההפרש בצורה מעשית יותר: GLM-5.3 עולה 0.68 דולר למשימה, Kimi K3 עולה 0.84 דולר, GPT-5.6 Sol עולה 1.23 דולר ו-Claude Opus 5 מגיע ל-2.34 דולר. הזול בקבוצה כולה הוא דווקא מודל אמריקאי, GPT-5.6 Luna, עם 4.7 סנט למשימה בציון 52.3.
בפלטפורמת הניתוב OpenRouter, שמודדת טוקנים שעברו דרך ה-API שלה, שישה מתוך עשרת המודלים המובילים בשבוע האחרון הם סיניים. DeepSeek V4 Flash ראשון עם 11.3 טריליון טוקנים, Hy3 של טנסנט שני עם 9.83 טריליון, ו-GPT-5.6 Luna שלישי עם 5.8 טריליון. Claude Opus 5 מופיע במקום התשיעי עם 2.68 טריליון. המדידה הזאת מתארת תנועה של מפתחים דרך פלטפורמה אחת, לצד שימוש ישיר ב-API של החברות עצמן.
מוצר שמייצר מיליון טוקני פלט ביום מגיע לכ-132 דולר בחודש לפי המחירון של Z.ai, ולכ-900 דולר לפי המחירון של GPT-5.6 Sol. עבור חברות ישראליות שבונות שכבת מוצר מעל מודל חיצוני, ההפרש הזה יורד ישירות לשולי הרווח של כל קריאה ומשפיע על תמחור המנוי ללקוח הסופי. בצד השני של המשוואה, מרוץ המחירים בין ספקיות המודלים מכווץ את ההכנסה לטוקן, ומגלגל את השאלה אל היקף ההשקעה בשבבים ובמרכזי נתונים. להרחבה: איך מודל שפה עובד באמת: אימון, פרמטרים וחיזוי המילה הבאה
מהירות הפלט מסדרת את הטבלה אחרת: GLM-5.3 מייצר 82.6 טוקנים בשנייה, Claude Opus 5 מגיע ל-56.9, ו-Kimi K3 עומד על 38.1. במשימות ארוכות המהירות מתורגמת לזמן המתנה של המשתמש, והיא נכנסת לשיקול לצד התעריף.
- יוניטרי פתחה בזינוק של 629% וסיימה ב-460%: כך התגלגל יום המסחר הראשון
- בורסת הונג קונג ברבעון שיא - הרווח קפץ 21% וההנפקות חוזרות
בשכבת הכניסה OpenAI מתמחרת את Luna ב-0.20 דולר לקלט וב-1.20 דולר לפלט, ואת Terra ב-2 ו-12 דולר למיליון טוקנים. מולם עומדים 1.4 ו-4.4 דולר של GLM-5.3, ו-0.44 ו-1.32 דולר של DeepSeek V4 Flash בשעות העומס.