עליבאבא
צילום: Istock

עליבאבא הולכת על מודל AI קטן יותר וזול להפעלה

Qwen3.8 27B כולל 27 מיליארד פרמטרים בלבד, אך הגיע לצמרת המודלים הפתוחים במבחן ביצועים חיצוני; המחיר מתחיל ב-0.5 דולר למיליון טוקנים של קלט, בזמן שעליבאבא מגדילה את ההשקעה בתשתיות AI והענן שלה צומח ב-45%

בן פלמון |
נושאים בכתבה עליבאבא

המרוץ בתחום הבינה המלאכותית כבר לא עוסק רק בבניית מודלים גדולים יותר. עליבאבא Alibaba 0.95%  מנסה להראות שאפשר לקבל ביצועים גבוהים גם ממודל קטן יחסית, שדורש פחות כוח מחשוב ועשוי להתאים לחברות שרוצות לשלוט בהוצאות.

החברה השיקה את Qwen3.8 27B, מודל הכולל 27 מיליארד פרמטרים. הוא תומך בטקסט, בתמונות ובווידאו, ויכול לשמש לכתיבת קוד, עבודה עם מסמכים, חיפוש ברשת והפעלת סוכני AI. חלון ההקשר שלו מגיע עד מיליון טוקנים, כך שהוא מסוגל לעבד כמות גדולה של חומר בבקשה אחת.

בעולם מודלי ה-AI, 27 מיליארד פרמטרים נחשבים למספר נמוך יחסית. מודלים גדולים כוללים לעיתים מאות מיליארדי פרמטרים ודורשים מערכי שבבים יקרים כדי לפעול. המודל של עליבאבא אמנם קטן מהם, אך במבחן של Artificial Analysis קיבלה גרסת החשיבה שלו ציון 52 ודורגה ראשונה מבין 138 מודלים פתוחים בקבוצת ההשוואה שלה.

המבחן גם הצביע על חסרונות. קצב הפקת התשובות עמד על כ-54 טוקנים בשנייה, נמוך מהחציון בקרב מודלים פתוחים בגודל דומה. המודל גם השתמש בכמות גדולה יחסית של טוקנים כדי לענות, ולכן מחיר נמוך לכל טוקן לא תמיד מבטיח שעלות המשימה כולה תהיה נמוכה.

פחות כוח מחשוב לכל משימה

המשקלים של Qwen3.8 27B זמינים תחת רישיון Apache 2.0. חברות ומפתחים יכולים להוריד את המודל, להתאים אותו לצורכיהם ולהפעיל אותו על תשתית משלהם. האפשרות הזאת מתאימה לארגונים שמעדיפים לשמור מידע בתוך החברה או להפחית את התלות בשירות חיצוני.

בשירות הבינלאומי של עליבאבא קלאוד המחיר עומד על 0.5 דולר למיליון טוקנים של קלט ו-3 דולר למיליון טוקנים של פלט. בסין המחיר נמוך יותר: 0.424 דולר לקלט ו-1.696 דולר לפלט. המחיר גבוה יחסית לחלק מהמודלים הפתוחים באותו טווח גודל, אך הוא עדיין עשוי להיות נמוך מהפעלת מודלי הדגל הגדולים במשימות רבות.

הפער מקבל משמעות גדולה יותר בשימוש בסוכני AI. סוכן שקורא מסמכים, מחפש מידע, מפעיל כלים ובודק את התוצאה יכול לצרוך הרבה יותר טוקנים משיחה רגילה עם צ'אטבוט. חברה שמפעילה סוכנים בהיקף גדול יכולה להעביר משימות שגרתיות למודל קטן יותר ולהשתמש במודל יקר רק במקרים מורכבים.

זו גם הסיבה שחברות AI מציעות כיום משפחות של מודלים בגדלים שונים. לא כל בקשה דורשת את המודל החזק ביותר. שירות לקוחות, סיכום מסמכים, חיפוש מידע ועבודה משרדית יכולים לעיתים להתבצע במודל קטן וזול יותר.

עבור עליבאבא, Qwen הוא גם כלי לקידום פעילות הענן. החברה יכולה להציע את המודל במחיר נמוך, למשוך לקוחות לעליבאבא קלאוד ולהרוויח מהשימוש שלהם בכוח מחשוב, באחסון ובשירותים נוספים.

הנתונים האחרונים של החברה מראים עד כמה התחום הפך מרכזי עבורה. הכנסות פעילות הענן וה-AI עלו ברבעון האחרון ב-45% ל-48.4 מיליארד יואן. הכנסות מוצרי ה-AI רשמו צמיחה תלת-ספרתית זה 12 רבעונים ברציפות.

במקביל, הוצאות ההון של עליבאבא עלו ב-75% ל-67.7 מיליארד יואן, כ-10 מיליארד דולר. חלק גדול מהכסף הופנה להרחבת כוח המחשוב ולתשתיות AI. ההכנסות הכוללות עלו ב-9% ל-269 מיליארד יואן, בעוד הרווח הנקי המיוחס לבעלי המניות ירד ב-76% ל-10.5 מיליארד יואן.

מודל קטן יותר יכול לעזור לעליבאבא לשרת יותר משתמשים באמצעות אותה תשתית. אם הוא מבצע חלק גדול מהמשימות ברמה מספקת, החברה צריכה להקדיש פחות שבבים וזיכרון לכל בקשה. עבור OpenAI, אנתרופיק וגוגל, התחרות אינה מגיעה רק מציוני הביצועים. מודלים סיניים פתוחים נותנים לחברות אפשרות להפעיל את המערכת בעצמן ולבחור בין כמה ספקים. ככל שהפערים בין המודלים מצטמצמים, המחיר ועלות ההפעלה מקבלים משקל גדול יותר בהחלטה.

Qwen3.8 27B אינו מחליף את המודלים הגדולים בכל משימה, וגם המהירות וצריכת הטוקנים שלו עדיין עלולות להכביד על העלות. הוא כן ממחיש את הכיוון שאליו השוק מתקדם: פחות התמקדות במספר הפרמטרים ויותר ניסיון לספק ביצועים גבוהים במחיר שאפשר להרחיב למיליוני משתמשים.

הוספת תגובה

תגובות לכתבה:

הגב לכתבה

השדות המסומנים ב-* הם שדות חובה