סרברס מתוך X
סרברס מתוך X

פי 30 יותר מהר מאנבידיה? סרברס חושפת את ה-CS-4 עם 4 טריליון טרנזיסטורים

ה-CS-4 החדש כולל שלושה מעבדי WSE-3 Turbo עם 4 טריליון טרנזיסטורים בכל אחד ומכוון בעיקר לשוק ה-Inference הצומח; סרברס טוענת למהירות של יותר מ-4,400 טוקנים לשנייה למשתמש במודל GPT-OSS-120B ולשיפור משמעותי בצריכת החשמל; המשלוחים הראשונים צפויים להתחיל כבר ברבעון הנוכחי

מנדי הניג |
נושאים בכתבה סרברס אנבידיה

סרברס (Cerebras -12.69%  ) מעלה הילוך בניסיון שלה לקחת נתח משוק תשתיות ה-AI שנשלט כיום במידה רבה על ידי אנבידיה (NVIDIA Corp. -2.34%  ). החברה חשפה את ה-CS-4, הדור החדש של מערכת המחשוב שלה, שמגיעה בתצורת Rack ומתמקדת בעיקר ב-Inference, כלומר בשלב שבו מודל שכבר אומן מקבל בקשות ממשתמשים, מבצע חישובים ומייצר תשובות. זהו בדיוק החלק בשרשרת ה-AI שהופך למשמעותי יותר ככל שהשימוש במודלים עובר מצ'אט פשוט לסוכני AI שמבצעים רצף ארוך של פעולות וחישובים בזמן אמת.

המספר שסרברס רוצה שיעמוד לנו בראש מההשקה הוא ״עד פי 30״. היא טוענת כי ה-CS-4 מסוגל לייצר טוקנים בקצב הגבוה עד פי 30 ממערכות GPU שנבדקו מולה. בבדיקה על GPT-OSS-120B היא מדווחת על קצב של יותר מ-4,400 טוקנים לשנייה למשתמש. זה נתון שיכול להיות משמעותי במיוחד ביישומים כמו סוכני קוד, מחקר או מערכות Reasoning, שבהם המודל נדרש לבצע שורה של צעדים בזה אחר זה, ולכן כל עיכוב קטן בכל שלב מצטבר לזמן המתנה משמעותי. עם זאת, חשוב לסייג: מדובר בנתון שמוצג על ידי החברה על בסיס בנצ'מרקים פנימיים והשוואות שהיא מפרסמת, ולא בקביעה שלפיה ה-CS-4 יהיה מהיר פי 30 מכל GPU ובכל סוג של עומס עבודה.

בבסיס המערכת נמצאים שלושה שבבי WSE-3 Turbo, הגרסה החדשה של ארכיטקטורת ה-Wafer Scale Engine של סרברס. במקום לחתוך את פרוסת הסיליקון למאות שבבים קטנים כפי שנעשה בתעשייה בדרך כלל, החברה משתמשת למעשה בפרוסה גדולה כמעבד אחד. כל WSE-3 Turbo כולל כ-4 טריליון טרנזיסטורים, כ-900 אלף ליבות המותאמות לעבודות AI ו-44 ג'יגה-בייט של זיכרון SRAM שנמצא ישירות על הפרוסה. החברה מדווחת על כוח חישוב של עד 250 PFLOPS לכל Wafer ועל רוחב פס לזיכרון של 43.2 פטה-בייט לשנייה. במערכת שמכילה שלושה מעבדים כאלה מדובר בכוח חישוב מצטבר של עד 750 PFLOPS.

ה-SRAM הוא חלק מרכזי בסיפור. במערכות GPU מסורתיות חלק משמעותי מהזמן והאנרגיה נצרכים בהעברת נתונים בין המעבדים, הזיכרון והרשת שמחברת בין המאיצים. הגישה של סרברס מנסה לקצר את המרחקים האלה באמצעות כמות גדולה של זיכרון מהיר שנמצאת על גבי אותו Wafer ורשת פנימית שמחברת בין יחידות החישוב. בדור החדש החברה הורידה את זמן ההשהיה בתקשורת בין Wafer-ים עד לכ-2 מיקרו-שניות, ולדבריה הדבר מאפשר למערכות המבוססות על CS-4 לשמור על קצב של יותר מ-1,000 טוקנים לשנייה גם כאשר מריצים מודלים בהיקף של יותר מ-10 טריליון פרמטרים.

אבל הפעם סרברס לא מתמקדת רק במהירות השבב. ה-CS-4 הוא המוצר הראשון בארכיטקטורת Nexus החדשה שלה, שנועדה להפוך את הטכנולוגיה לקלה יותר לפריסה בדאטה-סנטרים גדולים. החברה פיתחה יחידת Wafer-Scale Backpack שמשלבת את המעבד, אספקת החשמל, הקירור והתקשורת במודול אחד. לדבריה, מספר הרכיבים ירד בכ-50%, חלק גדול יותר מהייצור עבר לאוטומציה וזמן ההתקנה יכול לרדת מימים לשעות. גם מערכת אספקת החשמל הוצמדה כמעט לחלוטין למעבד, במרחק של כ-0.5 מילימטר לעומת עשרות מילימטרים במערכות GPU טיפוסיות. המטרה היא לא רק להציג בנצ'מרק גבוה יותר, אלא לאפשר ללקוחות להקים ולהרחיב תשתיות בקנה מידה גדול בצורה פשוטה יותר.

כאן נמצאת גם התחרות האמיתית מול אנבידיה (NVDA). המובילה בשוק כבר משווקת את מערכת GB300 NVL72, שמרכזת 72 מעבדי Blackwell Ultra ו-36 מעבדי Grace בתוך Rack אחד ומיועדת אף היא לעבודות Reasoning ו-Inference. אנבידיה (NVDA) טוענת לשיפור של פי 10 בקצב הטוקנים למשתמש ושל פי 5 בתפוקה למגה-ואט לעומת מערכות Hopper, ובמקביל כבר מתחילה להכניס לייצור את דור Vera Rubin. כלומר, סרברס (CBRS) לא מתחרה במטרה שעומדת במקום. היא מנסה להוכיח שארכיטקטורה שונה לחלוטין מזו של GPU יכולה לתת יתרון מספיק גדול במהירות וביעילות כדי להצדיק מעבר של לקוחות מתשתית שכבר נבנתה סביב האקוסיסטם של אנבידיה (NVDA).

יש כבר סימנים לכך שהמהירות של סרברס (CBRS) אינה קיימת רק במצגות החברה. במדידות של Artificial Analysis, השירות של סרברס על GPT-OSS-120B הגיע לאחרונה לכ-1,859 טוקנים לשנייה והוביל בין ספקי ה-API שנמדדו. אלא שהנתון הזה מתייחס לתשתית הקיימת ולא ל-CS-4 החדש. לכן המספר החדש של יותר מ-4,400 טוקנים לשנייה עדיין יצטרך לעבור את מבחן השימוש בפועל ומדידות בלתי תלויות אחרי שהמערכות החדשות יגיעו ללקוחות.

הטכנולוגיה מתקדמת, אבל המניה עדיין צריכה לשכנע

ההשקה מגיעה בתקופה מורכבת מבחינת סרברס. ברבעון השני החברה הציגה הכנסות GAAP של 180.1 מיליון דולר, עלייה של 74% לעומת התקופה המקבילה, אבל מתחת לפני השטח חל שינוי משמעותי בתמהיל הפעילות. ההכנסות מענן ושירותים אחרים הגיעו לכ-126 מיליון דולר וזינקו ב-281%, בזמן שהכנסות החומרה ירדו מ-70.3 מיליון דולר לכ-54.1 מיליון דולר, ירידה של כ-23%. במילים אחרות, סרברס הופכת בהדרגה מחברה שמוכרת בעיקר מערכות מחשוב לחברה שמנסה למכור את כוח החישוב שלה כשירות.

השינוי הזה דורש השקעות גדולות בתשתיות. החברה דיווחה ברבעון על הפסד GAAP של 450.5 מיליון דולר, כאשר 377 מיליון דולר ממנו היו הוצאות תגמול מבוסס מניות. בנטרול התאמות שונות הציגה סרברס  הפסד Core של 6.9 מיליון דולר ושיעור רווח גולמי Core של 40.6%. במקביל היא העלתה את התחזית השנתית להכנסות Core של 880-890 מיליון דולר, עם רווחיות גולמית Core של 41%-43%, אבל עדיין צופה שיעור הפסד תפעולי Core של 17%-19%.

לחברה יש גם צבר שאיפות גדול. סרברס חתמה עם OpenAI על הסכם רב-שנתי בהיקף של יותר מ-20 מיליארד דולר לפריסה של 750 מגה-ואט של מערכות החברה, ובדוחות האחרונים דיווחה על 600 מגה-ואט של קיבולת דאטה-סנטר שכבר נמצאת תחת חוזים ועל Remaining Performance Obligations בהיקף של 25.4 מיליארד דולר. לצד OpenAI היא עובדת גם עם AWS ו-AMD על פתרונות Inference שבהם שלבי החישוב השונים מחולקים בין ארכיטקטורות שונות. 

ועדיין, המשקיעים נשארים זהירים. מניית סרברס הונפקה במאי האחרון במחיר של 185 דולר, פתחה את יום המסחר הראשון סביב 350 דולר ואף הגיעה בהמשך לשיא של יותר מ-386 דולר. מחיר המניה האחרון עומד על 220 דולר. כלומר, היא איבדה כ-37% לעומת מחיר הפתיחה ביום המסחר הראשון וכ-43% מהשיא, אם כי היא עדיין גבוהה בכ-19% ממחיר ההנפקה עצמו. הירידות התחזקו אחרי פרסום הדוחות לרבעון השני, כשהשוק התמקד בקצב ההוצאות, בהשקעות הנדרשות להרחבת תשתיות הענן ובדרך

הוספת תגובה

תגובות לכתבה:

הגב לכתבה

השדות המסומנים ב-* הם שדות חובה