ג'נסן הואנג, מנכ"ל אנביידה מאי 26 (רשתות)
ג'נסן הואנג, מנכ"ל אנביידה מאי 26 (רשתות)

אנבידיה מאיצה את סוכני ה-AI: המערכת החדשה נכנסת לייצור

אנבידיה מסמנת את השלב הבא ב-AI: אחרי שהשתלטה על שוק השבבים לאימון מודלים, היא רוצה לשלוט גם בתשתית שמאפשרת לסוכני AI לעבוד מהר יותר; המערכת החדשה נכנסת לייצור, נביוס תהיה הראשונה להכניס אותה לענן, ובמקביל החברה מרחיבה את פלטפורמת ורה רובין עד למחשוב בחלל. ברקע: הדוחות ביום רביעי והמבחן להמשך הביקוש ל-AI

ענת גלעד |

עד עכשיו התרגלנו למדוד בינה מלאכותית לפי איכות התשובה שהיא נותנת. אבל כש-AI מתחיל לעבוד במקומנו - לכתוב קוד, לפתוח קבצים, להפעיל תוכנות, לבדוק תוצאות ולתקן טעויות - נכנס למשוואה גורם נוסף: הזמן. סוכן AI יכול לבצע מאות ואף אלפי פעולות בדרך להשלמת משימה אחת, וכל עיכוב קטן מצטבר.

לשם אנבידיה מכוונת עם גרוק 3 LPX, מערכת חדשה להאצת הסקה שנכנסה לייצור מסחרי. החברה רוצה לקצר את הזמן שבין פעולה לפעולה של סוכני AI, ובמקביל להרחיב את הנוכחות שלה לעוד חלקים בתשתית שמפעילה אותם - מהמעבד המרכזי והתקשורת ועד מרכזי הנתונים, ואפילו מחשוב בחלל.

המהלך ממחיש לאן אנבידיה מנסה לקחת את העסק אחרי שהפכה לספקית המרכזית של מעבדים גרפיים לאימון מודלי AI: לא להסתפק במכירת המעבד, אלא לספק חלק גדול יותר מהמערכת שעליה הבינה המלאכותית מתאמנת, פועלת ומבצעת משימות. גרוק 3 LPX מגיעה בתצורת ארון שרתים ומשתלבת בפלטפורמת ורה רובין של אנבידיה. היא נועדה לטפל באחד מצווארי הבקבוק שנוצרים ככל שסוכני AI מקבלים משימות ארוכות ומורכבות יותר: יצירת טוקנים במהירות גבוהה ובזמן תגובה קצר.

לפי אנבידיה, במדד הביצועים של Artificial Analysis הגיעה המערכת לקצב של 3,400 טוקנים בשנייה בהרצת מודל Gemma 4 31B עם חלון הקשר של 100 אלף טוקנים. החברה טוענת כי אלה הביצועים הגבוהים ביותר שנמדדו עד כה עבור המודל וכי המערכת מספקת תגובתיות מהירה עד פי ארבעה לעומת הפלטפורמה החלופית המהירה ביותר שנבדקה.

המספרים האלה חשובים בעיקר בגלל מה שהם אמורים לאפשר. סוכן AI שכותב קוד, למשל, אינו מייצר תשובה אחת ומסיים. הוא עשוי לקרוא קבצים, לכתוב קוד, להריץ אותו, לבדוק את התוצאה, לזהות שגיאה ולנסות שוב. כל פעולה כזאת דורשת עוד עיבוד ועוד טוקנים, ולכן ככל שהסוכן מבצע יותר שלבים, מהירות ההסקה הופכת לחלק משמעותי מזמן העבודה הכולל.

כשה-AI לא רק עונה, הוא גם עובד

הדור הראשון של הבינה המלאכותית היוצרת התמקד בעיקר ביצירת תשובות. המשתמש כתב בקשה, המודל יצר טקסט, תמונה או קוד והתהליך הסתיים. בסוכני AI התמונה שונה: המטרה היא לתת למערכת משימה ולאפשר לה לבצע בעצמה שורה של פעולות בדרך לתוצאה.

מבחינת אנבידיה, זה גם שוק מחשוב חדש. ככל שיותר מודלים עוברים משלב האימון לשימוש בפועל, חלק גדל מהביקוש לחומרה מגיע מהסקה - כל אותן פעמים שבהן המודל מופעל כדי לענות, לחשב או לבצע פעולה. כאשר סוכן מפעיל את המודל שוב ושוב במהלך משימה אחת, כמות המחשוב הנדרשת גדלה בהתאם.

ג'נסן הואנג, מייסד ומנכ"ל אנבידיה, הגדיר את ההסקה כ"מנוע הצמיחה של הבינה המלאכותית". מבחינת החברה, המשמעות העסקית ברורה: אחרי שהרוויחה מהמרוץ לאימון מודלים גדולים, היא רוצה להיות הספקית המרכזית גם בשלב שבו המודלים האלה מופעלים שוב ושוב עבור מיליוני משתמשים וסוכני AI.

נביוס תכניס ראשונה את המערכת לענן

נביוס צפויה להיות ספקית ענן ה-AI הראשונה שתשלב את גרוק 3 LPX בסביבת ייצור, באמצעות פלטפורמת Token Factory שלה. עבור מפתחים, המשמעות היא שהם לא יצטרכו בהכרח לרכוש ולהפעיל בעצמם את החומרה. הם יוכלו להשתמש ביכולת יצירת הטוקנים המהירה דרך שירות הענן הקיים של נביוס, בלי לעבור לפלטפורמה אחרת.

גם גרוק עצמה צפויה להיות בין המאמצות הראשונות של המערכת ולשלב אותה בשירות הענן שלה.

המהלך ממחיש כיצד אנבידיה מנסה להרחיב את האחיזה שלה בשוק. במקום להתחרות רק על השאלה מי מייצר את שבב ה-AI החזק ביותר, היא בונה מערכת שבה המעבדים הגרפיים, המעבדים המרכזיים, התקשורת והתוכנה עובדים יחד. התחרות של אנבידיה מול AMD ואינטל עוברת בהתאם מהשבב הבודד אל המערכת השלמה שמפעילה את מרכז הנתונים.

באדיבות אנבידיה

אנבידיה רוצה גם את המעבד המרכזי

הכרזה נוספת של אנבידיה בכנס Hot Chips נוגעת למעבד המרכזי ורה (Vera), שפותח כחלק מפלטפורמת ורה רובין.

המעבד הגרפי הוא עדיין הרכיב המזוהה ביותר עם מהפכת ה-AI, אבל סוכני AI יוצרים עבודה רבה גם עבור המעבד המרכזי. כאשר סוכן מפעיל תוכנות, מריץ קוד, מעבד נתונים או מתאם בין פעולות שונות, לא כל העבודה נעשית על המעבד הגרפי.

קיראו עוד ב"BizTech"

ורה כולל 88 ליבות וזיכרון שמספק רוחב פס של עד 1.2 טרה-בייט בשנייה. לפי אנבידיה, הוא מאפשר להשלים משימות במהירות גבוהה עד פי 1.8 לעומת מעבדים המבוססים על ארכיטקטורת x86 בעומסי עבודה הכוללים סוכני AI, למידת חיזוק ועיבוד נתונים.

מבחינה עסקית, זה מכניס את אנבידיה עמוק יותר לתחום שבו אינטל ו-AMD היו במשך שנים שחקניות מרכזיות. אנבידיה כבר שולטת בחלק גדול משוק המעבדים הגרפיים למרכזי נתונים; אם היא מצליחה למכור לאותו לקוח גם את המעבד המרכזי, את רכיבי התקשורת ואת התוכנה, ההכנסה שלה מכל מרכז נתונים יכולה לגדול.

ורה רובין בדרך לחלל

SpaceXAI מתכננת לפרוס את מעבדי ורה בקנה מידה גדול עבור יישומי AI מבוססי סוכנים. אבל שיתוף הפעולה בין החברות לא אמור להיעצר במרכזי הנתונים שעל הקרקע.

לפי אנבידיה, Starmind, לוויין של SpaceXAI, יתבסס על פלטפורמת ורה רובין, ושתי החברות עובדות על התאמתה לדרישות המחשוב במסלול מחוץ לכדור הארץ.

מרכז נתונים על הקרקע יכול לקבל חשמל, קירור ותחזוקה באופן שוטף. מחשוב בחלל מציב מגבלות אחרות של צריכת אנרגיה, פיזור חום, תקשורת ואמינות. בשלב הזה מדובר בכיוון טכנולוגי יותר מאשר בשוק שמתקרב בהיקפו למרכזי הנתונים שעליהם נשען העסק של אנבידיה, אבל הוא ממחיש את הניסיון של החברה להפוך את ורה רובין מפלטפורמה של מעבדים גרפיים למערכת מחשוב רחבה יותר.

לא רק השבבים עצמם

אנבידיה הציגה בכנס גם את Scale-In, תשתית תקשורת חדשה שנועדה לטפל בשירותים שמסביב למחשוב ה-AI עצמו.

המערכת מבוססת על מעבד BlueField-4, תוכנת DOCA ופלטפורמת התקשורת Spectrum-X, ומיועדת לטפל בין היתר בקישוריות, אחסון, אבטחה, הקצאת משאבים וניטור בזמן אמת.

זה אולי פחות מושך תשומת לב מנתון של אלפי טוקנים בשנייה, אבל מבחינה עסקית הוא חלק מאותה אסטרטגיה. מרכזי AI גדולים אינם מורכבים רק ממעבדים גרפיים. ככל שהם גדלים, נדרשת יותר תשתית כדי לנהל אותם, להעביר נתונים, לאבטח את המערכות ולהקצות משאבים בין לקוחות.

אנבידיה מכנה מרכזים כאלה "מפעלי AI", והשאיפה שלה היא לספק יותר ויותר מהרכיבים שנמצאים בתוכם. ככל שלקוח משתמש במעבד הגרפי, במעבד המרכזי, בתקשורת, בתוכנה ובמערכות ההסקה של אנבידיה, החברה יכולה להגדיל את ההכנסה מכל פרויקט - ובמקביל להקשות על הלקוח לעבור למערכת מתחרה.

ועכשיו מגיע המבחן של המספרים

כל ההכרזות האלה מגיעות יומיים לפני אחד האירועים החשובים יותר עבור המשקיעים באנבידיה: ביום רביעי צפויה החברה לפרסם את תוצאותיה הרבעוניות.

הדוחות יחזירו את הדיון מהביצועים הטכנולוגיים למספרים. השאלה כבר אינה אם יש ביקוש ל-AI, אלא באיזה קצב הוא ממשיך לצמוח וכמה זמן ימשיכו ענקיות הטכנולוגיה וחברות הענן להזרים סכומים גדולים למרכזי נתונים. המשקיעים יעקבו גם אחרי קצב המעבר לדורות החומרה החדשים, שיעורי הרווחיות והתחזית של החברה להמשך.

הכרזות Hot Chips מראות לאן אנבידיה רוצה לקחת את העסק: ממכירת מעבד גרפי לאימון מודלים לאספקת חלק הולך וגדל מהמערכת שמפעילה את ה-AI - מהמעבד המרכזי והמעבד הגרפי, דרך התקשורת והתשתית ועד למערכות שמאפשרות לסוכן לבצע יותר פעולות בזמן קצר.

הדוחות מגיעים במסגרת השבוע של אנבידיה והופעת הבכורה בג'קסון הול, שבו המשקיעים יבחנו במקביל את קצב ההשקעות ב-AI ואת סביבת הריבית שמולה מתומחרות השקעות הענק בתחום.

ביום רביעי יתברר אם גם המספרים ממשיכים לתמוך בהתרחבות שאנבידיה מציגה.


הוספת תגובה

תגובות לכתבה:

הגב לכתבה

השדות המסומנים ב-* הם שדות חובה