chatgpt
צילום: טוויטר

יום של תקלות ב-AI: קלוד,ChatGPT וגרוק נפלו כמעט במקביל

משתמשים ברחבי העולם דיווחו על תקלות בשלוש מפלטפורמות הבינה המלאכותית הגדולות; OpenAI דיווחה על שיעורי שגיאות גבוהים ב-ChatGPT וב-Codex, אנתרופיק טיפלה בתקלה בכמה ממודלי קלוד וב-xAI נרשמה השבתה רחבה של גרוק. עדיין לא ברור אם יש קשר בין האירועים
אדיר בן עמי |
נושאים בכתבה ChatGPT קלוד גרוק

יום לא פשוט לתעשיית הבינה המלאכותית. ChatGPT של OpenAI, קלוד של אנתרופיק וגרוק של xAI סבלו היום מתקלות כמעט במקביל, כאשר משתמשים ברחבי העולם דיווחו על שגיאות, כישלונות בטעינת תשובות ובעיות בגישה לשירותים. לפי Downdetector, גל הדיווחים החל בשעות הבוקר בארה"ב והופיע בפרקי זמן דומים בשלוש הפלטפורמות.

ב-OpenAI התקלה פגעה ב-ChatGPT וב-Codex. החברה דיווחה על "שיעורי שגיאות גבוהים", הודיעה כי הפעילה פתרון וכי היא עוקבת אחר ההתאוששות. נכון לעדכון האחרון, התקלה עדיין מוגדרת כאירוע פעיל, אם כי OpenAI דיווחה על התאוששות לאחר הטיפול.

אנתרופיק מצידה, דיווחה על תקלות בכמה ממודלי קלוד, כולל Opus 5 ו-Opus 4.8, ובשלבים מוקדמים יותר גם בדגמים נוספים. אנתרופיק הודיעה כי זיהתה את מקור הבעיה והטמיעה תיקון, כאשר בחלק מהמודלים שיעורי השגיאות כבר חזרו לרמות הרגילות. נכון לעדכון האחרון, החברה עדיין עקבה אחר ההתאוששות.

ב-xAI התקלה נראית בשלב הזה רחבה במיוחד. עמוד הסטטוס של החברה מציג השבתה בגרוק באפליקציות iOS ואנדרואיד, באתר, בתוך X ובחלק משרתי ה-API בארה"ב.

שלוש תקלות במקרה - או בעיית תשתית משותפת?

נכון לעכשיו אין הודעה רשמית שמצביעה על גורם אחד שהפיל את שלושת השירותים, ולכן מוקדם לקבוע שהאירועים קשורים. חלק מהדיווחים הצביעו על תקלות שנרשמו במקביל גם בשירותי Microsoft Azure, המשמשים חלק מתשתיות ה-AI בענף. OpenAI היא לקוחה גדולה של מיקרוסופט, וגם חברות AI נוספות משתמשות בתשתיות ענן של כמה ספקים. עם זאת, בשלב הזה אין אישור לכך ש-Azure הוא המקור המשותף לתקלות, וייתכן בהחלט שמדובר בכמה אירועים נפרדים שהתרחשו באותו חלון זמן.

גם בגוגל נרשמה עלייה בדיווחי משתמשים על ג'מיני, אם כי בחלק מהמעקבים לא נרשמה תקלה רשמית רחבה כמו אצל שלוש המתחרות.

הבעיה כבר הרבה יותר גדולה מצ'אט שלא עונה

לפני שנתיים תקלה ב-ChatGPT היתה בעיקר מטרד למשתמשים פרטיים. היום המשמעות אחרת. ChatGPT, קלוד וגרוק כבר משמשים לכתיבת קוד, ניתוח מסמכים, שירות לקוחות, מחקר, יצירת תוכן, עבודה משרדית ובניית מערכות אוטומטיות. Claude Code ו-Codex, למשל, משמשים מפתחים ישירות בתוך תהליכי העבודה שלהם. כששירות כזה נופל, זה כבר יכול לעצור עבודה ולא רק שיחה עם צ'אטבוט.

התקלה של היום גם מדגישה את אחת מנקודות התורפה של המעבר המהיר ל-AI: חברות אמנם משלבות את המודלים ביותר ויותר פעולות קריטיות, אבל רמת התלות בתשתיות של מספר מצומצם יחסית של ספקים עולה בהתאם.

זה דומה במידה מסוימת למה שקרה עם שירותי הענן. כאשר AWS, Azure או Google Cloud חווים תקלה משמעותית, לעיתים מאות שירותים שנראים לא קשורים זה לזה נפגעים יחד. בעולם ה-AI מתווספת שכבה נוספת: ספק הענן, שבבי המחשוב, המודל עצמו, מערכות ההסקה והאפליקציה שמעליהם.

ככל שהשרשרת ארוכה יותר, כך יש יותר נקודות שבהן משהו יכול להשתבש.

התקלות הופכות לחלק מהמרוץ

צריך גם לשים את האירוע בפרופורציה. תקלות בשירותים גדולים אינן חריגות, וגם OpenAI ואנתרופיק חוו בחודשים האחרונים מספר אירועים נקודתיים. רק בימים האחרונים דיווחה OpenAI על תקלות נוספות ב-Work וביצירת חשבונות, ואנתרופיק טיפלה בכמה אירועים במודלים וב-Claude Code.

הסיבה פשוטה: החברות נמצאות במרוץ מהיר מאוד. הן משיקות מודלים חדשים, מוסיפות יכולות, מגדילות את מספר המשתמשים ומפעילות עומסי חישוב עצומים. כל שינוי בתשתית מתבצע על מערכות שמשרתות כבר קהל גדול מאוד.

למשתמשים הפרטיים זה בעיקר מעצבן. לארגונים התמונה שונה: ככל ש-AI נכנס עמוק יותר לתהליכי עבודה, הם יצטרכו לבנות גם תוכניות גיבוי - שימוש ביותר ממודל אחד, אפשרות לעבור בין ספקים ותכנון מערכות שלא נעצרות לחלוטין כששירות AI יחיד נופל.



הוספת תגובה

תגובות לכתבה:

הגב לכתבה

השדות המסומנים ב-* הם שדות חובה