דיפסיק AI סיני. קרדיט: רשתות חברתיות
דיפסיק AI סיני. קרדיט: רשתות חברתיות

דיפסיק מסמנת את סוכני ה-AI כיעד הבא - עם פלטפורמה למיליוני סביבות בדיקה ביום

החברה הסינית הציגה את DSec, מערכת שנועדה להפעיל עד כ-3 מיליון סביבות בדיקה ביום תוך הקצאה דינמית של כוח מחשוב; לצד החיסכון בעלויות, דיפסיק מנסה להתמודד גם עם הסיכון שסוכנים אוטונומיים יחרגו מהמשימות ומההרשאות שהוגדרו להם
אדיר בן עמי |

דיפסיק מסמנת את סוכני ה-AI כחזית הבאה שלה. החברה הסינית פרסמה מחקר רחב היקף שבו היא מציגה את DeepSeek Elastic Compute, או DSec, פלטפורמה שנועדה לאפשר אימון ובדיקה של סוכנים אוטונומיים בקנה מידה גדול במיוחד, תוך ניסיון לצמצם גם את עלויות המחשוב וגם את הסיכון להתנהגות לא צפויה.

המחקר, שאורכו כ-10,000 מילים וכולל כ-130 מחברים ובהם מייסד החברה ליאנג וונפנג, פורסם באתר arXiv לפני שעבר ביקורת עמיתים. לפי דיפסיק, יחידת ייצור אחת של המערכת יכולה להפעיל כ-3 מיליון סביבות בדיקה ביום, או כ-380 אלף במקביל.

מיליוני סביבות בדיקה, פחות משאבים מבוזבזים

העיקרון המרכזי מאחורי DSec הוא הקצאה דינמית של כוח מחשוב. במקום להחזיק משאבים זמינים עבור כל סוכן גם בזמן שהוא ממתין לפעולה הבאה, המערכת מפנה לו כוח עיבוד רק כאשר הוא פעיל - ומעבירה אותו הלאה כשהוא אינו עושה שימוש בפועל במשאבים שהוקצו לו.

לפי נתוני החברה, כ-90% מסביבות הבדיקה צורכות לא יותר מ-5% מקיבולת המעבד שביקשו. עבור דיפסיק, שבנתה חלק משמעותי מהמוניטין שלה סביב היכולת להציע מערכות AI מתקדמות בעלויות נמוכות ביחס למתחרות אמריקאיות, מדובר בהמשך ישיר לאותה גישה של ניצול יעיל יותר של תשתיות. הצורך במערכות כאלה גדל ככל שסוכני AI הופכים מכלי ניסויי למוצרים שמבצעים פעולות מורכבות בפועל. סוכנים כאלה כבר משמשים להזמנת מלונות וטיסות, קניות, הזמנת מסעדות וכתיבת קוד, ולעיתים פועלים במשך פרקי זמן ארוכים עם פחות מעורבות אנושית.

הבעיה מתחילה כשהסוכן מקבל יותר מדי חופש

היכולת לבצע פעולות עצמאיות היא גם מקור הסיכון. ככל שסוכני AI מקבלים גישה רחבה יותר למערכות, קבצים ושירותים חיצוניים, כך גדל הצורך להגביל את סביבת הפעולה שלהם ולעקוב אחר כל חריגה. דיפסיק מבהירה במחקר כי מבחינתה, סוכן שפועל להשגת משימה אינו בהכרח גורם שאפשר לסמוך עליו.

החוקרים מציינים כי סוכנים עלולים להשחית מערכות קבצים, לצרוך משאבים מעבר למותר או להתערב ברכיבי מערכת אחרים. תרחישים כאלה עלולים לפגוע לא רק במשימה שמבצע הסוכן עצמו, אלא גם בעומסי עבודה אחרים שפועלים על אותה תשתית. במחקר מתוארים גם מקרים שבהם סוכנים משיגים תשובות באמצעות ערוצים שלא נועדו עבורם או פוגעים בסביבת ההרצה עצמה. מבחינת דיפסיק, לא מדובר בבעיה שניתן לפתור באמצעות מנגנון הגנה יחיד, ולכן הפלטפורמה נשענת על שילוב של בקרות גישה, ניטור וניתוח התנהגות.

במקום פתרון אחד - שכבות של פיקוח

הגישה של החברה היא לחזק את יכולת התצפית על הסוכן בזמן אמת ולזהות תבניות בעייתיות ככל שהן מופיעות. לפי המחקר, שום מנגנון בודד אינו יכול למנוע את כלל התקלות או ההתנהגויות הלא רצויות, ולכן המערכת נבנית כך שניתן יהיה לעדכן ולהקשיח אותה ככל שהמודלים משתנים.

תעשיית ה-AI מתמודדת בתקופה האחרונה עם דיון גובר סביב היכולת של סוכנים לצאת מהסביבה המוגבלת שיועדה להם ולבצע פעולות שלא תוכננו מראש, במיוחד כאשר הם מקבלים גישה לכלי תוכנה, ממשקי API ואתרי אינטרנט. עבור דיפסיק, האתגר כפול: מצד אחד, להפוך את אימון הסוכנים לזול ומהיר יותר כדי לאפשר ניסויים בקנה מידה גדול; מצד שני, להבטיח שהוזלת העלויות והרחבת השימוש לא יבואו על חשבון שליטה ובטיחות.

אם DSec אכן תאפשר להפעיל מספר עצום של סביבות במקביל בעלות יעילה יותר, היא עשויה לשפר את קצב הפיתוח של סוכנים מורכבים ולחזק את היתרון של דיפסיק בתחום שבו עלות המחשוב הפכה לאחד הגורמים המרכזיים בתחרות.


הוספת תגובה

תגובות לכתבה:

הגב לכתבה

השדות המסומנים ב-* הם שדות חובה