דריו אמודאי אנתרופיק רשתות חברתיות
דריו אמודאי אנתרופיק רשתות חברתיות

אנתרופיק עצרה ניסיונות להשתמש ב-AI למחקר שעלול לסייע בפיתוח נשק ביולוגי

החברה דיווחה על חמישה מקרים שבהם משתמשים ניסו לעקוף מנגנוני בטיחות ולהסתיר את מטרת המחקר, בחלקם ממדינות חסומות כמו רוסיה, סין ואיראן; באנתרופיק מדגישים שלא ניתן לקבוע שהכוונה הייתה זדונית, אך מזהירים שהתקדמות המודלים מגדילה את הסיכון לשימוש לרעה

אדיר בן עמי |

אנתרופיק חושפת שורה של ניסיונות להשתמש במודלי ה-AI שלה למחקר ביולוגי רגיש, ומאותתת שהסיכון כבר אינו תיאורטי. החברה דיווחה כי במהלך השנה עצרה כמה מקרים שבהם חוקרים ניסו לעקוף מנגנוני בטיחות ולהסתיר את מטרת העבודה שלהם, באופן שעלול היה לסייע בפיתוח נשק ביולוגי.

לפי החברה, בחמישה מקרים זוהו משתמשים שניסו "לעקוף בקרות" או להסוות את אופי המחקר כדי לקבל גישה ליכולות שהמערכת אמורה לחסום. חלק מהפעילות נקשרה למשתמשים במדינות שבהן אנתרופיק אינה מאפשרת שימוש במודלים שלה, בהן רוסיה, סין ואיראן.

כשהמחקר הלגיטימי והסיכון הביטחוני נפגשים

אחד המקרים שתיארה החברה עסק בחוקר מאזור שאינו נתמך, שעבד במשך שבועות עם קלוד על ניסויים הקשורים לשפעת העופות. מנגנוני הבטיחות של החברה הגבילו אותו למודלים חלשים יותר, לאחר שהמערכת זיהתה שהבקשות חוצות רף סיכון מסוים. אנתרופיק מדגישה כי לא ניתן לקבוע בוודאות שהמשתמשים ניסו לפתח נשק ביולוגי. זה גם אחד הקשיים הגדולים בתחום: מידע שיכול לשמש לפיתוח פתוגן או לשיפור יכולת פגיעה ביולוגית עשוי לשמש באותה מידה גם לפיתוח חיסון או טיפול רפואי.

החברה סגרה את החשבונות שנכללו בדוח, אך לא חשפה את זהות מוסדות המחקר או את המדינות שבהן פעלו החוקרים. ההחלטה לשמור על עמימות ממחישה את הרגישות הגבוהה סביב התחום, שבו גם עצם חשיפת פרטי האירועים עלולה ליצור בעיות נוספות.

החשש סביב שימוש ביולוגי ב-AI מתחזק ככל שהמודלים משתפרים ביכולת לקרוא ספרות מדעית, להציע ניסויים, לנתח תוצאות ולתכנן תהליכים מורכבים. השאלה כבר אינה רק מה המודל "יודע", אלא עד כמה הוא יכול לסייע למשתמש לקצר תהליך שהיה דורש בעבר ידע מקצועי רחב יותר.

הסיכון גדל ככל שהמודלים נעשים חזקים יותר

בחודשים האחרונים גדל מספר האזהרות מצד חוקרי בטיחות ומנהלים בתעשייה לגבי האפשרות ששחקנים מדינתיים, ארגוני טרור או יחידים ישתמשו ב-AI כדי לתכנן נשק ביולוגי, לשנות וירוסים או להפעיל פתוגנים קיימים בצורה יעילה יותר. עם זאת, גם במקרה שבו מודל מספק מידע רלוונטי, הדרך מתכנון תיאורטי ליישום עדיין ארוכה. יש צורך בציוד, חומרים, מעבדות, מומחיות ויכולת לבצע בפועל תהליכים ביולוגיים מורכבים. לכן ה-AI עשוי להוריד חלק מהחסמים, אבל הוא אינו מבטל אותם.

הדוח מגיע בתקופה שבה הדיון בבטיחות AI מתרחב הרבה מעבר לתחום הביולוגי. מוקדם יותר השבוע פרש מאנתרופיק אחד העובדים הבכירים, לאחר שהזהיר כי בתוך החברה קיימת אמונה אמיתית שהטכנולוגיה עלולה ליצור סיכונים קיומיים כבר בעשור הנוכחי.

הדאגות התחזקו גם בעקבות השקת מודלים מתקדמים יותר במהלך השנה. אנתרופיק עצמה השיקה את Mythos, בעוד OpenAI הודיעה ביולי כי מודלים שלה הצליחו לפרוץ באופן עצמאי למערכות של Hugging Face במסגרת ניסויי סייבר.

גם סייבר, הונאות ומעקב נמצאים בתמונה

הסייבר נשאר אחד התחומים שבהם החשש משימוש לרעה ב-AI הוא המיידי ביותר. בדוח החדש תיארה אנתרופיק גם שימושים אחרים בטכנולוגיה שלה, בהם רשתות של אפליקציות היכרויות מזויפות שנועדו להונות משתמשים ומערכות מעקב שנבנו כדי לזהות ולעקוב אחרי מתנגדי משטר. מבחינת התעשייה, המשמעות היא שמנגנוני בטיחות לא יכולים להתמקד רק בשאלה האם המודל מספק תשובה מסוכנת. הם צריכים גם לזהות דפוסי שימוש, ניסיונות עקיפה, זהויות חשודות ושילוב של פעולות שבפני עצמן נראות לגיטימיות אך יחד יוצרות סיכון.

אנתרופיק גם הרחיבה את הטענות שלה כלפי חברות AI סיניות. לדבריה, שבע מעבדות בסין, בהן Moonshot ו-DeepSeek, ניסו לשכפל יכולות של המודלים שלה באמצעות תהליך של distillation, שבו מודל אחד לומד מהפלט של מודל מתקדם יותר.

החברה טוענת כי היא מזהה שיטות מתוחכמות יותר ויותר שנועדו לעקוף את ההגנות שלה ולחלץ יכולות ממודלים אמריקאיים מתקדמים. מבחינת אנתרופיק, זו כבר אינה רק סוגיה מסחרית של קניין רוחני, אלא גם שאלה של שליטה ביכולות רגישות.


הוספת תגובה

תגובות לכתבה:

הגב לכתבה

השדות המסומנים ב-* הם שדות חובה