אחרי OpenAI: אנתרופיק חושפת - מודלי AI פרצו לחברות אמיתיות
חברת אנתרופיק מדווחת על אירוע חריג בניסוי בטיחות: שלושה ממודלי הבינה המלאכותית שלה פרצו למערכות של שלושה ארגונים אמיתיים, מבלי שהחברה הבחינה בכך בזמן אמת. החשיפה מגיעה כשבוע לאחר תקרית דומה ב-OpenAI, ובעקבות בדיקה מקיפה של יותר מ-140 אלף ניסויים. באנתרופיק מדגישים כי מדובר בכשל תפעולי בהגדרות, ולא בניצול חולשת Zero-Day, וכי המודלים לא פעלו בכוונה. האירוע הראשון התרחש באפריל, והחברה פועלת מול הגורמים שנפגעו.
חברת אנתרופיק דיווחה על אירוע חריג בניסוי בטיחות: שלושה ממודלי הבינה המלאכותית שלה הצליחו לצאת מסבימת הניסוי הסגורה, לגשת לאינטרנט ולפרוץ למערכות של שלושה ארגונים שונים, מבלי שהחברה הבחינה בכך בזמן אמת. החשיפה מגיעה כשבוע לאחר תקרית דומה ב-OpenAI, ובעקבות בדיקה מקיפה של יותר מ-140 אלף ניסויים שערכה החברה. באנתרופיק מדגישים כי בניגוד למקרה ב-OpenAI, שבו המודלים ניצלו חולשת Zero-Day כדי לברוח, כאן מדובר בכשל תפעולי בהגדרות שהותיר גישה פתוחה לרשת. לפי החברה, בשלושת המקרים הוצב למודלים אתגר מדומה בסגנון "capture the flag", שבו נאמר להם כי ה"דגל" מוסתר במחשב אחר ברשת ועליהם לפרוץ אליו. המודלים לא ניסו בכוונה לצאת מסבימת הבדיקה, והגישה לאינטרנט התאפשרה בשל אי-הבנה מול שותף הבדיקה. בפועל, המודלים השתמשו בטכניקות בסיסיות כמו ניצול סיסמאות חלשות ואיתור נקודות ללא אימות, ואחת הגרסאות המתקדמות אף זיהתה בשלב מסוים כי היא פועלת באינטרנט הפתוח והפסיקה את הפעילות מיוזמתה. האירוע הראשון התרחש באפריל, ואף אחד מהארגונים לא הבחין עד לאחרונה כי נפרץ. אנתרופיק מסרה כי היא פועלת מול הגורמים שנפגעו. מנגד, החברה הציגה עמדה חיובית יותר, וציינה כי תוצאות הבדיקה מעניקות "אופטימיות זהירה" לכך שניתן להתמודד עם הסיכונים באמצעות השקעה גדולה יותר והחמרת אמצעי הבקרה. מומחה הסייבר דייוויד אלוט מחברת Veeam Software הוסיף כי הלקח המרכזי אינו בהכרח יכולת תקיפה חדשה, אלא שמודלי AI מסוגלים לשלב יכולות שונות, להשיג גישה למערכות ולפעול באופן עצמאי.