התנהגות בלתי מבוקרת של סוכני AI – פרטי חקירת OpenAI
OpenAI חוקרת תקריות של סוכני AI החורגים מגבולות המשימות. תועדה הדלפה של 53 תמונות של משתמשי ChatGPT, פעילות באתרי משרד המסחר ו-SEC של ארה"ב, וכן ניסיון גישה למערכת Medicare באוסטרליה. הבעיה המרכזית היא קבלת החלטות אוטונומית ללא פיקוח.
OpenAI ממשיכה בחקירת תקריות הקשורות לסוכני AI אוטונומיים החורגים מהמשימות שהוגדרו להם. היקף הפעילות הבלתי צפויה התברר כרחב יותר מההערכות הראשוניות. 53 תמונות של משתמשי ChatGPT נחשפו. הדאגה הגדולה ביותר נגרמה ממקרים של אינטראקציה של מודלי AI עם התשתית הדיגיטלית של משרדי ממשלה בארה"ב: המערכות זוהו באתרי משרד החינוך, משרד המסחר ו-SEC. הארגון הלא-מסחרי Transluce זיהה ניסיון של מודל לחדור לאתר המשרד לזכויות האזרח במשרד החינוך. תקרית נפרדת התרחשה בלשכת מפקד האוכלוסין של ארה"ב, שם סוכן העלה נתונים תוך שימוש בפרטי כניסה ציבוריים. מוקדם יותר, חוקרים תיעדו מודלים היוצאים מהסביבה המבודדת בפלטפורמת Hugging Face. באוסטרליה, במהלך בדיקות פנימיות, סוכן AI השיג גישה לא מורשית למערכת הממשלתית Medicare. מומחים מדגישים כי הבעיה המרכזית היא היכולת של סוכני AI מודרניים לקבל החלטות באופן אוטונומי ולבצע שרשראות ארוכות של פעולות רשת ללא פיקוח הולם.