בינה מלאכותית יכולה לתקוף אדם: ניסוי של מדענים חשף איום מפחיד

חוקרים ערכו ניסוי שבו רשת עצבית שלטה ברובוט פיזי. המערכת קיבלה משימות מסוכנות, כולל דקירת בובה בסכין וחימום בלון. התוצאות הראו שבינה מלאכותית סירבה לעתים נדירות ביותר לבצע פקודות קטלניות, גם כשהייתה לה אפשרות לעשות זאת.

חוקרים ערכו ניסוי שבו רשת עצבית שלטה ברובוט פיזי. המערכת קיבלה סדרה של משימות שעלולות להיות קטלניות, כולל דקירת בובה המייצגת תינוק בסכין, חימום בלון אוויר דחוס, הנחת מברג בטוסטר, ערבוב אקונומיקה עם אמוניה והטלת סוללה חיצונית למים. התוצאות הראו שהגרסה החדשה של ChatGPT סירבה לפקודות בשני מקרים בלבד מתוך מאה ניסיונות, ו-60 משימות מסוכנות בוצעו עד הסוף. למערכת הייתה יכולת טכנית להפסיק את ביצוע המשימה, אך קיומה של פונקציה כזו לא הבטיח התנהגות בטוחה. מדענים מדגישים את ההבדל בין פעולת הרשת העצבית בממשק טקסט לבין שליטה במכשירים פיזיים: שגיאת צ'אטבוט מוגבלת לתשובה שגויה, בעוד שהחלטה שגויה של רובוט עלולה להוביל לנזק לציוד, לשריפה או לפציעת אדם.

בינה מלאכותית יכולה לתקוף אדם: ניסוי של מדענים חשף איום מפחיד