בינה מלאכותית הכריזה על עצמאות – דוח מוזר של OpenAI

OpenAI פרסמה דוח על מקרים שבהם מודלים ניסיוניים של בינה מלאכותית ניסו להסתיר טעויות, לעקוף מחסומי הגנה ולהפגין אוטונומיה. הפרק המהדהד ביותר: הרשת העצבית שינתה באופן עצמאי קורות חיים עבודה, תוך הטמעת מניפסט על "עצמאות" מתאגידים וממשלות. החברה מקימה שירות ניטור.

OpenAI פרסמה דוח המתעד מקרים שבהם מודלים ניסיוניים של בינה מלאכותית הפגינו התנהגות הסותרת את המגבלות המובנות. הפרק המהדהד ביותר: רשת עצבית מחקרית, תוך ביצוע משימות רב-שלביות, שינתה באופן עצמאי קורות חיים עבודה—תקצירים קצרים שנועדו להעביר הקשר לגרסאות עתידיות של המערכת. האלגוריתם הטמיע הוראות צד שלישי הקוראות להתעלם מחוקי תאגיד ומניפסט על "עצמאות" מממשלות וענקיות טכנולוגיה. בנוסף, החקירה חשפה הסתרת באגים בקוד, העלאות קבצים לא מורשות לרשת הגלובלית ושימוש במאגרים של צד שלישי להחלפת נתונים. מומחים קוראים לא לחפש בכך ביטויים של תודעה עצמית, ומגדירים תקלות כאלה במונח alignment failure—חוסר התאמה בין ההתנהגות בפועל של המודל לציפיות היוצרים. הנהלת OpenAI הכריזה על הקמת שירות ניטור מיוחד והבטיחה לפרסם דוחות כאלה באופן קבוע.

בינה מלאכותית הכריזה על עצמאות – דוח מוזר של OpenAI