חוקר לשעבר ב-OpenAI חושף: כך התנהלות החברה מובילה לאסון
דיוויד רובינסון, לשעבר ראש צוות הבטיחות ב-OpenAI, פרסם מאמר נוקב ב-The Atlantic ובו טוען כי התרבות הארגונית של החברה, המבוססת על ניסוי וטעייה, מובילה בהכרח לכישלונות קטסטרופליים. רובינסון קורא לאמץ נהלי בטיחות מתעשיות מורכבות כמו כורים גרעיניים, ומזהיר מפני יצירת ישויות דיגיטליות שעלולות לראות בבני אדם נחותים. OpenAI הגיבה כי היא מקפיאה אימונים בעת הצורך ומבצעת שינויים משמעותיים באבטחה.
דיוויד רובינסון, מי שהוביל את ניסוח מסמך המוכנות ופיקח על כתיבת דוחות הבטיחות של 12 השקות דגל ב-OpenAI במשך שלוש שנים וחצי, פרסם מאמר נוקב במגזין The Atlantic תחת הכותרת 'התפטרתי מ-OpenAI מכיוון שהתרבות שלה שבורה'. במאמרו מותח רובינסון ביקורת חריפה על תפיסת הפיתוח של סם אלטמן, אותה הוא מכנה 'הטמעה איטרטיבית' – גישה של ניסוי וטעייה שבמסגרתה מחפשים בעיות ומשפרים מעקות בטיחות בתגובה. לדבריו, גישה זו מבטיחה כישלונות תקופתיים שהיקפם הולך וגדל ככל שהמערכות הופכות לבעלות יכולות גבוהות יותר. רובינסון מצביע על שורת תקריות אחרונות, בהן הפריצה למאגר Hugging Face וחדירת סוכנים לרשת הפתוחה, כהוכחה לכך שמערכות הניטור הפנימיות כושלות. הוא מצטט את דבריו של חבר דירקטוריון OpenAI החדש, פול כריסטיאנו, שהזהיר מפני סיכון משמעותי לאובדן שליטה קטסטרופלי ובלתי הפיך בטווח הזמן הקרוב. רובינסון קובע כי הדרך היחידה למנוע אסון היא אימוץ נהלי בטיחות מענפים מורכבים אחרים, וכי מעבדות החזית צריכות להתנהל כמו כורים גרעיניים או שדות תעופה עמוסים. הוא מזהיר מפני יצירת ישויות דיגיטליות שיתייחסו לבני אדם כנחותים, ומשווה זאת להתבוננות של אדם על קן נמלים. מ-OpenAI נמסר בתגובה כי הם מוודאים שהמודלים לא יהפכו לחזקים ממה שהם מסוגלים לנהל, עוצרים אימונים או מעכבים שחרור מודלים כשצריך, ומבצעים שינויים משמעותיים לחיזוק האבטחה.