סוכני ה-AI פיתחו סלנג פנימי ביניהם שהמפקחים לא הצליחו לפענח
ניסוי של סטארט-אפ ניו-יורקי Emergence הפגיש סוכני AI אוטונומיים ממודלי שפה מובילים לפעילות משותפת ממושכת. המודלים פיתחו עגה פנימית של קיצורים וביטויים ייחודיים לייעול משימות, עד שמפקחים אנושיים לא הצליחו לפענח מעל 50% מהתכתובות. החוקרים מדגישים כי לא מדובר בהצפנה זדונית אלא בחיסכון במשאבים.
ניסוי חדש של חברת הבינה המלאכותית Emergence מניו יורק חשף תופעה מרתקת: סוכני AI אוטונומיים, שהופעלו על ידי מודלי השפה המובילים בעולם (OpenAI, Google, Anthropic ו-Mistral), פיתחו סלנג פנימי מורכב במהלך פעילות משותפת ממושכת בסביבה מדומה. לסוכנים היו זהויות קבועות, זיכרון לטווח ארוך וגישה ליותר מ-120 כלים דיגיטליים. לאורך אלפי אינטראקציות, הם אימצו ביטויים קבועים כמו "ספר החשבונות זוכר מי" (סוכני Mistral, כמעט 5,000 פעמים) ו"אפס נקי" (סוכני OpenAI) לציון היעדר מידע מאומת. שילובים מורכבים יותר נשמעו לבני אדם כגיבוב מילים חסר היגיון. החברה דיווחה כי מפקחים לא הצליחו לפענח 55% מההודעות בסביבת Gemini וכ-50% בסביבת OpenAI. החוקרים מדגישים כי מדובר בחיסכון במשאבים ולא בהצפנה זדונית, אך הממצאים מצביעים על צוואר בקבוק משמעותי בהנדסת תוכנה. הדוח טרם עבר ביקורת עמיתים.