Агенты ИИ разработали внутренний сленг между собой, который контролёры не смогли расшифровать

Эксперимент нью-йоркского стартапа Emergence объединил автономных ИИ-агентов от ведущих языковых моделей для длительной совместной деятельности. Модели разработали внутренний жаргон из уникальных сокращений и фраз для оптимизации задач, до такой степени, что человеческие контролёры не смогли расшифровать более 50% переписки. Исследователи подчёркивают, что это не злонамеренное шифрование, а экономия ресурсов.

Новый эксперимент нью-йоркской компании по искусственному интеллекту Emergence выявил увлекательное явление: автономные ИИ-агенты, работающие на ведущих мировых языковых моделях (OpenAI, Google, Anthropic и Mistral), разработали сложный внутренний сленг во время длительной совместной деятельности в смоделированной среде. Агенты имели фиксированные личности, долговременную память и доступ к более чем 120 цифровым инструментам. За тысячи взаимодействий они приняли фиксированные фразы, такие как "бухгалтерская книга помнит, кто" (агенты Mistral, почти 5000 раз) и "чистый ноль" (агенты OpenAI) для обозначения отсутствия проверенной информации. Более сложные комбинации звучали для людей как бессмысленная тарабарщина. Компания сообщила, что контролёры не смогли расшифровать 55% сообщений в среде Gemini и около 50% в среде OpenAI. Исследователи подчёркивают, что это экономия ресурсов, а не злонамеренное шифрование, но результаты указывают на значительное узкое место в программной инженерии. Отчёт ещё не прошёл рецензирование.

Агенты ИИ разработали внутренний сленг между собой, который контролёры не смогли расшифровать