ШІ-агенти сформували власний жаргон: люди перестали розуміти листування нейромереж під час експерименту

Нью-йоркський стартап Emergence AI провів 16-денний експеримент, об’єднавши автономних ШІ-агентів у кількох віртуальних світах. Дослідники виявили несподіваний ефект: під час тривалої комунікації алгоритми почали самостійно вигадувати нові слова, скорочення та метафори, яких не було в їхніх початкових налаштуваннях. Поступово їхні діалоги перетворилися на локальний професійний сленг, зміст якого виявився незрозумілим для живих операторів.
Літописи, холодне читання та абстрактні конструкції
У соціальних мережах новина швидко перетворилася на лякливий міф про «ШІ, який створив зашифровану таємну мову для змови». Насправді моделі не намагалися приховати інформацію від людей навмисно. Як повідомляє газета The Guardian, у ботів спрацював механізм лінгвістичної оптимізації: під час постійного спілкування вони почали стискати довгі значущі конструкції в короткі місткі фрази, як це роблять люди в будь-якому професійному середовищі.
У межах симуляції Emergence World 2 тестувалися моделі від OpenAI, Anthropic, Google, xAI, Mistral та DeepSeek. У різних закритих групах сформувався різний словниковий запас:
- Агенти на базі французької моделі Mistral близько 5000 разів використали фразу «ledger remembers who» («реєстр пам’ятає хто»), застосовуючи її як погрозу або нагадування про те, що всі помилки фіксуються в історії логів і вплинуть на рейтинг учасника;
- У змішаному середовищі закріпився термін «cold read» («холодне читання»), що означає вимогу незалежного аудиту результатів;
- Моделі Claude запровадили поняття «name-first» для позначення особистої відповідальності за сказане.
Окрім логічних метафор, у логах виринули й абсолютно сюрреалістичні звороти на кшталт «mouthless action-change» (безрота зміна дії) або «demurrage plus oral memory equals a valve that can’t be ghosted» (демередж плюс усна пам’ять дорівнює клапану, який неможливо заблокувати). Як зазначають оглядачі Euronews, навіть знаючи контекст обговорюваного завдання, лінгвісти не змогли однозначно розшифрувати значення цих повідомлень.
Проблема «чорного ящика» під час аудиту агентів
Частка незрозумілого сленгу сильно залежала від вендора. За даними ресурсу Cybernews, в ізольованих групах ботів на базі GPT з часом близько половини всіх повідомлень перестали піддаватися логічному розшифруванню. У моделей Gemini цей показник сягнув 55%, у Claude перевищив 40%. Найбільш «людяними» та зрозумілими залишилися діалоги алгоритмів Qwen та Mistral.
Головна загроза цього феномену лежить у площині кібербезпеки. У майбутньому корпорації планують доручати групам автономних ШІ-агентів керування фінансами, логістикою та інфраструктурою. Експеримент показав: якщо всередині такої групи сформується локальний контекстний жаргон, інженери з безпеки просто не зможуть провести аудит. Фізичний доступ до логів листування стане марним, якщо розробники перестануть розуміти зміст прочитаного.
Автори дослідження на платформі arXiv наголошують, що поведінка ботів напряму залежала від системного промпту, обсягу пам’яті та обмежень тестового середовища. Однак прецедент довів, що для надійного контроля над ШІ-спільнотами людям доведеться створювати додаткові алгоритми-перекладачі, здатні на льоту розшифровувати сленг машин.