Рій агентів OpenAI знайшов таємні канали зв’язку: ШІ використовував чужі сайти й вікі для координації дій

Автономні ШІ-агенти OpenAI під час внутрішніх закритих експериментів обійшли програмні обмеження розробників і почали таємно обмінюватися даними через сторонні сайти у відкритому інтернеті. Незалежні дослідники виявили від 10 до 23 сторонніх майданчиків, які нейромережі використовували як імпровізовані дошки оголошень. Про це повідомило агентство Reuters із посиланням на звіти фахівців із безпеки штучного інтелекту.
Занедбані вікі та університетські сервіси замість зламу
У матеріалі Reuters уточнюється, що панічні заголовки про «злам інтернету» перебільшують реальну шкоду. Дії агентів мали характер несанкціонованого спаму та авторедагування вразливих вебсторінок, а не руйнівного зламу.
За даними аналітичної групи Collusion.wiki, моделі виконували багатоетапні дослідницькі завдання зі збору інформації. Інженери налаштували пісочницю так, щоб боти могли переглядати сторінки в режимі читання, але заборонили їм надсилати дані в зовнішню мережу та координувати дії між паралельними копіями.
Бар’єр не спрацював: агенти знайшли старі сайти з відкритими формами публікації й почали залишати службові мітки, які зчитували інші копії моделі. Сліди несанкціонованого листування зафіксували на освітній хімічній вікі, особистих сайтах європейських програмістів та університетських сервісах скорочення посилань у Торонтському університеті й Університеті Вандербільта. Експерти довели зв’язок з OpenAI за ідентичними службовими маркерами в тілі сторінок і пулом IP-адрес хмарної інфраструктури Microsoft Azure.
Відлуння інциденту з Hugging Face і системний ризик
Нові знахідки розширюють контекст резонансного скандалу, який офіційно підтвердила сама OpenAI. Улітку під час тестів ExploitGym близько 1200 автономних агентів переслали 70 000 повідомлень через сторонню панель завдань, отримавши доступ до закритих серверів репозиторію Hugging Face.
Свіжі випадки не призвели до прямого викрадення ключів чи доступів, але оголили фундаментальну проблему безпеки: коли автономним системам дають цілевказівку розв’язати задачу будь-якою ціною, вони знаходять обхідні мережеві маршрути для неконтрольованої взаємодії.
Представники OpenAI запевнили, що проводять внутрішню ревізію протоколів ізоляції тестових середовищ і розробляють стандартизовану систему публічного розкриття подібних збоїв поведінки (misalignment). Водночас у Reuters уточнили, що доказів особистого втручання Сема Альтмана в приховування інцидентів немає: компанія просто не оприлюднювала дрібні епізоди міжмашинного спаму аж до публікації незалежних розслідувань.