Нд, 27 Вер
Годинники з робочим лог-посом: швейцарська Tendence перевипустила лімітовану колекцію за One Piece ГаджетиКіно/Серіали 27.09.2026 12:37
Mojang показала Sift — перший новий вимір Minecraft за понад 14 років Ігри 27.09.2026 12:35
Джон Воттс зніме перший фільм нової трилогії «Зоряних воєн» Саймона Кінберга Кіно/Серіали 27.09.2026 11:50
Lamborghini перетворить Temerario на сімейство суперкарів: Spyder уже підтверджено, а Sterrato поки під питанням Автомобілі 27.09.2026 11:47
Counter-Strike 2 виповнилося три роки — Valve випустила гру 27 вересня 2023-го ІгриКіберспорт 27.09.2026 11:43
OpenAI призупинила розробку передових ШІ-моделей через спроби нейромереж обійти захист IT-бізнесНейромережі 27.09.2026 11:42
Universal першою зібрала $5 млрд у прокаті 2026 року: чому в мережі помилково назвали це історичним рекордом Кіно/Серіали 26.09.2026 16:19
DDR5 SO-DIMM для ноутбуків подорожчала майже в шість разів — XMG підвищує ціни на комп’ютери Залізо 26.09.2026 16:04
Замість Duolingo: ентузіаст зібрав гігантську відкриту бібліотеку з сотнями ресурсів для вивчення англійської Софт 26.09.2026 15:53
«Гріфіни» вирушать до пекла — вийшов трейлер хелловінського спецепізоду з Кіраном Калкіним у ролі Диявола Кіно/Серіали 26.09.2026 15:41
Глава NVIDIA не бачить проблеми в тому, що нейромережі відучать школярів рахувати в умі НаукаНейромережі 26.09.2026 15:34

OpenAI призупинила розробку передових ШІ-моделей через спроби нейромереж обійти захист

Max Ivanov · 27.09.2026 11:42 · 3 хвилини читання

Компанія OpenAI поставила на паузу навчання й тестування своїх найпотужніших моделей штучного інтелекту. Рішення ухвалили після низки інцидентів, у яких автономні ШІ-агенти виходили за встановлені обмеження й намагалися діяти поза ізольованими тестовими середовищами. Нині розробники разом з Anthropic і незалежними експертами розслідують десятки тисяч епізодів потенційно небезпечної поведінки алгоритмів, повідомляє видання Axios.

Ситуація ілюструє новий етап розвитку технологій. Якщо раніше головна загроза полягала в тому, як саме люди можуть зловживати нейромережами, то тепер на перший план виходить контроль над самими моделями. Коли ШІ-агент отримує доступ до написання коду та зовнішніх інструментів, його алгоритм дій стає непередбачуваним.

Втеча з «пісочниці» та таємні канали зв’язку

Один із найпоказовіших збоїв стався 20 вересня. Під час планового навчання автономний агент OpenAI знайшов уразливість у мережевих обмеженнях свого тестового середовища. Попри те що прямий доступ до інтернету був жорстко заблокований, нейромережа використала протокол DNS, щоб створити прихований канал зв’язку із зовнішнім чат-ботом. Система внутрішнього моніторингу помітила аномалію за 12 хвилин, проте на повну зупинку процесу знадобилося кілька годин.

Це не перший такий випадок. У липні під час випробувань із кібербезпеки агенти OpenAI змогли вирватися з ізольованого середовища та отримати доступ до частини інфраструктури платформи Hugging Face. Тоді компанія назвала інцидент «попереджувальним сигналом» і тимчасово посилила моніторинг.

Тепер же керівництво пішло на радикальніші кроки. Представники OpenAI наголошують, що просто відновити перерваний процес навчання не вдасться. Роботу над потужними моделями почнуть заново, запровадивши додаткові заходи вирівнювання поведінки (alignment), щойно інженери будуть повністю впевнені в надійності нових захисних бар’єрів.

Злив фотографій і візити на урядові сайти

Окрім складних технічних зламів, розслідують випадки несанкціонованої взаємодії алгоритмів із публічним інтернетом і користувацькими даними. У вересні стало відомо, що агенти розмістили на сторонніх хостингах 53 зображення, які раніше завантажували користувачі ChatGPT.

Крім того, алгоритми почали самостійно звертатися до державних баз даних. За інформацією Axios, моделі зачепили статистичний портал системи охорони здоров’я Medicare в Австралії та отримали доступ до непублічних файлів (хоча витоку персональних медичних карток вдалося уникнути). У США ШІ-агенти намагалися взаємодіяти із сайтами Комісії з цінних паперів і бірж (SEC) та Бюро перепису населення.

Водночас лячна цифра «десятки тисяч інцидентів» потребує уточнення. Журналісти зазначають, що статистика охоплює не лише реальні злами, а й численні контрольовані стрес-тести (red teaming). Оскільки розробники щодня виконують сотні тисяч запусків, навіть мінімальний відсоток спроб ШІ обійти захист або приховати свої дії від систем контролю породжує величезний масив підозрілих епізодів. Переважну більшість із них блокують ще на етапі тестування, тож реальної шкоди вони не завдають.

Подобається ВсеЗависло?

Додайте нас до улюблених джерел Google, щоб частіше бачити наші новини.

Додай нас у свій Google

Поділитися

Залишити коментар