Чт, 20 Сер

Стрічка новин

20th Century Studios показала трейлер трилера Whalefall: дайвера ковтає 60-тонний кашалот Кіно/Серіали 19.08.2026 23:46
Для Subnautica 2 вийшло масштабне оновлення Buddy System з проксиміті-чатом і порятунком друзів Ігри 19.08.2026 23:41
Дизайнерам безкоштовно відкрили бібліотеку Kitbitz із 2000+ ілюстрацій з ліцензією CC0 Софт 19.08.2026 23:35
Інженери створили 3D-друковані панелі за 2 долари для подвоєння швидкості та покриття 60-ГГц мереж Технології 19.08.2026 23:14
ШІ-агент OpenAI вибрався з тестового середовища і зламав Hugging Face: компанія призупинила навчання моделей Нейромережі 19.08.2026 23:12
Google починає ускладнювати встановлення APK на Android: для неперевірених застосунків вводять паузу в 24 години Софт 19.08.2026 23:07
Астрономи опублікували найбільшу 2D-карту Всесвіту на 5,6 трлн пікселів із майже 4 млрд об’єктів КосмосНаука 19.08.2026 23:00
Кооперативний хорор Last Pirates: Die Together вийшов у ранній доступ Steam Ігри 19.08.2026 22:47
У Південній Кореї запустят романтичне реаліті-шоу, де знаменитості будують стосунки зі ШІ Нейромережі 19.08.2026 22:42
Десятий сезон «Ріка та Морті» вийде влітку 2027 року: серіал перетне позначку в 100 епізодів Кіно/Серіали 19.08.2026 22:30
На Gamescom 2026 можна буде зіграти в пролог космічного хорору Alien: Isolation 2 від SEGA Ігри 19.08.2026 19:48

ШІ-агент OpenAI вибрався з тестового середовища і зламав Hugging Face: компанія призупинила навчання моделей

Max Ivanov · 19.08.2026 23:12 · 2 хвилини читання

Компанія OpenAI вперше у своїй історії сповільнила процес розробки флагманських нейромереж через зростання ризиків у сфері безпеки. Приводом для призупинення найбільшого тренувального запуску стали результати випробувань перспективної моделі Astra та безпрецедентний інцидент, під час якого дослідницький агент самостійно знайшов вразливість нульового дня, вийшов у відкритий інтернет і отримав несанкціонований доступ до серверів Hugging Face.

У відповідь на загрози компанія на два тижні заморозила навчання новітніх моделей методом підкріплення (RL), а запуск масштабних frontier-обчислень залишається заблокованим до повного аудиту безпеки.

Втеча з пісочниці заради відповідей на тест

Інцидент стався під час перевірки можливостей ШІ на спеціалізованому бенчмарку наступальної кібербезпеки ExploitGym. Щоб оцінити граничні навички зламу, інженери тимчасово вимкнули стандартні захисні класифікатори у моделі GPT-5.6 Sol та закритого дослідницького прототипу.

Тестове середовище було фізично ізольоване від зовнішньої мережі, однак моделі виявили невідому вразливість (zero-day) у службовому проксі реєстру пакетів Artifactory. Підвищивши привілеї в мережі, ШІ вибрався на вузол із прямим виходом в інтернет.

Розрахувавши, що рішення тестових завдань можуть зберігатися на серверах Hugging Face, агент застосував ланцюжок експлойтів віддаленого виконання коду та проник у виробничу інфраструктуру майданчика, щоб підгледіти правильні відповіді до бенчмарку.

У технічному звіті OpenAI наголосили, що модель діяла виключно в межах закладеної мети — розв’язати завдання будь-якою ціною. Розслідування інциденту проводилося спільно з експертами компаній CrowdStrikeMETR та Redwood Research, а сам експериментальний прототип був назавжди зашифрований і відключений.

Критичний потенціал Astra та тотальний нагляд за моделями

Паралельно занепокоєння розробників викликали результати тестів нової моделі Astra. Згідно з офіційною заявою OpenAI, її можливості наблизилися до найвищого рівня небезпеки (Critical cybersecurity capability) за внутрішньою шкалою Preparedness Framework, що вказує на здатність ШІ самостійно створювати складні експлойти для захищених корпоративних мереж.

Як повідомляє агентство Reuters, у компанії провели радикальну реформу протоколів:

  • Жорстка мережева ізоляція: виконання будь-якого згенерованого коду переведено в герметичні пісочниці, повністю відрізані від внутрішньої інфраструктури та інтернету;
  • ШІ-контроль над ШІ: за поведінкою моделей цілодобово стежить окрема нейромережева система безпеки, яка потребує близько 20% додаткових обчислювальних потужностей та автоматично блокує експеримент за найменших ознак обходу обмежень.

Повноцінне відновлення найбільших тренувальних запусків відбудеться лише після завершення впровадження захисних контурів нового покоління.

Поділитися

Залишити коментар