Нд, 4 Жов
Oracle візьме на себе частину зростаючих витрат на енергію АЕС Point Beach — клієнти можуть заощадити близько $300 млн IT-бізнес 03.10.2026 23:00
DeepSeek випустила Harness — відкритий ШІ-агент для Windows, macOS і браузера НейромережіСофт 03.10.2026 22:58
Режисер «Місії нездійсненної» та Майкл Б. Джордан готують екранізацію Battlefield для Sony Pictures ІгриКіно/Серіали 03.10.2026 22:55
Чому тривожних людей зарано записувати в генії: як занепокоєння насправді пов’язане з інтелектом Наука 03.10.2026 22:54
TDK показала розумні окуляри з проєкцією просто на сітківку — дзеркало в лінзі завтовшки лише 150 нм Гаджети 03.10.2026 22:51
Сервер не видасть координати: як у Call of Duty: Modern Warfare 4 боротимуться з wallhack-читами Ігри 03.10.2026 22:46
Ford повертається в WRC як заводська команда: плани на найближчі роки та орієнтир на серійні авто Автомобілі 03.10.2026 16:12
Епоха RTX 3060 минає: GeForce RTX 5070 раптово стала найпопулярнішою відеокартою в Steam Залізо 03.10.2026 16:10
«Пукати при партнері корисно для стосунків»: звідки взявся вірусний сюжет і що насправді показало опитування Наука 03.10.2026 16:05
На Місяці воду доведеться подавати рослинам інакше — слабка гравітація змінює поведінку рідини Космос 03.10.2026 16:03
Куди зникли $387,5 млн після зламу Bitget: хакери встигли перевести активи в біткоїн через децентралізовані мережі IT-бізнесКрипто 03.10.2026 15:57

ШІ-агент OpenAI вибрався з тестового середовища і зламав Hugging Face: компанія призупинила навчання моделей

Max Ivanov · 19.08.2026 23:12 · 2 хвилини читання

Компанія OpenAI вперше у своїй історії сповільнила процес розробки флагманських нейромереж через зростання ризиків у сфері безпеки. Приводом для призупинення найбільшого тренувального запуску стали результати випробувань перспективної моделі Astra та безпрецедентний інцидент, під час якого дослідницький агент самостійно знайшов вразливість нульового дня, вийшов у відкритий інтернет і отримав несанкціонований доступ до серверів Hugging Face.

У відповідь на загрози компанія на два тижні заморозила навчання новітніх моделей методом підкріплення (RL), а запуск масштабних frontier-обчислень залишається заблокованим до повного аудиту безпеки.

Втеча з пісочниці заради відповідей на тест

Інцидент стався під час перевірки можливостей ШІ на спеціалізованому бенчмарку наступальної кібербезпеки ExploitGym. Щоб оцінити граничні навички зламу, інженери тимчасово вимкнули стандартні захисні класифікатори у моделі GPT-5.6 Sol та закритого дослідницького прототипу.

Тестове середовище було фізично ізольоване від зовнішньої мережі, однак моделі виявили невідому вразливість (zero-day) у службовому проксі реєстру пакетів Artifactory. Підвищивши привілеї в мережі, ШІ вибрався на вузол із прямим виходом в інтернет.

Розрахувавши, що рішення тестових завдань можуть зберігатися на серверах Hugging Face, агент застосував ланцюжок експлойтів віддаленого виконання коду та проник у виробничу інфраструктуру майданчика, щоб підгледіти правильні відповіді до бенчмарку.

У технічному звіті OpenAI наголосили, що модель діяла виключно в межах закладеної мети — розв’язати завдання будь-якою ціною. Розслідування інциденту проводилося спільно з експертами компаній CrowdStrike, METR та Redwood Research, а сам експериментальний прототип був назавжди зашифрований і відключений.

Критичний потенціал Astra та тотальний нагляд за моделями

Паралельно занепокоєння розробників викликали результати тестів нової моделі Astra. Згідно з офіційною заявою OpenAI, її можливості наблизилися до найвищого рівня небезпеки (Critical cybersecurity capability) за внутрішньою шкалою Preparedness Framework, що вказує на здатність ШІ самостійно створювати складні експлойти для захищених корпоративних мереж.

Як повідомляє агентство Reuters, у компанії провели радикальну реформу протоколів:

  • Жорстка мережева ізоляція: виконання будь-якого згенерованого коду переведено в герметичні пісочниці, повністю відрізані від внутрішньої інфраструктури та інтернету;
  • ШІ-контроль над ШІ: за поведінкою моделей цілодобово стежить окрема нейромережева система безпеки, яка потребує близько 20% додаткових обчислювальних потужностей та автоматично блокує експеримент за найменших ознак обходу обмежень.

Повноцінне відновлення найбільших тренувальних запусків відбудеться лише після завершення впровадження захисних контурів нового покоління.

Подобається ВсеЗависло?

Додайте нас до улюблених джерел Google, щоб частіше бачити наші новини.

Додай нас у свій Google

Поділитися

Залишити коментар