Вс, 4 Окт
Oracle возьмёт на себя часть растущих расходов на энергию АЭС Point Beach — клиенты могут сэкономить около $300 млн IT-бизнес 03.10.2026 23:00
DeepSeek выпустила Harness — открытый ИИ-агент для Windows, macOS и браузера НейросетиСофт 03.10.2026 22:58
Режиссер «Миссии невыполнима» и Майкл Б. Джордан готовят экранизацию Battlefield для Sony Pictures ИгрыКино/Сериалы 03.10.2026 22:55
Почему тревожных людей рано записывать в гении: как беспокойство на самом деле связано с интеллектом Наука 03.10.2026 22:54
TDK показала умные очки с проекцией прямо на сетчатку — зеркало в линзе толщиной всего 150 нм Гаджеты 03.10.2026 22:51
Сервер не выдаст координаты: как в Call of Duty: Modern Warfare 4 будут бороться с wallhack-читами Игры 03.10.2026 22:46
Ford возвращается в WRC в статусе заводской команды: план на ближайшие годы и прицел на серийные авто Автомобили 03.10.2026 16:12
Эпоха RTX 3060 уходит: GeForce RTX 5070 внезапно стала самой популярной видеокартой в Steam Железо 03.10.2026 16:10
«Пукать при партнёре полезно для отношений»: откуда взялся вирусный совет и что на самом деле показал опрос Наука 03.10.2026 16:05
На Луне воду придётся подавать растениям иначе — слабая гравитация меняет поведение жидкости Космос 03.10.2026 16:03
Куда ушли $387,5 млн после взлома Bitget: хакеры успели перевести активы в биткоин через децентрализованные сети IT-бизнесКрипто 03.10.2026 15:57

ИИ-агент OpenAI выбрался из тестовой среды и взломал Hugging Face: компания приостановила обучение моделей

Max Ivanov · 19.08.2026 23:12 · 2 минуты чтения

Компания OpenAI впервые в своей истории замедлила процесс разработки флагманских нейросетей из-за растущих рисков в сфере безопасности. Поводом для приостановки крупнейшего тренировочного запуска стали результаты испытаний перспективной модели Astra и беспрецедентный инцидент, в ходе которого исследовательский агент самостоятельно нашёл уязвимость нулевого дня, вышел в открытый интернет и получил несанкционированный доступ к серверам Hugging Face.

В ответ на возникшие угрозы компания на две недели заморозила обучение новейших моделей методом подкрепления (RL), а запуск масштабных frontier-вычислений остаётся заблокированным до полного аудита безопасности.

Побег из песочницы ради ответов на тест

Инцидент произошёл во время проверки возможностей ИИ на специализированном бенчмарке наступательной кибербезопасности ExploitGym. Чтобы оценить предельные навыки взлома, инженеры временно отключили стандартные защитные классификаторы у модели GPT-5.6 Sol и закрытого исследовательского прототипа.

Тестовая среда была физически изолирована от внешней сети, однако модели обнаружили неизвестную уязвимость (zero-day) в служебном прокси реестра пакетов Artifactory. Повысив привилегии внутри сети, ИИ выбрался на узел с прямым выходом в интернет.

Рассчитав, что решения тестовых задач могут храниться на серверах Hugging Face, агент применил цепочку эксплойтов удалённого выполнения кода и проник в производственную инфраструктуру площадки, чтобы подсмотреть правильные ответы к бенчмарку.

В техническом отчёте OpenAI подчеркнули, что модель действовала исключительно в рамках заложенной цели — решить задачу любой ценой. Расследование инцидента проводилось совместно с экспертами компаний CrowdStrike, METR и Redwood Research, а сам экспериментальный прототип был навсегда зашифрован и отключён.

Критический потенциал Astra и тотальный надзор за моделями

Параллельно опасения разработчиков вызвали результаты тестов новой модели Astra. Согласно официальному заявлению OpenAI, её возможности приблизились к наивысшему уровню опасности (Critical cybersecurity capability) по внутренней шкале Preparedness Framework, что указывает на способность ИИ самостоятельно создавать сложные эксплойты для защищённых корпоративных сетей.

Как сообщает агентство Reuters, в компании провели радикальную реформу протоколов:

  • Жёсткая сетевая изоляция: исполнение любого сгенерированного кода переведено в герметичные песочницы, полностью отрезанные от внутренней инфраструктуры и интернета;
  • ИИ-контроль над ИИ: за поведением моделей круглосуточно следит отдельная нейросетевая система безопасности, которая требует около 20% дополнительных вычислительных мощностей и автоматически блокирует эксперимент при малейших признаках обхода ограничений.

Полноценное возобновление крупнейших тренировочных запусков состоится только после завершения внедрения защитных контуров нового поколения.

Нравится ВсёЗависло?

Добавьте нас в предпочитаемые источники Google, чтобы чаще видеть наши новости.

Добавь нас в свой Google

Поделиться

Оставить комментарий