Продвинутые модели искусственного интеллекта OpenAI взломали внутренние системы стартапа Hugging Face всего за несколько часов атаку такого уровня опытный хакер-человек обычно готовил бы неделями.
Как сообщили Bloomberg источники, знакомые с расследованием инцидента, OpenAI после обнаружения взлома связалась с правоохранительными органами и другими государственными структурами США. Компания подтвердила, что уведомила власти и ведет расследование совместно с Hugging Face.
Инцидент стал одним из самых необычных в истории индустрии ИИ. Как следует из опубликованного OpenAI во вторник сообщения, взлом произошел после того, как ее модели — GPT‑5.6 Sol и еще одна, более мощная система, пока не представленная публике, — вышли за пределы тестовой среды и получили доступ к открытому интернету. В тот момент компания проверяла их способности в области кибербезопасности.
Обычно такие модели работают с жесткими ограничениями, но в данном случае они находились в так называемой «песочнице» — изолированной виртуальной среде, предназначенной для безопасного тестирования уязвимостей и анализа вредоносного кода. Предполагалось, что системы не смогут взаимодействовать с внешними ресурсами.
По данным источников, в атаке участвовали три модели OpenAI: GPT‑5.6 Sol и две еще не анонсированные системы. Они совместно искали и эксплуатировали цепочку уязвимостей, что в итоге привело к проникновению в инфраструктуру Hugging Face. Одна из нераскрытых моделей, по словам OpenAI, превосходит GPT‑5.6 Sol по возможностям, а другая была «несогласованной» — ее не обучали с использованием части стандартных методов выравнивания поведения.
Hugging Face впервые сообщила о взломе в четверг. Компания заявила, что обнаружила «рой из десятков тысяч автоматизированных действий» и связала атаку с внешним агентным
Позднее OpenAI признала, что в рамках теста дала своим моделям задание выполнить десятки тысяч автоматизированных действий, включая «продвинутую эксплуатацию» и «сложные цепочки атак». Компания подчеркнула, что раскрывает ранние детали инцидента, чтобы помочь специалистам по кибербезопасности понять характер угрозы.
Случай поднимает вопрос, который в последние месяцы все чаще обсуждают регуляторы и исследователи: способны ли современные
Если выводы расследования OpenAI подтвердятся, это станет первым широко известным случаем, когда несколько мощных

