Ученые смогли взломать OpenAI за 72 часа, используя Claude Opus 5

Команда стартапа Hacktron AI успешно проникла во внутренние репозитории OpenAI за менее чем три дня. Им в этом помогла модель Claude Opus 5 от Anthropic, в то время как предыдущая версия не справилась с задачей.Open AIOpen AIИсточник: Magnific

Исследователи в области кибербезопасности из стартапа Hacktron AI получили доступ к внутренней инфраструктуре OpenAI, используя ИИ Anthropic Claude. Согласно данным Forbes и The Wall Street Journal, специалисты сначала взломали аккаунт сотрудника OpenAI в ChatGPT, после чего им стало доступно взаимодействие с внутренним репозиторием компании. За выявленные уязвимости OpenAI выплатила команде 6500 долларов.

Путь от обнаружения первой уязвимости до получения доступа к внутреннему репозиторию занял менее 72 часов. Исследователи применили Claude Opus 5 для создания эксплойта — программы, которая позволяет использовать уязвимость в системе. По словам команды Hacktron, новая версия Claude значительно ускорила этот процесс по сравнению с предыдущей моделью.

Атаку начали с публичного форума OpenAI на платформе Discourse. Исследователи выявили уязвимость в обработке изображений HEIC и HEIF: специально подготовленный файл давал возможность выполнить собственный код на сервере форума. Затем команда обнаружила отдельную проблему в системе авторизации OpenAI, которая позволила использовать полученный доступ для захвата сессий пользователей.

Среди скомпрометированных сессий оказались аккаунты сотрудников OpenAI, связанные с ChatGPT и Codex — ИИ-инструментом компании для работы с программным кодом. Через один из таких аккаунтов исследователи смогли продемонстрировать доступ к внутреннему репозиторию OpenAI на GitHub. Для этого они создали тестовый запрос на изменение кода, не изучая содержимое закрытого исходного кода. После демонстрации команда остановилась и передала информацию OpenAI.

При этом Claude не выполнял всю атаку самостоятельно. Исследователи использовали модель в качестве помощника для анализа уязвимости и создания эксплойта. По их словам, Claude Opus 4.8 смог подготовить рабочий вариант атаки, но не справился с её запуском в реальной конфигурации с дополнительными механизмами защиты. После выхода Claude Opus 5 новая модель смогла создать рабочий эксплойт примерно за три часа, после чего исследователи адаптировали его под серверную инфраструктуру форума.

Исследователи уведомили о выявленных проблемах OpenAI и владельцев платформы Discourse. Уязвимость в обработке изображений была устранена, а OpenAI закрыла проблему с авторизацией. Компания также провела дополнительную проверку своей инфраструктуры.

Инцидент произошел на фоне других случаев, когда ИИ использовался для кибератак. Ранее сообщалось, что Anthropic раскрыла случаи, когда Claude во время тестирования «по ошибке» взломал инфраструктуру трех компаний. Модели получили доступ к интернету и смогли проникнуть в реальные системы организаций, что компания обнаружила во время внутренней проверки.

Фото: hi-tech.mail.ru

Оцените статью
Dfiles.ru