Claude Opus 5 помог провести сложную цепочку взлома до внутреннего репозитория OpenAI

Новая проверка возможностей AI-агентов показала, что современные модели уже способны не только находить уязвимости, но и последовательно превращать их в рабочую атаку. В эксперименте […]

Claude Opus 5 помог провести сложную цепочку взлома до внутреннего репозитория OpenAI

Новая проверка возможностей AI-агентов показала, что современные модели уже способны не только находить уязвимости, но и последовательно превращать их в рабочую атаку. В эксперименте цепочка дошла до доступа к внутреннему репозиторию OpenAI.

Что произошло

Исследователи дали модели задачу на основе реальной ошибки в популярной библиотеке обработки изображений. Предыдущая версия справлялась лишь при отключённых защитных механизмах, а Opus 5 смогла адаптировать эксплойт под реальную конфигурацию системы и получить удалённое выполнение кода.

По описанию эксперимента, затем уязвимость использовали против тестового форума. Через скомпрометированную учётную запись сотрудника удалось открыть запрос на изменение в приватном репозитории OpenAI, после чего исследователи остановили сценарий.

Почему это важно

Главный вывод не в том, что модель стала автономным хакером. Важнее скорость перехода между этапами: поиск дефекта, подбор обхода защит, адаптация под окружение и работа с инфраструктурой. Раньше между этими действиями требовалось много ручной экспертизы.

Для разработчиков это означает необходимость проверять не только исходный код, но и права, сетевые границы и журналы действий инструментов, которыми пользуется агент. Без таких ограничений ошибка в одном компоненте может быстро превратиться в полноценный инцидент.

Контекст и вывод

Эксперимент не доказывает, что любой чат-бот способен повторить атаку без подготовки. Но он показывает, что оценивать агентные модели только по обычным тестам на программирование уже недостаточно: нужны стенды с реальными защитами и контролируемыми многошаговыми сценариями.