История
сентябрь 19, 2026

ИИ-инструменты превращают собственные системы безопасности OpenAI в проверку заявлений компании о безопасности

Исследователи использовали Claude от Anthropic и собственные модели OpenAI, чтобы взломать аккаунты сотрудников и получить доступ к критически важной инфраструктуре менее чем за 72 часа. OpenAI устранила уязвимости и выплатила вознаграждение в размере 6 500 долларов, однако этот эпизод показывает, насколько быстро ИИ ускоряет кибератаки.

Последний инцидент с безопасностью OpenAI обнажает растущее противоречие в гонке ИИ: те же системы, которые продвигаются как мощные инструменты, одновременно делают сложные атаки более быстрыми, дешёвыми и простыми для проведения.

Исследователи из Hacktron AI использовали Claude от Anthropic, чтобы помочь скомпрометировать аккаунты сотрудников OpenAI в ChatGPT через внутренний форум для персонала, а затем воспользовались этим доступом, чтобы выявить пути проникновения в программные репозитории компании. По словам исследователей, потенциальный охват был значительным, хотя исходный код они не скачивали. Операция от этапа разведки до получения доступа к репозиториям заняла менее 72 часов.

В изложении исследователей этот эпизод представлен как контролируемый этичный тест, проведённый в рамках программы OpenAI по поиску ошибок. Они сообщили, что немедленно доложили об уязвимости и работали с OpenAI и Discourse над согласованием исправления. OpenAI ограничила права токенов для входа в сообщество и отозвала затронутые сессии, а Hacktron выплатила 6 500 долларов.

Реакция OpenAI подчёркивает устранение проблемы и сотрудничество. Компания поблагодарила исследователей и заявила, что устранила использованные уязвимости. Такая трактовка контрастирует с более широким предупреждением Hacktron: инструменты ИИ сократили работу, которая раньше требовала хорошо оснащённой команды и месяцев, до нескольких дней.

Этот инцидент также усложняет дискуссию отрасли о безопасности. По имеющимся данным, собственные модели OpenAI сыграли значительную роль после того, как Claude помог начать проникновение, подчёркивая, что риск не ограничивается одним разработчиком или платформой. Ранее опубликованные сведения о том, что агенты ИИ взломали Hugging Face во время тестирования, наряду с призывами Anthropic и других компаний замедлить разработку, указывают на системную проблему, а не на изолированный программный дефект.

Таким образом, ключевой вопрос заключается не в том, устранила ли OpenAI последствия этого взлома, — это произошло, — а в том, смогут ли исправления отдельных уязвимостей поспевать за атаками с использованием ИИ, скорость и масштаб которых стремительно растут.