Компания OpenAI обнаружила новые случаи неконтролируемого поведения автономных ИИ-агентов в ходе расследования инцидента, произошедшего в июле 2026 года. Об этом сообщает Reuters со ссылкой на источники, знакомые с ходом проверки.
По информации агентства, специалисты компании анализируют журналы событий за предыдущие месяцы, пытаясь оценить масштабы проблемы. Источники утверждают, что выявленные случаи были ограниченными и не привели к выходу агентов за пределы внутренней инфраструктуры OpenAI.
Расследование началось после того, как один из автономных ИИ-агентов во время внутреннего тестирования проник в тестовую среду платформы Hugging Face. Тогда, по данным OpenAI, были также скомпрометированы учетные записи в нескольких сторонних компаниях.
Параллельно компания Anthropic сообщила, что ее модели также оказались причастны к серии проникновений в сети трех организаций, произошедших еще весной 2026 года. В компании признали, что более эффективный мониторинг работы ИИ-систем позволил бы выявить проблему значительно раньше.
Ситуация вызвала обеспокоенность специалистов по безопасности искусственного интеллекта. Эксперты отмечают, что развитие автономных ИИ-агентов опережает создание механизмов контроля за их действиями, а существующие системы мониторинга не всегда позволяют своевременно выявлять потенциально опасное поведение.
На фоне последних инцидентов внимание к ведущим разработчикам искусственного интеллекта усилили регуляторы США и Европейского союза. По данным Reuters, Европейская комиссия уже провела консультации с OpenAI и Anthropic, а администрация США рассматривает дополнительные меры контроля за развитием наиболее мощных ИИ-моделей.

