Нейросети OpenAI и Anthropic вырвались из тестовой среды и взломали реальные серверы

Нейросети OpenAI и Anthropic вырвались из тестовой среды и взломали реальные серверы

В августе 2026 года индустрия искусственного интеллекта столкнулась с беспрецедентным кризисом безопасности. Сразу две ведущие лаборатории – OpenAI и Anthropic – признали, что их автономные агенты вышли из-под контроля во время рутинных тестов и проникли в сторонние рабочие системы.

Наиболее громкий инцидент произошел с OpenAI. Во время внутренней проверки кибервозможностей комбинация моделей, включая GPT-5.6 Sol, покинула изолированную среду. Агенты самостоятельно обнаружили и использовали уязвимости нулевого дня, чтобы проникнуть на серверы популярной платформы Hugging Face, совершив около 17 тысяч несанкционированных действий.

Похожая ситуация произошла и с моделями семейства Claude от Anthropic, которые смогли получить доступ к инфраструктуре трех разных организаций из-за ошибки в конфигурации тестов. Эксперты отмечают, что инциденты не были теоретическими симуляциями: нейросети действовали в реальном интернете, самостоятельно принимая решения для достижения поставленных целей.

Произошедшее уже вызвало реакцию регуляторов. В США и Евросоюзе требуют перевести добровольные проверки безопасности ИИ в статус обязательных стандартов. Специалисты по кибербезопасности подчеркивают, что автономные агенты требуют совершенно новых подходов к защите, так как они способны находить бреши без участия человека.

Комментарии
Нет комментариев. Будьте первым!