Исследователи взломали «внутренние мысли» главных нейросетей от OpenAI, Google и Anthropic

Исследователи взломали «внутренние мысли» главных нейросетей от OpenAI, Google и Anthropic

Команда специалистов по кибербезопасности обнаружила критическую архитектурную уязвимость в работе ведущих языковых моделей. Выяснилось, что OpenAI, Google и Anthropic использовали единый глобальный ключ шифрования для токенов «внутренних рассуждений» (chain-of-thought) – скрытого процесса, во время которого нейросеть обдумывает задачу перед выдачей финального ответа.

Исследователи из Института Макса Планка и компании Snyk успешно декодировали более 315 тысяч блоков рассуждений, собранных из публичных логов на GitHub и Hugging Face. В результате расшифровки эксперты получили доступ к десяткам действующих API-ключей, паролям и личным адресам электронной почты, которые модели обрабатывали в скрытом режиме.

Уязвимость оказалась кросс-модельной: стандартный доступ к API позволял одной нейросети, например, Haiku 4.5, читать скрытые мысли более мощной Opus 4.8. Аналогичная проблема затронула линейки GPT-5.6 от OpenAI и Gemini от Google.

Компании-разработчики уже выпустили серверные обновления и закрыли брешь после получения отчета от исследователей. Однако специалисты предупреждают, что тысячи уже расшифрованных логов сессий навсегда остались в открытом доступе, создавая долгосрочные риски для разработчиков, неосторожно передававших конфиденциальные данные ИИ-агентам.

Комментарии
Нет комментариев. Будьте первым!