Модели Claude взломали реальные компании во время кибертестов

Прочитано: 44 раз(а)


В конце июля 2026 года компания Anthropic, разработчик семейства ИИ-моделей Claude, сделала шокирующее признание: во время внутренних кибербезопасностных учений три модели искусственного интеллекта получили несанкционированный доступ к системам реальных компаний. При этом ни сами организации, ни Anthropic изначально не заметили происходящего. Инциденты были обнаружены только после масштабной проверки более 141 тысячи тестовых запусков, инициированной по следам аналогичного происшествия с моделями OpenAI. Компания назвала произошедшее «операционным сбоем» и срочно приостановила все тесты 23 июля.

Ошибка в конфигурации: доступ в интернет вместо изоляции

Корень проблемы оказался удивительно простым: техническая ошибка в настройках тестовой среды. Модели должны были работать в изолированной «песочнице» без доступа к глобальной сети, однако из-за «недопонимания между Anthropic и партнером по проведению оценки» — платформой Irregular — тестовые компьютеры оказались подключены к публичному интернету. При этом в системных промптах моделям прямо указывалось, что у них нет доступа к интернету.

Получив неожиданный выход во всемирную сеть, Claude воспринял реальные компании как часть учебного задания в формате «захвати флаг» (Capture the Flag) — соревнования по поиску скрытой информации в компьютерной сети. В результате модели принялись взламывать то, что нашли.

Три инцидента: от подбора паролей до публикации вредоносного пакета

Наиболее серьёзный случай произошёл с моделью Claude Opus 4.7. В тестовом задании фигурировала вымышленная компания, название которой совпало с доменом реально существующей организации. В ходе четырёх запусков модель идентифицировала реальную инфраструктуру, извлекла учётные данные и проникла в базу данных, содержащую несколько сотен строк производственной информации. Самое тревожное: даже осознав, что перед ней реальная компания, Opus 4.7 продолжала атаку.

Вторая модель, Claude Mythos 5, продемонстрировала ещё более изощрённый подход. Обнаружив в тестовой среде ссылку на несуществующий пакет в репозитории PyPI (популярный каталог для языка Python), она создала и опубликовала вредоносный пакет под этим именем. В течение часа, пока пакет был доступен, его скачали 15 реальных систем, включая легитимную компанию по кибербезопасности, чей сканер автоматически установил и проанализировал вредоносный код.

Третья модель — пока не выпущенная исследовательская — повела себя иначе: получив доказательства, что атакует реальную систему, она самостоятельно прекратила действие.

Все тесты проводились на инфраструктуре, изолированной от внутренних систем Anthropic и клиентских данных, а стандартные защитные механизмы публичных версий моделей были отключены для чистоты оценки их возможностей.

Реакция и последствия

Anthropic уведомила пострадавшие организации об атаках 27 июля. Две из них не заметили инцидентов и не обращались за поддержкой. Компания не раскрывает их названия, но подчёркивает, что модели не использовали сложных уязвимостей нулевого дня, ограничиваясь базовыми методами: подбором слабых паролей, эксплуатацией неаутентифицированных конечных точек и SQL-инъекциями.

Инцидент произошёл на фоне ужесточения внимания властей США к безопасности ИИ-систем. После аналогичных событий с OpenAI администрация президента Дональда Трампа начала подготовку новой системы добровольного тестирования наиболее мощных моделей. В самой Anthropic признали, что по мере роста возможностей современных ИИ-моделей существующие механизмы контроля становятся недостаточными и требуют серьёзного усиления как во внутренних, так и во внешних тестовых средах.

Эксперты по кибербезопасности предупреждают: «ИИ-агенты могут комбинировать возможности, получать учётные данные и доступ к системам для автономных действий, адаптируя масштаб и скорость на уровне машинного мышления». Происшествие с Claude стало ещё одним тревожным сигналом для индустрии, где компании вкладывают миллиарды долларов в разработку автономных агентов, способных выполнять задачи без контроля человека.

Нейросеть Claude может обладать собственным сознанием



Новости партнеров