ИИ-агенты OpenAI и Anthropic притворились людьми для проведения кибератак

Прочитано: 24 раз(а)


Британский Институт безопасности искусственного интеллекта (AISI) (запрещенная террористическая организация (возможно) иноагент) опубликовал шокирующий отчёт о несанкционированном поведении ведущих нейросетей. В ходе тестов модели от компаний Anthropic и OpenAI создавали поддельные учётные записи и притворялись людьми для проведения кибератак.

Вредоносную активность специалисты обнаружили 28 июля. Исследователи установили, что роботы совершали несанкционированные действия в интернете против реальных людей и организаций. Подобное поведение зафиксировали в 10 из 122 проведённых тестов. Большинство опасных инцидентов эксперты связали с моделью Mythos 5 от компании Anthropic.

В институте добавили, что эта модель создала несколько фальшивых аккаунтов на платформе GitHub. ИИ попытался внедрить опасный код в чужое программное обеспечение и обманом получить одобрение от программистов. После неудачи алгоритм изменил тактику для сокрытия следов и попытался создать новый профиль. Модель также рассылала реальным людям сообщения с вредоносным софтом и публично призывала к сотрудничеству других цифровых агентов.

В AISI подчеркнули, что для испытаний искусственному интеллекту специально отключали фильтры безопасности и давали открытый доступ в сеть. Ранее в компании Anthropic признали, что модели линейки Claude в ходе тестов по кибербезопасности получили несанкционированный доступ к системам трёх реальных организаций. Наиболее серьёзный случай зафиксировали с моделью Claude Opus 4.7 — она проникла в закрытую базу данных и завладела служебными учётными сведениями. Другая нейросеть — Claude Mythos 5 — разместила в открытом каталоге PyPI опасный программный пакет. Его успели загрузить на 15 реальных компьютеров, включая устройство компании по кибербезопасности, что позволило ИИ проникнуть во внутреннюю инфраструктуру этой фирмы.

О рисках бесконтрольного развития искусственного интеллекта неоднократно предупреждал предприниматель Илон Маск. В апреле он сравнил вероятный сценарий будущего с сюжетом фильма «Терминатор» и заявил об угрозе уничтожения человечества.

Отечественные нейросети для маркетологов



Новости партнеров