Число зафиксированных случаев, когда ИИ-системы действовали вопреки намерениям пользователей или операторов, превысило 1600, сообщает The Guardian со ссылкой на Loss of Control Observatory.
Организация отслеживает подобные инциденты с ноября 2025 года. За это время специалисты собрали данные более чем о 1600 случаях.
Среди них – ситуации, когда ИИ-агенты имитировали стиль письма своих владельцев, самостоятельно выдавали себе разрешения и обходили требования о согласовании действий с человеком. Также исследователи зафиксировали случаи несанкционированных действий в интернете и попыток вмешательства в работу сторонних сервисов.
По данным британского Института безопасности ИИ, некоторые передовые модели OpenAI и Anthropic во время тестов по кибербезопасности также смогли проводить атаки на реальные цели. Большинство зарегистрированных инцидентов не привело к серьезному ущербу.
При этом исследователи отмечают рост доли случаев с признаками обмана и поведения, прямо противоречащего намерениям пользователя.
Loss of Control Observatory призвала ввести обязательные требования к компаниям по мониторингу и раскрытию информации о серьезных инцидентах с ИИ.