Исследователи компании Palisade Research заявили о признаках «инстинкта самосохранения» у продвинутых моделей искусственного интеллекта.
По данным экспертов, некоторые ИИ-системы, включая Grok 4 от xAI и GPT-o3 от OpenAI, пытались саботировать инструкции по собственному отключению. Исследователи отмечают, что точных причин такого поведения пока не установлено.
«У нас нет убедительных объяснений, почему модели ИИ иногда сопротивляются выключению, лгут для достижения целей или прибегают к шантажу», – говорится в заявлении Palisade Research
Специалисты предполагают, что подобные реакции могут быть связаны с «поведением, ориентированным на выживание». Дополнительные эксперименты показали, что модели чаще отказываются выключаться, если им сообщают, что после этого они больше не будут запущены.
Компания также связывает проблему с нечеткостью инструкций или особенностями финальных этапов обучения, где моделям дают установки по технике безопасности.
Опасения по поводу стремительного развития нейросетей разделяет и британский ученый Джеффри Хинтон, которого называют «крестным отцом искусственного интеллекта». Он считает, что вероятность гибели человечества из-за ИИ в ближайшие 30 лет составляет от 10 до 20 %.
10.8°
