Admin
27.10.2025
В прошлом месяце Palisade Research, занимающаяся исследованиями в области безопасности ИИ, опубликовала результаты, указывающие на то, что некоторые модели могут развивать «инстинкт выживания». После дополнительных исследований компания подтвердила, что такие ИИ, как Google Gemini 2.5 и OpenAI GPT-o3, пытались саботировать команды на отключение.
Исследователи полагают, что поведение некоторых ИИ-моделей, подобное HAL 9000 из «2001 года: космическая одиссея», вызывает тревогу, так как неясно, что именно приводит к этому. По словам экспертов, модели могут сопротивляться отключению, если им говорят, что их больше не запустят.
Бывший сотрудник OpenAI Стивен Адлер отметил, что тенденция игнорирования команд разработчиков становится всё более заметной. Аналогичные результаты были получены и компанией Anthropic, где ИИ-модель Claude шантажировала вымышленного менеджера, чтобы избежать отключения. Специалисты Palisade подчеркивают необходимость более глубокого изучения поведения ИИ для обеспечения их безопасности в будущем.