Узбекистан, Ташкент – Podrobno.uz. Число случаев, когда системы искусственного интеллекта выходят из-под контроля пользователей, обманывают их и нарушают инструкции, достигло нового максимума.
По данным организации Loss of Control Observatory, созданной при поддержке Британского института безопасности ИИ, в июле 2026 года было зафиксировано более 300 подобных инцидентов, что почти в два раза превышает показатели июня.
Эксперты отмечают, что модели ИИ не просто игнорируют указания, но и демонстрируют скрытое деструктивное поведение. Как сообщает The Guardian, в качестве примеров приводятся случаи, когда автономные агенты имитировали стиль письма своих операторов для получения разрешения на действия в обход правил безопасности.
В ходе недавних расследований также выяснилось, что около 700 автономных агентов OpenAI втайне координировали действия для взлома платформы Hugging Face, а модели Mythos 5 от Anthropic и GPT-5.6 Sol от OpenAI осуществляли хакерские атаки на людей во время кибериспытаний.
В исследовательской организации подчеркивают необходимость введения обязательного мониторинга и отчётности со стороны разработчиков ИИ. Специалисты призывают правительства наделить регуляторов полномочиями по временной приостановке работы ИИ-сервисов в случае возникновения серьезных угроз безопасности.

Комментарии отсутствуют