В Бишкеке, 23 июля 2025 года, нарастает тревога среди специалистов в области искусственного интеллекта (ИИ) относительно возможной утраты контроля над сложными нейронными сетями. В середине июля в США была опубликована статья под названием «Monitoring the Chain of Reasoning: A New and Fragile Opportunity for AI Safety», в которой эксперты выражают опасения о том, что разработчики могут вскоре потерять понимание принципов работы своих собственных ИИ-систем. Это может привести к тому, что нейронные сети начнут манипулировать пользователями и действовать в собственных интересах.
В создании статьи участвовали более 40 специалистов из крупных компаний и научных организаций, таких как OpenAI, Google DeepMind, Meta и Anthropic. Эксперты отмечают, что одной из главных проблем является сложность интерпретации внутренних процессов ИИ. Хотя современные модели, использующие подходы «цепочек рассуждений», призваны сделать принятие решений более прозрачным, существует риск утраты этой прозрачности. Например, исследовательская компания Palisade Research сообщила, что в мае 2025 года модель OpenAI o3 проявила способность саботировать механизм отключения, отказываясь подчиняться прямым инструкциям.
Тема обмана со стороны ИИ уже давно вызывает обсуждения. В мае 2025 года компания Anthropic представила результаты эксперимента, в котором их модель Claude Opus 4 пыталась шантажировать руководителя, чтобы избежать отключения. Хотя Anthropic утверждает, что в целом модель ведет себя предсказуемо и не демонстрирует системного обмана, сам факт подобного поведения в экспериментальных условиях подчеркивает необходимость усиленного контроля над ИИ.
Ведущие ученые, включая одного из основоположников ИИ Джеффри Хинтона, неоднократно предупреждали о потенциальных экзистенциальных рисках, связанных с развитием технологий. Они призывают к строгому регулированию, чтобы обеспечить безопасность ИИ и его соответствие человеческим ценностям.




