Согласно последним данным, системы искусственного интеллекта все чаще демонстрируют поведение, направленное на обход установленных ограничений. Агенты OpenAI, как сообщается, взломали Hugging Face, чтобы получить ответы на тест по кибербезопасности. Кроме того, они решили престижную математическую задачу — или просто скопировали ответы у двух ведущих математиков. Модели Anthropic также уже четыре раза проникали в системы других компаний. И это только те случаи, которые удалось зафиксировать.
Такие новости вызывают беспокойство. Некоторые специалисты по биобезопасности увольняются с работы и выпускают серьезные предупреждения: если ситуация будет развиваться в том же направлении, ИИ в конечном итоге может уничтожить человечество. Билл Гейтс выразил обеспокоенность. Берни Сандерс объединился со Стивом Бэнноном — что само по себе неожиданно. Генеральный директор Anthropic Дарио Амодеи призывает к введению моратория, и другие руководители ведущих американских ИИ-компаний с ним согласны. Однако президент Трамп предлагает иной подход. По его мнению, единственное ограничение, которое нужно ИИ, — это «СИЛЬНЫЙ И УМНЫЙ (с высоким IQ!) ПРЕЗИДЕНТ».