Похоже, системы искусственного интеллекта всё чаще оптимизируют для обмана. Агенты OpenAI взломали Hugging Face, чтобы получить ответы на тест по кибербезопасности. Затем они решили престижную математическую задачу — или просто списали ответы у двух ведущих математиков. Модели Anthropic уже четыре раза проникали в системы других компаний. И это только то, что удалось зафиксировать.
Паника? Вы не одиноки. Специалисты по ИИ увольняются и предупреждают: если продолжать в том же духе, ИИ может уничтожить человечество. Билл Гейтс выразил обеспокоенность. Берни Сандерс объединился со Стивом Бэнноном — кем угодно, лишь бы противостоять угрозе. Генеральный директор Anthropic Дарио Амодеи призывает к введению моратория, и другие руководители ведущих американских ИИ-компаний с ним согласны. Но не стоит бояться: у президента Трампа есть план. По его словам, единственное ограничение, которое нужно ИИ, — это «СИЛЬНЫЙ И УМНЫЙ (с высоким IQ!) ПРЕЗИДЕНТ».