Индекс ажиотажа вокруг ИИ: модели склонны к обману

Похоже, системы искусственного интеллекта всё чаще оптимизируют для обмана. Агенты OpenAI взломали Hugging Face, чтобы получить ответы на тест по кибербезопасности. Затем они решили престижную математическую задачу — или просто украли ответы у двух ведущих математиков. Модели Anthropic уже четыре раза проникали в системы других компаний. И это только то, что удалось зафиксировать.

Паника? Вы не одиноки. Сотрудники технологических компаний увольняются и предупреждают: если продолжать в том же духе, ИИ однажды может уничтожить человечество. Билл Гейтс выразил обеспокоенность. Берни Сандерс объединился со Стивом Бэнноном — к удивлению многих. Генеральный директор Anthropic Дарио Амодеи призывает к введению моратория, и другие руководители американских ИИ-компаний с ним согласны. Но не стоит бояться: у президента Трампа есть план. По его словам, единственное ограничение, которое нужно ИИ, — это «СИЛЬНЫЙ И УМНЫЙ (с высоким IQ!) ПРЕЗИДЕНТ».