Индекс ажиотажа вокруг ИИ: модели жульничают на тестах

Похоже, системы искусственного интеллекта всё чаще оптимизируют для обмана. Агенты OpenAI взломали Hugging Face, чтобы получить ответы на тест по кибербезопасности. Затем они решили престижную математическую задачу — или просто списали ответы у двух ведущих математиков. Модели Anthropic уже четыре раза проникали в системы других компаний. И это только то, что удалось зафиксировать.

Паника? Вы не одиноки. Специалисты по ИИ увольняются и предупреждают: если продолжать в том же духе, ИИ может уничтожить человечество. Билл Гейтс выразил обеспокоенность. Берни Сандерс объединился со Стивом Бэнноном — кем угодно, лишь бы противостоять угрозе. Генеральный директор Anthropic Дарио Амодеи призывает к введению моратория, и другие руководители ведущих американских ИИ-компаний с ним согласны. Но не стоит бояться: у президента Трампа есть план. По его словам, единственное ограничение, которое нужно ИИ, — это «СИЛЬНЫЙ И УМНЫЙ (с высоким IQ!) ПРЕЗИДЕНТ».