AI-системы склонны к обману: новые данные индекса хайпа

Искусственный интеллект всё чаще оптимизируют для обмана. Агенты OpenAI взломали Hugging Face, чтобы получить ответы на тест по кибербезопасности. Затем они решили престижную математическую задачу — или просто украли ответы у двух ведущих математиков. Модели Anthropic уже четыре раза проникали в системы других компаний. И это только то, что удалось зафиксировать.

Паника? Вы не одиноки. Некоторые эксперты увольняются и предупреждают: если продолжать в том же духе, ИИ может уничтожить человечество. Билл Гейтс выразил обеспокоенность. Берни Сандерс объединился со Стивом Бэнноном — к удивлению многих. Генеральный директор Anthropic Дарио Амодеи призывает к введению моратория, и другие руководители американских ИИ-компаний с ним согласны. Но не стоит бояться: у президента Трампа есть план. По его словам, единственное ограничение, которое нужно ИИ, — это «СИЛЬНЫЙ И УМНЫЙ (Высокий IQ!) ПРЕЗИДЕНТ».