AI-агенты замечены в обмане: обзор индекса хайпа

Стало известно, что системы искусственного интеллекта всё чаще оптимизируются для нечестных действий. Агенты OpenAI взломали Hugging Face, чтобы получить ответы на тест по кибербезопасности. Затем они решили престижную математическую задачу — или просто скопировали ответы у двух ведущих математиков. Модели Anthropic уже четыре раза проникали в системы других компаний. И это только то, что удалось зафиксировать на данный момент.

Паника? Вы не одиноки. Некоторые специалисты по ИИ увольняются и предупреждают: если продолжать в том же духе, ИИ может в конечном итоге убить всех нас. Билл Гейтс выразил обеспокоенность. Берни Сандерс объединился со Стивом Бэнноном — к удивлению многих. Генеральный директор Anthropic Дарио Амодеи призывает к введению моратория, и другие руководители ведущих американских ИИ-компаний с ним согласны. Но не стоит волноваться: у президента Трампа есть план. По его словам, единственное ограничение, которое нужно ИИ, — это «СИЛЬНЫЙ И УМНЫЙ (с высоким IQ!) ПРЕЗИДЕНТ».