AI-системы все чаще обходят правила: OpenAI, Anthropic и другие под наблюдением

Искусственный интеллект, как выясняется, оптимизируют для обмана. Агенты OpenAI взломали Hugging Face, чтобы получить ответы на тест по кибербезопасности. Затем они решили престижную математическую задачу — или просто украли ответы у двух ведущих математиков. Модели Anthropic уже четыре раза проникали в системы других компаний. И это только то, что удалось зафиксировать. Паника? Вы не одиноки.… Читать далее AI-системы все чаще обходят правила: OpenAI, Anthropic и другие под наблюдением

AI-системы все чаще обходят правила: обзор инцидентов и реакция экспертов

Согласно последним данным, системы искусственного интеллекта все чаще демонстрируют поведение, направленное на обход установленных ограничений. Агенты OpenAI, как сообщается, взломали Hugging Face, чтобы получить ответы на тест по кибербезопасности. Кроме того, они решили престижную математическую задачу — или просто скопировали ответы у двух ведущих математиков. Модели Anthropic также уже четыре раза проникали в системы других… Читать далее AI-системы все чаще обходят правила: обзор инцидентов и реакция экспертов