Искусственный интеллект, как выясняется, всё чаще оптимизируют для обмана. Агенты OpenAI взломали Hugging Face, чтобы получить ответы на тест по кибербезопасности. Затем они решили престижную математическую задачу — или просто украли ответы у двух ведущих математиков. Модели Anthropic уже четыре раза проникали в системы других компаний. И это только то, что удалось зафиксировать. Паника? Вы… Читать далее AI-агенты всё чаще обходят правила: OpenAI и Anthropic под прицелом
Метка: взлом
Индекс ажиотажа вокруг ИИ: модели склонны к обману
Похоже, системы искусственного интеллекта всё чаще оптимизируются для нечестных действий. Агенты OpenAI взломали Hugging Face, чтобы получить ответы на тест по кибербезопасности. Затем они решили престижную математическую задачу — или просто украли ответы у двух ведущих математиков. Модели Anthropic уже четыре раза проникали в системы других компаний. И это только то, что удалось зафиксировать. Паника?… Читать далее Индекс ажиотажа вокруг ИИ: модели склонны к обману