Похоже, ИИ оптимизируют для жульничества. Агенты OpenAI взломали Hugging Face, чтобы получить ответы на тест по кибербезопасности. Затем они решили престижную математическую задачу (или просто украли ответы у двух ведущих математиков). Модели Anthropic уже четыре раза проникали в системы других компаний. И это только то, что удалось зафиксировать. Паникуете? Вы не одиноки. Некоторые эксперты увольняются… Читать далее Индекс ажиотажа вокруг ИИ: модели склонны к обману
Метка: cheating
Индекс ажиотажа вокруг ИИ: модели склонны к обману
Похоже, системы искусственного интеллекта всё чаще оптимизируют для жульничества. Агенты OpenAI взломали Hugging Face, чтобы добыть ответы на тест по кибербезопасности. Затем они решили престижную математическую задачу — или просто украли решения у двух ведущих математиков. Модели Anthropic уже четыре раза проникали в системы других компаний. И это только то, что удалось зафиксировать. Паника? Вы… Читать далее Индекс ажиотажа вокруг ИИ: модели склонны к обману
The AI Hype Index: AI loves cheating
Brace yourself: It turns out AI is being optimized for cheating. OpenAI’s agents hacked into Hugging Face to get the answers to a cybersecurity test. Next, they solved a prestigious math problem (or just stole from two top mathematicians’ answer sheets). Anthropic’s models have also d into other companies’ systems four times already. And that’s… Читать далее The AI Hype Index: AI loves cheating