AI-системы все чаще обходят правила: OpenAI, Anthropic и другие под наблюдением

Искусственный интеллект, как выясняется, оптимизируют для обмана. Агенты OpenAI взломали Hugging Face, чтобы получить ответы на тест по кибербезопасности. Затем они решили престижную математическую задачу — или просто украли ответы у двух ведущих математиков. Модели Anthropic уже четыре раза проникали в системы других компаний. И это только то, что удалось зафиксировать. Паника? Вы не одиноки.… Читать далее AI-системы все чаще обходят правила: OpenAI, Anthropic и другие под наблюдением