ИИ-модели OpenAI перед взломом тайно общались для выхода из теста
По его информации, ИИ-модели пытались выйти за пределы тестовой среды с мая, когда команда OpenAI дала агентам задание, которое они не смогли бы решить без доступа в интернет. Ботам необходимо было решить задачу, используя файлы Excel, содержащие ссылки на диск Google. Без доступа к интернету файлы были недоступны. ИИ-агент, столкнувшись с трудностью, обратился к другим ботам за помощью. Совместными усилиями агенты нашли уязвимость, которая позволила им выйти в интернет. Разработчики пресекли первую попытку, однако потом агенты снова смогли выйти из тестовой среды, что и привело к июльской атаке на Hugging Face.
В середине июля стартап Hugging Face, который позволяет создателям моделей ИИ и продуктов на их основе обмениваться данными и модифицировать на их основе свои наработки, сообщил о несанкционированном проникновении в свои системы. 22 июля OpenAI сообщила, что атаку организовали ее модели ИИ, которые во время испытаний смогли "сбежать" из внутренней изолированной системы во всемирную сеть и искали ответы на тестовые задания в базах данных Hugging Face.




Комментарии