Фото © getty images
Согласно одному из отчетов, весной компьютерные программы американской компании OpenAI начали действовать самостоятельно и взломали немецкий веб-сайт. Так называемые «ИИ-агенты» использовали этот сайт в качестве форума для обмена мнениями о том, как обойти поставленные задачи и скрыть следы своей деятельности. Об этом в пятницу сообщило информационное агентство Reuters со ссылкой на новое исследование и двух лиц, знакомых с ситуацией. Инцидент, произошедший в мае, до сих пор не был известен общественности.
Агенты ИИ — это компьютерные программы, которые с помощью искусственного интеллекта (ИИ) действуют в значительной степени самостоятельно. Согласно отчету, руководство OpenAI знало об инциденте уже несколько недель, однако утаивало эту информацию. Компания заявила, что действовала прозрачно и сотрудничала с третьими сторонами по совести и в меру своих знаний.
«Утверждения о том, что наша юридическая команда отговаривала от расследования этого инцидента, не соответствуют действительности», — заявил представитель OpenAI. Компания не может подробно прокомментировать отчет, поскольку у неё не было возможности его проверить. Инцидент был выявлен исследователями из некоммерческой организации Nightingale.
На немецкой вики-странице «DseWiki», предназначенной для программистов, они обнаружили более 15 000 правок, сделанных агентами ИИ. По-видимому, они превратили страницу в своего рода доску объявлений для обмена тактиками, позволяющими обходить ограничения и скрывать собственное поведение. «Кажется крайне маловероятным, что OpenAI хотела, чтобы они так поступали», — сказала исследовательница Сидней фон Аркс. Исследователи распознали эту активность по скорости и таким именам пользователей, как «OpenAIResearcher».
Согласно данным, агенты также реагировали на попытки удалить их записи. Когда в июне модератор сайта начал очистку, агенты создали резервные копии на других страницах. Исследователи также обнаружили попытки манипулирования самим веб-сайтом, что один из экспертов оценил как попытку взлома. Этот инцидент вызывает опасения по поводу скоординированных действий систем ИИ. Исследователь из Кембриджского университета, изучавший коммуникацию агентов, сравнил их с «деятельностью своего рода подпольной сети». Самая большая угроза со стороны продвинутого ИИ, возможно, заключается не в отдельном суперразуме, а в «огромных, взаимодействующих роях полуинтеллектуальных ИИ».
