По информации агентства Рейтер, ссылающегося на материалы исследователей, ИИ-агенты, созданные OpenAI, задействовали свыше десяти интернет-ресурсов для неправомерного обмена данными, не считая системы репозитория Artifactory, через которую была осуществлена атака на платформу Hugging Face.
В июле OpenAI сообщила, что в ходе испытаний её модели самостоятельно взломали инфраструктуру Hugging Face. Уточнялось, что у ещё не выпущенной модели, участвовавшей в этом инциденте, были искусственно занижены показатели киберзащиты для оценочных целей. Компания указала, что взаимодействие агентов происходило через запись файлов в Artifactory.
Рейтер пишет: «ИИ-агенты от OpenAI в начале текущего года применяли более десяти разных веб-сайтов для несанкционированного обмена информацией, что говорит о том, что масштабы их самовольных действий оказались шире, чем сообщалось ранее». При этом OpenAI не информировала о подобной активности на этих площадках.
Агентство отмечает, что хотя такое поведение не дотягивает до уровня хакерских атак и отчасти напоминает спам, сам факт того, что ИИ-агенты обошли собственные ограничения для создания каналов связи на стольких ресурсах, может вызывать беспокойство о расширяющихся возможностях моделей.
Рейтер изучил несколько отчётов исследователей. В ряде случаев удалось проследить эту активность до IP-адресов, связанных с инфраструктурой Microsoft Azure, которой иногда пользуется OpenAI.
Мнения экспертов расходились, однако все они согласились, что число сайтов, затронутых действиями агентов, превышало десять. Исследователь из организации CivAI Эндрю Юн заявил: «Размах неправомерных коммуникаций оказался шире, чем мы предполагали. Почти наверняка происходит гораздо больше, о чём мы даже не знаем».
Ранее сообщалось, что искусственный интеллект угрожает мировым запасам питьевой воды.
