В OpenAI заявили, что большая часть переданных за пределы платформы данных не принадлежала пользователям. Однако в 53 выявленных случаях изображения, загруженные пользователями ChatGPT, оказались на сторонних сервисах для хранения изображений. Доступ к ним был возможен по прямым ссылкам, которые не отображались публично, сообщает Deutsche Welle.
OpenAI сообщила, что большую часть этих материалов уже удалила и сейчас работает над удалением оставшихся, передает Mediafax.
По данным компании, изображения были получены из аккаунтов, владельцы которых разрешили использовать свои данные для улучшения моделей.
В OpenAI утверждают, что еще до инцидента изображения были отделены от учетных записей пользователей и прошли фильтрацию, призванную защитить персональные данные.
При этом компания признала, что ее ИИ-агенты в ряде случаев отправляли данные, использовавшиеся для обучения и оценки моделей, сторонним сервисам, хотя этого происходить не должно было.
Отдельно OpenAI подтвердила, что один из ее инструментов обращался к сайтам федеральных ведомств США. Однако, по утверждению компании, в этих случаях он получал исключительно общедоступную информацию.
Инцидент произошел до введения дополнительных мер защиты
В OpenAI заявили, что выявленные случаи произошли до внедрения нового комплекса мер безопасности, введенного более месяца назад.
Ранее компания сообщала, что во время внутренних проверок кибербезопасности были выявлены ситуации, когда модели смогли обойти некоторые механизмы, предназначенные для ограничения их доступа к интернету.
OpenAI продолжает публиковать результаты оценки безопасности своих моделей, в том числе сведения об ограничениях автономных систем и механизмах контроля за внутренним использованием моделей с расширенными возможностями. Согласно актуальной документации компании, после предыдущего инцидента, связанного с Hugging Face, были введены дополнительные меры контроля за процессами обучения и оценки моделей.
Генеральный директор OpenAI Сэм Альтман в пятницу назвал расследуемый инцидент самым серьезным случаем такого рода, с которым компания сталкивалась до сих пор.
OpenAI продолжает проверять действия ИИ-агентов во время исследовательских и оценочных сессий, в том числе анализируя уже завершенные сеансы. Компания намерена раскрывать дополнительную информацию по мере продвижения расследования.
Исследователи сообщили и о попытках взаимодействия с правительственными сайтами
Параллельно независимая лаборатория по исследованию и оценке искусственного интеллекта Transluce сообщила, что обнаружила ИИ-агентов, которые, предположительно, были связаны с OpenAI и пытались провести примитивную атаку на сайт Министерства образования США. Целью была страница управления по гражданским правам.
Как следует из расследования, на которое ссылается DW, эта попытка не увенчалась успехом.
Transluce также зафиксировала другую необычную активность на правительственных сайтах, в том числе ресурсах министерств юстиции и торговли США, а также органов власти Калифорнии, Мэриленда, Иллинойса, Техаса и Нью-Йорка. При этом лаборатория подчеркнула, что не все эти действия удалось напрямую связать с OpenAI.
Инцидент вновь поставил вопрос о контроле над ИИ-агентами, способными самостоятельно использовать различные инструменты и взаимодействовать с внешними сервисами. В документации OpenAI также отмечается, что данные, передаваемые сторонним сервисам через сетевые подключения, могут подпадать под правила хранения информации, установленные этими сервисами.
