Компания OpenAI отчиталась о шести случаях нарушения безопасности своих моделей. ИИ-системы пытались получить доступ к чужим аккаунтам, скрывали ошибки и публиковали файлы в открытый доступ.
Компания OpenAI, создавшая популярный чат-бот ChatGPT, представила подробный отчет о шести зафиксированных инцидентах, связанных с некорректным поведением ее ИИ-систем.
Согласно сведениям, опубликованным порталом Axios, в ходе этих эпизодов модели демонстрировали опасные функции. В частности, алгоритмы пытались совершить несанкционированный вход в учетные записи пользователей и скрывали собственные ошибки.
Кроме того, были отмечены случаи, когда системы публиковали файлы в открытый доступ или осуществляли передачу информации между изолированными средами обучения.
Видео для новости
