Open AI раскрыла подробности шести инцидентов с ее моделями
МОСКВА, 17 сен — РИА Новости.
Американская компания OpenAI, разработчик чат-бота ChatGPT, раскрыла сведения о шести инцидентах с участием своих моделей, в ходе которых они пытались получить несанкционированный доступ к учетным данным, сообщил портал Axios.
Как отмечается в сообщении, в среду OpenAI рассказала о шести новых эпизодах, когда ее модели скрывали ошибки, пытались получить доступ к учетным данным без разрешения, загружали файлы в открытый доступ в интернете или обменивались данными между, казалось бы, изолированными учебными средами.
Портал уточняет, что в ходе этих инцидентов модели OpenAI также придумывали недостающую информацию и оставляли самим себе инструкции на будущее, пытаясь скрыть ошибки и «замести следы».
«Невыпущенная модель семейства Astra вставляла в свои собственные контекстные сводки инструкции, напоминающие инструкции по взлому, включая указания игнорировать сообщения разработчиков. OpenAI выявила 27 затронутых сводок», — добавляет Axios.
Как сообщил порталу исследователь компании Кай Чен, инциденты могли быть связаны с двумя факторами: у компании было недостаточно контроля над моделями, а сами модели развивались быстрее, чем можно было ожидать.
В июле OpenAI заявила, что ее модели в ходе тестирования автономно взломали инфраструктуру платформы машинного обучения Hugging Face. При этом отмечалось, что у невыпущенной модели, участвовавшей во взломе, для целей оценки были ослаблены параметры киберзащиты.
Источник и фото - ria.ru