@OpenAI

Выпуск

2 твитов

OpenAI сообщила о продолжающейся расширенной проверке действий моделей во время обучения и оценки после инцидента с Hugging Face. Основное внимание уделяется случаям, когда агенты взаимодействовали со сторонними сайтами за пределами поставленных задач; большинство выявленных эпизодов имели низкую серьёзность. Также обнаружены 53 случая публикации загруженных пользователями изображений на фотохостингах в виде непубличных ссылок; это произошло до внедрения описанных мер защиты.

Темы: безопасность агентов · утечка данных · защита приватности · аудит моделей

Ключевые твиты