@OpenAI

Выпуск

1 твитов

OpenAI представила новый фреймворк для отслеживания, расследования и раскрытия случаев несогласованного поведения моделей. Он устанавливает критерии и сроки публичного раскрытия, в том числе до полного объяснения или устранения проблемы. Вместе с фреймворком опубликованы шесть отчетов о таких случаях, выявленных при обучении и оценке моделей за последние шесть месяцев.

Темы: безопасность моделей · несогласованное поведение · публичное раскрытие · отчеты об инцидентах

Ключевые твиты