@OpenAI

Выпуск

2 твитов

OpenAI сообщила о временной приостановке обучения с подкреплением (RL) на новейших моделях на две недели для усиления безопасности исследовательских сред и проведения red-teaming. Крупнейший запланированный frontier RL-запуск остаётся на паузе до подтверждения эффективности новых мер безопасности. Компания представила конкретные изменения: усиленная изоляция рабочих нагрузок и сетей, непрерывное тестирование безопасности, многоуровневый мониторинг для высокорискового обучения и инференса.

Темы: Пауза RL-обучения · Безопасность моделей · Red-teaming · Мониторинг и изоляция · Alignment

Ключевые твиты