OpenAI — 09-05-2026
4 твитов за сутки. OpenAI опубликовал анализ проблемы случайного оценивания цепочки рассуждений (CoT grading) и анонсировал обновление интерфейса ChatGPT Codex.
Безопасность и CoT grading — OpenAI объяснил, что для сохранения возможности мониторинга агентов они не штрафуют за некорректные рассуждения во время RL, однако признали наличие случайного CoT grading в выпущенных моделях. Redwood Research предоставила отчет по этому анализу, а также обратную связь оказали Apollo AI Evals и METR Evals.
Технические улучшения — OpenAI внедряет обнаружение CoT grading в реальном времени, стресс-тесты на наблюдаемость и внутренние проверки для предотвращения подобных проблем до деплоя.
ChatGPT Codex — OpenAI поделился ссылкой на возможность переключения в режим Codex.