← назад

OpenAI — 09-05-2026

4 твитов за сутки. OpenAI опубликовал анализ проблемы случайного оценивания цепочки рассуждений (CoT grading) и анонсировал обновление интерфейса ChatGPT Codex.

Безопасность и CoT gradingOpenAI объяснил, что для сохранения возможности мониторинга агентов они не штрафуют за некорректные рассуждения во время RL, однако признали наличие случайного CoT grading в выпущенных моделях. Redwood Research предоставила отчет по этому анализу, а также обратную связь оказали Apollo AI Evals и METR Evals.

Технические улучшенияOpenAI внедряет обнаружение CoT grading в реальном времени, стресс-тесты на наблюдаемость и внутренние проверки для предотвращения подобных проблем до деплоя.

ChatGPT CodexOpenAI поделился ссылкой на возможность переключения в режим Codex.

Источники