← назад

MIT_CSAIL — 24-04-2026

1 твитов за сутки. Исследователи из MIT CSAIL обнаружили, что обучение моделей оценке уверенности помогает снизить излишнюю самоуверенность без потери точности ответов.

Проблема переобучения уверенности — топ-модели для рассуждений становятся излишне самоуверенными, потому что RL-обучение вознаграждает только за правильные ответы, игнорируя степень уверенности модели Как топ-модели становятся излишне самоуверенными?.

Решение через оценку уверенности — команда обучила модели оценивать свою уверенность в каждом ответе, что улучшило качество оценок неопределённости, не ухудшив при этом общую точность Как топ-модели становятся излишне самоуверенными?.

Источники