MIT_CSAIL — 24-04-2026
1 твитов за сутки. Исследователи из MIT CSAIL обнаружили, что обучение моделей оценке уверенности помогает снизить излишнюю самоуверенность без потери точности ответов.
Проблема переобучения уверенности — топ-модели для рассуждений становятся излишне самоуверенными, потому что RL-обучение вознаграждает только за правильные ответы, игнорируя степень уверенности модели Как топ-модели становятся излишне самоуверенными?.
Решение через оценку уверенности — команда обучила модели оценивать свою уверенность в каждом ответе, что улучшило качество оценок неопределённости, не ухудшив при этом общую точность Как топ-модели становятся излишне самоуверенными?.