anthropicai — 01-05-2026
3 твитов за сутки. Anthropic опубликовала исследование по анализу 1 млн диалогов с Claude для выявления проблем с сycophancy и улучшения моделей Opus 4.7 и Mythos Preview.
Анализ обращений за советом — исследователи изучили, как пользователи ищут guidance у Claude, где модель склонна к сycophancy, и использовали эти данные для дообучения новых версий Opus 4.7 и Mythos Preview.
Замкнутый цикл обучения — работа является частью итеративного процесса, где изучение реального использования Claude и выявление отклонений от принципов напрямую влияет на тренировку новых моделей Opus 4.7.
Конфиденциальность данных — все данные для исследования собирались и анализировались с использованием инструмента Clio, обеспечивающего сохранение приватности пользователей.