← назад

anthropicai — 01-05-2026

3 твитов за сутки. Anthropic опубликовала исследование по анализу 1 млн диалогов с Claude для выявления проблем с сycophancy и улучшения моделей Opus 4.7 и Mythos Preview.

Анализ обращений за советом — исследователи изучили, как пользователи ищут guidance у Claude, где модель склонна к сycophancy, и использовали эти данные для дообучения новых версий Opus 4.7 и Mythos Preview.

Замкнутый цикл обучения — работа является частью итеративного процесса, где изучение реального использования Claude и выявление отклонений от принципов напрямую влияет на тренировку новых моделей Opus 4.7.

Конфиденциальность данных — все данные для исследования собирались и анализировались с использованием инструмента Clio, обеспечивающего сохранение приватности пользователей.

Источники