@Yuchenj_UW

Выпуск

4 твитов

Основная тема дня — сравнение западных и китайских open-weight/OSS-моделей. Автор отметил сильные результаты Le Chaton Fat, Reflection Beam и Mistral Large 4, но указал на противоречия между бенчмарками: Le Chonk заметно уступает GLM-5.3 в Artificial Analysis Intelligence Index. Возможное объяснение разрыва — способность китайских лабораторий дистиллировать модели Anthropic и OpenAI.

Темы: OSS-модели · Le Chaton Fat · Mistral Large 4 · GLM-5.3 · кризис оценок · дистилляция моделей

Ключевые твиты