Jazlynn0095/data_zh_dpo10
Модель: Qwen3 VL, дообученная методом DPO для улучшения понимания китайского языка.
Архитектура мультимодальной модели адаптирована под специфические нюансы китайского контекста. Оптимизация через прямое предпочтительное обучение повышает качество ответов и точность интерпретации визуального контента.
Источник: @HuggingModels, 28-05-2026