STEP-sft-Qwen2.5-VL-7B-Instruct-rawimg-v2-nomap-action-nocot
Модель: Qwen2.5-VL 7B от Alibaba, адаптированная для прямого анализа сырых изображений без предварительной обработки.
Инструмент предназначен для зрительно-языкового понимания с фокусом на действия, исключая цепочки рассуждений (CoT). Подходит для задач, где важна скорость и прямая интерпретация визуального контента.
Источник: @HuggingModels, 29-05-2026