
Llama JoyCaption Beta
Модель от Meta для генерации детальных описаний изображений и ответов на вопросы по ним.
Инструмент позволяет получать подробные текстовые описания визуального контента и взаимодействовать с изображениями через диалог. Отлично подходит для задач компьютерного зрения, где требуется глубокое понимание сцены.
Источник: @HuggingModels, 24-04-2026