
Falcon-Perception
Vision-language модель от TII UAE. Open-vocabulary segmentation: указываешь словами «red car», «person wearing a hat» — модель строит pixel-perfect маску.
Чем интересно: - Не ограничено фиксированным набором классов - Можно описать что угодно — модель попробует найти и сегментировать - Подходит для контент-модерации, робототехники, фото-редакторов, любых инструментов с визуальным пониманием