@atomic_chat_hq

Выпуск

2 твитов

Atomic Chat сообщил о запуске локального запуска Meta Muse Glimmer 30B на 16 ГБ VRAM с собственными GGUF-квантованиями. В качестве примера заявлена скорость 62 токена/с на RTX 4080 для AD-IQ3_XXS, а также поддержка vision и DFlash. Аккаунт также дал ссылки на GGUF-кванты и приложение Atomic Chat.

Темы: локальный ИИ · GGUF-кванты · Muse Glimmer · производительность GPU

Ключевые твиты