@Yuchenj_UW

Выпуск

1 твитов

Автор выразил восторг по поводу DFlash 2 и технологии speculative decoding. Мечтает о дне, когда можно будет запускать модель на 1 триллион параметров локально на iPhone со скоростью 100 токенов/с.

Темы: DFlash 2 · Speculative decoding · Локальный инференс · Мобильные LLM

Ключевые твиты