atomicbot_ai — 21-05-2026
2 твитов за сутки. Atomic Chat получил значительное ускорение генерации за счёт MTP, а также открыл бесплатный доступ к новому Gemini 3.5 Flash.
MTP speedup Qwen — в Atomic Chat реализовано ускорение Qwen на 2.5x благодаря Multi-Token Prediction (MTP), который чередует генерацию черновиков и их верификацию в один проход. На 2x RTX 5090 Qwen3.6 27B (dense) выросла с 51 до 117 tps (+137%), а Qwen3.6 35B-A3B (MoE) — с 218 до 267 tps (+25%). Ускорение плотных моделей выше, так как они ограничены пропускной способностью памяти и выигрывают от батчинга, тогда как MoE уже имеет высокий базовый уровень за счёт чтения только активных параметров (~3B против 27B). При ~80% принятии черновиков и нулевой потере точности требуется всего ~1 GB дополнительной VRAM. Open-source code and local AI app доступны в комментариях.
Gemini 3.5 Flash free — Google анонсировала выход Gemini 3.5 Flash, а Atomic Bot предлагает использовать её бесплатно через свой API в течение 24 часов. Инструкции по настройке для подключения к API опубликованы в твите.