@DeepLearn007

Выпуск

8 твитов

День аккаунта был полностью посвящён выходу DeepSeek V4.1 и V4.1 Flash. Основной акцент — на агрессивно низкой стоимости API (около 2.5% от стоимости Opus 5) при конкурентоспособной производительности. Также обсуждалась архитектура модели (552B backbone, но только 8–16B активных параметров на токен) и упоминалась модель GLM 5.3, которая якобы снижает стоимость задачи на 99%. Отдельно отмечен потенциал подобных эффективных моделей для физического ИИ на устройствах.

Темы: DeepSeek V4.1 Flash · Снижение стоимости API · Эффективная архитектура · GLM 5.3 · Физический ИИ на устройствах

Ключевые твиты