@ollama
Ollama сообщил, что DeepSeek-V4-Flash-0731 стал самым быстрорастущим по использованию токенов моделью на платформе. Компания масштабирует мощности в США и Европе и заявляет производительность свыше 100 токенов в секунду при нулевом хранении данных. Также опубликована страница модели.