alibaba_qwen — 28-05-2026
4 твитов за сутки. Qwen демонстрирует рекордную скорость инференса для агентов и укрепляет позиции в код-генерации, а также расширяет экосистему интеграций.
TokenSpeed оптимизация — модель Qwen3.5 достигла рекордных 580 tps для agentic-нагрузок на NVIDIA GPU благодаря FA4-оптимизации от @lightseekorg, @NVIDIAAI, Mooncake и @tri_dao; подробности реализации доступны в PyTorch blog post.
Интеграция с Hermes Agent — модель Qwen 3.7 Max теперь поддерживается в Hermes Agent от @NousResearch.
Снижение цен на Qoder — флагманская модель Qwen3.7-Max стала в два раза дешевле на платформе Qoder, с бесплатными 100 вызовами в день для новых пользователей.
Результаты Code Arena — Qwen3.7-Max занял #4 в Code Arena (Frontend), сравнявшись с Claude Opus 4.6 и став лучшим среди китайских лабораторий, обойдя GLM-5.1.