← назад

alibaba_qwen — 28-05-2026

4 твитов за сутки. Qwen демонстрирует рекордную скорость инференса для агентов и укрепляет позиции в код-генерации, а также расширяет экосистему интеграций.

TokenSpeed оптимизация — модель Qwen3.5 достигла рекордных 580 tps для agentic-нагрузок на NVIDIA GPU благодаря FA4-оптимизации от @lightseekorg, @NVIDIAAI, Mooncake и @tri_dao; подробности реализации доступны в PyTorch blog post.

Интеграция с Hermes Agent — модель Qwen 3.7 Max теперь поддерживается в Hermes Agent от @NousResearch.

Снижение цен на Qoder — флагманская модель Qwen3.7-Max стала в два раза дешевле на платформе Qoder, с бесплатными 100 вызовами в день для новых пользователей.

Результаты Code ArenaQwen3.7-Max занял #4 в Code Arena (Frontend), сравнявшись с Claude Opus 4.6 и став лучшим среди китайских лабораторий, обойдя GLM-5.1.

Источники

qwen35