alibaba_qwen — 29-05-2026
1 твитов за сутки. Модель Qwen3.7-Max заняла третье место в новом бенчмарке для оценки агентных способностей в корпоративной среде.
Результаты ITBench-AA — модель Qwen3.7-Max заняла #3 в бенчмарке ITBench-AA, который оценивает работу моделей с реальными задачами enterprise-IT в агентном стиле.
Контекст бенчмарка — ITBench-AA запущен Artificial Analysis и IBM Research как первая серия тестов для оценки моделей на задачах SRE, где передовые модели показывают результаты ниже 50%, включая диагностику инцидентов в Kubernetes по логам.