← назад

alibaba_qwen — 29-05-2026

1 твитов за сутки. Модель Qwen3.7-Max заняла третье место в новом бенчмарке для оценки агентных способностей в корпоративной среде.

Результаты ITBench-AA — модель Qwen3.7-Max заняла #3 в бенчмарке ITBench-AA, который оценивает работу моделей с реальными задачами enterprise-IT в агентном стиле.

Контекст бенчмаркаITBench-AA запущен Artificial Analysis и IBM Research как первая серия тестов для оценки моделей на задачах SRE, где передовые модели показывают результаты ниже 50%, включая диагностику инцидентов в Kubernetes по логам.

Источники