MiniMax_AI — 27-05-2026
1 твитов за сутки. Компания MiniMax представила новую архитектуру sparse attention, сравнив её с механизмами DeepSeek V3.2 и V4.
Sparse Attention от MiniMax — нововведение базируется на GQA вместо MLA и использует выборку на уровне блоков, аналогично CSA, но вычисления внимания выполняются над реальными KV-тензорами, а не в сжатом пространстве https://x.com/MiniMax_AI/status/2059321928205156568.