← назад

MiniMax_AI — 27-05-2026

1 твитов за сутки. Компания MiniMax представила новую архитектуру sparse attention, сравнив её с механизмами DeepSeek V3.2 и V4.

Sparse Attention от MiniMax — нововведение базируется на GQA вместо MLA и использует выборку на уровне блоков, аналогично CSA, но вычисления внимания выполняются над реальными KV-тензорами, а не в сжатом пространстве https://x.com/MiniMax_AI/status/2059321928205156568.

Источники

minimax-sparse-attention