MiniMax M3: attenzione sparsa e 15,6x di velocità nel decoding per contesti ultra-lunghi
MiniMax ha pubblicato il report tecnico del modello M2 e anticipato l’M3 con una nuova attenzione sparsa che promette un boost fino a 15,6x nel decoding su un milione di token.
