MiniMax svela i dettagli di M3: nuova attenzione sparsa e prestazioni fino a 15.6x su contesti lunghi
MiniMax ha pubblicato il report tecnico della serie M2 e anticipato M3, con una nuova architettura di attenzione sparsa che promette un boost di velocità fino a 15.6x su contesti di 1 milione di token.
