Circuito stampato e chip AI astratto per illustrare modello GLM-5.2

GLM-5.2 di Z.ai: un modello AI open-weight da 753 miliardi di parametri che batte GPT-5.5 nel coding a un sesto del costo

Z.ai (ex Zhipu AI) ha rilasciato GLM-5.2, un modello linguistico open-weight con 753 miliardi di parametri pensato per attività di coding e ingegneria su orizzonti temporali lunghi. Il modello è disponibile su Hugging Face, tramite API di Z.ai e in oltre 20 ambienti di sviluppo. Supporta un contesto fino a 1 milione di token con alta stabilità, e gli abbonamenti enterprise partono da 12,60 dollari al mese.

La novità principale è la licenza MIT, che permette di scaricare, modificare e far girare il modello localmente. Per le aziende attente a costi e sicurezza, questo significa bypassare le limitazioni geografiche dei modelli proprietari americani — un tema caldo dopo l’ultima direttiva dell’amministrazione Trump che ha bloccato l’uso di Claude Fable 5 da parte di cittadini non statunitensi, portando Anthropic a ritirare il modello.

Architettura IndexShare e nuovi Thinking Modes

Sotto il cofano, GLM-5.2 introduce IndexShare, un’ottimizzazione che riusa lo stesso indice ogni quattro strati di attenzione sparsa. Sul contesto massimo di 1 milione di token, questo taglia i FLOP per token del 2,9x. Il modello include anche un layer Multi-Token Prediction aggiornato, che aumenta la lunghezza dei token accettati fino al 20% durante l’inferenza.

Z.ai ha implementato Thinking Modes selezionabili: “Max” spinge al massimo il ragionamento ma consuma circa 85.000 token output per task; “High” sacrifica qualche punto percentuale in prestazioni ma dimezza i token necessari, ideale per applicazioni sensibili alla latenza.

Benchmark: supera GPT-5.5 e sfida Claude Opus 4.8

Nei test standardizzati, GLM-5.2 supera la maggior parte dei modelli open-source e si avvicina o batte i rivali a peso chiuso come GPT-5.5 e Claude Opus 4.8:

  • SWE-bench Pro: 62,1 (GPT-5.5: 58,6)
  • FrontierSWE: 74,4% (GPT-5.5: 72,6%; Claude Opus 4.8: 75,1%)
  • MCP-Atlas: 77,0 (GPT-5.5: 75,3)
  • Humanity’s Last Exam (con tool): 54,7 (GPT-5.5: 52,2)
  • PostTrainBench: 34,3% contro 25,0% di GPT-5.5
  • SWE-Marathon: 13,0% contro 12,0% di GPT-5.5
  • Design Arena: primo posto con ELO 1360, sopra Claude Fable 5

Piani Coding e prezzi API

Z.ai ha lanciato il GLM Coding Plan, pensato per workflow di sviluppo. Include supporto nativo per Claude Code, OpenClaw, Cline e altri harness. I prezzi annuali partono da:

  • Lite: 12,60 $/mese (151,20 $/anno dal secondo anno)
  • Pro: 50,40 $/mese
  • Max: 112,00 $/mese

L’API standard costa 1,40 $ per milione di token in input e 4,40 $ per milione di token in output. Rispetto ai rivali americani: GPT-5.5 costa 5 $ in input e 30 $ in output; Claude Opus 4.8 costa 5 $ e 25 $. Il tasso di input in cache scende a 0,26 $ per milione di token, con spazio di archiviazione gratuito a tempo limitato.

Articoli simili