Z.ai apresenta GLM-5.2, novo modelo de código aberto com atenção eficiente em contextos longos
Z.ai apresentou o GLM-5.2, um modelo de código aberto que, segundo análises iniciais, representa o melhor modelo aberto disponível no mercado. A arquitetura baseia-se nas versões anteriores GLM-5 e GLM-5.1, incorporando mecanismos de atenção de latência multi-cabeça e a técnica de atenção esparsa adaptada da DeepSeek V3.2.
A inovação principal chama-se IndexShare, um mecanismo que reutiliza índices de atenção entre camadas sucessivas. Em vez de recalcular os índices de atenção esparsa em cada camada, o GLM-5.2 executa o cálculo completo apenas a cada quatro camadas, com as camadas intermédias a reutilizarem os índices já selecionados. Isto reduz significativamente o custo computacional para inferência com contextos de um milhão de tokens.
Nos benchmarks de codificação, o GLM-5.2 alcançou uma pontuação de 68,8 pontos no Artificial Analysis Coding Index, superando significativamente o Claude Opus 4.8 que obteve 56,7 pontos, uma diferença superior a dez pontos.