moe

Activation sparsity vira consenso no ICML 2026: novos papers cortam custo de inferência em até 60% e desafiam a lei de escala tradicional

Papers do ICML 2026 consolidam esparsidade de ativação em LLMs: Sparsing Law, R-Sparse, La RoSA e Amber Pruner cortam custo…

1 mês ago

GLM-5.2: Z.ai libera modelo open-weights de 744B com licenca MIT e passa GPT-5.5 em codificacao por 1/6 do custo

GLM-5.2 chega com 744B MoE, 1M de contexto, 62,1 no SWE-Bench Pro e licenca MIT - e faz mais barato…

2 meses ago