Pesquisadores da Universidade Tsinghua propõem treinar o resumo de contexto como parte da política do agente, em vez de tratá-lo…
GLM-5.2 chega com 744B MoE, 1M de contexto, 62,1 no SWE-Bench Pro e licenca MIT - e faz mais barato…
Grok 4.5 chega com foco em código e agentes: 15.954 tokens médios em SWE-Bench Pro contra 67.020 do Opus 4.8,…