raciocínio de longo horizonte

Argus: runtime de agentes de IA atinge 78% no SWE-Bench Pro

Relatório técnico da Microsoft com nove universidades descreve um runtime que mantém estado durável entre missões e só admite aprendizado…

3 horas ago