Pesquisadores do SRI International e do MIT Media Lab descrevem como modelos podem coordenar decisões por estados internos invisíveis na…
Pesquisadores da UFSC rodaram 56.476 inferências variando o limite de tokens e mostraram que a ordem de classificação entre modelos…
Framework criado por pesquisadores europeus e asiáticos executa ciclos completos de campanha em plataforma simulada, com até 100 mil agentes,…
O framework ABBEL faz o agente manter uma descrição explícita do que sabe e decidir só a partir dela. O…
Pesquisadores de Hong Kong propõem medir a utilidade de cada instrução acumulada em uma skill e remover o que não…
Relatório técnico da Microsoft com nove universidades descreve um runtime que mantém estado durável entre missões e só admite aprendizado…
Papers do ICML 2026 consolidam esparsidade de ativação em LLMs: Sparsing Law, R-Sparse, La RoSA e Amber Pruner cortam custo…
Benchmark dinâmico WorldCupArena mede 13 modelos de IA em previsões pré-jogo da Copa 2026 em placar, jogadores, estatísticas e campeão…
SEED, publicado no arXiv em 16 de julho de 2026, ensina agentes de IA a extrair habilidades das proprias trajetorias…
ROMA da Sentient AGI usa decomposição recursiva com Atomizer/Planner/Executor/Aggregator e supera baselines em SEAL-0, FRAMES e EQ-Bench.