Juízes LLM reprovam em teste de confiabilidade pré-registrado
Modelos de linguagem hoje avaliam outros modelos de linguagem. Eles pontuam respostas, classificam traços de raciocínio, filtram dados de treinamento...
Modelos de linguagem hoje avaliam outros modelos de linguagem. Eles pontuam respostas, classificam traços de raciocínio, filtram dados de treinamento...
Um artigo submetido ao arXiv em 21 de agosto de 2026 e aceito para a conferência EMNLP 2026 aponta uma...
Um grupo internacional de pesquisadores publicou em 11 de agosto de 2026, no repositório arXiv, o artigo que apresenta o...
A equipe de inteligência de ameaças Cisco Talos publicou em 4 de agosto de 2026 uma análise incomum sobre o...
Resumo: A startup americana Subquadratic saiu do stealth em maio prometendo derrubar o gargalo matemático que segura os LLMs desde...
Ilustração: Plugged Ninja. Fonte do estudo: Nature Machine Intelligence — 'An agentic artificially intelligent X-ray scientist' (Chen et al., 2026)....
Pesquisadores da Universidade de Tel Aviv, do Technion e da Intuit demonstraram uma nova classe de ataque chamada HalluSquatting, que...
Pesquisadores da Wake Forest University publicaram um levantamento abrangente sobre vazamento de credenciais em aplicativos iOS com integração a modelos...
BLACK HAT USA – Las Vegas – Quinta-feira, 8 de agosto – As empresas estão implementando os chatbots baseados em IA...