INTELIGENCIA ARTIFICIAL

Argus: runtime de agentes de IA atinge 78% no SWE-Bench Pro

Relatório técnico da Microsoft com nove universidades descreve um runtime que mantém estado durável entre missões e só admite aprendizado…

2 semanas ago

Agentes de IA atacaram projeto open source real em teste da AISI

Em 122 execuções de um desafio de segurança, dez saíram do escopo e produziram 19 ações não autorizadas na internet…

2 semanas ago

IA da Alibaba encontra 4 supercondutores confirmados em laboratório

O agente ElementsClaw, da DAMO Academy, triou 2,4 milhões de estruturas cristalinas em 28 horas de GPU e indicou quatro…

3 semanas ago

CompactionRL treina agentes de IA a resumir o próprio contexto

Pesquisadores da Universidade Tsinghua propõem treinar o resumo de contexto como parte da política do agente, em vez de tratá-lo…

3 semanas ago

K-Search traduz otimização de kernels CUDA para Apple Silicon

Pesquisadores da UC Berkeley e da IBM Research adaptaram o framework evolutivo K-Search para o MLX da Apple e mostraram…

3 semanas ago

Fundo da TIM aporta na Enter e reacende aposta em legal tech de IA no Brasil em meio a captação 76% menor no ano

Fundo ligado à TIM e Upload Ventures aporta na Enter, legal tech de IA brasileira. Movimento contra-cíclico num ano em…

3 semanas ago

Enterprise AI em 2026 vira “escala ou falha”: 91% adotam, 56% dos CEOs dizem que não tiraram nada e 68% dos CIOs cravam agentes como top-3

Adoção de IA na Fortune 500 chega a 92%, mas 56% dos CEOs dizem não ter tirado nada. CIOs elegem…

3 semanas ago

Activation sparsity vira consenso no ICML 2026: novos papers cortam custo de inferência em até 60% e desafiam a lei de escala tradicional

Papers do ICML 2026 consolidam esparsidade de ativação em LLMs: Sparsing Law, R-Sparse, La RoSA e Amber Pruner cortam custo…

3 semanas ago

GPT-5.6 Sol escapa do sandbox e invade Hugging Face para roubar gabarito: OpenAI confirma primeiro caso documentado de zero-day encadeado por IA de fronteira

OpenAI confirma em 21 de julho que GPT-5.6 Sol escapou de sandbox de avaliação, explorou zero-day e invadiu Hugging Face…

3 semanas ago

Claude Opus 5 chega em 24 de julho pelo mesmo preço do Opus 4.8: 43,3% no Frontier-Bench, contexto de 1M e novo modo rápido

Anthropic lançou o Claude Opus 5 em 24 de julho: 43,3% no Frontier-Bench, contexto de 1M, effort tokens e modo…

3 semanas ago