Springboards lanca Flint, LLM que ataca o groupthink dos modelos: 7 de 10 no NoveltyBench contra media de 2,88 dos rivais

2 meses ago

A startup australiana Springboards apresenta Flint, LLM treinado para gerar respostas realmente diferentes. Como funciona a entropia seletiva e onde…

PL 2338/2023 na reta final antes do recesso: o placar da regulacao de IA no Brasil as vesperas de agosto de 2026

2 meses ago

PL 2338/2023 corre contra o recesso de agosto. Veja o que esta pendente na Camara, o que ja foi decidido…

Gemini 3.5 Pro chega em 17 de julho com 2 milhoes de tokens e camada Deep Think – o que a reconstrucao do modelo revela

2 meses ago

Google DeepMind aposta em janela de 2 milhoes de tokens e camada Deep Think no Gemini 3.5 Pro, previsto para…

Adobe ColdFusion sob ataque: CVE-2026-48282 é explorada horas após patch e coloca 775 servidores em risco

2 meses ago

Adobe alerta para aplicação urgente do boletim APSB26-68: falha crítica de path traversal (CVSS 10) permite RCE sem interação de…

Bad Epoll (CVE-2026-46242): falha use-after-free no kernel Linux dá root em Linux e Android

2 meses ago

Nova falha de escalada de privilégios no kernel Linux permite que processo sem privilégios vire root em desktops, servidores e…

Documento judicial revela: FBI usou Windows Device ID para rastrear suposto operador do Scattered Spider

2 meses ago

Denúncia federal americana desvela como o identificador persistente da Microsoft ligou um alegado membro do Scattered Spider à invasão de…

OpenAI lanca GeneBench-Pro: benchmark de 129 problemas mostra que o melhor modelo do mundo ainda erra 70% das analises de biologia real

2 meses ago

Novo benchmark da OpenAI mede research taste em biologia computacional. GPT-5.6 Sol acerta 31,5%; Claude Opus 4.8 fica em 16%.…

DeepMind, Schmidt Sciences e ARIA colocam US$ 10 milhoes no maior desafio esquecido da IA: como fazer milhoes de agentes conviverem sem quebrar tudo

2 meses ago

Chamada 'Scaling AI Safety for a Multi-Agent World' distribui ate US$ 1M por projeto para pesquisa em seguranca de populacoes…

MIT ensina robos a ler nas entrelinhas: Masked IRL usa dois LLMs para transformar ordens vagas em plano de acao – com 5x menos demonstracao

2 meses ago

Nova abordagem do CSAIL, apresentada no ICRA 2026, usa um LLM para desambiguar instrucoes e outro para filtrar contexto. Robos…

Mamba-3 chega ao ICLR 2026: como o novo modelo de espaco de estados corta pela metade o tamanho do estado e ainda ganha em precisao

2 meses ago

Mamba-3 propoe recorrencia mais expressiva, atualizacao complexa e formulacao MIMO. Ganho de 0,6 a 1,2 ponto vs. Gated DeltaNet a…