INTELIGENCIA ARTIFICIAL

Chain-of-thought em 2026: cinco prompts prontos que ainda entregam ganho real em modelos de raciocinio

Modelos de raciocinio pensam sozinhos, mas ainda respondem melhor com prompts bem estruturados. Cinco templates de chain-of-thought para copiar e…

1 mês ago

Anthropic e o J-lens: Claude teria um workspace silencioso interno que espelha uma das principais teorias da consciencia

Anthropic descreve um workspace silencioso dentro do Claude compativel com a Global Workspace Theory. O que isso significa para seguranca…

1 mês ago

Springboards lanca Flint, LLM que ataca o groupthink dos modelos: 7 de 10 no NoveltyBench contra media de 2,88 dos rivais

A startup australiana Springboards apresenta Flint, LLM treinado para gerar respostas realmente diferentes. Como funciona a entropia seletiva e onde…

1 mês ago

PL 2338/2023 na reta final antes do recesso: o placar da regulacao de IA no Brasil as vesperas de agosto de 2026

PL 2338/2023 corre contra o recesso de agosto. Veja o que esta pendente na Camara, o que ja foi decidido…

1 mês ago

Gemini 3.5 Pro chega em 17 de julho com 2 milhoes de tokens e camada Deep Think – o que a reconstrucao do modelo revela

Google DeepMind aposta em janela de 2 milhoes de tokens e camada Deep Think no Gemini 3.5 Pro, previsto para…

1 mês ago

OpenAI lanca GeneBench-Pro: benchmark de 129 problemas mostra que o melhor modelo do mundo ainda erra 70% das analises de biologia real

Novo benchmark da OpenAI mede research taste em biologia computacional. GPT-5.6 Sol acerta 31,5%; Claude Opus 4.8 fica em 16%.…

1 mês ago

DeepMind, Schmidt Sciences e ARIA colocam US$ 10 milhoes no maior desafio esquecido da IA: como fazer milhoes de agentes conviverem sem quebrar tudo

Chamada 'Scaling AI Safety for a Multi-Agent World' distribui ate US$ 1M por projeto para pesquisa em seguranca de populacoes…

1 mês ago

MIT ensina robos a ler nas entrelinhas: Masked IRL usa dois LLMs para transformar ordens vagas em plano de acao – com 5x menos demonstracao

Nova abordagem do CSAIL, apresentada no ICRA 2026, usa um LLM para desambiguar instrucoes e outro para filtrar contexto. Robos…

1 mês ago

Mamba-3 chega ao ICLR 2026: como o novo modelo de espaco de estados corta pela metade o tamanho do estado e ainda ganha em precisao

Mamba-3 propoe recorrencia mais expressiva, atualizacao complexa e formulacao MIMO. Ganho de 0,6 a 1,2 ponto vs. Gated DeltaNet a…

1 mês ago

Data centers de IA rumo aos 950 TWh: novo relatorio da IEA mostra a conta de energia que a Inteligencia Artificial vai cobrar ate 2030

IEA revisa projecao: data centers vao consumir 950 TWh ate 2030, quase o dobro de 2025. IA e o motor…

1 mês ago