INTELIGENCIA ARTIFICIAL

Holo 3.1: o agente computer-use que roda local em 12 GB de VRAM e marca 74% no OSWorld

Holo 3.1, da H Company, chega com 4 tamanhos, function calling nativo e quantizações para rodar local — 74,2% no…

3 meses ago

MatterChat: a IA multimodal da Berkeley que dá “olhos científicos” aos LLMs para descobrir materiais

MatterChat, publicado na Nature Machine Intelligence, une LLM e potencial interatômico para prever propriedades de materiais e explicar o raciocínio.

3 meses ago

Comunicações da ACM: 800 projetos de lei de IA nos estados dos EUA — e o que o Brasil pode aprender com a colcha de retalhos

Estudo na CACM analisa 800+ projetos estaduais de IA nos EUA desde 2019, com destaque para SB 53 da Califórnia,…

3 meses ago

Databricks lança Genie One: o agente que cruza dados internos, Slack e Office com cobrança por token

Databricks Genie One conecta Slack, Jira, SharePoint, Google Drive e mais 50 apps via Genie Ontology e cobra por tokens…

3 meses ago

SyntheMol-RL: a IA generativa que desenhou um antibiótico novo contra Staphylococcus resistente

Pesquisadores criam SyntheMol-RL, IA generativa que explorou 46 bilhões de compostos e gerou synthecin, antibiótico eficaz contra Staphylococcus resistente.

3 meses ago

Muse Spark: o primeiro modelo dos Superintelligence Labs da Meta chega pequeno, rápido e com ambição enorme

Meta libera Muse Spark, primeiro modelo dos Superintelligence Labs liderados por Alexandr Wang; aposta de US$ 115-135 bi em capex…

3 meses ago

DeepMind publica AI Control Roadmap: 15 defesas para quando o alinhamento de agentes de IA falhar

DeepMind lança em junho de 2026 o AI Control Roadmap com 15 defesas em camadas — abordagem que trata agentes…

3 meses ago

Nature Machine Intelligence: nova métrica “unfamiliarity” mostra quando o ML pode ser confiável na descoberta de fármacos

Nova métrica publicada na Nature Machine Intelligence mede quando um modelo de ML molecular está extrapolando — e foi validada…

3 meses ago

ClinHallu: o benchmark que disseca onde a IA médica alucina — e como aplicar isso em modelos no Brasil

Pesquisadores do Alibaba DAMO apresentam o ClinHallu, benchmark que separa erros de visão, conhecimento e raciocínio em IA médica. Saiba…

3 meses ago

Natural Language Autoencoders: como a Anthropic está fazendo Claude traduzir seus próprios pensamentos

A Anthropic apresentou os Natural Language Autoencoders, técnica que traduz ativações internas do Claude em texto humano. Entenda como funciona,…

3 meses ago