INTELIGENCIA ARTIFICIAL

Local-First AI Inference: o padrão de arquitetura que cortou 75% do custo de API em 4.700 PDFs

Padrão Local-First AI Inference combina extração local determinística com LLM em nuvem e revisão humana — corte de 75% no…

2 meses ago

Eles pediram, e a IA da Meta entregou contas do Instagram: o ataque que expõe a fragilidade dos agentes

Hackers usaram a IA de suporte da Meta para trocar e-mails de contas-alvo no Instagram. O caso expõe um padrão…

2 meses ago

Prometheus, da Majestic Labs: o servidor de 128 TB que quer derrubar o memory wall da IA

A Majestic Labs lançou o Prometheus, servidor com 128 TB de LPDDR6 e chips Ignite, que promete substituir 10 racks…

2 meses ago

150 mil demissões com IA como motivo em 2026: o que o número diz — e o que isso muda no Brasil

Mais de 150 mil demissões em 2026 já foram atribuídas à IA, com cortes da Block, Cisco e Baker McKenzie.…

2 meses ago

Agentes de IA que agem sem ser chamados: Writer lança gatilhos por evento e mira Microsoft, Salesforce e Amazon

A Writer abriu gatilhos por evento: agentes monitoram Gmail, Slack e Gong e executam tarefas sem prompt. Veja como isso…

2 meses ago

Agentes preguiçosos: o vício escondido dos sistemas multi-LLM e o método que tenta forçar deliberação

Pesquisadores mostram que sistemas multi-agente de LLM colapsam em um único agente dominante. O paper propõe uma recompensa de deliberação…

2 meses ago

Voxtral TTS: a Mistral abre voz sintética em 9 idiomas com clonagem em 3 segundos

Mistral lança Voxtral TTS open source com 9 idiomas, latência de 70 ms e clonagem em 3 segundos. Veja oportunidades,…

2 meses ago

Papers with Code está de volta — agora com agentes de IA e parceria com a Meta

Niels Rogge (Hugging Face) e Meta AI relançam o Papers with Code com agentes de IA e curadoria humana. Veja…

2 meses ago

Como dividir um LLM em dois: o passo a passo de prefill-decode disaggregation

Cloudflare separa prefill e decode de LLMs em servidores distintos e ganha 3x em latência. Veja como funciona e como…

2 meses ago

Gemma 4 12B: o modelo multimodal sem encoders que roda local em 16 GB

Gemma 4 12B é multimodal, sem encoders e roda local com 16 GB de VRAM. Veja como funciona, onde usar…

2 meses ago