llm

Juízes LLM reprovam em teste de confiabilidade pré-registrado

Duas campanhas pré-registradas de pesquisadores britânicos pararam antes da pergunta central: o instrumento de medição não passou na validação. Em…

1 semana ago

Privacidade personalizada: LLMs ignoram regras do usuário

Estudo do IPAI da Universidade Nacional de Seul mede quanto modelos abertos desrespeitam políticas de divulgação declaradas pelo usuário e…

3 semanas ago

IO Factory simula campanhas de influência com agentes de IA

Framework criado por pesquisadores europeus e asiáticos executa ciclos completos de campanha em plataforma simulada, com até 100 mil agentes,…

1 mês ago

Atacantes burlam guardrails de IA com frases simples, diz Talos

Pesquisadores recuperaram registros de conversas com assistentes de IA em máquinas de criminosos. Os casos vão de um operador de…

1 mês ago

Subquadratic SubQ: sparse attention entrega 12M tokens de contexto e corte de custo de US$ 2.600 para US$ 8 no RULER 128

Startup Subquadratic diz ter derrubado o gargalo da attention quadrática dos LLMs: 12M tokens, 56x mais rápido, custo 300x menor.…

2 meses ago

Agente LLM opera sincrotron sozinho e alinha cristais em experimento real: como funciona o AI X-ray Scientist da Nature Machine Intelligence

Publicado na Nature Machine Intelligence em julho: agente baseado em LLM planeja, executa e interpreta um experimento inteiro de difração…

2 meses ago

HalluSquatting: pesquisadores transformam alucinacoes de LLMs em vetor de infeccao para botnets agentic

Equipe da Tel Aviv, Technion e Intuit mostra como pre-registrar nomes de pacotes hallucinados pelos LLMs permite execucao remota de…

2 meses ago

Estudo encontra credenciais expostas em 282 apps de iOS com integração LLM e revela falha sistêmica do ecossistema

Pesquisadores da Wake Forest University analisaram 444 aplicativos iOS com funcionalidade LLM e identificaram 282 com tokens, chaves de API…

3 meses ago

Como tornar o Microsoft Copilot uma arma contra ciberataques

Na Black Hat USA, o pesquisador de segurança Michael Bargury lançou um módulo de hacking ético "LOLCopilot" para demonstrar como…

2 anos ago