Juízes LLM reprovam em teste de confiabilidade pré-registrado
Modelos de linguagem hoje avaliam outros modelos de linguagem. Eles pontuam respostas, classificam traços de raciocínio, filtram dados de treinamento...
Modelos de linguagem hoje avaliam outros modelos de linguagem. Eles pontuam respostas, classificam traços de raciocínio, filtram dados de treinamento...
A DeepSeek publicou os pesos completos do DeepSeek-V4-Flash-Vision-Exp no Hugging Face sob licença MIT. O repositório foi criado em 31...
Uma técnica que ficou conhecida em 2025 por enganar assistentes de inteligência artificial acabou reaproveitada para um objetivo bem mais...
A SonicWall divulgou em 1º de setembro de 2026 duas vulnerabilidades nos appliances de acesso remoto SMA 1000 e confirmou,...
Um grupo de pesquisadores do Google Research e da Virginia Tech publicou em 27 de agosto de 2026, no repositório...
A equipe Qwen, do Alibaba, publicou em 26 de agosto de 2026 o Qwen3.8-Flash-Next, um modelo multimodal de mistura de...
A Sophos publicou em 27 de agosto de 2026 a sexta edição anual do relatório The State of Ransomware in...
A ServiceNow publicou em 27 de agosto de 2026 um aviso de segurança que corrige quatro vulnerabilidades na ServiceNow AI...
Um artigo submetido ao arXiv em 21 de agosto de 2026 e aceito para a conferência EMNLP 2026 aponta uma...
A Unit 42, divisão de pesquisa de ameaças da Palo Alto Networks, publicou em 20 de agosto de 2026 uma...