DeepSeek V4.1-Flash abre pesos e corta o cache KV em 4 vezes
A DeepSeek publicou em 10 de setembro de 2026 os pesos abertos do DeepSeek-V4.1-Flash, um modelo multimodal de mistura de...
A DeepSeek publicou em 10 de setembro de 2026 os pesos abertos do DeepSeek-V4.1-Flash, um modelo multimodal de mistura de...
Uma colaboração entre o campus de pesquisa Janelia, do Howard Hughes Medical Institute (HHMI), o Laboratório de Biologia Molecular do...
A equipe Qwen, da Alibaba, publicou em 2 de setembro de 2026 o Qwen-Drive 1.0, um modelo de visão e...
Modelos de linguagem hoje avaliam outros modelos de linguagem. Eles pontuam respostas, classificam traços de raciocínio, filtram dados de treinamento...
A DeepSeek publicou os pesos completos do DeepSeek-V4-Flash-Vision-Exp no Hugging Face sob licença MIT. O repositório foi criado em 31...
Um grupo de pesquisadores do Google Research e da Virginia Tech publicou em 27 de agosto de 2026, no repositório...
A equipe Qwen, do Alibaba, publicou em 26 de agosto de 2026 o Qwen3.8-Flash-Next, um modelo multimodal de mistura de...
Um artigo submetido ao arXiv em 21 de agosto de 2026 e aceito para a conferência EMNLP 2026 aponta uma...
A DeepSeek publicou em 13 de agosto de 2026, no Hugging Face, os pesos do DeepSeek V4-Pro em sua versão...
Quando dois modelos de linguagem trocam mensagens em texto, existe um registro que alguém pode auditar. Um artigo publicado no...