qwen

Google troca raciocínio por difusão para acelerar busca com IA

Em vez de gastar centenas de tokens de raciocínio a cada consulta, o Google treina uma vez com aprendizado por…

3 semanas ago

Qwen-Drive 1.0: modelo aberto para direção autônoma

A Alibaba liberou sob licença Apache 2.0 um modelo de visão e linguagem voltado a veículos autônomos, que une percepção…

1 mês ago

Qwen3.8-Flash-Next antecipa a arquitetura da série Qwen4

Modelo multimodal com 125 bilhões de parâmetros e apenas 6 bilhões ativados por token traz atenção esparsa por microblocos, residual…

1 mês ago

Qwen3.8: Alibaba libera pesos abertos de modelo de 2,4 tri

Os pesos do modelo de 2,4 trilhões de parâmetros foram publicados no Hugging Face sob licença própria, sem restrição geográfica…

2 meses ago

SkillProx audita e poda skills de agentes de IA sem treinar pesos

Pesquisadores de Hong Kong propõem medir a utilidade de cada instrução acumulada em uma skill e remover o que não…

2 meses ago

Qwen3.8-Max: Alibaba promete abrir pesos de modelo de 2,4 tri

Modelo de mistura de especialistas ativa 95 bilhões de parâmetros por token e traz rastros públicos de execuções autônomas de…

2 meses ago

Springboards lanca Flint, LLM que ataca o groupthink dos modelos: 7 de 10 no NoveltyBench contra media de 2,88 dos rivais

A startup australiana Springboards apresenta Flint, LLM treinado para gerar respostas realmente diferentes. Como funciona a entropia seletiva e onde…

3 meses ago