qwen

Qwen3.8: Alibaba libera pesos abertos de modelo de 2,4 tri

Os pesos do modelo de 2,4 trilhões de parâmetros foram publicados no Hugging Face sob licença própria, sem restrição geográfica…

1 semana ago

SkillProx audita e poda skills de agentes de IA sem treinar pesos

Pesquisadores de Hong Kong propõem medir a utilidade de cada instrução acumulada em uma skill e remover o que não…

2 semanas ago

Qwen3.8-Max: Alibaba promete abrir pesos de modelo de 2,4 tri

Modelo de mistura de especialistas ativa 95 bilhões de parâmetros por token e traz rastros públicos de execuções autônomas de…

2 semanas ago

Springboards lanca Flint, LLM que ataca o groupthink dos modelos: 7 de 10 no NoveltyBench contra media de 2,88 dos rivais

A startup australiana Springboards apresenta Flint, LLM treinado para gerar respostas realmente diferentes. Como funciona a entropia seletiva e onde…

2 meses ago