Em vez de gastar centenas de tokens de raciocínio a cada consulta, o Google treina uma vez com aprendizado por…
A Alibaba liberou sob licença Apache 2.0 um modelo de visão e linguagem voltado a veículos autônomos, que une percepção…
Modelo multimodal com 125 bilhões de parâmetros e apenas 6 bilhões ativados por token traz atenção esparsa por microblocos, residual…
Os pesos do modelo de 2,4 trilhões de parâmetros foram publicados no Hugging Face sob licença própria, sem restrição geográfica…
Pesquisadores de Hong Kong propõem medir a utilidade de cada instrução acumulada em uma skill e remover o que não…
Modelo de mistura de especialistas ativa 95 bilhões de parâmetros por token e traz rastros públicos de execuções autônomas de…
A startup australiana Springboards apresenta Flint, LLM treinado para gerar respostas realmente diferentes. Como funciona a entropia seletiva e onde…