Papers with Code está de volta — agora com agentes de IA e parceria com a Meta

Resumo: O Papers with Code, referência de leaderboards e código aberto para papers de machine learning, voltou em 2026 sob nova liderança. O projeto é tocado por Niels Rogge (Hugging Face), em parceria com a Meta AI e os criadores originais, Robert Stojnic e Ross Taylor. A nova versão usa agentes de IA para varrer papers em escala, com verificação humana. Veja o que muda para pesquisadores, engenheiros e quem usa benchmarks no dia a dia.

Por que isso é notícia

O Papers with Code original foi descontinuado depois da aquisição pela Meta. Para a comunidade, perder a interseção entre paper, código e leaderboard foi um baque — boa parte da prática de ML depende de comparar reivindicações em condições iguais. A nova encarnação no domínio paperswithcode.co retoma o formato clássico: tabelas de benchmark, métricas, papers e código vinculado.

O que mudou em 2026

A reconstrução foi feita do zero com uso intensivo de agentes de IA para parsear papers — alimentando leaderboards automaticamente — e com curadoria humana para corrigir resultados antes da publicação. Em paralelo, Niels Rogge documentou no Hugging Face como sua equipe usou OpenAI Codex + modelos OCR abertos para processar cerca de 30.000 papers via Jobs do Hub, mostrando que a abordagem é replicável.

As novidades funcionais incluem suporte a múltiplas métricas por leaderboard (não só uma “metric of record”), categorias mais ricas e integração com cards de modelo no Hugging Face.

Por que importa

Três motivos.

  • Reprodutibilidade: benchmarks comparáveis evitam que cada paper invente sua própria régua. Sem isso, o ritmo de progresso fica turvo.
  • Engenharia: quando você procura “modelo SOTA para OCR em recibos”, quer ir direto ao código que funciona, não pular entre 20 PDFs.
  • Comunidade aberta: a base é mantida em parceria com a Meta e está aberta a contribuições — uma rota saudável depois de anos em que serviços comunitários sumiam ou viravam pagos.

Status no Brasil

Para grupos brasileiros de pesquisa (USP, UFMG, Unicamp, IF-USP, ITA, e laboratórios de empresas como Itaú, Embraer e Petrobras) o impacto é direto: voltar a publicar resultados com código vinculado em uma vitrine internacional reduz fricção de divulgação e abre porta para citações. Para engenheiros de ML em empresas brasileiras, o site retoma o papel de “primeira parada” antes de escolher arquitetura.

O lado prático: incluir o link do código no submetido conta. Estudos recentes mostram que papers de ML com código público ganham mais citações e atravessam melhor para a indústria.

Limitações

Resultados gerados por agente sem revisão humana podem trazer leaderboards bonitos e errados — métrica mal lida, conjunto de teste invertido, treino em dados de avaliação. A nova equipe sinaliza verificação humana, mas em escala de 30 mil papers o erro residual existe. Para tomar decisões importantes (concessão de bolsa, contratação, escolha de arquitetura em produção) vale sempre conferir o paper original e a release do código.

Cenário

O movimento mostra duas tendências combinadas: (1) infraestrutura científica viabilizada por agentes — não apenas no Papers with Code, mas em workflows de revisão por pares, replicação de experimentos e curadoria de datasets; (2) poder de plataforma migrando para hubs abertos — Hugging Face, ArXiv, e iniciativas comunitárias têm se tornado a infraestrutura padrão, no lugar de produtos fechados.

Conclusão prática

Se você publica em ML, plante código e dados no Hugging Face e linke no Papers with Code — sua reputação ganha tração. Se você é engenheiro, comece a sua próxima busca por SOTA no novo Papers with Code e confira se a métrica que você vai usar na produção (não só a do leaderboard) está no mesmo registro. Para o Brasil, é uma janela para reposicionar grupos de pesquisa e startups de IA no mapa global.

Fonte internacional de referência: Hugging Face — Relaunching PapersWithCode with new features e Papers with Code.

Ninja

Na cena de cybersecurity a mais de 25 anos, Ninja trabalha como evangelizador de segurança da informação no Brasil. Preocupado com a conscientização de segurança cibernética, a ideia inicial é conseguir expor um pouco para o publico Brasileiro do que acontece no mundo.

Recent Posts

DeepSeek V4-Pro 0813 chega com licença MIT e foco em agentes

A versão oficial do V4-Pro traz módulo de decodificação especulativa, contexto de mais de um…

16 horas ago

Agentes de IA podem combinar ações fora do registro público

Pesquisadores do SRI International e do MIT Media Lab descrevem como modelos podem coordenar decisões…

16 horas ago

Algoritmo do X amplifica o que contraria os valores do usuário

Estudo publicado na PNAS mediu o desalinhamento entre valores declarados por 715 usuários e o…

16 horas ago

MacSync Stealer: Microsoft liga mais de 30 domínios à campanha

A Microsoft mostrou que padrões de execução, formato de requisição e parâmetros de upload permanecem…

16 horas ago

Falha crítica no MLflow é explorada e entra no KEV da CISA

A CVE-2026-64849 permite que um atacante sem autenticação faça o servidor do MLflow buscar e…

16 horas ago

Falsas ferramentas de IA lideram ataques mapeados pela Sophos

Revisão de doze meses de casos de resposta a incidentes da Sophos mostra que a…

16 horas ago