Batizada de Stringlifier, a ferramenta foi escrita em Python e aproveita o aprendizado de máquina para diferenciar sequências de caracteres aleatórios de sequências de texto normais.
O projeto de código aberto deve ser útil ao analisar os logs de segurança e de aplicativo ou ao tentar descobrir credenciais que podem ter sido acidentalmente expostas.
Quer se trate de hashes, chaves de API, senhas geradas aleatoriamente ou outros tipos de strings aleatórias em código-fonte, logs ou arquivos de configuração, Stringlifier deve ajudar a identificá-los facilmente.
O código-fonte do Stringlifier foi publicado no repositório GitHub público da Adobe, mas a gigante do software também disponibilizou um pacote de instalação “pip” (instalador de pacote Python) com um modelo pré-treinado incluído.
A Adobe afirma que já usou a ferramenta para identificar strings aleatórias ao procurar anomalias em conjuntos de dados, além do utilitário de código aberto chamado Tripod .
A equipe usou várias abordagens para pré-processar e converter strings longas em forma numérica, mas essas abordagens encontraram um obstáculo ao encontrar strings aleatórias, interrompendo o algoritmo de agrupamento.
Substituindo todas as sequências de caracteres aleatórios por <RANDOM_STRING> , a equipe foi capaz de agrupar tipos semelhantes de linhas de comando mais facilmente, mesmo se eles empregassem hashes aleatórios em seus parâmetros.
“Esperamos que você ache o stringlifier útil. Todo o código-fonte está disponível no repositório GitHub da Adobe. Você também pode encontrar todos os nossos outros projetos de código aberto das equipes de segurança da Adobe nesse repositório. Estamos ansiosos para receber comentários e contribuições são sempre bem-vindas ”, observa Adobe.
A empresa também fornece informações sobre como começar a usar o Stringlifier, bem como sobre como os usuários podem treinar seus próprios modelos ao procurar detectar diferentes tipos de strings.
Fonte: https://www.securityweek.com/adobe-open-sources-tool-sanitizing-logs-detecting-exposed-credentials
Pesquisa com 1.131 usuários do Character.AI e 464 mil mensagens doadas encontrou associação entre uso…
Modelo de mistura de especialistas ativa 95 bilhões de parâmetros por token e traz rastros…
Relatório técnico da Microsoft com nove universidades descreve um runtime que mantém estado durável entre…
Injeção de SQL em campo de autocompletar levou invasores a compilar um kit Java como…
Microsoft rastreou mais de 250 domínios que só mostram a isca a quem parece usar…
Sistema agêntico da Unit 42 varreu 3.915 projetos em dois meses e reportou 14.090 falhas…