Categories: NOTÍCIAS EM GERAL

Encontrando falhas nos modelos de IA

As pesquisas sobre a segurança de inteligência artificial (IA) têm crescido nos últimos anos, e agora um estudo recente da McAfee Labs demonstrou que a capacidade de automatizar a descoberta de vulnerabilidades em modelos de IA está crescendo.

O estudo, intitulado “Texto oculto: como manipular modelos de processamento de linguagem natural para adulterar os resultados”, analisou 24 modelos de processamento de linguagem natural (NLP) de código aberto para identificar vulnerabilidades. Os modelos de NLP foram manipulados usando técnicas de “embedding”, que poderiam alterar o resultado final das análises do modelo em até 93,4%.

“As vulnerabilidades reveladas indicam que o design atual dos modelos de NLP não é seguro o suficiente para a maioria das aplicações. Os atacantes estão se aproveitando disso para tentar manipular os resultados dos modelos ”, disse Raj Samani, chefe cientista da McAfee.

Os pesquisadores também testaram os modelos de NLP e demonstraram que as técnicas de manipulação foram bem-sucedidas 52,3% do tempo, o que sugere que os ataques de enganação são possíveis.

Com a popularidade da inteligência artificial crescendo, os atacantes têm cada vez mais incentivos para manipular os modelos de IA para fins maliciosos. A McAfee recomenda que os desenvolvedores de modelos de IA:

• Projetem com segurança em mente

• Escalar a segurança para monitorar e responder aos ataques de adversários

• Ter um plano de contingência para lidar com falhas em seus sistemas

Ninja

Na cena de cybersecurity a mais de 25 anos, Ninja trabalha como evangelizador de segurança da informação no Brasil. Preocupado com a conscientização de segurança cibernética, a ideia inicial é conseguir expor um pouco para o publico Brasileiro do que acontece no mundo.

Next Ransomware e criptografia de dados aumentam »

Previous « A Estratégia de Segurança Cibernética de Kemba Walden é Bem Recebida

Published by

Ninja

3 anos ago

Encontrando falhas nos modelos de IA

Recent Posts

WhatsApp passa a exibir tela de aviso antes de conversas com números desconhecidos

Microsoft e Europol derrubam infraestrutura de StealC, Amadey e SocGholish em operação que tirou 326 servidores do ar

Gaslight: malware macOS norte-coreano usa prompt injection para enganar analistas que dependem de IA

UBS e Nethermind concluem PoCs que aplicam controles de compliance bancário diretamente na Ethereum pública

Vazamento na KDDI atinge 14,22 milhões de credenciais e seis ISPs do Japão após exploração de software de terceiros

Phishing direcionado contra Xsolis expõe dados médicos e Social Security de 1,4 milhão de pessoas nos EUA

Encontrando falhas nos modelos de IA

Related Post

Recent Posts

WhatsApp passa a exibir tela de aviso antes de conversas com números desconhecidos

Microsoft e Europol derrubam infraestrutura de StealC, Amadey e SocGholish em operação que tirou 326 servidores do ar

Gaslight: malware macOS norte-coreano usa prompt injection para enganar analistas que dependem de IA

UBS e Nethermind concluem PoCs que aplicam controles de compliance bancário diretamente na Ethereum pública

Vazamento na KDDI atinge 14,22 milhões de credenciais e seis ISPs do Japão após exploração de software de terceiros

Phishing direcionado contra Xsolis expõe dados médicos e Social Security de 1,4 milhão de pessoas nos EUA