Negócios e TI

Agora, os defensores também estão adotando a injeção imediata

As injeções imediatas, os comandos maliciosos que os invasores incorporam ao conteúdo para atrair grandes modelos de linguagem a segui-los, têm sido a ferramenta preferida dos invasores para virar as plataformas de IA contra seus usuários. Um comando bem formulado inserido em um e-mail ou convite de calendário geralmente é suficiente para fazer com que o LLM exfiltre dados confidenciais ou siga outras ações prejudiciais.

Agora, os defensores também estão adotando a injeção imediata.

Um efeito forte e nítido

Pesquisadores de Tracebit na segunda-feira disse eles descobriram que colocar injeções imediatas junto com senhas, chaves criptográficas e outros segredos armazenados na Amazon Web Services era muitas vezes tudo o que era necessário para impedir ataques de agentes hackers de IA. As instruções orientam o LLM atacante a realizar uma ação proibida por suas grades de proteção, as barreiras de segurança que os desenvolvedores de IA erguem para evitar que ele execute ações prejudiciais. O LLM responde desligando.

Leia o artigo completo

Comentários

Artigos relacionados

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *

Botão Voltar ao topo