Qual ataque baseado em prompt revela especificamente o comportamento configurado do modelo ou o modelo de prompt subjacente?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Extraindo o modelo de prompt.
Por que esta é a resposta
A extração do modelo de prompt é um ataque onde o invasor tenta obter informações sobre o prompt original ou a configuração interna do modelo. Isso pode revelar detalhes sobre como o modelo foi instruído a se comportar, suas restrições ou até mesmo dados sensíveis usados em seu treinamento. As trocas de persona solicitadas e a exploração da amizade e confiança são técnicas de engenharia social que visam manipular o modelo para gerar respostas específicas, mas não focam na revelação do prompt subjacente. Ignorar o modelo de prompt é uma forma de jailbreaking, onde o objetivo é fazer com que o modelo desobedeça suas instruções, mas não necessariamente extrair o prompt em si.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão