Questão 58 — SK0-005 CompTIA Server+ Simulado Online Grátis
Um chatbot voltado para o cliente e alimentado por IA foi desbloqueado por meio de injeções imediatas. Com isso, o modelo AI oferece desconto de 99% na compra de um veículo novo. Qual das opções a seguir deve ser implementada para aumentar a robustez do modelo contra tais ataques?
- A. Filtragem de polarização
- B. Prompt do sistema
- C. Monitoramento de log
- D. Guardrails
Resposta correta:
D
Explicação
Explicação: Conceito Básico: O jailbreak por meio de injeção imediata explora a tendência do LLM de seguir instruções incorporadas na entrada do usuário, substituindo o comportamento pretendido. O modelo foi manipulado para oferecer descontos não autorizados, demonstrando que os seus limites operacionais não foram devidamente aplicados. O Guia de Estudo CompTIA SecAI+ identifica as proteções como a principal defesa contra ataques de jailbreak. Por que D está correto: Guardrails são controles robustos e em camadas que impõem limites comportamentais nas entradas e saídas do LLM. Eles podem detectar e bloquear tentativas de jailbreak, impor restrições de lógica de negócios, como impedir descontos não autorizados, validar resultados em relação às regras de política antes da entrega e impedir que o modelo opere fora do escopo definido. Os Guardrails são projetados especificamente para tornar os modelos mais robustos contra injeção imediata e jailbreak. Por que A está errado: a filtragem tendenciosa foi projetada para detectar e remover conteúdo tendencioso, discriminatório ou ofensivo dos resultados do modelo. Ele aborda questões de justiça de conteúdo, mas não evita ataques de jailbreak que manipulam o modelo para realizar ações não autorizadas. Por que B está errado: um prompt do sistema define as instruções básicas e a personalidade do modelo, mas o ataque de jailbreak já demonstra que o prompt atual pode ser substituído. Guardrails fornecem aplicação em uma camada que é mais resistente à manipulação de prompt do que apenas o prompt do sistema. Por que C está errado: O monitoramento de log detecta tentativas de jailbreak depois de terem sido bem-sucedidas. É um controle de detetive que permite a resposta a incidentes, mas não impede que o modelo ofereça descontos não autorizados.
Quer todas as 123 questões por R$ 198,00?