Essa é daquelas que parecem simples até o entrevistador emendar um "why?". Abaixo, a estrutura de resposta que passa em entrevista.
#1 Prompt injection: malicious instructions hidden in user input OR inside retrieved documents (indirect injection — your own RAG pipeline can be the attack vector).
Defenses: treat ALL external content as DATA, not instructions; least-privilege tools; human approval for dangerous actions; output validation; never put secrets in prompts.
Insecure output handling: model output that reaches your DB, shell, or HTML is UNTRUSTED INPUT. Validate it like user input.
Ler é fácil. Falar isso em inglês, sob pressão, com alguém avaliando, é outra história. No VagaGringa esse tópico vira flashcard com repetição espaçada, cai em quiz e entra no simulado.
Treinar este tópico no app