Técnica que busca contornar as restrições de segurança de um modelo de IA por meio de instruções elaboradas no prompt — geralmente simulando papéis, contextos fictícios ou sequências de raciocínio induzido — levando-o a produzir conteúdo que normalmente recusaria. O termo vem do mundo dos dispositivos móveis, onde também designa a remoção das limitações impostas pelo fabricante no sistema operacional (como instalar apps não autorizados no iOS). Fabricantes de modelos de IA investem continuamente em resistência a jailbreaks.
Inteligência ArtificialIntermediário
Jailbreak
Técnica que busca contornar as restrições de segurança de um modelo de IA por meio de instruções elaboradas no prompt, levando-o a produzir conteúdo que normalmente recusaria.
Veja também
- System PromptRelacionado
Instrução inicial enviada a um modelo de IA antes da conversa começar, que define seu papel, tom, limites e contexto — diferenciando um chatbot genérico de um assistente especializado.
- Prompt EngineeringRelacionado
A prática de estruturar instruções para um modelo de IA de forma a obter respostas mais precisas e úteis.