Prompt Injection: é branco no branco!
Você já imaginou que um simples PDF pode conter ordens secretas que só uma IA enxerga? Esse truque invisível já reprovou alunos, enganou tribunais e até desviou pagamentos automáticos, tudo sem que ninguém percebesse.
Não sei se você já viu um caso de prompt injection.
Mas eu sei que se não viu ainda, vai ver algum dia.
Imagine um texto escrito com a fonte tamanho 1, na cor branca e em um fundo branco. Você não vai vê-lo, certo? Eu posso ter escrito uma frase inteira entre a linha anterior e essa e você não vai saber.
Ocorre que quando um PDF é carregado em uma IA como chatGPT, Gemini ou outros, a primeira coisa que ela faz é processá-lo por mecanismos de extração (parsers) para converter as páginas do PDF em texto no formato Markdown, um tipo de arquivo em texto simples, sem formatação.
Como arquivo de texto em Markdown não tem tamanho nem cor de fonte, todo o texto fica visível para a IA, inclusive aquela linha que você não viu que eu escrevi em tamanho 1 e na cor branca.
Em julho de 2026, nos Estados Unidos, em uma universidade do Mississipi, um professor de história mandou seus alunos escreverem uma redação sobre a Revolução Industrial. Para detectar quem usaria IA, ele inseriu em fonte branca sobre fundo branco no enunciado da terefa, enviada em PDF, o comando para que a IA incluísse a palavra "Madagascar" em algum ponto do texto. Quem lesse o arquivo não via a instrução, mas quando o aluno inseria o PDF na sua IA favorita a instrução invisível era enviada junto. Resultado, 32 dos 35 alunos foram reprovados porque no meio das suas redações tinha a palavra Madagascar.
No Brasil, alguns advogados estão inserindo comandos ocultos em petições com o objetivo de influenciar ferramentas de IA usadas pelos tribunais para que produzam resumos ou decisões favoráveis a seus clientes. Já foram detectados casos no Superior Tribunal de Justiça (STJ) e em Tribunais Regionais do Trabalho (TRTs). Os advogados flagrados foram condenados por litigância de má-fé e ato atentatório à dignidade da Justiça, com multas que chegam a 80 mil reais, além da abertura de procedimentos éticos na OAB e investigações criminais por fraude processual.
Atualmente os modelos de IA mais modernos já possuem mecanismos de defesa e de segurança treinados para identificar e ignorar as instruções maliciosas, pois a prática já evoluiu para formas mais perigosas com inserção de instruções ocultas no código HTML de sites que são consultados por agentes de IA autônomos que executam atividades como leitura e-mails, agendamentos de compromissos ou processamento faturas para pagamento, resultando até em pagamentos fraudulentos.
Por isso, fica o alerta: o invisível aos nossos olhos é gritante para uma IA, e o que parece uma brncadeira já virou golpe, multa e fraude no mundo real.
Qual é a sua reação?
Como
0
Não gosto
0
Amor
0
Engraçado
0
Uau
0
Triste
0
Bravo
0
Comentários (0)