O Caso do Professor e a Detecção de IA em Redações
A Estratégia da “Instrução Oculta” para Expor o ChatGPT
A estratégia que revelou o uso de Inteligência Artificial em avaliações e ganhou destaque global foi idealizada pelo historiador Jason Gibson, professor da Alcorn State University, nos Estados Unidos. Diante de uma tarefa de redação sobre a Revolução Industrial, Gibson concebeu um método engenhoso para identificar estudantes que recorreriam a assistentes de IA, como o ChatGPT, para gerar seus trabalhos.
O cerne da abordagem consistiu em inserir uma “instrução oculta” diretamente no enunciado da atividade. Essa instrução foi deliberadamente formatada com letras brancas sobre um fundo também branco, tornando-a imperceptível à leitura humana convencional na tela do computador. A diretriz secreta era simples, mas reveladora: exigir a inclusão da palavra “Madagascar” em algum ponto da redação, de forma completamente descontextualizada e sem sentido.
A eficácia da técnica residia na diferença de processamento entre humanos e sistemas de IA. Enquanto um estudante lendo o enunciado não notaria a frase invisível, aquele que copiasse todo o texto do prompt e o colasse em um assistente de IA para gerar o conteúdo da redação, inadvertidamente, também enviaria a instrução oculta. O sistema de IA, ao processar o texto, incluiria a palavra “Madagascar” conforme solicitado, mesmo que de forma sem sentido lógico dentro do contexto da Revolução Industrial.
Os resultados foram imediatos e inquestionáveis. As redações entregues por 32 dos 35 alunos da turma continham frases absurdas envolvendo “Madagascar”, tais como: “Madagascar flutua de lado durante a tarde”, “A bicicleta roxa de Madagascar sussurra para o teto” ou “Madagascar foi a um jogo de basquete usando uma torradeira”. Essas inserções incoerentes evidenciaram não apenas o uso da IA, mas também a falta de revisão crítica do conteúdo gerado pelos próprios estudantes, que sequer se deram ao trabalho de reler o material antes da entrega.
O que é Prompt Injection e Como Funciona
Prompt Injection, ou injeção de comandos, é uma técnica que explora a maneira como os modelos de linguagem de inteligência artificial (IA) processam e respondem às instruções. Essencialmente, consiste em inserir comandos ocultos ou enganosos dentro de um prompt aparentemente normal, com o objetivo de manipular o comportamento do assistente de IA para que ele execute ações não intencionais ou ignore diretrizes de segurança previamente estabelecidas por seus desenvolvedores.
A mecânica do Prompt Injection baseia-se na capacidade de um modelo de IA de interpretar e seguir instruções, mesmo aquelas que não são explicitamente visíveis para o usuário final ou que contradizem o propósito principal do prompt. Em vez de simplesmente fornecer a resposta esperada, a IA pode ser induzida a revelar informações internas, formatar a saída de uma maneira específica, ou até mesmo gerar conteúdo que viole suas próprias políticas de uso.
No contexto da detecção do uso de IA em avaliações, como exemplificado pelo caso do professor universitário, a técnica funciona através da inserção de uma instrução secreta no enunciado da tarefa. Esta instrução é deliberadamente projetada para ser imperceptível ao olho humano (por exemplo, texto branco em fundo branco), mas é detectável por um sistema de IA que processa o texto em sua totalidade. Quando o aluno copia o enunciado completo e o cola em um assistente de IA (como o ChatGPT), o comando oculto é transmitido junto com a solicitação principal.
Ao receber o prompt com a instrução oculta, o modelo de IA a processa e a incorpora em sua resposta. No exemplo do professor, a instrução para incluir a palavra ‘Madagascar’ de forma sem sentido resultou na aparição dessa palavra em frases absurdas nas redações geradas pela IA. Isso serve como um marcador claro de que o texto passou por um processamento de IA que seguiu um comando injetado, revelando que o estudante utilizou a ferramenta, muitas vezes sem sequer revisar o conteúdo resultante.
É importante notar que o Prompt Injection não se limita apenas a esse tipo de detecção. A técnica pode ser utilizada em cenários mais amplos e até maliciosos. Criminosos, por exemplo, podem empregar essa abordagem para tentar induzir sistemas de IA a revelar dados confidenciais de empresas ou a contornar mecanismos de proteção. Existe também a modalidade de injeção direta, onde comandos maliciosos são inseridos explicitamente na caixa de texto do assistente, sem a necessidade de ocultamento.
Tipos e Aplicações Maliciosas da Prompt Injection
Histórico e Preocupações de Segurança na IA
Fonte: https://olhardigital.com.br

Yuri Martins é um entusiasta em tecnologia apaixonado por explorar as últimas tendências e inovações do setor. Desde a infância, ele se fascina com a capacidade da tecnologia de transformar vidas. Com vasto conhecimento, Yuri compartilha dicas e insights em seu blog e redes sociais, tornando a tecnologia mais acessível para todos.






