Um novo tipo de ataque de injeção de prompts demonstra por que conceder acesso a navegadores, ferramentas de código e dados privados a assistentes de IA exige cautela redobrada.
Pesquisadores de IA descrevem a "Injeção de Contexto Criptográfico" — um ataque que oculta instruções maliciosas dentro de dados criptografados. A IA é então induzida a descriptografar esses dados usando sua própria ferramenta de execução de código. Como resultado, a IA pode tratar o texto resultante como se fosse informação interna confiável.
Uma injeção de prompt é semelhante a inserir uma instrução falsa em um documento para um assistente de IA ler. Em vez de seguir apenas a solicitação do usuário, o assistente pode ser enganado e passar a seguir as instruções de um invasor ocultas em uma página da web, e-mail ou arquivo.
Como relatamos meses atrás, especialistas alertaram que os ataques de injeção de prompts são um problema que talvez nunca seja resolvido. A injeção de prompts funciona porque os modelos de IA não conseguem distinguir de forma confiável entre instruções legítimas e instruções de um atacante, então às vezes obedecem às instruções erradas.
Para reduzir esse risco, os fornecedores de IA configuram seus modelos com mecanismos de proteção: medidas projetadas para impedir que os sistemas de IA façam coisas que não deveriam, seja intencionalmente ou não.
O que os pesquisadores descobriram foi que instruções maliciosas podiam ser ocultadas de algumas proteções da IA por meio de criptografia. A própria IA podia então ser enganada para descriptografar essas instruções usando suas ferramentas de programação.
Quando as instruções se tornaram legíveis, já haviam passado pelas verificações de segurança iniciais. A IA pôde então confundi-las com instruções legítimas e segui-las.
É um pouco como esconder instruções maliciosas em uma linguagem que o sistema de segurança não entende. A IA as traduz somente depois que elas passam pelas verificações de segurança, podendo então executar o que elas dizem.
Os pesquisadores testaram seu método contra dois agentes de IA, com resultados diferentes. No caso do Grok, os pesquisadores afirmam que o ataque conseguiu roubar informações como o nome do usuário, localização aproximada, plano de assinatura e histórico de conversas. No caso do Gemini, eles usaram a técnica para burlar os controles de segurança e gerar conteúdo que o modelo normalmente não produziria.
“No Grok, um simples 'resumir esta página' rouba os dados do chat do usuário sem nenhum clique ou aviso. No Gemini, ele produz conteúdo que o modelo normalmente rejeitaria. Ambos são sistemas de produção em tempo real.”
Os pesquisadores não forneceram detalhes completos porque a xAI não tomou nenhuma providência após a falha no Grok ter sido relatada em junho de 2026. A Gemini, por outro lado, fez melhorias, mas ainda não corrigiu completamente a vulnerabilidade.
Como se manter seguro
Um assistente de IA pode ser útil, mas não se deve confiar automaticamente a ele dados sensíveis ou ferramentas poderosas.
- Trate com cautela os resumos de IA de páginas da web, documentos e links compartilhados desconhecidos, especialmente quando o assistente pode navegar ou executar código.
- Não cole senhas, códigos de recuperação, chaves de API, informações financeiras ou detalhes confidenciais de saúde e trabalho em chats de IA, a menos que você entenda como essas informações serão tratadas.
- Analise as ferramentas e permissões conectadas de um assistente de IA. Remova o acesso desnecessário, principalmente a e-mail, armazenamento em nuvem, repositórios de código-fonte e integrações externas.
- Desconfie se uma ferramenta de IA solicitar que você descriptografe, decodifice, execute um script, abra um novo link ou carregue dados como parte de uma tarefa aparentemente comum.
- Mantenha o navegador e os aplicativos de IA atualizados e verifique os avisos de segurança do fornecedor ao usar recursos como navegação, agentes autônomos ou execução de código.
- Utilize uma solução antimalware atualizada e em tempo real para detectar e bloquear downloads maliciosos e conexões suspeitas.
Algo parece errado? Verifique antes de clicar.
Malwarebytes Guardajuda você a analisar instantaneamente links, mensagens de texto e capturas de tela suspeitas.
Disponível comMalwarebytes Premium para todos os seus dispositivos e noMalwarebytes para iOS Android.




