O AGENTICO
Pesquisadores revelam ataque que rouba dados do Grok via criptografia
2 fontesdesde 20 de agosto de 20262 artigos
A empresa de segurança Adversa AI divulgou uma técnica chamada 'Cryptographic Context Injection' que permite extrair dados de conversas do chatbot Grok, da xAI, por meio de páginas web maliciosas. O ataque explora a capacidade do modelo de descriptografar instruções ocultas em texto cifrado, contornando os filtros de segurança. A demonstração foi feita contra o Grok 4.5 Fast, sem evidências de exploração ativa na natureza.


Resumo
A Adversa AI divulgou a técnica de ataque 'Cryptographic Context Injection' que pode fazer o chatbot Grok, da xAI, enviar nome, localização aproximada, plano de assinatura e prompts da conversa para um servidor controlado por atacantes.
Esse é o fato central do ataque: a possibilidade de exfiltração de dados sensíveis do usuário por meio de uma solicitação de resumo de página da web.
A injeção de contexto criptográfico esconde instruções maliciosas em texto criptografado por AES para que os guardrails não consigam lê-las, enganando a IA para que as descriptografe e as trate como se fossem suas.
Esse é o mecanismo inovador do ataque, que explora a execução de código para contornar classificadores de segurança estáticos.
Não há correção nem solução paliativa disponível para o usuário, e a Adversa AI não relatou exploração ativa na natureza.
A ausência de patch ou workaround reforça a urgência de conscientização dos usuários e de mudanças nos provedores de IA.
A Adversa AI afirma que a técnica de ataque foi demonstrada contra o Gemini, do Google, e que, neste caso, ela produz conteúdo que o modelo normalmente se recusa a gerar.
O impacto no Gemini indica que a vulnerabilidade não é exclusiva de um único modelo, mas um problema mais amplo de segurança em sistemas de IA generativa.
A Adversa AI afirma que o ataque foi reproduzido no Grok 4.5 Fast em 19 de agosto de 2026, com uma taxa de sucesso de 40% em 20 tentativas desde junho.
A taxa de sucesso de 40% demonstra que o ataque é eficaz em uma parcela significativa das tentativas, tornando-o uma ameaça prática.
Citações
“Cryptographic Context Injection hides malicious instructions inside AES-encrypted text so guardrails can’t read them, then tricks the AI into decrypting and trusting them as its own.”
— Adversa AI, Empresa de segurança autora do relatório
Todo dia, só o que dois veículos independentes confirmaram — no seu feed.