O que aconteceu
Em setembro de 2026, circularam relatos técnicos detalhando como o ChatGPT, da OpenAI, poderia ter acesso a informações sobre o comportamento de navegação dos usuários em outros sites, mediado por redes de coleta de anuncios (ad collectors). A investigação, publicada em um blog de segurança e privacidade, aponta que a plataforma pode receber sinais de rastreamento originados de scripts de publicidade presentes em terceiros.
Esse tipo de coleta não e necessariamente intencional nem maliciosa por parte da OpenAI. O mecanismo e consequencia da forma como a industria de publicidade digital funciona: pixels de rastreamento, cookies de terceiros e SDKs de ad networks criam perfis de comportamento que podem, em tese, ser correlacionados com sessoes em plataformas de IA.
O assunto levantou preocupações entre pesquisadores de privacidade, pois usuários tendem a compartilhar informações sensiveis com assistentes de IA (dados de saude, financeiros, pessoais) sem imaginar que seu histórico de navegação externo pode estar sendo correlacionado a essas interações.
Como funciona
O mecanismo pode ser descrito em tres camadas técnicas distintas:
1. Pixels e scripts de terceiros: Muitos sites comerciais incorporam scripts de redes como Google Ads, Meta Pixel, criteo e outros. Esses scripts registram eventos de página (pageview, clique, tempo na página, produtos visualizados) e os enviam para servidores da ad network. O identificador do usuário nesse ecossistema e tipicamente um cookie de terceiro ou um fingerprint de navegador.
2. Compartilhamento entre plataformas via lookalike e APIs: Plataformas de IA que utilizam infraestrutura de anuncios (ou que firmam parcerias de dados com redes de publicidade) podem receber sinais cruzados sobre o mesmo usuário. Se o ChatGPT ou a OpenAI participam de redes de troca de dados de audiência, e possível que o histórico de navegação de um usuário em sites externos aparea como sinal de contexto ou seja usado para personalização.
3. Device fingerprinting: Mesmo sem cookies, scripts de terceiros podem construir um fingerprint único do dispositivo (resolução, fontes instaladas, user agent, WebGL, Canvas, AudioContext) e associar esse fingerprint tanto ao perfil da ad network quanto ao identificador de sessao do ChatGPT, se ambos são carregados no mesmo navegador.
O relatorio original menciona especificamente um ad collector que aparece integrado na interface do ChatGPT ou em dominos relacionados, coletando sinais de rastreamento que são transmitidos a terceiros. O código identificado utilizava técnicas de fingerprinting passivo e transmissao de eventos para endpoints externos.
Quem foi afetado
O impacto potencial e amplo, pois afeta qualquer usuário do ChatGPT que:
- Usa o mesmo navegador para sessoes do ChatGPT e para navegar em sites de comercio eletronico, saude, noticias ou entretenimento.
- Não utiliza bloqueadores de rastreamento (uBlock Origin, Privacy Badger, etc.).
- Não desativou cookies de terceiros no navegador.
- Acessa o ChatGPT em modo não anonimo/incognito.
Usuários corporativos tem risco elevado: conversas com assistentes de IA frequentemente incluem estrategias de negócio, informações de clientes e dados internos. Se o perfil comportamental externo do funcionario (sites visitados, interesses) puder ser correlacionado com essas sessoes, o risco de vazamento de contexto aumenta.
Do ponto de vista juridico, usuários no Brasil estão protegidos pela LGPD (Lei Geral de Proteção de Dados, Lei 13.709/2018), que exige base legal para coleta e tratamento de dados pessoais, incluindo dados de comportamento online. Na Europa, o GDPR estabelece restrições similares. Plataformas que coletam dados sem consentimento explicito podem ser responsabilizadas.
Como identificar
Existem metodos técnicos para verificar se uma plataforma está transmitindo dados de rastreamento a terceiros:
Inspeção de rede: Use as ferramentas de desenvolvedor do navegador (F12, aba Network) durante uma sessao no ChatGPT. Filtre por tipo XHR e Fetch. Procure requisições para domínios que não sejam da OpenAI (openai.com, chat.openai.com, cdn.oaistatic.com). Qualquer requisição para domínios de publicidade (doubleclick.net, googlesyndication.com, fb.com, criteo.com, etc.) e um indicador de rastreamento.
uBlock Origin - modo avancado: O uBlock Origin em modo avancado mostra em tempo real quais scripts de terceiros são carregados. Habilite o log de requisições bloqueadas e observadas. Requisições a domínios de ad-tech são marcadas automaticamente.
Extensão Privacy Badger (EFF): Exibe quais trackers foram detectados em cada site. Se trackers aparecerem no ChatGPT, ha coleta de comportamento ocorrendo.
Wireshark / mitmproxy: Para análise mais profunda, capture o tráfego de rede e inspecione os payloads enviados. Scripts de fingerprinting geralmente transmitem JSON com atributos do dispositivo para endpoints externos.
Relatorio de transparência da OpenAI: Consulte a política de privacidade e os termos de uso atualizados da OpenAI para verificar quais parceiros de dados e redes de publicidade são mencionados. Policies sem menção a parceiros de ad-tech podem não refletir a realidade técnica.
Como se proteger
As medidas de proteção podem ser divididas em camadas, da mais simples a mais robusta:
Nível básico:
- Instale o uBlock Origin no Chrome, Firefox ou Edge. E gratuito, open-source e altamente eficaz.
- Desative cookies de terceiros: Chrome (Configurações > Privacidade > Bloquear cookies de terceiros), Firefox (Proteção aprimorada contra rastreamento - modo Estrito).
- Use o modo anonimo do navegador para sessoes sensiveis no ChatGPT. O modo anonimo não salva cookies entre sessoes.
Nível intermediario:
- Use o Firefox com as configurações de privacidade maximas, ou o Brave Browser (bloqueia ads e trackers por padrão).
- Instale o Privacy Badger (Electronic Frontier Foundation) para bloqueio automático de trackers não consensuais.
- Considere usar um DNS com filtragem de rastreadores, como o Cloudflare 1.1.1.1 for Families ou o NextDNS.
Nível avancado:
- Acesse o ChatGPT exclusivamente em um perfil de navegador dedicado, sem outros sites logados.
- Use uma VPN confiável para mascarar seu IP real e dificultar a correlação de sessoes.
- Desative JavaScript de terceiros via uMatrix (extensão para usuários avancados).
- Em ambientes corporativos, implemente uma política de proxy com filtragem de URLs de ad-tech nos gateways de rede.
Comparação com casos anteriores
O tema de assistentes de IA coletando dados de rastreamento não e novo. Em 2023, o ChatGPT foi temporariamente bloqueado na Italia pelo Garante (autoridade de proteção de dados italiana) por falta de base legal para coleta de dados pessoais. A OpenAI teve que implementar melhorias na política de privacidade e no mecanismo de opt-out para retomar operações.
Em 2024, pesquisadores descobriram que varios chatbots comerciais incorporavam pixels do Facebook e do Google Analytics diretamente nas interfaces de chat, transmitindo metadados de conversação (tópico da mensagem, comprimento, frequência de uso) sem consentimento explicito dos usuários.
O caso do Zoom, em 2020, e um paralelo útil: a plataforma de videoconferencia foi flagrada enviando dados de chamadas para servidores do Facebook via SDK integrado ao app iOS, mesmo para usuários sem conta no Facebook. O incidente resultou em ação coletiva e mudancas na política de privacidade.
A diferença no caso atual e que assistentes de IA armazenam histórico de conversação, criando um risco adicional: não e apenas o comportamento de navegação que pode ser correlacionado, mas também o conteúdo das conversas, que pode incluir informações muito mais sensiveis.
Análise técnica
Do ponto de vista técnico, a integração de scripts de ad-tech em plataformas de IA levanta questoes sobre o modelo de privacidade por design (privacy by design), principio fundamental da LGPD (Art. 46) e do GDPR (Art. 25).
Um ad collector tipico opera da seguinte forma:
// Exemplo conceitual de fingerprinting passivo
const fp = {
resolution: `${screen.width}x${screen.height}`,
timezone: Intl.DateTimeFormat().resolvedOptions().timeZone,
plugins: Array.from(navigator.plugins).map(p => p.name),
canvas: getCanvasFingerprint(),
webgl: getWebGLFingerprint()
};
fetch('https://collector.adnetwork.example/track', {
method: 'POST',
body: JSON.stringify({ uid: cookieId, fp, page: location.href })
});A transmissao de location.href e particularmente problematica em plataformas de IA, pois a URL da sessao pode conter identificadores de conversa. Combinado com o fingerprint do dispositivo, isso permite correlacionar o histórico de navegação externo do usuário com sessoes específicas no ChatGPT.
Não ha um CVE específico atribuido a este comportamento, pois não se trata de uma vulnerabilidade de software tradicional, mas sim de uma prática de coleta de dados que pode violar regulamentações de privacidade. A classificação mais próxima seria uma violação de privacidade por design (privacy by design failure) conforme os frameworks NIST Privacy Framework e ISO/IEC 27701.
Impacto e consequencias
As consequencias podem ser analisadas em quatro dimensoes:
Privacidade individual: Usuários que discutem questoes de saude, financas pessoais ou situações juridicas com o ChatGPT podem ter esses contextos correlacionados com seu perfil de comportamento de consumo externo. Isso pode resultar em anuncios altamente targetados e invasivos, ou, em cenários mais graves, em discriminação por perfil comportamental.
Corporativa: Empresas cujos funcionarios usam o ChatGPT para tarefas relacionadas ao trabalho (análise de contratos, brainstorming de estrategia, revisao de código) podem ter metadados de uso correlacionados com o comportamento de navegação dos funcionarios em outros sites, criando um vetor de vazamento de contexto competitivo.
Juridico: Na Europa, violações do GDPR podem resultar em multas de até 4% do faturamento global anual da empresa. No Brasil, a LGPD prevê multas de até 2% do faturamento no território nacional, limitado a R$ 50 milhoes por infração. Adicionalmente, ações de classe por parte de usuários afetados são possíveis em multiplas jurisdições.
Reputacional: Para a OpenAI, incidentes de privacidade podem acelerar regulamentações setoriais para IA e reduzir a confianca de usuários corporativos, que são o segmento de maior receita da empresa (ChatGPT Enterprise, API).
Dicas práticas e boas práticas
Segue um checklist de segurança e privacidade para uso responsável de assistentes de IA:
- Nunca compartilhe dados pessoais de terceiros (clientes, pacientes, funcionarios) com assistentes de IA sem garantias contratuais de processamento de dados (DPA - Data Processing Agreement).
- Desative o histórico de conversas nas configurações do ChatGPT (Settings > Data controls > Improve the model for everyone: desligado) para que suas conversas não sejam usadas para treinamento.
- Use contas corporativas com DPA assinado se o uso for profissional (OpenAI oferece DPA para clientes Enterprise e Team).
- Audite regularmente as extensões instaladas no navegador. Extensões maliciosas podem injetar scripts de rastreamento em qualquer página visitada, incluindo o ChatGPT.
- Implemente Content Security Policy (CSP) rigorosa em suas próprias aplicações web para prevenir que scripts de terceiros sejam carregados sem autorização explicita.
- Para equipes de segurança: use o TrustSiteMonitor para monitorar se seus próprios sites estão incluindo scripts de terceiros não autorizados que poderiam criar riscos de privacidade para seus usuários.
Conclusao: o que fazer agora
A revelação sobre rastreamento via ad collectors em plataformas de IA e um lembrete importante: a privacidade não e garantida por padrão em nenhuma plataforma digital, mesmo naquelas voltadas para produtividade e trabalho.
Como usuário, as ações imediatas são claras: instale um bloqueador de rastreamento (uBlock Origin), desative cookies de terceiros, revise as configurações de privacidade do ChatGPT e seja criterioso sobre quais informações compartilha com assistentes de IA.
Como profissional de segurança ou desenvolvedor, o caso reforça a importancia de auditar as dependências JavaScript de terceiros em suas próprias aplicações. Scripts de ad-tech são frequentemente vetores de rastreamento não intencional que afetam seus usuários sem que você perceba.
O monitoramento continuo dos seus ativos digitais, incluindo análise dos scripts carregados e headers de segurança, e uma das melhores defesas preventivas. Ferramentas como o TrustSiteMonitor permitem identificar rapidamente quando novos scripts de terceiros aparecem em seus sites, ajudando a detectar inclusoes não autorizadas antes que causem impacto.
A industria de IA precisa adotar privacidade por design como principio inegociavel, não como feature opcional. Até que isso aconteca, a responsabilidade de proteger sua privacidade continua sendo majoritariamente sua.
Comentários
Deixar um comentárioVocê precisa ter uma conta no BlogDudu para comentar.