A fraude publicitária normalmente não é descoberta. Ela é relatada, pelos mesmos sistemas que estão sendo fraudados, e a essa altura o orçamento já foi gasto. O problema estrutural é que as plataformas e redes que veiculam seus anúncios também são a fonte dos números que você usa para avaliá-las, então qualquer coisa que dê errado dentro desse ciclo fica invisível de dentro dele.
Detecção independente significa verificar o que realmente acontece quando um usuário real em um lugar real carrega a página, e fazer isso continuamente em vez de em uma auditoria trimestral. Veja o que isso envolve na prática.
O que você está procurando
A fraude assume várias formas, e cada uma deixa uma assinatura diferente, o que importa porque sua detecção precisa estar procurando a coisa certa.
Domain spoofing deturpa onde o anúncio foi veiculado, de modo que uma impressão cobrada contra um publisher premium na verdade foi veiculada em um site de baixa qualidade. A assinatura é uma incompatibilidade entre o posicionamento relatado e a página que sua própria verificação encontrou.
Ad stacking e pixel stuffing escondem múltiplos anúncios uns sobre os outros, ou os renderizam em um espaço pequeno demais para ser visto, de modo que impressões são contadas para anúncios que nenhum humano poderia ter visualizado. A assinatura é geométrica: um elemento com dimensões reais no relatório e praticamente nenhuma na página.
Deturpação geográfica cobra tráfego como vindo de um mercado do qual ele não veio, o que importa quando você pagou um valor premium por aquele mercado. A assinatura só aparece se você verificar de dentro do mercado.
Tráfego inválido são impressões e cliques gerados por máquina disfarçados de humanos. A assinatura é comportamental e estatística, e não visível em nenhuma verificação isolada.
Problemas de criativo e de landing page ficam ao lado da fraude propriamente dita: o criativo errado, uma oferta expirada, uma landing page quebrada, ou o anúncio de um concorrente em um slot de exclusividade. Não é fraude no sentido legal, mas o mesmo dinheiro é desperdiçado, e é detectado pelo mesmo mecanismo.
Por que a detecção exige pontos de observação reais
O mecanismo central é simples de descrever. A veiculação de anúncios é segmentada, então o que é servido depende de quem parece estar pedindo: o país e a cidade da pessoa, o dispositivo, o idioma, e muitas vezes o histórico aparente. Para ver o que um usuário em São Paulo em um celular vê, a requisição precisa parecer que veio dessa pessoa.
É por isso que o tráfego de datacenter não pode fazer esse trabalho. Tanto as plataformas de anúncios quanto os operadores de fraude tratam faixas de hospedagem conhecidas de forma diferente, então uma verificação feita a partir de uma região de nuvem pode receber uma versão limpa e genérica da página enquanto a fraude continua para usuários reais, ou pode ser simplesmente bloqueada. O resultado é um sistema de verificação que relata que está tudo bem.
Saídas residenciais fazem cada verificação parecer um visitante comum do mercado que está sendo verificado, o que é toda a base para os proxies de verificação de anúncios como categoria. A seleção do endereço importa tanto quanto a geografia, já que um endereço sinalizado ou próximo de datacenter recebe uma experiência diferente, conforme o que é reputação de IP e como identificar IPs de datacenter vendidos como residenciais.
Cobertura entre mercados
Se você compra em muitos países, precisa verificar em muitos países, e a restrição honesta é que a cobertura é por mercado, não global. Uma rede que abrange 195 países transforma isso em uma questão de configuração, e o trabalho prático é decidir onde amostrar e com que frequência, já que verificar tudo continuamente não é nem necessário nem viável financeiramente.
Uma alocação razoável pondera três coisas: gasto, para que os mercados que consomem a maior parte do orçamento recebam a maior parte das verificações; risco, para que mercados ou parceiros com histórico de discrepâncias recebam mais atenção; e mudança, para que novas campanhas e novos posicionamentos sejam amostrados intensamente no lançamento e depois com menos frequência. Quando uma campanha é segmentada por cidade, a verificação também precisa ser, conforme segmentação em nível de cidade, e a disponibilidade varia por mercado de formas que vale a pena conhecer antes de prometer cobertura global, conforme disponibilidade por país.
O que “tempo real” realmente significa aqui
Tempo real nesse contexto não é abaixo de um segundo. Significa que o ciclo se fecha rápido o suficiente para que você possa interromper o gasto antes que ele se torne relevante, o que para a maioria dos programas fica entre minutos e algumas horas, e não no próximo relatório mensal.
Quatro fatores determinam se você atinge isso.
Frequência de amostragem, que é o fator dominante. Amostragem contínua em um conjunto rotativo de posicionamentos supera uma varredura exaustiva uma vez por dia, porque limita por quanto tempo um problema pode continuar sem ser detectado.
Latência de detecção, ou seja, quão rapidamente uma verificação é concluída e avaliada. Requisições residenciais são mais lentas do que as de datacenter, então planeje o orçamento para isso e mantenha as verificações enxutas, conforme reduzindo a latência.
Avaliação, que deve ser automática. Um screenshot que ninguém olha não é detecção. A comparação com as expectativas precisa rodar em código.
A ação. Detecção que termina em um painel é monitoramento; detecção que pausa um posicionamento ou abre um chamado é um controle. Decida com antecedência quais achados disparam quais respostas.
Construindo o ciclo
A estrutura é a mesma independentemente da escala.
Comece por uma expectativa, já que você não pode detectar uma discrepância sem uma. Para cada posicionamento, você deve saber o domínio em que ele deveria rodar, o criativo que deveria ser renderizado, o mercado ao qual ele é segmentado, e a landing page que deveria alcançar.
Depois verifique a partir do mercado, capturando evidência suficiente para agir: a página resolvida, o elemento de anúncio e suas dimensões reais renderizadas, o criativo, a URL da landing page após os redirecionamentos, e um screenshot. A evidência importa porque o resultado desse sistema costuma ser uma conversa com um parceiro sobre dinheiro, e uma alegação sem uma captura é apenas uma opinião.
def check_placement(placement, country, city=None):
ctx = browser_context(country=country, city=city) # residential exit
page = ctx.new_page()
page.goto(placement["url"], wait_until="networkidle")
ad = page.query_selector(placement["selector"])
box = ad.bounding_box() if ad else None
return {
"found": ad is not None,
"visible": bool(box and box["width"] > 1 and box["height"] > 1),
"dimensions": box,
"creative": ad.get_attribute("src") if ad else None,
"final_url": page.url,
"screenshot": page.screenshot(),
"market": {"country": country, "city": city},
"checked_at": now(),
}
Depois compare com a expectativa e classifique: anúncio ausente, anúncio presente mas praticamente invisível, criativo errado, domínio errado, mercado errado, ou landing page quebrada. Cada caso mapeia para uma resposta diferente, e é a classificação que torna o alerta acionável em vez de ruído.
Por fim, monitore a saúde da sua própria coleta, porque um mercado que silenciosamente parou de retornar resultados parece exatamente igual a um mercado sem problemas. Essa distinção é a diferença entre um sistema de verificação e uma falsa sensação de segurança, e é a disciplina descrita em monitorando a saúde de proxies em escala.
Mantendo a integridade
Vale explicitar duas restrições.
Isso é medição, não interferência. Verificação significa observar o que é veiculado, não clicar em anúncios para testá-los, gerar impressões, ou qualquer coisa que distorceria a própria veiculação ou o gasto. Ajuste o ritmo com moderação, para que suas verificações sejam um erro de arredondamento frente ao tráfego real, e não uma carga sobre os publishers que você está verificando.
E trate os achados como evidência a ser revisada, não como veredito. Um anúncio ausente pode ser um slot legitimamente não preenchido, uma incompatibilidade geográfica pode ser uma mudança de segmentação que ninguém informou, e um criativo errado pode ser uma campanha que foi rotacionada. O valor está no padrão e na captura, que é o que torna a conversa com o parceiro produtiva.
Conclusão
Você não pode detectar fraude publicitária de dentro do sistema que a relata, então a detecção significa verificações independentes a partir de pontos de observação de usuários reais nos mercados em que você compra. Conheça a aparência de cada tipo de fraude, porque a verificação precisa estar procurando a assinatura certa: uma incompatibilidade de domínio, um elemento sem dimensões reais, um mercado que não corresponde, um criativo que não deveria estar ali. Amostre continuamente e pondere a cobertura por gasto, risco e recência, em vez de tentar verificar tudo. Capture evidências, porque o resultado geralmente é uma conversa sobre dinheiro. Automatize a comparação e associe uma ação a cada classificação, e monitore sua própria coleta para que um mercado silencioso não seja confundido com um mercado limpo.
Os pontos de observação são a parte que não pode ser improvisada: os proxies de verificação de anúncios colocam cada verificação no mercado a que ela pertence, funcionando sobre proxies residenciais com segmentação por país e cidade e preços por GB que se adequam a um programa de amostragem contínua.