Toda ferramenta de monitoramento de marca produz um gráfico de menções ao longo do tempo, e o gráfico é tão honesto quanto a cobertura por trás dele. Uma queda pode significar que as pessoas pararam de falar sobre você. Também pode significar que um fórum começou a limitar a taxa do seu coletor, ou que um site de avaliações passou a servir um catálogo diferente para a região da qual você coleta.
Os dois casos parecem idênticos de dentro do painel. Esse é o problema central no rastreamento de menções, e é um problema de cobertura antes de ser um problema de sentimento.
As superfícies se comportam de forma diferente
Tratar “a internet” como uma única fonte é o que torna frágil a maioria dos monitoramentos internos. Cada superfície tem seu próprio modelo de acesso, sua própria estrutura e seu próprio modo de falha.
Plataformas sociais. Onde existem APIs oficiais e elas cobrem o que você precisa, use-as. São estáveis, são permitidas e não mudarão silenciosamente sua cobertura. Suas limitações costumam ser profundidade histórica, limites de taxa e quais campos elas expõem.
Fóruns e comunidades. Agregadores no estilo Reddit, fóruns técnicos de nicho, comunidades específicas do setor. Estruturalmente simples, muitas vezes as menções de maior valor, e as mais fragmentadas. Não há uma única rota de acesso, então é aqui que o trabalho por fonte se acumula.
Sites de avaliações. Diretórios de software, avaliações de varejo, avaliações de lojas de aplicativos. Fortemente regionalizados, o que é a armadilha abordada mais adiante. O conteúdo de avaliações também é estruturado, então é a superfície mais fácil de pontuar e a mais fácil de superponderar.
Notícias e blogs. Bem atendidos por feeds e agregadores existentes. Geralmente não vale a pena construir uma coleta sob medida para isso.
Sites de perguntas e respostas. Volume baixo, alta intenção, e vale a pena observar precisamente porque uma pergunta sobre seu produto muitas vezes precede uma decisão.
O conselho prático é classificar as superfícies por onde seu público realmente está, e não por quão fácil é coletar cada uma. Um programa de monitoramento que cobre bem as duas superfícies fáceis e não cobre nada da importante é um resultado comum e caro.
A geografia muda o que uma menção sequer é
Essa é a falha que pega equipes com clientes internacionais.
Lojas de aplicativos servem catálogos e conjuntos de avaliações diferentes por loja regional. Diretórios de software localizam tanto listagens quanto avaliações. Plataformas sociais variam o que é visível por região. Uma menção postada por um cliente na Alemanha pode ser genuinamente invisível para um coletor dos EUA, e nada no resultado indicará que algo está faltando.
A consequência é que um coletor de ponto de vista único produz uma visão regional rotulada como global. Se você reporta “as menções aumentaram 12 por cento” para uma equipe de liderança com receita internacional, esse número deveria ter sido coletado dos mercados de onde essa receita vem.
Proxies residenciais com segmentação por país e cidade são o que faz uma visão regional ser de fato regional. Com o gateway Shifter, o ponto de vista e a sessão vão nas credenciais em relação a p.shifter.io:443:
customer-USERNAME-country-de-sid-mentions-de-ttl-600:PASSWORD
Mantenha uma sessão por mercado e consulta para que uma thread paginada ou lista de avaliações permaneça internamente consistente, em vez de rotacionar no meio da coleta e juntar páginas de diferentes pontos de vista. A visão de produto desse fluxo de trabalho está na página de proxies para monitoramento de marca.
Construa o conjunto de consultas de forma deliberada
A cobertura é limitada pelo que você pesquisa, e a maioria das equipes pesquisa pouco demais e depois de mais demais.
Comece pelo óbvio: nome da marca, nomes de produtos, domínio. Depois adicione o que as pessoas realmente digitam: erros de digitação comuns, o nome sem espaços, a abreviação, o nome antigo caso você tenha feito rebranding. Depois adicione os contextos em que você aparece sem ser nomeado diretamente: comparações com concorrentes, termos de categoria mais uma reclamação, nomes de executivos.
O contraproblema surge se o nome da sua marca for uma palavra comum. Um nome genérico enterra menções reais sob ruído, e a solução não é um modelo melhor, é uma consulta mais restrita: exigir um termo coocorrente, restringir a comunidades relevantes, ou combinar com o domínio em vez da palavra. Decida isso no design da consulta, porque um corpus ruidoso envenena tudo a jusante.
Registre o conjunto de consultas como um artefato versionado. Quando o volume de menções subir no próximo trimestre, você precisa saber se o mundo mudou ou se suas consultas mudaram.
Deduplique antes de contar
A mesma declaração chega até você muitas vezes. Um comunicado de imprensa é sindicado em uma dezena de veículos. Uma postagem social é citada, capturada em tela e recompartilhada. Uma avaliação é espelhada por um agregador. Uma thread de fórum é republicada em outros lugares.
Contar tudo isso como menções separadas infla o volume de uma forma que se correlaciona com a sindicação, não com a atenção. Pior, faz um único evento ruidoso parecer um sentimento amplo.
Uma regra funcional é uma chave composta de autor normalizado, texto normalizado e uma janela de tempo, com uma preferência de fonte canônica para que o original supere as cópias. O que importa mais do que o algoritmo específico é que ele seja fixo e documentado, porque mudar a lógica de deduplicação retroativamente reescreve seu próprio histórico.
Mantenha as cópias vinculadas ao registro canônico em vez de descartá-las. A propagação é um sinal real, apenas um sinal diferente do volume.
A cadência deve seguir o risco, não a uniformidade
Coletar tudo a cada hora é caro e, na maior parte, desperdiçado. Coletar tudo semanalmente significa descobrir um problema depois que ele já se resolveu mal.
Escalone as superfícies. Os lugares onde uma reclamação escala rapidamente, tipicamente as redes sociais e a comunidade mais ativa da sua categoria, justificam um intervalo curto. Sites de avaliações e diretórios se movem devagar o suficiente para uma coleta diária. A agregação de notícias já costuma ser quase em tempo real através de feeds.
Depois adicione uma camada orientada a eventos: um lançamento, uma indisponibilidade, uma mudança de preço ou um ciclo de imprensa deve elevar temporariamente a cadência nas superfícies onde essa história se espalharia. Um cronograma fixo não consegue fazer isso, e os momentos que ele perde são exatamente aqueles para os quais o programa existe.
Meça sua própria cobertura
A disciplina que separa um programa de monitoramento em que você pode confiar de um gráfico em que não pode: acompanhar a coleta junto com as menções.
Registre a taxa de sucesso por fonte, resultados retornados contra resultados esperados, e páginas coletadas contra páginas disponíveis. Quando o volume de menções cai, a primeira pergunta é se sua própria taxa de sucesso caiu junto. Se caiu, isso é uma história de coleta, e reportá-la como um declínio na conversa estaria errado.
Execute uma pequena consulta de controle contra cada superfície duas vezes por janela de coleta a partir de dois pontos de saída diferentes na mesma região. Convergência significa que sua visão é estável; divergência significa que a fonte está respondendo a algo sobre suas requisições. O método para estabelecer essa linha de base está em testando velocidade, taxa de sucesso e precisão de localização de proxy, e o lado do ritmo de requisições está em limitação de taxa e controle de requisições.
O que fazer com o que você encontra
Um monitoramento que não produz nenhuma decisão de roteamento é um relatório que ninguém lê. Três categorias são suficientes para começar.
Agir agora. Uma reclamação específica de um cliente identificável, um erro factual sobre seu produto, uma alegação de segurança. Encaminhe para um humano com o link da fonte.
Agregar. Sentimento, volume, participação de voz contra concorrentes. Semanalmente, em forma de tendência, com métricas de cobertura anexadas para que a tendência possa ser confiável.
Arquivar. Todo o resto. Pesquisável, não exibido.
O lado de defesa de reputação disso, incluindo onde o rastreamento de menções encontra a detecção de falsificação e uso indevido, é abordado em usando proxies para proteger sua marca. As especificidades de lojas de aplicativos estão em coletando dados da App Store e do Google Play.
Perguntas frequentes
Devo usar APIs ou coletar páginas públicas?
APIs primeiro, sempre que houver uma e ela cobrir o que você precisa. A coleta de páginas públicas preenche as lacunas, o que na prática é a maioria dos fóruns, a maioria dos sites de avaliações e a maioria das comunidades de cauda longa.
Até quando o passado a coleta histórica deve ir?
Longe o suficiente para estabelecer uma linha de base contra a qual você possa comparar, o que geralmente significa um trimestre. Preencher anos retroativamente é caro e raramente muda uma decisão.
Por que meu volume de menções salta quando nada aconteceu?
Geralmente é sindicação de um único item, ou uma mudança de consulta. Verifique o resultado da deduplicação e a versão da consulta antes de concluir qualquer coisa sobre atenção.
Preciso disso se já tenho uma ferramenta de monitoramento paga?
Pergunte à ferramenta qual é sua cobertura por superfície e por região. A maior parte do trabalho interno existe porque uma comunidade específica importante, ou um mercado específico, não é coberto pela ferramenta.
Conclusão
O rastreamento de menções falha silenciosamente. Lacunas de cobertura parecem silêncio, sindicação parece consenso, e um ponto de vista doméstico parece uma visão global.
Construa o conjunto de consultas de forma deliberada, deduplique com uma regra que você possa defender, escalone a cadência pelo risco, colete dos mercados onde seus clientes realmente estão, e meça sua própria cobertura junto com as próprias menções. É isso que torna o gráfico digno de ser mostrado a alguém. Planos e tarifas estão na página de preços.