O número que não é volume

A escala do Google Trends vai de zero a cem, e a primeira coisa que precisa ser dita sobre ela é o que ela não é: não é volume, não é contagem de buscas e não é participação de mercado. O cem é o ponto mais alto da curva dentro da janela e do recorte escolhidos. O cinquenta é a metade desse ponto mais alto. O zero, na prática, costuma significar interesse abaixo de uma fração pequena do pico — não ausência de busca.

Isso produz a consequência que organiza todo o resto: dois países marcando cem na mesma comparação entre regiões não estão pesquisando a mesma quantidade de vezes. Cada um atingiu o próprio máximo na própria escala. Um mercado com dez mil buscas mensais e outro com duzentas podem marcar cem simultaneamente, desde que cada um esteja no seu ponto mais alto relativo ao próprio histórico.

Publicamos pesquisa editorial: não é consultoria e não garante resultado comercial. O que se segue descreve como o instrumento funciona e onde ele falha, a partir de literatura de mercado e de documentação pública da ferramenta — não a partir de medição nossa. Nenhuma empresa, ferramenta ou plataforma aparece aqui como recomendação, e nenhum número deve ser lido como parâmetro verificado.

Normalização: como a curva é construída

A normalização é o processo que transforma contagem bruta na escala de zero a cem. Ela existe para tornar comparáveis termos e regiões de tamanhos muito diferentes, e é justamente por isso que ela destrói a informação de magnitude que a maioria das pessoas quer ler nela.

O procedimento é uma amostragem. A ferramenta não processa todas as buscas; ela trabalha com uma amostra, calcula a proporção de buscas pelo termo dentro do universo total de buscas daquela região e daquele período, e normaliza o resultado pelo ponto mais alto da série. Cada escolha de janela temporal, de região e de categoria refaz o cálculo e reposiciona o cem.

Daí decorre uma regra operacional que evita boa parte dos erros: o valor de um ponto só significa alguma coisa em relação à janela em que foi calculado. Alterar o período de cinco anos para doze meses muda todos os números, sem que nenhuma busca real tenha mudado. Comparações precisam ser feitas dentro de um mesmo recorte, e qualquer conclusão tirada de gráficos gerados em recortes diferentes é inválida por construção.

O que a escala permite e o que ela proíbe

A ferramenta responde muito bem a três perguntas: onde um termo é relativamente mais forte, em que momento ele é mais forte, e como ele se comporta frente a outro termo na mesma régua. Todas são perguntas relativas, e é para elas que o instrumento foi desenhado.

Ela não responde a perguntas absolutas. Não informa quantas pessoas pesquisaram, não informa tamanho de mercado, não informa receita potencial e não informa participação de canal. Um índice relativo e não volume absoluto: essa distinção não é um detalhe técnico a ser mencionado em nota de rodapé, é o limite que define quais decisões podem e quais não podem ser tomadas com esse dado.

Na prática, isso significa que o gráfico é bom para ordenar e ruim para dimensionar. Serve para dizer que o interesse no termo A cresce mais rápido no país X do que no país Y, ou que um termo estável perdeu espaço para um termo novo. Não serve para dizer que o mercado X vale mais do que o mercado Y, e não serve para justificar orçamento com base no tamanho aparente da curva.

Comparação entre regiões: o erro mais caro

A comparação entre regiões é o uso mais comum e o mais mal compreendido. O mapa de interesse por país é lido como um mapa de tamanho de mercado, e não é: é um mapa de intensidade relativa ao pico local. Um país pequeno com uma comunidade muito engajada em um nicho pode aparecer mais quente do que um país grande onde o mesmo nicho é apenas uma atividade comum entre muitas.

O erro tem um custo assimétrico. Quando a leitura errada aponta para um mercado grande que na verdade é pequeno, o recurso é alocado, a localização é feita, e o retorno não vem — e a falha é atribuída ao produto ou à execução, não à medição. É o tipo de erro que não se corrige sozinho, porque o gráfico continua parecendo razoável quando revisitado.

Há uma segunda armadilha na mesma família: comparar regiões sem verificar se a coleta cobre ambas da mesma forma. Regiões com baixa densidade de dados, com idioma minoritário na amostra ou com forte presença de buscadores alternativos aparecem sistematicamente mais frias do que são, e a diferença não é demanda; é visibilidade.

O termo de ancoragem

Uma técnica discutida na literatura de mercado para reduzir o problema da escala relativa é o uso de um termo de ancoragem. A ideia é colocar, na mesma consulta, um termo amplo, de volume alto e comportamento estável — um conceito que se pesquisa de forma parecida em qualquer lugar — e ler o termo de interesse em proporção a ele.

Se no país X o termo de interesse marca trinta e o termo de ancoragem marca cem, enquanto no país Y o termo de interesse marca sessenta e o ancoragem também marca cem, a relação entre os dois melhora sensivelmente em relação à leitura direta. Uma cesta de ancoragem com mais de um termo amplo reduz o risco de o ancoragem escolhido ter comportamento idiossincrático em um dos mercados.

É preciso ser honesto sobre o que isso entrega. O método reduz a distorção de escala; não converte índice em volume e não produz número de buscas. Ele melhora a ordenação relativa entre mercados e dá uma base mais sólida para dizer onde o interesse é proporcionalmente mais forte. Converter isso em estimativa absoluta exige dados externos, e essa etapa é incontornável.

População e penetração de internet

Depois da normalização, o segundo fator que separa intensidade de tamanho é demográfico. Um país com o dobro de habitantes conectados produz mais buscas para o mesmo nível de interesse relativo, e a penetração de internet varia muito mais entre mercados do que a intuição de quem trabalha com mercados maduros costuma supor.

Por isso, qualquer leitura de intensidade que pretenda se aproximar de magnitude precisa ser cruzada com dois números externos: população e penetração de internet. Não é um cálculo refinado e não pretendemos apresentá-lo como tal — é um ajuste de ordem de grandeza, suficiente para evitar a inversão grossa de ranking que a leitura direta do mapa produz.

O mesmo raciocínio vale dentro de um país. Duas regiões com intensidade parecida podem representar volumes muito diferentes se a base de usuários conectados for muito diferente, e esse efeito se amplia quando se desce para o nível de estado ou província, onde a qualidade da coleta também varia.

Do país à sub-região: onde o dado desaparece

O interesse por sub-região permite descer do país para a unidade intermediária e desta para a cidade, e a descida é útil porque a maior parte das decisões operacionais acontece nesse nível: onde abrir atendimento, que idioma regional priorizar, onde concentrar campanha local.

O problema é que, a cada nível descendente, a base de dados encolhe. O que era uma amostra robusta no país vira uma amostra pequena no estado e uma amostra insuficiente na cidade. O resultado aparece de duas formas: valores zerados em lugares onde claramente há alguma atividade, e rankings locais instáveis, que mudam muito entre duas consultas feitas em dias diferentes sem que nada tenha mudado no mundo.

A regra de leitura é uma só e merece destaque: ausência de resultado em nível sub-regional não deve ser lida como ausência de demanda. Deve ser lida como insuficiência de dados. A diferença entre as duas interpretações é a diferença entre descartar um mercado erroneamente e investigá-lo por outra via.

Exigência de volume mínimo e dados insuficientes

Relacionada a isso está a exigência de volume mínimo que a ferramenta aplica para exibir qualquer coisa. Abaixo de determinado patamar de buscas na amostra, o termo simplesmente não retorna série — e esse patamar não é divulgado como um número fixo utilizável por quem consulta, o que é mais uma razão para tratar o silêncio como informação sobre a amostra e não sobre o mercado.

A consequência prática recai sobre termos longos e específicos, que são justamente os mais interessantes para decisão de nicho. Um termo de cauda longa raramente atinge o limiar em uma comparação regional, e raramente atinge em um recorte temporal curto. A tentação é concluir que não há interesse; a conclusão correta é que a ferramenta não tem resolução para responder naquele recorte.

Quando isso acontece, o caminho é subir um nível de agregação: ampliar a janela temporal, subir do município para a unidade intermediária, ou trocar o termo por uma formulação mais ampla e usar qualificadores em outra etapa. Nenhuma dessas manobras resolve o problema de fundo, mas todas evitam a conclusão falsa de que o mercado não existe.

Diferença de vocabulário por país

Antes de qualquer comparação regional, existe uma verificação prévia que não é opcional: o termo precisa ser o termo local. A diferença de vocabulário por país é o fator que mais frequentemente invalida estudos comparativos bem-intencionados, e o faz de modo silencioso — os dois países retornam curvas, os gráficos parecem comparáveis, e a comparação está sendo feita entre duas coisas diferentes.

O fenômeno aparece em pelo menos três formas. A mais óbvia é o idioma: um mesmo conceito tem nomes distintos em português e em espanhol, e a tradução literal quase nunca é o termo que as pessoas digitam. A segunda é a variante dentro do mesmo idioma, que em mercados grandes é decisiva. A terceira é o empréstimo: em vários setores, o termo em inglês é o que se pesquisa, e traduzi-lo produz uma curva de volume irrelevante.

O procedimento que evita o erro é verificar, dentro da própria ferramenta e em buscas comuns, qual formulação cada mercado realmente usa, e só então comparar — em muitos casos comparando mais de uma variante por mercado e somando a leitura qualitativamente. Comparar um termo traduzido contra um termo nativo não mede diferença de interesse; mede diferença de tradução.

Intenção informacional e intenção transacional

Não basta que o termo seja o termo local; é preciso que ele carregue a intenção certa. A distinção entre intenção informacional e intenção transacional é o que separa interesse de demanda endereçável, e ela se manifesta na própria formulação da busca.

Perguntas de como e por que, comparações genéricas e definições pertencem ao campo informacional: indicam curiosidade, estudo, estágio inicial de descoberta. Formulações que incluem comprar, melhor, avaliação, preço ou o nome de uma categoria seguido de recomendação pertencem ao campo transacional: indicam proximidade de decisão. Somente o segundo campo se aproxima de intenção de compra, e mesmo assim de forma indireta.

Já tratamos, em texto anterior desta série, da leitura de intenção a partir da composição dos resultados de busca. Aqui basta a consequência: uma comparação regional feita sobre termos informacionais pode inverter completamente a ordenação que apareceria sobre termos transacionais. Um país pode liderar em curiosidade e ficar atrás em propensão a comprar, e os dois gráficos são verdadeiros.

Sincronia entre países

Um sinal isolado é frágil; um sinal repetido em lugares diferentes é bem mais robusto. A sincronia entre países é o critério que separa tendência estrutural de ruído local: quando três ou quatro mercados distintos sobem de forma sustentada ao longo de vários meses, a probabilidade de que se trate de uma mudança real de comportamento é muito maior do que quando um único país apresenta um pico.

O motivo é que causas locais — uma notícia, uma regulamentação, uma campanha, um evento esportivo — afetam um mercado por vez. Causas estruturais — mudança de tecnologia, mudança de hábito, novo ciclo de preço — tendem a aparecer em vários mercados com defasagens curtas. Observar vários países na mesma janela é, portanto, um filtro de causalidade.

O inverso merece o mesmo cuidado: um pico agudo e isolado, com duração de dias, é quase sempre ruído disfarçado de tendência. Antes de agir sobre ele, vale verificar se o mesmo movimento aparece em países vizinhos e se persiste em janelas mensais. A persistência é mais informativa do que a amplitude.

Diferença sazonal entre hemisférios

A sazonalidade é o caso em que a comparação regional é mais necessária e mais frequentemente esquecida. Um mesmo conceito associado a verão, a volta às aulas ou a uma data comercial tem picos separados por cerca de seis meses entre o hemisfério norte e o hemisfério sul, e tratar a curva como se fosse única produz um calendário que erra os dois lados.

A diferença sazonal entre hemisférios também não se resume à inversão de datas. Há estações que não existem em boa parte dos mercados tropicais, há períodos de chuva que deslocam demanda de forma regional, e há calendários fiscais e regulatórios locais que criam picos próprios. A curva agregada do país costuma esconder todo esse detalhamento.

Em texto anterior desta série tratamos da antecedência necessária entre publicação e pico de demanda — contar para trás a partir do momento em que o interesse chega. Esse raciocínio se aplica duas vezes quando se opera nos dois hemisférios: duas curvas, duas contagens, dois calendários de produção. Publicar uma única peça no meio do caminho significa chegar atrasado nos dois.

Propriedade de busca

A propriedade de busca — pesquisa na web, em imagens, em notícias, em compras ou no YouTube — não é um filtro cosmético. Cada uma dessas superfícies responde a uma intenção distinta e é povoada por uma população distinta de consultas, e a comparação entre elas frequentemente revela o que a pesquisa web sozinha esconde.

O caso mais comum em análise de mercado é o de um termo frio na pesquisa web e quente na pesquisa em vídeo. Isso costuma indicar um mercado onde o conteúdo de apoio é assistido em vez de lido, e onde a estratégia de texto terá alcance muito menor do que a curva agregada sugeria. O inverso também ocorre e é igualmente decisivo.

A recomendação metodológica é simples: antes de concluir que um mercado é frio, verificar a mesma consulta em pelo menos duas superfícies. Um mercado que parece pequeno na web e grande em vídeo não é pequeno; é um mercado de outro formato. Ignorar essa distinção é uma das formas mais comuns de descartar mercados que eram viáveis.

Mercados com buscadores alternativos

Este é o ponto que, se omitido, pode inverter uma decisão inteira. O dado do Google Trends descreve busca feita no Google. Em mercados onde outro mecanismo de busca tem participação relevante — situação em que costumam aparecer nomes como Yandex ou Baidu, entre outros, dependendo do país — a amostra não representa o comportamento de busca local, e a sub-representação não é neutra: ela é sistemática e puxa o índice para baixo.

Nesses mercados com buscadores alternativos, um valor baixo no mapa não significa interesse baixo. Significa interesse baixo na fração do mercado que o instrumento consegue observar. E como a participação de mecanismos varia muito por país, a distorção varia por país, o que é exatamente o que destrói a validade de um ranking.

A consequência é direta: rankings regionais construídos apenas com esse dado não devem incluir mercados onde a participação do buscador de referência é minoritária. Esses mercados precisam ser avaliados por outra via — dados próprios, ferramenta de volume local, pesquisa de categoria — e comparados com cautela, ou deixados fora da comparação com nota explícita sobre o motivo.

Hiato de interesse e adoção

Existe uma discussão, em literatura acadêmica e de mercado, sobre a relação temporal entre interesse de busca e adoção efetiva de uma categoria. A observação é direcional: em alguns setores, o interesse medido em busca antecede indicadores de adoção em semanas, e em outros a relação é simultânea ou invertida, com a adoção puxando a busca.

Apresentamos isso como hipótese de leitura, não como capacidade de previsão. O hiato de interesse e adoção não é constante, não é medido por nós e não deve ser usado para projetar receita com precisão que o dado não tem. O que ele justifica é uma postura: tratar a curva como indicador antecedente possível e monitorá-la em conjunto com indicadores próprios, nunca isoladamente.

O uso prático mais defensável é qualitativo. Quando o interesse sobe em vários mercados antes de qualquer sinal nos seus próprios canais, vale investigar antes que o movimento apareça em dado de venda. Quando ele sobe em um mercado onde você já opera e não se converte em nada, vale investigar se o obstáculo é preço, distribuição ou formulação do termo.

Validação com ferramenta de volume

A etapa que transforma leitura em decisão é a validação com ferramenta de volume, e ela não é opcional em nenhum caso que envolva recurso. O índice relativo indica onde olhar; uma ferramenta de volume indica quantas pessoas olham; e dados próprios indicam quantas dessas pessoas se convertem.

No caso de decisão regional, recomendamos que a validação seja feita em pelo menos três fontes independentes: uma ferramenta de estimativa de volume por palavra-chave, o relatório de desempenho do Search Console nos mercados onde já existe presença, e a base de clientes, separando origem geográfica. A convergência das três é o que autoriza alocação; a divergência é o que indica que o sinal era ruído.

Vale registrar o óbvio que costuma ser esquecido: quem já opera em um mercado tem, nos próprios dados, uma fonte melhor do que qualquer ferramenta pública. O uso mais maduro da comparação regional não é descobrir onde entrar, e sim verificar se a curva do mercado explica o comportamento dos próprios números — e, quando não explica, descobrir por quê.

Decisão de entrada em mercado

Chegando ao fim, a pergunta que interessa é o que muda na prática. A decisão de entrada em mercado raramente é binária; ela se desdobra em pelo menos três formatos de compromisso, e a escolha entre eles depende menos do tamanho da curva do que da distância entre os mercados.

Quando terminologia, regulação e contexto cultural divergem de forma substantiva, faz sentido construir presença própria para aquele mercado: páginas dedicadas, vocabulário local, exemplos locais, referências regulatórias locais. O custo é alto e se justifica pela distância, não pelo volume.

Quando a intenção e a terminologia são próximas, consolidar em um único ativo e localizar metadados, exemplos e unidades costuma ser mais eficiente do que duplicar estrutura. Criar duas páginas concorrentes para mercados que pesquisam a mesma coisa com as mesmas palavras não captura mais demanda: divide sinais.

O critério que organiza a escolha é a distância semântica, e a comparação regional de tendências é útil exatamente para medi-la — não para medir tamanho, mas para verificar se dois mercados nomeiam e desejam a mesma coisa. Essa é uma pergunta que o instrumento responde bem, e é a que menos se faz.

O que este texto não é

Este é um texto de pesquisa editorial sobre o funcionamento e os limites de uma ferramenta pública de interesse de busca. Não é consultoria, não é metodologia validada por nós e não garante resultado comercial — nenhuma leitura de curva relativa garante retorno, porque a decisão depende de custo, margem, distribuição e execução, nenhum dos quais aparece no gráfico.

Também não é um manual de operação passo a passo. Descrevemos mecanismos e vieses porque é neles que estão os erros; a aplicação depende do contexto de cada operação e de dados que só quem opera possui.

A síntese é a seguinte: a ferramenta é um espelho relativo, amostrado e normalizado, que informa muito bem sobre direção, forma e proporção, e não informa nada sobre magnitude. Todo uso legítimo dela começa por reconhecer esse limite. Todo erro caro começa por esquecê-lo — e o erro mais comum continua sendo o do começo deste texto: ler dois cem como se fossem o mesmo volume.

Continuar lendo

Encontre a próxima pergunta que vale testar.

Percorra o arquivo com pesquisa sobre estratégia de conteúdo, busca social, GEO e geração de leads B2B.

Ver o arquivo