Periscopy
Artigos
Metodologia7 min de leitura

Como medir GEO: citation rate, share of voice e menção

Três métricas para perceber se o trabalho de GEO está a render: citation rate, share of voice e taxa de menção, com metodologia para correr internamente.


Há três métricas que importam em GEO: citation rate (com que frequência é mencionado), share of voice (a sua quota face aos concorrentes) e taxa de menção (que evolução depois de uma iniciativa). Este texto descreve a metodologia para correr cada uma internamente, conjunto de perguntas, cadência, repetições, gestão da variabilidade, sem ferramentas pagas. As mesmas três métricas que usamos com os nossos clientes.

Key takeaways
  • três métricas resolvem 90% da pergunta "está a funcionar?"
  • um conjunto fixo de perguntas (30 a 100) é a fundação; sem isso não há comparação válida
  • medir nos quatro motores principais (ChatGPT, Claude, Gemini, Perplexity) em paralelo
  • mensal para linha de base; semanal em fase ativa de otimização
  • 3 a 5 repetições por pergunta mais temperatura zero reduz a variabilidade ao mínimo

Porque há três métricas, não uma

Cada métrica responde a uma pergunta diferente. O citation rate responde a: aparecemos? O share of voice responde a: aparecemos comparado com a concorrência? A taxa de menção responde a: melhorou desde que começámos?

Em isolamento, qualquer uma delas mente. Um citation rate de 60% parece bom, até descobrir que os concorrentes estão a 80%. Um share of voice de 40% parece bom, até descobrir que o mercado total está a colapsar. Uma taxa de menção positiva parece boa, até perceber que a base era zero.

As três em conjunto dão a fotografia. É assim que medimos.

A fundação: o conjunto de perguntas

Tudo começa por um conjunto fixo de perguntas que representa como compradores reais investigam o setor. Sem conjunto estável, as métricas mudam por mudança de input, e perde-se a capacidade de comparar entre períodos.

Boas regras na construção:

  • 30 a 100 perguntas. Para SaaS B2B em Portugal, 50 cobre o terreno relevante.
  • Mistura de intenções. Comparação (melhor X para Y), avaliação (X é bom para Y?), descoberta (quem oferece X), técnicas (como X resolve Y).
  • Linguagem natural. Não imitar pesquisa do Google (curta, com keywords). Compradores no ChatGPT escrevem parágrafos.
  • Em PT-PT e em inglês. Compradores B2B portugueses alternam idioma conforme a profundidade técnica.
  • Fixar e versionar. O conjunto é tratado como código: versionado, com registo de alterações e data de atualização.

Métrica 1: citation rate

A pergunta: em que percentagem das perguntas do conjunto somos citados?

Fórmula: (perguntas em que aparecemos) a dividir por (total de perguntas no conjunto), vezes 100.

Definição operacional importante: ser citado é ter o nome da marca explícito na resposta. Se o motor menciona uma característica do produto sem nomear, não conta. Se aparece numa lista, conta uma vez (não por número de ocorrências). Se aparece com URL, conta, mas com registo separado da menção pura, porque o sinal é diferente.

Linha de base típica para empresa portuguesa de SaaS B2B sem investimento prévio em GEO: perto de 0%. Após 3 a 6 meses de trabalho consistente, 30% a 60% é razoável dependendo da competitividade do nicho.

Métrica 2: share of voice

A pergunta: das menções da categoria, quanto é nosso?

Fórmula: resposta a resposta. Em cada resposta, contam-se as marcas distintas nomeadas, a sua e os concorrentes diretos. Se a sua estiver entre elas, leva 1/n dessa resposta, sendo n o número de marcas nomeadas. No fim, faz-se a média dessas frações sobre as respostas que nomeiam pelo menos uma marca.

Um exemplo com três respostas. A primeira nomeia-o a si e a um concorrente: leva 1/2. A segunda nomeia-o a si e a mais nove: leva 1/10. A terceira não nomeia ninguém: não entra na conta. O share of voice é a média entre 0,5 e 0,1, ou seja 30%.

Porquê assim e não menções a dividir por menções totais. Aparecer num par e aparecer numa lista de dez não valem o mesmo para quem lê a resposta, e a soma de menções trata as duas como se valessem. A média por resposta mantém o peso de cada aparição, e torna o número comparável entre categorias que respondem em listas curtas e categorias que respondem em listas longas.

Para calcular, precisa de uma lista de 5 a 15 marcas concorrentes diretas. Não inclua marcas que não são concorrentes reais, mesmo que apareçam (a AWS ou a Salesforce em respostas genéricas não contam para a sua share of voice na sua categoria).

Esta métrica é a mais difícil de mover, e a mais informativa. Um citation rate alto com share of voice baixo significa que está a aparecer, mas no meio de muitos outros quando o utilizador lê a resposta. Para B2B, em que a recomendação é decisiva, isso é ainda fraco.

Métrica 3: taxa de menção

A pergunta: quanto subiu o nosso citation rate desde a linha de base?

Fórmula: ((citation rate atual) menos (citation rate da linha de base)) a dividir por (citation rate da linha de base), vezes 100.

Se a linha de base é 0% (cenário comum), trate como pontos percentuais absolutos. Subiu de 0 para 28%? A subida é de 28 pontos.

Esta é a métrica para reportar progresso. Tenha o cuidado de a contextualizar com o share of voice em simultâneo; caso contrário, a subida pode ser ilusória (o mercado todo subiu, a posição relativa manteve-se).

Metodologia operacional

O processo mensal típico:

  1. Sessões limpas. Cada pergunta vai num chat novo, sem histórico. Nalguns motores isso obriga a abrir janela anónima.
  2. Temperatura zero. Onde a API permitir (Claude, Gemini, ChatGPT via API). Reduz a variabilidade.
  3. 3 a 5 repetições por pergunta. Use a média ou a moda das menções. Para SaaS com poucos concorrentes, 3 chega; em setores muito competitivos, 5.
  4. Quatro motores em paralelo. ChatGPT, Claude, Gemini (preferencialmente em AI Mode), Perplexity. Cada um tem o seu citation rate.
  5. Registo estruturado. Folha de cálculo ou ferramenta com colunas: motor, pergunta, citado (sim/não), posição na lista, marcas concorrentes mencionadas, repetição, data.
  6. Análise mensal. Comparação mês a mês das três métricas, por motor. Tendências por trimestre.

O que não medir (ainda)

Algumas métricas parecem atrativas mas não acrescentam sinal fiável em 2026:

  • Análise de sentimento das menções. Os modelos tendem a ser neutros ou positivos. A diferenciação é fraca.
  • Cliques nos endereços citados. Os motores ainda não expõem analytics de origem fiáveis (o Perplexity é a exceção parcial). Esperar 12 a 18 meses.
  • Volume de tráfego de origem IA. Os headers de referrer são inconsistentes. Estimar é especulação.

Manter-se nas três métricas base até as outras maturarem é o caminho disciplinado.

Ferramentas: à mão ou pagas

Para arrancar, à mão chega:

  • O conjunto de perguntas numa folha de cálculo versionada.
  • Corrida manual com quatro separadores no browser, um por motor.
  • Anotação direta na folha com um visto (sim/não) e a lista de marcas mencionadas.

Cobertura: 50 perguntas vezes 4 motores vezes 3 repetições dá 600 interações. Uma pessoa faz em meio dia, uma vez por mês. É repetitivo, mas dá uma fotografia fiel a baixo custo.

Quando faz sentido pagar por ferramenta: quando o conjunto cresce acima de 100, quando a cadência precisa de ser semanal ou diária, ou quando a equipa quer poupar tempo operacional. Aí ferramentas do género da Profound, da Otterly ou da Peec fazem sentido: pesam o trabalho de execução, não o de decisão.

Reportar internamente

Um relatório de uma página. Topo: as três métricas, com variação mês a mês. Meio: perguntas em que perdemos posição (e porquê: o concorrente X subiu, o motor Y mudou de comportamento). Fundo: 1 a 3 ações para o mês seguinte.

Resistir à tentação de slides bonitos com 20 gráficos. Para a maioria das equipas, três números bem entendidos valem mais do que dashboards complexos.

Perguntas frequentes

Posso medir GEO só com o ChatGPT?

Pode, mas não chega. Cada motor tem dataset e comportamento próprio. Medir apenas no ChatGPT dá uma fotografia parcial; idealmente cobrir ChatGPT, Claude, Gemini e Perplexity em paralelo para o mesmo conjunto de perguntas.

Com que frequência devo medir?

Mensal para linha de base. Semanal se estiver a correr uma iniciativa de otimização ativa (quer ver a curva). Diário só faz sentido em fases de lançamento de algo num motor (uma funcionalidade nova, por exemplo); caso contrário é ruído.

Quantas perguntas no conjunto?

Entre 30 e 100. Menos do que 30 dá amostra fraca; mais do que 100 sem haver volume real de mercado por trás é overengineering. Para SaaS B2B portuguesa, 50 perguntas cobrem bem o terreno.

Como lido com a variabilidade entre repetições?

Médias de 3 a 5 repetições por pergunta, temperatura constante (idealmente 0 nos modelos que o permitem), sessões limpas (sem histórico anterior). A variabilidade reduz-se mas não desaparece: é uma propriedade dos modelos.

A ler a seguir

Publicado primeiro em destaque.ai/blog/como-medir-geo-citation-rate-share-of-voice