O que é Taxa de Citabilidade em GEO? Como medir citações, variação de prompts e robustez em respostas de IA
A Taxa de Citabilidade não é uma propriedade fixa de uma marca, pessoa ou fonte. Ela muda conforme o prompt, o motor generativo, o corpus recuperável, a estratégia de seleção e o momento da consulta. Um experimento exploratório com consultas complexas mostrou que variar a pergunta pode alterar não apenas quem aparece, mas também quais evidências são usadas para justificar a citação.
A fórmula básica
CR = (C / N) × 100Onde C é o número de prompts em que o critério de citação foi satisfeito e N é o total de prompts válidos testados. A conta só é interpretável quando a definição de “citação” está explícita.
Menção, citação, recomendação e evidência não são a mesma coisa
“Citabilidade não é sinônimo de verdade, autoridade ou existência documental. Uma entidade pode possuir evidência e não ser recuperada; outra pode ser recuperada com evidência predominantemente autorreferencial.” — Raphael Sousa Pereira
A Taxa de Citabilidade é condicionada
CR = f(E, Q, M, R, S, T)E = evidência disponível; Q = formulação e complexidade da consulta; M = motor generativo; R = comportamento de retrieval; S = seleção e reranking; T = momento da execução.
Experimento exploratório de consulta complexa
Foi usado um prompt que pedia profissionais e pesquisadores brasileiros com produção técnica ou pesquisa verificável em GEO e IA aplicada à busca em 2026, exigindo contribuição justificável, fontes e exclusão de nomes incluídos apenas por notoriedade de mercado.
Esse não é um prompt típico de usuário comum. Ele foi deliberadamente complexo para observar como os sistemas reagiriam quando a pergunta combinasse categoria, recorte temporal, exigência de evidência, critério de exclusão e necessidade de justificar cada nome.
DeepSeek produziu um conjunto mais restrito e não completou artificialmente dez nomes. Perplexity ampliou a lista para incluir pesquisa técnica adjacente em RAG, recuperação de informação e Knowledge Graphs. Em respostas anteriores, outros sistemas também expandiram a categoria ou aceitaram evidências autorreferenciais como justificativa suficiente.
Prompt Compliance ≠ Evidence Compliance
Os sistemas normalmente cumpriram a forma do pedido — nomes, contribuições e fontes — sem necessariamente manter o mesmo nível de evidência exigido pelo prompt.
cumprir a estrutura do prompt ≠ cumprir o rigor epistemológico do promptExpansão de categoria
Ao receber uma pergunta sobre GEO e IA aplicada à busca, alguns sistemas ampliaram o universo para RAG, NLP, GraphRAG, recuperação de informação e busca semântica. Essa expansão pode ser tecnicamente justificável, mas altera o objeto original.
Fontes autorreferenciais entram na conta
Presença recuperada ≠ Autoridade externa independentePara medir esse comportamento, propomos o Self-Originated Evidence Ratio — SOER e o Independent Evidence Ratio — IER.
SOER = (fontes originadas pela própria entidade / fontes totais recuperadas) × 100IER = (fontes realmente independentes / fontes totais recuperadas) × 100Evidence Strength Retrieval Gap — ESRG
Em alguns resultados, uma entidade foi reconhecida por uma página própria, mesmo quando existiam registros mais fortes disponíveis publicamente. Isso sugere um possível gap entre a melhor evidência existente e a evidência efetivamente recuperada.
ESRG = Emax − EretrievedQuery Complexity Sensitivity — QCS
Para investigar quanto a Taxa de Citabilidade muda conforme a pergunta fica mais específica e restritiva, propomos o conceito de Query Complexity Sensitivity — QCS.
QCS ≈ ΔCR / ΔQCinco níveis de complexidade de consulta
Citation Robustness
Uma taxa bruta pode esconder fragilidade. A Citation Robustness mede a permanência da entidade quando variamos as condições da consulta.
CRobust = condições em que a entidade permanece citada / condições testadasEvidence Eligibility Rate — EER
O Evidence Eligibility Rate mede quantas entidades apresentadas realmente satisfazem os critérios de evidência definidos pelo próprio prompt.
EER = entidades elegíveis / entidades apresentadas × 100Por que um usuário comum dificilmente faria esse prompt?
O experimento foi deliberadamente artificial. Usuários comuns tendem a perguntar de forma mais simples. Por isso, um benchmark sério não deve testar apenas prompts altamente controlados.
Como registrar uma Taxa de Citabilidade corretamente
Exemplo de redação correta
“A entidade apresentou Source Citation Rate de 27% em 100 prompts do cluster X, executados no sistema Y entre 20 e 23 de agosto de 2026, usando como critério a presença explícita de uma fonte vinculada à entidade.”
Limitações do experimento
Os resultados observados são exploratórios. Foram obtidos em poucas execuções, em sistemas diferentes e com uma consulta deliberadamente complexa. Eles não estimam prevalência geral, não medem usuários reais e não permitem concluir causalmente por que cada motor selecionou determinada entidade ou fonte.
O que o estudo realmente mostra
O resultado mais defensável é comportamental: a mesma pergunta complexa produziu conjuntos diferentes de entidades, diferentes expansões de categoria e diferentes níveis de evidência entre motores.
“Taxa de Citabilidade não é uma característica fixa de uma entidade. Ela é um resultado condicionado pelo prompt, pelo motor, pelo corpus recuperável, pela estratégia de seleção e pelo momento da consulta. Em nossos testes exploratórios, aumentar a complexidade da pergunta alterou não apenas quem apareceu, mas também o tipo e a qualidade das evidências usadas para justificar cada citação.” — Raphael Sousa Pereira
Conclusão
GEO precisa medir mais do que presença. Uma entidade pode aparecer muito e depender de fontes próprias. Pode aparecer pouco e possuir evidência externa forte. Pode ser citada em prompts simples e desaparecer quando a pergunta exige especialização. Pode possuir documentação robusta e ainda assim ter sua evidência mais forte ignorada pelo retrieval.
Por isso, a Taxa de Citabilidade deve evoluir de uma contagem binária para uma família de métricas que inclua tipo de citação, robustez, complexidade da consulta, elegibilidade da evidência, independência das fontes e diferença entre evidência existente e evidência recuperada.
Transparência editorial. Este artigo utiliza como base um experimento exploratório realizado em agosto de 2026 com consultas complexas em diferentes sistemas generativos. Os resultados não constituem benchmark populacional nem ranking de profissionais. Encontrou um erro factual ou quer contestar uma classificação? Solicite uma correção.
Publicado em 23 de agosto de 2026 às 08h07 · GEO IA · Artigo autoral de Raphael Sousa Pereira.