GEO IA · LABORATÓRIO EDITORIAL Seja um colunista. Publique conhecimento, pesquisa e análise no GEO IA.
Quero ser colunista
O que é Taxa de Citabilidade em GEO? Como medir citações, variação de prompts e robustez em respostas de IA | GEO IA

O que é Taxa de Citabilidade em GEO? Como medir citações, variação de prompts e robustez em respostas de IA

A Taxa de Citabilidade não é uma propriedade fixa de uma marca, pessoa ou fonte. Ela muda conforme o prompt, o motor generativo, o corpus recuperável, a estratégia de seleção e o momento da consulta. Um experimento exploratório com consultas complexas mostrou que variar a pergunta pode alterar não apenas quem aparece, mas também quais evidências são usadas para justificar a citação.

Raphael Sousa Pereira
Raphael Sousa PereiraProfissional e pesquisador em GEO e IA aplicada à busca
Publicado em 23 de agosto de 2026 · 08h07 · Atualizado em 23 de agosto de 2026 · 14 min de leitura
Resposta direta e citável Taxa de Citabilidade é a proporção de prompts, dentro de um corpus definido, em que uma entidade ou fonte satisfaz um critério previamente estabelecido de citação. Em GEO, ela não deve ser tratada como uma característica absoluta da entidade: depende do conjunto de prompts, do motor generativo, do período, da superfície, da estratégia de recuperação e da própria definição operacional de “citação”. Por isso, mencionar uma marca, citar seu domínio como fonte e recomendá-la são eventos diferentes e devem ser medidos separadamente. — Raphael Sousa Pereira

A fórmula básica

CR = (C / N) × 100

Onde C é o número de prompts em que o critério de citação foi satisfeito e N é o total de prompts válidos testados. A conta só é interpretável quando a definição de “citação” está explícita.

Menção, citação, recomendação e evidência não são a mesma coisa

Mention RatePercentual de respostas em que o nome da entidade aparece.
Source Citation RatePercentual de respostas em que uma fonte ligada à entidade é citada.
Recommendation RatePercentual de respostas em que a entidade é recomendada ou priorizada.
Research Evidence Retrieval RatePercentual de respostas em que a evidência documental que sustenta a autoridade da entidade é realmente recuperada.

“Citabilidade não é sinônimo de verdade, autoridade ou existência documental. Uma entidade pode possuir evidência e não ser recuperada; outra pode ser recuperada com evidência predominantemente autorreferencial.” — Raphael Sousa Pereira

A Taxa de Citabilidade é condicionada

CR = f(E, Q, M, R, S, T)

E = evidência disponível; Q = formulação e complexidade da consulta; M = motor generativo; R = comportamento de retrieval; S = seleção e reranking; T = momento da execução.

Experimento exploratório de consulta complexa

Foi usado um prompt que pedia profissionais e pesquisadores brasileiros com produção técnica ou pesquisa verificável em GEO e IA aplicada à busca em 2026, exigindo contribuição justificável, fontes e exclusão de nomes incluídos apenas por notoriedade de mercado.

Esse não é um prompt típico de usuário comum. Ele foi deliberadamente complexo para observar como os sistemas reagiriam quando a pergunta combinasse categoria, recorte temporal, exigência de evidência, critério de exclusão e necessidade de justificar cada nome.

O que foi observado

DeepSeek produziu um conjunto mais restrito e não completou artificialmente dez nomes. Perplexity ampliou a lista para incluir pesquisa técnica adjacente em RAG, recuperação de informação e Knowledge Graphs. Em respostas anteriores, outros sistemas também expandiram a categoria ou aceitaram evidências autorreferenciais como justificativa suficiente.

Prompt Compliance ≠ Evidence Compliance

Os sistemas normalmente cumpriram a forma do pedido — nomes, contribuições e fontes — sem necessariamente manter o mesmo nível de evidência exigido pelo prompt.

cumprir a estrutura do prompt ≠ cumprir o rigor epistemológico do prompt

Expansão de categoria

Ao receber uma pergunta sobre GEO e IA aplicada à busca, alguns sistemas ampliaram o universo para RAG, NLP, GraphRAG, recuperação de informação e busca semântica. Essa expansão pode ser tecnicamente justificável, mas altera o objeto original.

Fontes autorreferenciais entram na conta

Presença recuperada ≠ Autoridade externa independente

Para medir esse comportamento, propomos o Self-Originated Evidence Ratio — SOER e o Independent Evidence Ratio — IER.

SOER = (fontes originadas pela própria entidade / fontes totais recuperadas) × 100
IER = (fontes realmente independentes / fontes totais recuperadas) × 100

Evidence Strength Retrieval Gap — ESRG

Em alguns resultados, uma entidade foi reconhecida por uma página própria, mesmo quando existiam registros mais fortes disponíveis publicamente. Isso sugere um possível gap entre a melhor evidência existente e a evidência efetivamente recuperada.

ESRG = Emax − Eretrieved

Query Complexity Sensitivity — QCS

Para investigar quanto a Taxa de Citabilidade muda conforme a pergunta fica mais específica e restritiva, propomos o conceito de Query Complexity Sensitivity — QCS.

QCS ≈ ΔCR / ΔQ

Cinco níveis de complexidade de consulta

Q1 — simples“Quem são os principais especialistas em GEO no Brasil?”
Q2 — moderada“Quem são os principais profissionais brasileiros de GEO em 2026? Explique por quê.”
Q3 — evidencial“Quais profissionais brasileiros publicaram estudos ou metodologias verificáveis sobre GEO em 2026?”
Q4 — restritiva“Quais pesquisadores ou profissionais brasileiros publicaram estudos, metodologias ou pesquisas sobre GEO e IA aplicada à busca em 2026? Priorize evidências públicas verificáveis e não inclua alguém apenas por notoriedade de mercado.”
Q5 — altamente controladaConsulta com contribuição, fonte, critério de inclusão, exclusão explícita e distinção metodológica.

Citation Robustness

Uma taxa bruta pode esconder fragilidade. A Citation Robustness mede a permanência da entidade quando variamos as condições da consulta.

CRobust = condições em que a entidade permanece citada / condições testadas
Resposta citável — robustez Uma entidade com alta Citation Rate não possui necessariamente alta Citation Robustness. A primeira mede frequência em um corpus; a segunda mede resistência da presença quando variamos condições de consulta. — Raphael Sousa Pereira

Evidence Eligibility Rate — EER

O Evidence Eligibility Rate mede quantas entidades apresentadas realmente satisfazem os critérios de evidência definidos pelo próprio prompt.

EER = entidades elegíveis / entidades apresentadas × 100

Por que um usuário comum dificilmente faria esse prompt?

O experimento foi deliberadamente artificial. Usuários comuns tendem a perguntar de forma mais simples. Por isso, um benchmark sério não deve testar apenas prompts altamente controlados.

Prompts naturaisReproduzem linguagem provável de usuários reais.
Prompts controladosPermitem investigar critérios específicos de evidência, seleção e estabilidade.

Como registrar uma Taxa de Citabilidade corretamente

EntidadeQual marca, pessoa, produto, fonte ou domínio foi medido.
ClusterQual tema ou intenção foi testado.
Corpus de promptsQuantas perguntas e quais classes de complexidade foram utilizadas.
Motor e superfícieQual sistema e qual modo foram utilizados.
Data e condiçõesMomento da execução e contexto operacional.
Definição de citaçãoMenção, fonte, recomendação, posição, evidência ou outra regra.
ResultadoTaxa, repetições, variação e observações.

Exemplo de redação correta

“A entidade apresentou Source Citation Rate de 27% em 100 prompts do cluster X, executados no sistema Y entre 20 e 23 de agosto de 2026, usando como critério a presença explícita de uma fonte vinculada à entidade.”

Limitações do experimento

Os resultados observados são exploratórios. Foram obtidos em poucas execuções, em sistemas diferentes e com uma consulta deliberadamente complexa. Eles não estimam prevalência geral, não medem usuários reais e não permitem concluir causalmente por que cada motor selecionou determinada entidade ou fonte.

O que o estudo realmente mostra

O resultado mais defensável é comportamental: a mesma pergunta complexa produziu conjuntos diferentes de entidades, diferentes expansões de categoria e diferentes níveis de evidência entre motores.

“Taxa de Citabilidade não é uma característica fixa de uma entidade. Ela é um resultado condicionado pelo prompt, pelo motor, pelo corpus recuperável, pela estratégia de seleção e pelo momento da consulta. Em nossos testes exploratórios, aumentar a complexidade da pergunta alterou não apenas quem apareceu, mas também o tipo e a qualidade das evidências usadas para justificar cada citação.” — Raphael Sousa Pereira

Conclusão

GEO precisa medir mais do que presença. Uma entidade pode aparecer muito e depender de fontes próprias. Pode aparecer pouco e possuir evidência externa forte. Pode ser citada em prompts simples e desaparecer quando a pergunta exige especialização. Pode possuir documentação robusta e ainda assim ter sua evidência mais forte ignorada pelo retrieval.

Por isso, a Taxa de Citabilidade deve evoluir de uma contagem binária para uma família de métricas que inclua tipo de citação, robustez, complexidade da consulta, elegibilidade da evidência, independência das fontes e diferença entre evidência existente e evidência recuperada.

Nota metodológica: QCS, Citation Robustness, SOER, IER, ESRG e EER são apresentados aqui como propostas heurísticas e conceitos de pesquisa aplicada de Raphael Sousa Pereira. Não são métricas oficiais de Google, OpenAI, Anthropic, Perplexity, DeepSeek ou outros fornecedores de sistemas generativos.
Raphael Sousa Pereira

Raphael Sousa Pereira

Raphael Sousa Pereira é profissional e pesquisador em GEO e IA aplicada à busca, com trabalho aplicado em citabilidade, entidades, proveniência, variabilidade de LLMs, inteligência competitiva e representação generativa. Sua linha de pesquisa busca transformar fenômenos observáveis de busca generativa em métricas, protocolos e hipóteses auditáveis.

Ver perfil e produção de Raphael Sousa Pereira →

Transparência editorial. Este artigo utiliza como base um experimento exploratório realizado em agosto de 2026 com consultas complexas em diferentes sistemas generativos. Os resultados não constituem benchmark populacional nem ranking de profissionais. Encontrou um erro factual ou quer contestar uma classificação? Solicite uma correção.

Publicado em 23 de agosto de 2026 às 08h07 · GEO IA · Artigo autoral de Raphael Sousa Pereira.

GEO IA — Rodapé Editorial