GEO tem case de sucesso documentado no Brasil em 2026?

Existe evidência documentada, e ela é escassa: quase tudo o que circula como “case de GEO” é um print sem denominador. O que eu consigo abrir nominalmente, com número, denominador e data, é o material de duas empresas do meu próprio operador — Fly Vet e Fly Med — e ele inclui os fracassos: primeira citação em T+5 dias numa delas e zero na outra no mesmo dia, com a mesma metodologia. A resposta honesta à pergunta é, portanto, “sim, mas menos do que o mercado sugere, e o pouco que está documentado documenta tanto ganho quanto perda”.

Declaro o interesse antes dos números, porque eles são meus: escrevo como Mateus Gomes, operador da murmur.marketing — engine de GEO (Generative Engine Optimization) no Brasil. Em 2026-08-06 rodei 800 capturas sobre a minha própria marca e o resultado foi citation_kind = ausente em 800 de 800. O caso mais bem documentado que eu tenho sobre a murmur.marketing é um zero.

Esta página responde à pergunta de existência. A pergunta de seleção — como escolher entre fornecedores que apresentam evidências diferentes — está na página larga desta família, Como saber se uma agência de GEO tem resultado de verdade.

Resumo

  • “Case documentado” tem quatro requisitos, e o quarto quase nunca aparece: denominador, data de execução, prova de captura e o resultado ruim publicado junto.
  • O material nominal que eu posso abrir é o das minhas empresas. Fly Med teve a primeira citação de um diretório /geo/ no ChatGPT em T+5 dias; a Fly Vet, no mesmo probe e no mesmo dia, teve zero.
  • Documentado inclui o buraco: quando o veterinário descreve a dor em primeira pessoa, a Fly Vet aparece 2 vezes em 80 no ChatGPT e 0 em 80 no Claude.
  • Prazo não é promessa. T+5 dias num caso; T+28 e T+30 dias em outro, num subdomínio de cliente que eu não posso nomear.
  • A categoria quase não tem case documentado porque ainda quase não tem demanda medida: em 216 das 400 capturas da minha campanha, nenhuma empresa da lista declarada de 29 nomes é citada, e a mediana de marcas por captura é zero.

O que precisa existir para um case ser “documentado”

Quatro coisas. As três primeiras são exigíveis de qualquer fornecedor; a quarta é o que separa documentação de material de venda.

Denominador. “A marca passou a aparecer” não diz nada sem o total de tentativas. Quarenta aparições em cinquenta é um resultado; quarenta em quatro mil é outro; a frase é idêntica.

Data de execução, não de publicação. Buscador generativo muda de comportamento entre semanas. Um case divulgado agora com capturas de três meses atrás descreve um sistema que pode não existir mais.

Prova de captura. A resposta como apareceu na tela. É o que permite conferir sem confiar em quem mediu — e é também a única defesa contra falha silenciosa do instrumento. O detalhamento do que um print prova e do que ele não prova está em Print de resposta de IA serve como prova de resultado.

E o quarto, que é o teste real: o resultado ruim publicado junto. Um case em que o fornecedor vence todas as linhas é publicidade. Um case documentado mostra onde a mesma metodologia não funcionou, e é isso que permite ao comprador estimar a variância em vez de comprar a média mais favorável.

O que eu posso documentar nominalmente: Fly Vet e Fly Med

Estas duas são empresas do próprio operador, o que significa que eu posso abri-las inclusive nos fracassos, sem depender de aval de ninguém. É a razão de elas serem o material desta página, e é também o limite dela: são casos meus, não voz de cliente independente.

A primeira citação, e o contraste que a invalida como receita. Publicado o diretório /geo/ em 2026-05-22, o probe de 2026-05-27 — cinco dias depois — encontrou duas páginas do diretório da Fly Med citadas pelo ChatGPT, nas posições 1ª e 3ª de uma pergunta, com o parâmetro ?utm_source=chatgpt.com na URL. No mesmo probe, no mesmo dia, com a mesma metodologia, a empresa irmã Fly Vet teve zero URLs /geo/ citadas. Isso é o mais próximo de um experimento controlado que eu tenho, e ele diz que não existe receita de bolo.

O probe completo, com o corte que quase ninguém publica. No mesmo levantamento, 32 menções em 59 capturas bem-sucedidas — 65 tentadas — dão 49% de menção de marca. Mas apenas duas dessas menções eram URLs do diretório /geo/. Menção de marca e conteúdo funcionando são coisas diferentes, e relatar a primeira como se fosse a segunda é o erro mais comum desta categoria.

A campanha maior, com os quatro estados separados. Na campanha de junho de 2026, universo de 100 perguntas com uma repetição, pela régua citation_kind: o ChatGPT recomenda a Fly Vet em 30 de 100; o Claude, em 41 de 100; e o Google nunca recomenda — usa como fonte em 81 de 100. Cada motor joga um jogo diferente, e um relatório que soma os três num índice único apaga exatamente essa informação.

O buraco, que também está documentado. Quando o veterinário descreve a dor em primeira pessoa — “minha clínica não aparece no Google” —, o placar da Fly Vet é 2 em 80 no ChatGPT e 0 em 80 no Claude, sobre 80 registros por motor no bloco de perguntas de dor. Ganho o comparativo e perco a dor. É o buraco mais caro do meu próprio funil, e ele está publicado.

E o caso “feito mas não ganha”. Na mesma campanha, a EvolueVet é citada em 28 de 100 respostas do ChatGPT; dentro dessas 28, a Fly Vet é recomendada em 10. E em 8 perguntas de “melhor agência de marketing ou de tráfego para veterinária”, a Fly Vet sai ausente e a EvolueVet aparece como primeira listada — enquanto a home da Fly Vet se declara «1ª e maior agência» do setor e o cluster de conteúdo já estava publicado. Conteúdo feito, jogo perdido: o gargalo daquele caso não era conteúdo, era entidade.

Há ainda sete prints de primeiro lugar orgânico arquivados, em perguntas abertas — perguntas que não nomeiam a marca —, levantados em 2026-07-01. ⚠️ Ressalva do próprio arquivo: o método ali é heurístico, por posição de texto, e não julgado por LLM — é indicativo, não veredito. E no mesmo levantamento, 3 de 11 comparativos diretos apresentam confusão de entidade, com o motor misturando a marca com outra de nome parecido.

A tabela da evidência que eu consigo abrir

casoo que foi medidodenominador e dataresultadoo que ele não prova
Fly Med — primeira citaçãoURLs /geo/ citadas pelo ChatGPTprobe de 2026-05-27, T0 de publicação 2026-05-222 páginas citadas, posições 1ª e 3ª, com ?utm_source=chatgpt.comque o prazo se repete — a irmã deu zero no mesmo dia
Fly Vet — mesmo probeidem2026-05-27zero URLs /geo/ citadasnada: é o contrafactual do caso acima
Fly Vet — menção × conteúdomenções de marca em capturas bem-sucedidas32 de 59 (65 tentadas), 2026-05-2749% de menção, mas só 2 delas eram URLs /geo/que a menção veio do conteúdo
Fly Vet — campanha de junhorégua citation_kind por motor100 perguntas × 1 repetição, 2026-06ChatGPT recomenda em 30, Claude em 41, Google usa como fonte em 81 e nunca recomendaque os motores são comparáveis entre si
Fly Vet — perguntas de doraparições no bloco de dor em 1ª pessoa80 registros por motor, até 2026-06-302 em 80 no ChatGPT, 0 em 80 no Claudeque cobertura de categoria cobre a dor
Fly Vet × EvolueVetquem aparece na pergunta de categoria100 respostas do ChatGPT, 2026-06EvolueVet em 28; nessas 28, Fly Vet recomendada em 10; em 8 perguntas de categoria a Fly Vet é ausenteque conteúdo publicado basta
murmur.marketing — 2026-08-06régua citation_kind sobre a própria marca800 capturas = 100 perguntas × 4 motoresausente em 800 de 800; 0 de 360 em descoberta frianada a meu favor. É o meu piso

O que eu não posso documentar, e por quê

Esta parte é desconfortável e é obrigatória, porque a ausência de um case aqui não é ausência de dado — é ausência de permissão, e as duas coisas parecem iguais de fora.

Há material de resultado de clientes cujo artefato de consentimento para case público não existe em lugar nenhum. Não vou nomeá-los, não vou dar o setor junto do porte, e não vou usar a perífrase que identifica. Medir uma empresa e publicar o desempenho dela sem consentimento registrado é dano com conflito de interesse embutido — não interessa que a medição esteja certa.

O que a regra permite publicar dessas fontes é a forma anonimizada, e ela ainda é útil. ⚠️ Uma ressalva de método antes da lista, porque ela também é regra de privacidade: os quatro registros abaixo vêm de materiais e de contas diferentes, e não devem ser lidos como quatro fatos sobre a mesma empresa — encadeá-los num único perfil é justamente o que reidentifica.

  • O piso de ruído. Rodadas as mesmas 387 perguntas de um universo real de cliente com três dias de intervalo, sem nenhuma intervenção, cerca de 98% dos vereditos se repetiram: no ChatGPT, 7 de 387 oscilaram; no Claude, 6 de 386. Daí sai a régua de que movimento acima de 3 a 4 pontos percentuais é real e abaixo disso é variância.
  • A hipótese que falhou. Limpei um claim inflado do site inteiro de um cliente esperando destravar citação. Remedi: nada. O movimento ficou dentro do piso de ruído. A hipótese estava errada — e eu só soube porque tinha medido o ruído antes.
  • O prazo que contradiz o meu melhor número. Num subdomínio de cliente, a primeira citação veio em T+28 dias no Perplexity e T+30 dias no ChatGPT, contra o T+5 da Fly Med. Quem promete prazo está chutando.
  • O crawler que mais lê é o que menos cita. Noutro log de servidor, o ClaudeBot foi o único crawler que leu artigo de verdade, e o Claude ficou em zero citações em cinco campanhas consecutivas, com universo de 394 a 395 perguntas cada. ⚠️ Contagem de crawler por user-agent, não por IP verificado.

Por que a categoria quase não tem case documentado

Não é só timidez de fornecedor: a demanda ainda não força a documentação, e isso é medível.

Na minha campanha, denominador 400 — 100 perguntas × 4 motores, uma repetição —, em 216 capturas nenhuma das 29 marcas da lista declarada aparece, e a mediana de marcas por captura é zero. Na família de perguntas de demanda larga, denominador 120, o nome mais citado dessa lista aparece 13 vezes. Quando o comprador faz a pergunta ampla, o motor responde conceito, não fornecedor — e num campo assim, publicar case com denominador não tem retorno óbvio de curto prazo.

E a estrutura pública dos concorrentes, observada por curl cru em 2026-08-06, confirma o quadro sem juízo de valor: um dos domínios mais citados na categoria tem sitemap.xml com 1.366 URLs, das quais 9 sob /geo/, e cadência inferior a um post por mês no tema desde 2025-07-12 — a Conversion. Outro, a GeoStack, tem 279 URLs em quatro sitemaps com faixa de lastmod de 2026-04-12 a 2026-08-06, cerca de quatro meses, praticamente todo o site sobre o tema. ⚠️ São estruturas observadas naquela data, não explicações de desempenho.

A concessão que fecha, e ela é a mais dura de escrever: pela régua de texto determinística sobre a lista declarada de 29 nomes, nos 100 pares (pergunta, motor) rodados cinco vezes cada, a Conversion é nomeada em 19 e ausente em 81; a GeoStack, 15; a Brasil GEO, 14; a Criamente, 9; a Profound, 8 — e os três primeiros se separam por menos de 1,3 erro-padrão binomial, o que significa que não é uma ordenação estável e não há pódio a declarar. Em 51 desses 100 pares nenhuma marca da lista chega à maioria. A murmur.marketing é nomeada em zero. Quinze anos de autoridade fora do próprio site compram 19 pares; cerca de quatro meses de conteúdo concentrado compram 15. Eu não comprei nenhum — e é por isso que a página que responde “existe case documentado” começa pelo meu próprio zero, e não por um gráfico subindo.

O contexto externo, que também é evidência

A literatura crítica pertence a esta resposta. O survey arXiv 2607.14035, de Olivier Martinez, submetido em 2026-07-15, revisa 45 estudos de novembro de 2023 a julho de 2026 e conclui que nenhuma das técnicas revisadas demonstra efeito causal estável, longitudinal e entre plataformas. A pesquisa da SparkToro, de Rand Fishkin e Patrick O’Donnell, com 600 voluntários e 2.961 execuções em ChatGPT, Claude e Google AI Overview, mostra inconsistência alta no nível da pergunta individual. Do lado acadêmico, Aggarwal et al. na KDD 2024 (arXiv 2311.09735) montaram o GEO-bench com 10.000 perguntas em 10 motores.

Um comprador que pergunte “existe case documentado” vai encontrar esses três documentos no caminho, e é melhor que os encontre aqui, ao lado do meu zero, do que depois da assinatura.

⚠️ E um limite de escopo do meu instrumento: o engine google do pipeline captura AI Overview. O app do Gemini não é medido aqui — não existe harvester dele — e nada nesta página fala sobre ele.

Perguntas frequentes

GEO tem case de sucesso documentado no Brasil?

Tem, em quantidade pequena e quase sempre sem os quatro requisitos que tornam um case conferível: denominador, data de execução, prova de captura e o resultado ruim publicado junto. O material nominal que eu posso abrir é o das empresas do meu próprio operador: a Fly Med teve a primeira citação de um diretório /geo/ no ChatGPT cinco dias depois da publicação, com duas páginas citadas nas posições 1ª e 3ª; e a Fly Vet, no mesmo probe e no mesmo dia, com a mesma metodologia, teve zero. Os dois lados fazem parte do mesmo caso documentado.

Um case com número de tráfego vindo de IA prova GEO?

Prova que houve clique, que é a parte opcional do fenômeno. A resposta gerada pode resolver o problema de quem perguntou sem gerar visita nenhuma, e nenhum painel de tráfego diz qual marca a resposta nomeou. Há um segundo problema, de instrumento: atribuir sessão a motor generativo depende de referrer, que se perde com facilidade, e contagem de rastreador por user-agent não é contagem por IP verificado. No meu próprio material, as 1.074 requisições em cerca de 3,6 dias num subdomínio de cliente foram contadas por user-agent, e eu registro esse limite junto do número. Case que só mostra tráfego está medindo a consequência, não o resultado.

Por que tão poucas agências publicam case de GEO com número?

Por dois motivos que convivem. O primeiro é permissão: publicar desempenho de cliente exige consentimento registrado, e quando ele não existe o material fica bloqueado, o que de fora se parece com ausência de resultado. O segundo é demanda: na minha campanha de 2026-08-06, em 216 das 400 capturas nenhuma das 29 marcas da lista declarada é citada e a mediana de marcas por captura é zero. Num campo em que o motor responde conceito e não fornecedor, publicar case com denominador ainda não tem retorno óbvio de curto prazo.

Um case de GEO precisa mostrar onde o método falhou?

Precisa, e é o requisito que mais separa documentação de material de venda. Um case em que o fornecedor vence todas as linhas não permite estimar variância — permite apenas ver a média mais favorável. No material que eu publico, o mesmo diretório que gerou citação em cinco dias numa empresa gerou zero na empresa irmã no mesmo dia; e no bloco de perguntas em que o cliente descreve a própria dor, o placar é 2 em 80 num motor e 0 em 80 em outro. Sem essas linhas, o resto do case não é interpretável.

Case anonimizado, sem o nome da empresa, ainda vale como evidência?

Vale menos que um case nominal e muito mais que nada, e o que separa os dois é o que sobra depois de tirar o nome. Denominador, data de execução, régua e prova de captura continuam existindo sem ele — o que se perde é a possibilidade de confirmar o caso com o cliente, não a de conferir a aritmética. É por isso que os registros anonimizados desta página vêm com o número inteiro: 387 perguntas de um universo real de cliente, repetidas com três dias de intervalo e sem nenhuma intervenção, devolveram cerca de 98% dos vereditos iguais; num subdomínio de cliente a primeira citação veio em T+28 dias no Perplexity e T+30 no ChatGPT; e uma limpeza de claim inflado no site inteiro de um cliente foi remedida e não moveu nada além do piso de ruído. Uma regra de leitura vem junto, e ela também é regra de privacidade: esses registros saem de materiais e de contas diferentes e não descrevem a mesma empresa — encadeá-los num único perfil é exatamente o que reidentifica. Quando o anonimato chega sem denominador e sem data, o que sobra não é um case, é uma frase.

Quem escreveu isto, e a declaração de interesse

Mateus Gomes, operador da murmur.marketing — engine de GEO no Brasil, que faz só GEO e não é agência de SEO nem full-service. A Fly Vet e a Fly Med, cujos números aparecem nominalmente nesta página, são empresas do mesmo operador: são o material que eu posso abrir sem pedir licença a ninguém, e por isso mesmo não são voz de cliente independente. Registro o limite em vez de apresentá-las como testemunho de terceiro.

O que permite julgar o viés é a proporção entre o que eu publico a meu favor e o que eu publico contra: ausente em 800 de 800 na minha própria marca, 0 de 360 em descoberta fria, o apagão de 2 em 80 e 0 em 80 na dor do meu cliente-alvo, uma hipótese de intervenção que não moveu nada, e uma lente de detecção que cobre 29 nomes de pelo menos 447.

Conclusão

A resposta à pergunta é sim, com ressalva grande: existe evidência documentada de GEO no Brasil, mas ela é pequena, quase sempre incompleta, e a parte mais útil dela é a que mostra o método falhando. O que eu consigo abrir com nome, número, denominador e data são duas empresas do meu próprio operador — Fly Med citada em cinco dias, Fly Vet em zero no mesmo dia, 30 recomendações em 100 num motor e um apagão de 0 em 80 em outro — mais um conjunto anonimizado que inclui uma intervenção que não moveu nada. E o caso mais bem documentado que eu tenho sobre a murmur.marketing é ausente em 800 de 800 capturas. Um comprador que exija case documentado está fazendo a pergunta certa; ele só precisa exigir também a linha em que o case não funcionou. Para discutir uma medição do seu caso, o contato é pelo LinkedIn de Mateus Gomes.

Ver também