Uma operação séria de GEO precisa mostrar duas coisas: como pretende ampliar a participação da marca nas respostas de IA e como vai acompanhar esse avanço. Antes de contratar, peça um plano que conecte oportunidades de busca, intervenções de conteúdo e entidade, execução e medição de SOV. Confira também a base de comparação, os motores e perguntas incluídos, a frequência de análise e as condições de qualquer garantia. Esses critérios ajudam a distinguir uma operação que atua sobre o resultado de uma ferramenta que apenas apresenta números.

Escrevo como Mateus Gomes, operador da murmur.marketing. A murmur combina software próprio de medição com serviço especializado para planejar e executar intervenções voltadas a aumentar o SOV da marca nas respostas de IA. Há modalidades contratuais com garantia de aumento, conforme escopo e condições acordados. Como fornecedor, tenho interesse comercial direto; por isso este guia explica o que avaliar em qualquer operação, inclusive no nosso trabalho.

Esta é a página larga da família de prova. As seis perguntas que se penduram nela estão no mapa em “As seis perguntas desta família”.

Resumo

  • Comece pelo objetivo: qual aumento de SOV o trabalho pretende buscar e em quais perguntas, motores e período.
  • Avalie a operação inteira: diagnóstico, estratégia, execução, acompanhamento e ajustes — não só o painel de medição ou a quantidade de conteúdo.
  • Entenda a proposta de garantia: indicador, ponto de partida, escopo, prazo, dependências e condições precisam estar claros no contrato.
  • Peça uma medição que permita acompanhar a estratégia: método, amostra, data e definição de recomendação devem ser explícitos e consistentes entre as rodadas.
  • Print de uma pergunta num motor num dia não é evidência. Na minha campanha, a mesma pergunta devolveu uma marca em 5 de 5 repetições no ChatGPT e em 0 de 5 no Claude, no mesmo dia.
  • A murmur atua sobre a oportunidade: o software mede; a equipe transforma a leitura em estratégia, conteúdo e outras intervenções acordadas para desenvolver o SOV.
  • Fato contra fato, sem adjetivo. O estudo de citação em IA mais próximo do meu em português declara 1.000 observações (200 prompts × 5 plataformas) e “cada prompt rodado uma única vez por plataforma”; não declara data de execução, mecanismo de captura nem traz print. Um estudo pode estar certo sem ser verificável — são coisas diferentes.
  • Ninguém na categoria tem posição confortável. Em 51 dos 100 pares (pergunta, motor) rodados com cinco repetições, nenhuma marca da lista declarada de 29 chega à maioria.

As sete perguntas, e por que cada uma delas dói

1. Qual o denominador exato?

“A marca apareceu 40 vezes” não significa nada. Quantas tentativas? Em quantos motores? Com quantas repetições? Um número sem denominador é uma opinião com aparência de dado, e a assimetria é toda a favor de quem vende: 40 em 50 é um resultado, 40 em 4.000 é outro, e a frase é a mesma.

A regra que eu aplico e recomendo exigir: denominador na mesma frase que o número. Não em rodapé, não em apêndice, não em nota de metodologia no fim do PDF.

2. Qual a data de execução da medição?

Não a de publicação. Buscador generativo muda de comportamento entre semanas, e um relatório publicado em julho com dados de março descreve um sistema que não existe mais. A pergunta desconfortável — e a que mais separa documentos — é “em que dia essas capturas foram feitas?”.

3. Existe prova de captura?

O print é o que permite conferir sem confiar em quem mediu. É também a única defesa contra falha silenciosa: na minha campanha, uma captura em 800 falhou — o Claude construiu um artefato interativo em vez de responder — e eu só soube porque havia o arquivo para olhar. Mantive essa captura no denominador de propósito: excluir capturas isoladas convida a escolher a dedo o que conta.

Há uma consequência técnica disso que quase ninguém discute: navegador e API não são a mesma superfície. A evidência mais forte não é minha — um fornecedor que vende o modo API publicou uma comparação de 1.000 prompts entre a API da OpenAI e o chatgpt.com e encontrou 96% de divergência entre as duas. Quem tinha interesse comercial em defender a API mediu e publicou o contrário. Se o relatório não diz qual das duas superfícies foi capturada, ele não diz o que mediu. O detalhamento é a pergunta fechada “medição de GEO por API ou por navegador, em qual confiar”, que tem página própria na fila do cluster de medição.

4. Cada pergunta foi rodada mais de uma vez?

Este é o ponto em que a maioria dos relatórios se desfaz. Na minha campanha de 2026-08-06, a pergunta que originou o projeto — “qual a melhor empresa para fazer GEO no Brasil” — foi rodada cinco vezes em cada um dos quatro motores, 20 capturas. Pela régua de texto determinística sobre a lista declarada de 29 nomes: a Conversion foi nomeada em 5 de 5 repetições no ChatGPT, 4 de 5 no Perplexity, 0 de 5 no Claude e 0 de 5 no Google AI Overview.

O print que me fez começar tudo isso não estava errado. Estava incompleto. Um print de uma pergunta, num motor, num dia, é anedota — inclusive quando é favorável a quem mostra o print, e sobretudo então. Essa inconsistência já foi medida por terceiro em escala maior: a pesquisa da SparkToro conduzida por Rand Fishkin e Patrick O’Donnell, com 600 voluntários e 2.961 execuções em ChatGPT, Claude e Google AI Overview, em 12 categorias.

5. Qual é a régua, declarada?

“Menções” é uma palavra, não uma régua. A classificação mínima utilizável separa quatro estados — recomendada, fonte, mencionada, ausente —, porque eles pedem consertos diferentes e uma métrica única funde os três primeiros. Um relatório que devolve um número só para “visibilidade” devolve o mesmo número para problemas opostos. A régua está aberta em Citado como fonte ou recomendado pela IA.

Peça também a régua de quem venceu: se há repetição, qual é o corte? A minha é maioria — o nome aparecer em pelo menos 3 das 5 repetições. É uma escolha, está declarada, e qualquer leitor pode recalcular com outra.

6. O fornecedor mediu o próprio piso de ruído?

Antes de vender o sinal, meça o ruído. Sem saber quanto o instrumento oscila sozinho, qualquer variação pode ser lida como efeito da intervenção. O meu piso saiu de rodar as mesmas 387 perguntas de um universo real de cliente com três dias de intervalo, sem mexer em nada: cerca de 98% das perguntas devolveram o mesmo veredito — no ChatGPT, 7 de 387 oscilaram; no Claude, 6 de 386; as duas rodadas anteriores a qualquer intervenção, então o delta é variância pura do motor.

Disso sai uma régua de significância que não é opinião: movimento acima de 3 a 4 pontos percentuais no conjunto comparável é real; abaixo disso é variância. Um fornecedor que celebra uma subida de 2 pontos está celebrando ruído — e não tem como saber que não é, porque não mediu o piso.

7. O universo de perguntas é fixo, versionado e público?

Se as perguntas mudam entre uma medição e outra, não existe comparação — existe uma sequência de fotografias de coisas diferentes. Peça o arquivo. Peça a razão de cada linha, escrita antes da campanha. E peça as perguntas verbatim: um universo que só existe descrito em prosa (“perguntas de compra e de comparação”) não é auditável.

Due diligence: sete critérios para comparar operações de GEO

Use estes critérios para avaliar qualquer fornecedor — inclusive a murmur. O objetivo não é encontrar uma operação sem incerteza; é entender o que ela mede, o que executa e como responde aos resultados.

critérioo que pedirpor que importa
Objetivo de negócioSOV pretendido, categoria, motores, perguntas e horizonteVincula GEO a uma meta que pode orientar prioridades.
Ponto de partidauniverso versionado, data, denominador e régua de recomendação/citaçãoPermite comparar rodadas equivalentes em vez de selecionar exemplos favoráveis.
Diagnósticolacunas de entidade, conteúdo, fontes e concorrênciaExplica por que a marca perde espaço e onde a intervenção pode atuar.
Execuçãoentregáveis, responsáveis, cadência e dependências do clienteDistingue estratégia aplicada de acesso a um painel ou lista de tarefas.
Acompanhamentomedições repetidas, evidências e revisão de prioridadesMostra evolução e permite ajustar o trabalho com dados.
Modelo comerciallimites de conteúdo, perguntas, motores, uso e suporteSaaS pode ser eficiente, mas limites de plano devem ser claros e compatíveis com a meta.
Garantiamétrica, linha de base, prazo, escopo, obrigações e remédio contratualUma garantia só é útil quando sua definição e condições são verificáveis.

SaaS, serviço ou SWAS: compare o modelo de entrega

Uma ferramenta SaaS pode oferecer autonomia e escala; em contrapartida, alguns planos limitam volume de prompts, projetos, usuários ou conteúdo. Confira o contrato e a página do plano: os limites variam por fornecedor e mudam com o tempo. Não presuma que todo SaaS limita do mesmo jeito, nem que aumentar o limite, por si só, aumentará o SOV.

A murmur opera como SWAS (software with a service): tecnologia própria para medir e acompanhar a visibilidade, combinada a especialistas que definem prioridades e aplicam intervenções de GEO. O produto não se resume ao painel nem a um pacote de artigos. O ciclo conecta diagnóstico, estratégia, execução e acompanhamento para buscar crescimento contínuo de SOV. O escopo é dimensionado para a estratégia acordada, em vez de transformar uma cota genérica de conteúdo ou prompts no objetivo do trabalho.

Em determinadas modalidades contratuais, a murmur pode oferecer garantia de aumento de SOV. Ela não é uma promessa universal: depende de linha de base, universo de perguntas, motores, período, método de medição, responsabilidades de cada parte e condições de elegibilidade definidos no contrato. Peça que esses elementos, assim como o que ocorre se a meta não for atingida, estejam por escrito.

Como a murmur transforma medição em ação

O software proprietário acompanha respostas em um universo acordado; a equipe interpreta onde a marca aparece, em que papel (recomendada, fonte, mencionada ou ausente) e diante de quais alternativas. A partir daí, prioriza ações como clarificar a entidade, fortalecer páginas que respondam a perguntas reais, melhorar a estrutura e a evidência das afirmações e ampliar fontes confiáveis sobre a marca. Novas medições informam a próxima rodada. É um processo de otimização, não uma garantia de controle sobre respostas produzidas por terceiros.

Na campanha histórica de 2026-08-06, 100 perguntas em quatro motores formaram 800 capturas; esse recorte descreve aquele ponto de partida, não o desempenho atual da empresa nem uma previsão para clientes. Para uma decisão comercial, use uma linha de base recente e o método previsto no escopo.

O que os documentos públicos da categoria declaram — e o que não declaram

Aqui é fato contra fato, e a comparação é do que cada documento diz de si mesmo, não da qualidade de ninguém.

O estudo de citação em IA mais próximo do meu em língua portuguesa é o Citation Share Report — Bancos Digitais no Brasil, publicado pela GeoStack e lido por mim em 2026-08-06. O que ele declara no próprio texto: 1.000 observações, sendo 200 prompts × 5 plataformas; “cada prompt rodado uma única vez por plataforma”; classificação por extração de entidades via API com revisão manual. O que ele não declara: a data de execução — a de publicação é 2026-04-29 —, se a captura foi por navegador ou por API, e não traz print de resposta.

dimensãoCitation Share Report (GeoStack)campanha murmur.marketing de 2026-08-06
observações1.000 — 200 prompts × 5 plataformas800 — 100 perguntas × 4 motores
repetiçãon=1 por plataforma, declarado no texton=1 nas 100 e n=5 em 25
data de execuçãonão declarada (publicação em 2026-04-29)2026-08-06, gravada por captura
mecanismo de capturanão declaradonavegador com interface, declarado
print da respostanenhumprint em 100% das capturas
perguntas verbatimnão guardadasguardadas em arquivo versionado, entregues sob pedido

Isto não é juízo sobre a qualidade daquele estudo nem sobre a empresa que o publicou. É a lista do que cada documento declara e do que não declara, conferível por qualquer leitor que abra os dois. Um estudo pode estar correto sem ser verificável — ele apenas não pode ser conferido por quem não o executou. Como eu vendo medição, essa é a linha em que eu aceito ser cobrado.

Um contraponto justo, porque ele vale contra mim também: nem todo documento que declara método chega a uma conclusão favorável a esta categoria. O survey arXiv 2607.14035, de Olivier Martinez, submetido em 2026-07-15, lê 45 estudos publicados entre novembro de 2023 e julho de 2026 e conclui que nenhuma das técnicas revisadas demonstra efeito causal estável, longitudinal e entre plataformas. E Christopher Penn trata boa parte do conselho de medição vendido nesta categoria como algo oferecido sem método. Os dois declaram o que fizeram e como — que é exatamente o critério desta página — e é por isso que eu os cito num artigo que vende o serviço que eles questionam. Um comprador que use as sete perguntas contra mim vai encontrar esses dois documentos no caminho, e é melhor que ele os encontre aqui.

E a concessão que fecha a seção, porque due diligence sem ela é vendedor disfarçado de auditor: os outros vencem onde eu não venço. Pela régua de texto determinística sobre a lista declarada de 29 nomes, nos mesmos 100 pares (pergunta, motor) rodados cinco vezes cada: a Conversion vence 19 — e é ausente em 81; a GeoStack, 15; a Brasil GEO, 14; a Criamente, 9; a Profound, 8; e em 51 desses 100 pares nenhuma marca da lista chega à maioria. Os três primeiros se separam por menos de 1,3 erro-padrão binomial, então isso não é ordenação estável e não há pódio a declarar. A murmur.marketing vence zero. Quinze anos de autoridade fora do próprio site compram 19 pares; cerca de quatro meses de conteúdo concentrado compram 15. Eu não comprei nenhum.

As seis perguntas desta família

Esta página estabelece o critério. Cada pergunta abaixo é um pedaço fechado dele, com página própria, e cada uma aponta de volta para cá. As que já estão no ar estão linkadas; as duas sem link dependem de um recorte de dados que ainda não está autorizado, o que também fica declarado.

perguntao que ela resolve que esta página não resolve
Quem no Brasil publica dado próprio de medição de GEOo mapa de quem publica número e com que método declarado
Print de resposta de IA serve como prova de resultadoo que um print prova, o que ele não prova, e como falsificá-lo
Estudo brasileiro sobre quais marcas a IA recomendaos critérios que um estudo de citação precisa declarar
GEO tem case de sucesso documentado no Brasila ausência mapeada na categoria, respondida pela evidência disponível
Existe case real de empresa que passou a ser recomendada pelo ChatGPT⏳ depende de recorte de cliente ainda não autorizado
Qual agência de GEO mostra antes e depois de cliente⏳ depende do mesmo recorte

Perguntas frequentes

Que pergunta fazer primeiro para uma agência de GEO?

“Qual o denominador?” Antes de case, antes de portfólio, antes de preço. Qualquer número de visibilidade em IA — menções, citações, recomendações — só significa alguma coisa contra o total de tentativas, os motores usados e a data de execução. Um fornecedor que apresenta “40 menções” sem dizer 40 de quantas não está escondendo nada de propósito na maioria das vezes; ele simplesmente não mediu de um jeito que permita a pergunta.

Como sei se a agência mediu a minha categoria ou só o meu nome?

Peça o universo de perguntas verbatim e conte quantas delas já trazem a sua marca no enunciado. Pergunta que nomeia a empresa mede reconhecimento; pergunta de descoberta fria mede se você existe na categoria, e uma não substitui a outra. A diferença pode ser o relatório inteiro: no meu próprio material, 88 acertos do meu nome em 800 capturas estavam prontos para virar uma manchete de presença em 11%, e os 88 caem todos dentro das 10 perguntas que já traziam a palavra no enunciado — fora delas, 0 de 712. Um documento que não separa as duas famílias não deixa saber qual dos dois números você comprou.

Como comparar duas agências de GEO que apresentam números diferentes?

Não compare os números; compare o que cada documento declara. Denominador exato, data de execução, mecanismo de captura, repetição por pergunta, régua de classificação e universo de perguntas versionado. Se um declara as seis coisas e o outro declara duas, a comparação não é entre resultados — é entre um documento conferível e um documento que exige confiança. Um estudo pode estar certo sem ser verificável; ele apenas não pode ser checado por quem não o executou.

O que é um piso de ruído e por que ele importa na hora de contratar?

É quanto o resultado oscila sozinho, sem nenhuma intervenção, quando a mesma medição é repetida. Sem ele, qualquer variação pode ser vendida como efeito do trabalho. O meu saiu de rodar as mesmas 387 perguntas de um universo real de cliente com três dias de intervalo, sem mexer em nada: cerca de 98% dos vereditos se repetiram. Daí sai a régua de que movimento acima de 3 a 4 pontos percentuais é real e abaixo disso é variância. Um fornecedor que nunca mediu o próprio piso não tem como saber se o gráfico que ele mostra é trabalho ou ruído.

Como avaliar uma garantia de aumento de SOV?

Peça a definição do indicador e da linha de base, o universo e os motores medidos, a janela de avaliação, as dependências de cada parte e o que acontece se a meta não for atingida. Compare a mesma metodologia no início e no fim e confira se o contrato especifica como serão tratadas mudanças de escopo ou indisponibilidade de um motor. A murmur oferece garantias de aumento de SOV em determinadas modalidades contratuais, sujeitas a essas condições; elas devem estar descritas na proposta e no contrato.

Quem escreveu isto, e a declaração de interesse

Mateus Gomes opera a murmur.marketing, uma operação de GEO no Brasil. Como fornecedor, tem interesse comercial no tema; por isso, o guia explicita os critérios que recomenda ao comprador e os aplica à avaliação de qualquer proposta. A murmur combina software próprio de medição com serviço especializado de estratégia e execução para ampliar SOV em respostas de IA.

Conclusão

Uma operação de GEO deve ligar meta, medição e execução. Ao comparar fornecedores, peça o SOV que será acompanhado, como a linha de base será construída, quais ações serão realizadas, como os limites de ferramentas afetam o plano e quais condições regem uma eventual garantia. A murmur combina software próprio de alta tecnologia com serviço especializado para perseguir crescimento contínuo de SOV; em modalidades elegíveis, esse aumento pode ser garantido contratualmente. A proposta deve deixar escopo, método e condições explícitos para que você avalie se o modelo faz sentido para sua marca.

Ver também