30/09/2026·4 min

Dez perguntas não chegam: quantos prompts precisas mesmo para medir visibilidade em IA

Dez prompts não chegam para medir visibilidade em IA com estabilidade. O que importa não é só o volume, mas a distribuição das perguntas e a capacidade de separar tendência real da variabilidade dos modelos.

MG

Mauro Gama

Semantika

Dez perguntas não chegam: quantos prompts precisas mesmo para medir visibilidade em IA

Quase todas as ferramentas de monitorização de marca em IA te vendem um número de prompts. Dez, cinquenta, cem. E quase toda a gente escolhe o escalão mais barato, porque parece que dez perguntas bem escolhidas devem chegar para saber se a marca aparece.

Não chegam, e há dados para o demonstrar.

O problema chama-se volatilidade

Um estudo publicado a 11 de setembro de 2026 mediu 252.407 respostas de IA em sete motores para perceber uma coisa muito específica: se fizeres a mesma pergunta duas vezes, obténs a mesma resposta?

Não obténs.

Os modelos de linguagem não são determinísticos. A mesma pergunta, ao mesmo motor, no mesmo dia, pode devolver conjuntos de marcas diferentes. Não é erro da ferramenta nem do modelo, é como a tecnologia funciona.

E é isto que quebra a matemática das dez perguntas.

Porque é que dez perguntas te dão um número que não significa nada

Imagina que monitorizas dez perguntas e a tua marca aparece em três. Visibilidade de 30%.

No mês seguinte aparece em duas. Visibilidade de 20%.

Perdeste um terço da tua visibilidade? Provavelmente não perdeste nada. Com uma amostra de dez, uma única resposta a variar mexe dez pontos percentuais. O que estás a medir não é a tua presença no mercado, é o ruído do modelo.

Agora faz a mesma conta com cem perguntas. Uma resposta a variar mexe um ponto percentual. O sinal começa a distinguir-se do ruído.

A regra prática é esta: com uma amostra pequena, não consegues distinguir uma mudança real de uma flutuação. E um relatório que não distingue as duas coisas leva a decisões erradas nos dois sentidos, a comemorar subidas que não existem e a entrar em pânico com descidas que também não.

Mas mais perguntas custam mais dinheiro

Custam, e é a tensão real deste mercado. Cada pergunta feita a cada motor, repetida ao longo do tempo, é um custo de API que alguém paga.

Por isso a pergunta útil não é quantas perguntas queres. É quantas perguntas precisas para o teu caso.

Três casos concretos:

Marca única, categoria estreita. Uma clínica dentária numa cidade. As pessoas fazem variações de meia dúzia de perguntas. Trinta a cinquenta perguntas cobrem o espaço quase todo e dão-te estabilidade suficiente para medir tendência.

Marca com várias linhas de produto. Aqui o erro típico é medir a marca e esquecer os produtos. Se tens cinco linhas, cada uma tem o seu espaço de perguntas. Trinta perguntas divididas por cinco linhas são seis por linha, o que é a mesma amostra minúscula do início deste artigo, disfarçada.

Saúde, direito, finanças ou qualquer categoria com muitas tipologias. Uma agência disse-nos que num cliente de saúde identificou mais de 50 tipologias de pergunta diferentes. Nestes casos, cem perguntas é o mínimo e não o teto.

O erro de desenho que quase toda a gente comete

Não é o número. É a distribuição.

A maioria das listas de prompts que vejo tem este aspeto: dez variações de melhor X em Portugal, todas a perguntar essencialmente a mesma coisa.

Isso não é uma amostra de dez, é uma amostra de um, repetida dez vezes. Mede muito bem uma intenção e ignora todas as outras.

Uma lista bem desenhada cobre o percurso inteiro:

  • Descoberta. Quem faz X em Portugal.
  • Comparação. X ou Y, qual é melhor para Z.
  • Objeção. Vale a pena contratar X.
  • Problema. Como resolver Z, sem nomear nenhuma marca. É aqui que se ganham clientes que ainda não sabem que precisam de ti.
  • Marca própria. O que é a marca X, é de confiança.

Se a tua lista só tem a primeira categoria, estás a medir a parte mais competitiva e menos acionável do funil.

Como decidir hoje, sem sobrepagar

Um método simples:

  1. Escreve todas as perguntas que consegues imaginar, sem limite, em português de Portugal, como um cliente as escreveria. Costumam sair entre 40 e 150.
  2. Agrupa-as pelas cinco categorias acima. Vais descobrir que 80% caem numa só.
  3. Corta as que são variações literais da mesma coisa. Mesma intenção com outras palavras é ruído, não cobertura.
  4. Garante um mínimo de cinco perguntas por categoria e por linha de produto.
  5. O número que sobrar é o teu escalão. Se for maior do que o que consegues pagar, corta categorias inteiras conscientemente em vez de cortar perguntas a esmo. É melhor medir bem três intenções do que medir mal cinco.

O que isto quer dizer para quem compra

Se uma ferramenta te vende dez prompts como suficiente para monitorizar uma marca, ou não leu os dados ou está a vender-te tranquilidade em vez de medição.

E se te vende cem prompts sem te perguntar como estão distribuídos, está a vender-te volume em vez de método.

A pergunta certa a fazer a qualquer fornecedor é: como é que me ajudam a decidir que perguntas monitorizar, e como é que lidam com a variabilidade das respostas entre execuções? As respostas a essas duas perguntas dizem-te mais sobre a qualidade da plataforma do que qualquer lista de funcionalidades.

Partilha:

Newsletter mensal

Recebe um digest no primeiro dia útil de cada mês.

Um email por mês. Sem follow-ups, sem upsell. Casos reais, dados próprios sobre GEO em PT, e o que aprendemos a construir o Semantika.

Ler a seguir

Mais sobre GEO em PT.