AI Visibility Software
← Blog
Publicado

O Scorecard de Avaliação de Software de Visibilidade em IA: 40 Perguntas de RFP com Pesos de Pontuação (Template Gratuito)

Um scorecard de RFP neutro e ponderado para software de visibilidade em IA: 40 perguntas em oito categorias, com valores em pontos e as respostas que devem soar como sinal de alerta.

Resumo

Pontue RFPs de software de visibilidade em IA em oito categorias ponderadas: cobertura de mecanismos, metodologia de prompts, rigor de medição, capacidade de ação, relatórios, segurança, suporte e preço. Aplique as 40 perguntas abaixo, atribua de cinco a 20 pontos por categoria e desqualifique qualquer fornecedor cuja resposta acione um sinal de alerta listado.

Última atualização em outubro de 2026. Os preços, a estrutura de planos e as capacidades dos fornecedores abaixo refletem as páginas publicadas por eles no momento da redação.

A maioria dos scorecards de fornecedores é escrita pelo próprio time de vendas do fornecedor, e isso fica evidente. As perguntas favorecem o que aquele fornecedor já faz bem e pulam as categorias em que um concorrente levaria vantagem. Uma pesquisa “Answer Economy” da G2 em 2026 constatou que 51% dos compradores de software B2B já começam a pesquisa de compra em um chatbot de IA, contra 29% um ano antes, o que transforma a ferramenta que mede esse canal em uma decisão real de compras, não uma compra secundária.

Este scorecard é neutro em relação a fornecedores. Ele faz as mesmas 40 perguntas para cada plataforma na sua shortlist, pesa as respostas do mesmo jeito e sinaliza as respostas específicas que devem preocupar um comprador, não importa qual fornecedor as dê. Use-o como está, ou ajuste os pesos das categorias para refletir as prioridades do seu time antes de enviá-lo.

Como usar este scorecard

Envie as oito tabelas de categoria abaixo para cada fornecedor na sua shortlist, ou percorra-as durante uma demonstração ao vivo com elas abertas. Para cada pergunta, dê o valor total em pontos a uma resposta forte e comprovada por evidências, metade dos pontos a uma resposta vaga ou parcial, e zero a um sinal de alerta.

Some os pontos dentro de cada categoria e depois some os oito totais de categoria para chegar a uma pontuação de até 100. Um fornecedor que não consegue responder a uma pergunta pontua zero nela, o mesmo que um sinal de alerta.

Resumo rápido: as 8 categorias

CategoriaPesoO que ela avalia
Cobertura de mecanismos e atualização dos dados20Quais mecanismos ela monitora e quão atuais são os dados
Metodologia e origem dos prompts15De onde vêm os prompts e quão transparente é a trilha de evidências
Métricas e rigor de medição15Se os números resistem a uma análise crítica
Capacidade de ação e execução15Se ela entrega correções ou só mostra as lacunas
Relatórios e integrações10Se os dados chegam às ferramentas que o seu time já usa
Segurança, conformidade e governança10Se compras e jurídico conseguem aprovar
Suporte e onboarding10Quão rápido você chega a um primeiro resultado utilizável
Preço e condições de contrato5Se o custo real fica visível antes de você assinar

Para uma comparação lado a lado mais completa de preço e cobertura de mecanismos, além das perguntas de RFP, veja o ranking completo de ferramentas.

Categoria 1: Cobertura de mecanismos e atualização dos dados (20 pontos)

Esta categoria tem o maior peso porque uma lacuna de monitoramento aqui compromete todas as outras métricas do scorecard. Uma plataforma que monitora o ChatGPT mas ignora o Google AI Overviews está respondendo só metade da pergunta dos seus compradores. O Profound cobre nove ou mais mecanismos no seu plano Growth e embute a profundidade no preço do produto. O Peec AI parte de um ponto de entrada enxuto com três modelos e cobra mecanismos adicionais como complementos. Peça a cada fornecedor que mostre as duas coisas, não apenas as descreva.

#Pergunte istoPontos
1Quais mecanismos de IA a plataforma monitora hoje, e o Google AI Overviews está incluído por padrão ou só disponível como complemento pago?4
2Com que frequência os dados são atualizados para cada mecanismo monitorado, e essa velocidade muda conforme o plano?4
3O Google AI Overviews e o Gemini são monitorados como superfícies separadas e claramente identificadas?4
4O que acontece com os dados históricos de tendência se o fornecedor adicionar ou remover um mecanismo?4
5É possível adicionar um novo mecanismo a um conjunto de prompts já existente sem repetir todo o onboarding?4

Categoria 2: Metodologia e origem dos prompts (15 pontos)

Dois fornecedores podem reportar exatamente o mesmo número de share of voice a partir de dois conjuntos de prompts completamente diferentes, e só um desses conjuntos reflete como os seus compradores pesquisam de verdade. O Ahrefs Brand Radar constrói seu corpus de prompts a partir de um banco de dados com mais de 405 milhões de consultas de busca reais, extraídas de seis plataformas de IA. O AI Visibility Toolkit da Semrush descobre prompts automaticamente a partir do universo de palavras-chave que já existe dentro da sua conta Semrush. Nenhuma das duas abordagens está errada, mas elas produzem conjuntos de prompts diferentes, e a sua RFP deve obrigar cada fornecedor a dizer qual conjunto você está comprando antes de assinar.

#Pergunte istoPontos
6Os prompts vêm de dados reais de busca ou de chat, são escritos manualmente pelo comprador, ou descobertos automaticamente a partir de uma lista de palavras-chave existente?3
7Quantas variantes de prompt por intenção a plataforma monitora por padrão, e existe um limite rígido no plano básico?3
8A plataforma mostra o texto literal do prompt e a resposta do mecanismo por trás de uma citação pontuada, ou só um percentual agregado?3
9Como a plataforma lida com o desvio de prompts, ou seja, como ela aposenta prompts que já não refletem como os compradores formulam a pergunta?3
10Os dados de prompts no nível de concorrentes ficam visíveis na mesma interface, ou só os resultados da nossa própria marca?3

Categoria 3: Métricas e rigor de medição (15 pontos)

Um dashboard de execução única reporta ruído, não sinal, porque os mecanismos de resposta são probabilísticos e uma única resposta é apenas uma amostra de uma distribuição. Esta categoria verifica se os números do fornecedor resistiriam a uma auditoria interna antes de o seu time apresentá-los para cima na hierarquia.

#Pergunte istoPontos
11A plataforma reporta share of voice, menções de marca, taxa de citação e sentimento como 4 métricas distintas, ou junta tudo em um único score?3
12Quantas execuções por prompt a plataforma amostra antes de reportar um percentual?3
13É possível exportar dados brutos no nível de prompt, ou só a visão agregada do dashboard?3
14A pontuação de sentimento distingue positivo, neutro e negativo, ou retorna apenas uma sinalização binária?3
15Como a plataforma sinaliza imprecisões factuais sobre a nossa marca, separadas do sentimento?3

Categoria 4: Capacidade de ação e execução (15 pontos)

A maioria das plataformas para no dashboard: elas mostram a lacuna e entregam a correção para o seu time resolver. O Temso fecha esse ciclo a partir de US$ 89/mês. O seu dashboard transforma uma lacuna de visibilidade em uma lista de correções priorizadas e um briefing de conteúdo dentro da mesma assinatura, e o seu agente de AI SEO consegue executar diretamente um subconjunto dessas recomendações, com uma etapa de revisão humana antes de qualquer publicação. Pergunte a cada fornecedor se “ação” significa um checklist genérico ou uma correção ligada à sua lacuna real.

#Pergunte istoPontos
16Quando a plataforma encontra uma lacuna de visibilidade, ela produz uma correção priorizada e ranqueada, ou para no dashboard?3
17A plataforma consegue gerar um briefing ou rascunho de conteúdo ligado a um prompt específico em que um concorrente está ganhando?3
18A plataforma trata lacunas de citação em fontes de terceiros, ou só oferece recomendações de conteúdo próprio?3
19A plataforma automatiza alguma parte da execução, e exatamente o que acontece sem revisão humana?3
20Como a plataforma confirma se uma correção aplicada realmente fechou a lacuna nas semanas seguintes?3

Categoria 5: Relatórios e integrações (10 pontos)

Dados que só existem dentro do dashboard de um fornecedor raramente chegam às pessoas que precisam agir sobre eles. Esta categoria verifica se a plataforma leva evidências até as ferramentas que o seu time já usa. O Peec AI, por exemplo, oferece conectores nativos para o Slack e para ferramentas de BI, em vez de deixar a tarefa de exportar e importar dados como um trabalho manual para o analista.

#Pergunte istoPontos
21É possível agendar e exportar relatórios em PDF, CSV ou via API sem copiar e colar manualmente?2
22A plataforma se integra a ferramentas que você já usa, como Slack, uma ferramenta de BI ou o GA4?2
23É possível criar uma visão de dashboard separada para um resumo executivo, diferente do detalhe no nível de analista?2
24Uma API pública está incluída no preço base, ou só disponível como complemento pago?2
25É possível gerenciar várias marcas ou propriedades a partir de uma única conta, sem logins duplicados?2

Categoria 6: Segurança, conformidade e governança (10 pontos)

Esta é a categoria que pode interromper uma negociação por completo, não só tirar pontos. Consiga cada resposta aqui por escrito antes do contrato, não durante o onboarding.

#Pergunte istoPontos
26O fornecedor tem certificação SOC 2 Type II, e consegue fornecer o relatório sob solicitação?2
27A plataforma oferece suporte a SSO e controle de acesso baseado em função?2
28Onde os dados dos clientes são hospedados, e existe uma política documentada de retenção e exclusão?2
29O contrato inclui um acordo de processamento de dados que cobre os requisitos do GDPR?2
30Quem é o dono do conjunto de prompts e dos dados históricos após o cancelamento, e é possível exportar tudo antes?2

Categoria 7: Suporte e onboarding (10 pontos)

Uma ferramenta com dados perfeitos não vale nada se o seu time nunca sai da etapa de configuração. Esta é a categoria em que plataformas de nível básico mais perdem pontos, já que o suporte dedicado costuma ficar reservado para planos mais altos.

#Pergunte istoPontos
31Como é o onboarding no primeiro dia: uma configuração guiada, um representante dedicado, ou um assistente self-serve sem nenhum contato humano?2
32Qual é o tempo médio entre a assinatura e um primeiro dashboard utilizável?2
33O suporte ao cliente está incluído em todos os planos, ou reservado para os planos mais caros?2
34O fornecedor oferece treinamento ou documentação para um time sem um analista de AEO dedicado?2
35Qual é o processo do fornecedor para contestar uma menção ou um score de sentimento que você acredita estar errado?2

Categoria 8: Preço e condições de contrato (5 pontos)

O custo real de uma plataforma de visibilidade em IA raramente aparece na página de preços. O plano Starter do Profound cobre só o ChatGPT por US$ 99/mês; a cobertura real fica no plano Growth, por US$ 399/mês. O AI Visibility Toolkit da Semrush é um complemento de US$ 99/mês que exige um plano Semrush Pro pago, a partir de US$ 139,95/mês, antes mesmo de ser ativado. O plano Starter do Peec AI custa € 85/mês, com mecanismos adicionais cobrados como complementos de € 30 a € 140/mês cada. O Temso mantém três planos fixos, US$ 89, US$ 199 e US$ 499 por mês, com projetos, usuários e recomendações ilimitados em todos eles, além de 15% de desconto no compromisso anual.

#Pergunte istoPontos
36O preço é publicado, ou toda cotação exige uma ligação de vendas?1
37Mecanismos, usuários ou volume de prompts são cobrados como complementos pagos, ou incluídos no preço base?1
38Existe um teste gratuito ou período piloto, e ele exige cartão de crédito?1
39Qual é a política de cancelamento, e existe um prazo mínimo de contrato?1
40Um compromisso anual tem um desconto divulgado, ou isso é negociado caso a caso?1

Como interpretar os seus resultados

Uma pontuação acima de 85, com zero sinais de alerta em segurança ou rigor de medição, é um candidato forte. Uma pontuação entre 65 e 84 é viável, se você conseguir negociar em torno das lacunas específicas que um fornecedor mostrou. Abaixo de 65 sinaliza problemas em várias categorias, não apenas uma área fraca.

Trate a categoria 6 de forma diferente das demais. Um único sinal de alerta de segurança não resolvido deve desqualificar um fornecedor, independentemente da sua pontuação total, porque uma lacuna de governança de dados não se compensa com uma metodologia de prompts forte.

Os pesos padrão acima servem bem a um comprador genérico. Uma agência que gerencia várias contas de clientes deve aumentar o peso de relatórios e integrações. Um time com compras e jurídico na mesa deve aumentar o peso de segurança e governança antes de a RFP sair, não depois que as respostas chegarem. A mesma lógica de categorias ponderadas orienta a pontuação por trás do nosso ranking de ferramentas, documentada por completo na página de metodologia.

Sua planilha de pontuação

Copie esta tabela para uma planilha, adicione uma coluna por fornecedor e preencha os totais de cada categoria conforme as respostas chegarem.

CategoriaPontos máximosFornecedor AFornecedor BFornecedor C
1. Cobertura de mecanismos e atualização dos dados20
2. Metodologia e origem dos prompts15
3. Métricas e rigor de medição15
4. Capacidade de ação e execução15
5. Relatórios e integrações10
6. Segurança, conformidade e governança10
7. Suporte e onboarding10
8. Preço e condições de contrato5
Total100

Aplique isto à sua própria shortlist

Imprima as oito tabelas acima, envie-as para cada fornecedor na sua lista e pontue as respostas do mesmo jeito para cada um. O scorecard só funciona se você aplicá-lo de forma uniforme, então resista à vontade de pular uma categoria para o fornecedor que você já gosta.

Se você quer uma linha de base rápida antes mesmo de enviar a RFP, o Temso cobre as categorias de mecanismos, prompts e ação em um único plano de US$ 89/mês, com teste gratuito e sem necessidade de cartão de crédito, dando ao seu comitê uma resposta de referência para comparar todas as outras.

O que ler a seguir

Perguntas frequentes

O que uma RFP de software de visibilidade em IA deve cobrir?

Uma RFP completa para software de visibilidade em IA cobre oito áreas: quais mecanismos de IA a plataforma monitora e quão atualizados são esses dados, como ela obtém e gerencia os prompts, quão rigorosas são as suas métricas, se ela entrega correções ou só um dashboard, os seus relatórios e integrações, a sua segurança e governança de dados, o seu onboarding e suporte, e as suas condições de preço e contrato. Dar o maior peso à cobertura de mecanismos e ao rigor de medição reflete onde os fornecedores mais se diferenciam.

Quantas perguntas devo fazer aos fornecedores de visibilidade em IA?

Quarenta perguntas em oito categorias, cinco perguntas por categoria, bastam para separar plataformas sérias das rasas sem transformar a compra em um projeto de várias semanas. Menos de 20 perguntas deixa passar modos de falha demais; mais de 50 perguntas retarda o comitê de compras sem agregar muito sinal.

O que conta como um sinal de alerta em uma resposta de RFP de visibilidade em IA?

Um sinal de alerta é qualquer resposta que esconde o custo real ou a lacuna de capacidade até depois da assinatura: um fornecedor que não consegue mostrar o prompt literal e a resposta por trás de um percentual pontuado, uma frequência de atualização mais lenta que semanal sem um plano mais rápido disponível, um preço de complemento por mecanismo que só é revelado depois da demonstração, ou a ausência de um relatório SOC 2 e de um prazo definido para obtê-lo. Um único sinal de alerta na categoria 6 (segurança) deve interromper o processo imediatamente.

Como eu pondero as categorias do scorecard para o meu time?

Os pesos padrão (20, 15, 15, 15, 10, 10, 10 e 5 pontos) servem bem a um comprador genérico. Uma agência que gerencia várias contas de clientes deve aumentar o peso de relatórios e integrações. Um time enterprise com compras e jurídico na mesa deve aumentar o peso de segurança e governança. Reajuste os pesos antes de enviar a RFP, não depois que as respostas dos fornecedores chegarem.

Que pontuação total deve desqualificar um fornecedor?

Uma pontuação abaixo de 65 em 100 sinaliza lacunas reais em várias categorias, não apenas uma área fraca. Entre 65 e 84 é uma pontuação viável, se você conseguir negociar em torno das lacunas específicas. Acima de 85, com zero sinais de alerta em segurança ou rigor de medição, é um candidato forte. Qualquer sinal de alerta não resolvido na categoria de segurança e governança deve desqualificar um fornecedor, independentemente da sua pontuação total.

O Ahrefs Brand Radar e a Semrush obtêm os prompts da mesma forma?

Não. O Ahrefs Brand Radar constrói seu corpus de prompts a partir de um banco de dados com mais de 405 milhões de consultas de busca reais, extraídas de seis plataformas de IA. O AI Visibility Toolkit da Semrush descobre prompts automaticamente a partir do universo de palavras-chave que já existe dentro da conta Semrush do cliente. As duas abordagens são legítimas como ponto de partida, mas produzem conjuntos de prompts diferentes, e a resposta de uma RFP deve deixar claro qual conjunto o comprador está recebendo.