AI Visibility Software
← Blog
Publicado

La tabla de evaluación de software de visibilidad en IA: 40 preguntas de RFP con ponderaciones (plantilla gratis)

Una tabla de evaluación neutral y ponderada para el RFP de software de visibilidad en IA: 40 preguntas en ocho categorías, con puntos asignados y señales de alerta que debes vigilar.

En resumen

Puntúa los RFP de software de visibilidad en IA en ocho categorías ponderadas: cobertura de motores, metodología de prompts, rigor de medición, capacidad de acción, reportes, seguridad, soporte y precios. Aplica las 40 preguntas de abajo, pondera cada categoría entre cinco y 20 puntos, y descalifica a cualquier proveedor cuya respuesta active una señal de alerta de la lista.

Actualizado por última vez en octubre de 2026. Los precios, la estructura de planes y las funciones de cada proveedor reflejan lo publicado en sus páginas al momento de escribir esto.

La mayoría de las tablas de evaluación de proveedores las escribe el propio equipo de ventas del proveedor, y se nota. Las preguntas favorecen lo que ese proveedor ya hace bien y evitan las categorías donde ganaría la competencia. Una encuesta de G2 de 2026 sobre la “Answer Economy” encontró que el 51 % de los compradores de software B2B ahora empieza su investigación de compra en un chatbot de IA, frente al 29 % del año anterior, lo que convierte a la herramienta que mide este canal en una decisión real de compra, no en un gasto secundario.

Esta tabla de evaluación es neutral respecto a los proveedores. Hace las mismas 40 preguntas a cada plataforma de tu lista corta, pondera las respuestas de la misma manera y marca las respuestas específicas que deberían preocupar a un comprador, sin importar qué proveedor las dé. Úsala tal cual, o ajusta las ponderaciones de cada categoría según las prioridades de tu equipo antes de enviarla.

Cómo usar esta tabla de evaluación

Envía las ocho tablas de categorías que aparecen abajo a cada proveedor de tu lista corta, o revísalas durante una demo en vivo con ellos presentes. En cada pregunta, asigna el puntaje completo a una respuesta sólida y respaldada con evidencia, la mitad del puntaje a una respuesta vaga o parcial, y cero a una señal de alerta.

Suma los puntos dentro de cada categoría y luego suma los ocho totales para obtener un puntaje sobre 100. Un proveedor que no puede responder una pregunta obtiene cero en ella, igual que si fuera una señal de alerta.

De un vistazo: las 8 categorías

CategoríaPesoQué evalúa
Cobertura de motores y actualidad de los datos20Qué motores rastrea y qué tan reciente es la información
Metodología y origen de los prompts15De dónde vienen los prompts y qué tan transparente es el rastro de evidencia
Métricas y rigor de medición15Si las cifras resisten un análisis a fondo
Capacidad de acción y ejecución15Si entrega soluciones o solo muestra brechas
Reportes e integraciones10Si los datos llegan a las herramientas que tu equipo ya usa
Seguridad, cumplimiento y gobernanza10Si compras y legal pueden dar el visto bueno
Soporte e incorporación10Qué tan rápido llegas a un primer resultado utilizable
Precios y condiciones contractuales5Si el costo real es visible antes de firmar

Para una comparación más completa de precios y cobertura de motores más allá de las preguntas del RFP, consulta el ranking completo de herramientas.

Categoría 1: Cobertura de motores y actualidad de los datos (20 puntos)

Esta categoría tiene el mayor peso porque una brecha de monitoreo aquí debilita todas las demás métricas de la tabla. Una plataforma que rastrea ChatGPT pero deja fuera los AI Overviews de Google solo responde la mitad de la pregunta de tus compradores. Profound cubre más de nueve motores en su nivel Growth y le pone precio a esa profundidad. Peec AI ofrece un punto de partida ligero de tres modelos y cobra los motores adicionales como complementos. Pídele a cada proveedor que te lo muestre, no solo que te lo describa.

#Pregúntale estoPuntos
1¿Qué motores de IA rastrea la plataforma hoy, y los AI Overviews de Google vienen incluidos por defecto o solo como complemento pago?4
2¿Con qué frecuencia se actualizan los datos de cada motor rastreado, y esa frecuencia cambia según el plan?4
3¿Los AI Overviews de Google y Gemini se rastrean como superficies separadas y claramente identificadas?4
4¿Qué pasa con los datos históricos de tendencia si el proveedor agrega o elimina un motor?4
5¿Podemos agregar un motor nuevo a un conjunto de prompts existente sin repetir toda la incorporación?4

Categoría 2: Metodología y origen de los prompts (15 puntos)

Dos proveedores pueden reportar exactamente el mismo número de share of voice a partir de dos conjuntos de prompts completamente distintos, y solo uno de esos conjuntos refleja cómo buscan realmente tus compradores. Ahrefs Brand Radar construye su corpus de prompts a partir de una base de datos con más de 405 millones de consultas de búsqueda reales, recopiladas en seis plataformas de IA. El AI Visibility Toolkit de Semrush descubre prompts de forma automática a partir del universo de palabras clave que ya existe dentro de tu cuenta de Semrush. Ningún enfoque está mal, pero producen conjuntos de prompts distintos, y tu RFP debe obligar a cada proveedor a decir cuál de los dos estás comprando antes de firmar.

#Pregúntale estoPuntos
6¿Los prompts se obtienen de datos reales de búsqueda o de consultas en chat, se escriben a mano por el comprador, o se descubren automáticamente a partir de una lista de palabras clave existente?3
7¿Cuántas variantes de prompt por intención rastrea la plataforma por defecto, y existe un límite fijo en el plan base?3
8¿La plataforma muestra el texto literal del prompt y la respuesta del motor detrás de una cita puntuada, o solo un porcentaje agregado?3
9¿Cómo gestiona la plataforma la deriva de prompts, es decir, cómo retira los prompts que ya no reflejan cómo los compradores formulan la pregunta?3
10¿Los datos de prompts a nivel de la competencia son visibles en la misma interfaz, o solo se ven los resultados de nuestra propia marca?3

Categoría 3: Métricas y rigor de medición (15 puntos)

Un panel basado en una sola ejecución reporta ruido, no una señal, porque los motores de respuesta son probabilísticos y una sola respuesta es apenas una muestra de una distribución. Esta categoría comprueba si las cifras del proveedor resistirían una auditoría interna antes de que tu equipo las presente hacia arriba.

#Pregúntale estoPuntos
11¿La plataforma reporta share of voice, menciones de marca, citation rate y sentimiento como 4 métricas distintas, o las reduce a un solo puntaje?3
12¿Cuántas ejecuciones por prompt muestrea la plataforma antes de reportar un porcentaje?3
13¿Podemos exportar los datos crudos a nivel de prompt, o solo la vista agregada del panel?3
14¿La puntuación de sentimiento distingue entre positivo, neutral y negativo, o devuelve una marca binaria?3
15¿Cómo marca la plataforma las imprecisiones factuales sobre nuestra marca, de forma separada del sentimiento?3

Categoría 4: Capacidad de acción y ejecución (15 puntos)

La mayoría de las plataformas se detienen en el panel: te muestran la brecha y le dejan la solución a tu equipo. Temso cierra ese ciclo desde €89/mes, su panel convierte una brecha de visibilidad en una lista de soluciones priorizada y un brief de contenido dentro de la misma suscripción, y su agente de SEO con IA puede ejecutar un subconjunto de esas recomendaciones directamente, con un paso de revisión humana antes de que se publique nada. Pregúntale a cada proveedor si “acción” significa una checklist genérica o una solución vinculada a tu brecha real.

#Pregúntale estoPuntos
16Cuando la plataforma encuentra una brecha de visibilidad, ¿produce una solución priorizada y ordenada, o se detiene en el panel?3
17¿La plataforma puede generar un brief de contenido o un borrador vinculado a un prompt específico donde la competencia está ganando?3
18¿La plataforma aborda las brechas de citación en fuentes de terceros, o solo da recomendaciones de contenido propio?3
19¿La plataforma automatiza alguna parte de la ejecución, y qué pasa exactamente sin revisión humana?3
20¿Cómo confirma la plataforma si una solución implementada realmente cerró la brecha en las semanas siguientes?3

Categoría 5: Reportes e integraciones (10 puntos)

Los datos que solo viven dentro del panel de un proveedor rara vez llegan a las personas que necesitan actuar sobre ellos. Esta categoría comprueba si la plataforma envía la evidencia a las herramientas que tu equipo ya usa. Peec AI, por ejemplo, incluye conectores nativos con Slack y herramientas de BI, en lugar de dejarle a la analista la tarea de exportar e importar manualmente.

#Pregúntale estoPuntos
21¿Los reportes se pueden programar y exportar en PDF, CSV o vía API sin copiar y pegar manualmente?2
22¿La plataforma se integra con herramientas que ya usas, como Slack, una herramienta de BI o GA4?2
23¿Puedes crear una vista de panel separada para un resumen ejecutivo frente al detalle a nivel de analista?2
24¿Una API pública viene incluida en el precio base, o solo como complemento pago?2
25¿Se pueden gestionar varias marcas o propiedades desde una sola cuenta sin duplicar accesos?2

Categoría 6: Seguridad, cumplimiento y gobernanza (10 puntos)

Esta es la categoría que puede frenar un trato por completo, no solo restarle puntos. Consigue cada respuesta de esta sección por escrito antes de firmar el contrato, no durante la incorporación.

#Pregúntale estoPuntos
26¿El proveedor tiene la certificación SOC 2 Type II, y puede entregar el informe cuando se lo pidas?2
27¿La plataforma admite SSO y control de acceso basado en roles?2
28¿Dónde se alojan los datos de los clientes, y existe una política documentada de retención y eliminación?2
29¿El contrato incluye un acuerdo de procesamiento de datos que cubra los requisitos del RGPD?2
30¿Quién es dueño del conjunto de prompts y de los datos históricos después de la cancelación, y podemos exportarlo todo antes?2

Categoría 7: Soporte e incorporación (10 puntos)

Una herramienta con datos perfectos no sirve de nada si tu equipo nunca logra superar la configuración. Esta es la categoría donde las plataformas de nivel económico más suelen perder puntos, porque el soporte dedicado suele reservarse para los planes más altos.

#Pregúntale estoPuntos
31¿Cómo es la incorporación del primer día: una configuración guiada, un representante dedicado, o un asistente de autoservicio sin contacto humano?2
32¿Cuál es el tiempo promedio desde el registro hasta tener un primer panel utilizable?2
33¿El soporte al cliente está incluido en todos los planes, o reservado para los planes más caros?2
34¿El proveedor ofrece capacitación o documentación para un equipo sin una analista dedicada de AEO?2
35¿Cuál es el proceso del proveedor para impugnar una mención o un puntaje de sentimiento que crees incorrecto?2

Categoría 8: Precios y condiciones contractuales (5 puntos)

El costo real de una plataforma de visibilidad en IA rara vez aparece en la página de precios. El nivel Starter de Profound solo cubre ChatGPT por €99/mes; la cobertura real está en el nivel Growth por €399/mes. El AI Visibility Toolkit de Semrush es un complemento de €99/mes que exige tener antes un plan Semrush Pro pago desde €139.95/mes para poder activarse. El plan Starter de Peec AI cuesta €85/mes, con motores adicionales que se cobran como complementos de entre €30 y €140/mes cada uno. Temso tiene tres niveles fijos, €89, €199 y €499 al mes, con proyectos, usuarios y recomendaciones ilimitados en los tres, más un 15 % de descuento con compromiso anual.

#Pregúntale estoPuntos
36¿Los precios están publicados, o cada cotización exige una llamada de ventas?1
37¿Los motores, usuarios o el volumen de prompts se cobran como complementos pagos, o vienen incluidos en el precio base?1
38¿Existe una prueba gratis o un período piloto, y exige tarjeta de crédito?1
39¿Cuál es la política de cancelación, y existe un plazo mínimo de contrato?1
40¿Un compromiso anual tiene un descuento publicado, o se negocia caso por caso?1

Cómo leer tus resultados

Un puntaje por encima de 85, sin ninguna señal de alerta en seguridad o rigor de medición, es un candidato sólido. Un puntaje entre 65 y 84 es viable si puedes negociar en torno a las brechas específicas que mostró el proveedor. Por debajo de 65 indica problemas en varias categorías, no solo en un área débil.

Trata la categoría 6 de forma distinta al resto. Una sola señal de alerta de seguridad sin resolver debe descalificar a un proveedor sin importar su puntaje total, porque una brecha de gobernanza de datos no se compensa con una buena metodología de prompts.

Las ponderaciones predeterminadas de arriba le sirven a un comprador general. Una agencia que gestiona varias cuentas de clientes debería subir el peso de reportes e integraciones. Un equipo con compras y legal en la mesa debería subir el peso de seguridad y gobernanza antes de enviar el RFP, no después de recibir las respuestas. La misma lógica de categorías ponderadas es la que impulsa la puntuación detrás de nuestro ranking de herramientas, documentada en detalle en la página de metodología.

Tu hoja de puntuación

Copia esta tabla en una hoja de cálculo, agrega una columna por proveedor, y completa los totales de cada categoría a medida que lleguen las respuestas.

CategoríaPuntos máx.Proveedor AProveedor BProveedor C
1. Cobertura de motores y actualidad de los datos20
2. Metodología y origen de los prompts15
3. Métricas y rigor de medición15
4. Capacidad de acción y ejecución15
5. Reportes e integraciones10
6. Seguridad, cumplimiento y gobernanza10
7. Soporte e incorporación10
8. Precios y condiciones contractuales5
Total100

Aplícalo a tu propia lista corta

Imprime las ocho tablas de arriba, envíalas a cada proveedor de tu lista, y puntúa las respuestas de la misma manera para todos. La tabla de evaluación solo funciona si la aplicas de forma pareja, así que resiste la tentación de saltarte una categoría con el proveedor que ya te gusta.

Si quieres una línea base rápida antes de siquiera enviar el RFP, Temso cubre las categorías de motores, prompts y acción en un solo plan de €89/mes, con prueba gratis y sin necesidad de tarjeta de crédito, lo que le da a tu comité una respuesta funcional contra la cual comparar todas las demás.

Qué leer a continuación

FAQ

¿Qué debe cubrir un RFP de software de visibilidad en IA?

Un RFP completo para software de visibilidad en IA cubre ocho áreas: qué motores de IA rastrea la plataforma y qué tan reciente es esa información, cómo obtiene y gestiona los prompts, qué tan riguroso es en sus métricas, si entrega soluciones o solo un panel, sus reportes e integraciones, su seguridad y gobernanza de datos, su incorporación y soporte, y sus precios y condiciones contractuales. Dar el mayor peso a la cobertura de motores y al rigor de medición refleja dónde más difieren los proveedores.

¿Cuántas preguntas debo hacerles a los proveedores de visibilidad en IA?

Cuarenta preguntas en ocho categorías, cinco por categoría, bastan para separar las plataformas serias de las superficiales sin convertir la compra en un proyecto de varias semanas. Menos de 20 preguntas dejan pasar demasiados puntos de fallo; más de 50 ralentizan al comité de compra sin aportar mucha más señal.

¿Qué cuenta como señal de alerta en la respuesta de un RFP de visibilidad en IA?

Una señal de alerta es cualquier respuesta que oculte el costo real o una brecha de capacidad hasta después de la contratación: un proveedor que no puede mostrar el prompt literal y la respuesta detrás de un porcentaje puntuado, una frecuencia de actualización más lenta que semanal sin un nivel más rápido disponible, precios de complementos por motor que no se revelan hasta después de la demo, o la ausencia de un informe SOC 2 sin un plazo definido para obtenerlo. Una sola señal de alerta en la categoría 6 (seguridad) debe detener el proceso de inmediato.

¿Cómo debo ponderar las categorías de la tabla de evaluación para mi equipo?

Las ponderaciones predeterminadas (20, 15, 15, 15, 10, 10, 10 y 5 puntos) le sirven a un comprador general. Una agencia que gestiona varias cuentas de clientes debería subir el peso de reportes e integraciones. Un equipo de empresa con compras y legal en la mesa debería subir el peso de seguridad y gobernanza. Ajusta las ponderaciones antes de enviar el RFP, no después de recibir las respuestas de los proveedores.

¿Qué puntaje total debería descalificar a un proveedor?

Por debajo de 65 sobre 100 indica brechas reales en varias categorías, no solo un área débil. Entre 65 y 84 es viable si puedes negociar en torno a las brechas específicas. Por encima de 85 y sin ninguna señal de alerta en seguridad o rigor de medición es un candidato sólido. Cualquier señal de alerta sin resolver en la categoría de seguridad y gobernanza debe descalificar a un proveedor sin importar su puntaje total.

¿Ahrefs Brand Radar y Semrush obtienen los prompts de la misma manera?

No. Ahrefs Brand Radar construye su corpus de prompts a partir de una base de datos con más de 405 millones de consultas de búsqueda reales, recopiladas en seis plataformas de IA. El AI Visibility Toolkit de Semrush descubre prompts de forma automática a partir del universo de palabras clave que ya existe dentro de la cuenta de Semrush del cliente. Ambos son puntos de partida legítimos, pero producen conjuntos de prompts distintos, y la respuesta de un RFP debe indicar cuál de los dos está recibiendo el comprador.