Respuesta corta: para medir visibilidad en IA necesitas un conjunto versionado de preguntas, más de una plataforma, más de una ronda y la respuesta original de cada ejecución. Después separas presencia, recomendación, exactitud, fuentes y variabilidad. No necesitas empezar con una puntuación. La unidad mínima no es una posición; es una observación trazable: pregunta, plataforma, fecha, región, idioma, respuesta completa y fuentes visibles.

Empieza por los datos propios gratuitos

Antes de pagar un panel, comprueba las propiedades verificadas de la marca. Google Search Console ha anunciado informes específicos para AI Overviews y AI Mode con clics, impresiones, páginas, países, dispositivos y fechas. Bing Webmaster Tools ofrece en vista previa pública citas, páginas citadas, tendencias y frases agrupadas para Copilot, Bing y socios.

Son fuentes valiosas y no deben esconderse para justificar un servicio. También tienen límites: Google no documenta en ese informe la pregunta literal ni la respuesta completa, y Bing aclara que sus frases están agrupadas y que los datos son una muestra. Ninguna de las dos sustituye una medición con preguntas exactas, respuestas conservadas, competidores y dos rondas comparables.

1. Empieza por una decisión

Una medición sin decisión produce un panel bonito y poco trabajo útil. Define una sola pregunta de negocio:

  • ¿la marca entra en comparaciones sin que el usuario la nombre?
  • ¿se describe de forma correcta?
  • ¿qué fuentes aparecen para la categoría?
  • ¿qué competidor domina una intención concreta?
  • ¿qué hueco puede resolver la web propia?
  • ¿merece la pena un seguimiento recurrente?

La decisión determina preguntas, mercado, plataformas, rondas y entregable.

2. Diseña el conjunto de preguntas

Cada pregunta debe registrar un identificador estable, el texto exacto, la procedencia, la intención, la etapa de compra, el idioma y el país, si incluye o no el nombre de la marca, la versión y la fecha de alta.

Procedencia

Prioriza preguntas obtenidas de entrevistas y tickets reales, búsquedas internas, conversaciones de ventas e investigación de consultas. Las frases agrupadas de Bing sirven como pista, no como pregunta literal. Una hipótesis explícita vale cuando no existe otra fuente, siempre que no se presente como demanda observada.

Marca y no marca

«¿Qué sabes de Nubaria?» mide reconocimiento o representación. «Mejor programa de facturación para autónomos» mide descubrimiento sin marca. Mezclarlas en una sola tasa infla la lectura.

3. Fija el alcance

Nuestro diagnóstico usa 12 preguntas, 2 plataformas y 1 ronda: 24 observaciones. El acompañamiento repite 20 preguntas en 2 plataformas dos veces al mes. El número no demuestra representatividad; hace visible el trabajo, el coste y los huecos.

Registra antes de empezar: plataformas y versiones visibles, acceso web activado o no, sesión limpia o iniciada, región e idioma, intervalo entre rondas, límite de reintentos, tratamiento de errores y qué datos no deben introducirse nunca en un asistente.

4. Conserva la evidencia

Por observación guarda: identificador de ejecución, pregunta y versión, plataforma, fecha y hora, estado (válida, error o no disponible), respuesta completa, marcas presentes, recomendación explícita si existe, posición si hay una lista, afirmaciones verificables, fuentes visibles, método de extracción, confianza y revisor.

Una captura es útil para revisar diseño y estado. No sustituye datos estructurados ni una definición.

5. Clasifica sin esconder la muestra

Tasa de mención

Respuestas válidas que mencionan la marca dividido entre respuestas válidas elegibles. Publica numerador y denominador. Excluye errores según una regla definida antes de ver el resultado.

Tasa de recomendación

Respuestas válidas que recomiendan explícitamente la marca dividido entre respuestas válidas elegibles. Una mención no es una recomendación: «no recomendamos Nubaria» contiene la marca y no es un resultado favorable.

Posición

Solo existe cuando la respuesta presenta un orden interpretable. No asignes posición a un párrafo sin lista ni conviertas el primer nombre de una frase en un ranking.

Exactitud

Revisa afirmaciones concretas contra una fuente: correcta, parcial, incorrecta o no verificable. El tono positivo no convierte una afirmación en correcta.

Fuentes

Cuenta dominio y URL por separado. Una fuente visible no prueba causalidad. Registra si es propia, de un competidor, de un tercero, institucional, documentación o comunidad.

6. Muestra la variabilidad

Para cada combinación de pregunta y plataforma compara rondas: presente en todas, ausente en todas, variable o no evaluable. Compara también hechos, recomendación, posición y fuentes. Dos respuestas pueden mencionar la marca y describirla de forma distinta.

Una tasa agregada puede mantenerse estable mientras cambian casi todas las filas. Por eso la matriz completa debe estar disponible, no solo el resumen.

7. Separa observación, inferencia y acción

TipoContenido
ObservaciónUna guía de un comparador apareció en 9 de 24 respuestas
InferenciaPuede ser una fuente relevante para esa intención
AcciónRevisar si la ficha es correcta y aportar una actualización legítima
VerificaciónRepetir las mismas preguntas después de la actualización

No escribas «la guía causó las respuestas» si el protocolo no puede demostrarlo.

8. Prioriza por control y evidencia

Cada acción debería tener el hallazgo que la origina, el mecanismo esperado, el control del cliente de 1 a 5, la fuerza de la evidencia de 1 a 5, el coste, el responsable, la fecha, el riesgo y la observación que la evaluará después.

El trabajo con control alto y evidencia alta va primero. Una acción externa, cara y basada en una sola respuesta espera.

9. Qué debe recibir el cliente

Resumen ejecutivo, alcance y metodología, presencia por intención y plataforma, afirmaciones y exactitud, mapa de fuentes, variabilidad, plan de acción, matriz completa, registro de errores, exportación de datos, definiciones y versión, límites y no garantías.

Una puntuación sin anexo impide auditar. Un anexo sin resumen impide decidir. Se necesitan ambos niveles.

Errores comunes

  • Consultar una vez. La respuesta puede cambiar. Una ronda no permite hablar de estabilidad.
  • Escribir preguntas para producir el resultado deseado. Preguntas con la marca o afirmaciones inducidas inflan la presencia.
  • Mezclar plataformas. Una media puede ocultar que la marca aparece en una y no en otra. Enseña ambas.
  • Tratar errores como ceros. Un tiempo de espera agotado no demuestra ausencia. Regístralo como error.
  • Llamar cuota de mercado a una muestra. La selección de preguntas no es una encuesta representativa. Di «tasa observada en la muestra».
  • Atribuir el cambio a la última acción. Una respuesta distinta puede coincidir con una página nueva sin haber sido causada por ella.
  • Ocultar la respuesta original. Sin evidencia, el cliente solo puede confiar en el proveedor. Esa dependencia reduce el valor del informe.

Plantilla mínima

Decisión · mercado e idioma · preguntas y procedencia · plataformas · rondas · observaciones previstas · errores · menciones · recomendaciones · afirmaciones incorrectas · fuentes principales · combinaciones variables · tres acciones bajo control · siguiente ronda.

Copia esta lista en una hoja de cálculo y ya tienes el esqueleto de una línea base. El resto es disciplina: mismas preguntas, misma plataforma, otra fecha.

Cuándo convertirlo en seguimiento

No contrates un seguimiento recurrente antes de demostrar que alguien necesita memoria longitudinal. Tiene sentido cuando existe una línea base, hay una decisión recurrente, el conjunto de preguntas se mantiene, la empresa actuará ante cambios y una segunda ronda ya produjo valor.

Siguiente paso

Si quieres una línea base hecha con este protocolo, el Diagnóstico IA son doce preguntas, dos plataformas, veinticuatro observaciones guardadas, hasta tres competidores y cinco prioridades, entregado en cinco días laborables.