Cómo medir si un asistente de IA menciona tu marca
La matriz de prompts, las instantáneas fijadas y la aritmética — y las cuatro formas en que esta medición te miente.
La medición aquí es fácil de describir y fácil de hacer mal. Necesitas un conjunto fijo de prompts, instantáneas fijadas de modelos y una regla sobre qué cuenta como mención — las tres decididas antes de mirar una sola respuesta.
La matriz
Escribe prompts como los escribiría un comprador real. No palabras clave: preguntas. «¿Qué uso para monitorizar menciones de marca en ChatGPT?» es un prompt. «Herramienta de visibilidad IA» es una consulta de búsqueda, y nadie habla así con un asistente.
Versiona el conjunto y congélalo. Nunca edites un prompt en su sitio: un prompt cambiado recibe un id nuevo y una versión nueva de la matriz, o tu serie temporal deja de significar algo en silencio mientras sigue produciendo cifras.
Cubre las formas que los compradores usan de verdad: recomendación directa, comparación con un competidor nombrado, definición de categoría, y planteamiento desde el problema donde tu categoría no se menciona. En la última es donde las marcas suelen descubrir que son invisibles.
La fijación
Ejecuta contra instantáneas fijadas, no contra «la última». Un proveedor que actualiza un modelo por debajo produce un salto indistinguible de un cambio causado por ti. Registra el identificador de la instantánea en cada ejecución. Si tu herramienta no puede fijar, tus mediciones no son comparables entre meses y no deberían dibujarse como una línea.
La aritmética
Cuenta las respuestas que te nombran, divide entre las que ejecutaste. Presenta los dos enteros, nunca solo el porcentaje. 3/5 y 300/500 son el mismo porcentaje y no el mismo hallazgo, y la diferencia importa justo cuando la cifra se mueve.
Las cuatro formas en que esto miente
No determinismo. El mismo prompt contra la misma instantánea no devuelve la misma respuesta. Ejecuta cada prompt varias veces y presenta la tasa, no el resultado. Una sola ejecución es una anécdota con un número al lado.
Personalización e idioma. Las respuestas difieren por cuenta, por región y por si el asistente tiene búsqueda activada. Una medición tomada de la sesión de un operador es una medición de esa sesión.
El denominador que elegiste. Los prompts los escribiste tú. Una matriz que favorezca tu posicionamiento te mostrará ganando, y seguirá mostrándolo mientras optimizas hacia ella. Es el fallo más común y el más difícil de ver desde dentro.
Ausencia de control. Este es el grande. Si tus cifras se mueven, no puedes atribuir el movimiento a nada que hicieras — no sin un grupo de control, que nadie tiene en producción. Informar del movimiento está bien. Afirmar que lo causaste, no.
Comprar en vez de construir
Una docena de plataformas venden esta medición, y las comparativas — la de Rankability sobre rastreadores de visibilidad y la propia recopilación de Otterly — son un mapa razonable de un campo saturado. Compra una si quieres el panel y el histórico.
Entiende la aritmética igualmente. Una cifra cuya derivación no puedes reproducir no es evidencia, y la mayoría de los paneles de proveedor son bastante menos específicos sobre método que la investigación que dio nombre a la disciplina. Hazle dos preguntas a cualquier proveedor antes de firmar: qué instantáneas fijas y cuántas veces ejecutas cada prompt. Las respuestas son diagnósticas.
Cómo es un informe defendible
Enteros a ambos lados. La versión de la matriz y los identificadores de las instantáneas. El número de ejecuciones por prompt. Y una frase sobre lo que las cifras no establecen — que, en esta disciplina, es casi todo. Nuestra versión de esa frase está en la metodología.