Para saber qué dicen ChatGPT y los demás asistentes de IA de tu marca, abre ChatGPT, Gemini, Perplexity y Google en sesiones limpias y haz diez preguntas que haría un comprador, sin nombrar tu marca. Repite cada pregunta de tres a cinco veces. Anota cada respuesta en una hoja de cálculo: mencionada, recomendada, citada, con errores. Después calcula en qué proporción de las respuestas apareces.
Puntos clave
- Haz preguntas de categoría (“el mejor X para Y”), no “¿qué sabes de [marca]?”.
- Comprueba en sesiones limpias: sin iniciar sesión o en un chat temporal sin personalización, y con un chat nuevo en cada ejecución.
- Repite cada prompt (la pregunta que se le hace a la IA). En el estudio de SparkToro y Gumshoe (enero de 2026), dos respuestas de ChatGPT nombraron la misma lista de marcas menos de 1 vez de cada 100.
- Informa de la proporción de respuestas que te nombran, nunca de una “posición”.
- Una comprobación manual da una primera impresión; para seguir la evolución en el tiempo hace falta automatizar.
Paso 1: ¿qué preguntas hay que hacer a los asistentes de IA?
No empieces por “¿Qué sabes de [marca]?”. Esa pregunta solo muestra lo que dice un asistente cuando ya le has dado tu nombre. Lo que interesa comprobar es si tu marca aparece cuando nadie la menciona.
Escribe diez preguntas de categoría con las palabras de tus clientes, por ejemplo:
- “El mejor [tipo de producto] para [caso de uso]”
- “Alternativas a [competidor] para un equipo pequeño”
Redáctalas como se pregunta en tu mercado, con ciudad y moneda cuando importen: “gestoría online para autónomos en Valencia por menos de 50 € al mes” o “programa de nómina para una pyme en Ciudad de México por menos de 1000 pesos al mes”.
Añade después dos o tres preguntas de marca (“¿Cuánto cuesta [marca]?”) y cuéntalas aparte: las preguntas de categoría muestran si te recomiendan; las de marca, si los datos son correctos.
Mantén fija la redacción, o no podrás comparar unas ejecuciones con otras. Tienes un conjunto inicial por etapa de compra en qué prompts conviene seguir.
Paso 2: ¿qué asistentes de IA conviene comprobar?
Comprueba los asistentes que usan tus clientes, además de Google. El gráfico de chatbots de IA de Statcounter de septiembre de 2026 atribuye a ChatGPT el 80,48 % en todo el mundo, a Gemini el 10,91 %, a Perplexity el 5,85 %, a Microsoft Copilot el 1,79 % y a Claude el 0,95 %. En España, el gráfico del país situaba ese mes a ChatGPT en torno al 78 % y a Gemini algo por encima del 14 %; consulta el de tu país.
En su nota de prensa del 7 de mayo de 2026, Statcounter describe la métrica como la cuota de cada chatbot en las visitas remitidas a sitios web, medida en más de 1 millón de sitios. Cuenta las visitas enviadas a sitios web, no usuarios ni conversaciones. Grok no aparece porque no transmite datos de procedencia de las visitas, según la nota. Google AI Overviews (los resúmenes de IA de Google) tampoco figura en el gráfico.
Los asistentes también se diferencian en el origen de sus respuestas. La tabla resume la documentación de cada proveedor, consultada el 1 de octubre de 2026.
| Asistente | De dónde sale la respuesta | Qué anotar en tu registro |
|---|---|---|
| ChatGPT | Puede buscar en la web por su cuenta cuando necesita información actual; las respuestas con búsqueda pueden incluir citas (ayuda de OpenAI) | ¿Aparecieron citas? |
| Gemini | Puede añadir enlaces a las fuentes; no todas las respuestas los incluyen (ayuda de las aplicaciones de Gemini) | ¿Hay un botón de fuentes? |
| Google AI Overviews | Se generan en la Búsqueda de Google, a veces a partir de varias búsquedas relacionadas; “a menudo no se activan” (“often don’t trigger”, en el original; Google Search Central, actualizado el 10 de diciembre de 2025) | “No se mostró ningún resumen” es un resultado válido |
| Perplexity | Busca en internet en tiempo real y numera sus citas (centro de ayuda de Perplexity) | ¿Qué dominios cita? |
| Claude | Busca en la web cuando resulta útil o cuando la búsqueda web está activada; las respuestas con búsqueda incluyen citas (centro de ayuda de Claude) | ¿Hizo una búsqueda? |
Cuando una respuesta incluya enlaces a fuentes, anótalos: muestran en qué páginas se ha apoyado el asistente.
Paso 3: ¿cómo conseguir respuestas limpias y sin personalizar?
Los asistentes pueden adaptar las respuestas a quien pregunta. Para ver lo que ve un cliente nuevo, elimina tu rastro de la prueba.
- ChatGPT: usa una ventana privada sin iniciar sesión, o un chat temporal con la opción sin personalización (Unpersonalized). La página de ayuda de OpenAI sobre el chat temporal indica que esa opción no usa ni la memoria ni las instrucciones personalizadas, mientras que la opción personalizada (Personalized) puede usar ambas.
- Gemini: usa un chat temporal (requiere iniciar sesión con una cuenta personal de Google). La página de ayuda de Google incluye las respuestas personalizadas entre lo que un chat temporal no puede ofrecer.
- Google AI Overviews: busca en una ventana privada, sin iniciar sesión. La ayuda de la Búsqueda de Google enumera los países y los idiomas en los que los resúmenes están disponibles para todos los usuarios.
- Todos los asistentes: abre un chat nuevo en cada ejecución, para que las respuestas anteriores no condicionen las siguientes. Anota tu país y tu idioma: la página de ayuda de OpenAI sobre la búsqueda indica que ChatGPT puede estimar tu ubicación a partir de tu dirección IP.
Un estudio de Profound publicado el 9 de septiembre de 2026 ejecutó prompts sobre ropa, muebles y tarjetas de crédito en ChatGPT, Claude y Gemini durante 14 días (del 11 al 24 de agosto de 2026; 71.147 respuestas). Cada prompt empezaba con una línea que describía un perfil de usuario, por ejemplo una edad o una profesión. Las respuestas para perfiles distintos compartían aproximadamente 1 de cada 4 marcas recomendadas. Para un mismo perfil, unas 2 de cada 5.
Dos salvedades: son datos de un solo proveedor, y el perfil se escribió en el prompt, no estaba guardado en la memoria de la cuenta. Aun así, la lista variaba incluso cuando el perfil no cambiaba.
Paso 4: ¿qué hay que anotar de cada respuesta?
Anota una fila por respuesta. Las filas siguientes son ilustrativas, no datos reales.
| Fecha | Asistente | Prompt | Ejecución | ¿Mencionada? | ¿Recomendada? | Marcas nombradas en su lugar | Fuentes citadas | Errores |
|---|---|---|---|---|---|---|---|---|
| 5 oct | ChatGPT | mejor programa de facturación para autónomos | 1 | Sí | Solo mencionada | Marca A, Marca B | sitio de reseñas | Precio desactualizado |
| 5 oct | ChatGPT | mismo prompt | 2 | No | No | Marca A, Marca C | ninguna | Ninguno |
| 5 oct | Perplexity | mismo prompt | 1 | Sí | Sí | Marca B | nuestra página de precios | Ninguno |
- Distingue entre mencionada, recomendada y citada. Mencionada significa que la marca aparece en cualquier punto de la respuesta. Recomendada, que el asistente aconseja elegirte para el caso de quien pregunta. Citada, que tu sitio web figura entre las fuentes. Las definiciones completas están en qué es la visibilidad en IA (AI visibility).
- Guarda el texto completo de cada respuesta en una segunda hoja.
- Apunta todos los errores de hecho: un precio equivocado, una función que falta, una confusión con una empresa de nombre parecido.
Paso 5: ¿cómo interpretar los resultados?
Calcula una proporción, no una posición. Para cada asistente, divide las respuestas que nombran tu marca entre todas las respuestas a tus prompts de categoría.
En un estudio de SparkToro y Gumshoe publicado el 28 de enero de 2026, 600 voluntarios ejecutaron 12 prompts un total de 2961 veces en ChatGPT, Claude y Google AI Overviews; cuando no aparecía ningún resumen, se usó AI Mode (Modo IA). En ChatGPT y en la IA de Google, la probabilidad de que dos respuestas cualesquiera contuvieran la misma lista de marcas fue inferior a 1 entre 100. Claude fue solo un poco más constante. La misma lista en el mismo orden apareció aproximadamente una vez cada 1000 ejecuciones. El autor, Rand Fishkin, concluyó que un porcentaje de visibilidad calculado sobre muchos prompts repetidos es una métrica razonable, y que una posición en una lista no lo es.
Una sola captura de pantalla no demuestra nada, ni a favor ni en contra.
Un ejemplo de cálculo (es aritmética, no datos): diez prompts ejecutados cinco veces dan 50 respuestas por asistente. Si tu marca aparece en 15, la tasa de mención (mention rate) es del 30 %, y el intervalo de confianza al 95 %, es decir, el rango en el que cabe esperar el valor real (método de Wilson, tratando las respuestas como independientes), va aproximadamente del 19 al 44 %. Esa muestra distingue entre “nunca”, “a veces” y “casi siempre”. No permite distinguir un 30 % de un 40 %.
Un artículo de Schulte, Bleeker y Kaufmann, publicado en arXiv el 8 de abril de 2026, ejecutó ocho prompts en alemán en cada uno de cuatro sectores suizos en ChatGPT, Gemini, Google AI Mode y Perplexity: a diario del 24 de enero al 20 de marzo de 2026 y, después, hasta diez veces seguidas entre el 21 y el 25 de marzo. En las ejecuciones repetidas, el error estándar de la tasa de detección de una marca bajó de 0,10 con siete ejecuciones (un intervalo al 95 % de unos ±16 puntos porcentuales). Los autores recomiendan al menos siete ejecuciones por prompt y día. Es un solo país (Suiza) y unos pocos sectores, así que toma siete como un mínimo, no como una ley. Más detalles en por qué las respuestas de la IA cambian cada vez.
¿Dónde deja de funcionar la comprobación manual de la visibilidad en IA?
El método manual responde bien a dos preguntas: ¿saben los asistentes que existes? y ¿son correctos los datos? Se queda corto en cuatro puntos.
- Volumen. Diez prompts, cuatro asistentes y cinco ejecuciones suman 200 respuestas que leer y anotar.
- Tamaño de la muestra. Fishkin, de SparkToro, calcula que suelen hacer falta al menos entre 60 y 100 ejecuciones de un prompt para conocer el conjunto de recomendaciones de un asistente.
- Personalización y ubicación. Compruebas desde un solo dispositivo y un solo país. Un comprador en otro lugar puede recibir una respuesta distinta: no es lo mismo preguntar desde Madrid que desde Bogotá.
- Tiempo. Una comprobación es una instantánea. Los autores del artículo de arXiv recomiendan una ventana móvil de dos a cuatro semanas.
Para una primera impresión no necesitas ninguna herramienta. Automatiza cuando tengas que comparar meses, cubrir varios países o idiomas, o enseñar las cifras a alguien que va a preguntar cómo se han medido.
Haz tu primera comprobación
Empieza por el método manual: diez prompts y una hoja de cálculo. O haz la comprobación gratuita y puntual en la página de inicio de Brandometer.
Brandometer automatiza la repetición. Envía cada prompt a 9 motores de IA varias veces y en sesiones limpias, e informa de la tasa de mención con intervalos de confianza, de si tu marca aparece recomendada o solo mencionada, de qué competidores se nombran en su lugar y de qué fuentes se citan. Mide y propone hipótesis; no puede cambiar lo que dice un asistente. Consulta la metodología.
Para probarlo, crea una cuenta. Las cuentas nuevas reciben 200 créditos de bonificación tras confirmar el correo electrónico. No hay suscripción: los créditos son de prepago, no caducan y solo pagas cuando mides.
FAQ
¿Hay alguna herramienta gratuita para comprobar la visibilidad en IA?
Sí. Ahrefs y Backlinko, entre otros, tenían comprobadores gratuitos en línea el 1 de octubre de 2026, y Brandometer ofrece una comprobación gratuita y puntual en la página de inicio. Toma cualquier comprobación gratuita como una instantánea de unas pocas respuestas en un día concreto, no como una tendencia.
¿Por qué ChatGPT nos mencionó ayer y hoy no?
Eso por sí solo no indica un cambio. Los asistentes generan cada respuesta de nuevo: en el estudio de SparkToro y Gumshoe (enero de 2026), dos respuestas de ChatGPT nombraron la misma lista de marcas menos de 1 vez de cada 100. Valora la proporción en muchas ejecuciones, no una respuesta aislada.
¿Hace falta comprobar todos los asistentes de IA?
No. Empieza por ChatGPT, Gemini y Google AI Overviews, y añade después los asistentes que mencionen tus clientes o los que te envíen visitas.