Metodología

Cómo funciona la medición por dentro.

Este es el método detrás del estudio, escrito para que puedas juzgarlo antes de contratar nada. Cubre qué se cuenta, cómo se arman las preguntas y por qué nunca nombran tu marca, a qué asistentes se les pregunta, cómo se dimensiona un estudio, y las cosas que una medición honesta no va a afirmar.

Volver a la vista general
En esta página

Investigación de respuestas de IA

Google te da diez links. Un modelo de IA te da una respuesta.

Hasta ahora, que alguien encontrara tu marca o página quería decir posicionar. Un buscador entregaba una página de links y la persona decidía cuál abrir. La posición importaba porque había una lista en la cual tener posición.

Un modelo no entrega una lista. Lee las fuentes él mismo, decide qué cree, y contesta en un párrafo. Tu marca o página están dentro de ese párrafo o no están. La persona puede que nunca vea un link, nunca visite el sitio de nadie, y nunca sepa qué marcas quedaron fuera de la respuesta.

Eso es lo que esto mide, y medir tiene que ir primero, porque no puedes mejorar una respuesta que nadie ha leído.

Resultados Google

Un buscador, 2015

  • Los 12 mejores bloqueadores para niños, probadosconsumerreports.org
  • Bloqueador para piel sensible | Solariasolaria.mx
  • Mineral contra químico: lo que hay que saberaad.org
  • Bloqsol Kids SPF 50, compra en líneafarmaciasanpablo.com.mx
  • ¿Qué bloqueadores usan los dermatólogos?reddit.com
  • Estudio de seguridad de bloqueadores 2024profeco.gob.mx

Resultados ChatGPT

Un modelo de IA, hoy

Para piel infantil sensible, elige un bloqueador mineral con óxido de zinc en SPF 50. Bloqsol Kids es el que más se recomienda, y Dermalux Pediatric aparece con frecuencia para niños con dermatitis. Reaplica cada dos horas.

Entraron seis fuentes. Salieron dos marcas. Nadie hizo clic en un solo link, no se visitó ningún sitio, y las marcas que quedaron fuera no tienen forma siquiera de enterarse de que quedaron fuera. Ese es todo el problema en una línea, y por eso adivinar no es una opción.

Para quién es
Marcas que se compran a través de retailers, distribuidores, farmacias, asesores o recomendaciones. Productos de consumo es el caso más claro; salud, servicios financieros y categorías B2B que se juzgan por fuentes de terceros tienen el mismo problema.
Qué responde
Cuando alguien le pregunta a un modelo sobre tu categoría, si tu marca aparece, si la recomiendan, qué se dice de ella, y qué fuentes están formando esa respuesta.
Qué recibes
Un banco de preguntas congelado, cada respuesta registrada y legible, un reporte de tasas en lugar de scores, una lista ordenada de las fuentes que las están moviendo, y las prioridades que señala cada una.

Esto es investigación de mercado sobre esas respuestas, para marcas cuya posición no se puede leer desde su propio sitio web. Diseñamos el banco de preguntas con tu equipo, lo corremos en los modelos que importan para tu categoría, leemos cada respuesta, y te entregamos un reporte con evidencia y una sesión de trabajo sobre dónde enfocarte primero.

Así que la única manera honesta de saber dónde estás parado es preguntarle a un modelo de IA una pregunta real y leer cómo responde.

Qué se cuenta

Lo mismo, de la misma forma, en cada respuesta, en cada corrida. La consistencia es lo que hace comparable la corrida dos con la corrida uno.

  • Menciones de marcaCada aparición de la marca, sus alias, sus submarcas y sus errores de escritura.
  • Menciones de competidoresLo mismo, para cada marca del set competitivo, que es lo que hace posible una cifra de participación.
  • RecomendacionesSeparadas de las simples menciones, porque ser listado y ser recomendado son resultados distintos.
  • FuentesCada sitio citado o nombrado, sin duplicados y ordenado por quién puede influir en él.
  • Negativas y respuestas evasivasSe registran como estado propio. Que un asistente se niegue a recomendar es información, no un dato faltante.

Y lo que la marca necesite además

Los contadores de al lado vienen en cada proyecto. Estos se agregan cuando la marca tiene una razón para pedirlos, y ahí es donde vive casi toda la personalización.

  • Sentimiento hacia la marca y hacia la categoría
  • Alertas cuando un asistente repite una crítica específica o un estudio desactualizado
  • Qué retailers y canales nombra la respuesta como lugares de compra
  • Si una afirmación que legalmente puedes hacer la están haciendo por ti
  • Si una submarca se le está acreditando a la marca madre, o al revés

Por qué no se mide desde tu sitio

Tu sitio web es el instrumento equivocado

Casi toda herramienta en este espacio heredó su marco del SEO. Rastrea tu sitio, califica tus páginas y recomienda contenido para que el sitio sea citado. Ese es un producto coherente para una empresa cuyos ingresos llegan por su propio sitio web.

Es el marco equivocado para buena parte del mercado de consumo. Una marca de bloqueador solar vende en farmacias y supermercados. Su sitio es un folleto con consejos de cuidado solar. Ninguna cantidad de trabajo on-page cambia el hecho de que la compra ocurre en un anaquel, y el tráfico al sitio no es proxy de nada que el equipo de marketing esté tratando de mover.

Construye la medición alrededor del sitio y produces un reporte lleno de números sobre los que nadie puede actuar. Por eso la construimos alrededor de la conversación de categoría, y eso lleva a una regla que gobierna todo el banco de prompts.

Para saber si tu marca aparece por sí sola, la pregunta no puede mencionarla. Nombra la marca y el modelo la va a comentar con gusto, y lo que mediste fue tu propia pregunta.

Eso rige una capa del banco, no el banco entero. También vas a querer preguntar por tu marca directamente, y por cómo te comparas con las demás, y esas preguntas también están adentro. Lo que importa es que los tres tipos se pregunten aparte y se cuenten aparte, porque mezclarlos te da un número que no responde nada.

Los cuatro pasos de una compra, y dónde aparece tu sitio

  1. 01

    Le pregunta a un asistente qué comprar

    Recibe una lista corta. Tu sitio no está en ella.

  2. 02

    Revisa la app de una cadena de farmacias

    Lee una ficha de producto que escribió el retailer.

  3. 03

    Lee dos reseñas

    Un foro de mamás y una revista de consumo.

  4. 04

    La compra en el pasillo

    La decisión ya estaba tomada antes de llegar.

Veces que el comprador visitó el sitio web de la marca: 0

Cuatro resultados reemplazan al tráfico

Si no puedes contar visitas, cuenta esto. Cada uno se observa en el texto de la respuesta, sin integrar analytics y sin poner una etiqueta en tu sitio.

01

Mencionada

¿La marca aparece siquiera en una pregunta que nunca la nombra?

El piso. Presencia en la conversación de categoría.

02

Recomendada

¿El asistente la sugiere, o nada más la lista junto con otras?

Aparecer en una lista de ocho no es lo mismo que ser la que te dicen que compres.

03

Señalada como la mejor

¿La distingue en lugar de agruparla?

La forma más fuerte de presencia, y la más rara.

04

Con ruta de compra

¿La respuesta le dice a la persona dónde comprarla?

Lo más cerca que esto llega a la intención de compra, y no necesita analytics, porque lo que registramos es lo que dijo el asistente y no lo que la persona hizo después.

Una precaución que conviene resolver antes de la corrida y no después. Una mención a tu tienda en línea es señal de compra. Una mención a tu sitio corporativo es awareness. Una cuenta de redes sin tienda conectada no es ninguna de las dos. Promédialas en un solo número de propiedades propias y vas a reportar presencia como si fuera intención.

El sistema

Cómo corre una medición, paso a paso

Cinco pasos. Haz clic en cualquiera. Las partes que cargan el criterio son el banco de prompts y la lectura de las respuestas, y de esas dos trata el resto de esta página.

paso 1 de 5

Levantamiento

Entender la marca y qué tiene que cambiar el resultado

Tres preguntas hacen casi todo el trabajo. ¿El dinero llega por tu sitio web o por un anaquel? ¿Qué decisión tomarías distinto según el resultado? ¿Con quién compites, incluyendo las marcas que un asistente trata como intercambiables con la tuya aunque tú no lo hagas?

Esa última agarra a la gente desprevenida. Los asistentes agrupan de forma rutinaria una marca premium con la marca propia de supermercado que está junto a ella en el anaquel. Si tu lista de competidores solo trae marcas que tu equipo comercial respeta, el número de participación va a estar mal de una forma que nadie nota.

Lo mínimo para arrancar es una lista de competidores y tus dominios propios. Los términos de Search Console, las preguntas frecuentes del call center y los logs del buscador interno hacen que las preguntas apunten mejor. No cambian si el número es confiable.

Cómo se escriben las preguntas

El banco es el instrumento, así que vale la pena ver cómo se arma uno. Empieza por tu categoría y nunca por tu marca, y crece en dos direcciones: los temas sobre los que la gente pregunta, y las distintas formas en que pregunta sobre cada uno.

La categoríaBloqueador solar

Primero, los temas que hay adentro

Nadie pregunta por una categoría. Pregunta por una situación dentro de ella. Así que el primer trabajo es listar cada tema que un comprador real trae a esta categoría, y escribir preguntas para cada uno. Aquí hay siete para bloqueador solar, con el tipo de pregunta que va debajo de cada tema.

  • Proteger a los niños

    qué bloqueador es más seguro para un niño pequeño

  • Piel sensible

    cuál bloqueador no me irrita la rosácea

  • Uso diario en la cara

    puedo usar bloqueador debajo del maquillaje todos los días

  • Playa y deporte

    cuál aguanta de verdad cuando te metes al agua

  • Seguridad de ingredientes

    la oxibenzona hace daño

  • Precio y valor

    vale la pena el bloqueador caro

  • Dónde comprar

    dónde compro bloqueador mineral en México

Después, las distintas personas que preguntan

Una pregunta por tema no es una medición, es una muestra de uno. Así que cada tema recibe varias preguntas que le entran desde ángulos genuinamente distintos. Toma el tema de los niños. Estas cuatro no son la misma pregunta redactada de otra forma, y un asistente las contesta diferente.

Por quién pregunta
bloqueador para bebé de menos de seis meses
Por la situación
cómo evito que mis hijos se quemen en la playa
Por qué tan avanzada va la decisión
cuál bloqueador para niños es el mejor
Por comparación
bloqueador mineral o químico para niños

Después, las preguntas que sí te nombran

Todo lo de arriba deja tu nombre fuera a propósito, porque esa es la única forma de saber si apareces sin que te pidan. Pero mucho de lo que necesitas saber solo sale a flote cuando la marca ya está sobre la mesa. Así que el banco tiene una segunda capa que la nombra directo, y responde otra cosa: no si te encuentran, sino qué pasa una vez que ya lo hicieron.

Qué cree el modelo sobre ti
Solaria es seguro para un bebé
Si manda a los compradores a donde todavía te surten
dónde compro Solaria
Qué crítica trae pegada tu nombre
el bloqueador Solaria tiene algún problema
Si una submarca se te acredita a ti
Solaria Kids es lo mismo que Solaria

Y las preguntas sobre todos los demás

Una cifra de participación necesita un denominador, y el denominador es tu set competitivo. Ese set casi nunca es el que tu equipo comercial escribiría de memoria. Tiene que incluir a quien el modelo trata como intercambiable contigo, que de forma rutinaria es la marca propia de supermercado que está junto a ti en el anaquel. Esta tercera capa es donde te enteras de qué marcas son dueñas de la conversación de categoría, y qué comparaciones están pasando sin ti adentro.

Quién es dueño de la categoría
qué marcas de bloqueador recomiendan los dermatólogos
Frente a frente, con nombre
Solaria es mejor que Bloqsol para niños
Comparaciones donde no estás
Bloqsol o Dermalux para piel sensible
Quién es dueño de cada atributo
qué marca de bloqueador da el mejor valor en México

Tres capas, contadas aparte

Las preguntas sin marca, con marca y competitivas tienen cada una sus propios números, y nunca se promedian juntas. Una tasa de mención sin marca te dice si la conversación de categoría te incluye. Una con marca te dice qué pasa después de que alguien ya te eligió. Una competitiva te dice contra quién te están pesando. Mézclalas y cada cifra se mueve por razones que nadie puede explicar. Separadas, cada una tiene un corte con tamaño suficiente para reportarse, que es más o menos la razón por la que un banco termina entre cincuenta y cien preguntas y no en una docena.

No todos los modelos de IA responden igual

Esta es la única idea de verdad técnica de la página, y vale dos minutos porque cambia lo que significa un resultado.

Cuando le preguntas algo a un modelo, puede responder de dos maneras. Puede responder de memoria, usando solo lo que absorbió mientras lo entrenaron, y en ese caso no miró internet para nada: tu marca está en su memoria o no está. O puede ir a buscar primero, leer lo que encuentra, y escribir una respuesta con eso. Mismo modelo, misma pregunta, y algo completamente distinto medido.

Hay un tercer caso, donde el buscador mismo escribe la respuesta. Eso son Google AI Mode y AI Overviews: no un chat, sino una página de resultados que responde en lugar de listar.

Mézclalos en un solo número y no significa nada, porque no puedes distinguir si tu marca es realmente conocida o simplemente fue encontrada. Por eso los medimos y los reportamos por separado.

no busca

Responder de memoria

El modelo contesta usando solo lo que aprendió durante su entrenamiento. Nunca toca internet, así que nada publicado recientemente puede ayudarle.

Si el modelo de verdad conoce tu marca. Es lo más cercano al awareness espontáneo de marca que existe aquí, y lo más difícil de mover, porque solo cambia cuando reentrenan el modelo.

casi siempre busca

Buscar y luego responder

El modelo decide que necesita consultar algo, hace una búsqueda, lee un puñado de páginas, y escribe su respuesta a partir de ellas.

Lo que la mayoría de la gente ve hoy. También lo más sucio de medir, porque si se molestó en buscar o no varía entre dos preguntas idénticas.

siempre busca

Un buscador que responde

Google AI Mode y AI Overviews. Estás en una página de resultados, pero la respuesta viene escrita hasta arriba en lugar de ser una lista de links.

El puente hacia el trabajo de SEO que quizá ya estás pagando. Si alguien en la sala es dueño de un presupuesto de búsqueda, este es el número que conecta su mundo con este.

Los modelos también difieren muchísimo en si muestran sus fuentes. Algunos nombran marcas todo el tiempo mientras casi no ponen links. Cuando un modelo no expone ninguna fuente lo registramos como resultado propio, porque contarlo como cero corrompería en silencio toda la comparación.

Qué incluye el proyecto

El proyecto, fase por fase

Cada estudio se moldea alrededor de la categoría, pero la forma del trabajo no cambia. Esto es lo que pasa, quién de tu lado participa, y qué existe al final de cada fase.

Fase 1

Levantamiento

Definimos qué decisión debería cambiar el resultado, con quién compites en realidad, y cuáles de tus propiedades cuentan como propias. El estudio necesita tu lista de competidores y tus dominios; todo lo demás afina la puntería, no decide si el número es confiable.

De tu lado: quien lleva marca o insights, una sesión de trabajo

Fase 2

Banco de preguntas, escrito y revisado

El banco se redacta desde la categoría, y tú lo revisas. Revisar quiere decir verificar que las preguntas suenen como tus clientes y que no falte ningún tema. No quiere decir reescribirlas hacia la marca, que es el único cambio que invalidaría el resultado.

De tu lado: revisión y visto bueno, más quien hable con clientes

Fase 3

Congelar y correr

El banco aprobado se congela y se vuelve el instrumento. Corre en los modelos elegidos, repetido, con el número de observaciones y el techo del costo conocidos antes de enviar la primera pregunta.

De tu lado: nada. Esta parte es nuestra.

Fase 4

Lectura e interpretación

Cada respuesta se lee y se codifica igual. Esta es la parte cara y la que carga el criterio: separar una mención de una recomendación, atribuir submarcas, y ordenar las fuentes por quién puede moverlas de verdad.

De tu lado: nada hasta que los hallazgos estén listos

Fase 5

Reporte y sesión de trabajo

Recibes el reporte, y nos sentamos con él. La sesión importa más que el documento: repasamos qué se movió, qué implica, y qué equipo es dueño de cada acción, para que tu gente pueda defender los números en una junta donde no estamos.

De tu lado: marca, comunicación, retail e insights, juntos si se puede

Fase 6

Segunda ola, cuando el trabajo ya aterrizó

El mismo banco congelado, preguntado otra vez después de que los cambios tuvieron tiempo de publicarse e indexarse. Como el instrumento no cambió, las corridas se pueden comparar directamente. Si no se movió nada, el reporte dice que no se movió nada.

De tu lado: avisarnos cuando el trabajo ya salió

Qué es estándar, y qué es tuyo

  • Estándar en cada proyecto: el banco congelado, cada respuesta guardada y legible, las cuatro tasas de resultado, la participación en menciones de categoría, la lista ordenada de fuentes con su dueño, y el reporte más la sesión de trabajo.
  • Moldeado a ti: qué modelos vale la pena correr, qué temas se reportan como corte propio, el set competitivo incluyendo las marcas que los modelos tratan como intercambiables con la tuya, y cualquier medición extra que tu categoría necesite, como sentimiento, una afirmación que legalmente puedes hacer, o un estudio viejo que sospechas que sigue circulando.
  • No incluido: este proyecto no arregla tu sitio, no encarga el contenido editorial, ni negocia con los retailers. El reporte dice cuál de esas cosas movería el número y quién es dueño de ella.

Si quieres saber si tu categoría es una donde esto vale la pena, eso es una conversación de media hora y no una propuesta.

Platiquémoslo

Cómo se dimensiona un estudio

Tres perillas, y las ajustamos juntos en el levantamiento. Muévelas para ver cómo cambia la forma de un estudio. El punto no es configurar un producto, es que el tamaño del estudio queda definido antes de enviar la primera pregunta, así que la conversación de alcance ocurre antes de gastar el dinero y no después.

60
3
3

60 × 3 × 3

Observaciones recolectadas

540

Un estudio estándar . Suficientemente amplio para reportar tema por tema en varios modelos.

Direccionalmente: entre más preguntas y más modelos, más lejos llega el estudio, y más cosas hay que validar antes de poder reportar cualquier cifra con confianza. Más preguntas quiere decir más temas cubiertos y más cortes que se sostienen solos. Más modelos quiere decir que el resultado se sostiene en los lugares donde la gente realmente pregunta, y no en uno solo. El punto de esa curva lo elegimos juntos, contra la decisión que el estudio tiene que informar.

Por qué alguien la corre dos veces

Medir dos veces contra el mismo banco

La corrida uno te da una línea base y una lista de qué está citando a tus competidores. Luego ocurre el trabajo, que casi siempre es editorial, contenido de retail y relaciones públicas, más que un proyecto de sitio web.

Después le vuelves a preguntar al mismo banco congelado. Las mismas preguntas, los mismos asistentes, el mismo número de repeticiones. Como el instrumento no cambió, las dos corridas son comparables, y esa comparación es el punto.

Esta es la parte que convierte un estudio de una sola vez en algo que vale la pena conservar, y también la parte que nos mantiene honestos. Si no se movió nada, el reporte dice que no se movió nada.

El banco se congela después de la corrida uno. Agrega una pregunta más adelante y tienes dos bancos, no una tendencia, así que las preguntas nuevas van a un conjunto aparte que arranca su propia línea base.

Solaria recomendada, preguntas sin marca

cifras ilustrativas

Corrida 1 · línea base11%
Corrida 2 · después del trabajo26%

+15 puntos. El banco no cambió entre las dos corridas, así que el movimiento no es un artefacto de haber preguntado otra cosa. Aún así no prueba causa: una actualización de modelo o contenido nuevo de terceros pueden mover el mismo número.

Hábitos de buscador que ya no aplican

Cinco cosas que hay que desaprender

Casi toda la confusión de una primera conversación viene de traer costumbres de buscadores a un lugar donde no aplican. Cinco correcciones resuelven la mayor parte.

Los asistentes responden. No hacen ranking. Tu marca se nombra o no, se recomienda o solo se lista, se describe con precisión o no, y se le da un lugar dónde comprarla o se queda en el aire. Esos son los resultados.

Preguntar en qué lugar apareces en ChatGPT es preguntar algo que el medio no puede contestar. Si una herramienta te reporta una posición de todos modos, vale la pena preguntar qué midió en realidad para producirla.

Un análisis de 23,387 citas en 240 consultas de marca encontró que el earned media aporta 48 por ciento de lo que citan los asistentes, otro contenido comercial de terceros 30 por ciento, y el sitio propio de la marca 23 por ciento.

Entonces, si la respuesta sobre tu categoría se arma con el estudio de una revista de consumo, el reporte de un regulador y dos fichas de producto de retailers, la palanca es lo que dicen esas fuentes. Ese trabajo es relaciones públicas y contenido de retail, no una migración de sitio web.

Acabas de verlo. El trabajo de medición publicado ubica el traslape de fuentes entre consultas idénticas del mismo día entre un tercio y la mitad.

Una captura de pantalla es una anécdota. Una medición son muchas preguntas, y cada número del reporte es una tasa sobre esas preguntas. Esto también es lo que hace que el ejercicio cueste algo, así que conviene dejarlo claro desde el principio.

Una pregunta no tiene que ser popular para valer la pena. Si un asistente ya se formó una opinión sobre un tema de seguridad en tu categoría, esa opinión se le repite a quien sí pregunte.

Quieres saber qué dice hoy, no después de que un periodista te lo cite.

Casi todos llegan queriendo la optimización. Primero se mide, porque sin una línea base no puedes atribuir ningún cambio posterior a nada que hayas hecho.

La versión honesta de este negocio es que la corrida uno te dice dónde estás parado y qué está citando a tus competidores. La corrida dos es donde te enteras si el trabajo movió algo.

Qué es distinto aquí

Tres diferencias con las herramientas del mercado

Nada que comprar, nada que aprender

No hay dashboard, no hay licencias por usuario y no hay una herramienta que tu equipo tenga que adoptar. Un especialista corre la medición y tú recibes el análisis y el reporte. La mayoría de los equipos de marca ya tienen más software del que usan, y lo último que necesita una medición trimestral es un login que alguien olvida.

Hecho para marcas que no venden en línea

Toda herramienta de esta categoría rastrea tu sitio web y califica tus páginas. Si tu producto se compra en un anaquel, eso responde una pregunta que no hiciste. Esto está construido al revés, desde la conversación de categoría hacia adentro, y por eso funciona para una marca de alimentos empacados y funciona igual de bien para una empresa de software que sí vende en línea.

Aprendes el método, no nada más el número

Parte del proyecto es enseñarle a tu equipo cómo arman las respuestas los asistentes, por qué el banco está escrito como está, y cómo leer una tasa. La intención es que puedas defender estos números en una junta donde nosotros no estamos. Un número que nadie de tu lado puede explicar no sobrevive al primer cuestionamiento.

Qué no hace esto

Todos los demás en esta categoría venden un score instantáneo. Aquí están los límites reales de una medición honesta, para que decidas antes de gastar nada.

No te va a dar una posición
No hay una posición uno que reportar. Lo que te dé una, se la inventó.
No va a atribuir ventas
Registramos lo que dijo el asistente. Lo que la persona hizo después ocurre fuera de todo lo que podemos ver. El resultado de ruta de compra es el proxy honesto más cercano, y es un proxy.
No puede prometer que el número se mueva
La mayor parte de lo que cita un asistente lo escribió alguien más. Podemos decirte qué fuentes están empujando la respuesta y quién puede influir en cada una. No podemos comprometernos con un resultado que depende de que terceros publiquen distinto.
No verifica los hechos del asistente por ti
Podemos registrar que un asistente dijo algo sobre tu producto. Juzgar si esa afirmación es cierta requiere una fuente confiable aprobada que alguien de tu lado mantenga, y la mayoría de las marcas no la tienen. Si la precisión es tu preocupación, dilo en el levantamiento, porque construir esa referencia es un trabajo aparte.
Una corrida fija prioridades, no te entrega un plan
Una línea base nombra los huecos y ordena las fuentes detrás de ellos, y eso alcanza para decidir por dónde empezar. Lo que no puede decirte es si actuar sobre ellos funcionó; eso necesita una segunda corrida contra el mismo banco. Quien te prometa un arreglo comprobado a partir de una sola línea base te está vendiendo otra cosa.

Empieza por la pregunta, no por la herramienta

La primera conversación útil es sobre qué decisión debería cambiar el resultado, y si tu categoría es una donde el asistente ya tiene opiniones. Eso toma como media hora, y al final vas a saber si medir vale la pena para ti.

Platiquémoslo