Pídele a ChatGPT "cambio de embrague en Alcorcón" y mira a qué taller recomienda y de dónde saca el dato. Si el tuyo no sale, lo más probable es que su web no lo diga: el teléfono en una imagen del logotipo, el horario en el pie de página cargado por un script, y la palabra "embrague" en ninguna parte. Para una persona la web está bien. Para una máquina que lee texto, ese taller no hace embragues, no tiene teléfono y no abre a ninguna hora. Es el patrón que se repite en el rastreo de 195 webs, y esta guía es lo que haríamos con cualquiera de ellas.
Cómo lee una IA una web, en tres frases
Los sistemas de IA con búsqueda (ChatGPT, Perplexity, Claude, Gemini) tienen rastreadores que descargan páginas igual que Google, y además consultan resultados de buscadores y directorios. De cada página se quedan con el texto: títulos, párrafos, listas, tablas y datos estructurados. Lo que va en imágenes, en PDF pesados o en contenido que aparece solo después de ejecutar un script, o no lo ven, o lo ven mal; Google ejecuta JavaScript desde hace años, y los rastreadores de IA no documentan que lo hagan.
La consecuencia práctica: una IA sabe de tu negocio lo que está escrito como texto en tu web y lo que dicen de ti la ficha de Google, los directorios y las reseñas. Para un negocio local, lo segundo suele pesar más que lo primero, y por eso el trabajo útil empieza por la ficha de Google. Pero la web es lo único que controlas del todo.
Lo que encontramos en 195 webs
| Lo que una IA busca | Webs que lo tienen | Por sector, de más a menos |
|---|---|---|
| Teléfono como texto (no en imagen) | 66 % | inmobiliarias 79 %, peluquerías 74 %, clínicas y despachos 72 %, academias 67 %, talleres 61 %, tiendas 50 %, restaurantes 45 % |
| Horario en la portada (texto o datos estructurados) | 32 % | clínicas 44 %, peluquerías 43 %, talleres 39 %, despachos 36 %, tiendas 32 %, inmobiliarias 29 %, restaurantes 23 %, academias 15 % |
| Datos estructurados de negocio (tipo, dirección o teléfono) | 17 % | talleres 30 %, despachos 28 %, clínicas 24 %, academias 15 %, tiendas 14 %, peluquerías 13 %, restaurantes 9 %, inmobiliarias 4 % |
| Datos estructurados con horario | 9 % | despachos 20 %, talleres 17 %, clínicas 12 %, restaurantes 9 % |
| Preguntas frecuentes (página o bloque) | 19 % | talleres 30 %, clínicas y despachos 28 %, tiendas 18 %, academias 15 %, inmobiliarias 14 %, peluquerías 13 %, restaurantes 5 % |
| Archivo llms.txt | 14 % | casi todos generados por Yoast o All in One SEO |
| Bloquean algún rastreador de IA en robots.txt | 10 % | el entrenamiento; ninguna bloquea la búsqueda de ChatGPT a propósito |
Dos lecturas. Los restaurantes son el sector con menos texto útil (el horario y la carta suelen ser una foto o un PDF), y es justo el sector al que más se pregunta "¿abre hoy?". Y el 60 % de las webs tiene algún dato estructurado, casi siempre el que pone el tema de WordPress por defecto (sitio web, artículo, migas de pan); el que dice "soy un negocio con este horario" lo tiene una de cada once.
Las cinco cosas que una IA necesita de tu web
1. El teléfono, la dirección y el horario como texto. En la portada y en la página de contacto, escritos, no dentro del logotipo ni en una imagen del mapa. El horario, con los días: "lunes a viernes de 9:00 a 20:00, sábados de 10:00 a 14:00". Si cambia en verano, la fecha del cambio también. Es la comprobación más fácil y la que más webs fallan.
2. Los servicios con su nombre, uno por uno. "Cambio de embrague", "limpieza dental", "renovación de licencia de actividad". Una IA no infiere que un taller hace embragues; lo lee o no lo lee. Una lista de servicios con una línea cada uno vale más que tres párrafos sobre "soluciones integrales para tu vehículo". Los precios, si los tienes cerrados, también: son la pregunta más frecuente.
3. Datos estructurados de negocio. Un bloque de código en la página (JSON-LD, tipo LocalBusiness o el tipo de tu sector: Dentist, AutoRepair, Restaurant, HairSalon, RealEstateAgent) con nombre, dirección, teléfono, horario y área que atiendes. Los plugins de SEO de WordPress lo generan si rellenas la ficha del negocio; casi nadie la rellena. Google lo usa seguro; para una máquina que lee tu web es la forma más clara de encontrar los datos sin buscarlos.
4. Preguntas con su respuesta. Una página o un bloque de preguntas frecuentes con las que te hacen por teléfono: "¿hay que pedir cita?", "¿aparcamiento?", "¿aceptáis Bizum?", "¿atendéis urgencias?". Respuestas de dos a cuatro frases. Es el contenido que una IA cita con más facilidad, porque ya tiene la forma de una respuesta, y solo lo tiene el 19 % de las webs.
5. La puerta abierta. Que tu robots.txt no cierre el paso a los rastreadores de búsqueda de las IA. Tres de las 195 webs cierran la web a todos los robots, Google incluido, casi seguro sin querer. Cómo mirarlo y qué decidir está en la guía de robots.txt para bots de IA.
Compruébalo tú en diez minutos
- Pregunta a una IA como lo haría un cliente. En ChatGPT con búsqueda o en Perplexity: "[tu servicio] en [tu municipio]" y "[nombre de tu negocio] horario". Mira si te nombra y qué fuente cita. Si cita un directorio con datos viejos, ya sabes por dónde empezar.
- Abre tu portada, pulsa Ctrl+U (ver código fuente) y busca tu teléfono y la palabra "lunes". Si no aparecen, para una IA no existen aunque tú los veas en pantalla.
- Busca en ese mismo código "ld+json". Si no hay nada, no tienes datos estructurados. Si hay, mira si aparece "LocalBusiness" o el tipo de tu sector y "openingHours".
- Escribe en el navegador tudominio.es/robots.txt. Si ves "User-agent: *" seguido de "Disallow: /", tu web está cerrada a todos los robots.
- Pasa tu portada por el comprobador de Ahrefs o el de Semrush (gratis, sin registro el primero). No miden lo mismo que esta guía; dicen si tu marca aparece en respuestas de IA para preguntas de tu sector.
Lo que no hemos podido medir
El rastreo mira solo la portada, robots.txt y llms.txt de cada web, con una petición sin ejecutar scripts. Una web que tenga el horario en la página de contacto y no en la portada cuenta como "sin horario" aquí, aunque una IA que llegue hasta esa página sí lo vería; el dato es un mínimo. Tampoco sabemos cuántas visitas ni cuántos clientes trae la IA a estas webs: para un negocio local, en 2026, sigue siendo una fracción pequeña de lo que trae Google Maps. La comparación completa con lo que falla en estas mismas webs (contacto, legal, seguridad) está en el informe de las webs de pymes de Madrid.
Si tu web falla en las cinco comprobaciones, lo más probable es que falle también en las que mira Google, y eso se ve en cinco minutos con la auditoría gratuita. Si lo que quieres es que la web, además de dejarse leer, conteste sola a las once de la noche, eso es el asistente con IA, y necesita exactamente los mismos datos escritos: horario, servicios, precios y preguntas. Arreglar la web para las IA es arreglarla para tu propio asistente.
Preguntas sobre cómo ven las IA la web de un negocio
Las dos cosas, si las dejas. ChatGPT con búsqueda usa su propio rastreador (OAI-SearchBot) y también consulta resultados de buscadores. Perplexity y Claude tienen los suyos. Lo que ninguno hace es adivinar lo que no está escrito: si el horario está en una imagen, no existe para ellos.
No lo necesitas. Es un archivo de texto en la raíz de la web con un resumen del sitio para modelos de lenguaje, y ningún proveedor grande ha dicho que lo use. El 14 % de las webs que rastreamos lo tiene, y en casi todas lo ha generado el plugin de SEO sin que el dueño lo sepa. No hace daño; tampoco hemos visto que haga nada.
Sirven para Google, seguro, y son la forma más limpia de decir "esto es un negocio, este es el teléfono, este es el horario" a cualquier máquina. Solo el 9 % de las webs rastreadas tiene datos estructurados de negocio con horario. Es lo primero que arreglaríamos.
Pregúntaselo tal como lo haría un cliente ("fisioterapeuta en Majadahonda que atienda sin cita") y mira si te nombra y de dónde saca el dato. Ahrefs tiene un comprobador gratuito sin registro y Semrush otro en castellano. Para un negocio local, casi siempre te encuentra por la ficha de Google y las reseñas antes que por la web.
Puedes pedirlo en robots.txt y los rastreadores de OpenAI, Anthropic, Perplexity y Google dicen que lo respetan para el rastreo; no para las visitas que hace un usuario desde la propia IA. Cómo hacerlo, y por qué para un negocio local no suele compensar, está en la guía de robots.txt para bots de IA.
Fuentes
- Dimuweb, rastreo de portada, robots.txt y llms.txt de 195 webs de pymes de la Comunidad de Madrid (ocho sectores, muestra de OpenStreetMap; 256 direcciones, 195 alcanzables), 5 de septiembre de 2026
- OpenAI, rastreadores de OpenAI (OAI-SearchBot, GPTBot, ChatGPT-User), consultado el 5 de septiembre de 2026
- Perplexity, rastreadores de Perplexity (PerplexityBot, Perplexity-User)
- Anthropic, rastreadores de Anthropic (ClaudeBot, Claude-User, Claude-SearchBot)
- Google, Google-Extended y los rastreadores comunes de Google
- Ahrefs, comprobador gratuito de visibilidad en IA
- Semrush, comprobador gratuito de visibilidad en la búsqueda de IA (en castellano)