Saltar al contenido
SEOefectivo

Guía · SEO

Visibilidad en IA (GEO): cómo lograr que los asistentes lean y citen tu sitio

Por Eduardo MarínPublicado 11 min de lectura

Ilustración de estrategia de marketing digital
En este artículo

Cada vez más personas hacen preguntas a un asistente de IA (ChatGPT, Perplexity, Gemini, Copilot, las respuestas de IA dentro de Google) en lugar de recorrer una lista de enlaces. Para un negocio, la pregunta útil ya no es solo «¿en qué posición salgo?», sino «¿el asistente conoce mi negocio, puede leer mi sitio y me menciona cuando corresponde?».

A eso se le llama, según quién hable, GEO (Generative Engine Optimization), AIO (AI Optimization) o AEO (Answer Engine Optimization). Las siglas cambian y el mercado todavía está poniéndose de acuerdo. Lo importante es separar lo que se sabe de lo que se vende como humo.

Lo primero: qué se puede y qué no se puede prometer

  • Nadie controla lo que dice un asistente de IA. Las respuestas cambian de una consulta a otra, de un usuario a otro y de una versión del modelo a la siguiente.
  • No existe una técnica que garantice ser citado. Quien lo prometa está inventando.
  • Lo que sí puedes hacer es eliminar obstáculos (que los sistemas puedan acceder a tu sitio), facilitar que tu contenido se entienda y se atribuya bien, y medir con método.
  • Gran parte de esto es SEO bien hecho. Google documenta que para aparecer en sus funciones de IA en Búsqueda no hay requisitos técnicos adicionales: la página debe estar indexada y ser elegible para mostrarse con fragmento (snippet). Si tu SEO técnico falla, empieza por ahí: usa nuestra checklist de SEO técnico.

Cómo llega tu contenido a una respuesta de IA

Hay tres caminos distintos, y no se controlan igual:

  1. Entrenamiento del modelo. El modelo aprendió de grandes colecciones de páginas rastreadas en el pasado. Lo que sabe de tu marca viene de ahí y no se puede «corregir» de un día para otro.
  2. Búsqueda y recuperación en tiempo real. Cuando el asistente busca en la web para responder, consulta un índice de búsqueda o rastrea páginas en el momento y cita fuentes. Aquí sí puedes influir: si tu página es accesible, clara y relevante, puede entrar.
  3. Acciones a petición del usuario. Si alguien pega una URL o pide «resume esta página», el asistente la visita en ese momento.

La distinción importa porque bloquear el entrenamiento no es lo mismo que bloquear la búsqueda. Una empresa puede querer aparecer en las respuestas y, a la vez, no ceder sus textos para entrenar modelos.

Paso 1: comprueba que pueden entrar

robots.txt

El archivo robots.txt indica qué rastreadores pueden leer qué partes de tu sitio. Los rastreadores de IA más habituales, con la función que sus empresas les atribuyen, son:

Rastreador Empresa Para qué se usa
OAI-SearchBot OpenAI Mostrar y enlazar sitios en la búsqueda de ChatGPT
GPTBot OpenAI Entrenamiento de modelos
ClaudeBot Anthropic Entrenamiento de modelos
PerplexityBot Perplexity Listar y enlazar sitios en los resultados de Perplexity
Bingbot Microsoft Índice de Bing, que también alimenta a Copilot
Google-Extended Google Control para que tu contenido no se use para entrenar Gemini; no es un rastreador aparte, y no afecta a tu posición en Búsqueda
CCBot Common Crawl Colección abierta de la web, usada para entrenar modelos

Los nombres y las funciones cambian. Verifica siempre en la documentación oficial de cada empresa (por ejemplo, la de OpenAI en platform.openai.com/docs/bots y la de Perplexity en docs.perplexity.ai) antes de escribir reglas.

Decide con criterio de negocio, no por miedo:

  • Si quieres aparecer en respuestas de búsqueda con IA, no bloquees los rastreadores de búsqueda (OAI-SearchBot, PerplexityBot, Bingbot).
  • Bloquear los de entrenamiento (GPTBot, ClaudeBot, Google-Extended, CCBot) es una decisión legítima si no quieres ceder tus textos; no impide que un asistente de búsqueda te cite.

Un ejemplo que permite la búsqueda y bloquea el entrenamiento:

User-agent: OAI-SearchBot
Allow: /

User-agent: PerplexityBot
Allow: /

User-agent: GPTBot
Disallow: /

User-agent: ClaudeBot
Disallow: /

User-agent: Google-Extended
Disallow: /

Firewall, CDN y plugins de seguridad

Aunque robots.txt los permita, un cortafuegos, un CDN o un plugin de seguridad puede bloquear el tráfico de bots por reglas propias o por configuración por defecto. Revisa el panel de esas herramientas y prueba desde fuera:

curl -I -A "OAI-SearchBot" https://tu-dominio.com/

Si la respuesta es 200, el rastreador entra; si es 403, 429 u otro código de error, algo lo está frenando. (Es una prueba del comportamiento de tu servidor ante ese user agent, no una prueba de que el rastreador real vaya a visitarte.)

El texto debe estar en el HTML

No des por hecho que todos los rastreadores ejecutan JavaScript. Abre «Ver código fuente» (no la inspección del DOM) y comprueba que tu texto principal, tus títulos y tus enlaces están ahí. Si tu sitio es una aplicación que pinta todo en el navegador, prueba con:

curl -s https://tu-dominio.com/pagina/ | grep -i "una frase de tu texto"

Si la frase no aparece, lo que ve un rastreador sin JavaScript es una página vacía.

Paso 2: contenido que se pueda citar

Los asistentes suelen extraer pasajes breves y autosuficientes que responden una pregunta concreta. Puedes facilitarlo sin escribir «para robots»:

  • Pregunta como encabezado, respuesta directa debajo. Un H2 como «¿Cuánto tarda el SEO en dar resultados?» seguido de dos a cuatro frases que responden de entrada, y luego el matiz.
  • Definiciones claras en la primera frase del apartado: «X es …».
  • Listas y tablas para pasos, requisitos y comparaciones.
  • Datos con fuente y fecha. Si citas una cifra, di de dónde sale y cuándo. Si no puedes verificarla, no la incluyas.
  • Autor visible y fecha de actualización. Indica quién escribe (con enlace a su perfil) y cuándo se revisó el contenido. Marca las fechas también en los datos estructurados del artículo.
  • Una página, una intención. Evita mezclar cinco temas en una URL; un asistente cita mejor lo que está bien acotado.
  • Contenido con criterio propio. Experiencia real, ejemplos verificables y opiniones fundamentadas: es lo que un resumen genérico no puede aportar y lo que da motivos para citarte.

Y lo contrario también vale: no rellenes de texto generado en masa. No hace a tu sitio más citable, y tú pierdes credibilidad.

Paso 3: que entiendan quién eres (entidad)

Un asistente cita con más seguridad a quien puede identificar sin ambigüedad. Trabaja tu entidad:

  1. Nombre coherente en el título del sitio, og:site_name, el marcado de organización y tus perfiles. Si tu marca es «SEOefectivo», no la escribas de cuatro maneras.
  2. Datos estructurados de organización o persona (Organization, LocalBusiness o Person) con nombre, URL, logotipo y los perfiles oficiales en la propiedad sameAs (LinkedIn, Instagram, ficha de Google, etc.).
  3. Página «Nosotros» y páginas de autor con información verificable: quién eres, desde cuándo, qué haces y cómo contactarte.
  4. Coherencia externa: la misma descripción, dirección y datos en tu ficha de Google, redes y directorios. Si tienes un negocio local, tu ficha de Google importa aquí también.
  5. Menciones reales en otras fuentes: medios del sector, asociaciones, entrevistas, alianzas. No se compran ni se fabrican: se ganan con trabajo que otros consideran digno de mencionar.

llms.txt: qué es y qué esperar

llms.txt es una propuesta abierta (llmstxt.org) para publicar en la raíz del sitio un archivo en Markdown con un resumen y enlaces a tus mejores páginas, pensado para que los modelos entiendan tu sitio. Un ejemplo mínimo:

# Nombre de tu marca

> Descripción breve: qué haces, para quién y dónde.

## Guías
- [Título de la guía](https://tu-dominio.com/guia/): de qué trata en una línea.

## Servicios
- [Nombre del servicio](https://tu-dominio.com/servicio/): qué incluye.

La posición honesta: crearlo cuesta poco, pero no hay confirmación pública de que los principales buscadores y asistentes lo consulten. Trátalo como un extra opcional, no como la estrategia. Si lo publicas, mantenlo actualizado y coherente con tu sitio.

Paso 4: medir sin autoengaño

Como las respuestas varían, una prueba suelta no demuestra nada. Un método razonable:

  1. Prepara un conjunto fijo de preguntas (entre 10 y 20) que un cliente real haría: sobre tu categoría, tu ciudad, tu servicio y tu marca.
  2. Pregúntalas en varios asistentes, con sesión nueva, y regístralas en una hoja: fecha, asistente, pregunta, si te menciona, si enlaza a tu sitio y qué fuentes cita.
  3. Repite cada cierto tiempo (por ejemplo, cada mes) con las mismas preguntas y compara tendencias, no respuestas individuales.
  4. Mira el tráfico de referencia. En tu herramienta de analítica revisa las visitas que llegan desde dominios de asistentes (por ejemplo, chatgpt.com, perplexity.ai, copilot.microsoft.com, gemini.google.com). Es una señal parcial: muchas menciones no generan clic.
  5. Sobre Google: Search Console incluye el tráfico que llega desde las funciones de IA en Búsqueda dentro del informe de rendimiento habitual y no lo separa como una categoría propia. No esperes un informe «solo IA».

Un dato que ninguna de estas medidas te da es «cuánto influye la IA en mis ventas». Complementa con la pregunta «¿cómo nos conociste?» en formularios y llamadas.

Mitos y prácticas que conviene evitar

  • «Con llms.txt basta». No, ver arriba.
  • Texto oculto para «hablarle» al modelo (instrucciones invisibles, texto blanco sobre blanco). Es una práctica de manipulación que puede perjudicarte en buscadores y que se detecta.
  • Bloquearlo todo por miedo. Si bloqueas también a los rastreadores de búsqueda, desapareces de esas respuestas.
  • Generar cientos de páginas con IA para «cubrir preguntas». Contenido sin aporte propio no gana confianza.
  • Comprar menciones o reseñas. Además de arriesgarte a sanciones, aportan señales falsas.
  • Medir con una sola consulta. Una respuesta puntual es una anécdota.

Checklist rápida

  • robots.txt revisado: la búsqueda con IA permitida; el entrenamiento, decidido a propósito.
  • Sin bloqueos accidentales en firewall, CDN o plugins de seguridad.
  • Texto y enlaces principales presentes en el HTML inicial.
  • Páginas clave con encabezados en forma de pregunta y respuestas directas.
  • Autor visible y fecha de actualización en cada artículo, también en el marcado.
  • Datos estructurados de organización/persona con sameAs.
  • Nombre de marca y datos de contacto coherentes en todas partes.
  • llms.txt opcional, si decides publicarlo, actualizado.
  • Conjunto de preguntas de prueba y hoja de registro creados.

Cómo adaptarlo según tu tipo de negocio

  • Negocio local (clínica, taller, restaurante): tu ficha de Google, tus reseñas y la coherencia de nombre, dirección y teléfono pesan más que cualquier archivo especial. Cuida que los datos coincidan en todas partes.
  • Servicios profesionales o B2B: las páginas de servicio con preguntas y respuestas concretas, el perfil de las personas que firman el contenido y casos con contexto son lo que un asistente puede citar.
  • Ecommerce: fichas de producto con datos estructurados completos (precio, disponibilidad, características), comparativas honestas y páginas de preguntas frecuentes por categoría.
  • Medios y blogs: autoría visible, fechas claras, fuentes citadas y contenido original. Es también donde más conviene decidir qué rastreadores de entrenamiento permites.

Plantilla para tu registro de pruebas

Con este formato puedes registrar tus pruebas mensuales y comparar en el tiempo:

Fecha Asistente Pregunta ¿Te menciona? ¿Enlaza a tu sitio? Fuentes que cita Notas
(fecha) (asistente) «¿Qué consultor SEO recomiendas en Quito?» Sí / No Sí / No (lista) (observaciones)

Registra también lo que cita en lugar de ti: son tus competidores reales en las respuestas, y a veces no son los que esperabas.

Preguntas frecuentes

¿GEO reemplaza al SEO? No. Los cimientos son los mismos: un sitio accesible, claro y confiable. GEO añade decisiones (a quién dejar entrar, cómo estructurar las respuestas) y una forma distinta de medir.

¿Debo bloquear los rastreadores de IA? Es una decisión de negocio. Si quieres aparecer en las respuestas de los asistentes, no bloquees los rastreadores de búsqueda. Bloquear solo los de entrenamiento es legítimo y no impide que te citen.

¿Necesito el archivo llms.txt? No es imprescindible, y no hay confirmación pública de que los grandes asistentes lo consulten. Si lo publicas, mantenlo actualizado.

¿Cuánto tarda en verse un resultado? No hay un plazo fiable: depende de cómo actualice cada sistema su información y de tu punto de partida. Mide con el método del paso 4 y desconfía de cualquier plazo garantizado.

¿Puedo pagar para aparecer en las respuestas de IA? Algunas plataformas están probando formatos publicitarios, pero eso es publicidad, no visibilidad orgánica. No existe un pago que compre ser citado como fuente.

¿Los datos estructurados ayudan? Ayudan a que se entienda quién eres y qué ofreces, y tienen valor en buscadores tradicionales. No hay una garantía de que un asistente los use para citarte.

Pruébalo en tu sitio

El chequeo de visibilidad en IA revisa lo verificable de esta guía sobre la página que indiques: el acceso de siete rastreadores de IA según robots.txt, la existencia y estructura de llms.txt, el marcado de entidad y los perfiles sameAs, el formato de respuesta del contenido y la coherencia del nombre de marca. Marca como orientativas las comprobaciones que no son una regla exacta, y no mide si un asistente te cita: eso lo medirás con el método del paso 4.

Si quieres que se convierta en un plan para tu negocio, conoce nuestro servicio de AIO y GEO.

Si quieres llevarlo a tu sitio

Autor

Eduardo Marín — Consultor SEO y estratega digital en Ecuador, desde 2016. Ver su perfil.

Sigue leyendo

Ver todos los artículos