SEO para IA · GEO
Generative Engine Optimization : que los asistentes de IA citen tu marca
Cada vez más búsquedas terminan en una respuesta generada: un AI Overview en Google, una conversación en ChatGPT, un resumen en Perplexity. Esas respuestas se construyen con páginas que el sistema recupera y considera fiables. Trabajamos para que la tuya sea una de ellas.
Qué es el GEO
De posicionar enlaces a ser la fuente de la respuesta
El Generative Engine Optimization (GEO), o SEO para IA, es el trabajo de hacer que tu contenido y tu marca aparezcan, bien representados, en las respuestas de los motores de búsqueda basados en modelos de lenguaje. No sustituye al SEO: lo amplía. Los asistentes que buscan en la web se apoyan en índices de búsqueda, y las páginas que no se rastrean o no se consideran fiables rara vez llegan a la respuesta.
Lo que cambia es la unidad de competencia. En los resultados clásicos compite la página entera por una posición. En una respuesta generada compiten fragmentos: un párrafo que define algo con claridad, una tabla que compara opciones, un dato con su fuente. Y además importa algo nuevo: que el modelo reconozca tu marca como una entidad y la asocie a los temas correctos.
Somos prudentes con las promesas. Los sistemas generativos cambian rápido, no publican sus criterios completos y sus respuestas varían de una consulta a otra. Trabajamos con lo que está documentado por los propios proveedores y con lo que podemos observar y medir.
- Acceso correcto de los rastreadores de IA
- Contenido estructurado para ser extraído y citado
- Señales de entidad y autoridad de marca
- Seguimiento de menciones y citas en respuestas
Cómo funcionan
Cómo eligen sus fuentes los motores generativos
Cada sistema tiene sus particularidades, pero los que responden con información actual comparten un patrón general.
Recuperación desde un índice
Cuando la pregunta requiere información actual o concreta, el asistente lanza búsquedas en un índice web (propio o de un buscador) y recupera un conjunto de páginas candidatas. Los AI Overviews se apoyan en el índice de Google; Copilot, en el de Bing. Si tu página no está en esos índices, no puede ser candidata.
Expansión de la consulta (query fan-out)
Una pregunta compleja se descompone en varias subconsultas que se buscan por separado. Google ha descrito esta técnica para sus funciones de IA. Consecuencia práctica: una página puede ser citada por responder bien a una subpregunta concreta, aunque no posicione para la pregunta original.
Preferencia por pasajes claros y extraíbles
El modelo trabaja con fragmentos. Un párrafo que responde directamente, una definición precisa, una lista de pasos o una tabla comparativa se extraen con más facilidad que una idea repartida en varios párrafos con rodeos. La estructura del contenido importa tanto como su calidad.
Señales de entidad y de marca
Los modelos aprenden qué marcas se asocian a qué temas a partir de lo que se publica en la web: tu propio sitio, medios, directorios, reseñas, perfiles. Una marca descrita de forma coherente en muchas fuentes fiables tiene más probabilidades de ser mencionada. Lo trabajamos con SEO de entidades.
Frescura
Para preguntas sobre precios, normativa, productos o novedades, los sistemas tienden a preferir información reciente. Fechas de actualización visibles y contenido revisado de verdad, no solo con la fecha cambiada, ayudan a que tu página siga siendo elegible.
Confianza y autoridad
Igual que en el SEO clásico, las fuentes con autoría clara, referencias, reputación y enlaces de calidad pesan más, sobre todo en temas de salud, dinero o derecho. Las señales de E-E-A-T siguen siendo relevantes.
Rastreadores de IA
Qué agente hace qué, y qué implica bloquearlo
Los principales proveedores distinguen entre rastreadores para entrenar modelos y rastreadores para buscar y citar. Bloquear unos no tiene por qué significar bloquear los otros.
| User-agent | Proveedor | Para qué se usa | Si lo bloqueas en robots.txt |
|---|---|---|---|
| OAI-SearchBot | OpenAI | Indexar páginas para mostrarlas y enlazarlas en las búsquedas de ChatGPT | Tus páginas pueden dejar de aparecer como resultado o cita en ChatGPT search |
| GPTBot | OpenAI | Recopilar contenido que puede usarse para entrenar modelos | Tu contenido deja de recopilarse para entrenamiento; según OpenAI, no afecta a OAI-SearchBot |
| Google-Extended | Token de control (no un rastreador aparte): decide si el contenido rastreado por Google puede usarse para entrenar modelos Gemini y para fundamentar respuestas en apps de Gemini y Vertex AI | No afecta a la inclusión ni al posicionamiento en Google Search, y tampoco excluye de los AI Overviews | |
| Googlebot | Rastreo para Google Search, incluidos los AI Overviews y otras funciones de búsqueda | Desapareces de Google Search. Para limitar fragmentos se usan nosnippet o max-snippet, no un bloqueo | |
| PerplexityBot | Perplexity | Indexar páginas para mostrarlas y citarlas en los resultados de Perplexity | Reduce las posibilidades de que Perplexity te cite como fuente |
| Bingbot | Microsoft | Rastreo para Bing, cuyo índice alimenta las respuestas de Copilot | Desapareces de Bing y, con ello, de buena parte de Copilot |
robots.txt
Decide conscientemente qué permites y qué no
Muchas webs bloquean rastreadores de IA sin saberlo: reglas heredadas, plugins de seguridad o configuraciones del CDN que filtran agentes desconocidos. Otras los permiten todos sin haberlo decidido. Ambas cosas son decisiones de negocio y deben tomarse con información.
Un planteamiento habitual es permitir los rastreadores de búsqueda (los que generan citas y visitas) y decidir aparte sobre los de entrenamiento. El ejemplo adjunto lo ilustra. Ten en cuenta que robots.txt es una convención que los grandes proveedores declaran respetar, no una barrera técnica, y que los agentes que actúan a petición directa de un usuario (como ChatGPT-User o Perplexity-User) siguen reglas que cada proveedor documenta por separado.
Revisamos también la capa de infraestructura: firewalls, protección anti-bots y reglas del CDN, porque un bloqueo ahí no se ve en robots.txt pero tiene el mismo efecto.
Base técnica para IA
Lo que necesita tu web para ser legible por los asistentes
Renderizado sin depender de JavaScript
Google ejecuta JavaScript, pero muchos rastreadores de IA, por lo que se observa en los logs, leen sobre todo el HTML inicial. Si tu contenido principal, tus precios o tus enlaces se cargan con JavaScript en el navegador, pueden no verlo. El renderizado en servidor o la generación estática eliminan ese riesgo.
Ver másDatos estructurados
Schema.org ayuda a los buscadores a interpretar sin ambigüedad quién eres, qué ofreces y cómo se relacionan tus páginas: Organization, Product, Article con autor, LocalBusiness, BreadcrumbList. No es una vía directa para ser citado, pero refuerza la comprensión de la entidad y alimenta los sistemas de búsqueda en los que se apoyan las respuestas.
Ver másllms.txt
Es una propuesta surgida en 2024: un archivo en Markdown en la raíz del dominio que resume el sitio y enlaza sus páginas más útiles para modelos de lenguaje. Hoy no es un estándar y ningún gran buscador ha confirmado que lo use para elegir fuentes. Lo implementamos cuando es barato y tiene sentido (por ejemplo, documentación técnica), sin presentarlo como una palanca garantizada.
Proceso
Cómo trabajamos el GEO
Cuatro fases que se apoyan en una base SEO sana. Si esa base falla, la corregimos primero.
Diagnóstico de visibilidad en IA
Definimos un conjunto de preguntas representativas de tu negocio: cómo te buscarían, cómo compararían opciones, qué dudas tienen antes de decidir. Las lanzamos en varios asistentes y registramos si apareces, cómo se te describe, qué fuentes se citan y quién ocupa tu lugar.
Como las respuestas varían entre consultas y a lo largo del tiempo, repetimos las pruebas y miramos tendencias, no capturas aisladas.
Actividades
Resultados
- Mapa de presencia y ausencias en respuestas de IA
- Fuentes que citan a tu competencia
Acceso técnico
Revisamos robots.txt, la configuración del CDN y del firewall, el renderizado y los logs para confirmar que los rastreadores de búsqueda de IA pueden acceder a tu contenido. Comprobamos también la indexación en Google y en Bing, de la que dependen los AI Overviews y Copilot.
Acordamos contigo la política para los rastreadores de entrenamiento y la dejamos documentada.
Actividades
Resultados
- Política de rastreadores documentada
- Incidencias de acceso corregidas
Contenido citable
Reescribimos y ampliamos las páginas clave para que contengan respuestas claras y extraíbles: definiciones al inicio, pasos numerados, tablas comparativas, datos con fuente y fecha, y secciones que responden a las subpreguntas que los asistentes suelen generar.
Añadimos lo que solo tú puedes aportar: experiencia propia, ejemplos reales de tu operativa, criterios de decisión. Es lo que diferencia una fuente citada de una de tantas.
Actividades
Resultados
- Páginas reestructuradas
- Plan de contenidos para preguntas de IA
Autoridad y monitorización
Reforzamos las señales externas: menciones en medios y directorios relevantes, perfiles coherentes, reseñas y datos estructurados de entidad. Los asistentes reflejan lo que la web dice de ti, no solo lo que dices tú.
Mantenemos un seguimiento periódico del mismo set de preguntas y lo combinamos con el tráfico de referencia desde asistentes en GA4, para ver si la presencia se traduce en visitas y contactos.
Actividades
Resultados
- Informe mensual de visibilidad en IA
- Prioridades revisadas cada trimestre
Búsquedas sin clic
Medir cuando la respuesta se lee sin visitar tu web
Una parte de las consultas se resuelve en la propia respuesta: el usuario lee el resumen y no hace clic. Eso no significa que la visibilidad no valga. Ser la marca mencionada en la respuesta influye en la consideración, en las búsquedas de marca posteriores y en las visitas directas.
Por eso medimos en varias capas: presencia y forma de mención en el set de preguntas, tráfico de referencia desde asistentes (ChatGPT, Perplexity, Copilot y otros aparecen como fuentes en GA4 cuando envían visitas), evolución de búsquedas de marca en Search Console y conversiones asistidas. Ninguna métrica aislada cuenta toda la historia; juntas, sí permiten decidir.
- Presencia en un set fijo de preguntas, medida en el tiempo
- Tráfico de referencia desde asistentes en GA4
- Evolución de búsquedas de marca
- Conversiones vinculadas
Preguntas frecuentes
Sobre el SEO para IA
¿Podéis garantizar que ChatGPT recomiende mi empresa?
No. Nadie puede garantizarlo: las respuestas varían y los proveedores no publican sus criterios completos. Lo que sí podemos hacer es eliminar los obstáculos, mejorar el contenido y las señales que la documentación disponible y la observación indican como relevantes, y medir la evolución de forma honesta.
¿Es el GEO algo distinto del SEO?
Es una ampliación. La mayor parte del trabajo (indexación, contenido útil, autoridad) es SEO. Lo específico es el acceso de rastreadores de IA, la estructura de contenido orientada a pasajes, las señales de entidad y la medición en asistentes.
¿Debo bloquear GPTBot?
Depende de tu política sobre el uso de tu contenido para entrenar modelos. Bloquear GPTBot, según OpenAI, no impide aparecer en las búsquedas de ChatGPT, que dependen de OAI-SearchBot. Te ayudamos a tomar la decisión con sus implicaciones claras.
¿Bloquear Google-Extended me saca de los AI Overviews?
No. Google-Extended controla el uso del contenido para entrenar modelos Gemini y para fundamentar respuestas en las apps de Gemini y en Vertex AI. Los AI Overviews forman parte de Google Search y dependen de Googlebot; para limitar cómo se muestran tus fragmentos existen directivas como nosnippet.
¿Sirve de algo el archivo llms.txt?
Es una propuesta sin adopción confirmada por los grandes buscadores. Implementarlo cuesta poco y puede ser útil en ciertos sitios, pero no lo consideramos una palanca principal ni lo vendemos como tal.
¿Cuánto tarda en notarse?
Las correcciones de acceso se reflejan cuando los sistemas vuelven a rastrear. Los cambios de contenido y de autoridad, igual que en SEO, llevan meses. Como las respuestas varían, evaluamos tendencias a lo largo de varias mediciones, no resultados de un día.
Relacionado
Para completar tu visibilidad en IA
Answer Engine Optimization
Answer Engine Optimization: estructuramos tu contenido para fragmentos destacados, «Otras preguntas de los usuarios», asistentes de voz y AI Overviews.
SEO de entidades
SEO de entidades: Knowledge Graph, panel de conocimiento, Organization y sameAs, NAP coherente y autoridad temática para que Google y la IA te reconozcan.
Cómo aparecer en ChatGPT y AI Overviews
Cómo eligen y citan fuentes ChatGPT, Perplexity, Gemini y los AI Overviews de Google: pasos prácticos de GEO, cómo medir resultados y qué sigue sin saberse.
¿Te mencionan los asistentes de IA?
Analizamos cómo aparece tu marca en ChatGPT, Gemini, Perplexity y AI Overviews, y qué hacer para mejorarlo.