Búsqueda con IA
LLMO: cómo optimizar tu web para LLMs y ChatGPT (2026)
El LLMO (optimización para modelos de lenguaje) consiste en que herramientas de IA como ChatGPT y Gemini puedan rastrear, entender y citar tus páginas. Se basa en un SEO técnico sólido, no en trucos.
Por Equipo de investigación de SEORecheck, auditores SEOPublicado 11 min de lectura
El LLMO (Large Language Model Optimization, u optimización para modelos de lenguaje), también llamado SEO para LLMs, consiste en preparar tu web para que asistentes de IA como ChatGPT, Gemini, Claude y Perplexity puedan encontrarla, entenderla, confiar en ella y citarla. En la práctica se reduce a tres cosas: dejar que sus rastreadores accedan a tus páginas, escribir contenido que puedan citar con precisión y mantener los datos de tu marca coherentes en toda la web.
El LLMO se solapa mucho con el GEO y el AEO; el nombre simplemente pone el foco en los propios modelos. En esta guía verás cómo obtienen realmente los LLMs tu contenido, qué parte del LLMO es real y qué parte es mito, y qué debería corregir primero una pequeña o mediana empresa que quiera aparecer en ChatGPT y otras IA.
Qué es el LLMO y en qué se diferencia del GEO y del AEO
Estas siglas describen un mismo cambio desde ángulos distintos:
| Término | Enfoque | Pregunta típica |
|---|---|---|
| SEO | Posicionar en los resultados de búsqueda clásicos | «¿Estamos en la primera página?» |
| AEO | Ser la respuesta directa (fragmentos destacados, voz, respuestas de IA) | «¿Somos la respuesta a esta pregunta?» |
| GEO | Ser citado en la búsqueda generativa (AI Overviews, AI Mode, Perplexity) | «¿Somos una fuente en los resultados generados por IA?» |
| LLMO | Cómo ven, recuperan y describen tu marca los grandes modelos de lenguaje | «¿Qué dice ChatGPT de nosotros y nos enlaza?» |
El LLMO no es una disciplina aparte con sus propios factores de posicionamiento: es una forma de mirar. Para las comparativas, consulta GEO vs. SEO y nuestra guía de AEO. El resto del artículo trata lo específico de los LLMs: cómo obtienen la información y cómo puedes influir en lo que dicen.
¿Cómo encuentran y usan tu contenido los modelos de lenguaje?
Un LLM puede «conocer» tu web de dos maneras distintas, y el LLMO funciona de forma diferente en cada una.
1. Datos de entrenamiento. Los modelos se entrenan con grandes instantáneas de la web pública. Si tus páginas se rastrearon y se incluyeron, el modelo puede haber asimilado datos sobre tu marca. No puedes editarlo directamente, va con meses de retraso y casi nunca genera un enlace en el que se pueda hacer clic.
2. Recuperación en tiempo real (search grounding). Cuando ChatGPT search, Gemini, los AI Overviews de Google, Claude o Perplexity responden a una pregunta, a menudo lanzan una búsqueda web, descargan unas cuantas páginas y redactan una respuesta que las cita. Aquí es donde el LLMO te trae visitas reales. Si tu página se puede rastrear, está indexada y da una respuesta clara, puede recuperarse y citarse en cuestión de días.
Para la mayoría de los negocios, la recuperación en tiempo real importa mucho más. Se apoya en un índice de búsqueda normal, ya sea el de Google, el de Bing o el del propio rastreador de la empresa de IA. Por eso el primer requisito del LLMO es el mismo que el del SEO: la página tiene que poder rastrearse e indexarse. Si una página aparece en Search Console como Descubierta: actualmente sin indexar, por muy «amigable para la IA» que sea la redacción, no la van a citar.
¿Qué dice Google sobre optimizar para la IA?
La postura oficial de Google es inusualmente directa. Su página de Search Central «Funciones de IA y tu sitio web» (actualizada por última vez en diciembre de 2025) indica que no hay requisitos adicionales para aparecer en AI Overviews o AI Mode ni hacen falta optimizaciones especiales. La página tiene que estar indexada y poder mostrar un fragmento en la Búsqueda normal. Nada más.
Google recomienda los fundamentos de siempre: permitir el rastreo en robots.txt, usar enlaces internos, ofrecer una buena experiencia de página, poner el contenido importante en texto y mantener actualizados los datos estructurados y tu Perfil de Empresa. El tráfico de las funciones de IA aparece en el informe de Rendimiento de Search Console, dentro del tipo de búsqueda «Web». No existe un informe de IA aparte.
Para limitar cómo aparece tu contenido en las funciones de IA, Google remite a los controles de vista previa que ya existen: nosnippet, data-nosnippet, max-snippet y noindex. Google también afirma que no se necesitan nuevos archivos legibles por máquinas ni archivos de texto específicos para IA. Eso incluye llms.txt, que no tiene ningún efecto en la Búsqueda de Google.
¿Qué rastreadores de IA deberías permitir en robots.txt?
Es la tarea más concreta del LLMO y a menudo se hace mal. Muchas webs bloquean todos los bots de IA «por si acaso» y luego se preguntan por qué ChatGPT nunca las cita. Otras mantienen una regla del CDN o del firewall que devuelve errores 403 a los user agents de IA sin que nadie se dé cuenta.
Los principales bots se dividen en dos grupos: rastreadores de entrenamiento y rastreadores de búsqueda/recuperación. Puedes controlarlos por separado.
| Empresa | Rastreador de entrenamiento | Rastreador de búsqueda / recuperación | Notas |
|---|---|---|---|
| OpenAI | GPTBot | OAI-SearchBot | Según la documentación de OpenAI, permitir OAI-SearchBot ayuda a que tu web aparezca en ChatGPT search. ChatGPT-User descarga páginas a petición de un usuario y puede no respetar robots.txt. |
| Google-Extended (un token de control, no un bot independiente) | Googlebot | AI Overviews y AI Mode usan el índice normal de Googlebot. Bloquear Google-Extended no te saca de la Búsqueda. | |
| Anthropic | ClaudeBot | Claude-SearchBot, Claude-User | Consulta la documentación actual de Anthropic para conocer el comportamiento exacto. |
| Perplexity | — | PerplexityBot | Se usa para mostrar y enlazar webs en las respuestas de Perplexity. |
Una configuración equilibrada habitual es permitir los rastreadores de búsqueda y decidir aparte sobre el entrenamiento:
# Permitir la búsqueda/recuperación de IA para poder ser citado
User-agent: OAI-SearchBot
Allow: /
User-agent: PerplexityBot
Allow: /
# Excluirse del entrenamiento de modelos (decisión de negocio opcional)
User-agent: GPTBot
Disallow: /
User-agent: Google-Extended
Disallow: /
Excluirse del entrenamiento es una decisión legítima. Solo asegúrate de no estar bloqueando también la recuperación por error. Y revisa el servidor, no solo robots.txt: una regla de firewall o de protección contra bots que bloquee estos user agents prevalece sobre lo que permita robots.txt.
Cómo escribir contenido que los LLMs puedan citar
Los sistemas de recuperación dividen las páginas en fragmentos, eligen los pasajes que mejor encajan con la pregunta y los convierten en una respuesta. Tu trabajo es que tus mejores pasajes sean fáciles de extraer y difíciles de malinterpretar.
Primero la respuesta, después la explicación
Pon una respuesta directa de una o dos frases justo debajo de cada encabezado. Mal: tres párrafos sobre la historia de tu empresa antes de mencionar el precio. Bien: «Una revisión estándar de caldera cuesta entre X e Y y dura aproximadamente una hora. Esto es lo que incluye». Y después desarrolla.
Escribe pasajes autónomos
Cada sección debe entenderse si se lee sola. Repite el sujeto en lugar de escribir «esto» o «esta opción», porque un fragmento que empieza con «Como se ha mencionado antes…» pierde su sentido fuera de contexto. Las secciones de unas 130–170 palabras que responden a una sola pregunta son fáciles de recuperar y citar.
Usa datos concretos y verificables
Los modelos prefieren contenido con detalles concretos: cifras, normas con nombre, fechas, pasos, condiciones. «Nuestros planes empiezan en 49 $ al mes, con facturación anual y 14 días de prueba» es citable. «Planes asequibles para todos los bolsillos» no lo es. Publica solo cifras que puedas respaldar, porque un asistente de IA repetirá un número erróneo con total seguridad.
Estructura con HTML real
Usa encabezados correctos (h2, h3), listas y tablas para las comparativas. Mantén el contenido clave en el HTML en lugar de cargarlo solo mediante JavaScript del lado del cliente. Muchos rastreadores de IA no renderizan JavaScript con la misma fiabilidad que Googlebot, así que el texto que solo aparece tras ejecutar scripts puede no llegar a verse nunca.
Formula los encabezados como preguntas reales
Encabezados como «¿Cuánto tarda el envío a España?» coinciden con la forma en que la gente pregunta a los asistentes de IA. Además ayudan con los fragmentos destacados clásicos. Tienes más tácticas en Cómo posicionar en AI Overviews y en la búsqueda con IA.
Coherencia de marca: la parte del LLMO que casi todos olvidan
Cuando alguien pregunta a un asistente de IA «¿[tu marca] es buena?» o «Mejor software de contabilidad para autónomos», la respuesta se nutre de muchas fuentes además de tu web: plataformas de reseñas, directorios, artículos comparativos, foros, noticias y tu Perfil de Empresa en Google.
Si esas fuentes no coinciden en tus precios, ubicaciones, año de fundación o nombres de producto, el modelo puede mezclarlos o dejarte fuera. Pasos prácticos:
- Revisa los datos de tu entidad. Asegúrate de que tu nombre, dirección, teléfono, precios, horarios y oferta principal coinciden en todos los sitios donde aparecen.
- Ten una página «Quiénes somos» que exponga los hechos con claridad: qué haces, para quién, dónde operas y cómo contactarte.
- Usa datos estructurados Organization y LocalBusiness con información precisa y enlaces
sameAsa tus perfiles oficiales. Los datos estructurados no garantizan citas, pero hacen que tus datos no sean ambiguos. - Consigue menciones reales. Aparecer en artículos comparativos y recursos sectoriales de prestigio influye en qué marcas recomiendan los modelos. Esto no se puede falsear a escala.
- Corrige las páginas desactualizadas. Las páginas de precios antiguas, los productos descatalogados y las promociones caducadas siguen siendo rastreables y pueden acabar citadas.
Mitos habituales sobre el LLMO
«Necesitas un archivo llms.txt». Es una convención propuesta. Google ha dicho que no lo usa para la Búsqueda y ningún gran proveedor de IA lo ha confirmado como factor de cita. Añadirlo cuesta poco, pero no debería ir antes que corregir problemas de indexación o bloqueos de rastreo.
«El schema FAQ te mete en las respuestas de IA». Google retiró los resultados enriquecidos de FAQ para todos los sitios en mayo de 2026, y los de HowTo ya en 2023. El contenido claro en formato pregunta-respuesta sigue ayudando a los lectores y a la recuperación, pero el marcado ya no genera un resultado enriquecido.
«El LLMO sustituye al SEO». La recuperación de la IA depende de índices de búsqueda y de señales como la rastreabilidad, la autoridad y la claridad del contenido. Una web con problemas de SEO técnico es débil en ambos frentes. Si tu tráfico orgánico ha caído mientras aumentaban las respuestas de IA, descarta primero las causas habituales con un diagnóstico de caída de tráfico.
«Puedes colarte en las respuestas con prompt injection». El texto oculto dirigido a modelos de IA es spam. Incumple las políticas de spam de Google y pone en riesgo tu posicionamiento normal.
Qué corregir primero para aparecer en ChatGPT y otras IA
Para una web pequeña o mediana, este orden ofrece el mayor retorno por el esfuerzo:
- Indexación y acceso de rastreo. Comprueba que tus páginas clave están indexadas en Google y Bing. Corrige bloqueos en robots.txt, etiquetas
noindexolvidadas, canónicas rotas y errores de servidor. - Acceso de los rastreadores de IA. Revisa robots.txt y las reglas del firewall para OAI-SearchBot, PerplexityBot y bots similares. Toma una decisión consciente sobre los rastreadores de entrenamiento.
- Contenido renderizado en el servidor. Confirma que el texto principal, los precios y los detalles de producto están en el HTML inicial.
- Reescrituras con la respuesta primero. Empieza por tus 10–20 páginas de más valor: servicios, precios, guías principales. Añade respuestas directas y encabezados en forma de pregunta.
- Coherencia de entidad. Alinea tus datos en tu web, tu Perfil de Empresa, directorios y plataformas de reseñas.
- Experiencia de página. Las páginas rápidas y estables ayudan tanto a los usuarios como a los rastreadores. Apunta a los umbrales de Core Web Vitals: LCP ≤ 2,5 s, INP ≤ 200 ms, CLS ≤ 0,1.
- Seguimiento. Pregunta con regularidad a ChatGPT, Gemini y Perplexity lo mismo que preguntan tus clientes. Anota si te mencionan, si los datos son correctos y qué competidores aparecen citados en tu lugar.
Los pasos 1–3 y 6 son técnicos, y es ahí donde la mayoría de las webs fallan sin darse cuenta. Una auditoría SEO automatizada los detecta rápidamente. El informe de ejemplo muestra el tipo de evidencias que conviene buscar, como URLs concretas con recursos bloqueados, etiquetas noindex o contenido que falta en el HTML. El ejemplo completo muestra cómo se priorizan las correcciones en un plan de 30/60/90 días.
¿Cómo se miden los resultados del LLMO?
La medición todavía es imperfecta, pero puedes seguir señales útiles:
- Tráfico de referencia en tu analítica desde
chatgpt.com,perplexity.ai,gemini.google.comy dominios similares. - Rendimiento «Web» en Search Console, que incluye los clics desde AI Overviews y AI Mode.
- Logs del servidor con visitas de OAI-SearchBot, PerplexityBot y otros bots de recuperación. Si nunca aparecen, algo los está bloqueando.
- Comprobaciones manuales de prompts. Mantén una lista fija de 20–30 preguntas y registra cada mes si te citan y si las respuestas son correctas.
- Auditorías de antes y después. Tras corregir los problemas técnicos, lanza una reauditoría para confirmar que las correcciones funcionaron de verdad. Nuestro ejemplo de informe comparativo muestra los problemas marcados como corregidos, mejorados, sin resolver o nuevos.
Puntos clave
- El LLMO consiste en optimizar cómo los grandes modelos de lenguaje encuentran, entienden y citan tu marca. Se apoya en el SEO y no lo sustituye.
- La recuperación en tiempo real (búsqueda con IA) envía tráfico real. Los datos de entrenamiento no, y no puedes editarlos.
- Google afirma que AI Overviews y AI Mode no requieren optimización especial: lo que cuenta es la indexación y poder mostrar fragmentos.
- Permite los rastreadores de búsqueda de IA como OAI-SearchBot y PerplexityBot, y decide aparte si permites los de entrenamiento como GPTBot y Google-Extended.
- Escribe pasajes autónomos, con la respuesta primero y datos concretos, en HTML renderizado en el servidor.
- Mantén los datos de tu marca coherentes en tu web y en fuentes de terceros.
- llms.txt, el schema FAQ y los prompts ocultos no son atajos.
Empieza por la base técnica
La mayoría de los problemas de LLMO se reducen a cosas que se pueden comprobar: páginas sin indexar, rastreadores bloqueados, contenido oculto tras JavaScript o plantillas lentas. Si quieres saber cuáles afectan a tu web, solicita una vista previa gratuita de tu auditoría SEO. Recibirás tu puntuación y varios problemas reales detectados en tus propias páginas, y a partir de ahí podrás decidir si te merece la pena desbloquear el informe completo.