
Puedes tener el mejor contenido del mundo y los mejores backlinks, pero si Google no puede rastrear, indexar o renderizar tu web correctamente, nada de eso importa. Es como tener una tienda espectacular en un callejón sin salida: el producto es genial, pero nadie puede llegar hasta ella.
El SEO técnico es la infraestructura invisible que permite que todo lo demás funcione. Y en mi experiencia, es la parte del SEO que más webs tienen mal — porque es la que menos se ve y la que más se ignora.
No necesitas ser programador para entender y aplicar SEO técnico. Lo que necesitas es saber qué revisar, cómo identificar problemas, y cuándo necesitas ayuda técnica. Eso es exactamente lo que te voy a explicar.
Publiqué 172 artículos en marzo y fue mi peor mes
Tenía esta web parada y la estoy rehaciendo con IA. Cambié la forma de hacerlo y en once días de agosto ha tenido más visitas desde Google que en todo julio. Te cuento por correo qué cambié.
- · Por qué la oportunidad es mayor ahora, y no menor
- · Lo único que la IA no te puede copiar: tu criterio
- · Cómo hacer que Google te vea en días, no en seis meses

Qué es el SEO técnico
SEO técnico es el conjunto de optimizaciones que afectan a cómo los motores de búsqueda rastrean, indexan, renderizan y comprenden tu web. No tiene que ver con el contenido ni con los enlaces — tiene que ver con la infraestructura técnica.
Los tres pilares del SEO técnico:
- Rastreabilidad (crawling): ¿Puede Google encontrar y acceder a todas tus páginas?
- Indexabilidad (indexing): ¿Puede Google entender e incluir tus páginas en su índice?
- Rendimiento (performance): ¿Tu web carga rápido y ofrece buena experiencia de usuario?
Si alguno de estos tres falla, tu SEO tiene un techo que ninguna cantidad de contenido o backlinks puede romper.
En 2026 hay que añadir un cuarto pilar que hace tres años no existía: la accesibilidad para los rastreadores de IA. Googlebot ya no es el único que visita tu web, y las reglas no son las mismas para todos. Le dedico una sección entera más abajo.
Rastreo: que Google encuentre todas tus páginas
Cómo funciona el rastreo
Googlebot (el crawler de Google) visita tu web siguiendo enlaces. Empieza por las páginas que ya conoce (tu homepage, tu sitemap) y va descubriendo nuevas páginas a través de los enlaces internos.
Pero Googlebot tiene un presupuesto limitado de rastreo (crawl budget) para cada web. Esto significa que no puede rastrear todas tus páginas en cada visita — prioriza las más importantes y las que cambian con más frecuencia.
Problemas comunes de rastreo
Robots.txt bloqueando páginas importantes: El archivo robots.txt le dice a Google qué puede y qué no puede rastrear. Un error aquí puede bloquear páginas críticas. He visto webs que bloqueaban su propio directorio /blog/ o sus páginas de producto sin saberlo.
Cómo revisar: Visita tudominio.com/robots.txt y verifica que no estás bloqueando nada que debería ser rastreable. En Google Search Console tienes el informe de robots.txt, que te muestra la versión que Google ha leído realmente y cuándo.
Cadenas de redirecciones: Una redirección lleva a otra, que lleva a otra... Googlebot pierde paciencia y deja de seguir después de unos cuantos saltos. Máximo 1-2 redirecciones entre el origen y el destino final.
Páginas huérfanas: Páginas que existen pero no tienen ningún enlace interno apuntando a ellas. Si ni tú las enlazas, Google difícilmente las encontrará.
Solución: Asegúrate de que toda página importante tiene al menos un enlace interno desde otra página. Tu sitemap ayuda, pero los enlaces internos son la forma principal de descubrimiento.
URLs con parámetros infinitos: Filtros de búsqueda, ordenación, paginación... que generan miles de URLs que son técnicamente distintas pero tienen el mismo contenido. Googlebot malgasta crawl budget rastreando variantes que no aportan nada.
El sitemap XML
Tu sitemap XML es un mapa que le dice a Google qué páginas existen, cuándo se actualizaron, y qué prioridad tienen. No garantiza que Google las rastree o indexe, pero ayuda.
Buenas prácticas:
- Incluye solo URLs que quieres que se indexen (no 404s, no redireciones, no páginas con noindex)
- Actualiza las fechas de modificación solo cuando el contenido realmente cambie
- Envía el sitemap a Google Search Console
- Si tienes más de 50.000 URLs, usa sitemaps múltiples con un sitemap index
- Olvídate de las etiquetas
priorityychangefreq: Google confirmó hace años que las ignora. La única que lee eslastmod, y solo si eres consistente
Un extra que casi nadie usa: IndexNow. Es un protocolo abierto que avisa a los buscadores cuando publicas o actualizas una URL, en vez de esperar a que pasen. Bing y Yandex lo soportan; Google no lo ha adoptado. Si tu CMS lo trae de serie, actívalo: cuesta cero y acelera la indexación en el buscador que alimenta a Copilot.

Indexación: que Google incluya tus páginas
Que Google rastree una página no significa que la indexe. Rastreo es "la visito y la leo". Indexación es "la incluyo en mi base de datos de resultados".
Problemas comunes de indexación
Etiquetas noindex accidentales:
Una meta tag <meta name="robots" content="noindex"> le dice a Google que no indexe la página. A veces se pone durante el desarrollo y se olvida quitar en producción. O un plugin de SEO la añade sin que te des cuenta.
Cómo detectar: En Google Search Console, ve a Páginas > "No indexada" y revisa las razones.
Canonicals incorrectas: La etiqueta canonical le dice a Google cuál es la URL "principal" de una página (útil cuando la misma página es accesible por varias URLs). Si el canonical apunta a otra página, Google indexará esa otra en lugar de la tuya.
Contenido duplicado: Si tienes múltiples páginas con el mismo o muy similar contenido, Google puede no indexar ninguna — o indexar la que no quieres.
Contenido thin (delgado): Páginas con muy poco contenido (menos de 100 palabras), sin valor añadido, o que son prácticamente iguales a otras. Google cada vez es más agresivo descartando contenido que no aporta.
Solución: Cada página indexable debe tener contenido sustancial y único que justifique su existencia.
El caso nuevo: páginas indexadas pero nunca servidas. Desde que los sistemas generativos median entre el usuario y tu web, hay páginas que Google indexa y sobre las que nunca envía un clic porque su contenido se consume dentro de la respuesta de IA. En Search Console eso se ve como impresiones que se mantienen y clics que se desploman. No es un error técnico: es un cambio de producto, y el arreglo no es técnico tampoco.
Cómo verificar la indexación
- Google Search Console → Páginas: Te muestra cuántas páginas están indexadas y cuántas no, con las razones.
- Búsqueda site:tudominio.com: Muestra las páginas indexadas de tu dominio.
- Inspección de URL en Search Console: Verifica el estado de indexación de una URL específica y pide indexación manual si es necesario.
Core Web Vitals: la velocidad importa (mucho)
Los Core Web Vitals son métricas de experiencia de usuario que Google usa como factor de ranking desde 2021. En 2026 siguen siendo las mismas tres, y no hay señales de que Google vaya a cambiarlas a corto plazo:
Las 3 métricas actuales
LCP (Largest Contentful Paint): Mide cuánto tarda en cargarse el contenido principal visible de la página. El estándar: menos de 2,5 segundos.
Causas comunes de mal LCP:
- Imágenes de portada sin optimizar (demasiado pesadas)
- Fuentes web que bloquean el renderizado
- Servidor lento (Time to First Byte alto)
- JavaScript que bloquea la carga
Solución: Optimiza imágenes (WebP o AVIF, lazy loading, dimensiones correctas), usa font-display: swap para fuentes, y mejora tu hosting si el TTFB es alto.
INP (Interaction to Next Paint): Reemplazó a FID en marzo de 2024. Mide la respuesta de la página a las interacciones del usuario (clics, toques, teclado). El estándar: menos de 200 milisegundos.
Causas comunes de mal INP:
- JavaScript pesado bloqueando el hilo principal
- Manejadores de eventos ineficientes
- Demasiados event listeners
Solución: Minimiza JavaScript, usa lazy loading para scripts no críticos, y evita manipulaciones pesadas del DOM.
CLS (Cumulative Layout Shift): Mide la estabilidad visual. Cuando cargas una página y el contenido "salta" porque se carga un anuncio, una imagen, o una fuente diferente, eso es layout shift. El estándar: menos de 0,1.
Causas comunes de mal CLS:
- Imágenes sin dimensiones especificadas
- Anuncios que se insertan dinámicamente
- Fuentes web que cambian el tamaño del texto al cargar
- Contenido inyectado dinámicamente
Solución: Siempre especifica width y height en imágenes, reserva espacio para anuncios, y usa font-display: swap con fuentes de respaldo del mismo tamaño.
| Métrica | Qué mide | Bueno | Necesita mejorar | Malo |
|---|---|---|---|---|
| LCP | Carga del contenido principal | ≤ 2,5 s | 2,5 – 4 s | > 4 s |
| INP | Respuesta a la interacción | ≤ 200 ms | 200 – 500 ms | > 500 ms |
| CLS | Estabilidad visual | ≤ 0,1 | 0,1 – 0,25 | > 0,25 |
Un aviso de criterio, por si te obsesionas: los Core Web Vitals son un factor de desempate, no una palanca de posicionamiento. Pasar de un LCP de 4 segundos a 2 segundos sí mueve la aguja. Pasar de 2,1 a 1,9 no te va a subir ninguna posición. Si tienes tiempo limitado, gástalo antes en contenido que en arañar milisegundos.
Cómo medir Core Web Vitals
- PageSpeed Insights: Datos reales (Chrome UX Report) + datos de laboratorio
- Google Search Console → Core Web Vitals: Visión general de todo tu sitio
- Lighthouse (en Chrome DevTools): Auditoría detallada de una página

Arquitectura web: la estructura que Google entiende
La arquitectura de tu web (cómo están organizadas las páginas y cómo se conectan entre sí) es un factor técnico crítico que muchos ignoran.
Profundidad de clic
Ninguna página importante debería estar a más de 3 clics de la homepage. Si para llegar a un artículo de tu blog hay que hacer clic en: Inicio → Blog → Categoría → Subcategoría → Artículo (5 clics), estás enterrando contenido.
Estructura de URLs lógica
Tu estructura de URLs debería reflejar la jerarquía de tu web:
- /hub/ (sección principal)
- /hub/seo-on-page (artículo)
- /hub/categoria/marketing (categoría)
Breadcrumbs
Las migas de pan (breadcrumbs) ayudan al usuario a entender dónde está y a Google a entender la estructura. Implementa Schema markup de BreadcrumbList para que aparezcan en los resultados de Google.
Enlazado interno estratégico
Ya lo mencioné en el artículo sobre SEO On Page, pero vale la pena repetirlo: el enlazado interno es la forma en que distribuyes la autoridad de tu dominio entre tus páginas.
Páginas con más enlaces internos reciben más autoridad. Asegúrate de que tus páginas más importantes (las que quieres posicionar) reciben más enlaces internos que las menos importantes.
HTTPS y seguridad
En 2026 no debería hacer falta decirlo, pero lo digo: si tu web no tiene HTTPS, tienes un problema de SEO (y de seguridad, y de confianza del usuario).
HTTPS ha sido factor de ranking confirmado desde 2014. Chrome marca las webs sin HTTPS como "No seguras". No hay excusa para no tenerlo — los certificados SSL son gratuitos con Let's Encrypt.
Internacionalización (hreflang)
Si tu web está disponible en varios idiomas o dirigida a varios países, necesitas etiquetas hreflang correctas. Le dicen a Google qué versión de la página mostrar según el idioma/país del usuario.
Los errores de hreflang son comunes y pueden causar que Google muestre la versión equivocada de tu página o ignore ambas. Audita regularmente con herramientas como Screaming Frog.
Un apunte muy español: si tienes versión para España y versión para Latinoamérica, no basta con es. Necesitas es-ES, es-MX, es-AR y una x-default. Es de los errores que más veo en webs de servicios que quieren captar en ambos mercados.
Mobile-first indexing
Google completó la migración a indexación mobile-first el 5 de julio de 2024: desde esa fecha rastrea e indexa todas las webs con el crawler móvil, sin excepciones ni listas de espera. Si tu web no funciona bien en móvil, tu SEO no sufre "un poco": Google literalmente no ve la versión de escritorio.
Checklist mobile:
- Diseño responsive (no versión separada m.tudominio.com)
- Texto legible sin hacer zoom
- Botones y enlaces con espacio suficiente para tocar
- Sin contenido oculto en móvil que sí está en desktop
- Sin pop-ups intrusivos que cubran el contenido
Los rastreadores de IA: el SEO técnico que nadie te está contando
Esta es la parte que ha cambiado de verdad, y la que menos gente tiene resuelta. Tu robots.txt ya no negocia solo con Google: negocia con una docena de bots que hacen cosas distintas y que tienen consecuencias distintas para tu negocio.
La confusión habitual es tratarlos a todos igual. No lo son. Hay tres familias:
- Rastreadores de entrenamiento: recopilan contenido para entrenar modelos. Bloquearlos no te quita visibilidad hoy.
- Rastreadores de búsqueda en tiempo real: son los que alimentan las respuestas con citas. Si los bloqueas, desapareces de las respuestas de IA.
- Agentes bajo petición del usuario: se activan cuando alguien pega tu URL en un chat y pide que la lea.
| User-agent | Empresa | Para qué sirve | Si lo bloqueas |
|---|---|---|---|
GPTBot | OpenAI | Entrenamiento de modelos | No afecta a las citas en ChatGPT |
OAI-SearchBot | OpenAI | Búsqueda en ChatGPT | Desapareces de ChatGPT con búsqueda |
ChatGPT-User | OpenAI | El usuario pega tu URL | No pueden leer tu página bajo petición |
ClaudeBot | Anthropic | Entrenamiento | No afecta a las citas |
Claude-SearchBot | Anthropic | Búsqueda con citas | Desapareces de las respuestas de Claude |
PerplexityBot | Perplexity | Indexación para citar | Desapareces de Perplexity |
Google-Extended | Entrenamiento de Gemini | No afecta a Búsqueda ni a AI Overviews | |
Applebot-Extended | Apple | Entrenamiento | No afecta a Siri ni a Spotlight |
CCBot | Common Crawl | Dataset público usado por muchos | Sales de un dataset muy reutilizado |
Bytespider | ByteDance | Entrenamiento | Es el que más tráfico genera y el que peor respeta las reglas |
El detalle que más gente se equivoca: Google-Extended no controla si apareces en las AI Overviews. Solo controla si tu contenido se usa para entrenar Gemini. El acceso de las AI Overviews va con Googlebot: si quieres salir de las AI Overviews tienes que renunciar también a la Búsqueda normal, y eso casi nunca compensa. Lo explico con más detalle en la guía de cómo aparecer en las AI Overviews.
Mi recomendación por defecto para una web de negocio: permite todos los rastreadores de búsqueda y decide con calma sobre los de entrenamiento. Si vives del tráfico y de la visibilidad, bloquear PerplexityBot o OAI-SearchBot es dispararte en el pie. Si tienes contenido premium o propiedad intelectual sensible, bloquear los de entrenamiento tiene sentido y no te cuesta visibilidad.
¿Y el llms.txt?
Te lo van a vender como el nuevo robots.txt. No lo es, al menos todavía.
Google ha sido explícito: ni la Búsqueda ni sus sistemas de IA leen el archivo llms.txt. Lo han dicho tanto John Mueller como Gary Illyes, y la documentación de Google Search lo confirma. Anthropic sí lo utiliza en algunos flujos, y herramientas de desarrollo como Cursor lo soportan, pero la adopción real entre las webs más citadas por IA es prácticamente nula.
Mi criterio: si tu CMS te lo genera solo, déjalo puesto, no hace daño y cuesta cero. Si tienes que dedicarle una tarde de trabajo, dedícasela a otra cosa. Tienes el análisis completo en qué es el llms.txt.
Datos estructurados: más importantes, aunque den menos rich results
Aquí hay una paradoja que confunde a mucha gente. Por un lado, Google ha ido recortando los rich results que muestra: los de HowTo se retiraron por completo, y los de FAQ quedaron limitados a sanidad y administración pública en agosto de 2023 hasta desaparecer del todo en 2026. Por otro lado, los datos estructurados son más útiles que nunca.
¿Por qué? Porque los sistemas generativos usan el marcado para entender sin ambigüedad qué es cada cosa en tu página: qué es una pregunta y cuál es su respuesta, quién es el autor, cuándo se actualizó, qué producto y qué precio. Que Google no te pinte un acordeón bonito en la SERP no significa que la máquina no lo lea.
Prioriza, por este orden: Article con author y dateModified reales, BreadcrumbList, Organization con sameAs apuntando a tus perfiles, FAQPage en los artículos que respondan preguntas, y Product u Offer si vendes.
Cómo hacer una auditoría de SEO técnico
Herramientas esenciales
Gratuitas:
- Google Search Console: La fuente más fiable. Datos directos de Google sobre rastreo, indexación, y Core Web Vitals.
- PageSpeed Insights: Análisis de velocidad y Core Web Vitals de cualquier URL.
- Lighthouse (en Chrome): Auditoría completa de performance, accesibilidad, y SEO.
- Bing Webmaster Tools: gratuito y muy infravalorado en España. Es el índice que alimenta a Copilot, así que su informe de indexación importa más que hace tres años.
De pago:
- Screaming Frog: El estándar de la industria para auditorías técnicas. Rastrea tu web como lo haría Google y detecta problemas. Versión gratuita hasta 500 URLs; la licencia anual ronda las 240 £ (confirma el precio en su web, lo suben casi cada año).
- Ahrefs Site Audit: Auditoría técnica automatizada con priorización de problemas.
- Sitebulb: Alternativa visual a Screaming Frog con recomendaciones priorizadas.
Si nunca has hecho una, en cómo hacer una auditoría SEO tienes el proceso completo paso a paso, no solo la parte técnica.
Checklist de auditoría técnica
Rastreo:
- robots.txt no bloquea páginas importantes
- Sitemap XML actualizado y enviado a Search Console
- No hay cadenas de redirecciones largas
- No hay páginas huérfanas importantes
- No hay errores 404 internos
Indexación:
- No hay noindex accidentales en páginas importantes
- Canonicals correctas en todas las páginas
- No hay contenido duplicado significativo
- Todas las páginas importantes están indexadas en Google
Rendimiento:
- LCP < 2,5 segundos
- INP < 200 milisegundos
- CLS < 0,1
- Imágenes optimizadas (WebP o AVIF, dimensiones correctas, lazy loading)
- JavaScript minimizado y no bloqueante
Arquitectura:
- Profundidad de clic máxima de 3 para páginas importantes
- URLs limpias y descriptivas
- Breadcrumbs implementados con Schema
- Enlazado interno estratégico
Seguridad y mobile:
- HTTPS en todo el sitio
- Responsive design funcional
- Sin pop-ups intrusivos en móvil
Rastreadores de IA:
- Los bots de búsqueda con citas (OAI-SearchBot, PerplexityBot, Claude-SearchBot) tienen acceso
- La decisión sobre los bots de entrenamiento está tomada a conciencia, no por defecto
- El contenido crítico no depende de JavaScript para renderizarse

SEO técnico y la IA generativa
Con la irrupción de AI Overviews y la búsqueda generativa, el SEO técnico cobra nueva importancia:
El HTML plano vuelve a mandar. Googlebot renderiza JavaScript, aunque con retraso. La mayoría de rastreadores de IA, no: PerplexityBot y compañía leen el HTML que devuelve el servidor y poco más. Si tu contenido principal se inyecta con JavaScript en el cliente, para esos motores tu página está vacía. Renderizado en servidor o generación estática dejan de ser una preferencia de desarrollador y pasan a ser una decisión de visibilidad.
Velocidad y disponibilidad. Los rastreadores de IA tienen menos paciencia que Googlebot. Un timeout es una cita perdida, y no hay reintento garantizado.
La estructura es el formato de cita. Un encabezado que es una pregunta, seguido de una respuesta autónoma de tres líneas, es literalmente lo que un modelo copia. Un muro de texto de 800 palabras sin estructura no se cita nunca.
Todo esto es la capa técnica de algo más amplio: el GEO o Generative Engine Optimization, que es donde se decide si la IA te nombra o nombra a tu competencia.
El SEO técnico es la base sobre la que construyes todo
Sin SEO técnico sólido, el mejor contenido del mundo no posiciona. Es la parte menos glamurosa del SEO, la que no se ve en los rankings directamente, pero la que hace posible que todo lo demás funcione.
La buena noticia es que, una vez que tienes el SEO técnico bien configurado, no necesita atención constante. Una auditoría trimestral y correcciones puntuales son suficientes para mantenerlo en forma.
Pero ignorarlo es como construir una casa sin cimientos: puede que se mantenga un tiempo, pero eventualmente se viene abajo. Y cuando cae, arreglarlo cuesta mucho más que haberlo hecho bien desde el principio.
Preguntas frecuentes
¿Qué es el SEO técnico y para qué sirve?
El SEO técnico es el conjunto de optimizaciones que permiten que un buscador pueda rastrear, indexar, renderizar y entender tu web. No trabaja el contenido ni los enlaces: trabaja la infraestructura. Si falla, ni el mejor contenido del mundo posiciona, porque Google no llega a verlo o no puede procesarlo.
¿Cuáles son los Core Web Vitals y qué valores hay que cumplir?
Son tres métricas: LCP (carga del contenido principal), que debe estar por debajo de 2,5 segundos; INP (respuesta a la interacción), por debajo de 200 milisegundos; y CLS (estabilidad visual), por debajo de 0,1. INP sustituyó a FID en marzo de 2024. Puedes medirlas gratis en PageSpeed Insights y en Google Search Console.
¿Necesito saber programar para hacer SEO técnico?
No para diagnosticar, sí a veces para arreglar. Con Google Search Console, PageSpeed Insights y la versión gratuita de Screaming Frog puedes detectar el 80% de los problemas sin escribir una línea de código. Lo que necesitas es saber describirle a tu desarrollador qué está roto y por qué importa.
¿Cuánto cuesta una auditoría de SEO técnico en España?
Depende del tamaño de la web y de quién la haga. Una auditoría técnica de una web pequeña por un freelance suele moverse entre unos cientos de euros y el bajo millar; una web grande con ecommerce y varios idiomas se va a varios miles. Pide siempre que el entregable incluya priorización por impacto, no solo una lista de 300 errores.
¿Cómo dejo que las IAs rastreen mi web?
Revisa tu robots.txt y asegúrate de que no bloqueas los rastreadores de búsqueda con citas: OAI-SearchBot (ChatGPT), PerplexityBot (Perplexity) y Claude-SearchBot (Claude). Son distintos de los rastreadores de entrenamiento (GPTBot, ClaudeBot, Google-Extended), que puedes bloquear sin perder visibilidad en las respuestas de IA.
¿Bloquear google-extended me saca de las AI Overviews?
No. Google-Extended solo controla si tu contenido se usa para entrenar los modelos Gemini. Las AI Overviews se sirven a partir del índice de Búsqueda, al que accede Googlebot. Para salir de las AI Overviews tendrías que limitar los snippets de Googlebot, y eso te sacaría también de los resultados normales.
¿Sirve para algo el archivo llms.txt?
Hoy, para Google Search, no: Google ha confirmado que no lo lee ni tiene planes de hacerlo. Anthropic sí lo usa en algunos flujos y varias herramientas de desarrollo lo soportan. Si tu CMS lo genera automáticamente, déjalo; no merece la pena dedicarle horas de trabajo manual.
¿Los datos estructurados siguen sirviendo si Google quitó los rich results de FAQ?
Sí. Google retiró los resultados enriquecidos de HowTo y ha eliminado los de FAQ por completo en 2026, pero el marcado sigue siendo la forma más fiable de decirle a una máquina qué es cada cosa en tu página. Los sistemas generativos lo aprovechan para saber qué pregunta respondes y con qué respuesta exacta.
¿Mi web tiene que estar en HTML plano para que la citen las IAs?
No tiene que estarlo, pero el contenido principal sí debe llegar en la respuesta del servidor. La mayoría de rastreadores de IA no ejecutan JavaScript, así que si tu texto se inyecta en el navegador, para ellos la página está en blanco. Renderizado en servidor o generación estática resuelven el problema.
¿Cada cuánto hay que revisar el SEO técnico?
Una auditoría completa cada trimestre es suficiente para una web estable. Lo que sí conviene revisar cada mes es el informe de páginas de Search Console y los Core Web Vitals, y siempre después de un rediseño, una migración o un cambio de hosting: ahí es donde se rompen las cosas.
Inteligencia Artificial aplicada a negocio
Sin humo. Solo experimentos reales, prompts que funcionan y estrategias de escalabilidad.






