La IA no elige a los mejores del top 10, elige a los que más se parecen a la pregunta
Un equipo de la Universidad de Yokohama y de la empresa japonesa CyberAgent presentó en el congreso JSAI 2026 un trabajo con un título largo y una idea muy corta: las páginas que Google cita dentro de su resumen con IA encajan con la pregunta del usuario todavía mejor que las que ocupan los primeros puestos del buscador normal.
No es una intuición de consultor. Es una comparación con números y con pruebas estadísticas. Te la cuento en llano y luego bajamos a lo que puedes hacer tú.
Qué hicieron exactamente
El problema de fondo es que nadie sabe muy bien por qué la IA de Google escoge unas fuentes y descarta otras. Hasta ahora casi todo lo que se había estudiado era el envoltorio: si la página tiene datos estructurados, si el HTML está bien montado, si el dominio es una marca o un medio. Casi nadie había medido lo que dice el texto.
Estos investigadores montaron un medidor. Cogieron un modelo de lenguaje japonés capaz de leer páginas largas enteras (hasta unas 8.000 unidades de texto, mucho más de lo que aguantaban los modelos anteriores) y lo entrenaron con los cien primeros resultados de Google para un montón de búsquedas. El entrenamiento consistía en enseñarle parejas de páginas y preguntarle cuál de las dos encaja mejor con la búsqueda, una y otra vez, hasta que aprendió a ordenarlas como las ordena Google.
Solo usaron búsquedas informativas, del tipo "cómo investigar mis antepasados". Descartaron a propósito las de compra y las de marca, porque ahí mandan factores que no tienen nada que ver con el significado del texto.
Cuando el medidor estuvo listo, lo apuntaron a 714 páginas citadas dentro de los resúmenes con IA y las compararon con otras 714 páginas del buscador clásico. Y aquí está el detalle que da valor al estudio: emparejaron cada página citada con una orgánica de la misma posición, para que la comparación no estuviera contaminada por el hecho de salir arriba o abajo.
El número
Las páginas citadas por el resumen con IA sacaron una media de 0,915 de encaje con la pregunta. Las orgánicas equivalentes, 0,857. Casi seis centésimas de diferencia sobre una escala de cero a uno.
Parece poco. No lo es, por dos motivos. El primero es que la comparación no era contra el resultado número 50, era contra páginas de la misma posición, es decir, contra rivales que ya habían ganado en el buscador normal. El segundo es que la diferencia aguanta las pruebas estadísticas con holgura: sale significativa por dos caminos distintos, con probabilidades de que sea casualidad del orden de una entre cien mil y una entre cinco millones.
Traducido: no es ruido. La IA está aplicando un filtro extra por encima del ranking de siempre, y ese filtro premia el ajuste entre lo que se pregunta y lo que dice tu texto.
Qué significa esto para tu web
Que estar en el top 10 ya no te garantiza aparecer en el resumen. Es la condición de entrada, no el premio. Dentro de ese grupo, la IA vuelve a filtrar, y el criterio que usa se parece mucho a "¿este texto responde a esto que me han preguntado o responde a otra cosa parecida?".
Eso cambia la prioridad del trabajo. Durante años lo primero era la autoridad, los enlaces y la parte técnica. Siguen contando para llegar al top. Pero para el último salto, el que decide si te citan, cuenta el contenido en sí. Si te interesa el contraste entre las dos disciplinas, lo desarrollo en las diferencias entre SEO y GEO.
Cinco cosas que puedes hacer esta semana
1. Una página, una pregunta. El artículo que intenta cubrir seis búsquedas a la vez es exactamente el que peor puntúa en este tipo de medición: su significado medio queda a medio camino de todo. Parte los contenidos-monstruo en piezas con una intención clara cada una.
2. Responde arriba y sin rodeos. El modelo del estudio lee la página entera, pero mide el conjunto. Cada párrafo de introducción, de contexto histórico o de "en este artículo veremos" diluye la media. Empieza contestando.
3. Usa las palabras de la pregunta, no tus sinónimos internos. No hablo de repetir la keyword veinte veces. Hablo de que si la gente pregunta "cuánto cuesta", tu texto diga "cuesta" y una cifra, no "inversión orientada a resultados".
4. Revisa tus páginas que ya están en el top y no salen citadas. Ese es el diagnóstico más rentable que sale de este estudio. Si estás en la primera página y la IA no te menciona, tu problema no es de autoridad ni de enlaces: es que el texto no está lo bastante pegado a la pregunta.
5. No abandones lo técnico. El estudio no dice que los datos estructurados o el HTML limpio no sirvan. Dice que además de eso hay otro factor que nadie estaba mirando. Se suman, no se sustituyen.
Lo que el estudio no demuestra
Conviene ser honesto con los límites, que además reconocen los propios autores.
Los datos son de búsquedas en japonés. Es razonable pensar que el comportamiento del sistema es parecido en español, pero razonable no es lo mismo que demostrado.
Solo miraron búsquedas informativas. De búsquedas de compra o de marca, este trabajo no dice nada.
Para medir el texto quitaron todo el HTML. Es decir, midieron el significado con las etiquetas fuera, así que el estudio no puede decir cuánto pesa el encaje semántico comparado con el resto de factores; solo que pesa.
Y el propio medidor falla en cierto tipo de búsquedas. Con "listado de fabricantes químicos" no supo distinguir unas páginas de otras, porque todas eran básicamente la misma lista de nombres propios. Donde no hay diferencia de significado, esta lógica no aplica.
Mi lectura
Este trabajo pone número a algo que muchos veníamos observando a ojo: hay páginas que rankean bien y nunca aparecen en los resúmenes de IA, y suelen ser las que dan muchas vueltas antes de responder.
La conclusión práctica es casi antigua. Escribe para contestar la pregunta concreta que trae la persona, en sus palabras, sin adornos previos. Lo que ha cambiado es que ahora eso ya no es solo buen criterio editorial: es el filtro que decide si una máquina te cita o cita a otro.
Preguntas frecuentes
¿Qué encontró el estudio sobre los resúmenes con IA de Google?
Que las páginas citadas dentro del resumen con IA tienen un encaje con la búsqueda más alto (0,915 de media) que los resultados orgánicos de su misma posición (0,857). La diferencia es estadísticamente significativa.
¿Estar en el top 10 garantiza salir en el resumen con IA?
No. Según este trabajo, estar arriba es la condición de entrada, pero dentro de ese grupo la IA vuelve a filtrar y prioriza los textos que responden de forma más directa a la pregunta.
¿Entonces ya no importan los datos estructurados ni la parte técnica?
Sí importan. El estudio no compara ambos factores: solo demuestra que el encaje del texto con la pregunta influye además de lo técnico y de la autoridad del dominio.
¿Los resultados sirven para el español?
Los datos se recogieron en japonés y solo con búsquedas informativas. Es razonable esperar un comportamiento parecido en español, pero el estudio no lo demuestra.
¿Qué reviso primero en mi web con este dato?
Las páginas que ya están en la primera página de Google y no aparecen citadas en el resumen con IA. Ahí el problema no suele ser de enlaces, sino de un texto que no responde de forma bastante directa.