marketing 16 de septiembre de 2026 · Mintec

El paper de GEO dice 40% mas de visibilidad. Esto es lo que realmente midio.

El paper de Princeton que definio GEO dice 40% mas de visibilidad. Pero la metrica no es trafico ni clics, y el paper tiene limitaciones que la industria ignora. Analizamos que midio realmente, que no midio, y que dicen los papers de 2026.

Tu agencia de SEO te dice que aplica "optimizaciones GEO" y promete 40% mas de visibilidad en AI. Antes de pagar, lee que dice el paper.

En noviembre de 2023, investigadores de Princeton y Georgia Tech publicaron un paper que definio el termino GEO: Generative Engine Optimization. El paper se presento en KDD 2024, la conferencia principal de ACM sobre descubrimiento de conocimiento, y desde entonces se convirtio en la base de casi todas las agencias que venden servicios GEO.

La cifra que se repite es "40% mas de visibilidad." Aparece en pitches, en blogs de agencias, en presentaciones de conferencias. Lo que casi nadie dice es que ese 40% no es trafico, no son clics, y no es ranking en Google.

Que midio el paper realmente

El paper construyo un benchmark llamado GEO-bench con 10,000 consultas. Para cada consulta, tomo los cinco primeros resultados de Google, limpio el texto, y entrego esas fuentes a un modelo de lenguaje para que escriba una respuesta. Luego reescribio una fuente a la vez y midio que cambia.

El cambio se midio con dos metricas:

  1. Position-adjusted word count. Cuenta cuantas palabras en la respuesta de AI se atribuyen a una fuente, con un descuento exponencial por posicion. Es decir, si tu fuente aparece al inicio de la respuesta cuenta mas que si aparece al final.

  2. Subjective impression. Siete puntuaciones (relevancia, influencia, unicidad, diversidad, posicion subjetiva, conteo subjetivo, y probabilidad de clic) evaluadas por G-Eval, que es otro modelo de lenguaje. Es un modelo juzgando la salida de otro modelo.

Los mejores resultados: las estrategias que agregan evidencia (citar fuentes, agregar citas, agregar estadicas) superaron al baseline sin optimizar en 41% el word count ajustado por posicion y 28% la impresion subjetiva.

Las limitaciones que nadie menciona

El paper tiene limitaciones explicitas que la industria ignora:

No midio ranking en Google. Los autores dicen textualmente: "debido a la naturaleza de caja negra de los algoritmos de busqueda, no evaluamos como los metodos GEO afectan los rankings." Dicen que probablemente no los afecta porque modifican texto, no backlinks ni metadata, pero es una suposicion, no un resultado.

Todas las fuentes ya eran top 5. Cada fuente en el experimento ya rankeaba entre los cinco primeros resultados de Google para su consulta. El paper no explica como llegar ahi. Mide que pasa despues de que ya estas en el top 5, no como llegar.

El mismo edit puede herir. En los resultados del paper, agregar citas a una fuente en quinta posicion la subio 115%, pero a una fuente en primera posicion la bajo 30%. GEO, como lo define el paper, es un mecanismo de redistribucion entre fuentes que ya estan en la lista corta.

La metrica es inventada. Position-adjusted word count no es una metrica que use Google, ChatGPT, ni ninguna plataforma. Los autores la crearon para el paper.

Que dicen los papers de 2026

Tres follow-ups importantes han puesto a prueba los hallazgos originales:

SAGEO Arena (KDD 2026). Investigadores de Yonsei y Konkuk argumentaron que los benchmarks existentes operan "en documentos candidatos pre-determinados", abstraendo las etapas de retrieval y reranking que existen en un pipeline real. Cuando reconstruyeron el experimento incluyendo esas etapas, las optimizaciones existentes frecuentemente degradaron la visibilidad.

What Gets Cited (SIGIR 2026). Un equipo de Sprinklr corrio 252,000 ensayos pareados en seis modelos, cambiando un factor de contenido a la vez. Los dos drivers mas fuertes de que fuente es citada primero: relevancia topica y posicion en la lista. La informacion de precio explicita y un timestamp reciente ayudaron consistentemente. Las ediciones solo de formato tuvieron poco impacto.

El paper de viajes (preprint 2025). Un grupo entreno un modelo en 1,905 pares de contenido de viaje reescrito con citas, evidencia estadica y fluidez mejorada. Reporto 30.96% de ganancia en position-adjusted word count. Pero cubre un solo vertica, usa pares de entrenamiento sinteticos, y testea un solo modelo open-weight.

Que significa esto en la practica

La mayoria de la optimizacion GEO que se vende se basa en reescribir texto: agregar citas, poner estadisticas, mejorar la fluidez. Estas tacticas pueden ayudar, pero solo si tu pagina ya esta entre las fuentes que el modelo recupera.

Lo que la investigacion de 2026 sugiere es que los dos factores mas importantes estan fuera de tu control directo:

  1. Relevancia topica. Que tu contenido sea la mejor respuesta para la consulta. Esto es SEO clasico: topical authority, contenido comprehensivo, senales de entidad claras.

  2. Asociaciones externas. Que otros sitios te mencionen junto al tema relevante. El experimento de Search Engine Land en septiembre 2026 encontro que el 85.8% de las citaciones venian de listicles de terceros, no de contenido propio.

Esto conecta directamente con lo que Google publico en su guia oficial de GEO: la optimizacion para busqueda AI sigue siendo SEO, con un layer adicional de extractabilidad y datos estructurados.

El Framework de los Tres Trabajos

En Mintec (framework detallado) ya venimos diciendo que la busqueda AI tiene tres jobs separados que la mayoria mezcla:

  1. Retrieval. Que el motor te encuentre. Esto es crawlabilidad, indexacion, estructura del sitio.
  2. Citation. Que el motor te cite en la respuesta. Esto depende de evidencia, autoridad, y asociaciones externas.
  3. Conversion. Que el clic que llega convierta. Esto es experiencia de pagina, propuesta de valor clara.

El paper de GEO solo mide el job 2, y solo dentro de un escenario donde el job 1 ya esta resuelto.

Que hacer con esta informacion

Si una agencia te promete "40% mas de visibilidad en AI" basandose en el paper de Princeton, preguntale:

  • Ese 40% es trafico o position-adjusted word count?
  • El paper testea reescritura de contenido o tambien retrieval y ranking?
  • Que pasa cuando la fuente ya esta en primera posicion?

Las tacticas del paper (agregar evidencia, citas, estadisticas) funcionan como capa sobre un foundation solido. Pero si tu sitio no rankea bien organicamente, no tiene autoridad topical, y nadie te menciona externamente, reescribir texto no te va a poner en las AI Overviews.

Para una auditoria real de tu visibilidad en busqueda AI, mira nuestra guia de auditoria GEO en 30 minutos y las metricas que realmente importan para medir GEO.

Las preguntas que importan

Es GEO una disciplina separada de SEO? Google dice que no, y los papers de 2026 confirman que las optimizaciones de contenido solo funcionan dentro de un pipeline que incluye retrieval clasico.

Necesitas herramientas especiales de GEO? El paper no testea herramientas. Las herramientas que Mintec usa son las mismas que para SEO: Search Console, analytics, crawlers.

Que es lo que realmente mueve la aguja? Contenido que responde preguntas directamente, autoridad topical construida, y menciones de terceros. El paper lo confirmo sin proponerlo: las fuentes con mejor posicion en el listado original son las que mas citan. El ranking importa mas que la reescritura.

Preguntas Frecuentes

Que es el paper de GEO original?

Es el paper 'GEO: Generative Engine Optimization' de investigadores de Princeton y Georgia Tech, publicado en KDD 2024. Introdujo el termino GEO y midio como ciertos cambios de contenido afectan la visibilidad en respuestas generadas por AI.

El 40% de mejora es trafico real?

No. El 40% es una ganancia en position-adjusted word count, una metrica que cuenta cuantas palabras en la respuesta de AI se atribuyen a una fuente. No es trafico, no son clics, no es ranking en Google. El paper dice explicitamente que no evaluo como afecta a los rankings.

Que dicen los papers de 2026 sobre GEO?

SAGEO Arena (KDD 2026) encontro que las optimizaciones de GEO pueden degradar la visibilidad cuando se incluyen etapas de retrieval y reranking. What Gets Cited (SIGIR 2026) encontro que la relevancia topica y la posicion en la lista son los drivers mas fuertes de citacion, no el formato del contenido.

Artículos Relacionados