Medido, no prometido
Seis cosas que puedes cambiar en una página para que una máquina la entienda mejor, cada una medida antes y después, sin conexión, sin modelo y sin red. Y, en cada una, lo que el número no demuestra.
Por qué existe esto
Casi todo lo que se escribe sobre conseguir que los motores de respuesta te citen es un porcentaje sin barra de error. «+40 % de visibilidad.» ¿Sobre cuántas ejecuciones? ¿Contra qué línea base? ¿En qué motor y qué día? El número suele llegar sin nada de eso, y no se puede comprobar.
Así que esta es la versión pequeña, aburrida y verificable. Seis intervenciones, cada una aislada en una carpeta before/ y otra after/, cada una medida por un script determinista que corre en tu portátil en menos de un segundo. Sin clave de API, sin red y sin ningún modelo de lenguaje de por medio. Ejecútalo tú y obtienes la misma cifra, byte a byte.
Los seis instrumentos
Cada uno aísla un eslabón distinto de la cadena que va de publicar una página a que una máquina pueda usarla: si se puede descargar, si se puede leer sin ejecutar JavaScript, si sus hechos se pueden tipar, si se puede trocear limpiamente, si sus entidades se pueden resolver y si sus afirmaciones se pueden rastrear hasta una fuente.
¿Puede leer tu página un rastreador que no ejecuta JavaScript?
04-technical/ssr-vs-csr-renderingpalabras visibles en el HTML servido, con renderizado en cliente frente a renderizado en servidor. El mismo artículo, unas 25,3 veces más texto.
Que ningún motor vaya a citar la versión renderizada en servidor. Demuestra visibilidad mecánica: una condición necesaria, no suficiente.
¿Puede un analizador de esquemas extraer hechos tipados de tu página?
04-technical/structured-data-jsonldhechos tipados extraídos, repartidos en 17 entidades tipadas, tras añadir un solo bloque JSON-LD al mismo artículo visible.
Que un modelo de lenguaje te cite más. 37 hechos tipados extraíbles no es 37 veces más probabilidad de ser citado. N = 2 artefactos: una página, dos variantes.
¿Pueden los rastreadores llegar al sitio, y hay un fichero curado para ellos?
04-technical/ai-crawler-accessagentes de IA permitidos en robots.txt, de los 8 probados, más 0 → 2.868 bytes de llms.txt curado.
Que 8 rastreadores permitidos signifiquen ser citado 8 veces más. Y ningún motor importante ha confirmado que lea llms.txt siquiera: Google dice explícitamente que no hace falta crearlo.
¿Sobrevive tu texto a que lo corten en fragmentos de tamaño fijo?
03-content/chunk-friendly-structurefragmentos que se sostienen solos, con un troceador recursivo de 800 caracteres. Las mismas frases; solo cambió la estructura.
Que los fragmentos autocontenidos se recuperen o se citen más. Demuestra que sobreviven intactos al troceado, que es una condición previa para poder ser citado, no una prueba de que se cite.
¿Puede una máquina saber de qué cosa del mundo real habla tu página?
05-authority/entity-clarity-sameasentidades nombradas que resuelven a un identificador canónico, tras añadir enlaces sameAs a Wikidata y Wikipedia.
Que desambiguar aumente las citaciones, ni que nada aguas abajo resuelva la entidad correctamente. Elimina la ambigüedad para un analizador estructurado. N = 5 entidades.
¿Puede un analizador rastrear cada una de tus afirmaciones hasta su fuente?
06-measurement/citation-anchoringpares afirmación → fuente que un analizador determinista puede extraer. Las mismas ocho afirmaciones en los dos documentos.
Que las fuentes sean correctas ni autorizadas: el analizador comprueba que hay una fuente enlazable junto a la afirmación, no que esa URL la respalde. Y aquí «afirmación» se operacionaliza como un elemento de lista; otras definiciones darían otros números.
Lo que nada de esto mide, y por qué importa
La pregunta obvia es si alguno de estos cambios hace que un motor te cite más. Esa pregunta es mucho más difícil de lo que parece, y la razón conviene conocerla antes de fiarse del porcentaje de nadie, incluido el propio.
Haz la misma pregunta dos veces a un motor de respuesta y te citará fuentes distintas. Un trabajo publicado en 2026 (arXiv:2604.07585) que repite consultas idénticas contra motores en vivo encuentra que el solape entre dos ejecuciones ronda un índice de Jaccard de 0,32 a 0,43 sobre las fuentes citadas dentro de un mismo día. Es decir, unas seis de cada diez fuentes cambian entre dos pasadas idénticas sin haber tocado nada.
Eso tiene una consecuencia dura para quien reporte una mejora. Con siete ejecuciones por consulta, que es el mínimo que recomienda ese trabajo, el intervalo de confianza al 95 % sobre una tasa de citación es de unos ±15,8 puntos porcentuales. No de ±5. Para un semiancho de ±5 puntos hacen falta del orden de 139 ejecuciones por consulta si la tasa ronda el 10 %, y unas 246 si ronda el 20 %, y esas cifras suponen independencia entre ejecuciones, cosa que las consultas repetidas no cumplen.
Por eso los seis experimentos de arriba se paran donde se paran. Miden propiedades de un artefacto controlado, de forma determinista y repetible, porque esa parte sí se puede medir con honestidad hoy. El salto de esas propiedades a las citaciones reales es una pregunta de investigación abierta, no una viñeta.
Ejecútalos tú
Cada cifra de esta página sale de un script de un repositorio público. Clónalo y ejecuta cualquier receta; solo necesitan Python.
git clone https://github.com/ferinazumaDEV/generative-engine-optimization-cookbook
cd generative-engine-optimization-cookbook/04-technical/ssr-vs-csr-rendering
bash reproduce.shCada carpeta de receta contiene el artefacto sin optimizar, el optimizado, las notas de medición con el método y sus limitaciones, y el script que produce el número.
- The GEO Cookbook — las seis recetas reproducibles.
- The GEO Handbook — la teoría que demuestra cada receta, con una fuente primaria detrás de cada afirmación.
Así es como trabajo. Si quieres estas seis mediciones sobre tus propias páginas, escríbeme: te mando los números, incluidos los que no se muevan.