El diagnóstico que nadie mira
Se midieron los enlaces internos del sitio, no las visitas. El resultado: de treinta y un artículos publicados, ninguno enlazaba a otro desde su cuerpo, solo tres recibían algún enlace y diecinueve estaban a tres clics de la portada, alcanzables únicamente desde la segunda o tercera página del índice.
Un buscador reparte autoridad siguiendo enlaces. Lo que solo aparece en el sitemap y en una paginación profunda recibe muy poco presupuesto de rastreo y casi nada de autoridad. No era un problema de contenido: era un problema de topología, y explicaba mucho mejor la falta de resultados que cualquier hipótesis sobre la calidad de los textos.
Relacionar por afinidad real, no por categoría.
Lo fácil habría sido agrupar por etiqueta. Se descartó: con ocho áreas y un corpus desigual, en algunas solo hay dos piezas y en otras nueve, así que la categoría no da para elegir bien.
Se calcularon vectores de todas las piezas y se eligen las más próximas, con dos refuerzos: compartir una fuente citada —afinidad demostrada, no inferida— y pertenecer a la misma área. Ninguno de los dos puede rescatar a una pieza que no llegue al umbral: si no se parece, no entra aunque cite el mismo paper.
Del cuerpo del artículo se excluye la bibliografía antes de vectorizar. Todas estas piezas citan trabajos de arXiv con la misma forma, y dejarla dentro habría acercado artículos de temas opuestos por el vocabulario de sus citas.
Se puso a ojo. Se corrigió con datos.
El primer umbral se fijó en 0,45 por intuición. Después se midieron los 465 pares posibles del corpus:
| mediana | |
|---|---|
| pares de la misma área | 0,682 |
| pares de áreas distintas | 0,456 |
Es decir: 0,45 caía justo sobre la mediana de los pares no relacionados. Habría dejado pasar la mitad del ruido. Barriendo valores contra el corpus real, 0,55 recorta los pares entre áreas distintas de 410 a 70 —un 83 % menos— y solo deja corto a un artículo de treinta y uno.
Cada modelo de vectores tiene su propia escala. Un umbral que funciona en uno no significa nada en otro, y eso solo se descubre midiendo.
ANTES Y DESPUÉS
La misma medición, un mes después.
Un artículo sin relacionados suficientemente afines no muestra el bloque. Preferimos cuatro entradas pertinentes a seis con dos de relleno.
Lo resolvimos primero donde no cobra.
Dos semanas después se repitió la medición sobre las páginas de servicio, y salió el sesgo: cero artículos huérfanos y ocho de veintiséis servicios sin un solo enlace entrante. El problema estaba resuelto en la parte editorial y abierto justo en la comercial.
Es un patrón fácil de repetir. Se mide lo que se acaba de tocar, se ve verde, y no se vuelve a mirar el resto. La corrección fue extender el mismo motor a la otra sección — quince minutos, una vez identificado.
El sistema que hace esto en continuo es Mycelium. El diagnóstico y la corrección sobre un sitio ajeno, Agentic SEO.


