Respuesta breve
Las etiquetas parecen decoración hasta que alguien las cuenta. En un periodo de referencia cerrado de 207 publicaciones, los registros de VJOURNAL llevan 46 etiquetas de sección distintas y 20 cadenas de región distintas, que el sitio aplana después en 10 secciones y 4 mesas. Esto es lo que sobrevive al aplanamiento, y lo que le hace al lector que cambia de idioma.
Archivar no es decorar
Dos campos de cada registro de VJOURNAL deciden dónde puede encontrarse una historia. La sección alimenta los hubs temáticos, que seleccionan publicaciones comparando exactamente la sección del artículo con la del tema. La región alimenta los hubs de mesa, filtrados por coincidencia exacta con un código de región. Los dos campos alimentan además el selector de artículos relacionados, que ofrece al lector un segundo texto cuando su región o su sección coinciden con las del que ya está leyendo. Un hub sin publicaciones para un idioma se sirve con noindex, y su grupo de hreflang se recorta a los idiomas que sí tienen contenido. Una etiqueta es, por tanto, una decisión de enrutado, de enlazado interno y de indexación a la vez.
Esta auditoría cubre un periodo de referencia cerrado: todas las publicaciones de data/generated-journal-posts.js — el fichero en el que escribe la vía de publicación automatizada de la redacción — con fecha del 20 de julio de 2026 o anterior. Son 207 publicaciones, exactamente 69 en inglés, 69 en ruso y 69 en español, repartidas en 22 días del 29 de junio al 20 de julio. Filtrar el fichero del corpus por esa fecha reconstruye el mismo conjunto, así que cualquier recuento de aquí puede repetirse. Nada publicado después entra en la cuenta, ni tampoco los ficheros curados y localizados que el sitio también sirve.
Cuarenta y seis etiquetas para 207 publicaciones
La redacción escribió 46 cadenas de sección distintas en esos 207 registros. Veinticinco se usan exactamente una vez. Solo la edición inglesa gasta 28 etiquetas en 69 publicaciones. La mayor es Top News, con 66 publicaciones — 67 si se une la variante escrita con guion —, seguida de Global Desk con 21, Business & Strategy con 18, Business con 12 y Business Strategy con 11. Veintisiete de las 46 etiquetas contienen una palabra que significa negocio en alguno de los tres idiomas, y entre esas 27 cargan 82 publicaciones bajo nombres tan próximos entre sí como Business Strategy, Global Business Strategy, Geopolitical Business Strategy y Geopolitics & Business Strategy.
La región es el mismo cuadro en un marco más pequeño: 20 cadenas distintas para un solo archivo. Estados Unidos aparece escrito de cinco maneras — US, USA, United States, Estados Unidos y US, California — con North America y USA, Global al lado. La propia palabra Global figura en dos grafías: 140 registros con mayúscula y 18 sin ella. Nada de esto es un error en el sentido de ser falso. Es un sistema de archivo sin vocabulario, que es otro problema y peor.
Qué hace el sitio con ellas
Nada llega al lector tal como se escribió, porque el corpus se normaliza a la salida. El sitio reconoce 12 secciones y 8 mesas regionales. Dos tablas de alias mantenidas a mano traducen lo que produjo el generador a algo enrutable: 57 alias de sección y 34 de región. Lo que no encaja cae en un valor por defecto — World News para la sección, Global para la región — y, fuera de producción, imprime un aviso con el valor que no pudo asignar.
Tras esa pasada, las 46 etiquetas del periodo se resuelven en 10 secciones: Business 81, Top News 69, World News 25, Marketing 7, Style 6, Beauty 6, Innovation 4, Travel 3, Design 3 y AI 3. Dos de las doce secciones del sitio, Company News y People, no reciben absolutamente nada. Ninguna sección del periodo cae en el valor por defecto, lo que suena a resultado limpio y es en realidad el hallazgo. La tabla de alias es más larga que la lista de etiquetas a la que sirve porque se ha ido ampliando a mano, entrada por entrada, cada vez que el generador se inventaba un nombre. La taxonomía no se gobierna donde se escriben las historias: se parchea aguas abajo, a posteriori, por quien se da cuenta.
Tres cuartas partes del archivo no dicen dónde
Las regiones sí caen. De las 207 publicaciones, 27 llevan una cadena de región que la tabla de alias no reconoce y se sirven como Global. Dieciocho de ellas son el global en minúscula, a un solo carácter del código que habría coincidido. Las nueve restantes nombran un lugar real sin mesa detrás: tres dicen United Kingdom o UK, dos dicen Asia Pacific o APAC, y cuatro dicen LATAM, América o América Latina. Esas nueve son las que conviene mirar: una historia que sabía dónde estaba, archivada en ninguna parte.
El mapa servido del periodo es lo bastante corto como para leerlo entero: Global 167 publicaciones, USA 28, Dubai 11, Russia 1. Cuatro de las ocho mesas del sitio — Spain, Japan, China e India — no reciben nada de este periodo. Global cubre el 80,7 por ciento del archivo, y ningún lector debería leer eso como una afirmación de alcance. Es lo que dice el registro cuando el registro no dice un lugar.
La misma historia, archivada de tres maneras
Las 180 publicaciones de la serie de archivo de un solo editor son 60 historias en tres idiomas, y se pueden emparejar entre ediciones sin conjeturas: cada una de esas 60 URL de origen aparece en exactamente tres publicaciones, una por idioma. Eso hace que la comparación sea exacta y no inferida.
Tal como se escribieron, las tres ediciones coinciden en la sección en 9 de 60 historias y en la región en 22 de 60. Tras la normalización del propio sitio, la coincidencia de sección sube a 19 de 60 y la de región a 40 de 60. Es decir, en la versión que el lector recibe de verdad, 41 de 60 historias quedan en una sección distinta según el idioma en que se lean, y 20 de 60 quedan en una mesa distinta. Veintidós historias son Business en un idioma y Top News en otro. Ocho consiguen reunir las tres — Business, Top News y World News — en sus propias tres ediciones. Una historia construida a partir de un único artículo de Time es Business en inglés y Top News tanto en ruso como en español; otra es World News en inglés y español y Business en ruso.
La consecuencia no es cosmética. Como los hubs temáticos filtran por la sección servida y los de mesa por la región servida, las tres ediciones de una misma historia aparecen en hubs distintos, reúnen enlaces relacionados distintos y pueden ser indexables en un idioma y no existir en la página equivalente de otro. Nadie decidió nada de esto. Es la aritmética de tres elecciones de etiqueta independientes chocando con una sola tabla de alias.
Las veintisiete que mantienen la línea
Las 27 publicaciones salidas por la vía actual se comportan de otra manera. Entre todas usan siete etiquetas — AI, Beauty, Design, Innovation, Marketing, Style y Travel — y no comparten ni una sola con las 39 que empleó la serie de archivo. Sus nueve historias coinciden en sección y en región en las tres ediciones, sin excepción. Las nueve están archivadas como Global, lo que para historias sobre marcas internacionales es al menos defendible y, sobre todo, es la misma respuesta en los tres idiomas.
Un corpus, dos sistemas de archivo y ni una palabra en común entre ellos. Lo que los separa no es el idioma ni el tema. Es qué vía de publicación escribió el registro.
La imagen que nadie eligió
Otra consecuencia muestra hasta dónde viaja una etiqueta. De las 207 publicaciones, 180 no guardan portada alguna; solo la llevan las 27 con fuentes, nueve imágenes compartidas por tres ediciones cada una. Para todo lo demás, el sitio elige la ilustración en el momento de servir: calcula un hash de la cadena formada por sección, región y slug, y toma el resto de dividir ese hash entre el número de imágenes de la biblioteca correspondiente.
La imagen del 87 por ciento de este periodo la eligió, por tanto, una función aritmética de los dos campos de los que trata este artículo. Como el hash es determinista, una historia mal archivada no recibe una ilustración aleatoria: recibe la misma ilustración equivocada en cada compilación y en cada idioma, hasta que cambie la etiqueta.
Lo que un recuento de etiquetas no puede decir
Esta auditoría cuenta etiquetas, y las etiquetas son autodeclaradas. El campo de región es una cadena escrita en un registro, no un dateline: no significa que nadie estuviera en ese país, y nada de lo aquí dicho debe leerse como si lo afirmara. Global es a menudo la respuesta honesta. Tampoco mide nada de esto si el periodismo era bueno: un archivo impecablemente ordenado de textos flojos daría exactamente las mismas cifras, y una auditoría de taxonomía no sustituye a leer el trabajo.
Dos límites estructurales acotan la comparación. Las cifras entre ediciones cubren solo las 60 historias cuyas tres versiones comparten URL de origen; en el resto del corpus las ediciones no se pueden enlazar con fiabilidad, porque solo 27 de las 207 publicaciones tienen storyKey y los slugs traducidos rompen el método mecánico de reserva. Ninguna afirmación sobre archivado divergente se extiende más allá de esas 60. Y el periodo de referencia se cierra el 20 de julio de 2026 dentro de un único fichero de corpus, de modo que estas cifras describen un conjunto definido de registros y no el archivo vivo.
Menos etiquetas, no más
Cuando un sistema de archivo falla, el instinto es añadir una etiqueta para el caso que se escapó. Este archivo es el argumento contra ese instinto. Cuarenta y seis etiquetas produjeron una cobertura menos localizable que las diez en las que acabaron aplanadas, y el aplanamiento hubo que hacerlo dos veces: una con una tabla de alias mantenida a mano y otra con un valor por defecto que absorbe en silencio lo que la tabla no atrapó. Cada etiqueta añadida aguas arriba compra una obligación de mantenimiento aguas abajo, y la paga alguien que no estaba en la sala cuando se escribió la historia.
La cifra que merece seguimiento es la que mide acuerdo y no volumen: 19 de 60 historias archivadas hoy igual en los tres idiomas. No se mejora publicando más. Solo se mueve cuando las tres ediciones de una historia se archivan una vez y juntas, en el momento de crearla, que es además el único momento en que alguien sabe de qué va. Para que conste: este artículo está archivado en Business y Global, dos valores que el sitio ya reconoce, porque un texto sobre proliferación de etiquetas no tiene por qué inventar la número cuarenta y siete.
Preguntas frecuentes
¿Por qué el mismo artículo aparece en una sección distinta en cada idioma?
Porque cada edición idiomática de una historia se etiqueta por separado y nada concilia las tres. En el archivo de VJOURNAL hay 60 historias en inglés, ruso y español, y tras la normalización del sitio solo 19 están archivadas en la misma sección en las tres; otras 20 caen además en mesas regionales distintas. El sitio nunca compara las ediciones, así que tres elecciones de etiqueta separadas sobreviven en tres conjuntos separados de hubs y de enlaces relacionados.
¿Cuántas secciones debería tener realmente una web de noticias?
No hay una cifra universal, pero este archivo pone precio a superar la propia. El sitio de VJOURNAL enruta 12 secciones y 8 mesas regionales; los registros de la redacción contenían 46 cadenas de sección y 20 de región para 207 publicaciones, con 25 etiquetas usadas una sola vez. Todo lo que excedía el conjunto enrutable tuvo que absorberlo una tabla de 57 alias, y dos de las doce secciones terminaron el periodo vacías.
¿Qué ocurre con una historia cuya región no coincide con ninguna página regional?
Se sirve como Global. El normalizador de VJOURNAL compara la cadena guardada con ocho códigos de región y una tabla de alias, y lo que no coincide toma el valor por defecto, con un aviso en compilación fuera de producción. En este periodo eso alcanzó a 27 de 207 publicaciones: 18 eran la grafía en minúscula de global y nueve nombraban un lugar real — Reino Unido, Asia-Pacífico, América Latina — que no tiene mesa donde archivarse.
¿Una etiqueta Global significa que VJOURNAL tiene corresponsales en esos países?
No, y una etiqueta de país tampoco. El campo de región son metadatos escritos en un registro; no es un dateline ni describe dónde estaba nadie. Las firmas de VJOURNAL son mesas editoriales y no personas, y el 80,7 por ciento de este periodo está archivado como Global, que es lo que dice el registro cuando no nombra un lugar.
¿Cómo se auditan las secciones de tu propia web?
Tres pasadas, todas baratas. Cuenta las cadenas de etiqueta distintas de tus registros y compara ese número con las etiquetas que tus rutas saben servir de verdad. Pasa los registros por tu propio normalizador y mira qué secciones enrutables quedan vacías y qué valores acaban en el valor por defecto. Después, si publicas en más de un idioma, enlaza las ediciones de cada historia con una clave estable y cuenta cuántas están archivadas igual. Las respuestas de VJOURNAL fueron 46 frente a 12, dos secciones vacías y 19 de 60.

