Réponse en bref
L'audit du 9 août de VJOURNAL a révélé que 43 postes russes-locals avaient été affectés. Une nouvelle édition du 14 août n'affiche plus de page essentiellement non russe et aucune URL indexable affectée.
Mise à jour le 14 août 2026 : le défaut n'est plus le statu quo
Cet article a commencé par un instantané du 9 août de 74 enregistrements russo-locales dans data/generated-journal-posts.js. Ce résultat historique demeure en dessous, de sorte que le défaut, la méthode et le dossier de réhabilitation ne sont pas réécrits après coup. Il ne doit pas être lu comme une description des archives en direct le 14 août.
Le corpus effectif actuel contient 234 pages en russe. Dans un contrôle de prédominance au niveau des pages qui rejoint le titre, les champs SEO, l'extrait et le corps, puis divise les lettres cyrilliques par toutes les lettres Unicode, zéro de 234 pages tombe à ou en dessous du seuil de défaillance de 45 %. En d'autres termes, chaque page russe actuelle est principalement russe par ce test déclaré.
Le contrôle de niveau de chaîne plus strict trouve encore 18 chaînes sans cyrillique parmi 9 439 chaînes de trois mots ou plus, réparties sur 18 de 234 pages. Ces restes sont principalement des champs anglais CTA ou cover-alt sur les enregistrements noindex: zéro des 27 pages de russe indexées sont affectées et zéro page est entièrement en anglais. Les deux chiffres répondent à des questions différentes, de sorte que cette mise à jour signale à la fois au lieu de les comprimer en un zéro unique trompeur.
Les tests de publication et de localisation protègent maintenant les enregistrements plus récents, tandis que les URL héritées faibles sont exclues des archives publiques, RSS, plan du site et hreflang recommandations jusqu'à ce qu'ils passent la porte éditoriale. Les 18 cordes restantes sont une file d'attente de nettoyage, pas la preuve que l'état initial de 43-de-74 continue.
Un champ local est une revendication, pas une description
Chaque enregistrement de cette archive porte un local. Quand il lit ru, une chaîne de conséquences brûle: l'histoire est acheminée sous /ru/journal, il est compté dans l'édition russe, il reçoit un byline russe, son temps de lecture est imprimé avec un suffixe russe, et il est câblé dans un groupe hreflang qui dit aux moteurs de recherche que c'est la version russe de la pièce.
Rien de tout cela n'est une description du texte. C'est une affirmation sur le texte, faite par un champ. La documentation de Google sur les versions localisées est claire sur la différence: il indique que ni hreflang ni l'attribut HTML lang ne sont utilisés pour détecter la langue d'une page, et que la langue est déterminée par algorithme à la place. Le label est pour nous. Les mots sont ce qui se lit.
Rien dans ce dépôt ne vérifie si les deux sont d'accord. La porte de publication, shouldNoindexJournalPost in data/journal-data.js, lit le titre, le titre du référencement, la description, l'extrait, les mots-clés et les balises, et les compare à une liste de neuf chaînes littérales — lorem ipsum est l'une d'entre elles. Le langage n'est pas parmi les choses qu'il regarde. Aucun test dans la suite affirme qu'un poste russe est en russe.
Nous avons donc écrit le chèque qui n'existait pas et nous l'avons lancé sur nous-mêmes.
Le test, et ce qu'il a rendu
Pour chacun des 74 postes russo-locales dans des postes de données et de journaux générés. js nous avons recueilli chaque chaîne de prose de trois mots ou plus: le titre, le titre du référencement, la description du référencement, l'extrait, le texte de couverture, le résumé de la CTA, chaque rubrique du corps, chaque paragraphe du corps, chaque rubrique et paragraphe de sous, les deux champs de chaque entrée FAQ, chaque point de résumé et chaque élément de liste de contrôle.
Une chaîne est marquée lorsqu'elle contient au moins une lettre latine et non un seul caractère cyrillique.
Cette règle ne peut produire un faux positif contre la vraie prose russe, car la vraie prose russe contient du cyrillique. Les seules cordes qu'il pourrait à tort drapeau sont les phrases russes écrites entièrement en translittération latine, et l'archive ne contient aucune. Il sera heureux de sous-estimer dans l'autre direction: un paragraphe portant quarante mots anglais et un russe passe propre. Chaque numéro ci-dessous est donc un plancher, pas un plafond.
Dans l'édition russe, 2 097 des 3 852 cordes de prose ne contiennent aucun cyrillique. Cela représente 54,44 % de tout ce que dit l'édition.
Au niveau de l'ensemble des articles: 43 des 74 postes russes sont affectés. Trente-neuf d'entre eux sont à cent pour cent — chaque corde testée, du titre au dernier élément de liste de contrôle, revient sans cyrillique. Une autre place à 97,2 %, avec 69 de ses 71 cordes en anglais. Les trois autres sont légèrement touchés : deux cordes de 33, trois de 56, deux de 53. Il n'y a presque pas de milieu. Un message russe dans cette archive est soit entièrement russe ou totalement pas.
Compte tenu des mots du corps plutôt que des cordes, 29 441 des 60 099 mots de l'édition sont inscrits dans des paragraphes sans cyrillique — 48,99 %. Un peu moins de la moitié de la prose de l'édition russe, en volume, est anglaise.
Il atterrit sur les parties que le lecteur rencontre en premier
Les dommages ne sont pas enterrés dans le dixième paragraphe. Il est concentré dans exactement les champs qu'un lecteur, une carte et un résultat de recherche voir avant tout autre chose.
Sur les 74 postes russes, 42 ont un titre anglais. Quarante et un ont un titre de référencement anglais. Quarante ont une description de référencement anglais. Quarante ont un extrait en anglais. Quarante-deux ont une couverture en anglais, c'est ce qu'un lecteur d'écran annonce. Quarante portent au moins une tête de corps en anglais, 40 au moins une question FAQ en anglais et 40 au moins une liste de contrôle en anglais.
Les listes de mots clés racontent la même histoire avec un contrôle utile intégré. Sur les 43 postes concernés, 377 des 397 mots clés — 95,0 % — ne contiennent pas de cyrillique. Sur les 31 postes propres, 16 sur 266, soit 6,0 %. Les caractères latins d'une liste de mots clés russe ne se trompent pas par eux-mêmes; les noms de marque sont latins, et c'est ce qu'est le 6%. Le contraste entre 95 et 6 est la preuve, et non le nombre brut.
Ce ne sont pas des traductions qui ont échoué
L'explication intuitive est qu'une étape de traduction a été sautée et l'original anglais a été laissé en place. Les données ne le supportent pas.
Sur les 39 postes de russe entièrement anglais, seulement 8 ont une fratrie anglaise-locale sur la même limace de base une fois qu'un seul préfixe en-, ru- ou es- est supprimé. Aucune de ces huit personnes ne partage un titre avec sa sœur. Dans toute l'édition russe, seulement 14 cordes de prose correspondent à une chaîne de n'importe quel post anglais après le cas et le pliage de ponctuation, réparties sur 11 poteaux.
En d'autres termes, ce ne sont pas les articles anglais de l'édition anglaise assis dans le mauvais dossier. Il s'agit de différents articles en anglais, rédigés en anglais, classés en tant qu'édition russe. Un lecteur qui change de langue ne voit pas une version non traduite de l'histoire qu'il lisait. On leur montre une autre histoire, aussi en anglais.
Cette distinction est importante pour la correction. Une étape de traduction manquante peut être relancée. Le contenu généré dans la mauvaise langue doit être commandé à nouveau.
Le défaut a des bords, et les bords sont la bonne nouvelle
Deux frontières sont apparues que nous ne cherchions pas.
Le premier est un rendez-vous. Chacun des 43 postes touchés porte un A publié entre 2026-06-29 et 2026-07-11. Sur les 60 postes russes datés du 2026-07-11 ou avant, 43 sont affectés; sur les 14 postes datés après, aucun ne l'est. Les messages propres vont de 2026-07-01 à 2026-08-09, de sorte que les deux groupes se chevauchent dans le temps plutôt que de siéger dans des époques distinctes — mais rien publié après le 11 juillet n'a échoué au test.
Le deuxième est un byline. Tous les 43 portent la chaîne d'auteur VITON13 Éditorial (ru). Que Byline couvre 60 postes russes au total, donc 17 de ses propres sont propres. Les quatre autres bylines russes dans le dossier — VJOURNAL Editorial avec 4 messages, Редакяия VJOURNAL avec 5, VITON13 Intelligence éditoriale avec 4 et Редакюия VITON13 avec 1 — sont propres sans exception: 0 sur 14.
Tous les 43 portent le statut Publié. Aucun n'a été retenu et aucun n'a été signalé.
Un défaut avec les bords est une course, pas une politique. Quelque chose a changé la deuxième semaine de juillet et l'édition russe a commencé à sortir en russe. Cette vérification ne peut pas dire ce qui a changé, mais seulement que le changement est visible dans les données et que la première série n'a jamais été revue.
Espagnol, jusqu'à ce que la même méthode puisse atteindre
Le test cyrillique ne passe pas en espagnol, qui partage un alphabet avec l'anglais. Le substitut le plus proche disponible est une autre question : cette chaîne espagnole est-elle identique, après le cas et la ponctuation, à une chaîne qui apparaît dans un post anglais ?
Six. Ils sont présents sur 5 des 74 messages espagnols : trois questions FAQ, deux titres et un titre de référencement. Aucun titre espagnol ne correspond à un titre anglais.
Ce test est plus faible que celui cyrillique d'une manière spécifique, et la différence doit être indiquée plutôt que brillante. Il ne peut que capturer le texte anglais qui a été copié à partir d'un message en anglais dans ce même fichier. La prose anglaise écrite directement dans un disque espagnol, sans jumeau nulle part, le passerait invisiblement. Donc, la prétention honnête est étroite: sous le test le plus fort que nous pourrions appliquer à l'espagnol, aucun modèle ressemblant à l'échec russe est apparu. Nous n'affirmons pas que l'édition espagnole est propre. Nous rapportons que nous n'avons pas trouvé la même faute, avec une méthode qui aurait lutté.
Le Byline nous disait tout le temps
L'ensemble de données de la première partie de VJOURNAL, généré le 12 août 2026 sur un instantané 207 post du même fichier, énumère six chaînes d'auteur pour l'ensemble de l'archive : VITON13 Éditorial sur 60 postes, VITON13 Éditorial (es) sur 60, VITON13 Editorial (ru) le 60, VJOURNAL Editorial le 17, Redacción VJOURNAL le 5 et Редакюия VJOURNAL le 5.
Regardez la forme du troisième. VITON13 L'éditorial (ru) n'est pas un nom de bureau. C'est un nom de bureau anglais avec un code de langue fixé entre crochets — une étiquette locale portant les vêtements d'un byline. Deux des six chaînes d'auteur sont des noms de bureau russes et espagnols; deux sont le nom anglais avec un suffixe.
C'est la lecture propre de VJOURNAL plutôt qu'un fait que les données indiquent : lorsqu'un pipeline traite un langage comme un suffixe de formatage sur un nom, il n'est pas surprenant qu'il traite ce langage comme un suffixe de formatage sur un article. Le byline qui apparaît sur les 43 messages non traduits est le byline qui n'a jamais vraiment été traduit non plus.
Ce que le script ne peut pas vous dire
Il ne peut juger une traduction. Les 31 poteaux russes propres passent un test pour la présence de caractères cyrilliques, qui est une barre extraordinairement basse. Qu'ils lisent comme le russe écrit pour les lecteurs russes, ou comme les phrases anglaises portant des mots russes, est une question que cette méthode est structurellement incapable de répondre, et nous ne répondons pas ici.
Il ne peut pas vous dire si quelqu'un a remarqué. Il n'y a pas d'événement analytique dans ce dépôt qui enregistre une inadéquation de la langue, un rebond ou une heure sur la page contre ces messages. Nous avons compté ce qui a été publié, pas ce qui a été expérimenté.
Il ne peut pas nommer une cause. Nous n'avons pas lu les journaux de pipeline, et nous n'attribuons pas la course à un travail de génération ou à un appel de modèle spécifique. La limite de date et la limite de byline sont des observations sur les enregistrements, et non une reconstruction de ce qui s'est passé.
Et ça mesure un dossier. data/generated-journal-posts.js est l'une des nombreuses sources fusionnées dans l'archive que le site dessert; les postes sélectionnés et ensemencés de bureau vivent ailleurs et étaient en dehors de ce nombre. Les 74 postes russes audités ici sont ceux dans ce dossier le jour de l'audit.
Deux options honnêtes, et une qui n'est pas
Il y a exactement deux réponses défendables. Traduire les 43 correctement, ou les reétiqueter: les déplacer à l'édition anglaise, laisser tomber le ru locale, laisser tomber le byline russe et les laisser être ce qu'ils sont. Soit il est honnête.
La troisième voie - laissant la prose anglaise sous une ru locale, avec un byline russe, un temps de lecture suffisant en russe et une balise hreflang indiquant que les moteurs de recherche sont la version russe - est la seule option qui implique une affirmation que nous savons être faux. C'était le statu quo dans l'instantané original du 9 août; la mise à jour datée ci-dessus enregistre ce qui a changé par la suite.
Le chèque est trivial. La règle en haut de cet article est une expression régulière. Un test affirmant que chaque poste avec local ru a au moins un caractère cyrillique dans son titre aurait échoué sur 42 postes le jour où ils ont été écrits, et aurait coûté moins cher à écrire que ce paragraphe.
La raison pour laquelle il n'a jamais été pris n'est pas que l'échec était subtil. Quarante-deux titres en anglais dans une édition russe ne sont pas subtils. La raison est que personne n'avait imprimé le compte. C'est l'impression.
Questions et réponses
Comment puis-je savoir si un site Web multilingue est effectivement traduit?
Testez le texte, pas les étiquettes. Pour une langue avec son propre script, la vérification est une ligne : affirmez que chaque chaîne de caractères qu'une page rend contient au moins un caractère de ce script. Pour les langues qui partagent un alphabet, comparez chaque chaîne par rapport à la chaîne correspondante dans votre langue source et indiquez les correspondances exactes. Lors du premier test sur l'édition russe de VJOURNAL, 2 097 de 3 852 cordes de prose ont été lancées sur 43 des 74 poteaux.
Hreflang dit-il à un moteur de recherche dans quelle langue une page est écrite ?
C'est pas vrai. La documentation de Google sur les versions localisées indique qu'il n'utilise pas hreflang ou l'attribut HTML lang pour détecter la langue d'une page et détermine la langue algorithmique à la place. Ces annotations décrivent comment vos versions se rapportent les unes aux autres; elles ne certifient pas le contenu. Une page peut être étiquetée comme la version russe et être lue comme une page en anglais, ce qui est précisément la situation que cet audit a trouvée sur 43 messages.
Combien de l'édition russe de VJOURNAL est en réalité en russe ?
Par cordes, 45,56 % — 1 755 des 3 852 cordes de prose contiennent du cyrillique. Par corps, 51,01 % : 30 658 mots russes contre 29 441 dans des paragraphes sans cyrillique. Par des articles entiers, 31 des 74 poteaux sont propres. Trente-neuf d'entre eux sont en anglais, d'un côté, 97 % en anglais et trois portent une poignée de cordes anglaises chacune.
Pourquoi un article dans la section russe d'un site serait écrit en anglais ?
Dans ce cas, ce n'était pas une traduction qui a échoué. Seulement 8 des 39 postes en russe entièrement anglais ont un équivalent en édition anglaise sur la même limace de base, et aucun de ces 8 postes ne partage son titre, de sorte que le texte n'a pas été copié de l'édition anglaise. Les messages semblent avoir été générés en anglais et déposés directement dans la localité russe. Tous les 43 portent un seul byline et tous ont été publiés dans une quinzaine d'entre eux.
Quel est le test le moins cher pour les traductions manquantes sur un site?
Une assertion de présence de script dans votre suite de test, courrez contre vos propres enregistrements de contenu plutôt que vos pages rendues. Il n'a pas besoin d'accès réseau, pas de mémoire de traduction et pas d'examinateur. Sur cette archive il aurait pris 42 titres anglais le jour où ils ont été écrits. La partie coûteuse n'est pas le test — elle publie le nombre une fois que le test commence à échouer.

