VJOURNAL

БизнесГлобальная редакция09 августа 2026 г.

Помечено русским, написано по-английски: разбор второй редакции VJOURNAL

Выходить на трёх языках легко объявить и неудобно проверить. Мы прогнали по русскому изданию VJOURNAL самый грубый из возможных тестов — есть ли в этой фразе хоть один кириллический символ? — и 2097 строк из 3852 ответили «нет».

Политический глобус на деревянном столе в комнате с тёплым светом, к камере повёрнуты Европа, Африка и Азия
Выходить на трёх языках легко объявить и неудобно проверить. Мы прогнали по русскому изданию VJOURNAL самый грубый из возможных тестов — есть ли в этой фразе хоть один кириллический символ? — и 2097 строк из 3852 ответили «нет».

Поле локали — это утверждение, а не описание

У каждой записи в архиве есть локаль. Когда там стоит ru, срабатывает цепочка следствий: материал уходит под /ru/journal, попадает в счёт русского издания, получает русскую подпись, его время чтения печатается с русским суффиксом, и он включается в кластер hreflang, который сообщает поисковым системам: вот русская версия текста.

Ничто из этого не описывает сам текст. Это утверждение о тексте, сделанное полем. Документация Google о локализованных версиях страниц проводит эту границу прямо: там сказано, что ни hreflang, ни HTML-атрибут lang не используются для определения языка страницы и что язык определяется алгоритмически. Метка — для нас. Читают слова.

Ничто в этом репозитории не проверяет, совпадают ли одно с другим. Публикационный фильтр shouldNoindexJournalPost в data/journal-data.js читает заголовок, SEO-заголовок, описание, лид, ключевые слова и теги и сверяет их со списком из девяти буквальных строк — среди них «lorem ipsum». Языка в этом списке нет. Ни один тест в наборе не утверждает, что русский материал написан по-русски.

Мы написали недостающую проверку и запустили её на себе.

Тест и что он вернул

Для каждого из 74 материалов с локалью ru в data/generated-journal-posts.js мы собрали все текстовые строки от трёх слов и длиннее: заголовок, SEO-заголовок, SEO-описание, лид, альтернативный текст обложки, призыв к действию, каждый заголовок раздела, каждый абзац, каждый заголовок и абзац подсекции, оба поля каждого элемента FAQ, каждый тезис и каждый пункт чек-листа.

Строка помечается, если в ней есть хотя бы одна латинская буква и ни одного кириллического символа.

Это правило не может дать ложное срабатывание на настоящем русском тексте, потому что в настоящем русском тексте есть кириллица. Ошибочно помечены могли бы быть только русские фразы, целиком записанные латиницей, — таких в архиве нет. Зато правило легко недосчитывает в другую сторону: абзац из сорока английских слов и одного русского проходит как чистый. Поэтому все числа ниже — нижняя граница, а не верхняя.

По всему русскому изданию 2097 из 3852 текстовых строк не содержат кириллицы вовсе. Это 54,44 процента всего, что издание говорит.

На уровне целых материалов: затронуты 43 из 74. Тридцать девять — на сто процентов: каждая проверенная строка, от заголовка до последнего пункта чек-листа, приходит без кириллицы. Ещё один — на 97,2 процента: 69 строк из 71. Оставшиеся три задеты слегка: две строки из 33, три из 56, две из 53. Середины почти нет. Русский материал в этом архиве либо целиком русский, либо целиком нет.

Если считать не строками, а словами текста, то 29 441 слово издания из 60 099 находится в абзацах без единого кириллического символа — 48,99 процента. Чуть меньше половины прозы русского издания по объёму написано по-английски.

Это попадает в то, что читатель видит первым

Проблема не спрятана в десятом абзаце. Она сосредоточена ровно в тех полях, которые читатель, карточка и поисковая выдача видят раньше всего остального.

Из 74 русских материалов у 42 английский заголовок. У 41 — английский SEO-заголовок. У 40 — английское SEO-описание. У 40 — английский лид. У 42 английский альтернативный текст обложки, а именно его озвучивает экранный диктор. У 40 есть хотя бы один английский заголовок раздела, у 40 — хотя бы один английский вопрос в FAQ, у 40 — хотя бы один английский пункт чек-листа.

Списки ключевых слов рассказывают то же самое, но с готовым контролем внутри. У 43 затронутых материалов 377 ключевых фраз из 397 — 95,0 процента — не содержат кириллицы. У 31 чистого материала это 16 из 266, то есть 6,0 процента. Латиница в русском списке ключей сама по себе не ошибка: названия брендов латинские, и эти 6 процентов — как раз они. Доказательством служит контраст между 95 и 6, а не сама по себе цифра.

Это не сорвавшийся перевод

Интуитивное объяснение: шаг перевода пропустили, и английский оригинал остался на месте. Данные его не подтверждают.

Из 39 полностью английских русских материалов лишь у 8 есть английский двойник на том же базовом слаге, если убрать один ведущий префикс en-, ru- или es-. Ни один из этих восьми не совпадает с двойником по заголовку. По всему русскому изданию только 14 текстовых строк совпадают со строкой из какого-либо английского материала после сведения регистра и пунктуации, и разбросаны они по 11 материалам.

Иначе говоря, это не английские статьи из английского издания, лежащие не в той папке. Это другие английские статьи, написанные по-английски и оформленные как русское издание. Читатель, переключивший язык, видит не непереведённую версию того текста, который он читал, а другой текст, тоже по-английски.

Для починки это различие принципиально. Пропущенный шаг перевода можно перезапустить. Материал, порождённый не на том языке, придётся заказывать заново.

У дефекта есть границы, и границы — это хорошая новость

Обнаружились две границы, которых мы не искали.

Первая — дата. У всех 43 затронутых материалов publishedAt лежит между 2026-06-29 и 2026-07-11. Из 60 русских материалов с датой 2026-07-11 или раньше затронуты 43; из 14 с более поздней датой — ни одного. Чистые материалы идут с 2026-07-01 по 2026-08-09, то есть группы пересекаются во времени, а не лежат в разных эпохах, — но ничто, вышедшее после 11 июля, тест не провалило.

Вторая — подпись. Все 43 несут авторскую строку VITON13 Editorial (ru). Эта подпись стоит всего на 60 русских материалах, так что 17 её собственных материалов чисты. Четыре другие русские подписи в файле — VJOURNAL Editorial на 4 материалах, «Редакция VJOURNAL» на 5, VITON13 Editorial Intelligence на 4 и «Редакция VITON13» на 1 — чисты без исключений: 0 из 14.

У всех 43 статус Published. Ни один не придержали и ни один не пометили.

Дефект с границами — это прогон, а не политика. Что-то изменилось примерно во вторую неделю июля, и русское издание стало выходить по-русски. Этот аудит не может сказать, что именно изменилось, — только то, что изменение видно в данных, а к предыдущему прогону никто не возвращался.

Испанское издание — насколько тот же метод до него дотягивается

Тест на кириллицу не переносится на испанский: у него общий алфавит с английским. Ближайшая доступная замена — другой вопрос: совпадает ли эта испанская строка после сведения регистра и пунктуации со строкой из какого-нибудь английского материала?

Совпадают шесть. Они разбросаны по 5 из 74 испанских материалов: три вопроса FAQ, два заголовка разделов и один SEO-заголовок. Ни один испанский заголовок не совпадает с английским.

Этот тест слабее кириллического вполне определённым образом, и об этом стоит сказать прямо, а не замять. Он ловит только английский текст, скопированный из английского материала в том же файле. Английская проза, написанная сразу в испанскую запись и не имеющая нигде близнеца, пройдёт его незамеченной. Поэтому честное утверждение узкое: при самом сильном тесте, который мы смогли применить к испанскому, картина, похожая на русскую, не появилась. Мы не утверждаем, что испанское издание чистое. Мы сообщаем, что того же дефекта не нашли — методом, которому это было бы трудно.

Подпись говорила об этом всё это время

Первичный датасет VJOURNAL, собранный 12 августа 2026 года по срезу того же файла из 207 материалов, перечисляет для всего архива шесть авторских строк: VITON13 Editorial на 60 материалах, VITON13 Editorial (es) на 60, VITON13 Editorial (ru) на 60, VJOURNAL Editorial на 17, Redacción VJOURNAL на 5 и «Редакция VJOURNAL» на 5.

Посмотрите на форму третьей. VITON13 Editorial (ru) — это не название деска. Это английское название деска с прикрученным в скобках языковым кодом: метка локали, переодетая в подпись. Две из шести авторских строк — настоящие русское и испанское названия десков; ещё две — английское название с суффиксом.

Дальше идёт собственное прочтение VJOURNAL, а не факт из данных: там, где конвейер обращается с языком как с форматирующим суффиксом при имени, не удивительно обнаружить, что он обращается с этим языком как с форматирующим суффиксом и при статье. Подпись, стоящая на всех 43 непереведённых материалах, — это подпись, которую тоже толком не перевели.

Чего скрипт сказать не может

Он не судит о качестве перевода. Тридцать один чистый русский материал проходит проверку на наличие кириллических символов — планка запредельно низкая. Читаются ли они как русский текст, написанный для русского читателя, или как английские фразы, надевшие русские слова, этот метод ответить структурно не в силах, и мы здесь на это не отвечаем.

Он не говорит, заметил ли кто-нибудь. В репозитории нет ни одного события аналитики, фиксирующего языковое несовпадение, отказ или время на странице по этим материалам. Мы посчитали опубликованное, а не пережитое.

Он не называет причину. Мы не читали логи конвейера и не приписываем прогон конкретной задаче генерации или вызову модели. Граница по дате и граница по подписи — это наблюдения над записями, а не реконструкция событий.

И он измеряет один файл. data/generated-journal-posts.js — лишь один из нескольких источников, которые сливаются в архив, отдаваемый сайтом; курируемые и десковые материалы лежат в другом месте и в этот подсчёт не входили. Проверены те 74 русских материала, которые были в этом файле в день аудита.

Два честных выхода и один нечестный

Защитимых ответов ровно два. Перевести 43 материала как следует — или перемаркировать их: перенести в английское издание, снять локаль ru, снять русскую подпись и позволить им быть тем, что они есть. Оба варианта честны.

Третий путь — оставить английскую прозу под локалью ru с русской подписью, русским суффиксом времени чтения и тегом hreflang, который сообщает поисковым системам, что это русская версия, — единственный, где содержится утверждение, о ложности которого мы уже знаем. И именно он остаётся положением дел, пока по этому разбору никто ничего не сделает.

Сама проверка тривиальна. Правило из начала этого материала — одно регулярное выражение. Тест, утверждающий, что у каждого материала с локалью ru в заголовке есть хотя бы один кириллический символ, упал бы на 42 материалах в день их написания и обошёлся бы дешевле, чем этот абзац.

Причина, по которой это не поймали, — не в тонкости дефекта. Сорок два английских заголовка в русском издании тонкими не назовёшь. Причина в том, что никто не напечатал число. Вот оно напечатано.

Вопросы и ответы

Как понять, что многоязычный сайт действительно переведён?

Проверяйте текст, а не теги. Для языка с собственной письменностью проверка укладывается в одну строку: убедиться, что в каждой выводимой строке есть хотя бы один символ нужного алфавита. Для языков с общим алфавитом сравнивайте каждую строку с соответствующей строкой на исходном языке и помечайте точные совпадения. Первый тест на русском издании VJOURNAL пометил 2097 текстовых строк из 3852 в 43 материалах из 74.

Сообщает ли hreflang поисковику, на каком языке написана страница?

Нет. В документации Google о локализованных версиях сказано, что ни hreflang, ни HTML-атрибут lang не используются для определения языка страницы и что язык определяется алгоритмически. Эти аннотации описывают, как версии связаны между собой, но не удостоверяют содержимое. Страница может быть помечена как русская версия и читаться как английская — именно это аудит и обнаружил на 43 материалах.

Какая доля русского издания VJOURNAL действительно на русском?

По строкам — 45,56 процента: кириллица есть в 1755 из 3852 текстовых строк. По числу слов текста — 51,01 процента: 30 658 русских слов против 29 441 в абзацах без единого кириллического символа. По целым материалам чисты 31 из 74. Тридцать девять английские от заголовка до чек-листа, один английский на 97 процентов, ещё три несут по нескольку английских строк.

Почему материал в русском разделе оказывается написан по-английски?

В данном случае это не сорвавшийся перевод. Лишь у 8 из 39 полностью английских русских материалов есть двойник в английском издании на том же базовом слаге, и ни один из этих восьми не совпадает с ним по заголовку, — значит, текст не переносили из английской редакции. Похоже, материалы были порождены по-английски и сразу оформлены под русскую локаль. Все 43 несут одну подпись и вышли в пределах двух недель.

Какая проверка на пропущенный перевод самая дешёвая?

Утверждение о наличии нужной письменности в наборе тестов, запускаемое по вашим собственным записям контента, а не по отрисованным страницам. Ему не нужны ни сеть, ни память переводов, ни рецензент. На этом архиве оно поймало бы 42 английских заголовка в день их написания. Дорого стоит не тест, а публикация числа после того, как тест начал падать.