संक्षेप में जवाब
VJOURNAL के 9 अगस्त ऑडिट ने 43 रूसी-स्थानीय पदों को प्रभावित किया। 14 अगस्त को फिर से शुरू किया गया अब कोई मुख्य रूप से गैर-रूसी पेज नहीं दिखाता है और कोई प्रभावित अनुक्रमित यूआरएल नहीं है।
14 अगस्त 2026 को अद्यतन: दोष अब स्थिति नहीं है
यह लेख डेटा/generated-journal-posts.js में 74 रूसी-स्थानीय रिकॉर्डों के 9 अगस्त स्नैपशॉट के रूप में शुरू हुआ। यह ऐतिहासिक परिणाम नीचे रहता है इसलिए दोष, विधि और उपचार रिकॉर्ड इस तथ्य के बाद फिर से लिखा नहीं जाता है। इसे 14 अगस्त को लाइव संग्रह का वर्णन नहीं किया जाना चाहिए।
वर्तमान प्रभावी corpus में 234 सूचीबद्ध रूसी पृष्ठ शामिल हैं। एक पृष्ठ-स्तर की प्रबलता जांच में जो शीर्षक, एसईओ क्षेत्रों, अंश और शरीर में शामिल होता है, फिर सभी यूनिकोड अक्षरों द्वारा Cyrillic अक्षरों को विभाजित करता है, 234 पृष्ठों का शून्य 45 प्रतिशत विफलता सीमा पर या नीचे गिर जाता है। दूसरे शब्दों में, प्रत्येक वर्तमान रूसी पृष्ठ मुख्य रूप से रूसी है जिसके द्वारा परीक्षण घोषित किया गया है।
सख्त स्ट्रिंग-स्तर की जांच अभी भी तीन शब्दों या उससे अधिक के 9,439 स्ट्रिंग्स के बीच साइरिलिक के बिना 18 स्ट्रिंग्स को मिलती है, जो 18 पृष्ठों में फैला हुआ है। उन अवशेष ज्यादातर अंग्रेजी CTA या noindex रिकॉर्ड पर कवर-alt फ़ील्ड हैं: 27 इंडेक्सेबल रूसी पृष्ठों का शून्य प्रभावित होता है और शून्य पृष्ठ पूरी तरह से अंग्रेजी होते हैं। दो नंबर अलग-अलग सवालों का जवाब देते हैं, इसलिए यह अद्यतन उन्हें भ्रामक एकल शून्य में संपीड़ित करने के बजाय दोनों की रिपोर्ट करता है।
प्रकाशन और स्थानीयकरण परीक्षण अब नए रिकॉर्ड की रक्षा करते हैं, जबकि कमजोर विरासत यूआरएल को सार्वजनिक संग्रह, आरएसएस, साइटमैप और hreflang सिफारिशों से बाहर रखा जाता है जब तक कि वे संपादकीय गेट को पास नहीं करते हैं। शेष 18 स्ट्रिंग्स एक क्लीनअप कतार हैं, यह स्पष्ट नहीं है कि मूल 43-of-74 शर्त जारी है।
एक स्थानीय क्षेत्र एक दावा है, एक विवरण नहीं
इस संग्रह में हर रिकॉर्ड एक स्थानीय व्यक्ति है। जब यह रु को पढ़ता है, तो परिणामों की एक श्रृंखला आग: कहानी को /ru/journal के तहत रूट किया जाता है, इसे रूसी संस्करण में गिना जाता है, इसे रूसी उपरेखा दिया जाता है, इसका पठन समय रूसी प्रत्यय के साथ मुद्रित होता है, और इसे एक hreflang क्लस्टर में वायर किया जाता है जो खोज इंजन को बताता है यह टुकड़ा का रूसी संस्करण है।
इसमें से कोई भी पाठ का वर्णन नहीं है। यह पाठ के बारे में एक तर्क है, जिसे किसी क्षेत्र द्वारा बनाया गया है। स्थानीयकृत संस्करणों पर Google का अपना प्रलेखन अंतर के बारे में धुंधला है: यह बताता है कि न तो hreflang और न ही HTML lang विशेषता का उपयोग किसी पृष्ठ की भाषा का पता लगाने के लिए किया जाता है, और यह कि भाषा इसके बजाय एल्गोरिदमिक रूप से निर्धारित की जाती है। लेबल हमारे लिए है। शब्द क्या पढ़ा जाता है।
इस प्रस्तावना में कुछ भी नहीं है कि क्या दोनों सहमत हैं। प्रकाशन द्वार, डेटा / जर्नल-data.js में NoindexJournalPost, शीर्षक, एसईओ शीर्षक, विवरण, अंश, कीवर्ड और टैग की सूची के खिलाफ उन्हें मिलान करता है, और उन्हें नौ लीटर स्ट्रिंग्स की सूची के खिलाफ मैच करता है - lorem ipsum उनमें से एक है। भाषा यह नहीं है कि वह उस चीज़ के बीच है जिसे वह देखता है। सूट में कोई परीक्षण यह दावा नहीं करता कि रूसी पोस्ट रूसी में है।
इसलिए हमने उस जाँच को लिखा जो अस्तित्व में नहीं था और इसे खुद पर चला गया।
परीक्षण और क्या यह वापस आ गया
प्रत्येक के लिए 74 रूसी-स्थानीय पदों में डेटा/generated-journal-posts. Js हमने तीन शब्दों या उससे अधिक के हर prose स्ट्रिंग को एकत्र किया: शीर्षक, एसईओ शीर्षक, एसईओ विवरण, अंश, कवर alt पाठ, CTA सारांश, हर शरीर के शीर्षक, हर शरीर के पैराग्राफ, हर उपधारा शीर्षक और पैराग्राफ, दोनों क्षेत्रों के प्रत्येक सामान्य प्रश्न प्रविष्टि, हर सारांश बिंदु और हर चेकलिस्ट आइटम।
एक स्ट्रिंग को ध्वजांकित किया जाता है जब इसमें कम से कम एक लैटिन अक्षर और एक एकल सिरिलिक वर्ण नहीं होता है।
यह नियम वास्तविक रूसी गद्य के खिलाफ झूठे सकारात्मक नहीं पैदा कर सकता है, क्योंकि असली रूसी गद्य Cyrillic होता है। केवल तार यह गलत तरीके से झंडा हो सकता है रूसी वाक्य पूरी तरह से लैटिन अनुवाद में लिखे गए हैं, और संग्रह में कोई नहीं है। यह दूसरे दिशा में खुशी से कम होगी: एक पैराग्राफ चालीस अंग्रेजी शब्दों और एक रूसी को साफ करता है। इसलिए नीचे की हर संख्या एक मंजिल है, एक छत नहीं है।
रूसी संस्करण के पार, 3,852 के 2,097 प्रोस स्ट्रिंग्स में सभी पर कोई क्रिलिक नहीं होता है। यह सब कुछ है जो संस्करण कहते हैं का 54.44 प्रतिशत है।
पूरे लेख के स्तर पर: 74 रूसी पदों में से 43 प्रभावित होते हैं। उनमें से तीस-नैन एक सौ प्रतिशत पर हैं - प्रत्येक स्ट्रिंग का परीक्षण हेडलाइन से लेकर अंतिम चेकलिस्ट आइटम तक, कोई साइरिलिक के साथ वापस आता है। एक और अधिक 97.2 प्रतिशत पर बैठता है, जिसमें अंग्रेजी में अपने 71 स्ट्रिंग्स का 69 हिस्सा है। शेष तीनों को हल्के ढंग से स्पर्श किया गया है: 33 के दो तार, 56 में से तीन, 53 में से दो। लगभग कोई मध्य नहीं है। इस संग्रह में रूसी पोस्ट पूरी तरह से रूसी या पूरी तरह से नहीं है।
स्ट्रिंग्स के बजाय शरीर के शब्दों की तुलना में, संस्करण के 60,099 शब्दों का 29,441 कोई Cyrillic — 48.99 प्रतिशत के साथ पैराग्राफ में बैठते हैं। सिर्फ़ रूसी संस्करण के बहाव के नीचे, वॉल्यूम से, अंग्रेजी है।
यह भागों पर उतरता है एक रीडर पहले से मिलता है
दसवें पैराग्राफ में क्षति को दफनाया नहीं जाता है। यह वास्तव में उन क्षेत्रों में केंद्रित है जो एक रीडर, एक कार्ड और एक खोज परिणाम किसी अन्य चीज़ से पहले देखते हैं।
74 रूसी पदों में से: 42 में एक अंग्रेजी शीर्षक है। Forty-one एक अंग्रेजी एसईओ शीर्षक है। Forty एक अंग्रेजी एसईओ विवरण है। चालीस एक अंग्रेजी अंश है। Forty-two अंग्रेजी कवर alt पाठ है, जो एक स्क्रीन रीडर की घोषणा करता है। चालीस कम से कम एक अंग्रेजी बॉडी हेडिंग ले जाते हैं, 40 कम से कम एक अंग्रेजी सामान्य प्रश्न सवाल उठाते हैं, और 40 कम से कम एक अंग्रेजी चेकलिस्ट आइटम ले जाते हैं।
कीवर्ड सूची में निर्मित एक उपयोगी नियंत्रण के साथ एक ही कहानी बताती है। 43 प्रभावित पदों पर, 397 कीवर्ड वाक्यांशों की 377 — 95.0 प्रतिशत — कोई Cyrillic शामिल नहीं है। 31 स्वच्छ पदों पर, आंकड़ा 266 का 16 या 6.0 प्रतिशत है। रूसी कीवर्ड सूची में लैटिन वर्ण अपने आप में गलत नहीं हैं; ब्रांड नाम लैटिन हैं, और यह 6 प्रतिशत है। 95 और 6 के बीच विपरीत सबूत है, नहीं कच्चे गिनती।
ये अनुवाद नहीं हैं जो विफल हो गए हैं
सहज स्पष्टीकरण यह है कि एक अनुवाद कदम छोड़ दिया गया था और अंग्रेजी मूल जगह में छोड़ दिया गया था। डेटा इसका समर्थन नहीं करता है।
39 पूरी तरह से अंग्रेजी रूसी पदों में से केवल 8 के पास एक ही आधार स्लग पर एक अंग्रेजी-स्थानीय भाई है जो एक ही अग्रणी एन-, रु- या es- उपसर्ग को हटा दिया जाता है। उनमें से कोई भी 8 अपने भाई के साथ एक शीर्षक साझा नहीं करता है। पूरे रूसी संस्करण के पार, केवल 14 गद्य स्ट्रिंग्स मामले और punctuation तह के बाद किसी भी अंग्रेजी पोस्ट से एक स्ट्रिंग से मेल खाते हैं, जो 11 पदों पर फैले हुए हैं।
दूसरे शब्दों में, ये गलत फ़ोल्डर में बैठे अंग्रेजी संस्करण से अंग्रेजी लेख नहीं हैं। वे अंग्रेजी में लिखे गए विभिन्न अंग्रेजी लेख हैं, जिन्हें रूसी संस्करण के रूप में दायर किया गया है। एक रीडर जो भाषा स्विच करता है, उसे पढ़ने वाली कहानी का अनुवादित संस्करण नहीं दिखाया जा रहा है। उन्हें अंग्रेजी में भी एक और कहानी दिखाया जा रहा है।
यह तय करने के लिए महत्वपूर्ण है। एक लापता अनुवाद कदम फिर से चलाया जा सकता है। गलत भाषा में उत्पन्न सामग्री को फिर से कमीशन किया जाना चाहिए।
दोष के किनारे हैं, और किनारे अच्छी खबर हैं
दो सीमाएं उभरीं कि हम नहीं देख रहे थे।
पहला तारीख है। 43 प्रभावित पदों में से प्रत्येक में 2026-06-29 और 2026-07-11 के बीच प्रकाशित किया गया था। 2026-07-11 को या उससे पहले दिनांक 60 रूसी पदों में से 43 प्रभावित होते हैं; इसके बाद 14 तारीखों में से कोई भी नहीं है। स्वच्छ पोस्ट 2026-07-01 से 2026-08-09 तक चलाते हैं, इसलिए दो समूह अलग-अलग युगों में बैठने के बजाय समय पर ओवरलैप करते हैं - लेकिन 11 जुलाई के बाद प्रकाशित कुछ भी परीक्षण में विफल नहीं हुआ।
दूसरा एक बायलाइन है। सभी 43 लेखक स्ट्रिंग ले जाते हैं VITON13 संपादकीय (ru). उस बायलाइन में कुल 60 रूसी पदों को शामिल किया गया है, इसलिए अपने खुद के 17 स्वच्छ हैं। फ़ाइल में अन्य चार रूसी उप-रेखा - 4 पदों के साथ VJOURNAL संपादकीय, 5 के साथ Редакция VJOURNAL, VITON13 4 और Редакция साथ संपादकीय खुफिया VITON13 1 के साथ - अपवाद के बिना साफ कर रहे हैं: 0 of 14
सभी 43 पदों को प्रकाशित करते हैं। कोई भी वापस नहीं हुआ, और कोई भी झंडा नहीं था।
किनारों के साथ एक दोष एक रन है, कोई पॉलिसी नहीं है। कुछ जुलाई के दूसरे सप्ताह में या उसके आसपास बदल गया और रूसी संस्करण रूस में बाहर आने लगे। यह नहीं कह सकता कि क्या बदल गया है, केवल यह परिवर्तन डेटा में दिखाई देता है और यह कि पहले रन कभी संशोधित नहीं किया गया था।
स्पेनिश, जहां तक एक ही विधि पहुंच सकती है
Cyrillic परीक्षण स्पेनिश में स्थानांतरित नहीं होता है, जो अंग्रेजी के साथ एक वर्णमाला साझा करता है। निकटतम उपलब्ध विकल्प एक अलग सवाल है: यह स्पेनिश स्ट्रिंग समान है, मामले और punctuation तह के बाद, एक स्ट्रिंग जो एक अंग्रेजी पोस्ट में दिखाई देता है?
छह हैं। वे 74 स्पैनिश पदों में से 5 में बैठते हैं: तीन सामान्य प्रश्न प्रश्न, दो बॉडी हेडिंग और एक एसईओ शीर्षक। कोई स्पेनिश शीर्षक एक अंग्रेजी शीर्षक से मेल खाता है।
यह परीक्षण एक विशिष्ट तरीके से सिरिलिक की तुलना में कम है, और ग्लॉस के बजाय अंतर को बताया जाना चाहिए। यह केवल अंग्रेजी पाठ को पकड़ सकता है जिसे इस समान फ़ाइल में एक अंग्रेजी पोस्ट से कॉपी किया गया था। सीधे एक स्पेनिश रिकॉर्ड में लिखी गई अंग्रेजी गद्य, जिसमें कहीं भी जुड़वां नहीं है, इसे अदृश्य रूप से पास कर देगा। इसलिए ईमानदार दावा संकीर्ण है: सबसे मजबूत परीक्षण के तहत हम स्पेनिश पर लागू हो सकते हैं, रूसी विफलता के समान कोई पैटर्न दिखाई नहीं देता है। हम नहीं कह रहे हैं कि स्पैनिश संस्करण साफ है। हम रिपोर्टिंग कर रहे हैं कि हम उसी दोष को नहीं पा रहे थे, जिसमें एक ऐसी विधि थी जिसने संघर्ष किया था।
बायलाइन हमें पूरे समय बता रहा था
VJOURNAL की पहली पार्टी डेटासेट, जो 12 अगस्त 2026 को उसी फ़ाइल के 207-पोस्ट स्नैपशॉट पर उत्पन्न हुई, पूरे संग्रह के लिए छह लेखक स्ट्रिंग्स को सूचीबद्ध करती है: VITON13 संपादकीय 60 पदों पर, VITON13 संपादकीय (e) 60 पर, VITON13 संपादकीय (ru) 60 पर, VJOURNAL संपादकीय 17, Redacción VJOURNAL पर 5 और 5 पर Редакция VJOURNAL पर।
तीसरे के आकार को देखें। VITON13 संपादकीय (ru) डेस्क का नाम नहीं है। यह एक अंग्रेजी डेस्क नाम है जिसमें एक भाषा कोड को ब्रैकेट में बोल्ट किया जाता है - एक स्थानीय टैग जो बायलाइन के कपड़े पहनता है। छह लेखक स्ट्रिंग्स में से दो वास्तविक रूसी और स्पेनिश डेस्क नाम हैं; दो एक प्रत्यय के साथ अंग्रेजी नाम हैं।
यह एक तथ्य यह है कि डेटा राज्यों के बजाय VJOURNAL की अपनी रीडिंग है: जहां एक पाइपलाइन एक नाम पर एक प्रारूपण suffix के रूप में एक भाषा का इलाज करती है, यह एक लेख पर एक प्रारूपण suffix के रूप में उस भाषा का इलाज करने के लिए आश्चर्य नहीं है। सभी 43 untranslated पदों पर दिखाई देने वाली बायलाइन वास्तव में कभी भी अनुवादित नहीं थी।
आप क्या कह सकते हैं?
यह अनुवाद का न्याय नहीं कर सकता। 31 स्वच्छ रूसी पोस्ट क्रिलिक वर्णों की उपस्थिति के लिए एक परीक्षण पास करते हैं, जो एक असाधारण रूप से कम बार है। क्या वे रूसी पाठकों के लिए लिखित रूसी की तरह पढ़ते हैं, या रूसी शब्दों को पहनने वाले अंग्रेजी वाक्यों की तरह, यह एक सवाल है कि यह विधि संरचनात्मक रूप से जवाब देने में असमर्थ है, और हम इसे यहां जवाब नहीं दे रहे हैं।
यह आपको नहीं बता सकता कि कोई भी व्यक्ति ने देखा है। इस प्रस्ताव में कोई विश्लेषणात्मक घटना नहीं है जो इन पोस्टों के खिलाफ एक भाषा का गलतफहमी, एक उछाल या पृष्ठ पर एक समय रिकॉर्ड करता है। हमने क्या देखा है?
यह कोई कारण नहीं है। हमने पाइपलाइन लॉग नहीं पढ़ा था, और हम एक विशिष्ट पीढ़ी के काम या मॉडल कॉल के लिए रन को बढ़ावा नहीं दे रहे हैं। तारीख सीमा और बायलाइन सीमा रिकॉर्ड के बारे में अवलोकन हैं, जो कि हुआ था उसका पुनर्निर्माण नहीं है।
और यह एक फ़ाइल को मापता है। data/generated-journal-posts.js कई स्रोतों में से एक है जो साइट पर काम करने वाले संग्रह में विलय होता है; क्यूरेट और डेस्क-सीड पोस्ट कहीं और रहते हैं और इस गिनती के बाहर थे। यहां 74 रूसी पदों का लेखापरीक्षित लेखा परीक्षा के दिन उस फाइल में हैं।
दो ईमानदार विकल्प
वास्तव में दो निश्चित प्रतिक्रियाएं हैं। 43 को ठीक से अनुवाद करें, या उन्हें फिर से लेबल करें: उन्हें अंग्रेजी संस्करण में स्थानांतरित करें, रु स्थानीय को छोड़ दें, रूसी बायलाइन को छोड़ दें और उन्हें वे क्या हैं। तो ईमानदार है।
तीसरा पथ - एक रु स्थानीय के तहत अंग्रेजी गद्य छोड़ने, एक रूसी बायलाइन के साथ, एक रूसी-अनुच्छेदित रीडिंग टाइम और एक hreflang टैग खोज इंजन को बताते हुए यह रूसी संस्करण है - एकमात्र विकल्प है जिसमें एक दावा शामिल है जिसे हम झूठा जानते हैं। यह मूल 9 अगस्त स्नैपशॉट में स्टेटस quo था; रिकॉर्ड के ऊपर दिनांकित अद्यतन जो बाद में बदल गया था।
चेक स्वयं तुच्छ है। इस लेख के शीर्ष पर नियम एक नियमित अभिव्यक्ति है। एक परीक्षण में कहा गया है कि स्थानीय रु के साथ हर पोस्ट में अपने शीर्षक में कम से कम एक सिरिलिक चरित्र 42 पदों पर वे लिखा गया था, और इस पैराग्राफ से कम लिखने के लिए लागत कम होगी।
कारण यह कभी नहीं पकड़ा गया है कि विफलता सूक्ष्म थी। एक रूसी संस्करण में चालीस-दो अंग्रेजी हेडलाइन्स सूक्ष्म नहीं हैं। कारण यह है कि कोई भी गिनती मुद्रित नहीं था। यह प्रिंटआउट है।
सवाल और जवाब
मैं कैसे बता सकता हूं कि क्या एक बहुभाषी वेबसाइट वास्तव में अनुवादित है?
पाठ का परीक्षण करें, टैग नहीं। अपनी स्क्रिप्ट वाली भाषा के लिए चेक एक पंक्ति है: दावा करें कि प्रत्येक स्ट्रिंग में एक पृष्ठ प्रस्तुत होता है जिसमें उस स्क्रिप्ट से कम से कम एक चरित्र होता है। उन भाषाओं के लिए जो एक वर्णमाला साझा करते हैं, अपने स्रोत भाषा और ध्वज सटीक मैचों में संबंधित स्ट्रिंग के खिलाफ प्रत्येक स्ट्रिंग की तुलना करते हैं। VJOURNAL के रूसी संस्करण पर पहला परीक्षण चल रहा है, जिसमें 3,852 का 2,097 है, जो 74 पदों के 43 पदों पर है।
क्या hreflang एक खोज इंजन बताता है?
नहीं स्थानीयकृत संस्करणों पर Google का प्रलेखन बताता है कि यह एक पृष्ठ की भाषा का पता लगाने के लिए hreflang या HTML lang विशेषता का उपयोग नहीं करता है और इसके बजाय भाषा एल्गोरिदम को निर्धारित करता है। उन व्याख्याओं का वर्णन है कि आपके संस्करण एक दूसरे से कैसे संबंधित हैं; वे सामग्री को प्रमाणित नहीं करते हैं। एक पेज को रूसी संस्करण के रूप में टैग किया जा सकता है और इसे एक अंग्रेजी पेज के रूप में पढ़ा जा सकता है, जो ठीक उसी स्थिति में है जो 43 पदों पर पाया गया है।
रूसी संस्करण वास्तव में रूसी में कितना है?
स्ट्रिंग्स द्वारा 45.56 प्रतिशत — 1,755 of 3,852 prose स्ट्रिंग्स में सिरिलिक होता है। शरीर शब्द गिनती के अनुसार, 51.01 प्रतिशत: 30,658 रूसी शब्द 29,441 के खिलाफ अनुच्छेदों में कोई Cyrillic नहीं है। पूरे लेख तक, 74 पदों की 31 स्वच्छ हैं। तीस-नाइन हेडलाइन से चेकलिस्ट तक अंग्रेजी हैं, एक 97 प्रतिशत अंग्रेजी है और तीन प्रत्येक अंग्रेजी स्ट्रिंग के एक मुट्ठी भर ले जाते हैं।
किसी साइट के रूसी अनुभाग में एक लेख क्यों लिखा जाएगा?
इस मामले में यह एक अनुवाद नहीं था जो विफल रहा। 39 पूरी तरह से अंग्रेजी रूसी पदों में से केवल 8 में एक ही आधार स्लग पर एक अंग्रेजी-संपादन समकक्ष है, और उनमें से कोई भी 8 अपने शीर्षक को साझा नहीं करता है, इसलिए पाठ को अंग्रेजी संस्करण से कॉपी नहीं किया गया था। पोस्ट अंग्रेजी में उत्पन्न हुए हैं और सीधे रूसी स्थानीय लोगों के तहत दायर किए गए हैं। सभी 43 एक बायलाइन ले जाते हैं और सभी एक दूसरे के लिए एक रात के भीतर प्रकाशित किए गए थे।
साइट पर लापता अनुवाद के लिए सबसे सस्ता परीक्षण क्या है?
अपने टेस्ट सूट में एक स्क्रिप्ट-प्रेजेंस का दावा, अपने रेंडर किए गए पृष्ठों के बजाय अपनी खुद की सामग्री रिकॉर्ड के खिलाफ चलाएं। इसमें कोई नेटवर्क एक्सेस, कोई अनुवाद मेमोरी और कोई समीक्षाकर्ता की आवश्यकता नहीं है। इस संग्रह पर उन्होंने 42 अंग्रेजी हेडलाइंस को उस दिन पकड़ लिया था जिसे उन्होंने लिखा था। महंगा हिस्सा परीक्षण नहीं है - परीक्षण शुरू होने के बाद यह नंबर प्रकाशित कर रहा है।

