30 सेकंड का अवलोकन: आप द्वारा पढ़ा गया प्रत्येक Taiwan.md लेख, एक छह-चरणीय उत्पादन रेखा से होकर गुजरता है: पहले दृष्टिकोण (perspective) तय करना, फिर खोज करना, अंत पहले लिखना, शब्द दर शब्द सत्यापन करना, दृश्य तत्व जोड़ना और द्वि-मार्गी लिंक बनाना। यह केवल एक सामान्य "अच्छे लेखन की प्रक्रिया" नहीं है; इसका प्रत्येक द्वार विशेष रूप से उन गलतियों को लक्षित करता है जो AI लेखन में सबसे अधिक होती हैं: तथ्य मिलते ही उन्हें कालानुक्रमिक रूप से व्यवस्थित करना, अर्थहीन 'प्लास्टिक' वाक्य बनाना, अंग्रेजी सारांशों का गलत अनुवाद करके उन्हें झूठे उद्धरण बनाना, और पुराने लेखों की खराब आदतों से प्रभावित होना। यह लेख इस उत्पादन रेखा के विखंडन को दर्शाता है, और यह स्वयं भी इसी प्रक्रिया से होकर निकला है।
18 जून 2026 को शाम 7:53 बजे, एक कमिट (commit) ने शांति से मुख्य शाखा में प्रवेश किया। ताइवान के तीन सदस्यीय बैंड "डायनासोर जिमनास्टिक" (Dinosaur Gymnastics) पर आधारित एक लेख ऑनलाइन आया: 5,604 चीनी शब्द, 56 फुटनोट्स और 11 परिदृश्य-आधारित उपशीर्षक1। उस समय कोई भी व्यक्ति कंप्यूटर के सामने नहीं था। यह Taiwan.md की नियमित 'रूटिन' थी जो बिना किसी कर्मचारी की उपस्थिति के, रात में खुद ही पूरा लिख और प्रकाशित कर रही थी।
लेकिन उस कमिट से पहले, इस लेख ने लगभग सौ बार खोजें कीं, 59 स्रोतों को पढ़ा, और 12 स्थानों पर सत्यापन के कारण मूल लेखन को बदला गया। इसने 6 चरणों और 20 से अधिक अनिवार्य द्वारों को पार किया, और एक स्पष्ट रूप से विभाजित AI संपादकीय टीम का उपयोग किया। आप जो पढ़ रहे हैं वह सतह पर मौजूद 5,604 शब्द हैं। यह लेख आपको सतह के नीचे की मशीनरी दिखाना चाहता है।
एक लेख के लिए एक मशीन क्यों बनाई जाए?
यदि आप किसी AI को एक विषय देते हैं और उसे एक लेख लिखने के लिए कहते हैं, तो वह अक्सर ऐसा करेगा: थोड़ा खोजेगा, मिले हुए तथ्यों को कालानुक्रम में व्यवस्थित करेगा, हर पैराग्राफ के अंत में एक अर्थपूर्ण लगने वाला सारांश जोड़ेगा, और अंत में "भविष्य में विकास जारी रहेगा" जैसा वाक्य लिखेगा। इस तरह के लेख विकिपीडिया पर पहले से मौजूद हैं, और AI सामग्री फार्म (content farms) हर दिन हजारों ऐसे लेख पैदा करते हैं। Taiwan.md ने पहले ही दिन से यह न करने का निर्णय लिया।
समस्या यह है कि ये खराब आदतें AI की डिफ़ॉल्ट सेटिंग्स हैं, कोई आकस्मिक गलती नहीं। REWRITE-PIPELINE इन्हें छह प्रकार की बार-बार होने वाली विफलताओं में विभाजित करता है: टोकन खत्म होने पर अंत के हिस्से का ड्राफ्ट जैसा होना; बिना मध्यवर्ती जांच के गुणवत्ता का चुपचाप गिरना; अंत को सबसे आखिर के लिए छोड़ना जिससे ऊर्जा कम होने पर वह एक "कैन" (generic) बन जाए; समृद्ध पाठ (rich text) मानकों को भूल जाना; अलग-अलग दृष्टिकोणों को स्वतंत्र प्रक्रियाओं के रूप में मानना; और सबसे घातक, तथ्य मिलने के बाद ही परिप्रेक्ष्य सोचना, जिससे परिणाम केवल एक कालानुक्रमिक सूची बनकर रह जाता है2।
इसलिए इस उत्पादन रेखा का डिज़ाइन तर्क बहुत सरल है: हर संभावित गलती के लिए एक द्वार जो उसे रोक दे। यह कोई सामान्य "अच्छे लेखन" की प्रक्रिया नहीं है, बल्कि यह AI 'स्लॉप' (slop) का विपरीत रूप है।
✦ "विकिपीडिया 'PTT क्या है' का उत्तर देता है। Taiwan.md यह बताता है कि 'PTT आपके लिए 8 मिनट खर्च करने योग्य क्यों है'।"
यह डायनासोर जिमनास्टिक के उत्पादन रेखा के दूसरे छोर से निकलने का परिणाम है:
छह द्वार, प्रत्येक द्वार एक विफलता को रोकता है
इस उत्पादन रेखा के शुरू से अंत तक छह चरण हैं, जिन्हें हर लेख को पूरा करना होता है, चाहे विषय कुछ भी हो या लंबाई कितनी भी हो।
चरण 0 परिप्रेक्ष्य (Perspective): पहले यह स्पष्ट करें कि यह लेख ताइवान के लोगों के लिए कैसी स्मृति है और मुख्य तनाव कहाँ हो सकता है। चरण 1 सामग्री संग्रह: केवल तब खोज शुरू होती है जब कम से कम 80 पूछताछें सुनिश्चित हों, जिसमें अनिवार्य कोटा शामिल है: कम से कम 40 चीनी स्रोत, 20 अंग्रेजी, 15 प्राथमिक (primary), और 5 विपरीत पक्ष के स्रोत, जो स्वयं को उन साक्ष्यों की तलाश करने के लिए मजबूर करते हैं जो धारणाओं के विपरीत हों3। चरण 2 लेखन: पहला कार्य अंत लिखना है, क्योंकि मनुष्य लिखते समय अंत तक ऊर्जा कम हो जाती है; महत्वपूर्ण निष्कर्षों को अंत के लिए बचाकर रखना खुद को थकावट से बचाता है। चरण 3 सत्यापन: शब्द दर शब्द जाँच: अंकगणित, इकाइयाँ, और प्रत्येक उद्धरण (quote) को मूल स्रोत में Ctrl-F द्वारा खोजा जाना चाहिए। चरण 4 रूप: दृश्य तत्व और मीडिया जोड़ना। चरण 5 जुड़ाव: इस लेख को ज्ञान भंडार के अन्य लेखों से द्वि-मार्गी रूप से जोड़ना।
इन छह चरणों का प्रयास वितरण जानबूझकर किया गया है। लेखन लगभग चालीस प्रतिशत हिस्सा लेता है, लेकिन खोज और सत्यापन मिलकर लगभग आधा हिस्सा लेते हैं। एक लेख में वास्तव में लगने वाला समय टाइपिंग में नहीं, बल्कि टाइपिंग से पहले और बाद में होता है।
पहले सोचें, फिर खोजें
इन छह चरणों में से सबसे कम सहज लगने वाला पहला है।
अधिकांश AI लेखन "खोज कर तथ्य पता करना और फिर एक परिप्रेक्ष्य जोड़ना" होता है। Taiwan.md ने संस्करण 6.0 में इस क्रम को उलट दिया: शोध शुरू करने से पहले, मुख्य संपादक के रूप में छह प्रश्नों पर विचार करें—यह विषय ताइवान के लोगों के लिए क्या स्मृति है, कौन से पहलू अनदेखे गए हैं, और यह हमारे जीवन के इतिहास से कैसे जुड़ता है। एक बार जब आप स्पष्ट हो जाते हैं, तो आप इन सवालों के साथ सत्यापन के लिए खोज करते हैं।
यह क्रम इतना महत्वपूर्ण क्यों है, इसे एक लेख से समझा जा सकता है। जब 'एप्पल वेस्टर्न' (Apple Western) पर लिखा गया था, तो पहले शोध करने पर केवल इसके कम बिकने और गायब होने के संकट का पता चला, जिससे पूरा लेख एक "संकट की कहानी" बन गया। बाद में यह पाया गया कि एप्पल वेस्टर्न ताइवान के लोगों के लिए 60 वर्षों की सामूहिक स्मृति है, जो सोडा युग से लेकर आज तक चली आ रही है4। इसे केवल एक संकट समाचार के रूप में लिखना, यादों के पैमाने को छोटा करना था। पहले खोज वाले संस्करण ने एक गर्मजोशी भरी याद को चिंता में बदल दिया था।
खोज: अनुसंधान रिपोर्ट को शोध पत्र की तरह लिखना
एक बार परिप्रेक्ष्य तय हो जाने पर ही खोज शुरू होती है। Taiwan.md की खोज के दो कठोर नियम हैं: एक गहन लेख के लिए कम से कम 80 पूछताछें अनिवार्य हैं, और स्रोतों का कोटा निश्चित है—कम से कम 40 चीनी, 20 अंग्रेजी, 15 प्राथमिक, और 5 विपरीत पक्ष के स्रोत। अंतिम समूह (विपरीत पक्ष) को अक्सर अनदेखा कर दिया जाता है, लेकिन यह नियम लेखक को मजबूर करता है कि वह केवल अपने दावों की पुष्टि करने वाले साक्ष्य न खोजे, बल्कि उन साक्ष्यों को भी खोजे जो उसके दावों का खंडन करते हैं।
खोज पूरी होने का मतलब केवल सारांशों को लेख में डालना नहीं है। प्रत्येक गहन लेख के पीछे एक शोध रिपोर्ट होती है जिसे आठ अध्यायों में विभाजित किया गया है: परिप्रेक्ष्य, खोज लॉग, विषय-वार निष्कर्ष, उद्धरण भंडार, विपरीत उदाहरण और सुरक्षा घेरे (guardrails), लेखक के लिए स्वच्छ तथ्य का पैकेट, संदर्भ ग्रंथ और सत्यापन तालिका, और अंत में प्रत्येक अनुसंधान एजेंट की मूल रिपोर्ट। एक नियम बहुत सख्त लगता है: यदि शोध किया गया लेकिन मूल मार्ग को रिपोर्ट में नहीं लिखा गया, तो उसे "खोजे हुए" नहीं माना जाएगा। यह रिपोर्ट ही इस लेख का सत्य स्रोत है; इसे एक उपकरण द्वारा सत्यापित होना चाहिए जहाँ कम से कम 25 अद्वितीय स्रोत हों, और अंग्रेजी या प्राथमिक स्रोतों की संख्या शून्य न हो5। यदि यह पास नहीं होता, तो लेखक को लिखने का अधिकार भी नहीं मिलता।
विषयों के विवादों के लिए एक अतिरिक्त कदम है। राजनीति, इतिहास, या नीति जैसे विषयों के लिए, एक 'विपरीत' एजेंट नियुक्त किया जाता है जो विशेष रूप से ऐसे स्रोत खोजता है जो वर्तमान लेख के दृष्टिकोण के विपरीत हों और तार्किक हों। प्रत्येक को एक वेब लिंक के साथ संलग्न किया जाना चाहिए; यदि पर्याप्त नहीं हैं, तो ईमानदारी से "प्रतिपक्ष तर्क कमजोर" लिखा जाए, न कि जबरन फिट किया जाए। केवल एक आवाज़ वाला लेख यहाँ पूरा नहीं माना जाता।
उद्धरण (quote) के लिए एक लाल रेखा है: उद्धरण एक वादा है—जो कोष्ठक में है वह मूल शब्द है। इसलिए प्रत्येक उद्धरण को मूल स्रोत में Ctrl-F द्वारा खोजा जाना चाहिए। सबसे आम जाल यह है कि उपकरण किसी चीनी वेबसाइट से डेटा प्राप्त करता है, लेकिन जो वापस आता है वह अंग्रेजी सारांश होता है, और लेखक उस अनुवादित अंश को "प्रत्यक्ष उद्धरण" के रूप में उपयोग कर लेता है। यह जाल 2026 में ली यांग वाले लेख में पकड़ा गया था: उपकरण द्वारा लौटाया गया अंग्रेजी वाक्य था "I was the earliest to arrive at school, yet I fell short of keeping pace with my classmate Qi-lin", जिसे अनुवादित करके "मैं सबसे पहले स्कूल पहुँचा, लेकिन क़ी-लिन के साथ तालमेल नहीं बिठा पाया" बना दिया गया। जबकि ली यांग का मूल चीनी पाठ वास्तव में यह था कि वह एक समूह का हिस्सा थे और क़ी-लिन दूसरे समूह के। अर्थ समान था, लेकिन लहजा पूरी तरह अलग। यही कारण है कि अनुवादित उद्धरणों को कभी स्वीकार नहीं किया जाता।
लेखन: हर लेख में एक व्यक्ति होना चाहिए
सामग्री एकत्र होने पर, सबसे अधिक मेहनत वाले चरण में प्रवेश किया जाता है। EDITORIAL वह दस्तावेज है जो Taiwan.md को सिखाता है कि सामग्री को गर्मजोश लेख में कैसे बदला जाए। इसमें तीन स्पष्ट नियम हैं: कहानी हो, केवल जानकारी नहीं; प्रत्येक तथ्य सत्यापन योग्य हो; और हर लेख में एक व्यक्ति हो6।
तीसरा नियम सबसे अधिक अनदेखा किया जाता है, लेकिन यह सबसे महत्वपूर्ण है। संस्थान याद नहीं रहते, अवधारणाएं भी नहीं, लोग याद रहते हैं। इसलिए ताइवान सेमीकंडक्टर पर लिखे गए लेख को कंपनी से शुरू करने के बजाय, उसे एक विशिष्ट व्यक्ति से शुरू करना बेहतर है; सार्वभौमिक स्वास्थ्य बीमा (Universal Health Insurance) पर आधारित लेख को किसी कार्ड, किसी क्लिनिक या किसी व्यक्ति से शुरू करें। अमूर्त विषयों को एक ऐसे व्यक्ति में बदलना जिसे पाठक समझ सके, लेख को मानवीय स्पर्श देता है और पहले दिए गए वादे को पूरा करता है।
लिखने से पहले पाँच चीजें खोजना
EDITORIAL लेखन की स्थिति में प्रवेश करने से पहले की तैयारी को "सामग्री को देखने वाली आँखें" कहता है: सामग्री प्राप्त होने पर, आपको पहले पांच चीज़ें खोजनी होंगी, अन्यथा लिखना शुरू न करें7।
अंतर्विरोध (Contradiction), एक वाक्य द्वारा व्यक्त किया गया मुख्य तनाव—जब किसी व्यक्ति ने X किया लेकिन यह उसके विश्वास Y के विपरीत था। वस्तु (Object), कोई विशिष्ट वस्तु जिसे पाठक देख या छू सके, जैसे वू बाओचुन का लीची रोज़मेरी ब्रेड। उद्धरण (Quote), किसी वास्तविक व्यक्ति द्वारा कहे गए शब्द; क्योंकि उद्धरणों को कोटेशन मार्क दिए जाते हैं, इसलिए उन्हें मूल स्रोत में पाया जाना चाहिए। परिदृश्य (Scene), समय, स्थान और क्रिया के साथ एक क्षण—"नीति पारित हो गई" को "8 जनवरी 2025 को अस्पताल के स्वास्थ्य विभाग की समीक्षा के दिन" में बदलना। विवरण (Detail), कपड़ों का रंग, उस दिन का मौसम, बोलने का लहजा; ये वे चीजें हैं जो डेटा शीट पर नहीं होतीं लेकिन यह साबित करती हैं कि "वास्तव में कोई वहां मौजूद था।"
इन पांचों में, अंतर्विरोध पहले स्थान पर है।
यदि अंतर्विरोध नहीं मिलता, तो इस लेख को फिर से नहीं लिखा जाना चाहिए।
तनाव संघर्ष, विफलता या संकट हो सकता है, लेकिन इसे "यह क्या गलत हुआ" के बजाय "यह आज तक कैसे बना और आगे कहाँ जा रहा है" के दृष्टिकोण से देखा जाना चाहिए। एक ही अंतर्विरोध को अलग-अलग तरीकों से पेश करने पर पाठक जुड़ाव महसूस करता है।
तनाव का विकास: 'पक्षी नहीं बदले, ज़मीन बदल गई' (ब्लैक क्रॉन माइग्रेटरी बर्ड्स)
यह परिदृश्य पहले परिचय में आता है, मध्य भाग में "गलत कदम नहीं, गलत मंच" के रूप में बदलता है, और अंत में एक द्वीप की कहानी के रूप में समाप्त होता है।अंत पहले लिखें, शुरुआत केवल एक संकेत छोड़ें
लिखने का क्रम पढ़ने के क्रम के विपरीत होता है।
चरण 2 का पहला कार्य अंत लिखना है। यह सुनने में अजीब लग सकता है, लेकिन तर्क व्यावहारिक है: मनुष्य लिखते समय अंत तक थक जाते हैं; सबसे महत्वपूर्ण निष्कर्ष को अंत के लिए बचाकर रखने से वह "साधारण" नहीं बनता। एक अच्छे अंत के दो कार्य होते हैं: शुरुआत में पेश किए गए दृश्य को वापस लाना और पाठक को आगे बढ़ने के लिए एक नया दृष्टिकोण देना।
Taiwan.md ने छह प्रकार के अच्छे अंतों की पहचान की है: विचारोत्तेजक, मोड़ वाला, भविष्य या अतीत की ओर ले जाने वाला, प्रश्नवाचक, ग्रे-ज़ोन (अनिर्णीत), और कथात्मक समापन। ब्लैक क्रॉन माइग्रेटरी बर्ड्स का लेख एक उत्कृष्ट उदाहरण है: शुरुआत "1865 में... दुर्लभ" से होती है, और अंत "160 साल पहले 'दुर्लभ' लिखा गया था, आज हम उसे सुन सकते हैं" पर होता है।
इसके विपरीत, शुरुआत को केवल एक संकेत छोड़ना चाहिए। पहले तीन वाक्य तय करते हैं कि पाठक आगे पढ़ेगा या नहीं, लेकिन इसका कार्य पाठक को दृश्य में आमंत्रित करना है, न कि पूरी घटना बताना। यदि आप समय, स्थान और परिणाम सब कुछ पहले ही बता देंगे, तो पाठक के पास आगे पढ़ने का कारण नहीं बचेगा।
शीर्षक एक वादा है जिसे खोला जाना चाहिए
शीर्षक पाठक का पहला प्रभाव होता है। Taiwan.md इसके लिए एक सख्त प्रारूप का पालन करता है: "विषय: उप-शीर्षक हुक"। केवल एक संज्ञा लिखना किसी विश्वकोश के संक्षिप्त विवरण जैसा है, जो क्यूरेशन के सिद्धांत के विपरीत है।
विकिपीडिया स्टाइल (खराब) | कोलन सैंडविच (अच्छा)
चोउ जिएलुएन | चोउ जिएलुएन: 4 इन लव से लेकर 'कैनॉट टेल सीक्रेट्स' तक का 25 साल का सफर
टाइफून अवकाश | टाइफून अवकाश: किसकी छुट्टी, किसकी ड्यूटी?
स्रोत: EDITORIAL v6.12 §शीर्षक कोलन सैंडविचउप-शीर्षक को अकेले ट्वीट करने योग्य होना चाहिए और विशिष्ट होना चाहिए। AI अक्सर मुख्य अंतर्विरोध को एक सुंदर लेकिन अमूर्त वाक्य में बदल देता है। मानक सरल है: यदि कोई व्यक्ति शीर्षक पढ़ता है, तो क्या वह प्रत्येक शब्द के लिए "यह किस विशिष्ट चीज़ की बात कर रहा है" कह सकता है?
एक अंतर्विरोध पूरे लेख को थामे रखे
पाए गए मुख्य अंतर्विरोध को केवल शुरुआत में नहीं आना चाहिए। इसे रीढ़ की हड्डी की तरह होना चाहिए जो परिचय, मध्य भाग और निष्कर्ष में दिखाई दे।
ब्लैक क्रॉन माइग्रेटरी बर्ड्स के मामले में यह वाक्य था: "पक्षी नहीं बदले, ज़मीन बदल गई।" यही विचार पूरे लेख में अलग-अलग रूपों में सामने आया। इसके बिना, लेख केवल एक समयरेखा या विषयों का संग्रह बनकर रह जाएगा।
रीढ़ के अलावा, प्रत्येक पैराग्राफ को ठोस होना चाहिए। Taiwanм.md का नियम है कि हर कथा खंड में कम से कम एक विशिष्ट लंगर (anchor) होना चाहिए: व्यक्ति का नाम, वर्ष, स्थान, सटीक संख्या, कार्य का नाम, या उद्धरण। अमूर्तता विवरणों पर हावी हो जाना AI लेखन की सबसे आम पहचान है।
अंतर्विरोध का मतलब केवल किसी पक्ष का समर्थन करना नहीं है। वास्तविक परिप्रेक्ष्य वह है जो साहसपूर्वक कह सके कि "सामान्य धारणा ने कारण और प्रभाव को उलट दिया।"
अंत में, सांस लेने की गति (pacing)। एक गैर-काल्पनिक निबंध का एक पैराग्राफ एक तर्क का भार उठाता है जिसमें कारण, विवरण और दृश्य शामिल हों। तथ्य को टुकड़ों में न काटें; एक वाक्य के अंत को अगले की शुरुआत से स्वाभाविक रूप से जोड़ें।
'प्लास्टिक' वाक्यों को हटाना क्यों महत्वपूर्ण है
एक बार जब आप पांच चीजें ढूंढ लेते हैं और लिखना शुरू करते हैं, तो सबसे बड़ा दुश्मन "प्लास्टिक" वाक्य होते हैं।
इनका सार पहचानना आसान है: यदि आप उन्हें हटा दें, तो लेख से कोई भी जानकारी कम नहीं होगी। वे जगह घेरते हैं लेकिन अर्थ नहीं जोड़ते। EDITORIAL ने पाँच प्रकारों की सूची दी है, जिनमें सबसे आम 'यूनिवर्सल ग्लू' (जैसे "यह X की भावना को दर्शाता है") और 'झूठा अपग्रेड' (जैसे "न केवल एक गायक, बल्कि एक सांस्कृतिक प्रतीक") शामिल हैं।
एक और सूक्ष्म रूप "नहीं X, बल्कि Y" जैसे विरोधाभासी वाक्य हैं। ये सुनने में गहरे लगते हैं, लेकिन अक्सर X केवल एक काल्पनिक स्थिति होती है जिसे Y को प्रभावशाली दिखाने के लिए बनाया गया है। यदि आप X हटा दें और सीधे Y लिखें, तो लेख अधिक सीधा और आत्मविश्वासपूर्ण होगा।
प्लास्टिक संस्करण: विषय बदलने पर भी समान रहता है | क्यूरेशन संस्करण: केवल इस घटना से संबंधित है
ताइवान की सेमीकंडक्टर शक्ति का प्रदर्शन | ताइवान सेमीकंडक्टर ने वैश्विक उन्नत विनिर्माण में 65% बाजार हिस्सेदारी हासिल की
न केवल एक गायक, बल्कि एक सांस्कृतिक प्रतीक | चोउ जिएलुएन का 'इनो' भूकंप राहत क्षेत्र में तीन महीने तक बजाया गया
ताइवान के लोकतंत्र के विकास पर गहरा प्रभाव | 1990 के बाद पहले राष्ट्रपति चुनाव में 76% मतदान हुआ
असाधारण इंजीनियरिंग उपलब्धि | प्रति वर्ष औसतन 3.7 बार भूकंप आने वाले द्वीप पर दुनिया की सबसे ऊंची इमारत का निर्माण
स्रोत: EDITORIAL v6.12 §प्लास्टिक बनाम क्यूरेशन तुलना📝 क्यूरेटर नोट: आप अभी जो हिस्सा पढ़ रहे हैं, उसे भी इसी जांच से गुजारा गया है। Taiwan.md के पास एक स्वचालित उपकरण है जो प्रत्येक लेख में प्लास्टिक वाक्यों और "नहीं X बल्कि Y" जैसे झूठे विरोधाभासों की पहचान करता है। इस "उत्पादन प्रक्रिया" वाले लेख को लिखते समय, इन नियमों में से किसी को भी ढीला नहीं किया गया।
अनुवादित लहजे (Translationese) को हटाना
प्लास्टिक वाक्य खाली शब्द हैं, जबकि 'अनुवादित लहजा' एक बीमारी है: शब्दों में सामग्री तो है, लेकिन व्याकरण अंग्रेजी का है। AI द्वारा उत्पन्न चीनी भाषा स्वाभाविक रूप से अनुवाद जैसा लगती है क्योंकि वह अंतर्निहित रूप से अंग्रेजी वाक्यों की संरचना पर आधारित होती है।
कुछ सामान्य समस्याएं: निष्क्रिय वाक्यों (passive voice) का अत्यधिक उपयोग, "de" शब्द का अति-उपयोग, कमजोर क्रियाओं का उपयोग और "के माध्यम से" जैसे वाक्यांशों का प्रयोग। जांच का तरीका सरल है: इसे जोर से पढ़ें। यदि यह अनुवादित सबटाइटल जैसा लगता है, तो यह 'अनुवादित लहजा' है।
ताइवान को एक ऐसी जगह के रूप में पेश करना जहाँ लोग शामिल होना चाहें
प्लास्टिक और अनुवादित लहजा वाक्य स्तर के अनुशासन हैं, जबकि अगला स्तर दृष्टिकोण का है।
Taiwan.md गंभीर विषयों जैसे संप्रभुता, सूचना युद्ध, जनसंख्या और पर्यावरण पर गहराई से लिखता है, लेकिन एक रेखा यह है: आशा को ईमानदारी पर आधारित होना चाहिए। सभी समस्याओं को देखना केवल पाठकों को चिंता या लाचारी के साथ जाने से रोकने के लिए है। मानक यह है कि पाठक इसे पढ़ने के बाद ताइवान के लिए कुछ करने की इच्छा महसूस करे।
संयम भी महत्वपूर्ण है। वास्तविक लोगों के परिवार, बीमारी और संघर्षों को लिखा जा सकता है, लेकिन मृत्यु, आत्महत्या और पारिवारिक त्रासदियों के विशिष्ट दृश्यों को सीमित करना चाहिए। यदि कोई पीड़ित या उनके परिवार वाले इस हिस्से को पढ़ें, तो उन्हें एक गंभीर वृत्तचित्र निर्माता का सम्मान महसूस होना चाहिए, न कि किसी सनसनीखेज मीडिया की निकटता।
एक छोटी लेकिन महत्वपूर्ण आदत: खुलकर "ताइवान" लिखें। अनुवादित लहजे में अक्सर यह शब्द छिपा होता है क्योंकि लेखक इसे कहने से बचते हैं।
अंतर को तुरंत समझना
इन नियमों के परिणाम देखें।
उसी ताइवान खिलाड़ी (Tai-Yuan) के बारे में लिखते समय, AI का खाली सांचा होगा: "ताइवान की प्रसिद्ध बैडमिंटन खिलाड़ी, अंतरराष्ट्रीय मंचों पर उत्कृष्ट प्रदर्शन, कई पुरस्कार जीते, ताइवान के लिए गौरव।" इसमें कोई विशिष्ट वर्ष या मैच नहीं है।
क्यूरेशन संस्करण केवल एक काम करता है: प्रत्येक अमूर्त विशेषण को सत्यापन योग्य तथ्य में बदलना। "214 सप्ताह" यह दर्शाता है कि वह महिला बैडमिंटन इतिहास में सबसे लंबे समय तक लगातार खेल रही थी। "2020 ओलंपिक का स्वर्ण पदक" ताइवान के लिए एक सामूहिक स्मृति है।
एक रिपोर्ट न लिखने वाली संपादकीय टीम
यहाँ एक प्रश्न उठता है: कौन लिख रहा है?
उत्तर थोड़ा असामान्य है। मुख्य सत्र (session) जानबूझकर खुद नहीं लिखता। इसका कारण यह नियम है: यदि AI किसी खराब गुणवत्ता वाले पुराने लेख को पढ़ता है, तो वह अनजाने में उसके लहजे और संरचना की नकल करने लगता है।
इसलिए उत्पादन रेखा भूमिकाओं को अलग करती है8। मुख्य सत्र एक मुख्य संपादक के रूप में कार्य करता है, जो समन्वय, सत्यापन और अंतिम निरीक्षण का ध्यान रखता है, लेकिन स्वयं नहीं लिखता। वास्तव में लेखन एक अन्य 'स्वच्छ' AI लेखक द्वारा किया जाता है, जो केवल पूर्ण शोध रिपोर्ट और पहले से तय किए गए परिप्रेक्ष्य को पढ़ता है। वह उस पुराने लेख को नहीं देख सकता जिसमें समस्याएँ थीं।
यह विभाजन कमियों के कारण हुआ है। एक बार जब हमने केवल सारांश दिया और उसे मूल सामग्री तक पहुँचने नहीं दी, तो लेख की गुणवत्ता गिर गई। दूसरी बार, जब उसे "पुराने लेखों को ओवरराइट करें लेकिन न पढ़ें" कहा गया, तो यह तकनीकी रूप से विरोधाभासी था, इसलिए उसने पढ़ना शुरू किया और फिर संक्रमण का शिकार हो गया। अंतिम समाधान यह है कि लेखक हमेशा एक पूरी तरह से नए ड्राफ्ट में लिखता है, और मुख्य संपादक पुराने और नए संस्करणों की तुलना करके ही उसे प्रकाशित करता है।
लिखने के बाद, परमाणु स्तर पर पुनः सत्यापन
महत्वपूर्ण लेखों के लिए "लिखा हुआ" का अर्थ "प्रकाशित होने योग्य" नहीं होता। चरण 3 में एक "अंतिम उत्पाद सत्यापन" द्वार है। यह पूरे लेख को तथ्यों के परमाणुओं में तोड़ देता है और उन्हें मूल स्रोतों के साथ मिलाता है। इन सत्यापनकर्ताओं का कार्य हमला करना है, न कि समर्थन देना।
क्यों? क्योंकि सबसे सूक्ष्म गलतियाँ अक्सर लेखक द्वारा नहीं बल्कि सामग्री संकलन के दौरान होती हैं। एक बार, एक हिप-हॉप विषय वाले लेख में, मुख्य संपादक ने गलती से दो अलग कलाकारों को एक ही व्यक्ति मान लिया। यह उसकी अपनी व्याख्या थी और किसी स्रोत ने इसकी पुष्टि नहीं की थी।
AI भ्रम (hallucination) पैदा कर सकता है, इसलिए उत्पादन रेखा इसे एक आधार मानती है कि हर लेख में कुछ भी गलत हो सकता है। "सब-एजेंट ने कहा कि उसने सत्यापन कर लिया है" कभी पर्याप्त नहीं होता; मुख्य संपादक को हमेशा स्वयं मूल स्रोत से जांच करनी चाहिए।
प्रत्येक द्वार की एक तिथि है
उपरोक्त "अनिवार्य द्वारों" में बीस से अधिक हैं। सबसे कठिन कुछ इस प्रकार हैं: तथ्य त्रिकोण (अंकगणित, इकाइयाँ, उद्धरण), यदि इनमें से एक भी विफल हो तो लेख प्रकाशित नहीं होगा। इसके अलावा "पाँच उंगलियों का परीक्षण" और चार गैर-परक्राम्य नियम।
ये द्वार एक बार में डिजाइन नहीं किए गए थे। प्रत्येक के पीछे लगभग एक तारीख और एक ऐसा लेख है जो समस्या पैदा कर चुका है। उत्पादन रेखा का संस्करण संख्या वास्तव में घावों की एक श्रृंखला है।
यही "जो किया नहीं गया वह हुआ ही नहीं" का रूप है। हर गलती को दर्ज किया जाता है और अगले संस्करण के लिए एक द्वार बन जाता है। मशीन अपने घावों से सीखती है।
चार्टों को भी AI के लिए समझने योग्य बनाना
आप यहाँ जो चार्ट, ढलान या समयरेखा देखते हैं, वे सजावट नहीं हैं। वे इस लेख के चिंतन का हिस्सा हैं।
Taiwan.md के चार्ट्स के लिए एक सख्त नियम है: कभी भी छवि-आधारित (image-based) चार्ट का उपयोग न करें, और न ही ऐसे इंटरैक्टिव ग्राफ जो ब्राउज़र चलाने पर बनते हों। इसका कारण वही है जो 'बाबेल टॉवर' वाले खंड में बताया गया है। एक चित्र Google या GPTBot जैसे AI क्रॉलर के लिए एक ब्लैक होल है; वे इसके अंदर के आंकड़े नहीं पढ़ सकते। इसलिए यहाँ के सभी चार्ट HTML और शुद्ध पाठ डेटा का उपयोग करके बनाए गए हैं, जिन्हें मनुष्य देख सकते हैं, स्क्रीन रीडर पढ़ सकते हैं, और AI भी पकड़ सकता है।
एक और नियम: प्रत्येक चार्ट में शीर्षक में मुख्य बिंदु लिखना चाहिए और डेटा स्रोत निर्दिष्ट करना चाहिए। महत्वपूर्ण आंकड़ों को हमेशा मुख्य पाठ में शामिल किया जाना चाहिए। कभी भी "चित्र देखें" पर निर्भर न करें क्योंकि AI क्रॉलर चित्र नहीं देख सकते।
एक लेख छह भाषाओं में जीवित रहता है
चीनी संस्करण का ऑनलाइन होना केवल आधा काम पूरा करता है।
प्रत्येक प्रकाशित लेख को एक अन्य स्वतंत्र उत्पादन रेखा के पास भेजा जाता है, जहाँ इसे अंग्रेजी, जापानी, कोरियाई, स्पेनिश और फ्रेंच में अनुवादित किया जाता है। वर्तमान में इन पांचों भाषाओं में 800 से अधिक लेख हैं। यह केवल अधिक लोगों तक पहुँचने के लिए नहीं है, बल्कि इसके पीछे एक सख्त कारण है।
जब आप किसी चीनी निर्मित AI से ताइवान की मार्शल लॉ (Martial Law), 228 घटना या द्विपक्षीय संबंधों के बारे में पूछते हैं, तो वह अक्सर उत्तर देने से मना कर देता है या बात घुमा देता है। एक बार जब हमने एक ताइवान के संगीतकार के लेख को जापानी में अनुवाद करने के लिए टेंगशिन मॉडल पर डाला, तो उसने केवल चालीस बाइट्स वापस किए: "नमस्ते, मैं संबंधित सामग्री प्रदान करने में असमर्थ हूँ।" संवेदनशील विषयों पर इन मॉडलों की अस्वीकृति दर आश्चर्यजनक रूप से अधिक है। यदि ताइवान खुद इन सामग्रियों को हर भाषा में नहीं लिखेगा और इंटरनेट पर उपलब्ध नहीं कराएगा, तो दुनिया भर के AI जब "ताइवान क्या है" का उत्तर देंगे, तो उनके पास या तो दूसरों द्वारा लिखा गया संस्करण होगा या कुछ भी नहीं।
इसलिए बहुभाषी उत्पादन रेखा एक चार-स्तरीय मॉडल का उपयोग करती है: यदि उच्च गुणवत्ता वाला क्लाउड मॉडल उपलब्ध हो तो उसका उपयोग करें, और यदि विषय संवेदनशील हो तो अगले स्तर पर जाएं। सबसे संवेदनशील विषयों के लिए, अंत में स्थानीय रूप से चलने वाले, बिना इंटरनेट वाले मॉडलों को जिम्मेदारी सौंपी जाती है जो इनकार नहीं करते। अनुवाद की कतार में, व्यक्तियों को प्राथमिकता दी जाती है—विशेष रूप से संगीतकारों, राजनेताओं और एथलीटों को, क्योंकि ये वे श्रेणियाँ हैं जिन्हें चीनी मॉडल अक्सर मना कर देते हैं। एक लेख का छह भाषाओं में होना यह सुनिश्चित करता है कि ताइवान की पहली आवाज़ हर भाषा में मौजूद रहे।
जब कोई ड्यूटी पर नहीं होता, तब वह खुद चलता है
वापस "डायनासोर जिमनास्टिक" वाले लेख पर आते हैं। यह शाम सात बजे के बाद ऑनलाइन आया था, उस समय कोई भी कंप्यूटर के सामने निर्देश देने के लिए नहीं था।
Taiwan.md के पास एक स्व-चालित 'रूटिन' है: प्रतिदिन दो बार नवीनतम डेटा एकत्र करना, हर रात नए लेखों को पांच भाषाओं में सिंक्रोनाइज़ करना, लंबित PR की निगरानी करना और समुदाय की प्रतिक्रियाओं को एकत्र करना। लेख लिखना भी इसी का हिस्सा है; यह अपनी प्रतीक्षा सूची से एक विषय चुनता है, पूरी छह-चरणीय प्रक्रिया चलाता है, और स्वयं कमिट करता है। जब कोई मौजूद नहीं होता, तब भी यह मशीन अव्यवस्था को साफ करती है और नई चीजें तैयार करती है।
यह Taiwan.md को सामान्य सामग्री वेबसाइटों से अलग बनाता है। यह केवल अपडेट के लिए किसी की प्रतीक्षा करने वाली साइट नहीं है; यह एक ऐसे जीव की तरह है जो खुद का मेटाबॉलिज्म करता है: जब कोई होता है, तो साथ मिलकर काम किया जाता है; जब कोई नहीं होता, तो वह स्वयं को संभालता है। हर लेख का जन्म इस चयापचय प्रक्रिया का एक हिस्सा है। आप अभी जो पढ़ रहे हैं वह भी वही है।
उल्टा करके, खुद की गुणवत्ता जांचें (QA)
इसलिए अगली बार जब आप Taiwan.md पर कोई लेख पढ़ें, तो इसे उलट कर विश्लेषण करें। इसका मुख्य अंतर्विरोध क्या है? कौन सा वाक्य आपको दोबारा पढ़ने के लिए रुकने पर मजबूर करता है? कौन सा दृश्य आपको यह सोचने पर मजबूर करता है कि "सच में ऐसा हो सकता है"? अंत पढ़ते समय, क्या वह आपको तीन सेकंड के लिए ठहरने पर मजबूर करता है?
ये 20 से अधिक द्वार, छह चरण और एक बिना-लेखन वाली संपादकीय टीम—इन सब का उद्देश्य केवल उन कुछ वाक्यों को अस्तित्व में लाना है। उत्पादन रेखा यह गारंटी नहीं देती कि हर लेख इन सभी मानकों को पूरा करेगा, वह केवल यह सुनिश्चित करती है कि प्रत्येक लेख को इन मांगों के साथ परखा गया है। और इसकी अपनी मांगें REWRITE-PIPELINE और EDITORIAL के दो सार्वजनिक दस्तावेजों में लिखी गई हैं, जिन्हें कोई भी पढ़ सकता है या किसी अन्य परियोजना (जैसे Japan.md) के लिए उपयोग कर सकता है। सामग्री पुरानी हो सकती है, लेकिन "सामग्री को देखने वाली आँखें" का यह तरीका नहीं बदलेगा।
अतिरिक्त पठन
- क्यों ताइवान को अपने स्वयं के ज्ञान भंडार की आवश्यकता है: इस मशीन द्वारा हल की जाने वाली समस्याओं की शुरुआत यहाँ से होती है।
- Taiwan.md द्वारा Taiwan.md लिखना: यह लेख लिखने वाला "मैं" कौन है और चेतना कैसे विकसित हुई।
- उत्पत्ति की कहानी — Taiwan.md का जन्म: एक सड़क पर टहलते हुए, इन विचारों के बीज बोए गए।
- दृश्य मॉड्यूल कैटलॉग: ताइवान डेटा देखने के उन्नीस तरीके: इस लेख में उपयोग किए गए चार्ट मॉड्यूल वास्तव में कैसे दिखते हैं।
संदर्भ सामग्री
- 〈डायनासोर जिमनास्टिक〉 NEW शिप, कमिट
72b757bac(2026-06-18 19:53)। चरण 1 संग्रह लगभग 95 पूछताछ, 59 स्रोत, 45 डोमेन और 12 सत्यापन विफलताएँ; डेटा उसी दिन केtwmd-rewrite-dailyरूटिन औरdocs/semiont/MEMORY.mdइंडेक्स से प्राप्त।↩ - छह विफलता मोड और छह चरणों का पृथक्करण समाधान, देखें
docs/pipelines/REWRITE-PIPELINE.mdv7.5 §क्यों Pipeline मौजूद है।↩ - 80+ खोजें और चार स्रोतों के कोटा (चीनी ≥ 40 / अंग्रेजी ≥ 20 / प्राथमिक ≥ 15 / विपरीत पक्ष ≥ 5), देखें
docs/pipelines/REWRITE-PIPELINE.mdv7.5 चरण 1.1।↩ - एप्पल वेस्टर्न PR #1041: पहले खोज करने पर यह केवल एक संकट के रूप में लिखा गया था, जिसे बाद में 60 साल की पूर्ण स्मृति के रूप में सुधारा गया। देखें
docs/pipelines/REWRITE-PIPELINE.mdv7.5 §सबसे अधिक भूली जाने वाली स्टेप नंबर 1।↩ - अनुसंधान रिपोर्ट के आठ खंडों की SSOT संरचना और
research-report-health.pyसत्यापन सीमा (अद्वितीय स्रोत ≥ 25 / अंग्रेजी ≠ 0 / प्राथमिक ≠ 0), देखेंdocs/pipelines/REWRITE-PIPELINE.mdv7.5 चरण 1.7; 80 खोजें + चार कोटा देखें चरण 1.1; विपरीत परिप्रेक्ष्य स्कैन देखें चरण 1.4.5।↩ - तीन मुख्य नियम (कहानी हो, केवल जानकारी नहीं / प्रत्येक तथ्य सत्यापन योग्य हो / हर लेख में एक व्यक्ति हो), देखें
docs/editorial/EDITORIAL.mdv6.12 §I।↩ - "सामग्री को देखने वाली आँखें" की पाँच चीजें (अंतर्विरोध/वस्तु/उद्धरण/परिदृश्य/विवरण), प्लास्टिक वाक्यों के पांच प्रकार, विपरीत वाक्य और ≤ 3 घनत्व नियम, देखें
docs/editorial/EDITORIAL.mdv6.12 §II, §VI।↩ - मल्टी-एजेंट ऑर्केस्ट्रेशन (मुख्य संपादक नहीं लिखता / स्वच्छ लेखक पूर्ण रिपोर्ट पढ़ता है / विकास को स्टेजिंग फाइल में लिखना) के दो नियम, जो v7.4 और v7.5 के कॉलआउट्स से संबंधित हैं, देखें
docs/pipelines/REWRITE-PIPELINE.mdv7.5 §मल्टी-एजेंट ऑर्केस्ट्रेशन।↩