अपना ब्राउज़र छोड़े बिना लाइनें क्रमबद्ध करें और डुप्लिकेट हटाएँ
टेक्स्ट की एक सादी सूची उन चीज़ों में से एक है जिसे आप दिन भर सबसे ज़्यादा कॉपी, पेस्ट और जिससे जूझते हैं: ईमेल पतों का एक कॉलम, कीवर्ड का एक ढेर, फ़ाइल नामों की एक सूची, या स्प्रेडशीट से निकाली गई पंक्तियाँ। लगभग हमेशा वह सूची गड़बड़ हालत में आती है। यह बेतरतीब होती है, इसमें वही प्रविष्टि तीन बार दोहराई जाती है, और इसमें ख़ाली लाइनें बिखरी होती हैं। Sort and Dedupe Lines टूल इन सबको एक ही बार में ठीक कर देता है। अपना टेक्स्ट पेस्ट करें, चुनें कि आप उसे कैसे क्रमबद्ध करना चाहते हैं, और यह तुरंत एक साफ़, क्रमबद्ध, डुप्लिकेट-मुक्त सूची लौटा देता है।

लोग इसका असल में किस लिए उपयोग करते हैं
रोज़मर्रा के काम सरल लेकिन दोहराव वाले होते हैं, और ठीक इसीलिए एक टूल मदद करता है। किसी संपर्क सूची को साफ़ करना एक क्लासिक उदाहरण है: आप ईमेल पतों के दो एक्सपोर्ट मिलाते हैं और सैकड़ों ओवरलैपिंग प्रविष्टियाँ पा जाते हैं, इसलिए इम्पोर्ट करने से पहले आप उन्हें घटाकर एक अनूठे सेट में बदल देते हैं। SEO और कंटेंट से जुड़े लोग कीवर्ड सूचियों के साथ यही करते हैं, जहाँ वही वाक्यांश कई शोध स्रोतों से चुपके से आ जाता है और उसे एक में सिमटना होता है। लेखक और छात्र नाम, संदर्भ और शब्दावली के शब्दों को वर्णानुक्रम में रखते हैं ताकि कोई ग्रंथसूची या निर्देशिका साफ़-सुथरी पढ़ी जाए। डेवलपर और विश्लेषक लॉग लाइनों, कॉन्फ़िग प्रविष्टियों, या ID को क्रमबद्ध करते हैं ताकि कोई diff पढ़ने योग्य बने या यह पता चले कि क्या ग़ायब है। हर मामले में लक्ष्य एक ही है: एक शोरगुल वाले ढेर को एक व्यवस्थित, अनूठी सूची में बदलना जिस पर आप भरोसा कर सकें।
क्रमबद्ध करने के विकल्प जो असली मामलों को कवर करते हैं
क्रमबद्ध करना तब तक मामूली लगता है जब तक आप एज केस पर न पहुँच जाएँ, इसलिए यह टूल एक भोथरे बटन के बजाय आपको कुछ नियंत्रण देता है। A से Z मानक आरोही वर्णानुक्रम है, और Z से A उसे अवरोही क्रम के लिए उलट देता है। केस संवेदनशीलता लोगों की अपेक्षा से ज़्यादा मायने रखती है: केस-संवेदनशील क्रमबद्धन के साथ, बड़े अक्षर लोअरकेस से अलग समूहित होते हैं, इसलिए "Apple" और "apple" अलग-अलग जगहों पर पहुँचते हैं; केस-असंवेदनशील क्रमबद्धन के साथ वे साथ बैठते हैं, जो आमतौर पर मानव-पठनीय सूचियों के लिए आपको चाहिए होता है।
दूसरा बड़ा विकल्प है संख्यात्मक क्रमबद्धन। साधारण वर्णानुक्रमिक क्रमबद्धन संख्याओं को टेक्स्ट की तरह मानता है, जिसका मतलब है कि "10" "2" से पहले आता है क्योंकि यह अक्षर-दर-अक्षर तुलना करता है। संख्यात्मक मोड हर लाइन को एक संख्या की तरह पढ़ता है, इसलिए 2, 10 से पहले आता है और 100 अंत में पहुँचता है जहाँ उसका सही स्थान है। यह एक विकल्प तब बहुत भ्रम बचाता है जब आप वर्शन नंबर, क़ीमतें, टिकट ID, या कोई भी ऐसी सूची क्रमबद्ध कर रहे हों जहाँ मान शब्द नहीं बल्कि मात्राएँ हों।
डुप्लिकेट हटाना और शोर छाँटना
डुप्लिकेट हटाना हर अनूठी लाइन की पहली घटना को रखता है और हर बाद की प्रति को हटा देता है, इसलिए क्रमबद्धन लागू होने से पहले जो बचता है उसका क्रम सुरक्षित रहता है। आप इसे केस-असंवेदनशील मिलान के साथ जोड़ सकते हैं ताकि "Newsletter" और "newsletter" को दो अलग के बजाय एक ही प्रविष्टि के रूप में पहचाना जाए, जो तब ज़रूरी है जब आप असंगत रूप से टाइप किए गए ईमेल या टैग के डुप्लिकेट हटा रहे हों।
ख़ाली लाइनें और इधर-उधर का व्हाइटस्पेस गड़बड़ी का दूसरा स्रोत हैं। टूल हर लाइन से शुरुआती और अंतिम स्पेस छाँट सकता है और ख़ाली लाइनों को पूरी तरह हटा सकता है, इसलिए जो सूची 250 आइटम वाली लगती थी लेकिन असल में 180 के साथ बहुत सारे अंतराल वाली थी, वह साफ़-सुथरी होकर वापस आती है। छँटाई डुप्लिकेट हटाने को भी अधिक सटीक बनाती है, क्योंकि दो लाइनें जो केवल एक अंतिम स्पेस से भिन्न हैं, वरना अलग-अलग गिनी जातीं। क्रमबद्धन, डुप्लिकेट हटाना और छँटाई एक साथ चलाएँ और एक अव्यवस्थित पेस्ट एक सेकंड में प्रकाशन योग्य सूची बन जाता है।

यह स्थानीय रूप से चलता है, इसलिए आपका टेक्स्ट आपका ही रहता है
सब कुछ JavaScript का इस्तेमाल करते हुए आपके ब्राउज़र में होता है। आपका टेक्स्ट कभी किसी सर्वर पर अपलोड नहीं होता, कभी लॉग नहीं होता, और कभी पेज से बाहर नहीं जाता, जो तब मायने रखता है जब सूची किसी ग्राहक का ईमेल एक्सपोर्ट हो, कोई आंतरिक कीवर्ड रणनीति हो, या कुछ और जिसे आप किसी अनजान वेबसाइट में पेस्ट नहीं करेंगे। चूँकि काम स्थानीय है, यह तेज़ भी है और पेज लोड हो जाने के बाद ऑफ़लाइन भी काम करता है। जब आपको और ज़रूरत हो, तो इसे केस रूपांतरण और स्वरूपण के लिए हमारे अन्य टेक्स्ट टूल के साथ जोड़ें, या परिणाम को वर्ड काउंटर में चलाकर पुष्टि करें कि आपके पास कितनी अनूठी लाइनें रह गईं।
अक्सर पूछे जाने वाले सवाल
क्या यह टूल मेरा टेक्स्ट कहीं भेजता है?
नहीं। सभी क्रमबद्धन और डुप्लिकेट हटाना स्थानीय रूप से आपके ब्राउज़र में चलता है। आपका टेक्स्ट अपलोड, संग्रहीत या लॉग नहीं होता, और यह कभी आपके डिवाइस से बाहर नहीं जाता।
A से Z और संख्यात्मक क्रमबद्धन में क्या फ़र्क है?
A से Z लाइनों की अक्षर-दर-अक्षर टेक्स्ट के रूप में तुलना करता है, इसलिए 10, 2 से पहले आता है। संख्यात्मक क्रमबद्धन हर लाइन को एक संख्या की तरह पढ़ता है, इसलिए 2, 10 से पहले आता है और मान उनके असली आकार के अनुसार क्रमबद्ध होते हैं।
केस संवेदनशीलता परिणामों को कैसे प्रभावित करती है?
केस-संवेदनशील क्रमबद्धन के साथ, अपरकेस और लोअरकेस अक्षरों को अलग माना जाता है, इसलिए कैपिटलाइज़ किए गए शब्द अलग समूहित होते हैं। केस-असंवेदनशील क्रमबद्धन उन्हें एक जैसा मानता है, जो आमतौर पर अधिक स्वाभाविक पढ़ा जाता है और उन डुप्लिकेट को मिला देता है जो केवल कैपिटलाइज़ेशन में भिन्न हैं।
किसी डुप्लिकेट लाइन की कौन-सी प्रति रखी जाती है?
हर अनूठी लाइन की पहली घटना रखी जाती है और हर बाद की प्रति हटा दी जाती है। फिर आप बची हुई अनूठी लाइनों को जिस क्रम में चाहें क्रमबद्ध कर सकते हैं।
क्या यह ख़ाली लाइनें और अतिरिक्त स्पेस हटा सकता है?
हाँ। टूल हर लाइन से शुरुआती और अंतिम व्हाइटस्पेस छाँट सकता है और ख़ाली लाइनें हटा सकता है, जो डुप्लिकेट पहचान को भी अधिक सटीक बनाता है।
क्या मैं कितनी लाइनें प्रोसेस कर सकता हूँ इसकी कोई सीमा है?
कोई तय सीमा नहीं है। चूँकि प्रोसेसिंग आपके ब्राउज़र में होती है, बहुत बड़ी सूचियाँ आपके डिवाइस पर निर्भर करती हैं, लेकिन हज़ारों लाइनों वाली सामान्य सूचियाँ लगभग तुरंत क्रमबद्ध हो जाती हैं और उनके डुप्लिकेट हट जाते हैं।
