डुप्लिकेट लाइन रिमूवर के बारे में
यह किसी सूची से दोहराई गई लाइनें निकाल देता है, हर एक की केवल पहली उपस्थिति रखते हुए। ईमेल या पते की सूची डी-डुप्लिकेट करने, किसी मर्ज किए एक्सपोर्ट को साफ़ करने जहाँ पंक्तियाँ दो बार आती हैं, कीवर्ड या टैग सूची व्यवस्थित करने, या किसी लॉग को उसकी अद्वितीय लाइनों तक घटाने का यह त्वरित समाधान है। विकल्प आपको लाइनों को डुप्लिकेट मानने देते हैं भले ही वे केवल कैपिटलाइज़ेशन या आगे-पीछे के स्पेस से भिन्न हों।
यह कैसे काम करता है
यह आपके टेक्स्ट को लाइनों में बाँटता है और उन्हें क्रम में देखता है, याद रखते हुए कि कौन-सी देखी। किसी लाइन के पहली बार आने पर वह रखी जाती है; बाद की कोई भी समान लाइन हटा दी जाती है, और एक लाइव गिनती बताती है कि कितने डुप्लिकेट हटाए गए। "समान" क्या गिना जाता है यह टॉगल पर निर्भर करता है:
- व्हाइटस्पेस ट्रिम करें — तुलना करते समय आगे/पीछे के स्पेस अनदेखा किए जाते हैं (और आउटपुट में ट्रिम किए जाते हैं)।
- केस अनदेखा करें —
Appleऔरappleको एक ही लाइन माना जाता है। - खाली लाइनें हटाएँ — खाली लाइनें रखने के बजाय पूरी तरह हटा दी जाती हैं।
मान्यताएँ और व्यवहार
- पहली उपस्थिति जीतती है और शेष लाइनों का मूल क्रम संरक्षित रहता है — यह क्रमबद्ध नहीं करता।
- तुलनाएँ ट्रिम और केस-फ़ोल्डिंग केवल तभी लागू करती हैं जब आप उन्हें सक्षम करें; डिफ़ॉल्ट रूप से, डुप्लिकेट गिने जाने के लिए लाइनों का ठीक-ठीक मेल होना चाहिए (स्पेसिंग और केस सहित)।
- ट्रिम चालू होने पर, रखी गई लाइनें ट्रिम की हुई दिखाई जाती हैं, केवल ट्रिम करके तुलना नहीं।
सीमाएँ
- यह केवल पूर्ण-लाइन डुप्लिकेट हटाता है — किसी लाइन के भीतर दोहराए गए शब्द, या किसी अक्षर या विराम-चिह्न से भिन्न लगभग-डुप्लिकेट नहीं खोज सकता।
- "केस अनदेखा करें" सरल लोअरकेसिंग उपयोग करता है, जो अंग्रेज़ी के लिए विश्वसनीय है पर हर उच्चारण-चिह्नित या गैर-लैटिन अक्षर को लोकेल-सजग तुलना की तरह फ़ोल्ड न करे।
- यह हर डुप्लिकेट की पहली रखता है; इसके बजाय अंतिम रखने का कोई विकल्प नहीं है।
- बहुत बड़ी सूचियाँ आपके ब्राउज़र में मेमोरी में प्रोसेस होती हैं, इसलिए अत्यधिक बड़ी फ़ाइलें उपलब्ध RAM पर निर्भर करती हैं।
गोपनीयता
डी-डुप्लिकेशन पूरी तरह आपके ब्राउज़र में चलता है। आपकी सूची कभी अपलोड या संग्रहीत नहीं होती।

