हिन्दी

CSV से डुप्लिकेट रो हटाएँ

प्रत्येक की पहली प्रति रखते हुए, स्प्रेडशीट निर्यात से दोहराई गई पंक्तियों को हटा दें

टूल यहां लोड होता है. इसके लिए JavaScript की आवश्यकता है, क्योंकि काम आपके डिवाइस पर होता है।

आपकी फ़ाइलें और आपकी गोपनीयता

तुलना की जा रही पंक्तियाँ आपके डिवाइस को कभी नहीं छोड़तीं। फ़ाइल को ब्राउज़र द्वारा पढ़ा जाता है, पार्स किया जाता है इस टैब में एक वेब वर्कर द्वारा, मेमोरी में डी-डुप्लिकेट किया गया और ब्राउज़र द्वारा वापस लिखा गया डाउनलोड तंत्र. टूल कोड फ़ाइल, चिपकाए गए टेक्स्ट आदि को ले जाने का कोई अनुरोध नहीं करता है उत्पन्न आउटपुट. प्रकट किए गए एनालिटिक्स स्क्रिप्ट अनुरोध अलग हैं और इनका वर्णन इसमें किया गया है साइट गोपनीयता नीति.

यह टूल क्या करता है

उन पंक्तियों को हटा दें जो फ़ाइल में पहले से देखी गई पंक्ति को दोहराती हैं। तुलना कवर करती है प्रत्येक कॉलम, पार्स किए गए सेल मानों का उपयोग करता है, केस-संवेदी होता है और व्हाइटस्पेस को मानता है महत्वपूर्ण. पहली घटना जीवित रहती है और जीवित पंक्तियों का क्रम है अपरिवर्तित.

डी-डुप्लीकेशन डेटा पंक्तियों को क्रम में रखता है और प्रत्येक की केवल पहली उपस्थिति रखता है। ए पंक्ति तब डुप्लिकेट होती है जब इसकी प्रत्येक कोशिका तुलनात्मक रूप से पिछली पंक्ति से बिल्कुल मेल खाती है पार्सिंग के बाद, इसलिए उद्धरण चिह्नों के अंदर लिखा गया फ़ील्ड बिना लिखे गए फ़ील्ड के बराबर होता है उन्हें. केस और रिक्त स्थान दोनों की गिनती होती है: Ada, ada और Ada, अनुगामी स्थान के साथ तीन हैं अलग पंक्तियाँ. डुप्लिकेट को आसन्न होने की आवश्यकता नहीं है, और जो पंक्तियाँ बच जाती हैं वे वहीं रहती हैं थे.

इसका उपयोग कैसे करना है

  1. CSV या JSON फ़ाइल चुनें चुनें और निर्यात लोड करें।
  2. सबसे पहले पंक्तियों की संख्या पर ध्यान दें, क्योंकि टूल यह बताता है कि कितनी पंक्तियाँ बची हैं न कि कितनी बहुतों ने इसे हटा दिया।
  3. यदि कोशिकाओं को गद्देदार किया जा सकता है, तो व्हाइटस्पेस ट्रिम करें का चयन करें, क्योंकि पंक्तियों में केवल एक स्थान का अंतर होता है डुप्लिकेट नहीं.
  4. डुप्लिकेट पंक्तियाँ हटाएँ चुनें, संदेश में शेष गिनती पढ़ें, फिर चुनें CSV डाउनलोड करें या पूर्ववत करें।

उदाहरण उपयोग के मामले

समर्थित इनपुट और आउटपुट

स्वीकार

का उत्पादन

यह टूल क्या नहीं करेगा

सामान्य गलतियां

तकनीकी नोट्स

प्रत्येक पंक्ति को उसके कक्षों को NUL वर्ण के साथ जोड़कर एक पहचान कुंजी में बदल दिया जाता है, जो कानूनी तौर पर CSV पाठ में प्रकट नहीं हो सकता। इसके बजाय अल्पविराम पर जुड़ने से एक कक्ष जुड़ जाएगा a,b युक्त, a और b युक्त दो कोशिकाओं से टकराता है, जो एक डी-डुप्लीकेटर है गलत पंक्ति को चुपचाप हटा देता है। कुंजियाँ हैश सेट में जाती हैं, इसलिए स्कैन एक रैखिक होता है पास और डुप्लिकेट पास-पास होने के बजाय जहां भी बैठते हैं वहां पाए जाते हैं, और परिवर्तन एक नई सरणी लौटाता है इसलिए पूर्ववत करें पिछली तालिका को बिल्कुल पुनर्स्थापित करता है।

अक्सर पूछे जाने वाले प्रश्नों

क्या यह पहली या आखिरी प्रति रखता है?
पहला। मूल पंक्ति यथावत रहती है और बाद में प्रतियां हटा दी जाती हैं, इसलिए क्रम आपके द्वारा रखा गया डेटा अपरिवर्तित है. यदि बाद की प्रतियाँ संशोधित हैं, तो क्रमबद्ध करें या संपादित करें फ़ाइल ताकि आप जो संस्करण चाहते हैं वह पहले आए।
क्या मैं ईमेल जैसे एक कॉलम से डी-डुप्लिकेट कर सकता हूँ?
प्रत्यक्ष नहीं; बटन पूरी पंक्तियों की तुलना करता है। आप केवल उस कॉलम पर टिक कर सकते हैं, चयन करें कॉलम चयन लागू करें और फिर डी-डुप्लिकेट करें, लेकिन इससे केवल टिक किया हुआ कॉलम ही रहता है यदि आपको अन्य फ़ील्ड की आवश्यकता हो तो बाद में पूर्ववत करें।
एक स्पष्ट डुप्लिकेट अभी भी वहां क्यों है?
पंक्ति में कुछ अलग है: एक अनुगामी स्थान, एक वेब से चिपकाया गया एक गैर-ब्रेकिंग स्थान पृष्ठ, एक अलग पत्र केस, या एक कॉलम जिसे आप भूल गए थे जैसे कि एक पंक्ति आईडी या एक निर्यात टाइमस्टैम्प.