ব্রাউজার ছেড়ে না গিয়েই লাইন সাজান ও ডুপ্লিকেট বাদ দিন
একটি সাধারণ টেক্সট তালিকা দিনের বেলায় আপনি যা সবচেয়ে বেশি কপি, পেস্ট আর কুস্তি করেন তার একটি: ইমেইল ঠিকানার একটি কলাম, কীওয়ার্ডের একটি স্তূপ, ফাইলের নামের একটি তালিকা, বা স্প্রেডশিট থেকে টেনে বের করা সারি। প্রায় সবসময় সেই তালিকা এলোমেলো অবস্থায় আসে। এর ক্রম ঠিক নেই, একই এন্ট্রি তিনবার পুনরাবৃত্তি হয়েছে, আর মাঝে মাঝে খালি লাইন ছড়িয়ে আছে। Sort and Dedupe Lines টুল এক ধাপেই এসব ঠিক করে দেয়। আপনার টেক্সট পেস্ট করুন, কীভাবে সাজাতে চান তা বাছুন, আর এটি সাথে সাথে একটি পরিষ্কার, সাজানো, ডুপ্লিকেট-মুক্ত তালিকা ফিরিয়ে দেয়।

মানুষ আসলে এটি কীসের জন্য ব্যবহার করে
নিত্যদিনের কাজগুলো সহজ কিন্তু পুনরাবৃত্তিমূলক, আর ঠিক এই কারণেই একটি টুল সাহায্য করে। একটি কন্টাক্ট তালিকা পরিষ্কার করা একটি ধ্রুপদী উদাহরণ: আপনি ইমেইল ঠিকানার দুটি এক্সপোর্ট মার্জ করেন আর শত শত ওভারল্যাপিং এন্ট্রি নিয়ে শেষ করেন, তাই ইম্পোর্ট করার আগে আপনি এগুলো ডুপ্লিকেট বাদ দিয়ে একটি ইউনিক সেটে নামিয়ে আনেন। এসইও ও কন্টেন্ট পেশাদাররা কীওয়ার্ড তালিকা নিয়ে একই কাজ করেন, যেখানে একই বাক্যাংশ বিভিন্ন গবেষণা উৎস থেকে ঢুকে পড়ে আর একটিতে গুটিয়ে যাওয়ার দরকার হয়। লেখক ও শিক্ষার্থীরা নাম, রেফারেন্স আর গ্লসারি শব্দ বর্ণানুক্রমে সাজান যাতে একটি বিবলিওগ্রাফি বা ডিরেক্টরি পরিচ্ছন্নভাবে পড়া যায়। ডেভেলপার ও অ্যানালিস্টরা লগ লাইন, কনফিগ এন্ট্রি বা আইডি সাজান একটি ডিফ পাঠযোগ্য করতে বা কী বাদ পড়েছে তা খুঁজে বের করতে। প্রতিটি ক্ষেত্রেই লক্ষ্য একই: একটি বিশৃঙ্খল ব্লবকে একটি সুশৃঙ্খল, অনন্য তালিকায় রূপান্তর করা যার ওপর আপনি ভরসা করতে পারেন।
বাস্তব ক্ষেত্রগুলো কভার করে এমন সর্ট বিকল্প
এজ কেসে পৌঁছানোর আগ পর্যন্ত সাজানো তুচ্ছ শোনায়, তাই টুলটি একটি ভোঁতা বোতামের বদলে কয়েকটি নিয়ন্ত্রণ দেয়। A থেকে Z হলো স্ট্যান্ডার্ড ঊর্ধ্বক্রমিক বর্ণানুক্রম, আর Z থেকে A অবরোহক্রমের জন্য এটি উলটে দেয়। কেস সেনসিটিভিটি মানুষের ধারণার চেয়ে বেশি গুরুত্বপূর্ণ: কেস-সেনসিটিভ সর্টিংয়ে, বড় অক্ষর ছোট অক্ষর থেকে আলাদা দলে গোছায়, তাই "Apple" আর "apple" ভিন্ন জায়গায় পড়ে; কেস-ইনসেনসিটিভ সর্টিংয়ে এগুলো একসাথে বসে, যা মানুষ-পাঠযোগ্য তালিকার জন্য সাধারণত পছন্দনীয়।
আরেকটি বড় বিষয় হলো নিউমেরিক সর্ট। সাধারণ বর্ণানুক্রমিক সর্টিং সংখ্যাকে টেক্সট হিসেবে দেখে, যার অর্থ "10" "2"-এর আগে আসে কারণ এটি অক্ষর ধরে ধরে তুলনা করে। নিউমেরিক মোড প্রতিটি লাইনকে একটি সংখ্যা হিসেবে পড়ে, তাই 2 আসে 10-এর আগে আর 100 শেষে গিয়ে বসে যেখানে এটির থাকার কথা। এই একটি বিকল্পই ভার্সন নম্বর, দাম, টিকিট আইডি, বা যেকোনো তালিকা যেখানে মান শব্দ নয় বরং পরিমাণ, সেগুলো সাজানোর সময় অনেক বিভ্রান্তি বাঁচায়।
ডুপ্লিকেট সরানো ও গোলমাল ছাঁটাই
ডিডুপ্লিকেশন প্রতিটি অনন্য লাইনের প্রথম উপস্থিতি রাখে আর পরবর্তী প্রতিটি কপি বাদ দেয়, তাই সর্টিং প্রয়োগ করার আগে যা অবশিষ্ট থাকে তার ক্রম সংরক্ষিত থাকে। আপনি এটির সাথে কেস-ইনসেনসিটিভ ম্যাচিং জুড়ে দিতে পারেন যাতে "Newsletter" আর "newsletter" দুটি ভিন্ন এন্ট্রির বদলে একই এন্ট্রি হিসেবে স্বীকৃত হয়, যা ইমেইল বা ট্যাগ ডিডুপ করার সময় অপরিহার্য যেগুলো অসামঞ্জস্যপূর্ণভাবে টাইপ করা হয়েছিল।
খালি লাইন আর ছাড়া-ছাড়া হোয়াইটস্পেস গোলমালের আরেকটি উৎস। টুলটি প্রতিটি লাইনের শুরু ও শেষের স্পেস ছেঁটে দিতে পারে আর খালি লাইন সম্পূর্ণভাবে বাদ দিতে পারে, তাই একটি তালিকা যা দেখতে ২৫০টি আইটেম মনে হয়েছিল কিন্তু আসলে ছিল ১৮০টি প্লাস একগাদা ফাঁক, তা পরিপাটি হয়ে ফিরে আসে। ছাঁটাই ডিডুপ্লিকেশনকেও বেশি নির্ভুল করে তোলে, কারণ শুধু শেষের একটি স্পেসের পার্থক্য থাকা দুটি লাইন অন্যথায় ভিন্ন হিসেবে গণনা করা হয়। সর্ট, ডিডুপ ও ছাঁটাই একসাথে চালান আর একটি বিশৃঙ্খল পেস্ট মুহূর্তেই একটি প্রকাশযোগ্য তালিকা হয়ে যায়।

এটি স্থানীয়ভাবে চলে, তাই আপনার টেক্সট আপনারই থাকে
সবকিছু আপনার ব্রাউজারে জাভাস্ক্রিপ্ট ব্যবহার করে ঘটে। আপনার টেক্সট কখনো সার্ভারে আপলোড হয় না, কখনো লগ করা হয় না, আর কখনো পাতা ছেড়ে যায় না, যা গুরুত্বপূর্ণ যখন তালিকাটি একটি গ্রাহকের ইমেইল এক্সপোর্ট, একটি অভ্যন্তরীণ কীওয়ার্ড কৌশল, বা এমন যেকোনো কিছু যা আপনি একটি এলোমেলো ওয়েবসাইটে পেস্ট করতে চাইবেন না। কাজটি স্থানীয় হওয়ায়, এটি দ্রুতও, আর পাতাটি একবার লোড হয়ে গেলে অফলাইনেও কাজ করে। আরও প্রয়োজন হলে, কেস রূপান্তর ও ফরম্যাটিংয়ের জন্য এর সাথে আমাদের অন্যান্য টেক্সট টুল জুড়ে দিন, বা আপনি ঠিক কতগুলো অনন্য লাইনে শেষ করলেন তা নিশ্চিত করতে ফলাফলটি ওয়ার্ড কাউন্টার-এর মধ্য দিয়ে চালান।
প্রায়ই জিজ্ঞাসিত প্রশ্ন
এই টুল কি আমার টেক্সট কোথাও পাঠায়?
না। সমস্ত সর্টিং ও ডিডুপ্লিকেশন আপনার ব্রাউজারে স্থানীয়ভাবে চলে। আপনার টেক্সট আপলোড, সংরক্ষণ বা লগ করা হয় না, আর এটি কখনো আপনার ডিভাইস ছেড়ে যায় না।
A থেকে Z সর্ট আর নিউমেরিক সর্টের মধ্যে পার্থক্য কী?
A থেকে Z লাইনগুলোকে টেক্সট হিসেবে অক্ষর ধরে ধরে তুলনা করে, তাই 10 আসে 2-এর আগে। নিউমেরিক সর্ট প্রতিটি লাইনকে একটি সংখ্যা হিসেবে পড়ে, তাই 2 আসে 10-এর আগে আর মানগুলো তাদের প্রকৃত আকার অনুযায়ী সাজানো হয়।
কেস সেনসিটিভিটি ফলাফলকে কীভাবে প্রভাবিত করে?
কেস-সেনসিটিভ সর্টিংয়ে, বড় ও ছোট অক্ষরকে ভিন্ন হিসেবে বিবেচনা করা হয়, তাই ক্যাপিটালাইজড শব্দগুলো আলাদাভাবে গোছায়। কেস-ইনসেনসিটিভ সর্টিং এগুলোকে একই হিসেবে বিবেচনা করে, যা সাধারণত বেশি স্বাভাবিক পড়া যায় আর শুধু ক্যাপিটালাইজেশনে ভিন্ন এমন ডুপ্লিকেট মার্জ করে দেয়।
একটি ডুপ্লিকেট লাইনের কোন কপিটি রাখা হয়?
প্রতিটি অনন্য লাইনের প্রথম উপস্থিতিটি রাখা হয় আর পরবর্তী প্রতিটি কপি সরিয়ে ফেলা হয়। তারপর আপনি অবশিষ্ট অনন্য লাইনগুলো আপনার পছন্দমতো যেকোনো ক্রমে সাজাতে পারেন।
এটি কি খালি লাইন ও অতিরিক্ত স্পেস সরাতে পারে?
হ্যাঁ। টুলটি প্রতিটি লাইনের শুরু ও শেষের হোয়াইটস্পেস ছেঁটে দিতে পারে আর খালি লাইন বাদ দিতে পারে, যা ডুপ্লিকেট শনাক্তকরণকেও বেশি নির্ভুল করে তোলে।
আমি কতগুলো লাইন প্রসেস করতে পারি তার কোনো সীমা আছে কি?
কোনো নির্দিষ্ট সীমা নেই। যেহেতু প্রসেসিং আপনার ব্রাউজারে হয়, খুব বড় তালিকা আপনার ডিভাইসের ওপর নির্ভর করে, তবে হাজার হাজার লাইনের সাধারণ তালিকা প্রায় মুহূর্তেই সাজানো ও ডিডুপ হয়ে যায়।
