مولد داده ساختگی واقعاً چه کاری میکند
دارید یک فرم ثبتنام، یک جدول CRM، یا یک جریان وارد کردن CSV میسازید و به چیزی نیاز دارید که آن را پر کند. نه سه ردیف «تست تست تست» که چیزی نمیگویند، بلکه چند صد رکورد که شبیه مشتریان واقعی به نظر میرسند: نامهای قابل باور، ایمیلهای که به نظر کار میکنند، آدرسهای خیابانی که الگوی درست را دنبال میکنند، شماره تلفن با قالببندی منطقی. این کار یک مولد داده ساختگی است. رکوردهایی میسازد که شبیه افراد واقعی هستند بدون اینکه متعلق به هیچکدام از آنها باشند.
افراد بسته به تیم، آن را با نامهای مختلفی صدا میکنند. داده ساختگی، داده آزمایشی، داده نمونه، داده مصنوعی، فیکسچرهای آزمون. ایده همان است. مقادیر واقعگرایانهای میگیرید که میتوانید به پایگاه داده، یک فرم، یک API، یا یک صفحه نمایشی بیندازید تا ببینید نرمافزارتان چطور رفتار میکند وقتی واقعاً باری حمل میکند به جای اینکه خالی باشد.

چرا به آن نیاز دارید
یک اپ خالی به شما دروغ میگوید. طرحبندیهایی که با یک ردیف خوب به نظر میرسند در لحظهای که یک نام طولانی میشود یا یک آدرس به سطر دومی میرود خراب میشوند. صفحهبندی، مرتبسازی، جستجو، و مدیریت سرریز تنها پس از داشتن حجم تمرین میشوند. پس اولین دلیل توسعه ساده است: میخواهید صفحاتتان هنگام ساخت با محتوای واقعگرایانه روبرو شوند.
تضمین کیفیت (QA) بیشتر به آن تکیه میکند. داده آزمایشی خوب موارد ناراحتکننده را عمداً پوشش میدهد. نامهای طولانی، کاراکترهای لهجهدار، آدرسهای با شماره آپارتمان، یک فرمت تلفن که اعتبارسنجتان هنوز ندیده. تولید چند هزار ردیف به شما اجازه میدهد آزمون بار انجام دهید، باگی را که فقط در مقیاس بزرگ ظاهر میشود پیدا کنید، و تأیید کنید که روتینهای وارد کردن خفه نمیشوند. دموها سومین دلیل هستند. یک صفحه فروش یا یک اسکرینشات با افراد قابل باور پر شده بسیار متقاعدکنندهتر از با مزخرفهای placeholder به نظر میرسد، و میتوانید هر چند بار که بخواهید آن را بازتولید کنید.
هرگز با داده کاربر واقعی آزمایش نکنید
این بخشی است که ارزش صریح بودن را دارد. وسوسهای وجود دارد که یک تکه از پایگاه داده تولیدتان را در مرحله آزمایش کپی کنید چون درست آنجاست و از قبل واقعگرایانه است. نکنید. رکوردهای واقعی اطلاعات شخصی شناسندهپذیر (PII) واقعی هستند: نامها، ایمیلها، شماره تلفنها و آدرسهای واقعی متصل به انسانهای واقعی. به محض اینکه این داده در یک محیط آزمایش، یک صفحهگسترده مشترک، یک اسکرینشات در یک تیکت، یا یک گزارش باگ قرار گرفت، شعاع انفجار یک نشت را بزرگتر کردهاید و احتمالاً از یک خط حریم خصوصی عبور کردهاید.
داده مصنوعی از همه اینها اجتناب میکند. هیچ هویتی فاش نمیشود چون هیچ شخص واقعی در مجموعه نیست. میتوانید آن را در یک دمو عمومی paste کنید، به یک تیکت پشتیبانی ضمیمه کنید، یا به یک پیمانکار بدهید بدون فکر ثانوی. داده ساختگی اینجا فقط راحت نیست، بلکه پیشفرض مسئولانه است. از آن همه جا به غیر از پایگاه داده تولیدی استفاده کنید.
چه نوع دادهای میتوانید تولید کنید
یک مولد خوب اشکال رایجی را پوشش میدهد که بارها به آنها میرسید: نام کامل و نام و نامخانوادگی جدا، آدرس ایمیل، آدرس خیابان با شهر و کد پستی، شماره تلفن، تاریخ، نام کاربری، نام شرکت، و شناسههای عددی. مقادیر از فرمتهای دنیای واقعی پیروی میکنند، پس یک ایمیل شبیه ایمیل به نظر میرسد و یک کد پستی با الگوی تقریبی یک کد واقعی مطابقت دارد. همین قالببندی است که داده را مفید میکند، چون اعتبارسنجی که مزخرف را رد میکند، اینها را قبول میکند.
ترفند اینجاست که همه چیز به صورت تصادفی از لیستهای نام، الگوهای دامنه، و قالبهای آدرس مونتاژ میشود. هر رکورد در لحظه دوخته میشود، که یعنی میتوانید بازتولید کنید و هر بار یک دسته تازه بگیرید. الان به پنجاه ردیف نیاز دارید و یک ساعت دیگر به پنجاه ردیف متفاوت؟ مشکلی نیست، و هیچ خطری وجود ندارد که اتفاقاً یک شخص واقعی را مجدداً استفاده کنید، چون اصلاً هیچ شخص واقعی نبوده است.

کاملاً در مرورگر شما اجرا میشود
این ابزار همه چیز را به صورت محلی تولید میکند. نامها، ایمیلها و آدرسهای تصادفی مستقیماً در مرورگر شما با استفاده از دستگاهتان ساخته میشوند، و هیچ چیزی که تولید میکنید به سرور ارسال یا در جایی ذخیره نمیشود. این به دو دلیل مهم است. سریع است، چون رفت و برگشتی وجود ندارد، و خصوصی است، چون نگرانی از آپلود وجود ندارد. آنچه نیاز دارید تولید کنید، کپی کنید، برای بیشتر رفرش کنید. اگر میخواهید یک جریان کار را کامل کنید، همه مولدها یا مجموعه گستردهتر ابزارهای توسعهدهنده را برای چیزهایی مثل قالببندی و تبدیل مرور کنید.
سوالات متداول
آیا داده تولید شده بر اساس افراد واقعی است؟
نه. هر رکورد به صورت تصادفی از لیستهای نام، الگوهای دامنه، و قالبهای آدرس مونتاژ میشود. مقادیر طراحی شدهاند تا واقعگرایانه به نظر برسند، اما با هیچ شخص واقعی مطابقت ندارند، پس هیچ PII درگیر نیست.
چرا نباید از داده کاربر واقعی برای آزمایش استفاده کنم؟
رکوردهای واقعی داده شخصی متصل به افراد واقعی هستند. به محض اینکه در یک محیط آزمایش، یک اسکرینشات، یا یک گزارش باگ قرار بگیرند، یک ریسک حریم خصوصی و نشت ایجاد کردهاید. داده مصنوعی مقادیر واقعگرایانه بدون هیچکدام از آن افشاها میدهد.
آیا ابزار داده من را به جایی میفرستد؟
نه. تولید کاملاً در مرورگر شما روی دستگاه خودتان اتفاق میافتد. هیچ چیزی به سرور آپلود نمیشود و هیچ چیزی ذخیره نمیشود. هر چند بار که بخواهید تولید، کپی و رفرش کنید.
چه نوع داده ساختگی میتوانم ایجاد کنم؟
موارد رایج شامل نام، ایمیل، آدرس خیابان، شماره تلفن، تاریخ، نام کاربری، نام شرکت، و شناسههای عددی هستند. هر کدام از یک فرمت دنیای واقعی پیروی میکند پس اعتبارسنجی معمول را رد میکند.
میتوانم یک دسته بزرگ برای آزمون بار تولید کنم؟
بله. چون تصادفی و محلی است، میتوانید دستههای تازه هر چند بار که نیاز دارید تولید کنید تا پایگاه داده را پر کنید یا یک روتین وارد کردن را تحت فشار آزمایش کنید.
آیا واقعاً رایگان است؟
بله. ثبتنامی نیست و محدودیتی هم نیست. دادهای که نیاز دارید تولید کنید، کپی کنید، و هر وقت بیشتر خواستید برگردید.
