Ինչ է իրականում անում կեղծ տվյալների գեներատորը
Դուք կառուցում եք գրանցման ձև, CRM աղյուսակ կամ CSV ներմուծման հոսք, և ձեզ պետք է այն ինչ-որ բանով լցնել։ Ոչ երեք տող «test test test», որոնք ոչինչ չեն ասում ձեզ, այլ մի քանի հարյուր գրառում, որոնք նման են իրական հաճախորդների. հավանական անուններ, աշխատող-երևացող էլփոստեր, փողոցի հասցեներ, որոնք հետևում են ճիշտ օրինաչափությանը, հեռախոսահամարներ ողջամիտ ֆորմատով։ Հենց սա է կեղծ տվյալների գեներատորի աշխատանքը։ Այն հորինում է գրառումներ, որոնք նման են իրական մարդկանց, առանց նրանցից որևէ մեկին պատկանելու։
Մարդիկ սա տարբեր բան են անվանում՝ կախված թիմից. mock data, dummy data, sample data, synthetic data, test fixtures։ Գաղափարը նույնն է։ Դուք ստանում եք իրատեսական տեսք ունեցող արժեքներ, որոնք կարող եք նետել տվյալների բազայի, ձևի, API-ի կամ demo էկրանի վրա, որպեսզի տեսնեք, թե ինչպես է ձեր ծրագրաշարը իրեն պահում, երբ իսկապես ծանրաբեռնված է, այլ ոչ թե դատարկ նստած։

Ինչու է ձեզ պետք դա
Դատարկ հավելվածը ձեզ ստում է։ Դասավորությունները, որոնք լավ են թվում մեկ տողով, կոտրվում են, հենց որ անունը երկար դառնա, կամ հասցեն ծալվի երկրորդ տողի։ Էջավորումը, դասավորումը, որոնումը և գերբեռնվածության մշակումը փորձարկվում են միայն ծավալի դեպքում։ Ուստի առաջին պատճառը հենց մշակումն է. ցանկանում եք, որ ձեր էկրանները հանդիպեն իրատեսական բովանդակության, մինչ դեռ կառուցում եք դրանք։
QA-ն ավելի շատ է ապավինում դրան։ Լավ թեստային տվյալները մտադրված ընդգրկում են դժվար դեպքերը։ Երկար անուններ, շեշտադրված նիշեր, բնակարանի համարներով հասցեներ, հեռախոսի ֆորմատ, որին ձեր վալիդատորը դեռ չի հանդիպել։ Մի քանի հազար տող ստեղծելը թույլ է տալիս ծանրաբեռնվածության թեստ անել, հայտնաբերել սխալ, որը երևում է միայն մասշտաբում, և հաստատել, որ ներմուծման ընթացակարգերը չեն խեղդվում։ Demo-ները երրորդ պատճառն են։ Վաճառքի էկրանը կամ screenshot-ը շատ ավելի համոզիչ է թվում՝ լցված հավատալի մարդկանցով, քան placeholder-ի անհեթեթությամբ, և կարող եք վերաստեղծել այն այնքան հաճախ, որքան ցանկանում եք։
Երբեք մի թեստավորեք իրական օգտատերերի տվյալներով
Սա այն մասն է, որի հանդեպ արժե խիստ լինել։ Գայթակղիչ է production տվյալների բազայի մասնիկը պատճենել staging-ի մեջ, քանի որ այն ուղղակի այնտեղ է, ու արդեն իրատեսական։ Մի արեք դա։ Իրական գրառումները իրական PII են՝ իրական մարդկանց հետ կապված իրական անուններ, էլփոստեր, հեռախոսահամարներ ու հասցեներ։ Հենց այդ տվյալները հայտնվում են թեստային միջավայրում, ընդհանուր աղյուսակում, screenshot-ում tickets-ի մեջ, կամ սխալի հաշվետվության մեջ, դուք ընդլայնում եք արտահոսքի ազդակիրը և, հնարավոր է, հատում եք գաղտնիության սահմանագիծը։
Սինթետիկ տվյալները շրջանցում են այս ամենը։ Ոչ ոքի ինքնությունը չի բացահայտվում, քանի որ հավաքածուի մեջ ոչ մի իրական մարդ չկա։ Կարող եք տեղադրել այն հանրային demo-ի մեջ, կցել support thread-ին, կամ հանձնել կապալառուին՝ առանց երկրորդ մտածելու։ Կեղծ տվյալները ոչ միայն հարմար են այստեղ, դա պատասխանատու կանխադրված ընտրություն է։ Օգտագործեք այն ամենուր, բացի հենց production տվյալների բազայից։
Ի՞նչ տեսակի տվյալ կարող եք ստեղծել
Բավարար լավ գեներատորն ընդգրկում է ընդհանուր ձևերը, որոնց հաճախ դիմում եք. ամբողջական անուններ և առանձնացված անուն-ազգանուն, էլփոստի հասցեներ, փողոցի հասցեներ՝ քաղաքով և փոստային կոդով, հեռախոսահամարներ, ամսաթվեր, մուտքանուններ, ընկերության անուններ և թվային ID-ներ։ Արժեքները հետևում են իրական աշխարհի ֆորմատներին, ուստի էլփոստը նման է էլփոստի, և փոստային կոդը համապատասխանում է իրական կոդի մոտավոր օրինաչափությանը։ Հենց այս ֆորմատավորումն է դարձնում տվյալները օգտակար, քանի որ վալիդատորը, որը մերժում է անհեթեթություն, ընդունում է սրանք։
Հնարքն այն է, որ ամեն ինչ պատահականորեն հավաքվում է անունների ցուցակներից, դոմեյնի օրինաչափություններից և հասցեների ձևանմուշներից։ Յուրաքանչյուր գրառում կպցվում է թռիչքով, ինչը նշանակում է, որ կարող եք սեղմել regenerate և ամեն անգամ ստանալ թարմ խմբաքանակ։ Հիմա ձեզ պետք է հիսուն տող, և մեկ ժամից՝ մեկ այլ հիսուն։ Ոչ մի խնդիր, և ոչ մի ռիսկ, որ պատահաբար կրկնեք իրական մարդու տվյալները, քանի որ երբեք չի եղել իրական մարդ։

Այն աշխատում է ամբողջովին ձեր բրաուզերում
Այս գործիքը ամեն ինչ ստեղծում է լոկալ։ Պատահական անունները, էլփոստերն ու հասցեները կառուցվում են ուղիղ ձեր բրաուզերում, ձեր սարքի միջոցով, և ինչ էլ ստեղծեք, ոչ մի սերվեր չի ուղարկվում, ոչ մի տեղ չի պահվում։ Սա կարևոր է երկու պատճառով։ Դա արագ է, քանի որ չկա round trip, և գաղտնի է, քանի որ չկա upload, որի մասին անհանգստանալ։ Ստեղծեք ինչ անհրաժեշտ է, պատճենեք, թարմացրեք՝ ավելիի համար։ Եթե ցանկանում եք լրացնել ձեր աշխատահոսքը, դիտեք մեր բոլոր գեներատորները կամ ծրագրավորողի գործիքների ավելի լայն ընտրանին՝ ֆորմատավորման և փոխարկման նման խնդիրների համար։
Հաճախ տրվող հարցեր
Ստեղծված տվյալները հիմնվա՞ծ են իրական մարդկանց վրա
Ոչ։ Յուրաքանչյուր գրառում պատահականորեն հավաքվում է անունների ցուցակներից, դոմեյնի օրինաչափություններից և հասցեների ձևանմուշներից։ Արժեքները նախագծված են իրատեսական թվալու, բայց չեն համապատասխանում ոչ մի իրական մարդու, ուստի PII-ի հետ կապ չկա։
Ինչու՞ չպետք է օգտագործեմ իրական օգտատերերի տվյալները թեստավորման համար
Իրական գրառումները անձնական տվյալներ են, կապված իրական մարդկանց հետ։ Հենց նրանք հայտնվում են թեստային միջավայրում, screenshot-ում կամ սխալի հաշվետվության մեջ, դուք ստեղծել եք գաղտնիության և արտահոսքի ռիսկ։ Սինթետիկ տվյալները տալիս են իրատեսական արժեքներ՝ առանց այդ ռիսկի։
Գործիքն իմ տվյալները ինչ-որ տեղ ուղարկո՞ւմ է
Ոչ։ Ստեղծումն ամբողջովին կատարվում է ձեր բրաուզերում, ձեր սեփական սարքի վրա։ Ոչինչ սերվեր չի բեռնվում, և ոչինչ չի պահվում։ Ստեղծում եք, պատճենում եք և թարմացնում այնքան հաճախ, որքան ցանկանում եք։
Ի՞նչ տեսակի կեղծ տվյալ կարող եմ ստեղծել
Ընդհանուր տեսակների մեջ են անուններ, էլփոստեր, փողոցի հասցեներ, հեռախոսահամարներ, ամսաթվեր, մուտքանուններ, ընկերության անուններ և թվային ID-ներ։ Յուրաքանչյուրը հետևում է իրական աշխարհի ֆորմատի, ուստի անցնում է սովորական վալիդացիան։
Կարո՞ղ եմ ստեղծել մեծ խմբաքանակ load testing-ի համար
Այո։ Քանի որ այն պատահական է և լոկալ, կարող եք վերաստեղծել թարմ խմբաքանակներ այնքան անգամ, որքան անհրաժեշտ է տվյալների բազա լցնելու կամ ներմուծման ընթացակարգը սթրեսի ենթարկելու համար։
Դա իսկապես անվճա՞ր է
Այո։ Չկա գրանցում և չկա սահմանափակում։ Ստեղծեք անհրաժեշտ տվյալները, պատճենեք, և վերադարձեք, երբ ցանկանում եք ավելին։
