← 全部工具

假数据生成器

生成逼真的假姓名、邮箱、地址和电话号码,用于测试、演示和 QA。随机、私密,完全在浏览器中运行。

假数据生成器到底做什么

你在搭一个注册表单、一张 CRM 表格,或一个 CSV 导入流程,需要往里面填点东西。不是三行毫无意义的"test test test",而是几百条看起来像真实客户的记录:像模像样的姓名、看着能用的邮箱、遵循正确格式的街道地址、格式合理的电话号码。这就是假数据生成器的活儿。它编造出酷似真人、却不属于任何真人的记录。

不同团队对它的叫法不一样。模拟数据、虚拟数据、样本数据、合成数据、测试夹具。意思都一样。你得到一批看起来真实的值,可以丢进数据库、表单、API 或演示界面,从而看看你的软件在真正承载负荷时的表现,而不是空着干等。

深靛蓝空间中由数据流生成的抽象发光资料卡片
记录由随机模式拼装而成,而不是从任何人那里复制。

为什么你需要它

空荡荡的应用会骗你。在只有一行数据时看着没问题的布局,一旦姓名变长或地址折到第二行就崩了。分页、排序、搜索和溢出处理只有在有了一定数据量后才会被真正考验。所以第一个理由很朴素,就是开发本身:你希望在还在搭建界面时,它们就面对真实感的内容。

QA 对它依赖得更狠。好的测试数据会故意覆盖那些刁钻的情况。长姓名、带重音符的字符、带门牌号的地址、一种你的校验器还没见过的电话格式。生成几千行就能让你对它做负载测试,暴露那种只在规模上才出现的 bug,并确认导入流程不会卡住。演示是第三个理由。一个销售界面或一张截图,填上可信的人物会比填上占位乱码有说服力得多,而且你想重新生成多少次都行。

绝不要用真实用户数据来测试

这一点值得态度坚决。把生产数据库里的一小块复制到预发环境很诱人,因为它就在那儿,而且已经够真实了。别这么做。真实记录就是真实的个人身份信息:实实在在的姓名、邮箱、电话和地址,都绑定在活生生的人身上。这些数据一旦落进测试环境、共享表格、工单里的截图或缺陷报告,你就扩大了泄露的波及范围,而且很可能已经越过了隐私的红线。

合成数据完全绕开了这一切。没有谁的身份被暴露,因为这套数据里压根没有真人。你可以把它粘进公开演示、附在支持会话里,或者交给外包人员,全都无需顾虑。在这里,假数据不只是方便,它是负责任的默认选择。除了生产数据库本身,到处都该用它。

你能生成哪些类型的数据

一个像样的生成器能覆盖你反复用到的那些常见形态:全名以及拆开的姓和名、邮箱地址、带城市和邮编的街道地址、电话号码、日期、用户名、公司名以及数字 ID。这些值都遵循真实世界的格式,所以邮箱看着像邮箱,邮编也符合真实邮编的大致规律。正是这种格式让数据有用,因为一个会拒绝垃圾输入的校验器会接受它们。

诀窍在于,这一切都是从姓名列表、域名模式和地址模板里随机拼装出来的。每条记录都是临时缝合的,这意味着你点一下重新生成就能每次得到一批新的。现在要五十行,一小时后要另外五十行?没问题,而且不存在不小心复用到某个真人的风险,因为本来就没有真人。

一串匿名的发光身份卡片在青色与金色光线中流动
每一批都是全新且随机的,完全在你的浏览器中生成。

它完全在你的浏览器中运行

这个工具在本地生成一切。随机的姓名、邮箱和地址都是用你的设备直接在浏览器里构建出来的,你生成的任何内容都不会被发往服务器或存储在任何地方。这有两点意义。它快,因为没有往返请求;它私密,因为没有上传需要担心。生成你需要的,复制出来,刷新再来。如果你想完善整个工作流程,可以浏览我们的全部生成器,或更广的一套开发者工具,用于格式化、转换等场景。

常见问题

生成的数据是基于真实人物的吗?

不是。每条记录都是从姓名列表、域名模式和地址模板里随机拼装的。这些值被设计得看起来真实,但它们不对应任何真人,所以不涉及任何个人身份信息。

为什么我不该直接用真实用户数据来测试?

真实记录是绑定在活生生的人身上的个人数据。一旦它们出现在测试环境、截图或缺陷报告里,你就制造了隐私和泄露风险。合成数据给你真实感的值,却没有那种暴露。

这个工具会把我的数据发往任何地方吗?

不会。生成完全在你自己设备上的浏览器里进行。没有任何东西被上传到服务器,也没有任何东西被存储。你想生成、复制、刷新多少次都行。

我能创建哪些类型的假数据?

常见的包括姓名、邮箱、街道地址、电话号码、日期、用户名、公司名和数字 ID。每一种都遵循真实世界的格式,因此能通过典型的校验。

我能为负载测试生成一大批数据吗?

可以。因为它是随机且本地的,你可以反复重新生成新的批次,想生成多少次都行,用来填充数据库或对导入流程做压力测试。

它真的免费吗?

是的。无需注册,也没有限制。生成你需要的数据,复制出来,想要更多时随时回来。