关于 数据打乱 工具
数据打乱工具帮助你随机打乱数据行的顺序,使用业界标准的 Fisher-Yates 洗牌算法,确保每条数据出现在任意位置的概率相等。支持整行打乱和按字段打乱两种模式。
什么是数据打乱?
数据打乱是指将数据集的顺序随机重排,使原始顺序与结果顺序无任何关联。打乱后的数据保持原数据集内容不变,仅顺序变化。常用于消除数据原始顺序带来的偏差。
Fisher-Yates 算法
本工具采用 Fisher-Yates 洗牌算法,时间复杂度 O(n),是公认的最优洗牌算法。每一步从剩余数据中随机选取一条与当前位置交换,保证所有排列组合等概率出现。
使用场景
- A/B 测试:随机分组用户数据。
- 抽签:名单打乱后顺序抽取。
- 消除偏差:消除原始数据顺序影响。
- 测试数据:生成随机顺序的测试集。
- 机器学习:训练前打乱样本顺序。
如何使用
- 粘贴数据,每行一条。
- 可选勾选「保留空行」。
- 可选勾选「按字段打乱」并指定分隔符。
- 点击「打乱」按钮。
- 复制结果。
常见问题 FAQ
Q:打乱是真正的随机吗?
A:使用 Fisher-Yates 算法配合浏览器原生 Math.random,结果均匀分布。
Q:会保留空行吗?
A:默认忽略空行,可勾选「保留空行」选项保留。
Q:按字段打乱是什么?
A:对每行内的字段(按分隔符分割)顺序进行随机打乱,常用于列随机化。