【发布时间】:2012-12-25 19:48:33
【问题描述】:
我得到了以下有趣的任务:
给定一个包含 100 万个 16 位数字(例如信用卡号)的列表,其中包括 990,000 个由计算机系统生成的纯随机数字,以及 10,000 个由欺诈者手动创建的数字。这些数字被标记为真实或欺诈。构建一个算法来预测非随机数。
到目前为止,我的方法有点暴力:查看非随机数字以找到模式(例如重复数字:22222 或 01234)。
我想知道是否有现成的算法或工具来完成这类任务。我想这个任务在欺诈分析社区中应该很常见。
谢谢。
【问题讨论】:
-
你最好在 math.stackexchange.com 上询问。 AFAIK 通常可以确定整个集合是否是随机生成的,但是您无法在随机生成的数字集中找到手动生成的数字(如果它们之间没有相关性)。
标签: algorithm random fraud-prevention