英文原文地址:Benford’s Law and Accounting Fraud Detection

本福特定律

基本概念

本福特定律(也称为第一位数法或本福特分布)是一种概率分布,许多统计学的(但不是全部)数据集的第一个数字符合。 例如,

15435 是1
56    是5
9001  是9
199   是1
9     是9

本福特定律通常可用作欺诈性数据的指标,并可协助审计会计数据。本福特的分布是一种不均匀的分布,较小的数字比较大的数字有更大的出现j可能。

数位分布概率

第1位数字 出现概率
1 0.301
2 0.176
3 0.125
4 0.097
5 0.079
6 0.067
7 0.058
8 0.051
9 0.046

本福特分布图

本福特分布公式

P(d)=log10(d+1)−log10d=log10(1+1d)P(d) = log_{10}(d + 1)-log_{10}d = log_{10}(1 + \frac{1}{d})P(d)=log10​(d+1)−log10​d=log10​(1+d1​)

本福特定律适用于哪类数据?

在大部分情况下,本福特定律可以适用于具有以下特征的数据:

  • 具有通过来自多个分布的数字的数学组合形成的值的数据。
  • 具有多种数字的数据,例如 具有数百,数千,数万等数值的数据。
  • 数据集相当大。
  • 数据是右倾斜的,即平均值大于中值,并且分布具有长的右尾而不是对称的。
  • 数据没有预定义的最大值或最小值(最小值为零)。

虽然有以上的限制,但实际上在会计中,符合上述特征的数据非常普遍。

会计欺诈检测与取证分析

应收账款,应付账款,销售和费用数据均基于两种类型的变量相乘的值,即价格和数量。 单独,价格和数量不太可能符合本福特定律,但很可能会成倍增加。 这种会计数据也可能是正确的。 大公司的交易级会计数据几乎总是会有大量的观察结果。

如果某些会计数据预计符合本福特定律但不符合,则并不一定意味着数据是欺诈性的。 然而,这将为进一步调查提供充分的理由。

以下是如何对会计数据执行本福特分布分析的一些示例。

示例1 大型企业的应付账款数据

分析显示,大型企业的应付几款的数据的数字第一位数字中有很大比例的1。经过仔细检查后发现,与上一个会计期间相比,还有更多的支付支票略高于1000美元。前一期的大部分支票金额低于100美元。

在一起财务调查中,负责的财务官随后受到质疑,他们回答称他们决定汇总金额以试图减少支票。低数字金额的合并是偏离本福特定律的常见解释,使财务官的解释变得合情合理。

经过进一步调查,据透露,该官员正在向他们创建的虚假壳公司写支票。

示例2:本福特的分析应用于组织的费用数据。

最初的本福特分析显示,数据的第一位数字中“非常大”的比例非常大。经过仔细检查,特定费用的许多条目达到45美元。发现费用对于运营组织至关重要,必须经常支付。调查了这笔特殊费用,然后被认为是合法的。

然后将Benford的分析应用于费用数据的副本,但省略了特定的频繁费用。发现排除该特定费用的数据与本福特的分布非常接近。

超越第一个数字推广本福特定律

通过查看第一个数字以外的数字,可以增强Benford的分析。

广义本福特的分布表

译者:本表的作用是表示分布规则还可以作用在不同的数位上。比如,0出现在第2位的概率是 11.97%,要高于平均值10%。

数位 第1位 第2位 第3位 第4位 第5位
0 NA 0.11968 0.10178 0.10018 0.10002
1 0.30103 0.11389 0.10138 0.10014 0.10001
2 0.17609 0.10882 0.10097 0.10010 0.10001
3 0.12494 0.10433 0.10057 0.10006 0.10001
4 0.09691 0.10031 0.10018 0.10002 0.10000
5 0.07918 0.09668 0.09979 0.09998 0.10000
6 0.06695 0.09337 0.09940 0.09994 0.09999
7 0.05799 0.09035 0.09902 0.09990 0.09999
8 0.05115 0.08757 0.09864 0.09986 0.09999
9 0.04576 0.08500 0.09827 0.09982 0.09998

注意:由以上数据可以看出,在广义分布中,数字的出现概率要比第一个数字更加均匀。

一般分布公式

P(d)=∑k=10n−210n−1−1log10(1+110k+d)P(d)=\sum_{k=10^{n-2}}^{10^{n-1} - 1}log_{10}(1 + \frac{1}{10k+d}) P(d)=k=10n−2∑10n−1−1​log10​(1+10k+d1​)

【翻译】本福特定律和统计中的造假检测相关推荐

  1. python暴力实现本福特定律的例子

    概率论给予了我们现实生活直观感觉完全不一样的解释,现实生活中的本福特定律就是一个很好的例子: 就像我们对考第一名印象很深刻,但是之后的第二第三就不怎么去留意;奥运冠军也是一样,所有人都会记得冠军是谁, ...

  2. delhpi7 tcombobox清楚重复项_专利数据统计中需要搞清楚的首要问题(2)

    上一篇专利数据统计中需要搞清楚的首要问题(1)介绍了通过合并申请号避免重复统计,理清了专利篇数和专利件数的问题,那么还有一类统计就是对发明项数的统计,这里就涉及到对同一项发明的重复统计问题.上一篇介绍 ...

  3. 消解原理推理_什么是推理统计中的Z检验及其工作原理?

    消解原理推理 I Feel: 我觉得: The more you analyze the data the more enlightened, data engineer you will becom ...

  4. 常见数字规律:帕累托定律与本福特定律

    帕累托定律:又名二八定律,揭示了一类常见的投入-产出不平衡的现象,认为80%的产出实际上是由20%的最top的投入决定的. 这个定律适用范围非常广泛,比如少部分大客户,贡献了大部分的销售额,巨量的财富 ...

  5. 本福特定律(Benford‘s law)的直观解释

    若待查自然数集是均匀分布的,可用f(x)=10xf(x)=10^xf(x)=10x表示: xxx在[0,1)[0,1)[0,1)区间,f(x)f(x)f(x)从1到10. xxx在[1,2)[1,2) ...

  6. 捍卫数据真实性的卫士-本福特定律

    互联网内容很难分辨真伪,一旦发生一些集中性的事件,无论是吹水公众号,工作不饱和的程序员以及一些不怀好意者都喜欢蹭热度,博流量,这些人对于数据,大数据均有理解和掌握,但普遍过于 时尚 ,就事论事便缺乏跨 ...

  7. 用上市公司2019年报净利润数据验证本福特定律

    在疫情期间,听到一个消息:有国外研究者用"本福特"定律验证了中国公布的疫情信息,显示数据是真实可信的.这是第一次听到这个名字,感觉很神奇,它竟然能够验证数据有无作假. 上网查了一下 ...

  8. 使用wps2019的表格验证数据造假与否(本福特定律)

    观看了李永乐老师的视频,用了图标的方式来解释本福特定律,很是受用,使用wps 中的表图来表示非常方便,步骤如下: 1.打开wps表格. 2.创建一列1-9的数字. 另起一列,输入公式: 3.再起一列, ...

  9. 本福特定律和齐夫定律是一回事吗

    关于本福特定律的简单解释和推导,参见: https://zhuanlan.zhihu.com/p/440462854 思考本福特定律,与齐夫定律对照,它们之间似乎可以相互推导,是真的吗? 本福特定律说 ...

最新文章

  1. python 字典中的value 不在字典中,key才在
  2. 修改Kali Linux 2020.1主题颜色
  3. MySQL 数据库 练习题
  4. 步骤6 - WebSocket服务器把请求的响应结果推送给webshop
  5. 使用CallableStatement处理Oracle数据库的存储过程
  6. Python云端系统开发入门 pycharm代码
  7. android sqlite配置,60. (android开发)SQLite作为APP应用的配置打包
  8. java中ImageIcon路径问题
  9. 学编程语言,记不住代码怎么办?
  10. 使用软件或Python编程时EIS拟合的底层逻辑(EIS拟合的原理/过程)
  11. 朝阳正规的计算机学校有哪些,朝阳都有哪些专科学校
  12. 路由器安装教程和使用方法
  13. python+基于Python的资产管理系统 毕业设计-附源码201117
  14. 探究网络信息安全问题及防范措施
  15. react+amcharts5柱状图demo
  16. 微信小程序发布正式版规则,累的教训(小程序审核常见驳回类型-可用性和完整性问题)
  17. 这两天比较火的量子科技是什么?
  18. android 高德地图定位缓慢,Android高德地图定位逻辑优化
  19. OpenWRT 学习笔记 -- 用户自定义添加app的开机自启动
  20. LaTeX复选框实现

热门文章

  1. 第一招:考拉网,菜鸟的市场就是蓝海
  2. 01《穿越时空的git》科幻小电影-Git创建版本库和常用命令操作-提交、回退、撤销、删除
  3. pkr车牌识别系统服务器,JAT-PKR-交安通PKR停车场车牌识别管理系统
  4. 4399客户端实习生笔试
  5. 在iOS程序中检测数字和链接
  6. TensorFlow 强化学习:6~10
  7. 应用在手机消毒领域中的紫外线传感器
  8. Farrago for Mac(音频编辑软件)
  9. 45度角地图坐标计算 和 层级计算
  10. scrcpy—Android投屏神器