我的方法是,从特斯拉公司的公开财务数据中搜罗了552个所谓的随机数(它们都是生产、销售、费用等运营行为产生的数字),这些数字覆盖了从2018年开始的财报。
我对这些数据按照首位数字从1到9归类,然后和本福特规律对比。
特斯拉的数据和本福特曲线相比似乎并不是特别不着边。但它有它的问题,那就是以1开头的数字相当多,达到了35%,比本福特曲线的比例高了5%。这种情况会发生在怎样的公司呢?
特斯拉的这张图有个影子版本,那就是费尔菲尔德·森特里月度回报数据基金的本福特分布图。费尔菲尔德·森特里基金就是大名鼎鼎的麦道夫骗局基金。
伯纳德·麦道夫曾经是纳斯达克主席,大约从1992年他就开始编织他的庞氏骗局基金,一直骗到了2008年年底受金融危机影响才露馅。麦道夫本人被判了150年徒刑。
麦道夫的基金的数字也有这个特点—“1”多。为什么会有这种现象呢?因为麦道夫的基金要给客户平稳赢利的印象,所以他的基金就像完成作业一样有很多个月的收益都是1%多一点。对于对冲基金来说这几乎是不可能的,那些数据中有很多是麦道夫和他的助手编造的,有的数字甚至是他打高尔夫球时的得分。
一般来说,人们会把自己公司的目标定立为以“1”开头的数字。如果公司运营完成了这些目标,那么在报表中以“1”开头的记录就会特别多,同时以“7”“8”“9”开头的数字会很少。
但总是能如约完成计划的公司是非常令人怀疑的—怎么会总是这么巧呢?
当然了,只凭一张本福特表格不能构成对一家公司的指控,但已经可以增加投资者的怀疑了。
另外,本福特定律除了首位数字统计,还有更厉害的杀手锏,那就是末尾两位数字谎言识别。
末尾两位数字谎言识别,就是统计相当数量的随机数字的末尾两位数字,如果它们真的是随机的,那么这种分布应该是下面这个样子。
从00到99一共100个数字,这些数字的末两位出现的数如果是随机的,它们出现的平均概率应该是1%。
为了验证一下末尾两位数字的测谎功能,我找到了一份我的一个熟人和别人合伙开店的财务单子(很久以前的事了),从中搜罗了449个数据,然后统计了它们的末尾两位数出现情况的概率分布。
怎么从末尾两位数看这些数据是不是瞎编的?
大概可以用下面三个“筛子”,看看这些数字是否异常。
① 某些末两位数出现的频率是否太高?重点关注出现频率占比超过4%的两位数。同时,根本不出现的两位数是否太多?如果这种情况严重,数据经过人为编造的可能性增加。
② 末两位为重复数字的占比是否过低?如果是,数据经过编造的可能性增加。重复数字就是00、55、99之类的数。
③ 降序数字是否过多?如果过多,其中有编造数据的可能性增加。所谓的降序数字就是32、43、54这类数。
通过分析,很遗憾,这是一份令人怀疑的报表。
① 首先,出现频率超过4%的数字有3个,这有点离谱,特别是以36结尾的数字,出现了18次。另外有5个两位数从未出现过,有13个两位数只出现了1次。
总体来说,这些数字的不平均状况有点夸张。
② 重复数字的出现概率比较低,10个两位数一共出现了19次,比平均数低了26次。
③ 降序数频繁出现,一共87次,超过平均数42次。
实际上,总体来说,用本福特定律检查数据是否真实,在民间的应用将更有效。这是因为那些上市公司的数字即使是编造的,但大多数经过了多重美化。但民间的这些往来报表,如果是编造的,那就是赤裸裸的编造,用本福特首数和尾数检测法,大多可以令其原形毕露。