全プロセスの詳細解説
-
200件中24件の経費精算に対する期待度数とカイ二乗寄与度 6 ステップ
監査役が200件の経費精算書を抽出したところ、そのうちの24件が数字の1から始まっていることがわかりました。これはベンフォードの法則と整合するでしょうか。期待される件数、その数字単独でのカイ二乗値への寄与、そして何らかの行動を起こす前にテスト全体として何が必要になるかを計算してください。
-
まず、法則から期待される値を求めます。先頭数字が1である確率は log₁₀(1 + 1/1) = log₁₀ 2 = 0.30103 です。したがって、200件の精算書に対する期待件数は 0.30103 × 200 となります。
-
計算すると 60.2 件になります。監査役が見つけたのは 24 件でした。その差は 36.2 件ですが、これは法則が圧倒的に最も多いはずだと予測している数字での不足なのです。
-
カイ二乗は数字ごとに項を足し合わせます。それぞれの項は (観測値 − 期待値)² ÷ 期待値 で求められます。先頭数字が1の場合、この項は (24 − 60.21)² ÷ 60.21 となります。
-
(−36.21)² は 1,310.9 になり、これを 60.21 で割ると 21.77 が得られます。テスト全体の自由度は8であり、有意水準5%の棄却限界値は 15.507 です。つまり、この数字一つの結果だけで、統計量はすでに単独で棄却域に達していることになります。
-
これは、計算は終わったものの、推論はまだ終わっていないことを意味します。カイ二乗値はサンプル数に比例して大きくなります。もし2,000件の精算書で同じ割合の不足が出た場合、その項は10倍の大きさになります。そのため、大規模で不正のないクリーンなデータセットであっても、誰も詐欺とは呼ばないようなわずかなズレでテストに落ちてしまう可能性があるのです。これこそが、監査役がサンプルサイズ n とともに増大しない平均絶対偏差を代わりに引用する理由です。
-
率直に読めば、この200件の申請に見られる先頭数字の分布は、ベンフォードの法則による予測と一致していません。ただし、それが何の証拠なのかは、数字だけでは判断できません。たとえば、承認基準額を£999に設定している会社では、何ら不自然な事情がなくても先頭に九が集中します。日額を一律に定めて精算する会社でも同じことが起こります。
解答
1から始まる精算書の期待件数は 60.2 件ですが、実際には 24 件でした。この数字単独で 21.77 という値を統計量にもたらしますが、5%水準の棄却限界値は 15.507 です。したがってテスト結果は棄却となりますが、棄却と不正の検出は同じではありません。ベンフォードの法則は監査役にどこを見るべきかを示すフィルターであり、1990年代のマーク・ニグリーニによる税務調査以降、その役割について発表されたすべての事例において、不適合はあくまでファイルを調査するきっかけとして扱われており、結論として扱われているわけではありません。このツールがカイ二乗値の横に平均絶対偏差を表示しているのはまさにそのためです。データセットのサイズを5,000に変更してみれば、偏差はほとんど動かないのにカイ二乗値だけが跳ね上がるのを確認できるでしょう。
-
-
カイ二乗0.2、そしてなぜそれこそが疑わしいのか 6 ステップ
フィボナッチ数列のプリセットを読み込んでください。カイ二乗値は0.2、有意水準5%の棄却限界値は15.507ですから、この数列は余裕をもってテストを通過します。これほど良い適合がどれほど起こりにくいことなのかを計算し、そのうえで、きわめて小さいカイ二乗値が監査役に何を告げているのかを判断してください。
-
まず度数を見比べます。1,000個のフィボナッチ数のうち先頭が1のものは301個で、法則の予測は301.03個です。九つの区分で最も食い違いが大きいのは数字の7で、観測56に対して期待57.99。近いという水準ではありません。ほぼ完全な一致です。
-
自由度8のカイ二乗分布は、平均が8、標準偏差が4です。カードの表示は0.2ですが、その背後にある値は0.1695であり、ゼロより下には行けない統計量の平均から、標準偏差二つ分も下に位置しています。
-
ここでの下側確率には閉じた式があります。自由度が8なら不完全ガンマ関数は四項に収まるからです。数表は要りません。
-
0.1695を代入すると 2.0 × 10⁻⁶ が得られます。これほど法則に合うサンプルは、およそ50万回に1回です。同じ規模のまま、データセットを対数的に均等な分布、つまり法則を生む仕組みそのものを無作為に引いたものに切り替えてみてください。カードは5.6を示します。
-
理由は、フィボナッチ数がそもそもサンプルではなかったことにあります。log₁₀ Fₖ は k log₁₀ φ から定数を引いたものですから、先頭数字を決めるのは 0.2089876… の倍数の小数部分であり、この数は無理数です。こうした数列が一様に散らばることは、ワイルが1916年に証明しました。
-
しかも、無作為が達成できる以上に均等に散らばります。この種の回転が残す隙間は log N / N のように縮みますが、N回の無作為な抽出が残す隙間は 1/√N の程度で、カイ二乗は N とその隙間の二乗の積のように振る舞います。決定論的な1,000項が無作為な1,000項に大差をつけるのはそのためで、0.17 とはその差の見え方なのです。
解答
どんな無作為モデルのもとでも約50万分の1。つまりこの適合の良さは、このデータがそもそも標本ではなかったという証拠になります。カイ二乗検定が問えるのは一つだけです。データは偶然が許す以上に法則から離れているか。近すぎると告げる手立ては持っておらず、判定の行は0.17でも8でも同じ文言を出します。
監査役にとっては、これで読み方が反転します。小数点以下二桁までベンフォードに一致する帳簿は、それ自体が問題を抱えています。R・A・フィッシャーが1936年にメンデルのエンドウのデータについて指摘したのと同じ問題で、理論との一致が、標本抽出では起こりえないほど良すぎたのです。ベンフォードの法則を読んだ人物がそれに従って数字を作れば、この痕跡が残ります。しかもそれは、検定が本来狙っていた不正よりも見つけやすいのです。正直な帳簿は現実の標本らしいギザギザした縁を持って届きますが、1,000個のフィボナッチ数はそうではないからです。 -
参考文献 (3)
- The observation, made fifty-seven years before the law was named after somebody else: S. Newcomb, "Note on the Frequency of Use of the Different Digits in Natural Numbers." American Journal of Mathematics 4 (1881), p. 39.
- Why the law is scale-invariant, which is the property the unit switch on this page tests: T. P. Hill, "A Statistical Derivation of the Significant-Digit Law." Statistical Science 10 (1995).
- The paper the law is named for, and the one that first checked it against real data: F. Benford, "The Law of Anomalous Numbers." Proceedings of the American Philosophical Society 78 (1938), 551-572.