レッスン
理論 — 地球型惑星の存在確率
これは確率ではなく期待数です:恒星の数から出発し、“そのうち、さらに…を満たすものの割合はいくらか?”という問いに答える一連の割合を順に掛け合わせていきます。得られる結果は、すべての割合が正しいと仮定したときに期待される天体の数です — そしてこれはドレイク方程式の形をとった計算であり、それと同じ強みと弱みを備えています。
6本の棒が縦に並び、それぞれ上の棒の半分の幅になっています。調査した恒星から、期待される検出数まで。
- 調査した恒星。棒全体であり、ここで唯一、仮定ではなく数え上げられた値です。
- 各割合はすぐ上の棒の一部を取ります。いちばん上の棒ではありません。これこそが掛け算を正当化する条件であり、飛ばされがちな一歩です。
- 4つの割合を経て棒は出発点の16分の1になります。存在すると期待される数は
156256。 - 検出は真の姿のあとに、別の段階として掛かります —
78128。存在するものと、探査が見つけるものは別の棒です。
各記号の意味
N*- 調査対象の恒星数。デフォルト値では
150,000。 fractions- 連鎖する割合 — 惑星を持つ
f_p、ハビタブルゾーンにあるf_HZ、地球サイズのf⊕、岩石質のf_rocky。それぞれは全体に対する割合ではなく、前段階に対する条件付きの割合です。 E- 期待存在数 — 実際に存在する数:
3,029。 p_det- 検出効率:実際に発見できる割合。これは実在する数を観測値へと変換します。
E_det- 期待検出数、
E × p_det = 242。
公式の導き方
- 掛け算が正しい操作となるのは、各割合がその前段階に依存する条件付きの割合だからです。
f_HZはすべての恒星に対する割合ではなく、惑星を持つ恒星のうちハビタブルゾーンに惑星を持つものの割合を表します。 - これらを掛け合わせます:
E = N* · f_p · f_HZ · f⊕ · f_rocky。デフォルト値では150,000 × 0.85 × 0.18 × 0.22 × 0.6 = 3,029となります。 - 検出は実際の存在数が求まった後に適用される別段階です:
E_det = E · p_det = 3,029 × 0.08 = 242。これらを分けて扱うことが肝心であり — 実際に存在する数値と観測調査によって捉えられる数値とを明確に区別できます。
- 前提
- 前段階の条件が与えられれば各割合が相互に独立しており、それぞれの割合を単一の数値で代表できると仮定しています。しかし、どちらの仮定も妥当ではありません — 惑星の存在率は恒星のスペクトル型や金属量と相関するため、これらの割合を独立して1つずつ自由に設定することは実際にはできません。
- 成り立たない場合
- 表示される精度の高さには懐疑的であるべきです。スライダーで小数点以下1桁まで設定した5つの割合から、一の位まで精密な数値 —
242— が算出されていますが、5つの推測値を掛け合わせると誤差は平均化されるどころか掛け合わされて増幅します。割合のうち2つを半分にすると、結果は4分の1になります。表示されている変動帯が狭いのは、真の不確実性のほとんどが潜んでいる各割合ではなく、調査対象の規模のみを検証しているからです。
練習
自分で確かめる
まず答えを予想し、それから上のコントロールで確かめてください。予想を決めてから答えを開くこと。それが練習になる条件です。
-
すべての割合を 0.5 にし、二つの個数を書き留めてください。次に fp、fHZ、fEarth、frocky のうち一つだけを 0.6 に上げ、それを戻してから、代わりに pdetect を 0.6 に上げてください。五つ目だけ何が違うでしょうか。
答えを表示
四つの個数割合は互いに入れ替え可能です。どれを上げても、検出見込みは 78,128 → 93,754、母集団の真の数は 156,256 → 187,508 と動きます。掛け算は順序を気にしないので、20% の改善はどこに適用しても 20% の価値だからです。pdetect を上げると検出見込みは同じ 93,754 になりますが、真の数は 156,256 のまま動きません。検出効率はあなたの望遠鏡についての事実であって、銀河についての事実ではないからです。二つの行があるのはまさにそのためです。四つの因子は惑星が何個あるかを語り、五つ目は何個見えるかを語ります。この種の議論がつねに最も*不確かな*因子を巡り、最も小さい因子を巡らないのも同じ理由です。てこの効きは同じで、違うのは誤差の幅だけなのです。 -
幅は中心 156,256 に対して 155,481 – 157,031、つまりプラスマイナス 775 と表示されます。この 775 はどこから来ていて、何を含んでいないのでしょうか。
答えを表示
√156,256 = 395.3、そして 1.96 × 395.3 = 775 — ポアソン計数ゆらぎの 95% 区間です。五つの割合が正確に分かっていて、標本に何個の惑星が入るかを偶然だけが決めるとしたら生じる散らばりを表しています。割合そのものの不確かさは一切含まれていません。そして支配的なのはまさにそちらです。fHZ と fEarth は文献で 2 倍の開きをもって議論されているのであって、0.5% の開きではありません。fHZ を 0.5 から 0.6 に動かすと推定値は 31,252 も跳ね上がります。ツールがたった今表示した幅のおよそ四十倍です。この幅は、それが測っている唯一のものについては誠実で、数値全体については途方もなく楽観的なのです。
全プロセスの詳細解説
-
150,000個の恒星の探査から検出される地球型惑星 6 ステップ
150,000 個の恒星を調査する。このツールが初期値とする割合を用いて、どれだけの地球型惑星が存在し、そのうち実際にいくつを検出できるかを求めよ。さらに、表示された不確実性の帯をどれだけ信頼すべきかを評価せよ。
-
このモデルは単一の積である。恒星の数から始めて、各割合を順に乗じていく。内部の要素は互いに他方に依存しておらず、それ自体が仮定である。
-
左から右へと順に計算する。各因子が生存数を削り、最後の 3 つを合わせると、そもそも惑星を持っていた恒星の 96% が除外される。
-
検出率は 6 番目の因子であり、恒星ではなく母集団に適用される。おおむね地球型惑星 12 個につき 1 個が検出される。
-
次に帯について考える。カウントをポアソン分布として扱うと、その標準偏差は平均の平方根となり、その両側 2 標準偏差分の区間がツールに表示される範囲となる。
-
その検出効率を幾何学的な条件のみと比較してみる。トランジットが起きるには、軌道が R☉/1 au の範囲内で真横を向いている必要があり、その確率は 215 分の 1 である。したがって 0.08 は幾何学的な確率ではなく、観測戦略全体を 1 つの数値に集約したものであり、純粋なトランジットのみによる解は 242 個ではなく 14 個となる。
-
最後に、どの天文学者も不合理とは呼ばない範囲で単一の割合を変動させてみると、解が 4 倍も変化することが確認できる。
解答
存在するのは3,029、検出されるのは242。しかも、± 108という幅にはほとんど意味がありません。 この幅が表すのは、ポアソン分布に従う計数雑音です。五つの割合がすべて厳密に正しく、サイコロの出目だけが変動するときに現れるばらつきにすぎません。しかし、実際の割合は厳密にはわかっていません。たとえば、そのうちハビタブルゾーンに入る割合だけでも上下に2倍の不確かさがあるとすれば、推定値は1,515から6,059まで広がります。画面に示された幅の20倍です。これは、ドレイク方程式をはじめ、複数の割合を掛け合わせるモデルに共通する典型的な弱点です。入力値が一桁の精度でしかわかっていないのに、計算結果は四桁まで精密に見える。その精密さは、掛け算が作り出した見かけにすぎません。
-
参考文献 (1)
- The measured occurrence rate of rocky habitable-zone planets, the one factor here that is not a guess: S. Bryson, M. Kunimoto, R. K. Kopparapu, J. L. Coughlin, W. J. Borucki & D. Koch, "The Occurrence of Rocky Habitable-zone Planets around Solar-like Stars from Kepler Data." The Astronomical Journal 161(1), 36, 2020.