標本分布の正規確率計算機
標準誤差と正規標本モデルを使い、標本平均や標本比率の区間確率を求めます。
標本分布の確率
標本統計量を選び、母集団のパラメータと区間を入力してください。
標本分布の正規確率について
標本分布は、同じ大きさのあらゆる無作為標本において、統計量がどのように変動するかを表します。個々の観測値は広く散らばっていても、繰り返し抽出した標本から求める平均や比率は母集団の値の周辺に集まりやすくなります。この計算機はその集まり方を正規分布でモデル化し、標本平均または標本比率が指定した二つの境界の間に入る確率を求めます。
標本平均の場合、標本分布の中心は母平均です。標準誤差は母標準偏差を標本サイズの平方根で割った値です。そのため、標本サイズを大きくすると分布が狭くなり、標本平均の精度が上がります。計算機はこの標準誤差で区間の各端点をzスコアに変換し、両端の標準正規累積分布を計算して、上限までの面積から下限までの面積を引きます。
標本比率の場合、中心は母比率 p、標準誤差は p(1 - p) を n で割った値の平方根です。このモデルは世論調査、コンバージョン率、不良率、はい・いいえの結果などに使われます。一般的な目安は np と n(1-p) がともに十分大きく、多くの場合は少なくとも 10 あることです。これにより、離散的な成功数を連続的な正規曲線で適切に近似できます。比率の境界はゼロから一の範囲で指定できます。
中心極限定理は、個々の測定値が正規分布でなくても、標本サイズが増えると標本平均が正規分布に近づく理由を説明します。母集団自体が正規分布なら、どの標本サイズでも標本平均は正規分布になります。強く偏った分布や裾の重い分布では、より大きな標本が必要な場合があります。独立性も重要で、観測値は無作為な過程から得る必要があります。非復元抽出では、一般に標本サイズを母集団の 10 パーセント以下に抑えます。
結果はモデルに基づく確率であり、実際に集めた特定の標本内の観測値の割合ではありません。同じ大きさの標本を繰り返し抽出したとき、その平均や比率のどれだけが区間内に入るか、という問いに答えます。母集団のパラメータが未知で、標本データから推定する場合は信頼区間の手法を使ってください。この計算機は、母集団のパラメータが指定され、標本抽出による変動を知りたい場合に使います。
標本分布の計算例
対応する二種類の標本統計量の例です。
| 入力値 | 確率 | 解釈 |
|---|---|---|
| 平均:mu = 100、sigma = 15、n = 25、区間 97 から 103 | 0.68268947 | 境界は母平均の上下それぞれ一標準誤差の位置です。 |
| 比率:p = 0.5、n = 100、区間 0.45 から 0.55 | 0.68268947 | 標準誤差は 0.05 なので、境界のzスコアは -1 と 1 です。 |
| 平均:mu = 50、sigma = 10、n = 100、区間 48 から 52 | 0.95449974 | 標準誤差は 1 で、境界は平均から二標準誤差離れています。 |
標本確率の計算方法
- 対象の統計量に合わせて標本平均または標本比率を選びます。
- 既知の母集団パラメータと正の整数の標本サイズを入力します。
- 調べたい区間の下限と上限を入力します。
- 「確率を計算」を押すと、正規曲線の面積、標準誤差、端点のzスコアが表示されます。
標本分布のよくある質問
標本分布とは何ですか?
一定の大きさの標本を繰り返し抽出したときの統計量の確率分布です。個々の観測値間ではなく、標本間のばらつきを表します。
標準誤差とは何ですか?
標準誤差は標本分布の標準偏差です。標本サイズが増えるほど小さくなり、標本統計量の精度が高まることを示します。
標本平均がほぼ正規分布になるのはいつですか?
元の母集団が正規分布なら、標本平均も厳密に正規分布です。多くのほかの母集団では、十分な標本サイズがあれば中心極限定理による近似が役立ちます。
標本比率がほぼ正規分布になるのはいつですか?
一般的な基準は、np と n(1-p) がともに少なくとも 10 であることです。期待度数が小さいと、連続的な正規モデルが不正確になることがあります。
標本サイズを増やすと分布が狭くなるのはなぜですか?
大きな標本では、観測値レベルの無作為な変動がより多く平均化されます。数学的には、標準誤差は n の平方根の逆数に比例して減少します。