数字と報道

人口の半分を調べたときも、標本誤差は同じ式でよい?

定めた人口から、同じ対象を二度選ばず無作為に調べるなら、抽出割合を分散に反映します。人口の大きさN、標本数nの単純無作為非復元抽出では、平均の分散に1−n/Nという補正が入ります。未回答や測定の誤りは別です。

基本の用語

標本が母集団のごく小さな一部なら、人口の大きさをあまり気にせず近似する場面があります。しかし半数を選ぶと、その近似との違いは大きくなります。まず誰を全体とし、どんな方法で選んだかを定めてから誤差を考えます。

もう少し詳しく知りたいときは、次の基礎で補えます。

一度選んだ対象を戻さずに抽出する

大きさNの有限母集団からn個を単純無作為に非復元抽出すると、大きさnの可能な標本が等確率で選ばれます。一度選んだ対象を同じ標本でもう一度選ばないというのが非復元です。

復元抽出では同じ対象を再び選べます。二つの設計は同じではないため、非復元抽出の補正を復元抽出へそのまま当てはめません。また、この式の対象は定めた有限母集団で、無制限に新しい対象が生まれる仮想的な集団とは区別します。

抽出割合を平均の分散に反映する

全員が回答する単純無作為非復元抽出で、標本平均の分散は(1−n/N)S²/nです。N>1、1≤n≤Nとします。S²は全N個の値について、母集団平均との差の二乗和をN−1で割った量です。

母分散という言葉を分母Nのσ²で使う表記なら、同じ分散は(N−n)σ²/[n(N−1)]です。S²とσ²を同じ値として入れると式の意味が変わります。何を平均しており、分散の分母をどちらで定義したかを先にそろえます。

標準誤差には補正の平方根を掛ける

標準誤差は推定量の分散の平方根です。補正を省いたS²/nと比べると、補正後の標準誤差には√(1−n/N)が掛かります。母集団の半数を選ぶと、係数は√0.5で約0.707です。

これは同じS²とnを使い、補正を入れた式と省いた式を比較した係数です。復元抽出との厳密な比較係数をそのまま示したものではありません。n=Nでは抽出による分散が0になりますが、全ての種類の誤りが消えるという意味ではありません。

どの母集団の、どの誤差が減るかを見る

未回答、測定の違い、記録や集計の誤りは、対象の一部を選んだことによる抽出誤差とは別です。全数を調べる調査にも非標本誤差はあり、有限母集団補正だけでそれを取り除くことはできません。

調べた集団が、知りたい集団と時点に対応しているかも確かめます。今年の定めた全員についての抽出誤差がなくても、来年の人々について同じ値が成り立つことを保証する式ではありません。重み調整や複雑な抽出設計にも、この単純な式を無条件には広げません。

半数を選んだ平均の分散

架空の例

母集団を1000人、全員回答の単純無作為非復元標本を500人、母集団のS²を100点²と置きます。補正を省いたS²/nは0.2点²、補正後は(1−500/1000)×100/500=0.1点²です。

標準誤差は約0.447点から約0.316点になり、比は約0.707です。母集団の半数を選んだことが分散へ反映されます。ここで小さくなったのは、この1000人から誰を選ぶかによるばらつきです。誤った回答を直したり、来年の人々の平均を確定したりする補正ではありません。

持ち帰る見方

  • 非復元抽出では、母集団に占める抽出割合が平均の分散に関わる。
  • 分母の定義と完全回答の条件をそろえ、抽出誤差と他の誤差を分ける。

次に広がる疑問

  • 全数調査と標本調査を比べる
  • 世論調査の対象と標本を読む
  • 単純無作為抽出以外の精度を考える

順番に読んでいる方へ

学習地図で、ほかの分野とのつながりを見る

出典

  • Survey Methods and Practices(Statistics Canada)https://www150.statcan.gc.ca/n1/pub/12-587-x/12-587-x2003001-eng.pdf

    確認日:2026-10-05

本文の出典・補足

一度選んだ対象を戻さずに抽出する

単純無作為非復元抽出は、N個の母集団からn個を選び、いったん選んだ対象を同じ標本でもう一度は選ばない設計である。

対象
大きさNの定めた有限母集団からのSRSWOR。
条件
大きさnの可能な標本が等確率で選ばれ、n≤N。
例外・限界
復元抽出では同じ対象を再び選ぶことがあり、非復元抽出の有限母集団補正をそのまま当てはめない。
  • Survey Methods and Practices(Statistics Canada)https://www150.statcan.gc.ca/n1/pub/12-587-x/12-587-x2003001-eng.pdf

抽出割合を平均の分散に反映する

完全回答の単純無作為非復元抽出では、標本平均の分散は(1−n/N)S²/nとなる。S²は母集団の平均との差の二乗和をN−1で割った値である。

対象
固定した有限母集団の平均を、SRSWORの標本平均で推定する。
条件
母集団はN>1個、標本は1≤n≤N個で完全回答。S²=Σ(yi−Ȳ)²/(N−1)を用いる。
例外・限界
母分散σ²=Σ(yi−Ȳ)²/Nを用いる表記では、同じ分散は(N−n)σ²/[n(N−1)]となる。分母の定義を混ぜない。
  • Survey Methods and Practices(Statistics Canada)https://www150.statcan.gc.ca/n1/pub/12-587-x/12-587-x2003001-eng.pdf

標準誤差には補正の平方根を掛ける

平均の標準誤差は分散の平方根なので、S²/nに対して有限母集団補正を加えると、標準誤差には√(1−n/N)が掛かる。

対象
前述の完全回答SRSWORでの母集団平均推定。
条件
同じS²とnを用い、補正を省いた分散S²/nと比べる。
例外・限界
母集団の半分を選ぶなら係数は√0.5で約0.707。復元抽出との厳密な比較係数とは区別し、n=Nでゼロになるのは抽出による分散である。
  • Survey Methods and Practices(Statistics Canada)https://www150.statcan.gc.ca/n1/pub/12-587-x/12-587-x2003001-eng.pdf

どの母集団の、どの誤差が減るかを見る

有限母集団補正は、定めた母集団の一部を選ぶことで生じるばらつきへの補正であり、未回答や測定・記録の誤りを取り除くものではない。

対象
固定した有限母集団への抽出誤差と、それ以外の誤差の区別。
条件
抽出対象の母集団と、知りたい時点・集団が一致するかを確認する。
例外・限界
全数でも非標本誤差は残る。この式だけで将来の人々や別の母集団への推論の不確実性を消したとはしない。
  • Survey Methods and Practices(Statistics Canada)https://www150.statcan.gc.ca/n1/pub/12-587-x/12-587-x2003001-eng.pdf