ベイズ統計

Bayesian Statistics

ベイズ統計とは

ベイズ統計(Bayesian Statistics)とは、ベイズの定理に基づき、事前知識(事前分布)とデータの観測結果(尤度)を組み合わせて、パラメータや仮説に関する確信度(事後分布)を更新する統計的枠組みです。頻度主義統計に対する代替的なアプローチとして広く活用されています。

表:ベイズ統計の要点まとめ
ひとことで言うと事前の知識にデータを加えて、確からしさを更新していく統計の考え方。
どこで使うデータが少ない場面の推定、A/Bテストの逐次判断、迷惑メール判定。
注意点事前分布の置き方で結論が変わる。根拠を説明できるようにする。

ベイズの定理

ベイズの定理は「事後確率 = 尤度 × 事前確率 ÷ 周辺尤度」と表されます。新しいデータが得られるたびに事前分布が更新され、より精度の高い事後分布が得られます。この逐次更新の仕組みにより、データが蓄積するほど推定精度が向上します。

図:ベイズ更新の流れ
1事前分布はじめの見立て
▶
2データを観測実際の結果
▶
3尤度を計算そのデータの起きやすさ
▶
4事後分布へ更新見立てを修正
▶
5次の事前分布にデータが増えるほど精緻に
↺ データが増えるたびに1〜5をくり返す

頻度主義との違い

頻度主義統計ではパラメータは固定された未知の値とみなしますが、ベイズ統計ではパラメータを確率変数として扱い、確率分布で不確実性を表現します。この違いにより、ベイズ統計は直感的な確率解釈(「パラメータが区間内にある確率は95%」)が可能になります。

ベイズ統計の応用

ベイズ統計はスパムフィルタリング、医療診断、A/Bテスト、自然言語処理、ベイズ最適化など多岐にわたる分野で活用されています。計算コストの高さが課題でしたが、マルコフ連鎖モンテカルロ法(MCMC)などの手法の発展により、実用的な問題にも広く適用可能になっています。