どの分布が最尤推定のための閉形式の解を持っていますか?


回答:


25

一般性をかなりの損失なしに、我々は、確率密度(または質量)と仮定することができるの任意の観察は、xはI(のうちn個の指数関数として書くことを可能にする、厳密に正である観察)f(xi)xin

f(xi)=exp⁡(g(xi,θ))

パラメータベクトルの。θ=(θj)

対数尤度関数の勾配をゼロに等しくすると(尤度の静止点を見つけ、その中に存在する場合はすべての内部グローバル最大値)、次の形式の方程式のセットが得られます。

∑idg(xi,θ)dθj=0,

それぞれに1つ。これらのいずれかがすぐに解決できるように、θからx i項を分離できるようにしたいと思います。jxiθ用語。(すべてが数学の怠azineの原理に動機付けられたこの重要なアイデアから流れています:できるだけ少ない作業をしてください;計算する前に先を考えてください;最初に難しい問題の簡単なバージョンに取り組みます。)これを行う最も一般的な方法は方程式を採用することですフォーム

∑i(ηj(θ)τj(xi)−αj(θ))=ηj(θ)∑iτj(xi)−nαj(θ)

既知の機能のための、τ J、およびαηjτj、その後のための溶液は、連立方程式を解くことによって得られます。αj

nαj(θ)ηj(θ)=∑iτj(xi)

以下のための。一般に、これらは、解決が困難である、しかしの値のセット提供します(N α J(θに)θについての完全な情報提供θを、我々は単純に使用することができ、このベクトルの代わりに、θ自体は(それによって、多少)が、非常に生産的な方法では、「閉じた形」ソリューションのアイデアを一般化。そのような場合には、に関して統合θj個の利回り(nαj(θ)ηj(θ))θ θθj

g(x,θ)=τj(x)∫θηj(θ)dθj−∫θαj(θ)dθj+B(x,θj′)

(ここで、、すべてのコンポーネントを表してθを除きますθ J)。左手側はの機能的に独立であるため、θ jを、我々が持っている必要があり、そのτ J(X )= T (X )、いくつかの固定機能のためのT。そのBは、θにまったく依存してはいけません。およびη jは、いくつかの機能の誘導体であるH (θ )およびα jのいくつかの他の機能の誘導体であり、Aθj′θθjθjτj(x)=T(x)TBθηjH(θ)αjA(θ)、どちらも機能的にデータとは無関係です。ホセ

g(x,θ)=H(θ)T(x)−A(θ)+B(x).

この形式で記述できる密度は、よく知られているKoopman-Pitman-Darmoisファミリ、または指数関数ファミリを構成します。これは、ガンマ、標準、カイ2乗、ポアソン、多項、および他の多くを含む、連続および離散の両方の重要なパラメトリックファミリで構成されます。


そして、閉じたフォームを持たないものについては、EMアルゴリズムを使用できます。たとえば、ゼロ膨張ポアソンmoddelを考えてみましょう:stats.stackexchange.com/questions/32133/…–
— Damien

0

それらをすべてリストできるかどうかはわかりません。指数、通常、二項が思い浮かび、それらはすべて指数ファミリーのクラスに分類されます。指数族は指数に十分な統計があり、mleは多くの場合、この十分な統計の優れた関数です。


8
この質問は信じられないほど広範ですが、OPは網羅的なリストを求めるのではなく、MLEの閉じた形式のソリューションを持つディストリビューションの特徴を尋ねているようです。いずれにせよ、完全なリストは不可能です。
— マクロ

2
それは常に「素敵な関数」ではありません。たとえば、ベータ分布の十分な統計は [ログ⁡バツログ⁡(1−バツ)]T、そこから形状パラメータを見つけるために数値的手法が必要です a そして b。
— ニールG

Thnaks Neil for pointing that out. I guess not all exponential family distributions have closed form solutions.
— Michael R. Chernick
弊社のサイトを使用することにより、あなたは弊社のクッキーポリシーおよびプライバシーポリシーを読み、理解したものとみなされます。
Licensed under cc by-sa 3.0 with attribution required.