京都大学 情報学研究科 システム科学専攻 2023年8月実施 専門科目 確率統計
Author
AKIRA (小红书:94184092292) , 祭音Myyura
Description
大学公表の原題
以下の問題において, P ( A ) P(A) P ( A ) は事象 A A A の確率を表し, E ( X ) E(X) E ( X ) と V ( X ) V(X) V ( X ) は確率変数 X X X の期待値と分散を表す.また, e e e はネイピア数(自然対数の底)を表す.
問題1
ある日の,店 i ( i = 1 , … , n ) i\ (i=1,\ldots,n) i ( i = 1 , … , n ) の来客数 Y i Y_i Y i は,独立にポアソン分布 P o ( λ i ) Po(\lambda_i) P o ( λ i ) にしたがう確率変数とする.ただし, λ i > 0 \lambda_i>0 λ i > 0 は未知パラメータである.なお,パラメータ λ > 0 \lambda>0 λ > 0 のポアソン分布 P o ( λ ) Po(\lambda) P o ( λ ) の確率関数は
f ( y ; λ ) = λ y e − λ y ! , y = 0 , 1 , … f(y;\lambda)=\frac{\lambda^{y} e^{-\lambda}}{y!},\quad y=0,1,\ldots f ( y ; λ ) = y ! λ y e − λ , y = 0 , 1 , …
である.以下の設問に答えなさい.
(1) Y 1 , … , Y n Y_1,\ldots,Y_n Y 1 , … , Y n を用いて, λ 1 , … , λ n \lambda_1,\ldots,\lambda_n λ 1 , … , λ n の最尤推定量 λ ^ 1 , … , λ ^ n \hat\lambda_1,\ldots,\hat\lambda_n λ ^ 1 , … , λ ^ n を求めよ.
(2) ポアソン分布 P o ( λ ) Po(\lambda) P o ( λ ) にしたがう確率変数 Y Y Y の期待値 E ( Y ) E(Y) E ( Y ) と分散 V ( Y ) V(Y) V ( Y ) を求めよ.
広い店ほど来客数が多い傾向があり,店 i i i の広さを定数 x i > 0 x_i>0 x i > 0 で表すと λ i = θ x i ( i = 1 , … , n ) \lambda_i=\theta x_i\ (i=1,\ldots,n) λ i = θ x i ( i = 1 , … , n ) となることがわかった.ただし, θ > 0 \theta>0 θ > 0 は未知パラメータである.
(3) 最尤法で θ \theta θ を推定したい. Y 1 , … , Y n Y_1,\ldots,Y_n Y 1 , … , Y n を用いて, θ \theta θ の最尤推定量 θ ^ \hat\theta θ ^ を求めよ.
(4) 設問 (3) の θ ^ \hat\theta θ ^ の期待値 E ( θ ^ ) E(\hat\theta) E ( θ ^ ) と分散 V ( θ ^ ) V(\hat\theta) V ( θ ^ ) を求めよ.
(5) 重み付き最小二乗法で θ \theta θ を推定したい
∑ i = 1 n w i ( Y i − θ x i ) 2 \sum_{i=1}^n w_i\,(Y_i-\theta x_i)^2 i = 1 ∑ n w i ( Y i − θ x i ) 2
を最小にする θ \theta θ の値を θ ^ w \hat\theta_w θ ^ w とする.ただし, w 1 , … , w n w_1,\ldots,w_n w 1 , … , w n は正の定数である. θ ^ w \hat\theta_w θ ^ w を求めよ.
(6) 設問 (5) の θ ^ w \hat\theta_w θ ^ w の期待値 E ( θ ^ w ) E(\hat\theta_w) E ( θ ^ w ) と分散 V ( θ ^ w ) V(\hat\theta_w) V ( θ ^ w ) を求めよ.
(7) 設問 (5) の θ ^ w \hat\theta_w θ ^ w に対して, E ( ( θ ^ w − θ ) 2 ) E\!\left((\hat\theta_w-\theta)^2\right) E ( ( θ ^ w − θ ) 2 ) を最小にする w 1 , … , w n w_1,\ldots,w_n w 1 , … , w n の値を求めよ.また,そのときの θ ^ w \hat\theta_w θ ^ w を求めよ.
問題2
X , Y X,Y X , Y を実数値確率変数とし,その累積分布関数をそれぞれ F X ( x ) = P ( X ≤ x ) F_X(x)=P(X\le x) F X ( x ) = P ( X ≤ x ) , F Y ( y ) = P ( Y ≤ y ) F_Y(y)=P(Y\le y) F Y ( y ) = P ( Y ≤ y ) ,確率密度関数を f X ( x ) , f Y ( y ) f_X(x), f_Y(y) f X ( x ) , f Y ( y ) とする.ただし実数 a < b a<b a < b に対して F X ( a ) < F X ( b ) F_X(a)<F_X(b) F X ( a ) < F X ( b ) および F Y ( a ) < F Y ( b ) F_Y(a)<F_Y(b) F Y ( a ) < F Y ( b ) とする.また, X X X と Y Y Y の同時累積分布関数を F ( x , y ) = P ( X ≤ x , Y ≤ y ) F(x,y)=P(X\le x,\ Y\le y) F ( x , y ) = P ( X ≤ x , Y ≤ y ) ,同時確率密度関数を f ( x , y ) f(x,y) f ( x , y ) とする.以下の設問に答えなさい.
(1) X X X をそれ自身の累積分布関数に代入して得られる U = F X ( X ) U=F_X(X) U = F X ( X ) を考える. U U U は [ 0 , 1 ] [0,1] [ 0 , 1 ] の範囲で定められる一様分布にしたがう確率変数であることを示せ.
(2) U U U および V V V を [ 0 , 1 ] [0,1] [ 0 , 1 ] の範囲の一様分布にしたがう確率変数とする.確率変数 U , V U,V U , V の同時累積分布関数を C ( u , v ) ( 0 ≤ u ≤ 1 , 0 ≤ v ≤ 1 ) C(u,v)\ (0\le u\le 1,\ 0\le v\le 1) C ( u , v ) ( 0 ≤ u ≤ 1 , 0 ≤ v ≤ 1 ) とする.対応する同時密度関数を
c ( u , v ) = ∂ 2 C ( u , v ) ∂ u ∂ v c(u,v)=\frac{\partial^2 C(u,v)}{\partial u\,\partial v} c ( u , v ) = ∂ u ∂ v ∂ 2 C ( u , v )
とする.確率変数 X X X と Y Y Y に対して,ある C C C が存在して
F ( x , y ) = C ( F X ( x ) , F Y ( y ) ) F(x,y)=C\!\big(F_X(x),\,F_Y(y)\big) F ( x , y ) = C ( F X ( x ) , F Y ( y ) )
と表せることが知られている.このとき C C C を ( X , Y ) (X,Y) ( X , Y ) のコピュラ と呼び,対応する同時密度関数 c c c をコピュラ密度関数と呼ぶ.
上式を用いて X X X と Y Y Y の同時確率密度関数 f ( x , y ) f(x,y) f ( x , y ) を, ( X , Y ) (X,Y) ( X , Y ) のコピュラ C C C に対応するコピュラ密度関数 c c c ,および F X ( x ) , F Y ( y ) , f X ( x ) , f Y ( y ) F_X(x),F_Y(y),f_X(x),f_Y(y) F X ( x ) , F Y ( y ) , f X ( x ) , f Y ( y ) を用いて表せ.
(3) X X X と Y Y Y の同時累積分布関数が
F ( x , y ) = 1 1 + e − x + e − y F(x,y)=\frac{1}{1+e^{-x}+e^{-y}} F ( x , y ) = 1 + e − x + e − y 1
で与えられるとする. ( X , Y ) (X,Y) ( X , Y ) のコピュラ C C C に対応するコピュラ密度関数 c ( u , v ) c(u,v) c ( u , v ) を求めよ.
题目描述
以下以 P ( A ) P(A) P ( A ) 表示事件 A A A 的概率,以 E ( X ) E(X) E ( X ) 、V ( X ) V(X) V ( X ) 分别表示随机变量
X X X 的期望和方差,并以 e e e 表示自然对数的底。回答以下两题。
某一天,商店 i i i 的顾客数
Y i Y_i Y i (i = 1 , … , n i=1,\ldots,n i = 1 , … , n )相互独立,并服从 Poisson 分布
Po ( λ i ) \operatorname{Po}(\lambda_i) Po ( λ i ) ,其中
λ i > 0 \lambda_i>0 λ i > 0 是未知参数。参数 λ > 0 \lambda>0 λ > 0 的 Poisson 分布概率质量函数为
f ( y ; λ ) = λ y e − λ y ! , y = 0 , 1 , … . f(y;\lambda)
=\frac{\lambda^y e^{-\lambda}}{y!},
\qquad y=0,1,\ldots. f ( y ; λ ) = y ! λ y e − λ , y = 0 , 1 , … .
用观测 Y 1 , … , Y n Y_1,\ldots,Y_n Y 1 , … , Y n 求
λ 1 , … , λ n \lambda_1,\ldots,\lambda_n λ 1 , … , λ n 的最大似然估计量
λ ^ 1 , … , λ ^ n \widehat{\lambda}_1,\ldots,\widehat{\lambda}_n λ 1 , … , λ n 。
若 Y ∼ Po ( λ ) Y\sim\operatorname{Po}(\lambda) Y ∼ Po ( λ ) ,求 E ( Y ) E(Y) E ( Y ) 和 V ( Y ) V(Y) V ( Y ) 。
已知商店越大,顾客数往往越多。以正常数 x i x_i x i 表示商店 i i i 的面积,并采用模型
λ i = θ x i , i = 1 , … , n , \lambda_i=\theta x_i,
\qquad i=1,\ldots,n, λ i = θ x i , i = 1 , … , n ,
其中 θ > 0 \theta>0 θ > 0 是未知参数。
用 Y 1 , … , Y n Y_1,\ldots,Y_n Y 1 , … , Y n 求 θ \theta θ 的最大似然估计量
θ ^ \widehat{\theta} θ 。
求上一小问中 θ ^ \widehat{\theta} θ 的
E ( θ ^ ) E(\widehat{\theta}) E ( θ ) 和 V ( θ ^ ) V(\widehat{\theta}) V ( θ ) 。
改用加权最小二乘法估计 θ \theta θ 。给定正常数
w 1 , … , w n w_1,\ldots,w_n w 1 , … , w n ,令 θ ^ w \widehat{\theta}_w θ w 为使
∑ i = 1 n w i ( Y i − θ x i ) 2 \sum_{i=1}^n
w_i(Y_i-\theta x_i)^2 i = 1 ∑ n w i ( Y i − θ x i ) 2
最小的 θ \theta θ ,求 θ ^ w \widehat{\theta}_w θ w 。
6. 求
E ( θ ^ w ) E(\widehat{\theta}_w) E ( θ w ) 和
V ( θ ^ w ) V(\widehat{\theta}_w) V ( θ w ) 。
7. 对第 5 小问的 θ ^ w \widehat{\theta}_w θ w ,求使均方误差
E [ ( θ ^ w − θ ) 2 ] E\!\left[(\widehat{\theta}_w-\theta)^2\right] E [ ( θ w − θ ) 2 ]
最小的权重 w 1 , … , w n w_1,\ldots,w_n w 1 , … , w n ,并求此时的
θ ^ w \widehat{\theta}_w θ w 。
设 X , Y X,Y X , Y 是实值随机变量,其边缘分布函数和边缘密度分别为
F X ( x ) = P ( X ≤ x ) , F Y ( y ) = P ( Y ≤ y ) , F_X(x)=P(X\leq x),\qquad
F_Y(y)=P(Y\leq y), F X ( x ) = P ( X ≤ x ) , F Y ( y ) = P ( Y ≤ y ) ,
以及 f X ( x ) , f Y ( y ) f_X(x),f_Y(y) f X ( x ) , f Y ( y ) 。假设对任意实数 a < b a<b a < b 都有
F X ( a ) < F X ( b ) , F Y ( a ) < F Y ( b ) . F_X(a)<F_X(b),
\qquad
F_Y(a)<F_Y(b). F X ( a ) < F X ( b ) , F Y ( a ) < F Y ( b ) .
记联合分布函数和联合密度为
F ( x , y ) = P ( X ≤ x , Y ≤ y ) , f ( x , y ) . F(x,y)=P(X\leq x,\ Y\leq y),
\qquad
f(x,y). F ( x , y ) = P ( X ≤ x , Y ≤ y ) , f ( x , y ) .
定义 U = F X ( X ) U=F_X(X) U = F X ( X ) 。证明 U U U 服从区间 [ 0 , 1 ] [0,1] [ 0 , 1 ] 上的均匀分布。
设 U , V U,V U , V 各自服从 [ 0 , 1 ] [0,1] [ 0 , 1 ] 上的均匀分布,它们的联合分布函数为
C ( u , v ) , 0 ≤ u ≤ 1 , 0 ≤ v ≤ 1 , C(u,v),
\qquad 0\leq u\leq1,\quad0\leq v\leq1, C ( u , v ) , 0 ≤ u ≤ 1 , 0 ≤ v ≤ 1 ,
相应联合密度为
c ( u , v ) = ∂ 2 C ( u , v ) ∂ u ∂ v . c(u,v)
=\frac{\partial^2C(u,v)}
{\partial u\,\partial v}. c ( u , v ) = ∂ u ∂ v ∂ 2 C ( u , v ) .
已知对 X , Y X,Y X , Y 存在某个 C C C 使
F ( x , y ) = C ( F X ( x ) , F Y ( y ) ) . F(x,y)
=C\!\left(F_X(x),F_Y(y)\right). F ( x , y ) = C ( F X ( x ) , F Y ( y ) ) .
称 C C C 为 ( X , Y ) (X,Y) ( X , Y ) 的 Copula,称 c c c 为 Copula 密度。利用该等式,用
c c c 、F X ( x ) F_X(x) F X ( x ) 、F Y ( y ) F_Y(y) F Y ( y ) 、f X ( x ) f_X(x) f X ( x ) 和 f Y ( y ) f_Y(y) f Y ( y ) 表示联合密度
f ( x , y ) f(x,y) f ( x , y ) 。
3. 若联合分布函数为
F ( x , y ) = 1 1 + e − x + e − y , F(x,y)
=\frac{1}{1+e^{-x}+e^{-y}}, F ( x , y ) = 1 + e − x + e − y 1 ,
求 ( X , Y ) (X,Y) ( X , Y ) 的 Copula 所对应的密度 c ( u , v ) c(u,v) c ( u , v ) 。
Kai
問題1
(1)
定数項を除く対数尤度は ℓ = ∑ i ( Y i log λ i − λ i ) \ell=\sum_i(Y_i\log\lambda_i-\lambda_i) ℓ = ∑ i ( Y i log λ i − λ i ) である。Y i > 0 Y_i>0 Y i > 0 なら、各項の微分は Y i / λ i − 1 Y_i/\lambda_i-1 Y i / λ i − 1 で符号が正から負に変わるので λ ^ i = Y i \hat\lambda_i=Y_i λ ^ i = Y i となる。Y i = 0 Y_i=0 Y i = 0 なら λ i > 0 \lambda_i>0 λ i > 0 上に最大点はなく、λ i ↓ 0 \lambda_i\downarrow0 λ i ↓ 0 で上限に近づく。
(2)
確率母関数は E [ z Y ] = e λ ( z − 1 ) E[z^Y]=e^{\lambda(z-1)} E [ z Y ] = e λ ( z − 1 ) である。z = 1 z=1 z = 1 での1階、2階微分から
E [ Y ] = λ , E [ Y ( Y − 1 ) ] = λ 2 , V [ Y ] = λ . E[Y]=\lambda,\quad E[Y(Y-1)]=\lambda^2,
\qquad \boxed{V[Y]=\lambda}. E [ Y ] = λ , E [ Y ( Y − 1 )] = λ 2 , V [ Y ] = λ .
(3)
S = ∑ i Y i S=\sum_iY_i S = ∑ i Y i 、X = ∑ i x i X=\sum_i x_i X = ∑ i x i とおく。対数尤度の微分は S / θ − X S/\theta-X S / θ − X だから、S > 0 S>0 S > 0 なら θ ^ = S / X \hat\theta=S/X θ ^ = S / X である。S = 0 S=0 S = 0 なら θ > 0 \theta>0 θ > 0 上に最大点はない。パラメータ空間を閉包 θ ≥ 0 \theta\ge0 θ ≥ 0 に拡張すれば、すべての標本について
θ ^ = ∑ i Y i ∑ i x i \boxed{\hat\theta=\frac{\sum_iY_i}{\sum_i x_i}} θ ^ = ∑ i x i ∑ i Y i
と定義できる。
(4)
(3) の式を S = 0 S=0 S = 0 で 0 0 0 と定めた推定量について、独立性から
E [ θ ^ ] = ∑ i θ x i X = θ , V [ θ ^ ] = ∑ i θ x i X 2 = θ X . E[\hat\theta]=\frac{\sum_i\theta x_i}{X}=\theta,
\qquad
V[\hat\theta]=\frac{\sum_i\theta x_i}{X^2}
=\boxed{\frac\theta X}. E [ θ ^ ] = X ∑ i θ x i = θ , V [ θ ^ ] = X 2 ∑ i θ x i = X θ .
(5)
目的関数を微分すると − 2 ∑ i w i x i ( Y i − θ x i ) -2\sum_iw_ix_i(Y_i-\theta x_i) − 2 ∑ i w i x i ( Y i − θ x i ) となる。2階微分は 2 ∑ i w i x i 2 > 0 2\sum_iw_ix_i^2>0 2 ∑ i w i x i 2 > 0 なので、制約なしの一意な最小化解は
θ ^ w = ∑ i w i x i Y i ∑ i w i x i 2 . \boxed{\hat\theta_w=\frac{\sum_iw_ix_iY_i}{\sum_iw_ix_i^2}}. θ ^ w = ∑ i w i x i 2 ∑ i w i x i Y i .
θ > 0 \theta>0 θ > 0 に制限した場合、全観測値が 0 0 0 なら最小点は存在せず、θ ↓ 0 \theta\downarrow0 θ ↓ 0 で下限に近づく。以下ではこの場合の推定量を 0 0 0 と定める。
(6)
E [ θ ^ w ] = θ , V [ θ ^ w ] = θ ∑ i w i 2 x i 3 ( ∑ i w i x i 2 ) 2 . E[\hat\theta_w]=\theta,
\qquad
\boxed{V[\hat\theta_w]=
\theta\frac{\sum_iw_i^2x_i^3}{(\sum_iw_ix_i^2)^2}}. E [ θ ^ w ] = θ , V [ θ ^ w ] = θ ( ∑ i w i x i 2 ) 2 ∑ i w i 2 x i 3 .
(7)
不偏性から均方誤差は分散に等しい。Cauchy–Schwarz の不等式より
( ∑ i w i x i 2 ) 2 ≤ ( ∑ i w i 2 x i 3 ) ( ∑ i x i ) . \left(\sum_iw_ix_i^2\right)^2
\le\left(\sum_iw_i^2x_i^3\right)\left(\sum_i x_i\right). ( i ∑ w i x i 2 ) 2 ≤ ( i ∑ w i 2 x i 3 ) ( i ∑ x i ) .
従って均方誤差の最小値は θ / ∑ i x i \theta/\sum_i x_i θ / ∑ i x i であり、等号条件は
w i = c x i ( c > 0 ) . \boxed{w_i=\frac{c}{x_i}\quad(c>0)}. w i = x i c ( c > 0 ) .
このとき θ ^ w = ∑ i Y i / ∑ i x i \hat\theta_w=\sum_iY_i/\sum_i x_i θ ^ w = ∑ i Y i / ∑ i x i となる。
問題2
(1)
密度の存在により F X F_X F X は連続であり、仮定により厳密に増加する。0 < u < 1 0<u<1 0 < u < 1 に対して、
P ( U ≤ u ) = P ( X ≤ F X − 1 ( u ) ) = F X ( F X − 1 ( u ) ) = u . P(U\le u)=P(X\le F_X^{-1}(u))=F_X(F_X^{-1}(u))=u. P ( U ≤ u ) = P ( X ≤ F X − 1 ( u )) = F X ( F X − 1 ( u )) = u .
端点でも P ( U ≤ 0 ) = 0 P(U\le0)=0 P ( U ≤ 0 ) = 0 、P ( U ≤ 1 ) = 1 P(U\le1)=1 P ( U ≤ 1 ) = 1 だから、U U U は一様分布に従う。
(2)
連鎖律により、
f ( x , y ) = c ( F X ( x ) , F Y ( y ) ) f X ( x ) f Y ( y ) . \boxed{f(x,y)=c(F_X(x),F_Y(y))f_X(x)f_Y(y)}. f ( x , y ) = c ( F X ( x ) , F Y ( y )) f X ( x ) f Y ( y ) .
(3)
一方の変数を + ∞ +\infty + ∞ にすると、F X ( x ) = 1 / ( 1 + e − x ) F_X(x)=1/(1+e^{-x}) F X ( x ) = 1/ ( 1 + e − x ) 、F Y ( y ) = 1 / ( 1 + e − y ) F_Y(y)=1/(1+e^{-y}) F Y ( y ) = 1/ ( 1 + e − y ) である。従って e − x = ( 1 − u ) / u e^{-x}=(1-u)/u e − x = ( 1 − u ) / u 、e − y = ( 1 − v ) / v e^{-y}=(1-v)/v e − y = ( 1 − v ) / v を代入し、
C ( u , v ) = u v u + v − u v . C(u,v)=\frac{uv}{u+v-uv}. C ( u , v ) = u + v − uv uv .
u , v u,v u , v でそれぞれ微分すると
c ( u , v ) = 2 u v ( u + v − u v ) 3 , 0 < u , v < 1. \boxed{c(u,v)=\frac{2uv}{(u+v-uv)^3}},\qquad 0<u,v<1. c ( u , v ) = ( u + v − uv ) 3 2 uv , 0 < u , v < 1.