跳到主要内容

京都大学 情報学研究科 システム科学専攻 2023年8月実施 専門科目 確率統計

Author

AKIRA (小红书:94184092292)

Description

以下の問題において,P(A)P(A) は事象 AA の確率を表し,E(X)E(X)V(X)V(X) は確率変数 XX の期待値と分散を表す.また,ee はネイピア数(自然対数の底)を表す.

問題1

ある日の,店 i (i=1,,n)i\ (i=1,\ldots,n) の来客数 YiY_i は,独立にポアソン分布 Po(λi)Po(\lambda_i) にしたがう確率変数とする.ただし,λi>0\lambda_i>0 は未知パラメータである.なお,パラメータ λ>0\lambda>0 のポアソン分布 Po(λ)Po(\lambda) の確率関数は

f(y;λ)=λyeλy!,y=0,1,f(y;\lambda)=\frac{\lambda^{y} e^{-\lambda}}{y!},\quad y=0,1,\ldots

である.以下の設問に答えなさい.

(1) Y1,,YnY_1,\ldots,Y_n を用いて,λ1,,λn\lambda_1,\ldots,\lambda_n の最尤推定量 λ^1,,λ^n\hat\lambda_1,\ldots,\hat\lambda_n を求めよ.

(2) ポアソン分布 Po(λ)Po(\lambda) にしたがう確率変数 YY の期待値 E(Y)E(Y) と分散 V(Y)V(Y) を求めよ.

広い店ほど来客数が多い傾向があり,店 ii の広さを定数 xi>0x_i>0 で表すと λi=θxi (i=1,,n)\lambda_i=\theta x_i\ (i=1,\ldots,n) となることがわかった.ただし,θ>0\theta>0 は未知パラメータである.

(3) 最尤法で θ\theta を推定したい.Y1,,YnY_1,\ldots,Y_n を用いて,θ\theta の最尤推定量 θ^\hat\theta を求めよ.

(4) 設問 (3) の θ^\hat\theta の期待値 E(θ^)E(\hat\theta) と分散 V(θ^)V(\hat\theta) を求めよ.

(5) 重み付き最小二乗法で θ\theta を推定したい

i=1nwi(Yiθxi)2\sum_{i=1}^n w_i\,(Y_i-\theta x_i)^2

を最小にする θ\theta の値を θ^w\hat\theta_w とする.ただし,w1,,wnw_1,\ldots,w_n は正の定数である.θ^w\hat\theta_w を求めよ.

(6) 設問 (5) の θ^w\hat\theta_w の期待値 E(θ^w)E(\hat\theta_w) と分散 V(θ^w)V(\hat\theta_w) を求めよ.

(7) 設問 (5) の θ^w\hat\theta_w に対して,E ⁣((θ^wθ)2)E\!\left((\hat\theta_w-\theta)^2\right) を最小にする w1,,wnw_1,\ldots,w_n の値を求めよ.また,そのときの θ^w\hat\theta_w を求めよ.


問題2

X,YX,Y を実数値確率変数とし,その累積分布関数をそれぞれ FX(x)=P(Xx)F_X(x)=P(X\le x)FY(y)=P(Yy)F_Y(y)=P(Y\le y),確率密度関数を fX(x),fY(y)f_X(x), f_Y(y) とする.ただし実数 a<ba<b に対して FX(a)<FX(b)F_X(a)<F_X(b) および FY(a)<FY(b)F_Y(a)<F_Y(b) とする.また,XXYY の同時累積分布関数を F(x,y)=P(Xx, Yy)F(x,y)=P(X\le x,\ Y\le y),同時確率密度関数を f(x,y)f(x,y) とする.以下の設問に答えなさい.

(1) XX をそれ自身の累積分布関数に代入して得られる U=FX(X)U=F_X(X) を考える.UU[0,1][0,1] の範囲で定められる一様分布にしたがう確率変数であることを示せ.

(2) UU および VV[0,1][0,1] の範囲の一様分布にしたがう確率変数とする.確率変数 U,VU,V の同時累積分布関数を C(u,v) (0u1, 0v1)C(u,v)\ (0\le u\le 1,\ 0\le v\le 1) とする.対応する同時密度関数を

c(u,v)=2C(u,v)uvc(u,v)=\frac{\partial^2 C(u,v)}{\partial u\,\partial v}

とする.確率変数 XXYY に対して,ある CC が存在して

F(x,y)=C ⁣(FX(x),FY(y))F(x,y)=C\!\big(F_X(x),\,F_Y(y)\big)

と表せることが知られている.このとき CC(X,Y)(X,Y)コピュラと呼び,対応する同時密度関数 cc をコピュラ密度関数と呼ぶ. 上式を用いて XXYY の同時確率密度関数 f(x,y)f(x,y) を,(X,Y)(X,Y) のコピュラ CC に対応するコピュラ密度関数 cc,および FX(x),FY(y),fX(x),fY(y)F_X(x),F_Y(y),f_X(x),f_Y(y) を用いて表せ.

(3) XXYY の同時累積分布関数が

F(x,y)=11+ex+eyF(x,y)=\frac{1}{1+e^{-x}+e^{-y}}

で与えられるとする.(X,Y)(X,Y) のコピュラ CC に対応するコピュラ密度関数 c(u,v)c(u,v) を求めよ.

题目描述

以下 P(A)P(A) 表示事件 AA 的概率,E(X),V(X)E(X),V(X) 分别表示随机变量 XX 的期望与方差,ee 表示自然对数的底。

  1. 某一天第 ii 家商店的顾客数 YiY_ii=1,,ni=1,\ldots,n)相互独立,且服从 Poisson 分布 Po(λi)\operatorname{Po}(\lambda_i),其中 λi>0\lambda_i>0 为未知参数。参数为 λ>0\lambda>0 的 Poisson 分布概率质量函数为

    f(y;λ)=λyeλy!,y=0,1,.f(y;\lambda)=\frac{\lambda^ye^{-\lambda}}{y!}, \qquad y=0,1,\ldots.

    (1)使用 Y1,,YnY_1,\ldots,Y_n,求 λ1,,λn\lambda_1,\ldots,\lambda_n 的最大似然估计量 λ^1,,λ^n\hat\lambda_1,\ldots,\hat\lambda_n

    (2)若 YPo(λ)Y\sim\operatorname{Po}(\lambda),求 E(Y)E(Y)V(Y)V(Y)

    观察到商店越大,顾客越多。用正常数 xix_i 表示第 ii 家商店的面积,并假设

    λi=θxi,i=1,,n,\lambda_i=\theta x_i,\qquad i=1,\ldots,n,

    其中 θ>0\theta>0 未知。

    (3)使用 Y1,,YnY_1,\ldots,Y_n,求 θ\theta 的最大似然估计量 θ^\hat\theta

    (4)求第(3)问 θ^\hat\theta 的期望与方差。

    (5)希望用加权最小二乘法估计 θ\theta。对正常数 w1,,wnw_1,\ldots,w_n,令 θ^w\hat\theta_w 为使

    i=1nwi(Yiθxi)2\sum_{i=1}^nw_i(Y_i-\theta x_i)^2

    最小的 θ\theta,求 θ^w\hat\theta_w

    (6)求 θ^w\hat\theta_w 的期望与方差。

    (7)求使

    E ⁣[(θ^wθ)2]E\!\left[(\hat\theta_w-\theta)^2\right]

    最小的权重 w1,,wnw_1,\ldots,w_n,并求此时的 θ^w\hat\theta_w

  2. X,YX,Y 为实随机变量,边缘分布函数分别为

    FX(x)=P(Xx),FY(y)=P(Yy),F_X(x)=P(X\leq x),\qquad F_Y(y)=P(Y\leq y),

    边缘密度分别为 fX(x),fY(y)f_X(x),f_Y(y)。假设对任意实数 a<ba<b 都有

    FX(a)<FX(b),FY(a)<FY(b).F_X(a)<F_X(b),\qquad F_Y(a)<F_Y(b).

    记联合分布函数与联合密度为

    F(x,y)=P(Xx,Yy),f(x,y).F(x,y)=P(X\leq x,Y\leq y),\qquad f(x,y).

    (1)令 U=FX(X)U=F_X(X)。证明 UU 服从区间 [0,1][0,1] 上的均匀分布。

    (2)设 U,VU,V 均服从 [0,1][0,1] 上的均匀分布,其联合分布函数为

    C(u,v),0u,v1,C(u,v),\qquad0\leq u,v\leq1,

    相应联合密度为

    c(u,v)=2C(u,v)uv.c(u,v)= \frac{\partial^2C(u,v)}{\partial u\,\partial v}.

    已知对 X,YX,Y 存在某个 CC,使

    F(x,y)=C ⁣(FX(x),FY(y)).F(x,y)=C\!\bigl(F_X(x),F_Y(y)\bigr).

    此时称 CC(X,Y)(X,Y) 的 Copula,cc 为 Copula 密度。利用上式,用 c,FX,FY,fX,fYc,F_X,F_Y,f_X,f_Y 表示联合密度 f(x,y)f(x,y)

    (3)若 X,YX,Y 的联合分布函数为

    F(x,y)=11+ex+ey,F(x,y)=\frac1{1+e^{-x}+e^{-y}},

    求其 Copula CC 对应的 Copula 密度 c(u,v)c(u,v)

考点

  • Poisson 分布与最大似然:估计独立强度参数及带曝光量 xix_i 的共同发生率。
  • 加权最小二乘与最优权重:推导线性估计量的偏差、方差,并依据异方差结构最小化均方误差。
  • 概率积分变换:证明连续分布函数作用于自身随机变量后服从均匀分布。
  • Copula 密度分解:使用链式法则把联合密度分解为 Copula 密度与边缘密度之积。
  • 边缘反函数与参数化 Copula:从给定联合分布求边缘分布、反函数及显式 Copula 密度。

Kai

問題1

問題2