跳到主要内容

京都大学 情報学研究科 知能情報学専攻 2022年8月実施 専門科目 S-2

Author​

Isidore, 祭音Myyura

Description​

大学公表の原題

設問1​

確率変数 XX は下の確率密度関数 f(x)f(x) をもつ確率分布に従うとする。

f(x)={−12x+12(∣x∣≤1)0(∣x∣>1)f(x) = \left \{ \begin{aligned} -\frac{1}{2}x + \frac{1}{2} \quad &(|x| \le 1) \\ 0 \quad &(|x| > 1) \end{aligned} \right.

XX の平均と分散を求めよ。

設問2​

独立な確率変数 XX と YY が、それぞれパラメータ λ1,λ2\lambda_1,\lambda_2 のポアソン分布に従うとする。このとき、Z=X+YZ = X + Y がパラメータ (λ1+λ2)(\lambda_1 + \lambda_2) のポアソン分布に従うことを示せ。パラメータ λ\lambda のポアソン分布は下の確率質量関数で与えられる。

P(X=k)=λke−λk!P(X = k) = \frac{\lambda^k e^{-\lambda}}{k!}

設問3​

モデル yi=βxi+ϵi(i=1,2,…,n;ϵiは誤差項)y_i = \beta x_i + \epsilon_i(i = 1,2,\dots,n;\epsilon_i \text{は誤差項}) から生成されるデータ (x1,y1),(x2,y2),…,(xn,yn)(x_1,y_1),(x_2,y_2),\dots,(x_n,y_n) に、切片がゼロの回帰直線 y=β^xy = \hat{\beta}x を最小二乗法でフィッティングする。

(1) β^\hat{\beta} 求めよ。

(2) ϵi^=yi−β^xi\hat{\epsilon_i} = y_i - \hat{\beta}x_i とおくと、∑i=1nxiϵi^=0\sum_{i = 1}^n x_i\hat{\epsilon_i} = 0 が成り立つことを示せ。

設問4​

ある研究分野における全統計的仮説の中で、真の仮説 (帰無仮説が誤り) と偽の仮説 (帰無仮説が正しい) の数の比が R:1R:1 であることがわかっているとする。

(1) ある仮説について実験を実施し、有意水準 α\alpha 、検出力 1−β1 - \beta で検定を行う。検定結果が有意であった場合にこの仮説が真である確率を、R,α,βR,\alpha,\beta を用いて表せ。また、R=0.1,α=0.05,β=0.2R = 0.1,\alpha = 0.05,\beta = 0.2 のときの値を計算せよ。

(2) ある仮説について kk 回の独立な実験を実施し、それぞれについて(1)と同様の検定を行う。kk 回全ての実験について検定結果が有意であった場合にこの仮説が真である確率を、R,α,β,kR,\alpha,\beta,k を用いて表せ。また、R=0.1,α=0.05,β=0.2,k=2R = 0.1,\alpha = 0.05,\beta = 0.2,k = 2 のときの値を計算せよ。

题目描述​

  1. 随机变量 XX 的密度为

    f(x)={−12x+12,∣x∣≤1,0,∣x∣>1.f(x)=\begin{cases} -\frac12x+\frac12,&|x|\le1,\\ 0,&|x|>1. \end{cases}

    求 E[X]E[X] 与 V[X]V[X]。

  2. 独立随机变量 X,YX,Y 分别服从参数 λ1,λ2\lambda_1,\lambda_2 的 Poisson 分布。用 P(X=k)=λke−λ/k!P(X=k)=\lambda^ke^{-\lambda}/k! 证明 Z=X+Y∼Poisson⁡(λ1+λ2)Z=X+Y\sim\operatorname{Poisson}(\lambda_1+\lambda_2)。

  3. 数据由过原点模型 yi=βxi+ϵiy_i=\beta x_i+\epsilon_i 生成,用最小二乘拟合 y=β^xy=\hat\beta x。

    1. 求 β^\hat\beta;
    2. 令残差 ϵ^i=yi−β^xi\hat\epsilon_i=y_i-\hat\beta x_i,证明 ∑ixiϵ^i=0\sum_i x_i\hat\epsilon_i=0。
  4. 某领域真假研究假设(真指零假设错误)的先验数量比为 R:1R:1。

    1. 一次检验显著性水平为 α\alpha、功效为 1−β1-\beta。在结果显著条件下,求假设为真的概率,并计算 R=0.1,α=0.05,β=0.2R=0.1,\alpha=0.05,\beta=0.2 时的值。
    2. 对同一假设作 kk 次独立实验且均显著,求此时假设为真的概率,并计算上述参数且 k=2k=2 时的值。

Kai​

設問1​

E[X]=∫−11x(−12x+12)dx=−13E[X] = \int^{1}_{-1}x(-\frac{1}{2}x+\frac{1}{2})\mathrm{d}x = -\frac{1}{3}
E[X2]=∫−11x2(−12x+12)dx=13E[X^2] = \int^{1}_{-1}x^2(-\frac{1}{2}x+\frac{1}{2})\mathrm{d}x = \frac{1}{3} \\
Var[X]=E[X2]−E2[X]=29\text{Var}[X] = E[X^2] - E^2[X] = \frac{2}{9}

設問2​

By the convolution Rule, we have

fZ(z)=P(Z=z)=∑i=0zfX(i)fY(z−i)=∑i=0zλ1ie−λ1i!λ2z−ie−λ2(z−i)!=e−(λ1+λ2)z!∑i=0zz!(z−i)!i!λ1iλ2z−i\begin{align} f_{Z}(z) &= P(Z=z) = \sum^{z}_{i=0}f_{X}(i)f_{Y}(z-i) \\ & = \sum^{z}_{i=0} \frac{\lambda_1^{i}e^{-\lambda_1}}{i!} \frac{\lambda_2^{z - i}e^{-\lambda_2}}{(z - i)!} \\ & = \frac{e^{-(\lambda_1 + \lambda_2)}}{z!}\sum^{z}_{i=0}\frac{z!}{(z-i)!i!}\lambda_1^{i}\lambda_2^{z - i} \end{align}

By the Binomial Theorem, we can insert ∑i=0zz!(z−i)!i!λ1iλ2z−i=(λ1+λ2)z\sum^{z}_{i=0}\frac{z!}{(z-i)!i!}\lambda_1^{i}\lambda_2^{z - i} = (\lambda_1 + \lambda_2)^z

fZ(z)=e−(λ1+λ2)z!(λ1+λ2)zf_{Z}(z) = \frac{e^{-(\lambda_1 + \lambda_2)}}{z!}(\lambda_1 + \lambda_2)^z

So is the PMF for a Poisson Distribution with the parameter (λ1+λ2)(\lambda_1 + \lambda_2)

PS: A easier solution is to use Moments Generating Function.

設問3​

(1)​

By the Least Square Method, we have the sum of square residuals,

S(β^)=∑i=1n(yi−β^xi)2S(\hat{\beta}) = \sum^{n}_{i=1}(y_i - \hat{\beta}x_i)^2

Calculate its derivative with the root

S′(β^)=∑i=1n(−2xi)(yi−β^xi)=2(∑i=1nβ^xi2−∑i=1nxiyi)β^=∑i=1nxiyi∑i=1nxi2,∑i=1nxi2>0.\begin{align} S'(\hat{\beta}) &= \sum^{n}_{i=1}(-2x_i)(y_i-\hat{\beta}x_i) \\ &= 2(\sum^{n}_{i=1}\hat{\beta}x_i^2 - \sum^{n}_{i=1}x_iy_i) \\ \hat{\beta} &= \frac{\sum^{n}_{i=1}x_iy_i}{\sum^{n}_{i=1}x_i^2},\qquad \sum_{i=1}^n x_i^2>0. \end{align}

If x1=⋯=xn=0x_1=\cdots=x_n=0, every value of β^\hat\beta minimizes SS.

(2)​

The normal equation directly gives

0=(∑i=1nxiyi−∑i=1nβ^xi2)=∑i=1nxi(yi−β^xi)=∑i=1nxiϵi^\begin{align} 0 &= (\sum^{n}_{i=1}x_iy_i-\sum^{n}_{i=1}\hat{\beta}x_i^2) \\ &= \sum^{n}_{i=1}x_i(y_i-\hat{\beta}x_i) \\ &= \sum^{n}_{i=1}x_i\hat{\epsilon_i} \end{align}

設問4​

(1)​

Denote the events below:

  • The hypothesis is true: TT
  • The hypothesis is false: FF
  • The test results in significance: SS

Then, what is asked can be represented by the probability as Pr[T∣S]Pr[T|S]. Given the ratio R:1R:1, we have

Pr[T]=RR+1;  Pr[F]=1R+1Pr[T] = \frac{R}{R+1} ;\; Pr[F] = \frac{1}{R+1}

Assume each test has exact Type I error probability α\alpha and power 1−β1-\beta. Then

Pr[S∣F]=α;  Pr[S∣T]=1−βPr[S|F] = \alpha ;\; Pr[S|T] = 1 - \beta

Therefore, with the Bayes' theorem, we have

Pr[T∣S]=Pr[S∩T]Pr[S]=Pr[S∣T]Pr[T]Pr[S∣T]Pr[T]+Pr[S∣F]Pr[F]=(1−β)Rα+(1−β)R\begin{align} Pr[T|S] &= \frac{Pr[S\cap T]}{Pr[S]} \\ &= \frac{Pr[S|T]Pr[T]}{Pr[S|T]Pr[T]+Pr[S|F]Pr[F]} \\ &=\frac{(1-\beta)R}{\alpha+(1-\beta)R} \end{align}

Insert the values, the answer is

Pr[T∣S]=813Pr[T|S] = \frac{8}{13}

(2)​

Conditional on whether the hypothesis is true or false, the kk experiments are independent with the same test properties. Writing Sk=S1∩⋯∩SkS^k=S_1\cap\cdots\cap S_k, we obtain

Pr[T∣Sk]=Pr[Sk∣T]Pr[T]Pr[Sk∣T]Pr[T]+Pr[Sk∣F]Pr[F]=Prk[S∣T]Pr[T]Prk[S∣T]Pr[T]+Prk[S∣F]Pr[F]=(1−β)kRαk+(1−β)kR\begin{align} Pr[T|S^k] &= \frac{Pr[S^k|T]Pr[T]}{Pr[S^k|T]Pr[T]+Pr[S^k|F]Pr[F]} \\ &= \frac{Pr^k[S|T]Pr[T]}{Pr^k[S|T]Pr[T]+Pr^k[S|F]Pr[F]} \\ &= \frac{(1-\beta)^kR}{\alpha^k+(1-\beta)^kR} \end{align}

Insert the values, the answer is

Pr[T∣S2]=128133Pr[T|S^2] = \frac{128}{133}