108 年 國立清華大學統計學系碩士班《統計學》
Suppose that are a random sample from , where and are both unknown parameters. Let , , , and be the c.d.f. (cumulative distribution function) of .
第 1 題4 分
What is the maximum likelihood estimator of ?
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
-
常態分配的分位數(Quantile of Normal Distribution):
若 ,將其標準化:
依題意 ,可得:
兩邊取標準常態累積分布函數的反函數 :
-
最大概似估計量的不變性定理(Invariance Property of MLE):
若 為參數 的最大概似估計量(MLE),則對於任何參數函數 ,其 MLE 為 。 -
常態分配母體參數的 MLE:
設 :- 母體平均數 的 MLE 為:
- 母體變異數 的 MLE 為:
- 母體標準差 的 MLE 為:
解題方法與詳細推導
步驟一:表示目標參數
由核心觀念可知, 可表示為母體參數 與 的函數:
第 2 題4 分
What is the uniformly minimum variance unbiased estimator of ? (Here is the gamma function)
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
-
參數 之定義與轉化:
已知 ,則標準化變量 。
根據題意 ,可得:
因此 (其中 為標準常態分佈之 80 百分位數)。 -
Lehmann-Scheffé 定理與 UMVUE:
在常態母體 中,樣本均數 與樣本變異數 構成未知參數 的完備充分統計量(Complete Sufficient Statistic)。
由 Lehmann-Scheffé 定理,若能找到完備充分統計量 的函數,使其為 的不偏估計量,則該估計量即為均勻最小變異不偏估計量(UMVUE)。 -
樣本標準差 的期望值:
由於 ,利用卡方分佈之動差性質可求得 :
解題方法
- 尋找未知母數 與 的 UMVUE:
- 由於 ,且 為完備充分統計量,故 即為 的 UMVUE。
- 為尋找 的 UMVUE,我們先計算 。令 ,其概率密度函數(p.d.f.)為:
求 的期望值:
Suppose that a single random variable has the p.d.f. (probability density function) , and otherwise, where the value of is unknown, but . Based on this "single" random variable , the following hypotheses are to be tested: versus .
第 3 題4 分
What is the critical region for which is a minimum, where and are the respective probabilities of Type I and Type II errors?
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題為虛無假設 對抗對立假設 的單一觀察值檢定問題。
目標為尋找一個拒絕域(Critical Region) ,使得型一錯誤率 與型二錯誤率 的線性組合 達到最小。
用到之主要定義與定理如下:
- 型一錯誤率():當 為真時,誤拒絕 的機率,即 。
- 型二錯誤率():當 為真時,誤接受 的機率,即 。
- Neyman-Pearson 檢定思想(似然比檢定結構):
欲使 (其中 )最小化,可將目標式表示為單一積分:
利用 ,可得:
欲使上述積分最小化,當且僅當拒絕域 包含所有滿足 integrand 的 點,即:
解題方法
-
求出兩種假設下的母體機率密度函數(p.d.f.):
題目給定 ()。- 在 下:
- 在 下:
- 在 下:
-
構建 之最小化條件:
這裡 。根據 Neyman-Pearson 最小化準則,最佳拒絕域 應滿足:
第 4 題4 分
What is the minimum value of for the critical region you found in Problem 3?
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題考查假設檢定中第一類型錯誤機率 、第二類型錯誤機率 的計算與求極值問題(Minimization of linear combination of error probabilities)。
- 母體機率密度函數 (p.d.f.):
- 在 下:。
- 在 下:。
- 拒絕域 (Critical Region / Rejection Region):
根據 Neyman-Pearson 檢定法(Neyman-Pearson Lemma)或概似比檢定(Likelihood Ratio Test),事態概似比為: 由於 在 上為對 嚴格遞增函數,故最佳拒絕域的形式必為 ,其中 為臨界值(Critical Value)。
解題方法
步驟一:將 與 表示為臨界值 的函數
設拒絕域為 ,其中 :
-
第一類型錯誤機率 :
-
第二類型錯誤機率 :
步驟二:求目標函數 的最小值
第 5 題4 分
Suppose that for testing against , the significance level is given, . What is the best critical region for which the probability of Type II error is minimized?
(A) , where satisfies
(B) , where satisfies
(C) , where satisfies
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題考查統計推論中假設檢定(Hypothesis Testing)的**奈曼-皮爾森定理(Neyman-Pearson Lemma, N-P Lemma)**與最佳臨界區域(Best Critical Region, BCR)的求法。
- 單純假設檢定(Simple Hypothesis Testing):
對決 。兩者皆為單點假設(Simple hypotheses)。 - Neyman-Pearson Lemma:
在給定顯著水準 下,欲使型二錯誤機率 最小化(即檢定力 最大化),最佳臨界區域 的形式為概似比檢定(Likelihood Ratio Test, LRT): - 型一錯誤機率(Significance Level, ):
解題方法
Step 1:寫出 null 與 alternative 下的概率密度函數(p.d.f.)
給定 。
- 當 時:
- 當 時:
Step 2:利用 Neyman-Pearson Lemma 求解最佳臨界區域
根據 N-P Lemma,概似比為:
由於函數 在 區間內為嚴格遞增函數,因此 等價於:
故最佳臨界區域 。
Step 3:由顯著水準 求解臨界值
已知 :
計算定積分:
故有:
Suppose that "four observations are taken at random from a normal distribution for which the mean , , is unknown and the variance is 1. Suppose also that the following hypotheses are to be tested: versus .
第 6 題4 分
Define to be the sample mean of these four observations. What is the best critical region for the uniformly most powerful test for testing against with the size (maximum significance level) ? (hint: , where is the c.d.f. of )
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題的核心觀念為單尾常態分配母體均值假設檢定的**均勻最強檢定力檢定(Uniformly Most Powerful Test, UMP Test)與拒絕域(Critical Region)**的推導。
- 抽樣分配:設 ,已知樣本數 ,母體標準差 。則樣本平均數 。
- 單調概似比(Monotone Likelihood Ratio, MLR)與 Karlin-Rubin 定理:對於常態分配 ,其機率密度函數具有單調概似比性質。針對單尾假設 vs ,UMP 檢定的最佳拒絕域形式為:
- 檢定顯著水準(Size of the test, ):當真正的 (即在臨界邊界)時,型一錯誤率達到最大值:
解題方法與推導
第一步:標準化樣本平均數
當 時,,標準標準差為 。
將 進行標準化:
第二步:求臨界值
根據拒絕域定義與顯著水準條件:
第 7 題4 分
What is the power of this uniformly most powerful test at ?
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題考驗單尾常態分配母體均值檢定中的**均勻最強力檢定(Uniformly Most Powerful Test, UMP Test)及其檢定力(Power)**計算。
-
極小化第一型錯誤與最控制:
當母體分配為常態分配 ,且變異數 已知、樣本數為 時,考慮假設檢定:
根據 Neyman-Pearson 樞紐定理(Neyman-Pearson Lemma)與單調概似比(Monotone Likelihood Ratio, MLR)性質,此單尾檢定在顯著水準 下的 UMP 拒絕域型態為:
其中 。 -
臨界值與標準化:
在邊界點 下,標準化檢定統計量為:
預設的傳統顯著水準通常為 。對應單尾標準常態分配臨界值為 (若取 ),使得:
-
檢定力(Power)定義:
在特定對立假設對應的參數值 下,拒絕虛無假設 的機率即為檢定力:
解題方法
首先明確檢定統計量在不同 下的分配情形:
樣本數 ,變異數 ,故樣本平均數標準差(Standard Error)為 。
- 確定顯著水準與拒絕域:
在研究所統計學考古題中,當題目未明確給定顯著水準 時,通常觀察選項數值。選項出現常態分配累積機率數值 、、 等,其中 為標準常態分配的上 分位數,即 (使得 或 )。
由此可知,本題設定之顯著水準為 。
第 8 題4 分
What is the probability of not rejecting if ?
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題考查假設檢定(Hypothesis Testing)中之不拒絕域與型二錯誤概率(或接受 之概率)。關鍵觀念與公式如下:
-
樣本平均數之抽樣分配:
若獨立隨機抽樣 ,則樣本平均數 。
本題中 、,故標準誤(Standard Error, )為:
-
左尾檢定之拒絕域與臨界值:
對假設 vs ,於顯著水準 (一般常見標準水準 時,)下,檢定統計量為 。
拒絕 的區域為 ,意即 ;不拒絕 的區域(Acceptance Region)則為:
-
標準常態累積分布函數(CDF)性質:
設 ,其累積分布函數記為 。由常態分配之對稱性可得:
解題方法
步驟一:求出不拒絕 的臨界條件(以 為例)
考慮標準臨界值 ,當假定邊界值 時:
拒絕 之臨界值 為:
因此,不拒絕 的事件即為 。
步驟二:計算當真實母體平均數 時,不拒絕 的機率
當真實參數為 時,樣本平均數服從 。將 標準化:
Suppose that "one observation" is drawn from a distribution with the following p.d.f.: for and otherwise. Also, suppose that the prior p.d.f. of is for and otherwise.
第 9 題4 分
What is the posterior distribution of given ?
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題考查貝氏統計(Bayesian Statistics)中**事後機率密度函數(Posterior Distribution)**的推導與計算。
關鍵公式與定義如下:
- 聯合機率密度函數(Joint p.d.f.):
- 邊際機率密度函數(Marginal p.d.f. of ):
- 事後機率密度函數(Posterior p.d.f. of ):
解題方法與推導過程
步驟一:確定母體似然函數與先驗分佈的支援集(Support)
- 似然函數(Likelihood):
- 先驗分佈(Prior):
注意:給定觀測值 後,由於 ,因此 的有效範圍必須滿足 。
步驟二:求 與 的聯合分佈
在 的條件下:
即聯合密度函數為:
步驟三:求 的邊際密度函數
對於給定的 ,對 從 到 進行積分:
第 10 題4 分
What is the Bayes estimator of under squared error loss?
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
-
Bayes Estimator(貝氏估計量)與平方誤差損失函數(Squared Error Loss):
在平方誤差損失 下,貝氏估計量(Bayes Estimator)即為後驗分配(Posterior Distribution)的期望值(Posterior Mean):
-
Bayes' Theorem for Continuous Random Variables(貝氏定理):
已知母體檢定分配(似然函數 Likelihood)為 ,先前分配(Prior Distribution)為 。- 聯合機率密度函數(Joint p.d.f.):
- 邊際機率密度函數(Marginal p.d.f. of ):
- 後驗機率密度函數(Posterior p.d.f. of ):
- 聯合機率密度函數(Joint p.d.f.):
-
支撐集(Support)的限制:
- 母體分配限制:,意味著當觀察值 給定時, 的可行範圍必須滿足 。
- 先前分配限制:。
- 綜合兩者,後驗分配中 的積分與定義域範圍為 。
解題方法
Step 1:設定似然函數與先前分配
根據題意:
- 似然函數:
- 先前分配:
Step 2:求聯合機率密度函數
當 時:
Step 3:求觀察值 的邊際機率密度函數
對 進行積分,注意積分下限為 (因為 ):
Step 4:求後驗機率密度函數
當 時:
第 11 題4 分
What is the Bayes estimator of under absolute error loss?
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
-
貝氏估計量(Bayes Estimator)與損失函數(Loss Function):
在貝氏統計中,給定觀察值 時,未知參數 的貝氏估計量 取決於採用的損失函數:- 在絕對誤差損失(Absolute Error Loss) 下,貝氏估計量為 後驗分配(Posterior Distribution)的中位數(Median)。
- 在平方誤差損失(Squared Error Loss) 下,貝氏估計量為 後驗分配的期望值(Mean)。
-
後驗機率密度函數(Posterior p.d.f.):
根據貝氏定理,後驗密度函數正比於概似函數與先驗密度函數的乘積:需注意聯合定義域:
- 概似函數:
- 先驗密度:
當給定觀察值 時, 的範圍限制為 。
解題方法
步驟一:求出後驗分配
給定觀察值 (其中 ),聯合機率密度函數(或未標準化的後驗密度)為:
計算邊際機率密度 作為歸一化常數(Normalizing Constant):
因此,給定 時, 的條件後驗機率密度函數(Posterior p.d.f.)為:
Let be a random sample from , where is the unknown parameter.
第 12 題4 分
What is the Fisher information of this random sample of size ?
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題考驗點估計理論中**費雪訊息量(Fisher Information)**的定義與性質計算。
- 單一觀測值的費雪訊息量 :
對單一隨機變數 ,其對數概似函數(log-likelihood function)對參數 的二階微分負期望值為: - 隨機樣本(Random Sample)的費雪訊息量 :
若 為來自同一分配的獨立同分配(i.i.d.)隨機樣本,則整體樣本長度為 的費雪訊息量具有可加性(Additivity):
解題方法
步驟一:寫出單一觀測值 的機率密度函數與對數概似函數
單一觀測值 的機率密度函數(pdf)為:
取對數得到對數概似函數:
步驟二:求對數概似函數對 的一階與二階偏微分
對參數 求一階偏微分(Score function):
再對 求二階偏微分:
第 13 題4 分
What is the Rao-Cramér Lower Bound for all unbiased estimators of ?
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題考查勞-克拉美下界(Rao-Cramér Lower Bound, RCLB)(又稱 Cramér-Rao Lower Bound, CRLB)的計算。
-
費雪訊息量(Fisher Information):
對於單一觀察值 ,其 Fisher Information 為:
隨機樣本大小為 時,總訊息量為 。 -
參數函數之 Rao-Cramér Lower Bound:
設 為參數 的可微函數,對於 的任意無偏估計量 (即 ),其變異數的下界為:
解題方法
步驟一:求單一觀察值的 Fisher Information
母體 的機率密度函數(PDF)為:
對 PDF 取對數:
對 偏微分:
再對 做二次偏微分:
計算 Fisher Information:
第 14 題4 分
What is the uniformly minimum variance unbiased estimator of ?
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題旨在求取常態母體平均數平方 的均勻最小變異不偏估計量(Uniformly Minimum Variance Unbiased Estimator, UMVUE)。
主要使用的統計學定理與公式如下:
- 不偏估計量(Unbiased Estimator):若估計量 滿足 ,則 為 的不偏估計量。
- 樣本平均數的抽樣分配:若 ,則樣本平均數 。
- 期望值與變異數之關係公式:對任意隨機變數 ,有 。
- Lehmann-Scheffé 定理與完備充分統計量(Complete Sufficient Statistic):正態母體 的完備充分統計量為 (或 )。根據 Lehmann-Scheffé 定理,若能找到完備充分統計量 的函數 滿足 ,則 即為 唯一的 UMVUE。
解題方法
-
尋找完備充分統計量:
母體分配為 ,屬於單參數指數族(Exponential Family)。其機率密度函數可表示為:
因此,聯合機率密度函數中與參數 相關的項為 。由因子分解定理與指數族的性質可知, 為 的完備充分統計量。 -
推導 的期望值:
已知 ,其期望值與變異數分別為:
第 15 題4 分
Let the random variable have a Poisson distribution with expectation . What is the limiting distribution of as ?
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題旨在考驗中央極限定理(Central Limit Theorem, CLT)與Slutsky定理(Slutsky's Theorem)(或極限運算性質)在極限分配(Limiting Distribution)中的綜合應用。
- Poisson 分配的性質:若 ,則其期望值與變異數皆為:
- 中央極限定理(CLT):
根據中央極限定理,當 時,將 進行標準化(Standardization):
其中 表示依分配收斂(Convergence in distribution)。
解題方法
本題要求目標隨機變數 當 時的極限分配。
步驟一:拆解並整理目標隨機變數
將 的前兩項提取公因數 :
步驟二:套用中央極限定理與極限性質
設 。由中央極限定理可知:
因此,目標隨機變數可表示為:
Let be a random sample of size 3 from Gamma (with p.d.f. ), where and is the unknown parameter.
第 16 題4 分
What is the distribution of ? Here the notation means a chi-square distribution with degrees of freedom.
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題考驗伽瑪分布(Gamma Distribution)的加總性與尺度變換(Scale Transformation),以及其與**卡方分布(Chi-Square Distribution)**之間的轉換關係。
- Gamma 分布的矩產生函數與加總性:
若 且獨立,則 。 - Gamma 分布與卡方分布的轉換關係:
- 設 ,若對 乘以常數 ,則 。
- 特別地,卡方分布 實質上就是 ,即形狀參數(shape parameter)為 、尺度參數(scale parameter)為 的 Gamma 分布。
- 因此,若 ,則可推出:
解題方法
步驟一:求出 的抽樣分布
由題意, 為來自 的獨立隨機樣本(Random Sample),樣本數 。
令 。根據獨立 Gamma 隨機變數的相加性質,其形狀參數相加、尺度參數保持不變:
步驟二:求出 的分布
將 代入目標隨機變數 :
根據 Gamma 分布的尺度變換性質:
第 17 題4 分
Based on your solution to Problem 16, which one below is a 95% equal-tail confidence interval for ? Here is a positive number such that .
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
-
Gamma 分配與卡方分配( Distribution)之轉換:
若獨立隨機變數 ,則其累加和 。
特別地,當隨機變數 時,經由尺度變換可得:
(註:這裡採用 Gamma 分配的尺度參數表示法 )。 -
樞紐變數法(Pivot Method)建立信心區間:
選定包含未知參數 與樣本統計量,且其機率分配完全已知(不含任何未知參數)的樞紐變數(Pivotal Quantity)。
在樣本數 、 情況下,,因此樞紐變數為:
-
等尾信心區間(Equal-Tail Confidence Interval):
根據題目對臨界值的定義:,即 表示卡方分配(自由度 )的第 百分位數(左尾累積機率為 )。
因此,95% 等尾區間是將兩側尾部機率各留 2.5%(即 ):
解題方法
步驟一:求出樣本總和的分配
已知 。根據 Gamma 分配的可加性:
步驟二:構造樞紐變數
利用 Gamma 分配與卡方分配的轉換關係,將 轉換為標準卡方分配:
Following a presidential debate, people were asked how they might vote in the forthcoming election. Based on the data below, is there any association between one's gender and choice of presidential candidate? To test the hypotheses, you might need the information that and .
| | Gender | |
| Candidate Preference | Male | Female |
| Candidate A | 150 | 130 |
| Candidate B | 100 | 120 |
第 18 題4 分
Given the significance level , what is your conclusion for the test?
(A) no association
(B) rejection of no association
(C) the observed value of test statistic is between 3.841 and 5.991
(D) the observed value of test statistic
登入後即可作答並保存紀錄。
核心觀念
本題考查卡方獨立性檢定(Chi-Square Test for Independence),用於評估兩個分類變數(性別與候選人偏好)之間是否存在顯著相關性(Association)。
-
虛無假設與對立假設:
- :性別與候選人偏好獨立(無相關,No association)。
- :性別與候選人偏好不獨立(有相關,Association exists)。
-
卡方檢定統計量公式:
其中 為觀察頻率(Observed frequency), 為期望頻率(Expected frequency)。
期望頻率計算方式為:
-
卡方分佈之自由度:
對於 的交叉表(Contingency table),其卡方統計量服從自由度 的卡方分佈。
本題為 交叉表,。 -
卡方檢定快速計算公式:
對於以下 列聯表:欄 1 欄 2 總和 列 1 列 2 總和 卡方統計量可簡化為:
解題方法
步驟一:整理數據與列聯表
將題目給予的數據繪製完整的交叉表並計算邊際總和:
| 候選人偏好 \ 性別 | 男性 (Male) | 女性 (Female) | 列總和 |
|---|---|---|---|
| 候選人 A | () | () | |
| 候選人 B | () | () | |
| 行總和 |
步驟二:計算卡方檢定統計量 observed value
利用 卡方統計量簡化公式代入數值:
代入公式計算 值:
第 19 題4 分
Given the significance level , what is your conclusion for the test?
(A) no association
(B) rejection of no association
(C) the observed value of test statistic
(D) the observed value of test statistic
登入後即可作答並保存紀錄。
核心觀念
本題旨在檢驗兩個類別變數(性別與候選人偏好)之間是否獨立(即是否有相關性)。屬於二維列聯表( Contingency Table)的卡方獨立性檢定( Test of Independence)。
相關公式與定義如下:
-
虛無假設與對立假設:
- :性別與候選人偏好無相關(獨立,No Association)
- :性別與候選人偏好有相關(不獨立,Association Exists)
-
期望次數(Expected Frequency, )公式:
其中 為第 列的邊際合計, 為第 行的邊際合計, 為總樣本數。 -
檢定統計量(Test Statistic, ):
對於 列聯表,亦可採用交叉相乘快速公式:
自由度 。 -
拒絕域(Rejection Region):
當 時,拒絕虛無假設 。
解題方法
步驟一:整理觀察次數表(Observed Frequencies, )與邊際合計
將題目給予的數據繪製成完整的 列聯表並計算邊際合計:
| 候選人偏好 \ 性別 | 男性 (Male) | 女性 (Female) | 列邊際合計 () |
|---|---|---|---|
| Candidate A | () | () | |
| Candidate B | () | () | |
| 行邊際合計 () |
步驟二:計算期望次數()
- (A, 男)
- (A, 女)
- (B, 男)
- (B, 女)
步驟三:計算檢定統計量觀察值()
法一:定義式計算
Three plants, , and produce respectively, 10, 50, and 40 percent of a company's output. Although plant is a small plant, its manager believes in high quality and only 1 percent of its products are defective. The other two, and , are worse and produce items that are 3 and 4 percent defective, respectively. All products are sent to a central warehouse.
第 20 題4 分
If one item is selected at random from the warehouse, what is the probability that this item is defective?
(A) 0.016
(B) 0.017
(C) 0.031
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題的核心觀念為全機率定理(Law of Total Probability)。
當樣本空間(全域集合)被一組互斥且窮盡(Mutually Exclusive and Exhaustive)的事件 所分割時,對於任意事件 (本題代表「產品為不良品」),其發生的邊際機率 可由各分割區域下的條件機率加權求和而得:
在本題中,工廠 的產量佔比即為權重 ,而各廠的不良率則為條件機率 。
解題方法與推導
Step 1:定義事件與題意已知條件
- 設 表示「產品來自工廠 」()。
- 設 表示「產品為不良品(Defective)」。
根據題意,各工廠產量佔比(先驗機率)為:
注意 ,符合分割條件。
各工廠的產品不良率(條件機率)為:
Step 2:套用全機率定理計算從倉庫隨機抽取一件商品為不良品的機率
Step 3:帶入數值計算
第 21 題4 分
If one item is selected at random from the warehouse and observed to be defective, what is the probability that this item comes from plant ?
(A) 1/31
(B) 1/32
(C) 1/16
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題屬於**全機率公式(Law of Total Probability)與貝氏定理(Bayes' Theorem)**的典型應用題型。
在機率論中,若一樣本空間 被劃分為若干個互斥且集合交集涵蓋全域的事件 (稱為完備事件分劃),且已知各事件發生的事前機率(Prior Probability),以及在事件 發生下事件 發生的條件機率(Conditional Probability),則:
-
全機率公式:事件 發生的邊際機率(Marginal Probability)為各路徑條件機率之加權平均:
-
貝氏定理:在已知事件 發生的條件下,反推其來自特定條件 的事後機率(Posterior Probability)為:
解題方法
步驟一:定義事件與整理已知條件
- 設事件 表示「產品來自工廠 」()。
- 設事件 表示「產品為瑕疵品(Defective)」。
根據題意,可列出各工廠產量比例(事前機率)與瑕疵率(條件機率):
- 事前機率:
- 條件機率(瑕疵率):
步驟二:計算全機率
隨機抽取一件產品,該產品為瑕疵品的總機率 為各工廠產生瑕疵品機率的加權和:
After fitting a simple linear regression model , where are i.i.d. from , we have the information that , , and .
第 22 題4 分
What is the estimate of the standard deviation of ?
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題考查**簡單線性回歸模型(Simple Linear Regression Model)**中殘差變異數(Residual Variance)與誤差項標準差(Standard Deviation of )的不偏估計量(Unbiased Estimator)。
關鍵公式與關係如下:
- 總變異(Total Sum of Squares, ):
- 判定係數(Coefficient of Determination, ):
因此,殘差平方和(Sum of Squared Errors, )可表示為:
- 誤差項變異數 的不偏估計量(Mean Squared Error, ):
其中 為簡單線性回歸模型中殘差平方和的自由度(Degree of Freedom, ),因為模型估計了兩個未知參數(截距項 與斜率項 )。 - 誤差項標準差 的估計量:
解題方法
步驟一:計算殘差平方和()
已知 且 。
利用 代入數據:
第 23 題4 分
If we have more information that , what is the sample correlation coefficient between and ?
(A)
(B)
(C)
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題考查**單簡單線性回歸模型(Simple Linear Regression Model)**中,**判定係數(Coefficient of Determination, )與樣本相關係數(Sample Correlation Coefficient, or )**之間的數學關係。
-
判定係數與相關係數的關係:
在簡單線性回歸(單一自變數 與因變數 )中,判定係數等於樣本相關係數的平方:
因此,樣本相關係數的絕對值為:
-
相關係數的正負號判定:
樣本相關係數 的正負號由迴歸斜率的估計值 決定。因為:
其中標準差 且 ,故 。
解題方法
- 求出樣本相關係數的絕對值:
已知判定係數 ,故相關係數的絕對值為:
第 24 題4 分
Two numbers are selected at random from the interval . If these values are uniformly and independently distributed, compute the probability that the three resulting line segments, by cutting the interval at the numbers, can form a triangle.
(A) 1/2
(B) 1/3
(C) 1/4
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題屬於**連續型均勻分配(Continuous Uniform Distribution)與幾何機率(Geometric Probability)**的經典結合題目。
-
獨立隨機變數與聯合機率密度函數:
設從 中獨立隨機選取的兩個數分別為 與 。因為 ,其聯合機率密度函數(Joint PDF)為:
樣本空間 在平面直角座標系上對應一個邊長為 1 的單位正方形,總面積為 。 -
構成三角形的三邊長條件(三角形不等式):
欲使剪切後的三段線段能構成三角形,必須滿足任兩邊之和大於第三邊(等價於任意邊長皆小於總長度的一半 )。
解題方法
步驟一:設定變數與線段長度
將區間 切成三段,兩切點為 與 。為方便分析,分兩種情況討論:
-
當 時:
三條線段長度分別為:- 第一段
- 第二段
- 第三段
-
當 時:
三條線段長度分別為:- 第一段
- 第二段
- 第三段
步驟二:建立構成三角形的幾何區域條件
根據三角形不等式,三邊長必須同時滿足 、、。
情況 A: 區域
綜合上述不等式,此區域由下列直線圍成:
在座標平面上,這是一個頂點位於 、、 的直角三角形,其底與高皆為 ,面積為:
情況 B: 區域
第 25 題4 分
Let be a random sample from a distribution of the continuous type having p.d.f. , zero elsewhere. What is the probability that the smallest of these exceeds the median of this distribution?
(A) 1/2
(B) 1/4
(C) 1/6
(D) none of above
登入後即可作答並保存紀錄。
核心觀念
本題屬於**數理統計學(Mathematical Statistics)**的經典問題,主要考驗以下三大核心觀念:
- 中位數(Median, )的定義:對於連續型隨機變數 其機率密度函數(p.d.f.)為 ,中位數 滿足累積分布函數(c.d.f.) ,亦即整條分布在 的左側與右側累積機率各占 ()。
- 順序統計量(Order Statistics):自母體抽出一組大小為 的隨機樣本 ,將其由小到大排序為 。其中最小者 。
- 最小順序統計量的事件轉換:最小值大於某一數值 的事件,等價於「每一個獨立樣本 都同時大於 」,即:
解題方法
本題有兩種解題切入點:直觀機率法(最速解法)與母體分布推導法(標準解法)。
方法一:直觀機率法(推薦快速解法)
根據連續型隨機變數中位數 的定義:
由於 為獨立同分布(i.i.d.)的隨機樣本,最小值大於中位數代表三者皆須大於中位數:
方法二:母體分布推導法(完整計算與驗證)
- 求出中位數 :
母體機率累積函數 為:
由中位數定義 得: