113 年 國立成功大學數據科學研究所《統計學(含迴歸分析)》
第 1 題20 分
- (20%) 某個工業大廠專案研究要探討特定批次液晶面板亮點缺陷數目的分布的狀況。使用一組未知抽樣方法得到的 10 片液晶面板樣本,缺陷數目觀察值為 。
(a) (5%) 請計算液晶面板缺陷數目樣本平均數、樣本中位數、樣本眾數。
(b) (5%) 假設此液晶面板樣本來自簡單隨機抽樣,此三個統計量何者比較適合描述該批次液晶面板亮點缺陷數目的集中性?原因為何?
(c) (5%) 假設使用 Poisson 分配來描述液晶面板亮點缺陷數目的分布的狀況,請寫出 Poisson 分配機率函數。並請計算 Poisson 分配變異數的估計值。
(d) (5%) 假設缺陷數目觀察值是依照時間次序所記錄,請討論使用 Poisson 分配來描述液晶面板亮點缺陷數目的分布的狀況是否適當,說明適當或不適當的原因。
登入後即可作答並保存紀錄。
本題主要考驗對敘述性統計量、集中量統計量的判斷,以及 Poisson 分配的基本概念與應用。
(a) 樣本平均數、中位數、眾數計算
給定樣本數據為:
-
樣本平均數 (Sample Mean):
樣本平均數是所有觀測值的總和除以觀測值的個數。
-
樣本中位數 (Sample Median):
樣本中位數是將數據按大小順序排列後,位於最中間的數值。由於樣本數為偶數 (10),中位數是中間兩個數值的平均。
數據排序後為:
中間兩個數值是第 5 個和第 6 個,分別是 5 和 26。
-
樣本眾數 (Sample Mode):
樣本眾數是數據中出現頻率最高的數值。
在給定的數據中,數字 5 出現 3 次,數字 28 出現 3 次。因此,此樣本有兩個眾數:5 和 28。
【答案】
樣本平均數為 16.5,樣本中位數為 15.5,樣本眾數為 5 和 28。
(b) 集中量統計量的判斷
當數據存在極端值 (outliers) 時,樣本平均數會受到極端值的影響而產生較大的偏移,較不適合用來代表數據的集中趨勢。樣本中位數則較不受極端值影響,更能反映數據的「典型」值。樣本眾數則表示最常出現的值,但可能有多個眾數,或出現頻率不高。
在此樣本數據中,有 1 到 5 的較小數值,但也有 26、28、30 的較大數值。這表示數據呈現偏態 (skewed) 的分布,尤其是有明顯的右偏 (positively skewed) 現象(從 5 跳到 26)。
- 樣本平均數 16.5
- 樣本中位數 15.5
- 眾數 5, 28
由於存在極端值,例如 26, 28, 30,它們將樣本平均數拉向較大的值。樣本中位數 15.5 則較接近數據的中間部分。眾數 5 較貼近左側的數據群,而 28 則較貼近右側的數據群。
因此,在本例中,樣本中位數 (15.5) 是最適合描述此批次液晶面板亮點缺陷數目集中性的統計量。因為它不受極端值 (26, 28, 30) 的影響,更能代表數據的「典型」值。樣本平均數 (16.5) 被極端值拉高了,而眾數 (5, 28) 則可能無法有效代表整個數據集的集中趨勢,尤其是在有多個眾數或數據分布不對稱時。
【答案】
樣本中位數最適合。因為數據存在極端值,樣本平均數會受到影響,而樣本中位數較不受極端值影響,更能代表數據的集中趨勢。
(c) Poisson 分配機率函數與變異數估計
Poisson 分配常用來描述單位時間或單位空間內發生某事件的次數。其機率函數為:
第 2 題20 分
- (20%) 抽樣調查是民意調查、市場調查和社會調查常運用的方法。
(a) (5%) 假設一個調查機構要調查某一候選人的支持率 ,採取隨機抽樣電訪的方式,假設選區內的選民支持或不支持的意向 , , 可以用二項分配的隨機變數來描述,請列出估計 常用的樣本估計量以及該估計量的標準差。
(b) (5%) 如果希望控制支持率 估計量的標準差不大於 ,至少需要多少樣本 。請列出推導公式,並嘗試給出 大約的數值。
(c) (5%) 假設一個調查機構要調查某兩候選人的支持率差異 ,採取隨機抽樣電訪的方式,假設選區內的抽取的 位選民,其支持或不支持兩候選人的意向 , , 可以用兩個互相獨立二項分配的隨機變數來描述,請列出估計 常用的樣本估計量以及該估計量的標準差。
(d) (5%) 如果希望控制支持率 估計量的標準差不大於 ,至少需要多少樣本 。請列出推導公式,並嘗試給出 大約的數值。
登入後即可作答並保存紀錄。
本題主要考驗關於比例估計的樣本統計量、標準差,以及如何根據期望的精度來確定樣本大小。
(a) 單一比例的樣本估計量與標準差
調查機構要估計候選人的支持率 。假設選民的支持或不支持可以視為二項分配的結果,令 為第 位選民的支持意向,若支持則 ,不支持則 。則 ,且 , 。
對於從 個獨立的 Bernoulli 隨機變數中抽取樣本,其和 服從二項分配 。
-
樣本估計量 (Sample Estimator):
估計支持率 最常用的樣本估計量是樣本比例,記為 。它是樣本中支持該候選人的選民比例。
這個估計量是 的最大概似估計量 (MLE) 和矩估計量 (Method of Moments estimator)。 -
樣本估計量的標準差 (Standard Error of the Sample Estimator):
首先計算 的期望值:
是 的一個不偏估計量 (unbiased estimator)。接著計算 的變異數:
估計量的標準差 (Standard Error, SE) 是其變異數的平方根:
在實際應用中,由於 是未知的,我們通常用樣本比例 來估計 ,得到標準誤的估計值:
然而,題目要求的是估計量的標準差,理論上是使用真實參數 。
【答案】
樣本估計量為 。該估計量的標準差為 。
(b) 單一比例估計的樣本大小決定
希望控制支持率 估計量 的標準差不大於 ,即 。
為了確保這個條件,我們需要找一個足夠大的 。通常在決定樣本大小時,由於 未知,我們會採用一個保守的估計。函數 在 時達到最大值 。因此,為了保證標準差足夠小,我們通常使用 作為最壞情況的假設,這會給出最大的所需樣本量。
使用 :
平方兩邊:
由於樣本數必須是整數,所以至少需要 個樣本。
推導公式:
在不知道 的情況下,取 得到最保守的估計:
在此題中,。
【答案】
推導公式為 。若以 作為最保守的估計,則至少需要 個樣本。
第 3 題20 分
- (20%) 新藥的藥效需要經過臨床實驗來確認是否優於舊藥。假設某一種常用降血壓藥物 A, 長期的平均約莫可降低收縮壓 10 mmHg。今有一藥廠開發新降血壓藥物 B, 進行符合衛生福利部食品藥物管理署規範的臨床試驗,在目標治療族群中隨機挑選 36 位受測者進行試驗。平均可降低收縮壓 12 mmHg,樣本標準差為 6 mmHg。
(a) (5%) 請列出適當的檢定假設 和 。
(b) (5%) 請計算適當檢定統計量,在型一誤差 0.05 和 0.01 之下進行檢定。並討論檢定結果的差異。
(c) (5%) 上述的檢定方法需要那些統計假設?
(d) (5%) 當收縮壓降低量並不符合常態分佈,假設檢定如何進行較為適當?你的建議為何?
登入後即可作答並保存紀錄。
本題主要考驗對單一樣本平均數的假設檢定(t-test),包括設定虛無假設與對立假設、計算檢定統計量、進行決策,以及探討檢定的統計假設與當假設不滿足時的替代方法。
(a) 檢定假設 和
我們要檢定的是新藥 B 的藥效是否優於舊藥 A。舊藥 A 的長期平均降低收縮壓為 10 mmHg。臨床試驗的目標是確認新藥 B 的平均降低收縮壓是否「優於」舊藥 A。在統計學上,「優於」通常表示「大於」。
令 為新藥 B 降低收縮壓的真實平均值。
-
虛無假設 ():表示沒有效果或效果與舊藥相同(或更差)。在這裡,我們假設新藥 B 的效果不優於舊藥 A。
或者,為了方便檢定,我們常常將虛無假設設定為「無差異」或「效果相等」,即:
(在實務上,兩種寫法都可以,但通常將「無差異」作為 的一部分,因為我們關心的是是否「優於」。若 是 ,則對立假設 是 。若 是 ,則對立假設 是 。這兩種設定都是右尾檢定。) -
對立假設 ():表示新藥 B 的藥效優於舊藥 A。
【答案】
mmHg (或 mmHg)
mmHg
(b) 檢定統計量計算與決策
樣本資訊:
- 樣本數
- 樣本平均數 mmHg
- 樣本標準差 mmHg
- 虛無假設的平均值 mmHg
由於樣本數 ,且我們不知道母體標準差 ,我們使用 t-檢定。
檢定統計量為:
計算檢定統計量的值:
檢定統計量的值是 。
自由度 (degrees of freedom, df) 為 。
這是右尾檢定 ()。
情況一:型一誤差
我們需要找到自由度為 35 的 t 分配的右尾臨界值 ,使得 。
查閱 t 分配表 (或使用統計軟體),對於 df=35 和 (右尾),臨界值約為 。
(若查閱 page 4 的表三 F 分布,其中 df=35 需插值。但 page 3 有提供 t 分布的一些值。Page 3 的表格是 F 分布,不是 t 分布。Page 2 的題目敘述沒有直接給 t 分布表。通常考試會提供。)
假設我們有 t 分配表,df=35, (右尾) 的臨界值約為 。
決策規則:若 ,則拒絕 。
我們的檢定統計量 。
因為 ,所以我們在 的顯著水準下,拒絕 。
結論:有足夠的證據顯示新藥 B 的平均降低收縮壓優於 10 mmHg。
情況二:型一誤差
我們需要找到自由度為 35 的 t 分配的右尾臨界值 ,使得 。
查閱 t 分配表,對於 df=35 和 (右尾),臨界值約為 。
決策規則:若 ,則拒絕 。
我們的檢定統計量 。
因為 ,所以我們在 的顯著水準下,不拒絕 。
結論:沒有足夠的證據顯示新藥 B 的平均降低收縮壓優於 10 mmHg。
檢定結果的差異討論:
在 的顯著水準下,我們有足夠的證據拒絕虛無假設,得出新藥 B 的效果優於舊藥 A 的結論。
然而,在 的顯著水準下,我們未能拒絕虛無假設,表示沒有足夠的證據支持新藥 B 的效果優於舊藥 A。
這種差異是由於我們設定了不同的風險等級(型一誤差)。
- 表示我們願意承擔 5% 的風險,在實際上新藥效果不優於舊藥時,卻錯誤地得出新藥優於舊藥的結論(偽陽性)。
- 表示我們只願意承擔 1% 的風險,要求更高的證據強度才能拒絕虛無假設。
當我們要求更嚴格的證據(較小的 值),檢定統計量需要比更嚴格的臨界值更大,才足以拒絕 。
第 4 題20 分
- (20%) 影像處理是資料科學研究重要的議題。常見的應用為人臉辨識、自動駕駛、腫瘤辨識、電路板缺陷辨識等等。影像擷取的量測設備會受多種因子干擾,例如設備震動(Vibration)和輸入電壓(Voltage),導致影像清晰度(Clarity)減低。今採取實驗方式進行研究,使用兩個設備震動水準(高水準和低水準)和兩個輸入電壓水準(高水準和低水準),對影像擷取設備進行16次影像清晰度量測。以下為實驗結果的變異數分析表:
| Df | Sum Sq | Mean Sq |
|---|---|---|
| Vibration | 1 | 2.0 |
| Voltage | 1 | 34.8 |
| Vibration:Voltage | 1 | 10.5 |
| Residuals | 12 | 12.0 |
(a) (5%) 請檢定設備震動(Vibration)和輸入電壓(Voltage)個別對影像清晰度(Clarity)的影響。型一誤差設為 0.1。
(b) (5%) 請檢定設備震動(Vibration)和輸入電壓(Voltage)對影像清晰度(Clarity)的交互作用影響。型一誤差設為 0.1。並解釋交互作用的意義。
(c) (5%) 在(a)和(b)的分析使用了哪幾個模型假設?
(d) (5%) 如果(c)的模型假設不正確,對(a)和(b)的分析的結果有何影響?請對每一個假設進行說明。
登入後即可作答並保存紀錄。
核心觀念
本題考察二因子完全隨機設計的二因子變異數分析。令
- :設備震動 Vibration
- :輸入電壓 Voltage
- 反應變數:影像清晰度 Clarity
包含兩個主效果與一個交互作用的模型為
其中 為震動效果、 為電壓效果、 為交互作用。
各效果均以殘差均方 作為誤差估計量,因此檢定統計量為
本題中
在型一誤差 下,
當計算出的 值大於 時,拒絕虛無假設。
(a) 檢定 Vibration 與 Voltage 的個別影響
1. 設備震動 Vibration
檢定假設為
亦即不同震動水準的平均影像清晰度相同;對二水準因子而言,也可寫成「震動的主效果為零」。
由變異數分析表,
比較臨界值:
因此在 下,不拒絕 。
**結論:**沒有足夠統計證據顯示設備震動對影像清晰度具有顯著的主效果。
其 值約為
2. 輸入電壓 Voltage
檢定假設為
亦即不同輸入電壓水準的平均影像清晰度相同;
由變異數分析表,
比較臨界值:
因此在 下,拒絕 。
**結論:**輸入電壓對影像清晰度具有顯著的主效果。不同輸入電壓水準所造成的平均影像清晰度差異,已大於隨機誤差所能合理解釋的程度。
其 值遠小於 。
(a) 答案
(b) 交互作用檢定與意義
1. 檢定假設
交互作用檢定為
表示震動與輸入電壓對影像清晰度的影響彼此獨立,不存在交互作用。
對立假設為
由變異數分析表,
比較臨界值:
因此在 下,拒絕 。
其 值約為
2. 統計結論
3. 交互作用的意義
交互作用表示:
輸入電壓對影像清晰度的影響,會隨著設備震動水準不同而改變;同樣地,設備震動的影響也會隨著輸入電壓水準不同而改變。
以四個處理組合的平均值表示,若兩條反應平均數線分別為:
- 低震動下,低電壓與高電壓的平均清晰度差異;
- 高震動下,低電壓與高電壓的平均清晰度差異;
若兩個差異不相同,即
便表示存在交互作用。
在交互作用顯著時,Voltage 的主效果是「跨越兩種震動水準平均後」的效果,Vibration 的主效果也是「跨越兩種電壓水準平均後」的效果。因此解釋主效果時,應進一步檢查各水準下的簡單主效果,不能只依賴整體平均效果。
(c) 使用的模型假設
本題二因子變異數分析主要使用下列假設。
1. 誤差項彼此獨立
不同次影像清晰度量測的誤差彼此獨立:
第 5 題20 分
- (20%) 一組隨機樣本有 10 個 y 觀察值,欲探討可能影響因子 x 與 y 的關係。
初步嘗試建立回歸模型 , 回歸分析表如下:
| Estimate | Std. Error | t value | Pr(>|t|) |
| :--: | :--: | :--: | :--: |
| (Intercept) | 0.5662 | 1.0803 | 0.524 | 0.6144 |
| x | 0.4109 | 0.1741 | 2.360 | 0.0459 * |
Multiple R-squared: 0.4105, Adjusted R-squared: 0.3368
(a) (5%) 請列出 和 的最小平方估計量公式。並依照上面回歸分析表說明 x 與 y 的可能關係。
(b) (5%) (a)的回歸模型使用了哪幾個模型假設? 回歸分析表使用了哪幾個模型假設?
(c) (5%) 如何檢查(b)所敘述的模型假設? 請對每一個假設說明檢定方法。
(d) (5%) 如果 x vs residual 的圖形繪出如下,請說明 x 與 y 的可能關係。
🖼️【此處有附圖,請對照原卷】
登入後即可作答並保存紀錄。
本題主要考驗對簡單線性迴歸的理解,包括最小平方估計、模型假設、假設檢定,以及殘差圖的判讀。
(a) 最小平方估計量公式與 x, y 關係說明
對於簡單線性迴歸模型 ,其最小平方估計量 (Ordinary Least Squares, OLS) 公式如下:
-
截距項 (估計 ) 的最小平方估計量:
其中 是 y 的樣本平均數, 是 x 的樣本平均數, 是斜率的估計量。 -
斜率項 (估計 ) 的最小平方估計量:
其中 是 x 和 y 的共變異數總和, 是 x 的變異數總和。
回歸分析表中的 Estimate 欄位給出了這些估計量的值:
x 與 y 的可能關係說明:
根據回歸分析表:
- 斜率 : 這個值是正的,表示當自變數 x 每增加一個單位時,應變數 y 的平均值預期會增加 0.4109 個單位。這表明 x 與 y 之間存在正向的線性關係。
- P 值 (Pr(>|t|)) for x = 0.0459: 這個 P 值小於常用的顯著水準 0.05 (題目中未指定,但 0.05 是常見的預設值,且此處有星號 * 標示)。這表示斜率 的統計顯著性檢定結果為顯著。換句話說,我們有足夠的證據拒絕虛無假設 ,認為 x 對 y 的影響是統計上顯著的。
- R-squared = 0.4105: 決定係數 (R-squared) 為 0.4105,表示自變數 x 可以解釋應變數 y 變異的約 41.05%。這表示 x 對 y 的解釋力尚可,但仍有約 58.95% 的變異未能被 x 解釋。
綜合以上,x 與 y 之間存在一個統計上顯著的、正向的線性關係。
【答案】
的最小平方估計量公式為 。
的最小平方估計量公式為 。
依照回歸分析表,x 與 y 之間存在統計上顯著的、正向的線性關係,x 的增加預期會導致 y 的平均值增加。
(b) 模型假設
簡單線性迴歸模型 的主要假設可以分為兩部分:
-
關於 (a) 的回歸模型 (即模型本身) 的假設:
- 線性關係 (Linearity): 應變數 y 與自變數 x 之間存在線性關係。模型假設 本質上就是建立這個線性關係。
- 固定自變數 (Fixed Independent Variable): 自變數 x 被視為固定或非隨機的,或者如果 x 是隨機的,則它與誤差項 是獨立的。
- 誤差項的假設 (Assumptions about the error term ):
- 零期望值 (Zero Mean): 。
- 恆定變異數 (Constant Variance / Homoscedasticity): 對所有 x 值都相等。
- 獨立性 (Independence): 誤差項 之間是相互獨立的。
- 常態性 (Normality): 誤差項 服從常態分配,即 。
-
關於回歸分析表 (統計檢定) 的假設:
回歸分析表中的 t 值和 P 值是基於對誤差項的假設進行的統計推斷。這些推斷通常需要上述誤差項的假設(零期望值、恆定變異數、獨立性、常態性)。- 獨立的誤差項: 這是進行 t 檢定和 F 檢定的基礎。
- 誤差項的常態性: 雖然對於樣本平均數的抽樣分配,中央極限定理可以提供近似,但進行嚴格的假設檢定(尤其是 P 值計算)通常依賴於誤差項的常態性。
- 誤差項的恆定變異數: 這影響了標準誤的計算,進而影響 t 值和 P 值。
總結來說,最核心的模型假設是:
- 線性關係
- 誤差項的零期望值
- 誤差項的恆定變異數
- 誤差項的獨立性
- 誤差項的常態性
【答案】
(a) 的回歸模型假設:線性關係、自變數固定或與誤差獨立、誤差項零期望值、誤差項恆定變異數、誤差項獨立性、誤差項常態性。
回歸分析表(統計推斷)假設:上述誤差項的假設(獨立性、常態性、恆定變異數)成立,以確保 t 值和 P 值的準確性。
(c) 模型假設檢查方法