109 年 國立成功大學土木工程系碩士班丙組《工程統計》
第 1 題10 分
何謂中央極限定理?
登入後即可作答並保存紀錄。
中央極限定理(Central Limit Theorem, CLT)是機率論與統計學中的一個重要定理。它指出,在適當的條件下,大量的獨立隨機變數之和(或平均)的機率分佈,近似於常態分佈(高斯分佈),而與這些隨機變數的原始分佈無關。
更具體地說,假設有一串獨立且同分佈(i.i.d.)的隨機變數 ,它們具有有限的期望值 和有限的變異數 。當樣本數 足夠大時,這些隨機變數的樣本平均值 的分佈,會近似於一個常態分佈,其期望值為 且變異數為 。
第 2 題10 分
何謂假設檢定的型II誤差?
登入後即可作答並保存紀錄。
在假設檢定中,我們設定一個虛無假設 () 和一個對立假設 (),並根據樣本資料來決定是否拒絕 。在決策過程中,可能出現兩種錯誤:
- 型I誤差 (Type I Error):當虛無假設 () 實際上為真時,我們卻拒絕了它。此錯誤發生的機率通常用 表示,稱為顯著水準。
- 型II誤差 (Type II Error):當虛無假設 () 實際上為偽時(即對立假設 為真時),我們卻未能拒絕它。此錯誤發生的機率通常用 表示。
型II誤差的定義:
型II誤差是指,實際上母體參數(或現象)存在某種差異或效果(即 為偽),但根據樣本資料進行檢定後,卻得出「沒有足夠證據拒絕 」的結論。
第 3 題10 分
樣本變異數為母體變異數之估計量,請證明其是否為不偏估計。
登入後即可作答並保存紀錄。
我們要證明樣本變異數 是母體變異數 的不偏估計量。
假設母體為 ,其期望值為 ,變異數為 。
樣本平均值為 。
樣本變異數的定義為:
我們需要證明 。
考慮 :
我們知道 。
考慮 :
對上式取期望值:
我們有:
- 。
- 。
當 時,。
當 時, 與 是獨立的,且 ,,所以 。
因此,
第 4 題10 分
為線性迴歸式,請以最小誤差平方法推導出迴歸係數之計算式。
登入後即可作答並保存紀錄。
核心觀念
給定 組觀測資料 ,以直線 描述 與 的關係。最小平方法選擇截距 與斜率 ,使觀測值與迴歸線預測值之間的殘差平方和最小:
解題方法:對殘差平方和求極小值
將 分別對 、 求偏導數,並令偏導數為零。
對 求偏導:
整理得:
對 求偏導:
整理得:
這兩式稱為最小平方法的常態方程式。由第一式可得:
其中 ,。將 代入第二式,解得斜率:
第 5 題20 分
若某混凝土抗壓強度呈常態分配,已知其平均值=250.3 kgf/cm²,標準差=34.2 kgf/cm²。請估計強度介於210至300之機率。
登入後即可作答並保存紀錄。
本題考驗對常態分配機率計算的理解。已知混凝土抗壓強度 服從常態分配,其平均值 ,。我們要求的是 。
為了計算這個機率,我們需要將 標準化為標準常態變數 ,其公式為 。
-
計算 對應的 值:
-
計算 對應的 值:
現在我們需要計算 。
根據標準常態分配的性質,此機率等於 。
我們可以查閱標準常態分配表(或使用統計軟體)來獲得這些值。
從標準常態分配表中(或使用計算機):
- 約為 (查表時,1.45約為0.9279,1.46約為0.9279,取中間值或查更精確表格)。
第 6 題20 分
由某建材中抽樣15片進行抗拉強度試驗後,得知其平均數與標準差分別為39.3與2.6,請計算該建材平均抗拉強度之95%信賴區間。
登入後即可作答並保存紀錄。
本題要求計算母體平均值的信賴區間。由於母體標準差 未知,且樣本數 較小,我們應使用 分配來建構信賴區間。
已知資訊:
- 樣本數
- 樣本平均值
- 樣本標準差
- 信賴水準為 95%,因此顯著水準 。
對於 分配,自由度 (degree of freedom, df) 為 。
95% 信賴區間的公式為:
其中 是 分配在自由度為 時,尾端機率為 的臨界值。
-
確定臨界值 :
,所以 。
自由度 。
我們需要在 分配表中查找 。
查閱 分配表(或使用計算機),當 且右尾機率為 時,臨界值 。 -
計算標準誤 (Standard Error, SE):
第 7 題20 分
為了探討土木與化工兩系在英文能力的差異,乃從兩系學生中隨機抽樣考試,資料如下:土木系樣本數=30,平均分數=83.5,標準差=8;化工系樣本數=40,平均分數=80,標準差=10。試問在的顯著水準下,兩系的英文能力是否有差異?(20分)
登入後即可作答並保存紀錄。
本題考驗對兩獨立樣本 檢定的應用。我們欲比較土木系與化工系學生英文能力的平均分數是否存在顯著差異。
已知資訊:
- 土木系 (Civil Engineering, CE):
- 樣本數
- 樣本平均值
- 樣本標準差
- 化工系 (Chemical Engineering, ChE):
- 樣本數
- 樣本平均值
- 樣本標準差
- 顯著水準 (題目中的 "在的顯著水準下" 應為 ,這是統計檢定中最常見的顯著水準,若未標明通常預設為此值。若題目意指其他值,則需更正。)
假設設定:
- 虛無假設 ():兩系學生英文能力的平均分數沒有差異。即 。
- 對立假設 ():兩系學生英文能力的平均分數有差異。即 。
這是一個雙尾檢定 (two-tailed test)。
檢定方法:
由於我們有兩個獨立樣本,且母體標準差未知,我們使用兩獨立樣本 檢定。
在進行 檢定之前,需要判斷兩個母體變異數是否相等。若相等,則使用合併變異數的 檢定;若不相等,則使用 Welch's 檢定(不假設變異數相等)。
我們可以先進行 檢定來比較變異數,但在此類考試題目中,若未特別指示,常預設兩種情況,或鼓勵直接採用較保守的 Welch's 檢定。
我們計算變異數的比值:
。
這個比值不算非常大,但也不小。如果使用 檢定,需要查表。
在此,我們採用較通用的 Welch's 檢定,它不假設母體變異數相等。
Welch's 檢定統計量:
在 下,,所以:
計算檢定統計量 :