112 年 國立政治大學心理學系碩士班社會與人格組《心理與教育統計學、心理測驗學、心理實驗法》
第 1 題
某研究員想了解嚼食檳榔與牙周病之間的關係,他使用與醫療有關的開放資料庫,並整理出下方列聯表。表格內英文字母代表人數。請問,有嚼食檳榔習慣的情形下,人們會得到牙周病的條件機率為?
(圖表:
有牙周病 | 無牙周病
有嚼食檳榔習慣 | m | n
無嚼食檳榔習慣 | w | x
)
(A)
(B)
(C)
(D)
登入後即可作答並保存紀錄。
核心觀念
本題考「條件機率」。在已知有嚼食檳榔習慣的條件下,得到牙周病的機率為:
解題方法
列聯表中,有嚼食檳榔習慣者位於第一列,共有 人;其中有牙周病者有 人。因此:
選項分析
第 2 題
承第一題,如果該研究員想了解嚼食檳榔會得牙周病的風險,他想計算 odds ratio 來表示風險,請問,此處的 odds ratio 為?
(圖表:
有牙周病 | 無牙周病
有嚼食檳榔習慣 | m | n
無嚼食檳榔習慣 | w | x
)
(A)
(B)
(C)
(D)
登入後即可作答並保存紀錄。
本題考查 Odds Ratio (OR) 的計算。
Odds Ratio 是用來衡量暴露 (exposure) 與結果 (outcome) 之間關聯性強度的指標,尤其常用於病例對照研究 (case-control study) 或橫斷面研究 (cross-sectional study)。在本題中,「嚼食檳榔」是暴露因素,「牙周病」是結果。
給定列聯表:
| 有牙周病 (Outcome+) | 無牙周病 (Outcome-) | |
|---|---|---|
| 嚼食檳榔 (Exposure+) | m | n |
| 不嚼檳榔 (Exposure-) | w | x |
首先,我們需要計算「暴露組」的 odds (勝算) 以及「對照組」的 odds (勝算)。
- 暴露組 (嚼食檳榔) 的 odds:
在嚼食檳榔的人群中,有牙周病的機率是 ,無牙周病的機率是 。
暴露組的 odds = 。
第 3 題
承第一題,如果該研究員想進行推論統計分析,來說明嚼食檳榔與牙周病之間的關係,下列何者檢
定你會建議他使用?
(圖表:
有牙周病 | 無牙周病
有嚼食檳榔習慣 | m | n
無嚼食檳榔習慣 | w | x
)
(A) F test
(B) z test
(C) t test
(D) test
登入後即可作答並保存紀錄。
本題考查適合分析類別資料關聯性的統計檢定方法。
此研究的情境是探討「嚼食檳榔習慣」(一個類別變項,有/無)與「牙周病」(一個類別變項,有/無)之間的關係。這種兩個類別變項之間的關聯性分析,通常使用卡方檢定 (Chi-squared test)。
列聯表 (contingency table) 的資料,最適合用來檢定兩個類別變項之間是否獨立。卡方檢定就是用來檢定兩個類別變項之間是否獨立的統計方法。
我們來分析其他選項為何不適合:
(A) F test:F檢定通常用於變異數分析 (ANOVA),用於比較三個或更多組別的平均數是否有顯著差異,或者用於迴歸分析中檢定整個迴歸模型的顯著性。它主要處理連續型依變項。
第 4 題
某生投擲兩枚公正骰子並記錄點數總和,若該生重複這個動作一百次,並將每次記錄的點數和做成
次數分配圖,請問這個分配會傾向於下列何者?
(A) 常態分配
(B) 均等分配
(C) 正偏分配
(D) 雙峰分配
登入後即可作答並保存紀錄。
本題考查中央極限定理 (Central Limit Theorem) 的應用,以及機率分佈的性質。
當我們投擲一枚骰子時,點數(1 到 6)是均勻分佈的。然而,題目要求的是「投擲兩枚公正骰子並記錄點數總和」。
兩枚骰子的點數總和可能的範圍是 到 。
我們來列出各種總和的組合及機率:
- 總和為 2:(1,1) - 1 種組合
- 總和為 3:(1,2), (2,1) - 2 種組合
- 總和為 4:(1,3), (2,2), (3,1) - 3 種組合
- 總和為 5:(1,4), (2,3), (3,2), (4,1) - 4 種組合
- 總和為 6:(1,5), (2,4), (3,3), (4,2), (5,1) - 5 種組合
- 總和為 7:(1,6), (2,5), (3,4), (4,3), (5,2), (6,1) - 6 種組合
- 總和為 8:(2,6), (3,5), (4,4), (5,3), (6,2) - 5 種組合
- 總和為 9:(3,6), (4,5), (5,4), (6,3) - 4 種組合
- 總和為 10:(4,6), (5,5), (6,4) - 3 種組合
- 總和為 11:(5,6), (6,5) - 2 種組合
- 總和為 12:(6,6) - 1 種組合
總組合數為 。
各種總和的機率分別為:
P(2)=1/36, P(3)=2/36, P(4)=3/36, P(5)=4/36, P(6)=5/36, P(7)=6/3
第 5 題
若已知母親懷孕的年齡可以解釋孩子智力分數變異的9%。今有一童,其智力測驗分數為x。已知該
智力測驗常模的平均值為µ,標準差為s。則以下敘述何者正確?
(A) 母親懷孕年齡與孩子智力相關為0.081
(B) 若已知該童母親懷他時的年齡,則在 95%信心水準下,該兒童智力分數的上下區間為 x±1.96s (0.91)0.5
(C) 如果x>2s+µ,則表示該童智力勝過95%的同龄孩童
(D) 若某醫生宣稱該孩童的智力不同於平常孩童,為滿足統計假設,我們應該使用ttest 檢驗對該醫生的宣言進行檢定。
登入後即可作答並保存紀錄。
核心觀念
本題考查:
- 決定係數與相關係數的關係:
- 迴歸預測的估計標準誤:
- 標準常態分數與百分等級的判斷。
- 單一個體與常模平均數比較時, 檢定與 檢定的選用。
已知母親懷孕年齡可解釋孩子智力分數變異的 ,因此:
題目未提供相關方向,因此只能確定相關係數的絕對值為 。
解題方法
由決定係數可得未被母親懷孕年齡解釋的變異比例:
因此,迴歸預測的估計標準誤為:
在 信心水準下,使用標準常態臨界值 ,預測區間可寫為:
其中 是根據母親懷孕年齡所得到的孩子智力預測分數。題目選項以 表示該預測分數,因此選項(B)的公式正確。
選項分析
(A)錯誤
母親懷孕年齡與孩子智力的相關係數不是 。
因為:
所以:
且題目沒有提供相關方向,相關係數可能為 或 ,不能判定為 。
(B)正確
第 6 題
某生一共收集了十名男生十名女生的身高,他想了解性別與身高的關係,請問下列何種分析不適合
用?
(A) t test
(B) ANOVA
(C) z test
(D) Pearson's r
登入後即可作答並保存紀錄。
本題考查不同統計方法適用於不同資料類型和研究問題的判斷。
研究問題:了解「性別」(類別變項,兩類:男生、女生)與「身高」(連續變項)之間的關係。
樣本:10 名男生,10 名女生,共 20 人。
我們逐一分析各選項:
(A) t test (獨立樣本 t 檢定)
獨立樣本 t 檢定用於比較兩個獨立群體(在這裡是男生和女生)的平均數是否有顯著差異。
我們可以計算男生平均身高和女生平均身高,然後使用獨立樣本 t 檢定來判斷這兩個平均身高是否存在統計上的顯著差異。
因此,t test 是適合的。
(B) ANOVA (變異數分析)
當我們只有兩個群體時,變異數分析 (ANOVA) 的結果與獨立樣本 t 檢定是等價的。
ANOVA 可以用來比較兩個或多個群體的平均數。在這裡,我們有兩個群體(男生和女生),可以進行單因子變異數分析 (One-way ANOVA)。
因此,ANOVA 是適合的。
(C) z test
z 檢定通常用於以下情況:
- 當母體標準差 已知時,檢定單一樣本平均數與母體平均數的差異。
- 當母體標準差 已知時,檢定兩個獨立樣本平均數的差異。
- 當樣本量夠大 (n>30),母體標準差未知時,用樣本標準差 近似 ,進行樣本平均數與母體平均數的差異檢定。
- 當樣本量夠大 (n>30),母體標準差未知時,用樣本標準差 近似 ,進行兩個獨立樣本平均數的差異檢定。
第 7 題
某個長期研究收集了一批受試者在八歲和十八歲時的身高。該研究的助理本想檢驗以八歲的身高預
測十八歲身高的迴歸模型,但在操作統計軟體分析卻不小心變成做變異數分析了。輸出的報表中有
獨變項平方和SSA和殘差平方和SSR,試問,我們是否仍有辦法得知兩個年齡下的身高之間的相關?
(A) 有辦法,相關係數為[SSA/(SSA+SSR)]^0.5
(B) 有辦法,相關係數為SSA/SSR
(C) 沒辦法
(D) 有辦法,相關係數為SSA/(SSA+SSR)
登入後即可作答並保存紀錄。
核心觀念
本題考查「單一自變項線性迴歸」與「變異數分析表」之間的關係。
以八歲身高預測十八歲身高時,若迴歸模型包含截距,則:
- 總平方和:
- 自變項所解釋的平方和:
- 殘差平方和:
三者關係為:
在單一自變項的線性迴歸中,決定係數 等於兩變項相關係數的平方:
解題方法
由變異數分析表可先求出決定係數:
代入 :
由於單一自變項迴歸中 ,因此:
本題研究的是八歲與十八歲身高,兩者通常具有正向關係,因此相關係數取正值:
因此選擇(A)。
嚴格而言,單靠平方和只能得到 ,無法判斷相關係數正負;本題依身高發展的合理研究情境,採正向關係。
選項分析
第 8 題
承第七題,若該報表中顯示獨變項的自由度為1,殘差的自由度為m,則請問這個研究的受試者有
幾位?
(A) m+1
(B) m+2
(C) m+3
(D) m+4
登入後即可作答並保存紀錄。
本題考查迴歸分析或變異數分析中的自由度計算。
題目提到:
- 獨變項的自由度 (df_variable) = 1
- 殘差的自由度 (df_residual) = m
在簡單線性迴歸模型中 ():
- 迴歸平方和 (SSR or SSA) 的自由度為自變項的數量。在這裡,只有一個自變項(八歲身高),所以迴歸自由度為 1。這與題目給的「獨變項的自由度為 1」一致。
- 殘差平方和 (SSE or SSR) 的自由度與樣本數 (n) 和迴歸參數的數量有關。
- 迴歸模型有兩個參數:截距 () 和斜率 ()。
- 殘差自由度 (df_residual) = 樣本數 (n) - 迴歸參數的數量。
- 所以,。
- 在簡單線性迴歸中,參數數量為 2 (即 和 )。
- 因此,。
題目給定 。
所以,。
要計算受試者人數 ,我們需要將公式重新排列:
。
第 9 題
有兩條麵包生產線,甲生產線製作的麵包平均100克,標準差10克;乙生產線製作的麵包平均150
克,標準差10克,試問從品管的角度來看,哪一條生產線的生產品質比較穩定?
(A) 乙
(B) 甲
(C) 一樣穩定
(D) 無法判斷
登入後即可作答並保存紀錄。
本題考查變異數作為品質穩定性指標的判斷。
品管 (Quality Control) 的目標之一是確保產品的一致性 (consistency) 和穩定性 (stability)。在統計學上,衡量數據變異程度的指標通常是標準差 (standard deviation) 或變異數 (variance)。標準差越小,表示數據越集中在平均值附近,變異越小,品質越穩定。
題目給了兩條生產線的資訊:
- 甲生產線:
- 平均值 () = 100 克
- 標準差 () = 10 克
- 乙生產線:
- 平均值 () = 150 克
- 標準差 () = 10 克
第 10 題
某生欲以線性模型(linear model)進行受試間二因子變異數分析,其模型為: 。其中,A和B為獨立變項,y為依變項。若已知兩變項文互作用達顯著,A的主要因果達顯著,但B的主要效果沒有達顯著,則下列何者為真?
(A) 顯著不等於 0
(B) 顯著不等於 0
(C) 顯著不等於 0
(D) 、、 和 均顯著不等於 0
登入後即可作答並保存紀錄。
本題考查二因子變異數分析 (Two-way ANOVA) 中,因子效果與交互作用的顯著性與迴歸係數顯著性的關係。
線性模型為:
其中:
- 是依變項。
- 和 是兩個類別型的自變項(因子)。
- 是總平均數 (overall mean)。
- 是因子 A 的主效果 (main effect of A)。
- 是因子 B 的主效果 (main effect of B)。
- 是因子 A 和 B 的交互作用效果 (interaction effect of A and B)。
- 是誤差項。
通常在進行因子分析時,類別變項會被編碼成虛擬變數 (dummy variables)。
假設因子 A 有 個水準,因子 B 有 個水準。
若採用虛擬編碼,通常會將其中一個水準設為參照組 (reference group)。
例如,如果 A 有兩個水準 ,B 有兩個水準 。
我們將 編碼為 , 編碼為 。
將 編碼為 , 編碼為 。
此時,模型的各項係數有特定含義:
- : 當 且 時 (即 ) 的平均反應。
- : 在 (即 ) 的情況下,因子 A 從 到 的效果。
- : 在 (即 ) 的情況下,因子 B 從 到 的效果。
- : 交互作用項。它代表當 A 從 變到 時,B 的效果的改變量;或者,當 B 從 變到 時,A 的效果的改變量。
題目給定的資訊是:
- 兩變項交互作用達顯著 (A x B interaction is significant):這意味著 項的效果是顯著的。在線性模型中,這個效果對應的係數是 。因此, 應該是顯著不等於 0。
第 11 題
某實驗採二因子混合設計,其中甲為受試者間變項,有兩個水準,乙為受試者內變項,有三個水準。
考驗甲的主要效果時,誤差項分母為58;考驗乙的主要效果時,誤差項分母為116。假設此實驗為
等格設計,試問實驗受試者的總人數為何?
(A) 30
(B) 180
(C) 60
(D) 90
登入後即可作答並保存紀錄。
本題考查混合設計 (mixed design) 變異數分析中,自由度的計算,特別是受試者間 (between-subjects) 和受試者內 (within-subjects) 的設計。
研究設計:
- 因子 A (甲):受試者間因子 (between-subjects factor),有 2 個水準。
- 因子 B (乙):受試者內因子 (within-subjects factor),有 3 個水準。
- 設計為混合設計,表示包含受試者間和受試者內因子。
- 題目假設為「等格設計」(equally good design),這通常意味著各組的樣本數相等。
我們需要釐清「誤差項分母」的自由度是如何計算出來的。
在混合設計 ANOVA 中,通常有幾種誤差項:
- 受試者間誤差 (Between-subjects error):用於檢定受試者間因子的主效果(例如因子 A 的主效果)。
- 受試者內誤差 (Within-subjects error):用於檢定受試者內因子的主效果(例如因子 B 的主效果)以及交互作用效果 (A x B interaction)。
我們需要定義一些符號:
- :總受試者人數。
- :受試者間因子(甲)的水準數 = 2。
- :受試者內因子(乙)的水準數 = 3。
- :每個受試者內設計的樣本數。對於混合設計,這通常是指每個受試者內因子組合的觀測值數量,或者更常理解為每個「受試者」的觀測值數量。
在這種設計中,總受試者人數 是關鍵。
受試者間因子 (A) 有 個水準。
受試者內因子 (B) 有 個水準。
1. 檢定甲的主要效果 (Factor A, Between-subjects effect):
- 這個檢定是比較不同受試者群體(即因子 A 的不同水準)的平均反應。
- 檢定這個效果的誤差項是「受試者間誤差」。
- 受試者間誤差的自由度 (df_error_between) 通常計算為:
第 12 題
下列關於假說檢定的敘述,何者為真?
(A) p值愈小,效果愈強
(B) sample size 不會影響 p值
(C) power 會受到 effect size、sample size 和 a 的影響
(D) power 是根據 分配來計算的
登入後即可作答並保存紀錄。
本題考查統計學中假設檢定的基本概念,包括 p 值、樣本大小、效果量與統計檢定力 (power)。
我們逐一分析各選項:
(A) p 值愈小,效果愈強
- p 值 (p-value):p 值是指在虛無假說 () 為真的情況下,觀察到當前樣本結果或更極端結果的機率。p 值越小,表示觀察到的結果越不可能在 為真的情況下發生,因此我們有更強的證據拒絕 。
- 效果量 (Effect Size):效果量衡量的是自變項與依變項之間關聯的實際大小,或者不同群體之間差異的大小。它獨立於樣本大小。
- 關係:p 值的大小受到樣本大小、效果量和顯著水準 () 的影響。
- 在相同的 下,較小的 p 值表示統計顯著性較高。
- 然而,p 值小(統計上顯著)並不直接等同於效果量大(實際意義上的重要性)。一個很小的效果量,只要樣本夠大,也可能得到很小的 p 值。反之,一個很大的效果量,如果樣本量不大,p 值可能不夠小而無法達到統計顯著。
- 結論:p 值小表示統計上顯著,但不能直接推斷效果量一定強。因此,選項 (A) 錯誤。
(B) sample size 不會影響 p 值
- 關係:p 值的大小與樣本大小 (sample size, ) 密切相關。
- 在效果量和 不變的情況下,樣本越大,檢定統計量的絕對值通常越大,p 值就越小。
- 這是因為較大的樣本提供了更多資訊,能更精確地估計母體參數,從而更容易檢測出即使是微小的差異(效果量)。
- 結論:sample size 會影響 p 值。因此,選項 (B) 錯誤。
(C) power 會受到 effect size、sample size 和 a 的影響
第 13 題
某人想建立預測y的迴歸模型。三個變項 、、 都有可能放入這個迴歸模型,但不知道是哪幾
個。他分別建立了兩個迴歸模型: 以及 。他以ANOVA 比較兩個
模型的對資料變異的解釋量,在計算F值時,分子的自由度為多少?
(A) 3
(B) 1
(C) 4
(D) 2
登入後即可作答並保存紀錄。
本題考查迴歸分析中,比較兩個模型時,F檢定的自由度計算。
題目中比較了兩個迴歸模型:
-
模型 1 (較複雜模型):
- 包含三個預測變項 (),加上截距項。
- 總共有 4 個參數 ()。
- 預測變項的數量為 。
-
模型 2 (較簡單模型):
- 包含一個預測變項 (),加上截距項。
- 總共有 2 個參數 ()。
- 預測變項的數量為 。
當我們使用 ANOVA 來比較兩個嵌套模型(一個模型是另一個模型的子集)時,我們通常是檢定較複雜模型中,被排除在較簡單模型之外的預測變項是否對依變項有顯著的額外解釋力。
這個 F 檢定的目的是檢定:
: 且 (即 和 對 沒有額外的解釋力,模型 2 足夠)
: 或 (即 或 中至少有一個對 有額外的解釋力,模型 1 更好)
F 檢定的公式為:
第 14 題
下列何者不是描述一個分配的指標?
(A) 極端值
(B) 峰度
(C) 偏態
(D) 標準差
登入後即可作答並保存紀錄。
本題考查描述性統計中,用來描述機率分佈特徵的指標。
描述性統計中的指標可以分為三大類:
- 集中趨勢 (Central Tendency):描述數據的中心位置,例如平均數、中位數、眾數。
- 離散程度 (Dispersion/Variability):描述數據的散佈範圍,例如標準差、變異數、全距。
- 分佈形狀 (Shape of Distribution):描述數據分佈的形態,例如偏態、峰度。
我們來分析各選項:
(A) 極端值 (Extreme values)
- 極端值(離群值, outliers)是指那些遠離數據集中大部分數據的值。
- 極端值會影響數據的集中趨勢(特別是平均數)和離散程度(標準差)。
- 雖然極端值本身不是一個單獨的「指標」,但它們是描述數據分佈特徵(例如,是否可能存在偏態)的一個重要「觀察對象」。
- 在某些情況下,會報告數據中的最小值和最大值,這也反映了極端值。
- 嚴格來說,極端值不是一個「指標」,而是一種「現象」。但它們是描述分佈的重要線索。
(B) 峰度 (Kurtosis)
- 峰度是描述機率分佈「峰」的尖銳程度或平坦程度,以及尾部的厚重程度。
- 峰度是描述分佈形狀的一個重要統計指標。例如,正態分佈的峰度為 0 (或 3,取決於定義)。
第 15 題
下列與變異數分析有關的敘述,何者正確?
(A) 交互作用達顯著後可以進行事後比較
(B) 主要效果達顯著後可以進行事後檢定
(C) 趨勢分析是事後比較的一種
(D) 事後比較後可以進行單純主要效果分析
登入後即可作答並保存紀錄。
本題考查變異數分析 (ANOVA) 的事後檢定 (post-hoc tests) 和相關概念。
我們逐一分析各選項:
(A) 交互作用達顯著後可以進行事後比較
- 交互作用 (Interaction Effect):當兩個或多個自變項的聯合效應不同於它們各自單獨效應的總和時,就存在交互作用。
- 事後比較 (Post-hoc Tests):事後比較(也稱為多重比較, multiple comparisons)通常是指在檢定到某個因子(或交互作用)有顯著差異後,進一步確定是哪些組別之間存在顯著差異。
- 情況:
- 如果是交互作用顯著,我們通常會進行單純主要效果分析 (Simple Main Effects Analysis),而不是直接進行事後比較。單純主要效果分析是固定其中一個因子的一個水準,然後檢定另一個因子的效果。例如,若 A x B 交互作用顯著,我們可以固定 A 的某個水準,然後檢定 B 在這個固定水準下的差異。
- 事後比較 (如 Tukey's HSD, Bonferroni, Scheffé 等) 主要用於檢定主要效果顯著時,哪個或哪些組別之間有差異。
- 結論:交互作用顯著時,通常進行單純主要效果分析,而不是直接的事後比較。因此,選項 (A) 錯誤。
(B) 主要效果達顯著後可以進行事後檢定
- 主要效果 (Main Effect):指單一自變項對依變項的平均影響,忽略其他自變項。
- 情況:
- 當一個因子(主要效果)有多於兩個水準,並且該因子的 F 檢定結果顯著時,我們知道至少有兩個水準的平均數之間存在差異。
- 為了確定是哪些具體的水準之間存在差異,我們需要進行事後檢定(post-hoc tests)。
第 9 題
說明何為「度量化方法」(scaling methods)。詳述任何兩個心理計量學家提出的
度量化方法的理論細節內容。(8%)
登入後即可作答並保存紀錄。
度量化方法 (Scaling Methods)
度量化方法是指在心理計量學中,將觀察到的反應(例如,對題目的同意程度、判斷的等級、行為的頻率等)轉換為量化分數的系統性程序。這些方法試圖建立一個心理連續量尺,使得測量結果能夠反映個體在某種心理特質上的程度。透過度量化,我們可以將模糊的、定性的觀察轉化為數值的、定量的指標,進而進行統計分析和比較。
度量化方法的目標是:
- 建立量尺:將觀察到的反應對應到一個連續的量尺上。
- 量化特質:反映個體在特定心理特質(如態度、能力、性格)上的程度。
- 確保測量屬性:使量尺具有一定的數學和心理學屬性,例如等距性、單度性等(依方法而異)。
以下詳述兩種重要的心理計量學家提出的度量化方法:
1. 步驟反應理論 (Item Response Theory, IRT)
- 提出者:雖然 IRT 是由多位學者發展起來的,但其基礎工作可追溯至 Rasch, Lord, Birnbaum 等人。
- Rasch Model:Georg Rasch 提出的二參數邏輯模型 (2-parameter logistic model) 或一參數邏輯模型 (1-parameter logistic model) 是 IRT 的重要代表。
- 理論細節:
- 核心思想:IRT 認為,個體在測驗題目上的表現(例如,答對題目的機率)是個體潛在特質量(theta, )和題目本身特徵(參數)的函數。
- 模型假設:
- 單度性 (Unidimensionality):測驗只測量一個潛在特質量。
- 局部獨立性 (Local Independence):在相同潛在特質量水平的個體之間,其對不同題目的反應是獨立的。
- 模型參數:
- 個體參數 ():代表個體在所測量特質量上的水平。
- 題目參數:
- 難度參數 (difficulty parameter, ):代表回答該題目所需的能力水平。對於二分法題目(對/錯),較高的 值表示題目較難。
- 區辨度參數 (discrimination parameter, ):代表題目區分不同能力水平個體的能力。較高的 值表示題目能更好地區分高低能力者。
- 猜測參數 (guessing parameter, ):代表個體僅憑猜測而答對題目的機率(通常用於多選題)。
- 數學模型 (以二分法題目為例):
- 一參數邏輯模型 (1PL, Rasch Model):。
第 2 題
如何決定需要編制一個「新」的測驗,而非使用現成的測驗?詳述至少兩個理由並說明其具體細節和判准標準。(8%)
登入後即可作答並保存紀錄。
決定是否需要編制一個「新」的測驗,而不是直接使用現有的測驗,需要考量多方面的因素。以下是至少兩個重要理由,以及其具體細節和判准標準:
理由一:現有測驗無法充分符合研究目的或測量需求
- 具體細節:
- 測量對象的特殊性 (Target Population Specificity):現有的測驗可能是在特定人群(例如,某個文化背景、年齡層、臨床群體)上發展和標準化,但你的研究對象是另一特定群體,他們在語言、文化、經驗或認知能力上可能與標準化群體有顯著差異。這可能導致現有測驗的題目對你的研究對象不適用、難以理解,或無法準確反映其特質。
- 判準標準:
- 現有測驗的題目內容(概念、詞彙、情境)與目標對象的生活經驗、文化背景或認知結構不符。
- 現有測驗的標準參照群體與目標研究對象差異過大,導致標準分數解釋失準。
- 現有測驗未能涵蓋目標對象的特定潛在特質或行為表現。
- 判準標準:
- 測量目的的獨特性 (Unique Measurement Objective):你的研究可能關注的是現有測驗未曾涵蓋的、全新的心理概念、行為或現象,或者需要以一種新的方式來操作化 (operationalize) 這些概念。現有測驗可能只測量了部分相關的特質,但無法提供你研究所需的精確度和廣度。
- 判準標準:
- 現有測驗無法測量到你感興趣的特定構念 (construct)。
- 現有測驗所測量的構念,在操作化定義上與你的研究定義不符。
- 你需要測量的是一個新興的、尚未被廣泛研究的現象。
- 判準標準:
- 測量工具的限制 (Limitations of Existing Instruments):現有測驗可能存在效度或信度不足的問題(儘管這通常是在開發新測驗時需要解決的問題,但有時現有測驗的缺陷非常明顯且難以彌補),或者其施測方式、計分方法不符合你的研究設計或資源限制。
- 判準標準:
- 現有測驗的效度 (validity) 和信度 (reliability) 指標(如 Cronbach's 、test-retest reliability、效標關聯效度等)不符合研究要求。
- 判準標準:
- 測量對象的特殊性 (Target Population Specificity):現有的測驗可能是在特定人群(例如,某個文化背景、年齡層、臨床群體)上發展和標準化,但你的研究對象是另一特定群體,他們在語言、文化、經驗或認知能力上可能與標準化群體有顯著差異。這可能導致現有測驗的題目對你的研究對象不適用、難以理解,或無法準確反映其特質。
第 3 題
請列出三項在使用心理測驗於臨床實務上必須注意的道德考量和規範,並說明
其考量原因和未注意時可能造成的影響為何。(9%)
登入後即可作答並保存紀錄。
在臨床實務中使用心理測驗,必須嚴格遵守道德規範,以確保受試者的權益、測驗的準確性及結果的恰當使用。以下列出三項重要的道德考量和規範:
1. 保密性與隱私權 (Confidentiality and Privacy)
- 道德考量與規範:
- 心理師必須對在測驗過程中獲取的受試者資訊(包括測驗結果、個人資料、訪談內容等)嚴格保密。
- 除非獲得受試者的書面同意,或法律要求(例如,有立即的自傷或傷人風險、兒童虐待報告義務),否則不得向第三方透露這些資訊。
- 測驗結果的儲存和傳輸應採取適當的安全措施,防止未經授權的存取。
- 考量原因:
- 建立信任關係:保密性是建立心理師與受試者之間信任關係的基石。受試者只有在相信其資訊會被保護時,才願意坦誠地分享個人經歷和感受。
- 保護受試者免受傷害:某些測驗結果(如精神疾病診斷、潛在心理困擾)可能對受試者的聲譽、就業、保險或人際關係造成負面影響。保密性可以保護他們免受不必要的傷害。
- 尊重個人自主權:個人有權決定其個人資訊的分享範圍。
- 未注意時的影響:
- 破壞信任,阻礙治療:如果保密性被破壞,受試者可能會失去對心理師的信任,拒絕繼續接受治療,或在溝通過程中有所保留,嚴重影響治療效果。
- 法律訴訟與專業懲戒:違反保密原則可能導致法律訴訟、專業倫理委員會的調查和懲戒,甚至吊銷執照。
- 對受試者造成二次傷害:測驗結果的洩漏可能導致受試者面臨社會歧視、排斥,或遭受情感上的痛苦。
2. 測驗的適當使用與解釋 (Appropriate Use and Interpretation of Tests)
- 道德考量與規範:
- 心理師應僅使用其專業知識和能力範圍內適當的測驗。
- 測驗的使用應符合其開發時的標準化樣本和目的。不得將不適用於特定人群(如文化、語言、年齡、診斷群體)的測驗強行套用。
- 測驗結果的解釋必須基於專業知識,並結合其他臨床資訊(如面談、行為觀察、病史),而非僅依賴單一測驗分數。
- 解釋結果時,應以受試者能夠理解的方式溝通,並避免過度簡化或誇大。
- 考量原因:
第 4 題
「效度」為評量一個測驗的重要面向,請說明以 Myers-Briggs Type Indicator
(MBTI)作為生涯規劃中工作職業選擇使用的效度評量。(1)何為 MBTI 測驗?
(2)詳述至少三個可以具體執行上述使用目的之效度評量的內容細節。(10%)
登入後即可作答並保存紀錄。
效度 (Validity) 是指測驗測量其聲稱要測量的特質的程度。在評量一個測驗用於特定目的時,效度是首要考量。
1. 何為 MBTI 測驗?
Myers-Briggs Type Indicator (MBTI) 是一種性格類型分類工具,由 Isabel Myers 和 Katharine Briggs 在 Carl Jung 的心理類型理論基礎上發展而來。它旨在幫助人們理解自己與生俱來的偏好,以及這些偏好如何影響他們對世界的看法和決策方式。
MBTI 將個體的性格偏好歸類於四個二元對立的維度上:
- 能量來源 (Where you focus your energy):
- 外傾 (Extraversion, E):傾向於從外部世界獲取能量,關注行動和人。
- 內傾 (Introversion, I):傾向於從內部世界(想法和觀念)獲取能量,關注思考和內省。
- 獲取資訊的方式 (How you take in information):
- 感覺 (Sensing, S):傾向於關注實際、具體的事實和細節,通過五官感知。
- 直覺 (Intuition, N):傾向於關注模式、可能性和抽象概念,通過聯想和預感。
- 做決定的方式 (How you make decisions):
- 思考 (Thinking, T):傾向於基於邏輯、客觀分析和因果關係做決定。
- 情感 (Feeling, F):傾向於基於價值觀、人際和諧以及對他人的影響做決定。
- 生活方式 (How you live your outer life):
- 判斷 (Judging, J):傾向於有組織、有計劃、喜歡結構化和解決問題。
- 知覺 (Perceiving, P):傾向於靈活、自發、喜歡保持開放和適應性。
這四個維度的組合產生了 16 種不同的性格類型(例如,ISTJ, ENFP 等)。MBTI 測驗通常透過問卷形式進行,受試者選擇最符合其偏好的選項。
2. 以 MBTI 作為生涯規劃中工作職業選擇的效度評量
在生涯規劃和職業選擇的應用中,MBTI 的效度評量需要關注其測量結果是否能準確預測或解釋個體在工作中的適配性、滿意度及表現。以下詳述至少三個效度評量的內容細節:
(a) 效標關聯效度 (Criterion-Related Validity)
- 定義:效標關聯效度是指測驗分數與外部效標(一個被認為是衡量同一特質或相關結果的標準)之間的關聯程度。在生涯規劃中,效標可以是工作滿意度、工作績效、職業適配度評級、在特定職業中的穩定性等。
- 具體執行細節:
- 招募樣本:選擇一個在特定職業領域工作的樣本群體(例如,軟體工程師、護士、教師、銷售人員)。
- 施測 MBTI:讓這些員工完成 MBTI 測驗,記錄其性格類型。
- 收集效標數據:
- 工作滿意度:讓員工填寫標準化的工作滿意度量表。
- 工作績效:由其主管對員工的工作績效進行評級(例如,使用評級量表,或客觀績效數據如銷售額、生產量)。
- 職業適配度:可以由專家或主管評定員工與其職業的適配程度。
- 穩定性:記錄員工在該職業的任職時間,或離職率。
- 統計分析:
- 比較不同 MBTI 類型群體在效標上的差異:例如,檢定特定職業(如工程師)中,某種 MBTI 類型(如 T 型)的員工,其工作滿意度或績效是否顯著高於其他類型的員工。可以使用 t 檢定、ANOVA 或卡方檢定。
- 計算相關係數:如果將 MBTI 的維度(如 E/I, S/N, T/F, J/P)轉換為數值(例如,使用點雙列相關),可以計算其與連續型效標(如滿意度分數)的皮爾森相關係數。
- 判准標準:如果發現特定的 MBTI 類型或偏好與較高的工作滿意度、績效或適配度顯著相關,則支持 MBTI 在此類職業選擇上的效標關聯效度。例如,研究發現,工程師職業中 T (Thinking) 偏好者比例顯著高於 F (Feeling) 偏好者,且 T 偏好者在此職業中滿意度更高,則證明了效標關聯效度。
(b) 結構效度 (Construct Validity)
第 1 題
The appropriate control for pseudoconditioning is to employ a conditioning group and a control group. The
animals in the control group are exposed to the same number of CS and US presentations as the animals in
the experimental group, but in the control group
A. the CS and US presentations are unpaired and presented randomly.
B. the CS never precedes the US.
C. the CS is different than the CS in the conditioning group.
D. the US is different than the US in the conditioning group.
登入後即可作答並保存紀錄。
核心觀念
本題考「假性制約」(pseudoconditioning)的控制組設計。假性制約是指:受試動物在接受強烈或反覆的刺激後,對某刺激的反應變強;這種反應增強可能來自一般性的敏感化,而非學會了條件刺激(CS)與非條件刺激(US)之間的關聯。
因此,控制組須接受與實驗組相同數量的 CS 和 US,但兩者不能形成穩定的配對關係。如此才能檢驗實驗組的反應是否源於 CS–US 聯結。
解題方法
比較兩組時,控制組要控制刺激暴露量,同時排除「CS 預測 US」的關聯。做法是讓 CS 和 US 不配對,並以隨機方式呈現。若實驗組反應較強,便較能歸因於 CS–US 的制約,而非單純受到 US 刺激後的敏感化。
選項分析
第 2 題
Which of the following is not an example of an operational definition?
A. a rat is hungry when the rat craves food
B. great grandpa's recipe for moonshine
C. an actor has memorized his lines when he can repeat all of his lines twice without an error
D. reaction time is the interval between the presentation of a stimulus and the participant's response
登入後即可作答並保存紀錄。
核心觀念
操作型定義是把抽象概念說明成可觀察、可測量,或可依明確步驟執行的條件。它讓研究者知道要如何判定一個概念是否出現,而不只用另一個含糊概念來描述。
解題方法
逐一檢查各選項:描述是否提供了明確的判定標準或操作步驟?若只以主觀、未界定的感受解釋概念,就不是有效的操作型定義。
選項分析
- A. a rat is hungry when the rat craves food:以「想吃食物」判定老鼠是否飢餓,但「想吃」本身沒有明確的觀察或測量標準,仍是用另一個主觀概念解釋飢餓,不是操作型定義。
- B. great grandpa's recipe for moonshine:食譜列出製作過程與具體步驟,屬於可執行的操作程序,可作為操作型描述的例子。
第 3 題
Which of the following is NOT true?
A. Scale attenuation effects can be a problem in research on memory.
B. Forced choice tests are preferred to yes/no tests because correcting for guessing is less of a problem with the forced choice procedure.
C. There is a clear-cut distinction between recall and recognition.
D. The number of errors made on a memory test is frequently used as a dependent variable in memory experiments.
登入後即可作答並保存紀錄。
核心觀念
本題考記憶實驗中的測量方式,包括量尺限制造成的效應、再認測驗中的猜測,以及回憶與再認的關係。判斷時要分清楚:測驗形式不同,不代表它們測量的記憶歷程有絕對分界。
解題方法
逐項檢查敘述是否符合記憶研究的常見做法。A、B、D 描述測量上的限制或常見依變項;C 則主張回憶與再認有明確界線。回憶與再認通常是可區分的測驗形式,但兩者的心理歷程並非截然二分,因此 C 不正確。
選項分析
- A 正確。 量尺衰減效應(scale attenuation effect)是指測驗分數受量尺範圍限制,使真實的記憶差異在觀察分數上被壓縮。例如答對率接近滿分時,記憶能力仍有差異,答對率卻不容易充分呈現。記憶研究因此可能低估條件間的差異。
- B 正確。 強迫選擇測驗提供固定數目的選項,答對機率可由選項數直接估計,例如二選一的猜測機率為 。
第 4 題
When a researcher finds that the same instructions to the participants in a memory experiment have
different effects on their memory depending on how they are tested,
A. there is a main effect for instructions given to the participants.
B. there is no effect of instructions.
C. there is a main effect for type of test.
D. there is an interaction between instructions and type of test.
登入後即可作答並保存紀錄。
核心觀念
本題考二因子變異數分析中的交互作用。研究有兩個因素:給參與者的指示,以及記憶測驗的類型。若指示對記憶表現的影響,會隨測驗類型改變,表示一個因素的效果取決於另一個因素的水準,這就是交互作用。
解題方法
抓住題幹的關鍵:「相同指示對記憶的效果,會因測驗方式不同而不同。」這描述的是指示效果隨測驗類型改變,符合交互作用的定義。
若以平均數表示,設 、 為兩種指示,、 為兩種測驗類型,交互作用可表為:
也就是不同測驗類型下,指示造成的平均差異不相同。
選項分析
第 5 題
A researcher records mean response time in milliseconds for a group of participants who perform a
Donders A task and a Donders C task under two conditions. In one condition, they do the reaction time
tasks alone; in the other condition, they perform the two tasks while doing a secondary attentionally
demanding task at the same time. Reaction times for the Donders A task are the same for both conditions
of the experiment; however, reaction times for the Donders C task are longer when the secondary task is
being performed. Using the subtractive method, these results suggest
A. the secondary task slowed down the identification time of the participants.
登入後即可作答並保存紀錄。
核心觀念
本題考「Donders 減法法」:比較兩種反應作業的平均反應時間,利用兩種作業所需心理歷程的差異,推論額外歷程所需的時間。
Donders A 作業是簡單反應作業,看到刺激後做固定反應;Donders C 作業是辨識刺激後,僅對特定刺激反應。相較於 A 作業,C 作業多了刺激辨識歷程,因此:
解題方法
比較有無次要注意力作業時的反應時間:
- A 作業在兩種條件下反應時間相同,表示次要作業沒有造成可觀察的 A 作業反應時間變化。
- C 作業在同時執行次要作業時反應時間較長,表示受到干擾的是 C 作業額外包含的歷程。
- 依減法法,C 相較於 A 多出的歷程是刺激辨識,因此結果支持次要作業拖慢刺激辨識時間。
選項分析
第 6 題
The participant in an experiment has the right to
A. withdraw at any time only in certain types of experiments.
B. withdraw only prior to the start of the experiment.
C. withdraw only if the experimenter agrees.
D. withdraw at any time.
登入後即可作答並保存紀錄。
核心觀念
本題考研究參與者的基本倫理權利:參與必須出於自願,參與者可以在研究進行期間或任何階段退出,不必取得研究者同意,也不應因此受到不當處罰或損失。
解題方法
判斷各選項是否保留參與者的自主權。只要選項把退出權限縮在特定研究、特定時間,或交由研究者決定,就不符合研究倫理的自願參與原則。
選項分析
第 7 題
In order of increasing informativeness, the measurement scales are
A. interval, ordinal, ratio, and nominal.
B. nominal, ordinal, interval, and ratio.
C. ordinal, interval, nominal, and ratio.
D. ratio, ordinal, nominal, and interval.
登入後即可作答並保存紀錄。
核心觀念
本題考測量尺度的資訊量。四種尺度由低至高分別為:
- 名目尺度:只分類或命名,不能比較大小,例如血型。
- 順序尺度:能分類,也能排列高低,但相鄰等級的差距不一定相等,例如名次。
- 等距尺度:能比較差距,單位間隔相等,但沒有絕對零點,例如攝氏溫度。
- 比率尺度:具備等距尺度的性質,另有絕對零點,因此可比較倍數,例如身高與反應時間。
資訊量逐級增加:每往上一級,保留前一級的資訊,並多出一種可進行的比較。
解題方法
依序檢查每種尺度能提供的資訊:
第 8 題
In order to manipulate attention, psychologists gradually increase task demands until the subject can hardly
complete them. This is known as
A. d'.
B. confounding.
C. overload.
D. manipulation check.
登入後即可作答並保存紀錄。
核心觀念
本題考「注意力負荷」的操弄方式。研究者逐步提高作業需求,直到受試者幾乎無法完成,這種做法稱為過載(overload)。藉由提高認知需求,研究者可以觀察注意力或作業表現如何受到限制。
解題方法
抓住題幹中的關鍵描述:「逐漸增加作業需求,直到受試者幾乎無法完成」。這表示作業需求已逼近或超過受試者可用的注意力與處理能力,因此對應到「過載」。
選項分析
- A. :錯誤。 是訊號偵測理論中的辨別力指標,用來衡量個體區分訊號與雜訊的能力,與提高作業需求的操弄方式不同。
第 9 題
What is stimulus onset asynchrony (SOA) in psychological experiments? (3%) Give an example of
experiment with the SOA manipulation (4%) and explain how the SOA manipulation could help to
understand mental processing in the experiment. (4%)
登入後即可作答並保存紀錄。
核心觀念
刺激起始非同步(stimulus onset asynchrony, SOA)是兩個刺激開始呈現的時間差。若先呈現刺激 A,再呈現刺激 B,則:
例如,A 在 0 毫秒出現,B 在 300 毫秒出現,SOA 就是 300 毫秒。SOA 衡量的是兩個刺激的「起始點」相隔多久;若第一個刺激尚未消失,第二個刺激便出現,兩者呈現時間會重疊。
解題方法與例子
可用語意促發實驗說明 SOA 的操弄方式。研究者先呈現一個促發詞,再呈現目標詞,並要求受試者判斷目標詞是不是有意義的詞。例如促發詞為「護士」,目標詞為「醫生」;對照條件則可用語意無關的促發詞,例如「窗戶」。
研究者操弄促發詞與目標詞之間的 SOA,例如設定為 100、300、600 毫秒,並記錄受試者辨認目標詞的反應時間與正確率。實驗中應安排語意相關與無關條件,並控制目標詞、促發詞及作答要求,才能比較不同 SOA 下的表現。
SOA 如何幫助理解心理處理
第 10 題
The counterbalancing technique is useful for the (a) (2%) effect by systematically arrange (b) (2%) design to minimize the (c) (2%) of the conditions presented to participants. When there are more than two conditions, (d) (2%) is recommended for optimal counterbalancing.
登入後即可作答並保存紀錄。
核心觀念
反平衡(counterbalancing)主要用於受試者內設計/重複量數設計(within-subjects design/repeated-measures design)。同一位受試者會接受所有實驗條件,因此條件呈現的先後可能造成:
- 練習效果(practice effect)
- 疲勞效果(fatigue effect)
- 殘留效果(carryover effect)
這些合稱順序效果(order effect)。反平衡藉由安排不同受試者經歷不同的條件順序,使「條件」不會固定與特定的先後位置混淆。
解題方法與填空解析
-
(a)within-subjects/repeated-measures
反平衡適用於同一受試者接受多個條件的設計,也就是受試者內設計或重複量數設計。若是受試者間設計,每位受試者只接受一種條件,通常不會產生同一受試者內的條件順序問題。
-
(b)order
反平衡的主要目的,是降低條件呈現先後所造成的順序效果(order effect)。
-
(c)order/sequence
反平衡是系統性安排條件呈現的順序或序列(order/sequence),例如讓不同受試者分別接受 、、 的條