108 年 國立政治大學心理學系碩士班社會與人格組《心理與教育統計學、心理測驗學、心理實驗法》
第 1 題5 分
請問進行變異數分析(ANOVA)時,如違反各組「變異數同質性」之前提假設時,對結果推論的影響為何?
如何檢驗此「變異數同質性」的假設(說明方法和判斷標準)?
登入後即可作答並保存紀錄。
核心觀念
單因子 ANOVA 假設各組母群體變異數相等。若第 組的母群體變異數為 ,其虛無假設為:
傳統 ANOVA 會以各組資料合併估計共同的組內誤差變異數,並用 比值檢定各組平均數:
當各組變異數不同時,合併的 不再符合「共同誤差變異數」的假設,因此傳統 檢定的參考分配可能不準確,顯著性與 值也可能失真。
違反假設對推論的影響
變異數不等不代表平均數比較必然錯誤,但會使傳統 ANOVA 的第一類錯誤率不再受原定顯著水準妥善控制。尤其各組樣本數不等時,影響較大:
- 變異數大的組別樣本數較小:傳統檢定較可能保守,較不容易拒絕平均數相等的虛無假設。
- 變異數大的組別樣本數較大:傳統檢定較可能過度寬鬆,第一類錯誤率可能膨脹,增加誤判平均數有差異的風險。
各組樣本數相等時,傳統 ANOVA 對變異數不等通常較具穩健性,但並不表示假設不再重要,也不能保證推論一定正確。NIST 對單因子 ANOVA 的說明;ANOVA 穩健性研究回顧
檢驗方法與判斷標準
常用方法是 Levene 檢定。它先計算每筆觀察值與該組中心值的距離,再檢驗各組平均距離是否相同。以組平均數為中心時,定義:
其中 是第 組第 位受試者的觀察值, 是第 組樣本平均數。接著對 進行單因子 ANOVA,檢驗:
第 2 題5 分
如進行變異數分析(ANOVA)時的「變異數同質性」前提假設違反時,請舉出「兩種」處理此一狀況的方法和步驟,並說明各方法所根據之原理邏輯。
登入後即可作答並保存紀錄。
核心觀念
傳統單因子變異數分析(ANOVA)假設各組母體變異數相等:
若變異數不齊,傳統 檢定的顯著水準可能失準;當各組樣本數也不相等時,影響尤其值得注意。可先用 Levene 檢定或 Brown–Forsythe 檢定檢查變異數同質性。處理此問題時,仍須另行考量觀察值獨立與常態性等假設。
方法一:改用 Welch 變異數分析
步驟
- 對第 組計算樣本數 、平均數 與樣本變異數 。
- 以各組樣本數及變異數設定權重,計算加權平均數:
- 計算 Welch 檢定統計量及自由度:
第 3 題5 分
請說明「相關(correlation)」和「迴歸(regression)」分析之間的相同處和相異處,並各舉一個適合的應用實例。
另「相關」和「迴歸」分析,何者能幫助研究者做「因果」推論?
登入後即可作答並保存紀錄。
核心觀念
本題考查兩種分析如何描述變項關係,以及「統計上的關聯」是否足以支持「因果」推論。
相關分析用一個相關係數描述兩個變項共同變動的方向與程度。以皮爾森積差相關為例:
介於 與 之間。正值表示兩變項傾向同向變動,負值表示傾向反向變動;絕對值愈大,線性關聯愈強。相關係數描述的是線性關聯,無法完整反映非線性關係。
迴歸分析用一個或多個預測變項來描述或預測結果變項。簡單線性迴歸可寫成:
其中 是迴歸斜率,表示 每增加一單位,預測的 平均改變多少單位; 是截距。
兩者的共同點是都能用來分析變項間的關聯,並常以成對觀察資料為基礎。若採用皮爾森相關與簡單線性迴歸,兩者有以下關係:
簡單線性迴歸的決定係數也滿足:
這表示在只有一個預測變項的線性迴歸中,相關係數與迴歸都反映線性關係;但它們呈現關係的方式和用途不同。
解題方法:比較分析目的與解讀方式
解題時可從「是否區分變項角色」、「結果的單位與範圍」及「分析用途」三個面向比較。
| 面向 | 相關分析 | 迴歸分析 |
|---|---|---|
| 變項角色 | 與 對稱,交換兩變項不改變相關係數 | 指定結果變項 與預測變項 ,角色不對稱 |
| 主要結果 | 相關係數 ,介於 與 | 迴歸係數、截距、預測值及 |
| 單位 | 無單位 | 斜率有單位,依 、 的測量尺度而定 |
第 4 題5 分
請說明「標準常態分配」和「Student’s 分配」之間的:
1)相同處。
2)相異處。
3)兩分配之間的關聯。
4)兩分配何時會「相等」。
5)兩分配的各自適用時機。
登入後即可作答並保存紀錄。
核心觀念
本題要比較兩種連續機率分配,重點是:標準常態分配是固定的分配;Student’s 分配則會隨自由度改變,且自由度增加時逐漸接近標準常態分配。
標準常態變數記為 ,其分配為 ,機率密度函數為:
自由度為 的 變數記為 ,其機率密度函數為:
其中 ,而 為伽瑪函數。
解題方法
比較兩種分配時,可依序檢視它們的形狀與基本性質、彼此的數學關係、相等條件,以及各自的統計推論用途。
1)相同處
- 兩者都是連續分配,取值範圍皆為整條實數線。
- 兩者皆以 為中心,左右對稱且單峰。
- 兩者曲線下的總面積皆為 。
- 兩者都能用來描述標準化後的統計量,並用於估計或假設檢定。
2)相異處
- 尾部厚薄不同:有限自由度的 分配比標準常態分配有較厚的尾部,因此較容易出現距離中心較遠的值。
- 形狀會否改變:標準常態分配固定為 ; 分配則隨自由度 改變。自由度越小,尾部越厚、中央峰越低、分配越分散。
- 變異數不同:標準常態分配的變異數為 。 分配在 時的變異數為 ,大於 ;當 時,變異數不存在。 分配在 時平均數為 ;當 時,平均數不存在。
第 5 題5 分
請問以皮爾森卡方檢定(Pearson test)進行兩變項間「獨立性」檢定時,所設定的虛無()和對立()假設各為何?
請問這個檢定的步驟及其所根據原理為何?
登入後即可作答並保存紀錄。
核心觀念
皮爾森卡方獨立性檢定用來判斷兩個類別變項是否彼此獨立。設第一個變項有 個類別,第二個變項有 個類別,觀察資料整理成 列聯表。
虛無假設與對立假設為:
- :兩變項彼此獨立。若以第 列與第 欄表示兩變項的類別,則
- :兩變項不獨立,也就是兩變項之間有關聯;至少有一組類別的聯合機率不符合獨立關係。
在 成立時,每個儲格的期望次數為:
其中 為總觀察次數。皮爾森卡方統計量為:
其中 是第 列、第 欄的觀察次數。
解題方法與檢定原理
檢定的核心是比較觀察次數 與在兩變項獨立假設下所預期的次數 。若兩者差異普遍很小,卡方統計量通常較小,資料與獨立假設相容;若差異較大,卡方統計量便較大,反對 的證據也較強。
在樣本數及期望次數符合近似條件時, 成立下的 統計量近似服從卡方分配,其自由度為:
檢定步驟
第 6 題5 分
請問如何決定一個研究需要多大的樣本數?影響一個研究所需「樣本數」大小的相關因素有哪些?
這些因素又如何影響一個研究所需的樣本數?
登入後即可作答並保存紀錄。
核心觀念
樣本數不是固定的通則,而是由研究目的、研究設計與可接受的錯誤風險共同決定。研究者必須先明確界定主要研究問題,再選用相應的樣本數規劃方法。
常見目標有兩類:
- 檢定假設:希望在母體中確有差異或關聯時,研究能以足夠機率偵測到它。此時通常採用事前檢定力分析。
- 估計參數:希望估計平均數、比例或其他參數,並讓信賴區間達到指定的精確度。此時依信賴水準、母體變異程度與容許誤差決定樣本數。
檢定力(power)是母體中確有研究效果時,正確拒絕虛無假設的機率:
其中 是第二類錯誤機率; 則是第一類錯誤機率,即虛無假設為真時錯誤拒絕它的機率。
解題方法
一、先確認主要分析與研究設計
樣本數公式取決於研究要回答的問題及資料結構。兩組平均數比較、配對測量、相關分析、迴歸分析與群集抽樣,使用的計算方式都不同。因此,應先決定主要結果變項、主要比較或關聯,以及預定使用的統計分析。
二、以檢定力分析規劃檢定研究
事前檢定力分析至少要指定:
- 顯著水準 ;
- 目標檢定力 ;
- 預期效果量;
- 研究設計與統計檢定方式;
- 單尾或雙尾檢定;
- 各組樣本數比例。
以兩組獨立樣本、等組樣本數、比較平均數且變異數相同為例,每組所需樣本數可用下式近似:
其中 是母體標準差, 是預期的組間平均數差異, 為標準常態分配的分位數。公式顯示,標準差越大,所需樣本數越多;欲偵測的差異越小,所需樣本數越多。
以標準化效果量 表示時,樣本數主要隨 增加。若希望偵測的效果量縮小為原來的一半,在其他條件相同時,所需樣本數約增加為四倍。
三、以精確度規劃估計研究
若研究重點是估計平均數,並要求信賴區間半寬不超過 ,所需樣本數可近似為:
其中 是可接受的估計誤差。要求誤差越小,樣本數越大;要求更高的信賴水準,所需樣本數也越大。
若估計母體比例,且尚無先前比例估計值,可採保守的 :
因為 在 時最大,用此值規劃可避免低估所需樣本數。
四、調整無法完成研究或抽樣設計造成的需求
若預估有比例 的受試者會退出、未回覆或資料無法使用,需增加招募人數:
第 7 題5 分
請舉出心理學研究中資料有「遺漏值(missing data)」的兩個可能原因?
並請舉出三個處理遺漏值的方法和其根據原理。
登入後即可作答並保存紀錄。
核心觀念
遺漏值是指研究中某位受試者的某個變項沒有取得有效觀測值。題目考查兩部分:遺漏值的成因,以及如何依照遺漏機制與統計原理處理遺漏資料。
遺漏機制可分為三類:
- 完全隨機遺漏(MCAR):資料是否遺漏與任何已觀察或未觀察變項都無關。
- 隨機遺漏(MAR):資料是否遺漏與未觀察到的數值無關,但可由其他已觀察變項解釋。
- 非隨機遺漏(MNAR):資料是否遺漏與該筆未觀察到的數值本身有關。
遺漏機制會影響處理方法的適切性;若遺漏機制判斷錯誤,估計結果可能產生偏誤。
解題方法
先舉出兩種研究中常見的遺漏成因,再說明三種處理方法及其依據。回答方法時,需一併指出適用條件與主要限制,才能說明其統計原理。
遺漏值的兩個可能原因
- 受試者未作答或中途退出:受試者漏答敏感題目、忘記填答,或因疲勞、時間不足而中途退出,造成問卷或測驗資料缺漏。
- 研究程序或資料管理失誤:儀器故障、網路中斷、研究者漏記、資料輸入錯誤等,造成觀測值未被記錄或無法使用。
這些原因對應不同的遺漏機制;例如,若敏感題目的漏答與受試者未觀察到的真實回答有關,便可能屬於 MNAR。
三種處理遺漏值的方法及原理
一、整筆刪除法(listwise deletion)
只要個案在分析所需變項中有任何一項遺漏,就將該個案排除,再以完整個案進行分析。其原理是只分析資料完整者,避免替缺失值填入推估數值。
當遺漏接近 MCAR 時,完整個案仍可視為隨機抽出的樣本,分析估計較不容易產生系統性偏誤。不過,刪除會減少樣本數、降低統計檢定力;若遺漏與研究變項有關,分析結果可能產生偏誤。
二、平均數代入法(mean imputation)
以該變項已觀察資料的平均數取代遺漏值。若變項 有 個有效觀測值,其平均數為:
第 8 題5 分
請問「校標參照測驗(Criterion-Referenced Test)」和「常模參照測驗(Norm-Referenced Test)」的意義內涵各為何?
並列出這兩類測驗的各自最適用時機。
登入後即可作答並保存紀錄。
核心觀念
本題考查的是測驗分數如何解釋。兩類測驗的差異不在題目形式,而在於考生的分數要和什麼比較:
- 校標參照測驗(Criterion-Referenced Test):將個人表現與事先訂定的標準或能力目標比較,判斷是否達到特定要求。
- 常模參照測驗(Norm-Referenced Test):將個人表現與一群具代表性的受試者之表現比較,判斷個人在群體中的相對位置。
簡言之,校標參照回答「達到標準了嗎?」;常模參照回答「和其他人相比表現如何?」
解題方法
作答時先辨認分數的比較基準,再依測驗用途說明適用時機。
校標參照測驗:與固定標準比較
測驗前先設定通過標準、精熟標準或能力要求。令考生分數為 ,標準分數為 ,可用下式表示基本判斷:
例如,某項安全訓練測驗以 80 分為合格標準;考生是否合格取決於是否達到 80 分,而非其他考生的分數高低。即使全班成績普遍提高,合格標準仍可維持不變。
校標可以是課程目標、工作能力要求、執照資格或最低合格標準。這類測驗重視考生是否掌握特定知識或技能,通常不以區分群體中的高低排名為首要目的。
常模參照測驗:與群體表現比較
先以具有代表性的常模團體建立分數分布,再依受試者的原始分數判斷其相對位置。常見的標準分數表示方式為:
其中 是個人原始分數, 和 分別是常模團體的平均數與標準差。 分數表示個人成績距離常模平均數多少個標準差;也可用百分等級、百分位數等方式呈現相對位置。
第 9 題5 分
如欲檢驗一個為單向度的性格測驗之「內部一致性(Internal Consistency)」,請舉出三個可能的做法和每一作法所根據的原理和邏輯。
登入後即可作答並保存紀錄。
核心觀念
內部一致性是指:在同一次施測中,測驗題目是否彼此一致地測量同一個特質。若性格測驗具有單向度,受試者在各題上的作答應主要反映同一個潛在特質,因此題目分數之間通常會呈現正向關聯。
內部一致性屬於信度的一種,但高內部一致性不等於已證明測驗單向度;題目內容重複也可能使一致性偏高。以下三種方法都需要以題目分數資料估計一致程度。
解題方法
一、折半信度
將測驗題目分成兩半,例如奇數題與偶數題,計算每位受試者在兩半測驗上的分數,再求兩半分數的相關 。由於相關係數只反映半份測驗的信度,需用斯皮爾曼-布朗公式推估完整測驗的信度:
**原理與邏輯:**若測驗測量同一特質,兩半題目分數應有正相關;相關越高,代表兩半測量結果越一致。折半方式會影響結果,因此常以奇偶題分半,避免前半與後半因題目難度或題序差異而形成系統性偏差。
二、克朗巴赫 係數
對多點計分題目,例如李克特量表,可用克朗巴赫 衡量各題分數的共變程度。若測驗有 題,第 題變異數為 ,總分變異數為 ,則:
第 10 題5 分
請問項目分析中進行「題目鑑別度(Item Discrimination)」檢驗的目的為何?
如一測驗題目採用李克特式(Likert type)量尺,對此測驗每個題目的進行鑑別度檢驗的步驟和判斷標準為何?
登入後即可作答並保存紀錄。
核心觀念
題目鑑別度是指一個題目能否區分「在欲測特質上整體得分較高」與「整體得分較低」的受試者。鑑別度高的題目,應讓高分組在該題的得分也較高;若低分組反而得分較高,須檢查反向計分是否遺漏、題意是否含糊,或題目是否測到不同構念。
李克特式題目沒有標準答案,不能直接使用二分題的答對率解讀。常見做法是比較高、低分組在該題的平均得分,並檢查該題與其他題目合計分數的相關。對量表而言,校正後題目-總分相關會先從總分中排除該題,可避免題目與包含自身的總分相關而偏高。校正後題目-總分相關的說明、傳統題目分析方法
解題方法:高、低分組比較
- 先確認計分方向。 將反向題反向計分,確保較高分一律代表較高程度的欲測特質。
- 計算受試者的量表總分。 檢驗第 題時,宜計算排除第 題的其餘題目合計分數,作為分組依據,避免該題同時影響分組與組間比較。
- 依其餘題目合計分數排序。 取最高約 為高分組、最低約 為低分組。 是常用的極端組比例;樣本條件不合適時,也可依研究設計採用其他比例,並在報告中說明。
- 比較兩組在該題的平均得分。 設高分組平均數為 、低分組平均數為 ,以獨立樣本 檢定比較兩組:
其中 分別為高、低分組人數, 為合併變異數。若兩組變異數不宜視為相等,使用 Welch 檢定。
也可將平均差表示為鑑別指標:
對李克特式題目, 為量尺原始分數上的平均差;量尺分數範圍為 至 時,差值範圍為 至 。
第 11 題5 分
請問設計一個「速度測驗(Speed Test)」和一般「成就測驗(Achievement Test)」的主要差異和注意事項為何?
該如何對一個「速度測驗」進行信度分析,並有何特別考量和注意事宜?
登入後即可作答並保存紀錄。
核心觀念
本題比較的是速度測驗與一般成就測驗的測量重點,並要求說明速度測驗為何不宜直接套用一般的內部一致性信度方法。
古典測驗理論將觀察分數表示為:
其中 為觀察分數、 為真分數、 為測量誤差。信度係數表示觀察分數中真分數變異所占的比例:
速度測驗的分數受作答速度、作答正確性與時間限制共同影響。因此,分析信度時要問:不同測驗形式或不同施測時,受試者的總表現是否穩定,而不能只看同一次施測中各題彼此是否相關。
速度測驗與一般成就測驗的差異
| 比較面向 | 速度測驗 | 一般成就測驗 |
|---|---|---|
| 主要測量目標 | 在固定短時間內完成工作的速度或流暢度,並兼顧正確性 | 對特定知識、技能或學習內容的掌握程度 |
| 時間限制 | 時間刻意設得較短,多數受試者無法作答全部題目 | 通常給足時間,使多數受試者能嘗試全部或大部分題目 |
| 題目安排 | 常使用大量、內容相近且難度相對容易的題目;題目順序與時間限制會影響分數 | 題目可涵蓋不同難度與內容範圍,以區分學習成就程度 |
| 分數意義 | 常反映限時內答對的題數或完成量;須留意速度與正確率 | 主要反映答對的內容與程度 |
| 設計重點 | 控制題目可讀性、版面、作答方式與施測時間,避免把理解困難或操作不熟誤當成速度差異 | 確保內容代表性、題目難度適切,並符合測驗欲評量的課程或能力範圍 |
實務上,成就測驗也可能設有時間限制;關鍵不是有沒有計時,而是時間是否足以讓多數受試者完成作答。若大量受試者因時間到而未能作答後段題目,測驗分數就可能混入速度成分。
設計速度測驗時,應使題目數量足以讓作答速度有差異可呈現,又避免題目難到讓受試者因不會答而停滯。施測時間、作答規則與計分方式也要一致,並清楚界定錯答、漏答及未到達題目的處理方式。速度測驗的信度會受到時間限制與題目次序影響;相關研究指出,以單一施測的切半或 α 係數估計純速度測驗信度,可能產生偏誤。Oxford Academic:Reliability in Educational Measurement
速度測驗的信度分析方法
優先採用:複本信度
編製兩份內容、題數、難度、題序與施測條件相當的複本,讓同一群受試者分別作答,再計算兩份總分的相關:
第 12 題5 分
請列出五個編寫「中文測驗題目」時,在文字、詞彙、用語或語句描述上應注意的地方。
登入後即可作答並保存紀錄。
核心觀念
本題考查的是測驗題項的文字與語句編寫原則。題目文字應讓受試者清楚理解作答要求,並盡量避免因生僻詞、複雜句型或文化背景差異而影響作答。否則,測驗分數可能混入與目標能力無關的語文理解差異,降低測驗結果的解釋效度。一般命題原則也要求題意明確、文字淺顯簡明,並保留解題所需的條件。教育百科:測驗題目
解題方法
題目要求列出五項,因此可從受試者讀題時最容易受影響的環節整理:看不看得懂詞語、能否確定題意、句子是否易讀、否定語句是否造成混淆,以及文字是否引入與測驗目標無關的負擔。
五項編寫注意事項
-
使用符合受試者程度的常用詞彙
避免生僻字、古語、艱深術語、俚語或特定地區用語。若專業術語是測驗內容的一部分,才使用並維持前後一致;否則,陌生詞彙可能使受試者因閱讀困難而失分。 -
題意明確,避免含糊或多重解讀
清楚交代題目所指的人、事、時間與條件;避免指涉不明的代名詞、模糊的程度詞,或範圍不清的描述。
第 1 題2 分
In signal-detection theory, the position of the criterion is determined by
(A) the decision process.
(B) the sensory process.
(C) the stimulus intensity.
(D) the mean of the signal distribution.
登入後即可作答並保存紀錄。
核心觀念
訊號偵測理論把「感覺能力」與「決策標準」分開:
- 感覺歷程決定訊號與雜訊分布的區隔程度,常以敏感度 表示。兩分布越分開,越容易辨認訊號。
- 決策歷程決定觀察到的感覺證據要高於何種門檻,才判定「有訊號」。這個門檻就是判準(criterion)。
判準的位置會受到決策時採用的政策影響,例如漏報與誤報的代價、不同反應的報酬,以及訊號出現的基準率。
解題方法
題目問的是判準位置由哪個歷程決定。先辨認它問的是「感覺證據有多可靠」,還是「根據證據採取什麼判斷標準」。
判準是觀察者用來作出反應的決策門檻,因此由決策歷程決定。感覺歷程會影響訊號與雜訊分布的重疊程度,也就是辨別能力;兩者不可混為一談。
選項分析
第 2 題2 分
A control variable is
(A) under the control of the subject.
(B) a potential independent variable that is held constant in an experiment.
(C) a potential independent variable that is manipulated by the experimenter.
(D) expected to change as the result of an experimental manipulation.
登入後即可作答並保存紀錄。
核心觀念
控制變項(control variable)是研究者為了排除其他因素的影響,在實驗中加以固定的變項。若某因素原本可以成為自變項,但研究者不打算研究它對結果的影響,便可將它保持不變,以降低混淆。
實驗中的自變項由研究者操弄;依變項則是研究者觀察或測量的結果。控制變項的功能,是讓依變項的變化較能歸因於研究者操弄的自變項。
解題方法
辨認題目所問的「control variable」,抓住兩個關鍵:它是實驗中需要排除影響的因素,並且由研究者固定不變。符合這項定義的選項,就是 (B)。
選項分析
-
(A) under the control of the subject.
錯誤。此選項指由受試者控制的因素;控制變項的重點是研究者在實驗中將某因素保持固定。 -
(B) a potential independent variable that is held constant in an experiment.
第 3 題2 分
Parallel distributed processing (PDP) refers to
(A) an early method for measuring reaction time.
(B) the use of fMRI to study brain activity.
(C) a modern model of cognition.
(D) a method of statistical analysis.
登入後即可作答並保存紀錄。
核心觀念
平行分散處理(Parallel Distributed Processing, PDP)是認知心理學中的一種認知歷程模型,常與連結論(connectionism)相連。它將認知活動描述為:許多簡單的處理單元彼此連結,訊息在多個單元間平行傳遞,並以分散於網絡中的活動模式表徵資訊。
因此,PDP 是解釋認知如何運作的模型,不是特定的腦造影技術,也不是統計分析方法。
解題方法
先辨認題目中的關鍵詞 Parallel Distributed Processing。它在認知心理學中指以平行運作的連結網絡說明認知歷程,故應選擇「認知模型」相關選項。
選項分析
第 4 題2 分
When the time between two signals to respond is very short, the response to the second stimulus
(A) speeds up.
(B) is more accurate.
(C) slows down.
(D) remains the same compared to longer intervals.
登入後即可作答並保存紀錄。
核心觀念
本題考「心理不應期」(psychological refractory period, PRP)。當兩個需要作出反應的刺激先後出現,且兩者間隔很短時,第一個刺激的反應處理會占用有限的中央處理資源,使第二個刺激的反應處理必須等待。因此,第二個刺激的反應時間通常會變長,也就是反應變慢。
兩個刺激的起始時間間隔稱為刺激起始間隔(stimulus onset asynchrony, SOA)。在其他條件相同時,SOA 越短,第二個反應受到的延遲通常越大。
解題方法
抓住題幹的兩個線索:「兩個訊號都要求反應」以及「兩個訊號間隔很短」。這正是心理不應期的典型情境。短間隔下,第二個刺激的反應處理受到第一個刺激影響,故第二個反應會延遲;題目問的是第二個刺激的反應變化,因此應選「變慢」。
選項分析
第 5 題2 分
An experimenter presents a subject with a standard weight of 100 grams followed by a comparison weight of 20 grams; the subject is asked if the two weights are the same or different.
The standard is repeated followed by a comparison weight of 30 grams; the subject is again asked if the two are the same or different. This procedure continues with a comparison weight 10 grams heavier on each presentation until the subject says that both weights are the same.
These steps are repeated starting with a comparison weight of 190 grams and decreasing it by 10 grams on each trial until the subject says the two weights are the same.
What is the experimenter trying to measure?
(A) absolute threshold
(B) perceptual defense
(C) method of limits
(D) difference threshold
登入後即可作答並保存紀錄。
已確認原卷圖片內容,第 5 題與題目文字一致。以下為詳解:
核心觀念
本題考的是**心理物理學(psychophysics)**中兩個必須區分的概念:
| 概念 | 定義 |
|---|---|
| Absolute threshold(絕對閾限) | 能被偵測到的最小刺激量(50% 偵測率對應的刺激強度) |
| Difference threshold(差異閾限) | 又稱 just noticeable difference (JND),指能被察覺為「不同」的最小刺激差異量 |
| Method of limits(極限法) | 一種測量閾限的「程序/方法」,以遞增或遞減序列逼近轉換點 |
| Perceptual defense(知覺防衛) | 對威脅性或情緒性刺激的閾限提高現象,屬於社會知覺議題 |
關鍵區分:題目問的是 "trying to measure"(試圖測量什麼),也就是「測量目標」,而非「使用什麼方法」。
解題方法
從圖中原題可讀到以下關鍵資訊:
- 實驗者先呈現一個 standard weight = 100 grams(標準刺激),再呈現一個 comparison weight(比較刺激),要求受試者判斷兩者「相同或不同(same or different)」。
- 遞增序列:比較重量從 20 g → 30 g → 40 g → …,每次加 10 g,直到受試者說「相同」。
- 遞減序列:比較重量從 190 g → 180 g → 170 g → …,每次減 10 g,直到受試者說「相同」。
整個實驗的結構是:
- 存在一個固定的標準刺激(100 g)。
- 比較刺激從遠離標準值之處逐步接近標準值。
- 受試者的任務是比較兩個刺激,判斷是否相同。
- 當受試者說「相同」時,該點即為轉換點(transition point)。
遞增序列的轉換點為下差異閾(lower difference threshold),遞減序列的轉換點為上差異閾(upper difference threshold)。
第 6 題2 分
In a multiple-baseline design
(A) the length of the baseline period is the same for all of the subjects in the experiment.
(B) the behavior of the subjects is expected to revert to baseline levels after the removal of the independent variable.
(C) the length of the baseline period is different for different subjects or different behaviors prior to the introduction of the independent variable.
(D) the occurrence of carryover effects cannot be assessed.
登入後即可作答並保存紀錄。
核心觀念
多重基線設計(multiple-baseline design)是單一受試者實驗設計中的非撤回設計。研究者先觀察數個受試者、行為或情境的基線,再將介入措施依序、錯開時間引入各條基線。各條基線的長度因此不同。
若行為改變是在介入引入後才出現,且此模式在不同基線上重複出現,便能支持介入與行為改變有關。此設計不必撤除介入,適合不宜中止有效治療,或預期行為不會在撤除介入後回復的情況。
解題方法
抓住「多重基線」的關鍵:多條基線的介入起始時間錯開。比較各選項是否符合這項設計特徵:
- 基線期是否都等長?
- 是否必須撤除介入並觀察行為回復?
- 基線期是否會因介入時間錯開而有長有短?
- 是否能觀察介入效果是否擴散到尚未介入的基線?
符合「基線長度不同、介入依序引入」者,即為正確敘述。
選項分析
第 7 題2 分
The view that the perceiver picks up the information afforded by the environment naturally and essentially, without reflecting upon them, is referred to as
(A) top-down perception.
(B) the indirect approach to perception.
(C) sensational perception.
(D) the bottom-up approach to perception.
登入後即可作答並保存紀錄。
核心觀念
本題考查知覺的由下而上處理(bottom-up processing)與由上而下處理(top-down processing)的差異。
由下而上的知覺以環境中的感官資訊為起點,從刺激的物理特徵逐步形成知覺,不必先依賴既有知識或主動推論。題幹所說的「知覺者自然地拾取環境提供的資訊,且不需反思」,符合直接從環境資訊形成知覺的觀點。
解題方法
先抓題幹中的關鍵描述:「拾取環境提供的資訊」與「不需反思」。這表示知覺主要由外在刺激資訊引導,而不是先運用期待、經驗或背景知識來解讀刺激,因此判定為由下而上的知覺。
選項分析
- (A) top-down perception(由上而下知覺):錯誤。由上而下處理會受到既有知識、期待、經驗或情境影響,再據此解讀感官資訊,與題幹強調直接拾取環境資訊不同。
第 8 題2 分
The method of limits can be used to determine
(A) an absolute threshold.
(B) a difference decision.
(C) a response threshold.
(D) a decision threshold.
登入後即可作答並保存紀錄。
核心觀念
此題考古典心理物理學的極限法(method of limits),以及它所測量的感覺閾限。
絕對閾限是個體剛好能察覺某刺激的最低刺激強度。極限法會讓刺激強度以固定步幅逐漸增加或逐漸減少,記錄受試者從「未察覺」轉為「察覺」,或從「察覺」轉為「未察覺」時的刺激強度。將多次測量的轉折點平均,可估計絕對閾限。
解題方法
判斷重點是:極限法直接操弄刺激強度,並找出受試者開始察覺刺激的轉折點,因此測量的是絕對閾限。題目問的是此方法「可用來決定」哪一種閾限,故選絕對閾限。
選項分析
- (A) an absolute threshold:正確。 極限法可透過逐步增加或減少刺激強度,估計刺激可被察覺的閾限。
第 9 題2 分
On an implicit word fragment completion test, 47 percent of the fragments in the studied condition were completed and 23 percent of fragments in the non-studied condition were completed. The amount of priming is ____ percent.
(A) 70
(B) 24
(C) 23
(D) 47
登入後即可作答並保存紀錄。
核心觀念
這題考的是**啟動效果(priming)**的計算。字詞片段補全作業中,若受試者先前學過某些字詞,之後補出這些字詞的比例通常會高於未學過的字詞。兩種條件的補全率之差,就是此題所問的啟動量:
解題方法
學習條件的補全率為 ,未學習條件的補全率為 。以未學習條件作為基準,扣除原本就會出現的補全比例:
第 10 題2 分
Theory in psychology serves to both organize data and to
(A) Generate prediction for untested situations.
(B) allow psychology to be termed a natural science.
(C) validate psychological findings.
(D) ensure the reliability of data.
登入後即可作答並保存紀錄。
核心觀念
心理學理論的主要功能,是將分散的研究資料與現象加以組織,並根據這些資料提出概括性的解釋。理論還能推導出可檢驗的預測,讓研究者對尚未觀察或測試的情境形成預期。
理論產生的預測可進一步轉化為研究假設,再透過實驗或其他研究方法檢驗。若預測獲得支持,理論的解釋力便得到證據支持;若預測不符,則需重新評估理論或其適用條件。
解題方法
題幹指出理論能「組織資料」,接著詢問理論的另一項功能。可從科學理論的基本功能判斷:除了整理並解釋已知現象,理論也要能推導出可檢驗的預測,延伸至尚未測試的情境。
因此,符合題意的是「對未經測試的情境產生預測」。
選項分析
- (A) Generate prediction for untested situations.
正確。 理論可依據既有資料與解釋架構,推導尚未測試情境中的預期結果,並據此形成可檢驗的研究假設。
第 11 題2 分
An experimenter computing the correlation between age and memory span would
(A) be able to show that old age produces a decrease in memory span.
(B) be able to determine that a third variable was involved.
(C) make an error because age and memory span are measured on different scales.
(D) be able to determine whether there is a relationship between age and memory span.
登入後即可作答並保存紀錄。
核心觀念
本題考「相關研究能回答什麼問題」,以及相關不代表因果。相關係數用來描述兩個變項之間關係的方向與強度;若使用皮爾森積差相關,其公式為:
其中 、 是兩個變項,、 是各自的標準差。相關係數介於 與 之間:正值表示正向線性關係,負值表示負向線性關係,絕對值越大表示線性關係越強。
相關可以判斷兩變項是否有關聯,但單靠相關不能證明一個變項造成另一個變項改變,也不能確認是否有第三變項影響兩者。
解題方法
題目問研究者計算「年齡」與「記憶廣度」的相關,可以做出什麼結論。先判斷相關分析的功能:它能檢視年齡與記憶廣度是否有關係,並描述關係的方向與強度;至於年齡是否造成記憶廣度下降,則涉及因果推論,不能只由相關結果得知。
兩個變項使用不同單位或尺度,也不妨礙計算相關。皮爾森相關以兩變項各自的標準差標準化共變數,因此不受測量單位不同的影響。
選項分析
- (A) be able to show that old age produces a decrease in memory span.
錯。即使年齡與記憶廣度呈負相關,也只能說年齡較高者傾向有較低的記憶廣度,不能據此證明年齡造成記憶廣度下降。兩者的關聯也可能受到其他因素影響,且相關研究本身不能排除其他因果解釋。
第 12 題2 分
When is it acceptable for a researcher to dispense with obtaining the informed consent of research participants?
(A) Whenever there is no deception involved in the research
(B) Whenever the risk of harm to the participants is minimal, they participate voluntarily, and their confidentiality is ensured
(C) Whenever the participants are being paid for their participation
(D) Whenever the research has been approved by an IRB
登入後即可作答並保存紀錄。
核心觀念
本題考研究倫理中的「知情同意」及其免除條件。知情同意是研究者先向參與者說明研究相關資訊,再由參與者自願決定是否參加。免除知情同意不能只看研究者是否取得某種形式的核准,還要考量研究風險、參與者權益與資料保密。
解題方法
原卷第 3 頁的第 12 題選項 B 延續至第 4 頁,完整條件是:參與者面臨的傷害風險極低、自願參與,且其機密性受到保障。依本題選項設定,這些條件最符合可免除取得知情同意的情況,因此選 B。
實務上,研究者仍須依適用的研究倫理規範辦理;是否能免除同意,應由研究倫理審查機構依研究情況判定,不能只因研究者認為風險低就自行免除。
選項分析
第 13 題2 分
The primary danger in within-subjects designs is in the presence of
(A) the effects that testing subjects in one condition might have on their later behavior.
(B) the failure to establish a baseline of behavior.
(C) the minimization of the amount of variability caused by differences among subjects.
(D) The employment of few subjects, which leads to skewed results.
登入後即可作答並保存紀錄。
核心觀念
本題考查受試者內設計(within-subjects design)的主要威脅。此設計讓同一批受試者依序接受不同實驗條件,再比較其在各條件下的表現。由於每位受試者都作為自己的對照,個體差異造成的變異通常會降低,統計檢定力也可能提高。
主要風險是順序效應:先前條件的經驗可能影響受試者在後續條件中的表現。若影響來自某一條件殘留至下一條件,稱為殘留效應(carryover effect);練習、疲勞、適應與測驗經驗也都可能造成影響。
解題方法
判斷受試者內設計的主要危險時,先確認不同條件是否由同一位受試者依序經歷。若是,須留意先前條件是否改變後續行為,造成觀察到的差異混合了實驗操弄與條件順序的影響。
常見控制方式包括平衡不同條件的呈現順序,以及在條件之間安排休息或洗除期,以減少順序與殘留效應。
選項分析
第 14 題2 分
The typical Stroop task
(A) involves naming the color of ink that a word is printed in.
(B) involves naming the color of an object as it would normally occur (e.g., saying "yellow" to "lemon").
(C) requires participants to read words aloud as they are presented.
(D) requires participants to read profane words aloud.
登入後即可作答並保存紀錄。
核心觀念
典型的史楚普作業(Stroop task)測量的是自動化閱讀反應對顏色命名造成的干擾。參與者看到以不同顏色印出的文字時,必須說出字的墨水顏色,而不是讀出文字。
例如,看到「藍」字以紅色印出時,正確反應是「紅色」。由於閱讀文字通常是高度自動化的歷程,文字意義可能干擾參與者說出墨水顏色的反應;不一致條件下常見反應時間較長、錯誤率較高。
解題方法
辨認題目描述的作業要求即可:典型史楚普作業的關鍵是命名文字的墨水顏色。再逐一檢視選項,區分它與一般物體顏色命名、朗讀文字,以及情緒性史楚普作業。
選項分析
第 15 題2 分
In explaining how people process overlapping tasks, central bottleneck models
(A) postulate sequential processing of one task at a time.
(B) postulate a common resource needed for mental operations.
(C) assume that a mental module can be added or deleted without altering the processing duration of the other modules.
(D) assume that there are no limits to processing capacity.
登入後即可作答並保存紀錄。
核心觀念
本題考查中央瓶頸模型如何解釋兩項重疊作業的處理。此模型主張,兩項作業可以在部分階段同時進行,但某些中央處理階段具有單通道限制:同一時間只能處理一項作業。
典型的資訊處理歷程可分為知覺、反應選擇與反應執行。中央瓶頸通常指向反應選擇階段:當兩項作業的反應選擇階段重疊時,其中一項必須等待另一項完成,因而形成序列處理。
解題方法
判斷關鍵是分辨兩種說法:
- 中央瓶頸模型:特定中央處理階段不能同時處理兩項作業,需依序進行。
- 共同資源模型:多項作業競爭共享的心理資源,資源分配影響各作業的處理效率。
題幹問的是中央瓶頸模型的主張,因此應選描述「一次處理一項作業」的選項。要注意,這是指瓶頸所在的中央階段;知覺或反應執行等其他階段仍可與另一項作業的階段重疊。
選項分析
第 16 題2 分
In the ABA design, the B is the
(A) discriminative stimulus.
(B) matched group.
(C) baseline.
(D) condition after therapy.
登入後即可作答並保存紀錄。
核心觀念
本題考的是單一受試者實驗設計中的 ABA 設計。字母代表不同的實驗條件,依序為:
| 階段 | 名稱 | 意義 |
|---|---|---|
| 第一個 A | 基線期(baseline) | 尚未施加介入,持續測量目標行為,建立比較基準。 |
| B | 治療期/介入期(treatment/intervention phase) | 施加治療或介入,並持續測量目標行為。 |
| 第二個 A | 撤除介入期 | 撤除介入,恢復原先的基線條件,觀察目標行為的變化。 |
因此,B 的定義是「正在施加治療或介入的階段」,不是治療結束後的狀況。
ABA 設計透過「引入介入」與「撤除介入」前後的行為變化,評估介入與目標行為之間的功能關係。須注意,第二個 A 表示恢復基線條件,不表示行為數值必然回到最初的基線水準。
解題方法
本題是定義辨識題,直接將題幹中的 B 對應到 ABA 的階段順序:
介入前的基線條件 → 施加介入 → 撤除介入、恢復基線條件。
中間的 B 對應「施加介入」。因此,正確選項須表達「治療期」、「介入期」或「治療進行中的條件」。題列四個選項均未符合這項定義。
選項分析