2010年12月31日 星期五

統計諮詢:如何算出1個變項中有3組資料的p值。單尾假設檢定,H0和H1的相對關係

諮詢主題
1. 如何得知1個變項中有3組資料p
2. 單尾假設檢定,H0H1的相對關係
3. 實際題目的驗算和討論
諮詢時間
99/11/29 6:41pm~7:05pm (skype)
       9:37pm~10:00pm (skype)
99/11/30 8:45am~10:51am (e-mail信件討論實際題目的驗算和討論)
諮詢時數
2小時
諮詢內容彙整
對此主題的未知概念
諮詢後釐清的概念
1.      知道應該使用fisher’s exact test的計算方法,但只會使用fisner's exact計算2x2的table,但不知要如何計算3x 2的table?
2.      於單尾假設檢定,不清楚對α應設定在左邊和右邊(單尾假設檢定),有困難算出H0臨界值(是要加還是剪σ/n) H0H1的相對關係。
3.      兩人分別針對同一個題目,練習計算單尾假設檢定,算出power值,和已知power值後,如何算出樣本數。
2. 先畫出H0H1的分佈圖,了解位置方向。舉例,H0:μμ0H1:μ>μ0H1分佈圖H0分佈圖的右邊。
3.對照比較算出的答案

報告的同學,課前,請至電腦教室練習

孰能生巧!

甚至須留意SPSS版本不同的差異,分析過程與結果,皆可能不同。

2010年12月30日 星期四

EFA作業要求

EFA作業要求
1. 提供分析問卷的理論及其如何設計,
2. 之前研究所提及的construct/factor數,及所使用的分析方法。
3. 你作EFA的理由及目的。
4. 提供樣本描述、變項的Descriptive data(包括平均數、變異數、相關等等資料)等基本資料。
5. 明確寫出作EFA的各個步驟,及每個步驟中所選擇的方法,及選擇的理由。
6. 解釋EFA的結果,包括因素命名、因素相對應的題目。
7. 量表的最後結果及架構。

P.S.在EFA結果報告的部分,請參考12/18講義中討論EFA報告的部分。

請於1/31 23:59前 以E-mail寄到我的信箱,謝謝。

2010年12月29日 星期三

統計諮詢-如何以paired t-test去解釋internal responsiveness

諮詢主題

如何以paired t-test去解釋internal responsiveness

諮詢時間

99/11/23 1430-1530

諮詢時數

1小時

諮詢內容彙整

對此主題的未知概念

諮詢後釐清的概念

如何以paired t-test的假設來解釋internal responsiveness?

虛無假設:H0:兩個時間點的平均測量結果之間沒有變化

paired t-test的虛無假設是:同一樣本前測/後測沒有顯著差異,而我們會關心的兩個重點是: (1) 前後測是否真的有差異(2) 測量準不準 (再測信度)運用在internal responsiveness的重點,應該是前後測是否真的有差異,也就是同一群病人的前後平均分數是否有顯著差異,「這個評估工具是否能測出變化」

2010年12月28日 星期二

未來兩週的報告主題

為了方便大家準備報告,就把未來兩週的報告者和主題先記錄在這裡。


日期
報告者
報告主題
1/4
Jenny
Kappa, weighted kappa, & Cronbachs α
恩綺
ICC
1/11
莞薈
SEM, MDC, SRD, reliable changing index
姿誼
Paired t test, Wilcoxon signed rank test, SRM, & effect size

2010年12月27日 星期一

心理計量課程報告內容大綱

1. 相關概念回顧 (3-5分鐘)

2. 進行該分析所需符合的假設

3. SPSS操作流程及注意事項 (若包含以excel運算公式也須列出)

4. Syntax說明

5. 簡要結果撰寫及結果解釋

6. 相關論文(紫色參考書)補充說明

PS. 可向老師拿資料分析; 以講義或投影片呈現報告; 以廣播軟體示範SPSS操作;

文獻彙整-五點量尺與十點量尺的使用考量

出處 Garratt, A. M., Helgeland, J., & Gulbrandsen, P. (2011). Five-point scales outperform 10-point scales in a randomized comparison of item scaling for the Patient Experiences Questionnaire. Journal of Clinical Epidemiology, 64(2), 200-207.

背景:
同一量表使用五點量尺與十點量尺對施測結果的影響眾說紛紜。有學者認為十點量尺可更仔細區分個案的差異,有學者認為五點量尺的項目表現與心理計量特性較佳,也有學者認為兩者沒有差異。本研究以
Patient Experiences Questionnaire (PEQ)為例,進行五點量尺和十點量尺的測量結果比較。

方法:
藉由認知訪談
14位個案,將十點量尺的PEQ修改為五點量尺,並在挪威一所大學醫院當中隨機收案1000位接受治療的住院個案。將受測的個案隨機分派為兩組,分別填答五點量尺(每個選項都有文字說明)與十點量尺(在最低分與最高分有文字說明)的問卷。

重要發現:
五點量尺的測量結果分數的分布為單峰且較對稱、項目平均較低、較少天花板與地板效應;十點量尺的測量結果偏態較大、峰度較小、分布的曲線較不接近常態,且所有題目都有天花板效應。迴歸分析的結果也顯示不同量尺是造成天花板效應與地板效應的主要原因。此外,較多個案表示五點量尺比較好回答。

結論:

五點量尺具有較佳的項目表現且更能反映個案的感受,因此新版的PEQ將改以五點量尺計分。

個人的想法:
1.文獻中比較了十點量尺的分析結果較差的幾題,但兩種量尺測量結果較差的題目可能不同,建議可把兩種量尺測量結果較差的項目都拿出來比較。
2.十點量尺並沒有在每個分數都附上說明文字,可能影響個案填答。
3.使用五點量尺之後,PEQ問卷仍有半數的題目有天花板效應,因此建議修改問卷的內容,或加入一些較為困難的題目。

2010年12月23日 星期四

課外補充

Five-point scales outperform 10-point scales in a randomized comparison of item scaling for the Patient Experiences Questionnaire
Journal of Clinical Epidemiology Volume 64, Issue 2Pages 208-212  


徵求志願者: 簡要說明上述研究之重點。

2010年12月22日 星期三

2010年12月15日 星期三

Gender v.s. sex

"Sex" refers to the biological and physiological characteristics that define men and women.
"Gender" refers to the socially constructed roles, behaviours, activities, and attributes that a given society considers appropriate for men and women.
To put it another way:
"Male" and "female" are sex categories, while "masculine" and "feminine" are gender categories.
Aspects of sex will not vary substantially between different human societies, while aspects of gender may vary greatly.
Some examples of sex characteristics :
  • Women menstruate while men do not
  • Men have testicles while women do not
  • Women have developed breasts that are usually capable of lactating, while men have not
  • Men generally have more massive bones than women
Some examples of gender characteristics :
  • In the United States (and most other countries), women earn significantly less money than men for similar work
  • In Viet Nam, many more men than women smoke, as female smoking has not traditionally been considered appropriate
  • In Saudi Arabia men are allowed to drive cars while women are not
  • In most of the world, women do more housework than men
Reference:
http://www.who.int/gender/whatisgender/en/index.html

chart and graph

Chart:以圖示的方式呈現數據資料,例如:長條圖 (bar chart),折線圖 (line chart),餅狀圖 (pie chart)。資料參考http://en.wikipedia.org/wiki/Chart
Graph:以圖示的方式解釋抽象的概念。在數學領域中,使用點線的方式,顯示物體與物體之間的關聯。詳細的圖表示,可參考資料http://en.wikipedia.org/wiki/Graph_(mathematics)#Graph

2010年12月14日 星期二

12/18(六) EFA課程通知

以下為與李晏討論後的EFA上課時間

時間:9:00-12:00 概念講解

           13:30-15:00 電腦操作

地點:上午課程於422教室,下午課程於電腦教室進行。

2010年12月3日 星期五

統計諮詢紀錄表-效度之驗證方法

諮詢時間
2010/12/1 14:30-15:30
諮詢時數
1小時
諮詢主題
效度之驗證方法
諮詢內容彙整
對此主題的未知概念
諮詢後釐清的概念
1.如何由MTMM矩陣看出方法偏誤 (method bias)
當區辨效度所框出來的上三角形(不同方法測不同特質)/下三角形(同樣方法測不同特質)跟其他上三角形/下三角形內的得分趨勢(例、左上最高、左下次高、右下最低)與其他三角形不同,就可能有方法偏誤。原因可能是工具的特性所造成的。
2.若效標效度過高(>0.91),可能造成量表與效標的題目相似度過高或重複,不知效標效度是否有可接受的上限?或是應該如何避免題目過於類似的情形?
良好的效標關連效度需0.75。而且很少有量表的效標效度可以非常高。然而,當量表與效標有30%的題目過於相似,則難以判斷效標效度是否因為這些題目而大幅提昇。因此,可以在選擇效標之前,先比較兩個測驗工具是否有太多相似的題目,以避免類似情形。
3.如果量表可同時具備效標參照與常模參照的特質,適用性會更廣。請問:如果要發展具備兩種特質的量表,需符合哪些條件?
在應用的時候,如果嚴格遵守效標參照與常模參照的定義,沒有具備兩種特質的工具。而學科能力測驗原本的用意為效標參照(瞭解學生是否符合畢業標準),結果卻作為分發的依據(常模參照),並不是很恰當的作法。
心得或建議
提早把問題整理清楚,討論時確實比較有效率。

統計諮詢紀錄表-效度之驗證方法


諮詢時間
2010/12/1 14:30-15:30
諮詢時數
1小時
諮詢主題
效度之驗證方法
諮詢內容彙整
對此主題的未知概念
諮詢後釐清的概念
1.如何由MTMM矩陣看出方法偏誤 (method bias)
當區辨效度所框出來的上三角形(不同方法測不同特質)/下三角形(同樣方法測不同特質)跟其他上三角形/下三角形內的得分趨勢(例、左上最高、左下次高、右下最低)與其他三角形不同,就可能有方法偏誤。原因可能是工具的特性所造成的。
2.若效標效度過高(>0.91),可能造成量表與效標的題目相似度過高或重複,不知效標效度是否有可接受的上限?或是應該如何避免題目過於類似的情形?
良好的效標關連效度需0.75。而且很少有量表的效標效度可以非常高。然而,當量表與效標有30%的題目過於相似,則難以判斷效標效度是否因為這些題目而大幅提昇。因此A量表不是最好的選擇。或許可以在選擇效標之前,先比較兩個測驗工具是否有太多相似的題目,以避免類似情形。
3.如果量表可同時具備效標參照與常模參照的特質,適用性會更廣。請問:如果要發展具備兩種特質的量表,需符合哪些條件?
在應用的時候,如果嚴格遵守效標參照與常模參照的定義,沒有具備兩種特質的工具。而學科能力測驗原本的用意為效標參照(瞭解學生是否符合畢業標準),結果卻作為分發的依據(常模參照),並不是很恰當的作法。
心得或建議
提早把問題整理清楚,討論時確實比較有效率。