跳到主要內容區

101/10/15-101/11/19「教師次級資料庫應用工作坊」

 
101/10/15-101/11/19「教師次級資料庫應用工作坊
                                                                    
                                                                   撰文/鄭家麟
 
  教師發展中心為推動本校101年度教學卓越計畫分項計畫1-5:全方位T型教師之
成長,於101年10月15日至11月19日間共辦理了五場教師次級資料庫應用工作坊
邀請本校劉介宇副教授主講希望提昇教師應用國內外健康照顧相關次級資料庫於研究
及教學實務之技巧,增進教師間學術研究心得之相互砥礪。
 
10月15日第一場活動:次級資料庫應用-國民健康訪問調查 
  演講一開始,劉副教授先向大家簡單介紹一下何謂「次級資料」,通常是一項「有
目的」,且多數為政府機構想瞭解某一情況而所做的研究方法,運用既存的統計資料或
是學術資料庫針對研究主題進行實證探索之研究方法。其實次級資料在我們的日常生活
中是相當普遍的,舉例來說:主計處或是內政部等所做出的資料統計。在劉副教授次級
資料分析經驗中除蒐集次級資料外,還可能需要一些相關的重要事件資訊及其一些延續
相關資料,這些在副教授分享的論文中都可以觀察得到次級資料的應用也是一門大學問。
  而次級資料分析有不需花費大量金錢與時間即可進行之特點,且奠基於隨機抽樣原
則,因此研究成果有可推論至整體社會之效果;包含多期的調查能對研究主題跨時變化
行探討,且隨著網路之發達對於公開的次級資料運用更為方便。
  雖然具有以上優點,但次級資料並非為你(妳)的研究主題而設計,因此對於諸多
問題僅能回覆「關聯性」、「初探性」或「間接性」等推論,且較少縱貫性的研究與調
查,值得關切的是欲分析次級資料,在劉副教授的經驗分享中,提到這是需要較高的資
料處理能力及統計分析能力的。
 
10月22日第二場活動:次級資料庫應用-中老年身心社會生活狀況長期追蹤調查 
  在本次的演講中,劉副教授將以台灣地區中老年身心社會生活狀況長期追蹤調查來
闡述次級資料庫之介紹與應用。此資料庫是屬長期追蹤的調查,因此在台灣地區應用頗
廣,緣起是為配合人口老化及政策需要,且進一步調查亞洲四國(台灣、菲律賓、新加
坡、泰國)老人比較研究,期能收集台灣地區老年身心社會健康狀況,並能探討現況
及變化等,以及藉此研究調查瞭解老年相關政策之需求及期望。今天,劉副教授透過介
紹此研究調查的目的、問卷、抽樣、調查單位、世代樣本……等多項資料來說明此資料
庫的鍵入、檢核直到建檔。
 
10月29日第三場活動:次級資料庫應用-資料包絡分析法 
   劉副教授希望在這一系列的演講中,透過概念中再深一點的概念,並有著實用性之
資訊來分享給在座的各位同仁。而在此演講中,將介紹「資料包絡分析法」,而其重要
一個核心概念即是運用另一角度使用次級資料並進行分析。舉個例子來說,在05年本校
的醫護期刊中,有一篇關於「不同權屬與評鑑等級醫院的效率評估」,此篇論文即是資
料包絡法的應用,而資料包絡法本質即是績效評估,且是單位的績效評估,除此之外,
還具有「單位獨立」之特性,因此不論投入產出單位為何,皆不影響最後之效率估計結果。
  劉副教授也實際的簡單操作了DEAP程式來計算DEA的效率值,讓有興趣的同仁可
以在活動後自行操作。在此簡單描述步驟:首先步驟一建立資料檔,接著建立指令檔,
並執行,步驟四找尋結果檔,最後,進行結果分析。
 
11月05日第四場活動:次級資料庫應用-時間數列分析
  時間數列主要是依照事件或資料發生的先後順序進行排列之數據,而時間數列資料
則是指同一特質在不同時間點或不同期間的資料,包括了日資料、週資料、月資料……
等。而例如股市大盤指數的日資料則屬於高頻資料。依據劉副教授的介紹,時間數列
分析方法可以分為:
(一)時間範圍分析法:
    古典分析方法-分解法
    平滑法
    回歸分析法
    Box-Jenkins方法-ARIMA model
    計量經濟的方法
(二)類神經網路的方法
(三)頻率範圍分析法
而今天的演講講將以Box-Jenkins方法-ARIMA model為主軸。
ARIMA(Autoregressive Integrated Moving Average Model)代表的是自我相關(AR)、
差分(I)與移動平均(MA)三種技術的結合,在運用此模式的前提條件是用作預測之時
間數列已經是由一個零均數的平穩隨機過程產生的。
  緊接著,劉副教授同時也分享了SPSS時間數列的功能介紹,首先是定義日期,這是
相當重要的環節,因為只有在定義時間變數後,SPSS才承認該數列之週期等時間特性。
接著是建立時間數列,而SPSS也提供繪圖工具用以觀察時間數列。
 
11月19日第五場活動:次級資料庫應用-資料採礦簡介
  綜觀這幾年的軟體市場,加進Data mining這個模組的軟體越來越多,劉副教授所講的
Data mining跟資管所講的Data mining有點不太一樣,資管講的主要從資料刪除開始去提,
劉副教授Data mining偏重於統計部分,若以關鍵字去搜尋資料庫的話,可找到許多相
關資料,而碩博士論更是驚人,到Pubmad上面找也可以找到許多資料,而大部分用於生
物資訊上面,劉副教授認為在他麼多統計資料以來CP值最高的就是資料採礦。
  在處理大型資料時,絕對沒有像在處理一兩百筆資料的結果那麼簡單,因為不需要的
資料一定很多,如何從眾多論文中搜尋到所需要的資料,就需要使用統計的Data mining去
做一些最佳化,最適化的選擇。
 
  次級資料庫的應用是一門大學問,結合了數學邏輯和統計軟體應用的精髓,透過劉介宇
副教授一系列相關的經驗演講與實例操作,參與的各位同仁也都對於次級資料庫有更深一層
的瞭解,期望未來本單位能夠藉更加精進教師之間學術間研究心得之相互砥礪。
 
瀏覽數: