導言|從中醫科學化,到科學論文,再到《笑傲江湖》-張清貿醫師
今天是我們中醫系大三「中醫研究方法」這門課的第二次上課。上個星期是開學第一堂課,我沒有一開始就教大家什麼叫 P value,也沒有馬上叫大家背 PICO、randomized controlled trial(隨機對照試驗)或 cohort study(世代研究),而是先帶大家讀何曼德院士談「中醫科學化」的文章。我覺得這件事情要放在研究方法的第一堂課,原因很簡單:在開始學「怎麼做研究」以前,我希望大家先想清楚一個更根本的問題——我們為什麼要研究中醫?所謂中醫科學化,到底是在做什麼?
何曼德院士本身是非常典型的 biomedical scientist(生物醫學科學家)與 physician-scientist(醫師科學家),專長包括微生物學、病毒學、免疫學以及感染症,1978 年當選中央研究院院士,後來也參與國家衛生研究院臨床研究體系的建立。 所以當一位接受完整現代醫學與科學研究訓練的學者回過頭來談「中醫科學化」,我覺得很值得中醫學生去思考。因為這個問題不是簡單地問「你相不相信中醫」,而是要進一步問:中醫累積了這麼長時間的臨床經驗,我們有沒有辦法用科學的方法,把其中真正有效的部分找出來?哪些只是傳承下來的說法?哪些可以被驗證?哪些需要被修正?哪些甚至應該被推翻?
所以我上個星期帶大家讀這篇文章時,我希望大家抓住的並不是「科學化」三個字本身,而是一種思考方式。中醫科學化不是把所有中醫理論換成西醫名詞,也不是找到一個 cytokine(細胞激素)、一條 pathway(訊息路徑),就可以宣布某個古代醫學理論已經被證明。真正的科學化,是把原本來自 clinical observation(臨床觀察)與經驗累積的現象,逐步轉換成可以提出問題、可以測量、可以比較、可以重複,也可以被別人挑戰的 scientific question(科學問題)。也就是說,我們不是先假設古人一定對,再想辦法找證據證明古人;同樣也不是先假設傳統醫學一定錯,再用現代醫學去否定它。我們真正要做的是把問題問清楚,建立適當的方法,讓 data(資料)來回答。

例如古人告訴我們某一個方可以治某一種證,第一個問題不是趕快去找一個動物實驗證明這個方可以降低某個 inflammatory cytokine(發炎細胞激素)。真正的研究問題應該往前退一步:這群病人到底是誰?診斷怎麼定義?所謂這個「證」能不能有 reproducibility(可重現性)?介入究竟是什麼?和什麼比較?所謂「有效」到底是哪一個 outcome(結果指標)改善?改善多少才具有 clinical significance(臨床意義)?如果別的研究團隊用相同的方法做一次,能不能得到接近的結果?這其實就是我們後面要學的 PICO、study design(研究設計)、measurement(測量)、bias(偏差)、statistics(統計)與 reproducibility(可重現性)。
所以我覺得,中醫真正要進入現代科學體系,最重要的不是「證明中醫是科學」,而是願不願意接受科學的方法來檢驗自己。科學最重要的一個精神,是一個 hypothesis(假說)不只要有可能被支持,也必須有可能被推翻。如果一個理論無論出現什麼結果,都可以重新解釋成自己是對的,那它就很難真正進入 empirical science(實證科學)的範圍。因此,中醫科學化真正困難的地方,其實不是替中醫多做幾個實驗,而是如何把中醫原本很複雜、很整體、很依賴臨床判斷的知識,轉換成可以清楚定義、可以測量、可以比較、又不至於把原本臨床意義完全切掉的研究問題。
這也是為什麼我上週先講「中醫科學化」,今天才正式進入「科學論文的結構」。因為一篇 scientific paper(科學論文)其實不是為了湊成 Introduction、Methods、Results、Discussion 四個部分而存在。IMRaD structure(引言—方法—結果—討論結構)的背後,其實就是一套科學推理的順序。Introduction(引言)告訴我們:現在已經知道什麼、還不知道什麼,所以為什麼值得問這個問題;Methods(方法)告訴我們:你打算用什麼方式回答,而且別人能不能知道你到底做了什麼;Results(結果)只負責把實際觀察到的 data 呈現出來;Discussion(討論)才是研究者開始解釋這些結果代表什麼、不能代表什麼,以及它和既有知識之間到底有什麼關係。
大家如果把這四個部分弄混,research thinking(研究思維)就很容易開始出問題。Methods 還沒有做好,結果就已經先決定答案;Results 明明只看到 association(關聯),Discussion 卻直接寫成 causation(因果);一個 secondary outcome(次要結果)剛好達到 statistical significance(統計顯著),摘要就把它寫得像整個研究最主要的發現;或者只挑支持自己想法的結果來討論,不符合原先假說的 data 就輕輕帶過。這些問題表面上發生在 paper writing(論文寫作),本質上其實全部都是研究方法的問題。
所以今天在正式帶大家看 scientific paper structure(科學論文結構)之前,我想先用一個我自己非常喜歡的例子,跟大家講研究方法。
不是 NEJM。
不是 Nature。
也不是 The Lancet。
而是金庸的《笑傲江湖》。
我覺得《笑傲江湖》裡面有一段故事,如果用研究方法重新去看,真的非常精彩,就是《葵花寶典》。因為整個《葵花寶典》的故事,其實一直在發生我們研究裡最常碰到的事情:有人只看到 partial information(部分資訊),有人依靠 memory(記憶)重建資料,有人根據自己的 background knowledge(背景知識)重新 interpretation(詮釋),有人拿到 secondary source(二手來源)以後又再加工,最後不同版本的資訊一路流傳,竟然形成完全不同的理論、門派與行動。
更有意思的是,每一個人都覺得自己手上的版本有道理。
岳肅有他的版本,蔡子峰有他的版本,於是後來出現劍宗與氣宗;渡元禪師沒有真正讀過原本,卻根據兩人口述重新推演,最後形成林遠圖的《辟邪劍譜》;另一份殘本被日月神教拿走,最後到了任我行與東方不敗手中;風清揚和令狐沖又讓我們看到,一場比武的輸贏不一定能證明哪一個理論正確;東方不敗最後雖然死了,也不能因此簡單下結論說「獨孤九劍勝過葵花寶典」,因為黑木崖那一場根本不是一個乾淨的 head-to-head comparison(頭對頭比較)。
所以今天我想利用《笑傲江湖》問大家一個問題:
如果《葵花寶典》是一份 scientific evidence(科學證據),它從 original source(原始來源)一路傳到岳肅、蔡子峰、渡元禪師、林遠圖、任我行、東方不敗、岳不群與林平之手上,中間到底發生了什麼事情?
等我們把這個故事講完,大家會發現,incomplete information(資訊不完整)、recall bias(回憶偏差)、interpretation bias(詮釋偏差)、confirmation bias(確認偏差)、selection bias(選擇偏差)、confounding(混雜)、secondary interpretation(次級詮釋)、data provenance(資料來源追蹤)、case report(病例報告)、generalizability(可推廣性)、causal inference(因果推論),甚至 research misconduct(研究不當行為),幾乎全部都藏在裡面。
所以我們今天不是要研究金庸,也不是要考大家《笑傲江湖》的劇情。
我是想用這個故事讓大家先理解一件事情:研究方法真正處理的,其實就是「資訊從哪裡來,我們怎麼知道,以及我們憑什麼從這些資訊得到現在這個結論」。
有了這個觀念以後,我們再回頭看一篇 scientific paper,就會開始知道自己真正要看的是什麼。
好,那我們現在先從《葵花寶典》開始。
-------------------------
從《葵花寶典》到東方不敗:《笑傲江湖》其實是一堂研究方法課
前面我們一直在講 PICO、研究設計、bias(偏差)以及怎麼讀一篇 paper。這些東西如果只是把名詞一個一個背起來,其實很容易變得很乾,也很容易上完課就忘記。所以這裡我想用一個我自己很喜歡的例子,把前面講過的研究方法重新串起來,就是金庸的《笑傲江湖》。現在可能不是每個同學都完整看過,但是《葵花寶典》應該多少聽過,「欲練神功,引刀自宮」更幾乎已經變成共同文化記憶。東方不敗大家也知道,只是很多人腦中的東方不敗,其實已經是林青霞電影版的形象,而不是完全等同於金庸小說原著。其實光是這件事情本身,就已經有研究方法的味道:小說是一個 original source(原始來源),電影經過 adaptation(改編),觀眾又根據電影形成 collective memory(集體記憶),最後大家以為自己知道「東方不敗」,實際上腦中保存的可能早已不是原始版本。資訊在傳遞的過程中,本來就會經歷 selection(選擇)、interpretation(詮釋)與 transformation(轉換)。
一、《葵花寶典》:先從 primary source(第一手來源)開始
《笑傲江湖》裡相傳,《葵花寶典》是前朝皇宮一位宦官所著,作者姓名已經不可考,只知道其中武學極為高深,同時也非常凶險。後來這部秘笈不知道經過多少轉折,流入福建莆田少林寺,由紅葉禪師保管。如果我們今天把整個故事當成一個研究資料庫,那麼紅葉禪師手中保存的完整《葵花寶典》,就是這個故事裡最接近 primary source(第一手來源)或 original source(原始來源)的版本。
但這裡其實已經可以帶出第一個研究方法觀念:primary source(第一手來源)並不等於 absolute truth(絕對真相)。就像我們現在做研究拿到 raw data(原始資料),也不能直接假設原始資料百分之百正確,因為儀器可能有誤差,病人可能記錯,研究者也可能輸入錯誤。只是越接近事件發生的源頭,中間經過的人為加工與解讀通常越少,所以研究上我們才會一直強調要盡可能回到 original data(原始資料)與 source document(原始文件)。
二、岳肅、蔡子峰偷看寶典:問題不是統計,而是一開始就只拿到 partial data(部分資料)
真正讓故事開始出現分歧的,是華山派岳肅與蔡子峰偷閱《葵花寶典》。兩個人既然是偷看,當然不可能坐在莆田少林寺裡慢慢抄,也不可能把整本秘笈帶走,所以他們想到一個看似非常有效率的方法:一個人讀一部分,另一個人讀另外一部分,各自強記,等回到華山之後再把兩邊內容合起來研究。乍看之下,這其實很像現在做研究時進行 work allocation(工作分配):dataset(資料集)太大,一個人做不完,那就拆開來,由不同研究者各自負責,再進行整合。
問題是,完整的《葵花寶典》並不一定只是簡單的 A 加 B。岳肅看到 A,蔡子峰看到 B,可是 A 與 B 之間還可能存在上下文、先後順序、前提條件與整體理論架構。如果只看到其中一部分,就可能出現 incomplete information(資訊不完整)。這件事情最值得學生記住的是:having data(有資料)並不等於 having complete data(擁有完整資料)。研究最危險的地方,有時候並不是統計算錯,而是你所有統計都算對了,卻不知道自己一開始拿到的 evidence(證據)就是不完整的。
這也很像很多人讀 paper 只看 abstract(摘要)。你不能說他完全沒讀,他當然有讀,可是摘要只是作者從整篇研究裡濃縮出來的一部分。primary outcome(主要結果)、secondary outcome(次要結果)、subgroup analysis(次群分析)、missing data(缺失資料)以及各種限制,未必都會完整出現在摘要裡。所以岳肅看到的《葵花寶典》不是完整的《葵花寶典》,蔡子峰看到的也不是;同樣地,abstract(摘要)也不是整篇 paper。
三、他們不是拍照,而是靠腦袋記:recall error(回憶誤差)又加了一層
事情更麻煩的是,岳肅與蔡子峰不是把自己看到的內容完整複製回去,而是靠記憶帶回華山。這就多了一層 recall error(回憶誤差),在特定研究情境中也可能形成 recall bias(回憶偏差)。人的記憶不是錄影機,你今天聽一堂三個小時的課,晚上回去再轉述時,一定會留下自己覺得重要的部分,忽略不熟悉的內容,甚至不知不覺用自己的語言重新組織。
所以岳肅與蔡子峰真正帶回華山的,其實不是原始文本,而是經歷了「原始內容、閱讀、理解、記憶、回想、重建」之後的版本。臨床研究也是一樣。假設我們問病人過去三個月一週平均運動幾次,病人回答三次,資料庫裡就會出現一個「3」。可是這個 3 並不是 reality(真實狀態)本身,而是實際行為先經過病人的感受、記憶、估計與回答,最後才被研究者輸入資料庫。因此 research data(研究資料)很多時候不是 reality 本身,而是 reality 經過 measurement process(測量過程)之後留下來的 representation(表徵)。
四、回到華山資料對不起來:從 data discrepancy(資料不一致)變成 interpretation bias(詮釋偏差)
岳肅與蔡子峰回到華山之後,把自己記得的內容拿出來比對,發現很多地方根本對不起來,甚至互相矛盾。如果今天是兩個研究者做 independent chart review(獨立病歷審查)發現結果不一致,最合理的做法是回去看 source document(原始文件)重新核對。可是岳肅與蔡子峰做不到,因為原始《葵花寶典》還在莆田少林寺,他們不可能隨時回去重新確認,所以兩個人只能開始根據自己手上的版本進行 interpretation(詮釋)。
慢慢地,這個資料不一致不再只是技術問題,而逐漸發展成兩套武學觀。岳肅一脈偏重「氣」,蔡子峰一脈偏重「劍」,後來甚至形成華山派著名的氣宗與劍宗之爭。這就很像研究裡的 interpretation bias(詮釋偏差):同一個現象,不同研究者因為拿到的資料不同、背景知識不同,最後可能建立出完全不同的 theoretical framework(理論框架)。一旦某一套理論建立起來,還可能進一步出現 confirmation bias(確認偏差),也就是人會比較容易注意、接受與記住支持自己原先想法的 evidence。
這在現代研究裡其實非常常見。做 immunology(免疫學)的團隊容易先看到 immune dysregulation(免疫失調),做 microbiome(微生物相)的團隊容易先看到 microbial dysbiosis(微生物失衡),做 autonomic nervous system(自律神經系統)的團隊則可能強調 autonomic dysfunction(自律神經功能失調)。這不代表誰一定錯,而是每個研究者可能只看到同一個疾病的不同 slice(切面)。問題出在,如果把自己看到的切面當成整個疾病,就很容易從有限資料走向過度結論。
五、劍宗、氣宗真的打起來:winner(勝者)不等於 theory(理論)被證明
華山派的劍宗與氣宗後來不是停留在理論爭論,而是真的發展成嚴重的門派內鬥。氣宗強調內功根基與以氣御劍,劍宗則更重視劍法招式、速度與臨敵變化。最後氣宗取得華山派主導權,岳不群所屬的就是氣宗,而劍宗逐漸式微。乍看之下,好像可以說:「結果很清楚,氣宗最後贏了,所以氣宗理論比較正確。」
但這恰恰是一個很好的研究方法教材。因為那根本不是 randomized controlled trial(隨機對照試驗),兩邊的 baseline characteristics(基線特徵)也不一樣,更重要的是,劍宗最重要的高手之一風清揚在決戰之前被設計離開華山,根本沒有參與那場關鍵戰役。換句話說,最重要的 participant(參與者)之一沒有進入比較,最後的 outcome(結果)當然可能受到 selection bias(選擇偏差)與 confounding(混雜)影響。
因此「氣宗贏了」只能說明那一次歷史事件的結果,不能直接證明氣宗的武學理論優於劍宗。這就像 treatment group(治療組)全部都是年輕人,control group(對照組)全部都是八十歲老人,最後治療組死亡率比較低,你不能立刻說 intervention(介入)有效,因為兩組根本不是在同一起跑點上。Outcome difference(結果差異)不等於 causal effect(因果效果),這就是研究方法中非常核心的一個觀念。
六、令狐沖與風清揚:新的 evidence(證據)出現,不代表原本門派之爭立刻有答案
故事到了令狐沖這一代又更有意思。令狐沖是岳不群的大弟子,因此從小接受的是氣宗教育,他原本被教導「氣是根本,劍是運用」。但他在華山思過崖面壁時,先是在山洞中看到五嶽劍派許多失傳招式以及日月神教十長老刻下的破解方法,後來又遇到隱居已久的風清揚,並從風清揚那裡學到獨孤九劍。
思過崖山洞這一段,其實非常適合拿來講 disconfirming evidence(反向證據)。大家原本一直傳承「我們這套劍法很厲害」,結果山洞裡卻存在另一批資料,告訴你這些招式其實有破解方法。如果這些 negative evidence(負向證據)永遠沒有被看見,那大家對五嶽劍法 effectiveness(有效性)的認識就可能被高估。這和 publication bias(發表偏差)很像:positive results(正向結果)一直發表,negative results(負向結果)全部被藏起來,最後文獻看起來當然會覺得某個 intervention 特別有效。所以思過崖山洞甚至可以開玩笑說是一個「unpublished negative data repository(未發表負向資料庫)」。
不過風清揚傳給令狐沖的其實是獨孤九劍,而不是單純的華山劍宗劍法,所以令狐沖後來成為頂尖高手,也不能直接拿來證明「劍宗勝過氣宗」。因為這時 intervention(介入)本身已經改變了。更何況令狐沖仍然只是 N=1,也就是一個 case report(病例報告)。一個精彩的 case 可以提出 hypothesis(假說),可以告訴我們某件事情值得研究,卻很難建立 causality(因果關係)與 generalizability(可推廣性)。令狐沖可能本來就是悟性特別高的人,所以他的成功不能自動推論到所有華山弟子。
七、渡元禪師:expert opinion(專家意見)不等於 primary evidence(第一手證據)
華山派偷閱《葵花寶典》的事情被莆田少林寺知道之後,紅葉禪師派弟子渡元禪師上華山處理。岳肅與蔡子峰一方面承認私閱秘笈,另一方面卻認為渡元既然是紅葉禪師弟子,一定熟悉《葵花寶典》,於是把自己不懂的部分拿出來請教他。問題是,渡元本人其實沒有看過原始《葵花寶典》。
這個情節非常適合提醒學生,expert opinion(專家意見)與 primary evidence(第一手證據)是不同的。專家可能非常有經驗、非常有學問,但如果沒有直接接觸 source data(來源資料),他所提供的仍然是 interpretation(詮釋)。渡元的武學底子很高,所以岳肅講一部分、蔡子峰講一部分,他一邊聽,一邊依照自己的理解重新推演,最後把這些內容記在袈裟上。之後他沒有回莆田少林寺,而是還俗改名林遠圖,創立福威鏢局,並以七十二路辟邪劍法威震江湖。
所以《辟邪劍譜》的 information flow(資訊流程)其實非常複雜:原始《葵花寶典》先被岳肅、蔡子峰各看一部分,再經過兩人的記憶與口頭轉述,最後由渡元依照自己的知識重新理解與補完。這就是 data provenance(資料來源追蹤)的概念。當你看到一個 conclusion(結論)時,不能只看最後一層,而要往前追:「這個資訊最早從哪裡來?中間經過幾手?每一層做了什麼 transformation(轉換)?」
八、《辟邪劍譜》很有效,但 effective(有效)不等於 faithful to original(忠實還原原始版本)
林遠圖靠辟邪劍法成為江湖頂尖高手,這證明他自行整理與推演出來的版本確實能產生很強的效果。但研究方法上要小心的是,effectiveness(有效性)不能反過來證明它就是原版《葵花寶典》的完整複製。Derived model(衍生模型)可以非常好用,甚至比原始版本更適合某些情境,但這不代表 derived model 等於 original reality(原始真實)。
這和現在很多 predictive model(預測模型)或 AI model(人工智慧模型)很像。一個模型可以非常準確預測疾病結果,卻不代表它真的掌握了疾病完整的 causal mechanism(因果機轉)。同樣地,林遠圖練得很強,只能說明他的版本可以產生很強的武功,不能證明那就是百分之百完整的《葵花寶典》。
九、紅葉禪師把原版燒掉:raw data(原始資料)消失以後,很多問題再也無法驗證
後來紅葉禪師認為《葵花寶典》過於凶險,最終把莆田少林寺保存的原本焚毀。這在研究方法上是一個非常重要的節點,因為 original raw data(原始資料)從此消失。從這一刻開始,岳肅、蔡子峰、林遠圖留下的各種版本到底哪一部分最接近原始內容,後人已經無法真正重新核對。
這就是研究為什麼重視 data preservation(資料保存)、audit trail(稽核軌跡)、version control(版本控制)與 reproducibility(可重現性)。如果一篇 paper 發表以後,所有 raw data 都被刪掉,幾年之後有人質疑結果,想做 reanalysis(重新分析),卻已經沒有辦法回到原始資料,那很多爭議就永遠不可能真正解決。保存原始資料並不是單純行政要求,而是科學能否被驗證的重要基礎。
十、從此《葵花寶典》分成兩條 evidence lineage(證據傳承線)
原版被毀之後,江湖上實際留下兩條不同的 information lineage(資訊傳承線)。第一條是岳肅、蔡子峰自己留下的《葵花寶典》殘本,後來日月神教十長老攻打華山,岳肅、蔡子峰在相關衝突中死亡,而華山保存的殘本則被日月神教奪走。第二條則是岳肅、蔡子峰口述給渡元,再由渡元重新理解與推演,最後形成林遠圖的《辟邪劍譜》。
所以同一個 original source(原始來源),最後形成兩套 derivative versions(衍生版本)。這非常像同一個 database(資料庫)被兩組研究者用不同 definition(定義)、不同 inclusion criteria(納入條件)、不同 statistical model(統計模型)與不同 assumptions(假設)進行 secondary analysis(次級分析),最後得到兩篇完全不同的 paper。因此讀研究不能只看哪一篇 P value 比較漂亮,而要追問兩篇 paper 到底怎麼從 source data(來源資料)一路走到最後的 conclusion(結論)。
十一、任我行與東方不敗:拿到 intervention(介入)和真正接受 intervention 是兩回事
日月神教奪走《葵花寶典》殘本之後,這部秘笈逐漸成為教中的重要武學,後來傳到任我行手上。任我行本身已經是頂尖高手,以吸星大法聞名,手上雖然擁有《葵花寶典》,卻沒有真正依照寶典修練。後來他把這部秘笈交給自己一路提拔的東方不敗,而東方不敗則真的照著內容去練,並且練成極高境界。
這裡其實可以帶出 clinical trial(臨床試驗)中一個很基本但很重要的概念:assignment(分派)與 actual exposure(實際暴露)並不是同一件事。病人被 randomize(隨機分派)到藥物組,不代表他真的每天按規定服藥;任我行「擁有」《葵花寶典》,也不代表他真正接受這個 intervention。東方不敗才是實際接受介入的人。因此如果要比較兩人的結果,不能單純把「都有葵花寶典」當成相同 exposure(暴露)。
十二、東方不敗練成功:一個非常漂亮的 positive case(正向案例),但還是 N=1
東方不敗修練《葵花寶典》之後武功大進,最終甚至反過來囚禁任我行於西湖梅莊地牢,自己掌握日月神教。從故事結果來看,《葵花寶典》似乎非常有效。但研究方法會要求我們再多問一步:東方不敗仍然只是一個 positive case(正向案例),也就是 N=1。
一個成功案例很吸引人,但不能直接建立 generalizability(可推廣性)。我們不知道如果一百個人都照著這個方法練,會有多少人成功、多少人失敗,也不知道那些失敗者是不是根本沒有留下故事。這甚至可以連到 survivorship bias(倖存者偏差):我們最容易看到的,往往是成功留下來的人,而那些失敗、退出、受傷或根本沒有練成的人,可能完全不在我們的資料裡。醫學上常有人說「我朋友吃這個好了」,這個 observation(觀察)當然值得注意,但不能因此直接推論所有人都會有效。
十三、東方不敗練成,也不能證明日月神教手上的版本就是完整原版
更重要的是,日月神教手上的《葵花寶典》本來就是岳肅、蔡子峰留下來的殘本,不是紅葉禪師保存的完整原本。東方不敗卻依然練成功了。這件事情再次提醒我們,effectiveness(有效性)不能等同於 fidelity to original source(忠實還原原始來源)。東方不敗的成功只能證明「這個版本在東方不敗這個人身上產生了非常強的效果」,不能證明這就是完整、正確、沒有缺失的《葵花寶典》。
這和現代研究裡 surrogate marker(替代指標)與 mechanism(機轉)之間的關係很像。一個 marker 很會預測 outcome,不代表它一定就是造成 outcome 的原因;一個模型很準,也不代表它完整描述 reality。研究最忌諱的就是從「看起來有效」直接跳到「所以我們已經完全理解它」。
十四、黑木崖決戰:最後誰死了,不能直接告訴你哪一套武功比較強
後來任我行逃出梅莊,和令狐沖、向問天、任盈盈等人一起攻上黑木崖。真正交手以後,大家才發現東方不敗武功之高已經到了驚人的程度。任我行本身是頂尖高手,令狐沖有獨孤九劍,向問天也是一流高手,但幾人聯手仍然很難真正制住東方不敗。東方不敗以一根繡花針快速穿梭於眾人之間,一度仍佔上風。
最後真正改變戰局的關鍵,並不是單純「令狐沖用獨孤九劍破解了葵花寶典」,而是任盈盈轉而攻擊東方不敗最在意的楊蓮亭,使東方不敗為了救人而分心,任我行、令狐沖、向問天等人才得到機會重創他。因此如果只看最後結果,說「東方不敗死了,所以獨孤九劍勝過葵花寶典」,就是非常典型的過度推論。
因為黑木崖這一戰根本不是乾淨的 head-to-head comparison(頭對頭比較),而是存在 multiple concurrent interventions(多重同步介入)、co-intervention(共同介入)與 confounding factors(混雜因子)。最後 outcome(結果)發生了,不代表我們就能把全部 causal effect(因果效果)歸給其中一個 intervention。這其實就是 causal inference(因果推論)最核心的困難:結果發生,不代表你已經知道為什麼發生。
所以如果真正要問「獨孤九劍和葵花寶典誰比較強」,小說其實沒有提供一個乾淨的一對一比較。這就像某個病人同時吃藥、接受針灸、改變飲食、開始運動、改善睡眠,三個月後症狀變好,我們不能直接把全部效果歸因給其中一項 intervention。
十五、《辟邪劍譜》到了岳不群:bias(偏差)和 fraud(造假)不是一回事
另一條《辟邪劍譜》的傳承後來成為整部《笑傲江湖》的重要主線。林遠圖的後代沒有真正掌握完整辟邪劍法,但江湖上仍然記得林遠圖當年的威名,因此余滄海、岳不群等人都覬覦真正的劍譜,最後導致福威鏢局滅門,林平之的人生也因此徹底改變。
岳不群最後取得真正《辟邪劍譜》並秘密修練,武功大進;更有意思的是,他還利用錯誤版本去誤導左冷禪。這裡一定要和學生講清楚:這已經不是 bias(偏差),而是 deception(欺騙)。如果放到研究倫理裡,就是 research misconduct(研究不當行為),甚至接近 fabrication(捏造)或 falsification(竄改)的概念。
Bias 很多時候不是故意的。岳肅與蔡子峰可能都很認真,只是因為取得資料不完整、記憶有誤差、後續詮釋不同,所以逐漸偏離原始內容。渡元則屬於 secondary interpretation(次級詮釋),他根據二手資訊重新建構。但如果明知道資訊是假的,還故意製造、修改並讓別人相信,那就不再只是 bias,而是 misconduct。這三者在研究方法與研究倫理上一定要分開。
十六、最後回到令狐沖:真正好的 researcher(研究者),不是先決定自己是哪一派
我覺得整部《笑傲江湖》裡,令狐沖其實有一個很像 good researcher(好的研究者)的地方,就是他比較不容易被門派先綁死。華山告訴他氣宗才是正統,他沒有因此拒絕風清揚;正派告訴他日月神教都是魔教,他也沒有因此認為任盈盈、向問天一定都是壞人;五嶽劍派一直說自己的劍法高明,他在思過崖看到破解方法時,也沒有假裝那批 evidence 不存在。
這就是 science(科學)真正需要的態度:evidence first(證據優先),不是 faction first(門派優先)。研究最怕的是先決定自己是哪一派,再去找 evidence 支持自己。「我是做中醫,所以我要證明中醫一定有效」不對;「我是西醫,所以我要證明中醫沒有效」一樣不對;「我是做 microbiome,所以任何疾病最後一定都是 microbiome」也不對。真正好的 research question(研究問題)應該是先提出 hypothesis(假說),再讓 data(資料)告訴我們這個 hypothesis 到底對不對,甚至如果 data 證明自己錯了,也要接受。
十七、所以 PICO 到底在訓練什麼?
講到這裡再回來看 PICO,就會發現它其實不是叫學生背四個英文字母而已。假設江湖上有人跟你說:「辟邪劍法天下第一。」這句話本身根本不能算 scientific conclusion(科學結論),因為 Population(研究族群)是誰?林遠圖、岳不群、林平之,還是一般武林人士?Intervention(介入)是哪一版辟邪劍法?完整袈裟、殘缺版本還是假的版本?Comparator(比較組)是獨孤九劍、華山氣宗還是普通劍法?Outcome(結果)又是什麼?單場比武勝負、長期勝率、武功速度、生存,還是最後人生過得好不好?
一拆 PICO,原本一句看起來很有氣勢的「辟邪劍法天下第一」,其實變成一個非常模糊的 statement(陳述)。同樣地,今天有人說「針灸治乾眼有效」,也一定要問是哪一種 dry eye disease(乾眼症)、有沒有 Sjögren’s disease(修格蘭氏症)、針哪裡、多久、跟 waiting list(等待名單)、sham acupuncture(假針灸)、usual care(常規治療)還是 artificial tears(人工淚液)比較,outcome 是 Schirmer test(淚液分泌試驗)、TBUT(淚膜破裂時間)、OSDI(眼表疾病指數)還是 subjective symptoms(主觀症狀)。
所以 PICO 真正訓練的,是不要接受模糊的江湖傳言,而要把一個模糊的 claim(主張)拆成可以被驗證的 research question(研究問題)。
十八、《葵花寶典》整件事情,在研究方法上到底發生了什麼?
如果最後把整條故事重新看一次,《葵花寶典》其實經歷了一連串 information transformation(資訊轉換)。一開始有 primary source(第一手來源),岳肅、蔡子峰只能看到部分內容,產生 incomplete information(資訊不完整);兩人靠記憶把內容帶回去,又加入 recall error(回憶誤差);回華山後各自解釋,產生 interpretation bias(詮釋偏差),之後又可能形成 confirmation bias(確認偏差)。華山劍宗、氣宗後來真的決戰,但是風清揚缺席等因素造成 selection bias(選擇偏差)與 confounding(混雜),所以不能用最後誰勝誰敗判定理論對錯。
令狐沖後來接受風清揚傳授,但他學的是獨孤九劍,intervention(介入)已經不同,而且令狐沖本身仍然只是 N=1 的 case report(病例報告),不能直接建立 generalizability(可推廣性)。渡元沒有接觸 original source,而是根據岳肅、蔡子峰口述重新推演,形成 secondary interpretation(次級詮釋)與 derived model(衍生模型)。紅葉禪師燒掉原本,則讓 raw data(原始資料)消失,後來的 verification(驗證)與 reproducibility(可重現性)受到限制。
日月神教保存的殘本最後傳到任我行,再由東方不敗真正修練。東方不敗是一個非常成功的 positive case(正向案例),但仍然不能因為一個成功案例就建立普遍性。最後黑木崖之戰中,東方不敗雖然死亡,卻不能因此說獨孤九劍打敗葵花寶典,因為整場戰鬥有多名高手參與,任盈盈攻擊楊蓮亭更是關鍵 co-intervention(共同介入),因果歸屬沒有那麼單純。至於岳不群故意用錯誤資訊欺騙別人,則已經從 bias 跨進 research misconduct(研究不當行為)。
換句話說,一部《笑傲江湖》,從 information bias(資訊偏差)、recall bias(回憶偏差)、interpretation bias(詮釋偏差)、selection bias(選擇偏差)、confounding(混雜)、case report(病例報告)、generalizability(可推廣性)、data provenance(資料來源追蹤)、reproducibility(可重現性)、causal inference(因果推論)一直講到 research misconduct(研究不當行為),幾乎可以把一堂研究方法都串起來。
十九、最後真正要學的,是隨時問自己:「我手上到底是哪一版?」
所以我真正希望大家從這個故事學到的,並不是把十幾個英文名詞全部背起來,而是養成一個研究者的習慣。當你看到一個研究結論時,第一個反應不是「我相信」或「我不相信」,而是先問:這個資訊從哪裡來?我現在看到的是 primary data(第一手資料),還是別人整理過的版本?中間有沒有 missing information(缺失資訊)?這是 data(資料)本身,還是 interpretation(詮釋)?有沒有我沒有看到的 negative evidence(負向證據)?兩個 group(組別)真的可以直接比較嗎?結果發生了,能不能真的歸因到 intervention?這只是一個 case,還是有 comparator(比較組)?這個結果能不能 generalize(推廣)到其他人?最後這個 conclusion(結論),真的有被 study design(研究設計)支持嗎?
當你開始自然地問這些問題,research methodology(研究方法學)就不再只是 PICO、P value 和 bias,而會變成你看待所有資訊的一種方式。
所以我覺得《葵花寶典》這個故事真正精彩的地方,不只是誰的武功最高,而是每個人手上其實都拿到不同版本的資訊,卻很容易把自己看到的那一版當成完整真相。岳肅與蔡子峰是這樣,華山劍宗與氣宗是這樣,後來搶《辟邪劍譜》的人也是這樣,到了任我行與東方不敗這一段,我們甚至看到:就算 outcome(結果)真的很驚人,也不能跳過 study design(研究設計),直接下 causality(因果)結論。
所以如果我要用一句話收掉今天這一段,我會說:
研究方法真正教我們的,不只是怎麼證明自己是對的,而是隨時提醒自己:我手上的《葵花寶典》,到底是不是完整的那一本?
如果岳肅、蔡子峰當年先學過 research methodology(研究方法學),華山派後來也許真的不用分成劍宗跟氣宗。
----------------------------














沒有留言:
張貼留言
感謝您的寶貴意見,張清貿醫師