0

0
0

文字

分享

0
0
0

《精準預測 The Signal and the Noise》-政治預測為何容易失誤

PanSci_96
・2013/09/20 ・3367字 ・閱讀時間約 7 分鐘 ・SR值 527 ・七年級

精準預測-立體書封-大談到政治方面的預測時,狐狸式的態度特別重要。政治預測的舞台上有些特別的陷阱,狐狸會比較小心避開,卻會讓刺蝟上當。

其中之一就是黨派的意識形態。莫里斯雖然當過柯林頓總統的顧問,卻認同共和黨,為他們的候選人募款—他的保守觀點也符合他的頻道:福斯新聞。但是自由派人士也不能免於成為刺蝟的傾向。在我對《麥克勞夫林團》來賓預測準確性的研究中,埃莉諾‧克里夫特—通常是來賓中最自由派的—比起來賓的共識,她提出的預測幾乎沒有對共和黨結果比較有利的。在預測二○○八年大選結果的時候,這樣也許對她有利,但是長期來看,她不會比保守派的對手更正確。

像泰特洛克研究的這些學者專家也可能受同樣的問題影響。事實上,在擁有博士學位的刺蝟手上,一知半解會是件很危險的事。泰特洛克最值得注意的發現之一就是,雖然靠著經驗,狐狸可以預測得更好,但刺蝟則相反:他們拿到越多額外的憑據,他們的表現就越差。泰特洛克相信,刺蝟可以掌控的事實越多,他們就越有機會更動、操弄這些事實,以符合他們的偏見。這個狀況就像你把一個慮病症患者放進一個暗暗的房間,裡面連上網際網路。你給他的時間越多,他能支配的資訊越多,他就會想出越荒謬的自我診斷;要不了多久他就會把普通的感冒當成黑死病了。

雖然泰特洛克發現左派跟右派的刺蝟預測都特別差,但他也發現各種政治信念的狐狸都比較不會受到這些效果影響。狐狸對於這個世界應該是什麼樣子可能有堅定的信念。但是對於這世界實際的樣子、還有近期內會是什麼樣子,他們在分析的時候常常可以將這個信念清楚畫分。

-----廣告,請繼續往下閱讀-----

相較之下,刺蝟比較難把他們支持的利害關係和他們的分析做區隔。相反的,用泰特洛克的話來說,他們把「事實和價值觀全部堆在一起,弄成模糊難辨的混合體」。他們用有偏見的眼光看待證據,看到他們想看的東西,而不是真正存在的東西。

你可以運用泰特洛克的測驗,來判斷你是不是刺蝟:你得到越多資訊的時候,你的預測是不是越好?理論上來說,更多的資訊應該能助你的預測一臂之力—如果這項資訊看起來沒有幫助,你永遠都可以忽略。但是刺蝟常常就把自己困在荊棘堆裡。

想想《國家期刊》(National Journal)政治圈內人民意調查(Political Insiders’ Poll)的例子,這個調查對大約一百八十位政治家、政治顧問、民意調查專家、名嘴進行。這個調查有區分民主黨和共和黨,但兩個團體都問到相同的問題。不管他們的政治信念為何,這個團體都傾向於刺蝟:政治工作者都為他們作戰受傷的疤而自豪,認為他們自己跟雞尾酒會的另一派鬥得難分難解、沒完沒了。

在二○一○年的中期選舉之前,《國家期刊》詢問他們的小組成員:民主黨有沒有可能繼續掌控參眾兩院。這些問題大家幾乎一致同意:民主黨可以守住參議院,但共和黨會拿下眾議院(這個小組這兩點都對了),民主黨和共和黨的圈內人幾乎都同意共和黨在眾議院席次增加的幅度;民主黨的專家預測他們會增加四十七席,共和黨員則預測會增加五十三席—考慮到眾議院一共有四百三十五席的話,這樣只算很微小的差距。

-----廣告,請繼續往下閱讀-----

然而,《國家期刊》也要求這個小組來預測十一場個別選舉的結果,內含參議院、眾議院,以及州長選舉。在此差距就大得多。在預測內華達州、伊利諾州、賓夕法尼亞州的參議員選舉、佛羅里達州的州長選舉,還有愛荷華州關鍵的眾議院選舉時,小組對勝利者的意見就有分歧。整體來說,共和黨的小組成員預料民主黨只會贏得十一場選舉裡的一場,而民主黨的小組成員則預料十一場會贏六場。(實際的結果很可以預期,就落在兩者之間—《國家期刊》問到的十一場選舉中,民主黨贏了三場 。)

很明顯的,黨派偏見在此發揮了一些作用:民主黨與共和黨都各自支持他們的主場球隊。然而,這樣不足以解釋小組回答不同類型的問題時出現的那不尋常的歧異。籠統地問到共和黨可能表現如何時,小組成員之間幾乎沒有差異。然而,問到特定的案例:那些會讓黨派差異浮現的案例時,他們就大相逕庭了 。

刺蝟的手上有太多資訊會是件壞事。共和黨整體而言可以比民主黨增加多少席次,這是個抽象的問題:除非你研究過全部四百三十五場選舉,不然沒有什麼額外的細節可以幫助你解決這個問題。相反的,如果問到任何一場特定選舉的話—例如,內華達州的參議員選舉—小組成員手上就有各式各樣的資訊:不只有當地的民意調查,還有他們讀到的關於選舉的新聞報導、從朋友那裡聽來的小道消息,或者他們在電視上看到候選人的時候,對他們的看法。他們甚至可能認識候選人或是為他們工作的人。

有很多資訊的刺蝟就會開始編故事—比現實世界更妥善、更規矩的故事,有主角和壞人,贏家和輸家,高潮和結局—而且主場球隊通常都有個美滿的結局。該死,民意調查中落後十個百分點的這位候選人就是會勝選,因為我認識這個候選人,認識他那州的選民,說不定我還從他的新聞秘書那裡聽到過民意調查是如何緊繃—還有你看過他最新的廣告了嗎?

-----廣告,請繼續往下閱讀-----

我們開始編這些故事的時候,就會失去批判性考量證據的能力。選舉通常會提出各種令人注目的說法。不管你對二○○八年歐巴馬、莎拉‧裴林(Sara Palin)、麥肯或希拉蕊(Hillary Clinton)的政治生涯有什麼看法,這些全都是很有說服力的真人真事:報導競選活動的書,像是《選情告急》(Game Change),讀起來就像穩坐暢銷排行榜的小說。二○一二年角逐的候選人比較沒那麼動人,但還是可以輕鬆拿出一整套老掉牙劇本,從悲劇(賀曼‧凱恩?)到鬧劇(瑞克‧佩瑞 )都有。

你可能會迷失在這些說法裡。正因為政治有人性的要素,所以可能特別容易受到差勁的預測影響:一場好的選舉會觸動我們激動的情緒。這樣不代表你非得對政治事件完全不動感情才能做好政治預測。但這確實代表狐狸冷淡的態度自有其好處。

狐狸般的預測方式

二○○八年二月,我在紐奧良的路易斯‧阿姆斯壯國際機場等一班誤點的班機時,有了五三八網站 的想法。因為某些原因—也許是馬丁尼激起了些東西—突然間似乎變得很清楚,應該要有人架個網站,來預測當時還在激烈爭奪民主黨提名的希拉蕊跟歐巴馬對抗麥肯的表現會如何。

不過我對選舉政治的興趣開始得比這更早一點—而且大多是因為挫折,而不是對政治的過程有任何一點的喜愛。我曾經很仔細地觀察二○○六國會對於禁止網路撲克的努力,那時網路撲克是我主要的收入來源之一。我發現對政治的報導不夠可靠,甚至還不如運動之類的東西,在運動中「魔球革命」已經大大增進分析能力了。

-----廣告,請繼續往下閱讀-----

在初選前的準備階段,我發現自己看的政治性電視越來越多,大多是MSNBC、CNN和福斯新聞。有許多的報導枯燥乏味。雖然選舉還有好幾個月才到,但電視評論都集中在希拉蕊必然被提名,卻忽略了這麼早的民意調查固有的不確定性。對於希拉蕊的性別和歐巴馬的種族似乎有太多關注 。大家似乎執著在哪個候選人在記者會上說了俏皮話,或是找了哪位籍籍無名的參議員來為他們背書,來判定哪個候選人「當天佔優勢」—這些事百分之九十九的選民都不在乎。

政治新聞,尤其是真正會影響競選活動的重要新聞,都是以不規則的速度在進行的。但是每天都要生產新聞報導。大部分的報導都是充版面用的,用故事的形式來包裝,設計來掩蓋報導的沒有價值。政治新聞報導不只常常錯失訊號—還常常強調雜訊。如果某一州有幾個民意調查都顯示共和黨領先,又有民意調查說了一樣的話的時候,就不算新聞了。但要是有個新的民意調查出現,顯示民主黨領先,那就會拿下頭條了—就算這次調查或許是異常值、沒辦法正確的預測結果也一樣。

換句話說,競爭的門檻低得令人動心。只要有人做一些相當基本的研究,了解政治競選活動之中什麼東西才真的有預測力,看起來就會像天才了。所以我開始在科斯日報

Daily Kos) 的網站寫部落格,貼出詳細、以資料為主的分析,討論民意調查、募款數字之類的議題。我研究了哪家民意調查公司在過去最正確,初選拿下某一州—例如愛荷華州—之後別州的調查數字有什麼變化。雖然在科斯日報這樣的網站,評論常常比較是質勝於量(黨派意識又重),但文章很快就有人追蹤。二○○八年三月,我把我的分析轉到我自己的網站:五三八,希望對大選做預測。

-----廣告,請繼續往下閱讀-----

五三八的預測模型一開始頗為單純—基本上來說,這模型是把民意調查結果平均,但是再依照民意調查過去的準確性加權—然後慢慢變得越來越複雜。但這模型還是遵守三大原則,這三個原則都是像狐狸一樣的。

圖2-3摘自《精準預測:如何從巨量雜訊中,看出重要的訊息?》,由三采文化出版。

-----廣告,請繼續往下閱讀-----
文章難易度
PanSci_96
1294 篇文章 ・ 2683 位粉絲
PanSci的編輯部帳號,會發自產內容跟各種消息喔。

0

0
0

文字

分享

0
0
0
AI 可以設計散熱,但誰敢讓它出貨?林唯耕談算力背後的物理現實
鳥苷三磷酸 (PanSci Promo)_96
・2026/08/20 ・2819字 ・閱讀時間約 5 分鐘

本文由 高柏科技 合作,泛科學撰文

林唯耕剛回台灣任教時,曾在清華大學的實驗室裡用一立方公分的「氨」做實驗。沒想到氨氣意外洩漏,那股刺鼻的氣味瞬間瀰漫整棟大樓,引來眾多師生抗議。

「從此以後,我再也不敢在實驗室裡用氨了。」他在《思想實驗室》的訪談中,帶著笑意回憶這段往事。

這段插曲聽來像是一則工程師的寓言:在理論模型中,氨是太空熱控系統的理想介質;但在現實的辦公大樓裡,它首先是逼人逃竄的臭味。公式本身沒有錯,但現實世界永遠比公式更複雜——它包含了人、成本、風險,以及必須為後果負責的工程師。

-----廣告,請繼續往下閱讀-----

高柏科技技術專家、清華大學榮譽退休教授林唯耕 ,曾任職於美國 OAO 工程部熱流組,深耕電子構裝散熱與熱管技術多年。隨著 AI 浪潮席捲全球,他鑽研一輩子的老問題再次被推向科技產業的核心:當晶片運算速度無止境攀升,那股伴隨而生的熱,究竟該往哪裡去?

熱不會讀新品發表會

科技巨頭在發表會上熱衷於談論大型語言模型、GPU 規格與驚人的算力。這些詞彙在投影片上光鮮亮麗,彷彿進步毫無邊界。然而,每一次數位運算都紮實地發生在實體晶片上。晶片會發熱、材料會疲勞老化,一旦設備過熱,系統便會降頻保護。在物理現實面前,再動聽的發表會敘事也必須低頭。

晶片會發熱、材料會疲勞老化,一旦設備過熱,系統便會降頻保護 / 圖片:envato

回顧個人電腦發展早期,晶片幾乎不需專屬散熱元件。隨後,鋁製鰭片、風扇、熱管到均溫板逐一登場。這段歷程常被視為技術升級,其實更像是對空間的極限勒索:晶片功率翻倍,發熱源的面積卻沒變大,機箱空間也不可能無限擴張。

林唯耕指出,散熱設計的核心只有三要素:功率、熱源面積與空間限制。他舉例,在標準的 1U 機箱中,若發熱面積約為三十乘三十毫米,氣冷系統在達到八百瓦時就會面臨瓶頸。這並非固定的物理常數,而是取決於空間、面積與氣流的動態平衡。最現實的代價在於,風扇轉速提升的背後,是噪音、電力損耗與空間占用。

-----廣告,請繼續往下閱讀-----

因此,「液冷技術」的興起並非單純為了追求酷炫,而是算力密度提升後的必然選擇。它能更精準地帶走晶片廢熱,卻也將新的挑戰帶入機房:漏液風險、流道堵塞、材料相容性,以及維運時的難度。工程的進步,本質上鮮少是徹底消滅問題,更多時候是選擇一組「比較值得承擔」的新問題。

太空教他的,不是把答案搬回地面

太空熱控工程之所以迷人,是因為它剝奪了地球上最常見的散熱工具。在真空宇宙中,沒有空氣能讓風扇製造對流;受光面溫度破百度,陰影處卻極度嚴寒。工程師必須純粹仰賴熱傳導、熱輻射,以及熱管與環路型熱管(LHP)來搬移熱能。

熱管運作的關鍵在於「相變」——液體蒸發時吸收大量潛熱,冷凝後重回循環。林唯耕比較了銅與水的熱傳導能力:在他設定的特定條件下,實心銅塊約能傳導 120 瓦的熱能;但若每秒有一立方公分的水發生蒸發相變,移熱量可瞬間拉升至 2.4 千瓦(kW)。他強調「每秒」的觀念,因為散熱談的是動態流動速率,而非靜態的冷卻魔法。

儘管如此,太空科技並不能直接套用到地面。太空元件因考量重量、功耗與維修難度,偏好無馬達幫浦的被動式設計;但地面 AI 伺服器面臨更高的熱負載與環境溫度,往往仍需幫浦驅動流量。當年那場「氨氣洩漏」事故正是最好的提醒:技術是否「先進」,與它是否「適合」當下的場景,始終是兩回事。

-----廣告,請繼續往下閱讀-----
他強調「每秒」的觀念,因為散熱談的是動態流動速率,而非靜態的冷卻魔法。/圖片:envato

好論文,為什麼仍可能造不出好產品

學術研究致力於證明「可行性」,而工業現場則要求「可重複性」——不僅要能運作,還得確保每台出廠的設備都不漏水。林唯耕將此定義為「從 0 到 1」與「從 1 到 100」的差別。後者涉及良率、成本、公差與客戶信任。論文中那次最完美的實驗數據,在產線上往往未必管用。

他從不避談失敗。在高柏科技早期與學界合作時,也曾遇過實驗數據無法複製,或研究方向偏離產業需求。這未必是雙方努力不夠,而是彼此對「成功」的標準不同。為了解決這道鴻溝,高柏科技推動「柏苗啟航創新培育計畫」,每年投入逾千萬資金與成大、中山、台科大等校合作,並指派專業人才在過程中持續微調、校正,確保研發貼近產線現實。

他分享了近期一項液冷工質校正專案。團隊使用非侵入式的超音波流量計進行觀測,但由於儀器預設以「水」校正,換成其他化學流體後讀數便出現誤差。最初嘗試用幫浦壓差推算,卻發現缺乏重複性,數據甚至推導出不合理的蒸發率。最後團隊回歸基本面,改用秤重法搭配能量平衡進行交叉驗證,才讓數據成功收斂。

這個故事真正的價值不在於「產學雙贏」的口號,而在於那段不夠優雅的挫折:假設失效、數據混亂、方法砍掉重練。也正是在這種時刻,企業需要的不只是會算數的人才,而是能洞察研究何時「走鐘」,並有權力喊停、要求重來的關鍵決策者。

-----廣告,請繼續往下閱讀-----

林唯耕坦言,過去在校園裡總認為「技術第一、成本第二」,進入商界後才驚覺行銷與信任關係往往才是關鍵。這番話雖然不如科技突破那樣動聽,卻是產品能否進入市場的殘酷真相。再卓越的散熱設計,若無法穩定生產或贏得客戶信任,也僅止於一份精美的報告。

AI 會給答案,誰來負責出貨?

訪談尾聲,主持人國威提出了一個時代難題:假設 AI 能在彈指間生成散熱架構、材料配方與流道設計,企業該選擇全面擁抱 AI 的速度,還是保留緩慢但穩定的工程驗證,以規避潛在的失效風險?

林唯耕拒絕落入二選一的框架。他的觀點是:兩者並存。AI 擅長處理資訊、生成草案;但工程師仍須實作原型,進行嚴苛的性能與可靠度測試,最終由人決定是否出貨。這並非盲目崇拜人類直覺,而是基於一項事實:AI 的資料庫裡,通常沒記載下一次「意外洩漏」或「材料疲勞」的細節,且模型永遠無法為量產結果擔負法律與商業責任。

在 AI 時代,最稀缺的未必是熟練下指令(Prompt)的人,而是具備這種能力的人:能預判答案可能在哪裡出錯、能設計實驗將問題「逼」出來,並且願意為最終的量產品質負起責任。

-----廣告,請繼續往下閱讀-----

大眾習慣將雲端想像成輕盈、無重量的空間。但現實中,雲端是由龐大的機房架構而成,裡面裝滿了晶片、管線、泵浦與冷卻液。虛擬算力的每一次擴張,都會在實體世界留下發熱的足跡。散熱工程師的價值,就是不讓這筆物理帳單,被埋沒在光鮮亮麗的投影片背後。

-----廣告,請繼續往下閱讀-----
文章難易度

討論功能關閉中。

0

0
0

文字

分享

0
0
0
預測市場?預測股票?如何讓預測有更高的準確率?——《超越直覺》
一起來
・2024/05/04 ・1635字 ・閱讀時間約 3 分鐘

我們發現在足球賽中,只要知道一個簡單的訊息(主隊過去的獲勝機率超過一半),預測力就會明顯好過隨便亂猜。如果再加上第二個簡單的訊息(勝負紀錄較佳的隊伍會略占優勢),可以再進一步提升預測力。除此之外,你可能還想收集其他訊息,像是四分衛最近的表現、球隊有沒有傷兵、明星跑衛的花邊新聞,但這些資訊對預測的幫助不大。換句話說,預測複雜系統這件事依循著「收益遞減定律」:第一個訊息很有幫助,但很快就找不到有幫助的其他訊息。

對於某些事件,我們當然會非常計較預測的準確性,像是投放線上廣告或投資高頻交易(HFT),可能一天內就要預測數百萬、數十億次,而且金額相當龐大。投入極大心力與費用、運用最精細的運算模型來開發複雜的預測方式,在那種情況下或許值得。但在其他商業領域,例如製作電影、出版書籍到發展新技術,只需要一年預測數十次、頂多數百次,而且這不過是整個決策過程中的一部分。這時,我們只要借助相對簡單的方式,就可以讓預測臻至完善。

預測時,不該只根據一人的意見就做決定——尤其是你自己的意見。雖然人們善於察覺與特定問題相關的因素,卻往往不會評估因素之間的相對重要性。譬如,預測電影的首映週末票房時,你可能會認為一些變項都是高度相關,例如製作費、宣傳費、上映廳數、試映會評價。沒錯。但我們要如何權衡「評價不優」與「額外行銷預算:一千萬美元」之間的比重?這沒有一定答案。同樣,在決定分配行銷預算的方法時,要如何判斷多少人會受到網路或雜誌廣告影響,又有多少人會從親朋好友那邊聽到產品訊息?我們也不清楚。唯一知道的是,這些因素都可能相關。

圖/envato

你可能會以為,精準判斷應該是專家的強項。但正如泰特洛克的試驗結果,專家在量化預測上的表現,其實跟普通人一樣糟糕,甚至可能更糟。然而,我們依賴專家之所以會成效不彰,不是因為專家的預測力跟一般人沒兩樣。問題在於,我們通常一次只會諮詢一位專家(否則何必找專家)。但我們應該要綜合多人的意見(無論是專家或非專家)再取平均值。至於要如何達成?這其實沒那麼重要。

-----廣告,請繼續往下閱讀-----

儘管預測市場有各種花俏的噱頭與技術,表現也比民調這類簡單方式好一點,但這種微小差異,還不如採用某種方式簡單綜合許多觀點再取平均。或者,我們也可以直接根據歷史數據,評估各項因素的相對重要性——這實際上就是統計模型在做的事。我必須再強調一次,雖然複雜模型可能會比簡單模型好一點,但兩者的差異小到幾乎沒有差別。到頭來,模型跟群眾所能達到的預測目的都一樣。第一,這兩種預測方式都要靠人為判斷,確認哪些因素與預測相關。第二,兩者皆需要估計、權衡那些因素的相對重要性。正如心理學家羅賓.道斯所言:「訣竅在於,找到要注意的變項,然後知道如何加入它們。」

只要一直使用這個訣竅,一段時間後,就會知道哪一些預測的失誤率較小,哪一些較大。舉例來說,當你要預測一個事件的結果,假如其他條件都相同,那越早做預測的失誤率就越大。不管你用什麼方法預測電影票房,在「剛開拍」時會比「上映前幾週」時要難得多。同樣,如果你想預測尚未上市的新產品銷量,那準確度可能不會高過預測已上市的產品。

你無法解決這個問題,唯一能做的只有:使用其中一種方式,或甚至結合幾種方式,就像我們研究預測市場時的方法,然後隨時觀察、記錄預測的表現。我在第 6 章開頭也提過,一般人通常不習慣追蹤自己的預測。我們做了大量預測,卻很少回頭檢視自己對了幾次。然而,留意並記錄預測成效或許才是最重要的事,唯有如此,你才能知道準確度是多少,進而知道自己預測的可信度。

——本文摘自《超越直覺》,2024 年 01 月,一起來出版,未經同意請勿轉載。

-----廣告,請繼續往下閱讀-----
-----廣告,請繼續往下閱讀-----

討論功能關閉中。

一起來
5 篇文章 ・ 2 位粉絲

0

30
2

文字

分享

0
30
2
民眾黨是未來台灣政治的樞紐?
林澤民_96
・2024/01/30 ・3382字 ・閱讀時間約 7 分鐘

一、前言

選後的立法院三黨不過半,但民眾黨有八席不分區立委,足以與民進黨或國民黨結成多數聯盟,勢將在國會居於樞紐地位。無獨有偶的是:民眾黨主席柯文哲在總統大選得到 26.5% 的選票,屈居第三,但因其獲得部分藍、綠選民的支持,在選民偏好順序組態的基礎上,它卻也同樣地居於樞紐地位。這個地位,將足以讓柯文哲及民眾黨在選後的台灣政壇持續激盪。

二、柯文哲是「孔多塞贏家」?

這次總統大選,誰能脫穎而出並不是一個特別令人殷盼的問題,更值得關心的問題是藍白綠「三跤㧣」在選民偏好順序組態中的消長。台灣總統大選採多數決選制,多數決選制英文叫 first-past-the-post(FPTP),簡單來講就是票多的贏,票少的輸。在 10 月中藍白合破局之後,賴蕭配會贏已經沒有懸念,但這只是選制定規之下的結果,換了另一個選制,同樣的選情可能就會險象環生。

從另一個角度想:選制是人為的,而選情反映的是社會現實。政治學者都知道天下沒有十全十美的選制;既定的選制推出了一位總統,並不代表選情的張力就會成為過眼雲煙。當三股社會勢力在制度的帷幕後繼續激盪,台灣政治將無法因新總統的誕生而趨於穩定。

圖/作者自製

如果在「三跤㧣」選舉之下,選情的激盪從候選人的得票多少看不出來,那要從哪裡看?政治學提供的一個方法是把候選人配對 PK,看是否有一位候選人能在所有的 PK 中取勝。這樣的候選人並不一定存在,如果不存在,那代表有 A 與 B 配對 A 勝,B 與 C 配對 B 勝,C 與 A 配對 C 勝的 A>B>C>A 的情形。這種情形,一般叫做「循環多數」(cyclical majorities),是 18 世紀法國學者孔多塞(Nicolas de Condorcet)首先提出。循環多數的存在意涵選舉結果隱藏了政治動盪。

-----廣告,請繼續往下閱讀-----

另一方面,如果有一位候選人能在配對 PK 時擊敗所有的其他候選人,這樣的候選人稱作「孔多塞贏家」(Condorcet winner),而在配對 PK 時均被擊敗的候選人則稱作「孔多塞輸家」(Condorcet loser)。三角嘟的選舉若無循環多數,則一定會有孔多塞贏家和孔多塞輸家,然而孔多塞贏家不一定即是多數決選制中贏得選舉的候選人,而多數決選制中贏得選舉的候選人卻可能是孔多塞輸家。

如果多數決選制中贏得選舉的候選人不是孔多塞贏家,那與循環多數一樣,意涵選後政治將不會穩定。

那麼,台灣這次總統大選,有沒有孔多塞贏家?如果有,是多數決選制之下當選的賴清德嗎?我根據戴立安先生調查規劃的《美麗島電子報》追蹤民調第 109 波(1 月 11 日至 12 日),也是選前最後民調的估計,得到的結果令人驚訝:得票墊後的柯文哲很可能是孔多塞贏家,而得票最多的賴清德很可能是孔多塞輸家。果然如此,那白色力量將會持續地激盪台灣政治!

我之前根據美麗島封關前第 101 波估計,侯友宜可能是孔多塞贏家,而賴清德是孔多塞輸家。現在得到不同的結果,顯示了封關期間的三股政治力量的消長。本來藍營期望的棄保不但沒有發生,而且柯文哲選前之夜在凱道浩大的造勢活動,還震驚了藍綠陣營。民調樣本估計出的孔多塞贏家本來就不準確,但短期內的改變,很可能反映了選情的激盪,甚至可能反映了循環多數的存在。

-----廣告,請繼續往下閱讀-----

三、如何從民調樣本估計孔多塞贏家

根據這波民調,總樣本 N=1001 位受訪者中,如果當時投票,會支持賴清德的受訪者共 355 人,佔 35.4%;支持侯友宜的受訪者共 247 人,佔 24.7%。支持柯文哲的受訪者共 200 人,佔 19.9%。

美麗島民調續問「最不希望誰當總統,也絕對不會投給他的候選人」,在會投票給三組候選人的 802 位支持者中,一共有 572 位對這個問題給予了明確的回答。《美麗島電子報》在其網站提供了交叉表如圖:

根據這個交叉表,我們可以估計每一位明確回答了續問的受訪者對三組候選人的偏好順序,然後再依這 572 人的偏好順序組態來判定在兩兩 PK 的情形下,候選人之間的輸贏如何。我得到的結果是:

  • 柯文哲 PK 賴清德:311 > 261(54.4% v. 45.6%)
  • 柯文哲 PK 侯友宜:287 > 285(50.2% v. 49.8%)
  • 侯友宜 PK 賴清德:293 > 279(51.2% v. 48.8%)

所以柯文哲是孔多塞贏家,賴清德是孔多塞輸家。當然我們如果考慮抽樣誤差(4.1%),除了柯文哲勝出賴清德具有統計顯著性之外,其他兩組配對可說難分難解。但在這 N=572 的小樣本中,三位候選人的得票率分別是:賴清德 40%,侯友宜 33%,柯文哲 27%,與選舉實際結果幾乎一模一樣。至少在這個反映了選舉結果的樣本中,柯文哲是孔多塞贏家。依多數決選制,孔多塞輸家賴清德當選。

-----廣告,請繼續往下閱讀-----

不過以上的分析有一個問題:各陣營的支持者中,有不少人無法明確回答「最不希望看到誰當總統,也絕對不會投給他做總統」的候選人。最嚴重的是賴清德的支持者,其「無反應率」(nonresponse rate)高達 34.5%。相對而言,侯友宜、柯文哲的支持者則分別只有 24.1%、23.8% 無法明確回答。為什麼賴的支持者有較多人無法指認最討厭的候選人?一個假設是因為藍、白性質相近,對許多綠營選民而言,其候選人的討厭程度可能難分軒輊。反過來說,藍、白陣營的選民大多數會最討厭綠營候選人,因此指認較無困難。無論如何,把無法明確回答偏好順序的受訪者歸為「遺失值」(missing value)而棄置不用總不是很恰當的做法,在這裡尤其可能會造成賴清德支持者數目的低估。

補救的辦法之一是在「無法明確回答等於無法區別」的假設下,把「遺失值」平分給投票對象之外的其他兩位候選人,也就是假設他們各有 1/2 的機會是無反應受訪者最討厭的候選人。這樣處理的結果,得到

  • 柯文哲 PK 賴清德:389 > 413(48.5% v. 51.5%)
  • 柯文哲 PK 侯友宜:396 > 406(49.4% v. 50.6%)
  • 侯友宜 PK 賴清德:376 > 426(46.9% v. 53.1%)

此時賴清德是孔多塞贏家,而柯文哲是孔多塞輸家。在這 N=802 的樣本中,三位候選人的得票率分別是:賴清德 44%,侯友宜 31%,柯文哲 25%。雖然依多數決選制,孔多塞贏家賴清德當選,但賴的得票率超過實際選舉結果(40%)。用無實證的假設來填補遺失值,反而造成賴清德支持者數目的高估。

如果擔心「無法明確回答等於無法區別」的假設太勉強,補救的辦法之二是把「遺失值」依有反應受訪者選擇最討厭對象的同樣比例,分給投票對象之外的其他兩位候選人。這樣處理的結果,得到

-----廣告,請繼續往下閱讀-----
  • 柯文哲 PK 賴清德:409 > 393(51.0% v. 49.0%)
  • 柯文哲 PK 侯友宜:407 > 395(50.8% v. 49.2%)
  • 侯友宜 PK 賴清德:417 > 385(52.0% v. 48.0%)

此時柯文哲又是孔多塞贏家,而賴清德又是孔多塞輸家了。這個樣本也是 N=802,三位候選人的得票率分別是:賴清德 44%,侯友宜 31%,柯文哲 25%,與上面的結果一樣。

以上三種無反應處理方法都不盡完美。第一種把無反應直接當遺失值丟棄,看似最不可取。然而縮小的樣本裡,三位候選人的支持度與實際選舉結果幾乎完全一致。後兩種以不同的假設補足了遺失值,但卻過度膨脹了賴清德的支持度。如果以樣本中候選人支持度與實際結果的比較來判斷遺失值處理方法的效度,我們不能排斥第一種方法及其結果。

無論如何,在缺乏完全資訊的情況下,我們發現的確有可能多數決輸家柯文哲是孔多塞贏家,而多數決贏家賴清德是孔多塞輸家。因為配對 PK 結果缺乏統計顯著性,我們甚至不能排除循環多數的存在。此後四年,多數決選制產生的總統能否在三角嘟力量的激盪下有效維持政治穩定,值得我們持續觀察。

四、結語

柯文哲之所以可以是孔多塞贏家,是因為藍綠選民傾向於最不希望對方的候選人當總統。而白營的中間偏藍位置,讓柯文哲與賴清德 PK 時,能夠得到大多數藍營選民的奧援而勝出。同樣的,當他與侯友宜 PK 時,他也能夠得到一部份綠營選民的奧援。只要他的支持者足夠,他也能夠勝出。反過來看,當賴清德與侯友宜 PK 時,除非他的基本盤夠大,否則從白營得到的奧援不一定足夠讓他勝出。民調 N=572 的樣本中,賴清德得 40%,侯友宜得 33%,柯文哲得 27%。由於柯的支持者討厭賴清德(52.5%)遠遠超過討厭侯友宜(23.7%),賴雖然基本盤較大,能夠從白營得到的奧援卻不多。而侯雖基本盤較小,卻有足夠的奧援。柯文哲之所以成為孔多塞贏家,賴清德之所以成為孔多塞輸家,都是這些因素的數學結果。

-----廣告,請繼續往下閱讀-----

資料來源

-----廣告,請繼續往下閱讀-----

討論功能關閉中。

林澤民_96
37 篇文章 ・ 248 位粉絲
台大電機系畢業,美國明尼蘇達大學政治學博士, 現任教於美國德州大學奧斯汀校區政府系。 林教授每年均參與中央研究院政治學研究所及政大選研中心 「政治學計量方法研習營」(Institute for Political Methodology)的教學工作, 並每兩年5-6月在台大政治系開授「理性行為分析專論」密集課程。 林教授的中文部落格多為文學、藝術、政治、社會、及文化評論。