0

0
0

文字

分享

0
0
0

海量資料萬歲?請三思!

活躍星系核_96
・2013/05/25 ・4971字 ・閱讀時間約 10 分鐘 ・SR值 616 ・十年級

本文出處:Think Again: Big Data
作者:KATE CRAWFORD
譯者:Leonard Chien

圖片取自 https://team.inria.fr/zenith/ibc-seminar-patrick-valduriez-parallel-techniques-for-big-data-march-22-2pm/

「海量資料」是當今最流行的用語,也是科技界對世上各種棘手難題的萬用解答,意指藉由分析龐大資訊後,歸納出模式、精闢見解,並預測複雜問題的答案,聽來或許有些無趣,但無論是阻止恐怖份子終結貧窮拯救地球,海量資料支持者都深信可迎刃而解。

在《Big Data: A Revolution That Will Transform How We Live, Work, and Think》一書中,兩位作者寫道,「對於氣候變遷、根除疾病、促進良好治理與經濟發展等全球迫切問題,海量資料均可提供部分答案,為社會提供眾多好處」。

只要握有足夠數據,例如iPhone內部資料、雜貨店購物內容、網路交友檔案、全國匿名醫療紀錄,電腦運算即可拆解這些原始資料,從中挖掘出無數見解。美國歐巴馬政府亦傾力投入,於5月9日「首開先例」,公開「過往無法取用或管理的資料」,供企業家、研究人員及大眾使用。

-----廣告,請繼續往下閱讀-----

歐巴馬總統表示,「我們希望促成更多民間創新與發現,因此史上首次釋出大量美國資料,開放人們輕鬆取用,優秀企業家也已開發出眾多用途」。

可是海量資料的威力是否名實相符?在龐大電腦數據裡,是否真能揭露人類行為的秘密?《外交政策》雜誌邀請麻省理工學院「公民媒體中心」成員Kate Crawford,說明數字背後的真相。-編按

「只要資料足夠,數字自會說話。」

不可能。海量資料支持者希望我們相信,在程式碼字裡行間與巨大資料庫內,必有客觀及通用的見解,能解釋人類行為模式,包括消費情況、犯罪或恐怖主義行動、健康習慣、員工產能等,但他們卻總不願正視缺點。數字不會說話,資料不論規模大小,仍受人類設計限制,Apache Hadoop軟體架構等海量資料工具亦無法排除偏斜、落差與假設錯誤。當海量資料試圖歸納社會狀態,這些因素影響格外顯著,但我們卻常誤以為分析結果比個人意見更客觀。其實海量資料、個人觀感及體驗皆然,充滿偏見及盲點,可是許多人卻以為資料量越大就代表品質越好的資料,也以為「相關」與「因果」一樣好。

例如社群媒體常成為海量資料分析主題,其中也確實充斥大量資訊,據稱從Twitter資料裡可見,人們離家愈遠愈開心,且情緒在每週四晚上最低落。可是我們必須懂得質疑資料背後真正的涵義,例如「皮猶研究中心」指出,美國只有16%的成年網路用戶使用Twitter,亦無法如實代表社會結構,通常年紀較輕、較集中於都會區。此外,許多Twitter帳號均為自動機器人或假檔案,近期估計總數可能高達2000萬,因此討論如何從Twitter分析輿論之前,得先釐清這些反應究竟來自真人或電腦演算式。

-----廣告,請繼續往下閱讀-----

縱然各位相信絕大多數Twitter用戶均為真人,偏見依然存在,例如為分析2013年澳洲網球公開賽中,人們在社群媒體對哪些選手「看法最佳」,IBM透過「社會觀感指數」,大量分析Twitter訊息,結果由Victoria Azarenka奪冠,但許多訊息提到她時,都在批評濫用傷停時間,如此看來,很難相信IBM的演算式確能反映現實。

即便排除不良資料問題,演算式本身亦有偏見,新聞彙整網站取用你我的個人偏好與瀏覽紀錄,編排出用戶感興趣的最新消息,其中假設頻率與重要性呈正比,或個人社群最常分享的資訊,也必定與你興趣相符。演算式過濾龐大資料時,也訂定呈現世界的原則,一般用戶不會感受到這些規則,可是大大左右民眾觀點。

不少資訊工程專家正在努力解除疑慮,Ed Felten為普林斯頓大學教授,曾為美國聯邦貿易委員會首席科技專家,最近發起一項計畫,測驗各項演算式的偏見,尤其是美國政府也運用演算式評估個人,例如聯邦調查局與運輸安全局即彙整多項官方海量資料,列出航空旅客黑名單,做為飛安制度之用。

「海量資料可提高城市智慧及效能。」

仍有上限。海量資料可提供珍貴見解,協助改善城市,但也僅止於此,由於資料生成與收集過程並不均等,其中會出現「信號問題」,造成有些民眾及社區遭到漠視或代表性不足,若以海量資料處理城市規劃問題,必須仰賴官員同時瞭解資料及其侷限。

-----廣告,請繼續往下閱讀-----

例如美國波士頓的Street Bump應用程式裡,收集行經坑洞的駕駛人智慧型手機資料,能以低成本途徑收集資訊,類似應用程式也與日俱增,可是城市若完全依賴智慧型手機用戶提供資料,等於自動排除部分樣本,某些社區內智慧型手機用戶比例若較低,通常年齡層較高,經濟條件也較弱勢,因此遭到排擠。波士頓市政單位盡力想彌補潛在資料缺口,但假若官員對此警覺性較低,就可能忽略這項問題,導致資源分配不均,進一步擴大既有社會失衡現象。2012年Google的流感趨勢預測中,就曾犯下相同錯誤,嚴重高估年度流感比例,證明若依賴有瑕疵的海量資料,將大大影響公共服務與政策。

「開放政府」計畫將公部門資料張貼於網路上,如Data.gov或美國白宮「開放政府計畫」,也可能面臨相同問題,資料增加未必可改善透明度、責信等政府功能,必須搭配公眾參與機制,政府也得懂得如何詮釋資料,再運用適當資料因應。這些條件都不簡單,況且目前優秀的資料科學家也不足,各大學仍在趕緊劃定學科領域、編寫課程,希望能滿足需求。

人權團體也希望運用海量資料,瞭解各種衝突和危機,但資料與分析品質同樣令人存疑,麥克阿瑟基金會最近核准17.5萬美元的獎助金,由卡內基梅隆大學人權科學中心投入為期18個月的研究,分析海量資料數據如何改變人權運動發展,例如開發「可信度測驗」,以驗證張貼於Crisis MappersUshahidi、Facebook、YouTube等網站的人權侵害控訴真偽。該中心主任Jay D. Aronson指出,「包括學界及人權組織的消息來源,以及資料使用情況,都產生嚴重問題,有了這些新科技之後,對於通報者的人身安全是利或弊,許多時候仍不得而知」。

「海量資料對各個社會族群一視同仁。」

未必如此。海量資料號稱客觀,因為原始資料似乎能排除社會偏見,故可減少歧視少數族群的機率,讓大規模分析避免族群歧視,但海量資料之所以存在,就是為了將個人劃入族群之中,再解釋各族群行為有何異同。例如近期一篇論文才提到,在海量資料基因體研究內,科學家如何讓個人立場左右研究方向。

-----廣告,請繼續往下閱讀-----

如Alistair Croll所言,人們可能運用海量資料製造價格歧視,引起眾多公民權疑慮,在「個人化」名義下,海量資料卻可能用來針對特定社會族群,給予不一樣的待遇,法律通常禁止企業與個人出現此種歧視行為。企業購買網路廣告宣傳信用卡時,可能依據家戶所得或信貸紀錄,挑選特定目標群眾,導致他人完全無從得知該項優惠。Google甚至握有浮動設定內容價格的專利,例如你過往消費紀錄若顯示,可能花高價購買鞋子,下回在網路上打算買鞋時,搜尋結果也將傾向高價品。雇主如今也希望在人力資源方面運用海量資料,完全透過分析電腦使用習慣,評估如何提高員工生產力,而員工可能對這些資料與用途毫不知情。

其他因素也可能產生歧視,例如《紐約時報》曾報導,量販店Target多年前便已開始收集消費者分析數據,如今消費紀錄相當龐大,在某些情況下,甚至可單純根據消費品項歴史,判斷該名女性顧客是否懷孕,可靠度甚至高達87%。儘管該公司代表在報導內強調,這些資料是用來改善對準媽媽的行銷策略,可是這種手段很容易用於歧視,大大影響社會平等與隱私。

英國劍橋大學最近發表一項海量資料研究,運用58000則Facebook網站的按讚紀錄,預測用戶相當敏感的個人資訊,例如性傾向、族裔、宗教與政治立場、個性、智商、幸福程度、菸毒習慣、父母婚姻狀況、年齡、性別等,記者Tom Foremski指出,「取得如此敏感的資訊後,可能遭雇主、房東、政府機關、教育機構、民間組織利用,刻意歧視與懲罰個人,且對方完全無法抵抗」。

海量資料也會影響執法,無論是華府德拉瓦州的新堡郡,警方都開始採用海量資料「預防巡邏」模型,希望有助調查懸案,甚至避免犯罪發生,可是若將警力集中在海量資料判斷出的潛在犯罪熱點,卻可能強化某些社會族群的污名,認為他們較可能犯案,也等於將區域警力落差視為常態。一名警官曾表示,雖然預防巡邏演算式刻意避免種族、性別等分類,但若隨意使用這些系統,又未察覺差別待遇可能造成的後果,將會造成「警察與社區關係惡化,欠缺程序正義、遭指控種族歧視,也威脅執法基礎」。

-----廣告,請繼續往下閱讀-----

「海量資料屬匿名,不會侵犯隱私。」

大錯特錯。許多海量資料供應者都盡其所能,希望避免個人身分曝光,但風險卻仍存在,大量手機資料或許看似匿名,但近期研究歐洲150萬手機用戶資料顯示,只要四點參考點,即可辨識95%的民眾。研究人員提到,人們往來城市路徑有其獨特性,又能以大量公開資料組推論,讓隱私「疑慮愈來愈強烈」。拜Alessandro Acquisti等學者之賜,只要交叉分析公開資料,即可預測個人社會安全碼。

可是海量資料的隱私問題,不只是一般身分辨識風險,目前醫療資料轉售給分析公司後,可能用來追蹤個人身分,許多人都在討論個人化醫學,希望藥品及其他療程能夠針對個人需求,讓治療效果如同取自個人DNA。此舉可改善療效,但基本上得辨識人體分子和基因,假若使用不當或外流,可能造成高風險。儘管RunKeeperNike+等個人健康資料收集裝置迅速增加,尚無太多海量資料實際改善醫療服務的案例。

海量資料能源計畫亦收集各種私密資訊,智慧電力網即為一例,分析龐大消費者用電量資料後,希望改善住家與企業能源配送效能,雖然前景可期,隱私風險也很高,不僅可預測能源用量及需用時間,亦包括住戶在家中動向及行為的時刻資訊,例如何時洗澡、客人何時離開、何時關燈睡覺。

這些充滿個人資訊的海量資料,自然成為駭客及洩露情報者下手的目標,「維基解密」為近期釋出海量資料的知名案例,此外,英國境外金融產業資料最近也大量曝光,顯見人們不論貧富,個人資料都可能公諸於世

-----廣告,請繼續往下閱讀-----

「海量資料是科學的未來。」

部分屬實,但仍在持續發展。海量資料確實提供科學發展的新方向,例如在發現希格斯玻子的過程中,歐洲核子研究組織CERN即運用Hadoop分散式檔案系統管理資料,可是除非我們正視及處理海量資料反映人類生活的缺陷,就可能依據錯誤假設做出重大公共政策及企業決定。

為處理此事,資料科學家開始與社會科學家合作,因為後者處理資料的經驗相當豐富,包括評估來源、資料收集方式、使用倫理等,發掘結合海量資料策略與少量資料研究的新方式,不只是需要焦點團體、A/B測試等廣告行銷策略。新混成方式能思考行為背後的成因,而不只是計算事物發生頻率,故除了資訊檢索與機器學習,也需要社會學分析及民族誌學見解。

科技公司很早就明白,社會科學家能協助解釋消費者與產品互動的方式,例如PARC就曾聘請知名人類學家Lucy Suchman,資訊工程、統計、社會科學等領域未來將更密切合作,不僅是為測試彼此研究所得,也要以更嚴謹的態度提出各種問題。

每天各方都收集關於你我的大量資料,包括Facebook點擊習慣、衛星定位資料、醫療處方、Netflix影片觀賞紀錄等,我們必須盡早決定可託付資料的對象及用途。資料永遠不可能中立,也很難匿名,但我們可運用各項專業領域,以察覺種種偏見、落差與假設,進而面對有關隱私及公平性的新挑戰。

-----廣告,請繼續往下閱讀-----

 

本文原發表於譯者部落格「我書

-----廣告,請繼續往下閱讀-----
文章難易度
活躍星系核_96
778 篇文章 ・ 127 位粉絲
活躍星系核(active galactic nucleus, AGN)是一類中央核區活動性很強的河外星系。這些星系比普通星系活躍,在從無線電波到伽瑪射線的全波段裡都發出很強的電磁輻射。 本帳號發表來自各方的投稿。附有資料出處的科學好文,都歡迎你來投稿喔。 Email: contact@pansci.asia

0

1
0

文字

分享

0
1
0
人與 AI 的關係是什麼?走進「2024 未來媒體藝術節」,透過藝術創作尋找解答
鳥苷三磷酸 (PanSci Promo)_96
・2024/10/24 ・3176字 ・閱讀時間約 6 分鐘

本文與財團法人臺灣生活美學基金會合作。 

AI 有可能造成人們失業嗎?還是 AI 會成為個人專屬的超級助理?

隨著人工智慧技術的快速發展,AI 與人類之間的關係,成為社會大眾目前最熱烈討論的話題之一,究竟,AI 會成為人類的取代者或是協作者?決定關鍵就在於人們對 AI 的了解和運用能力,唯有人們清楚了解如何使用 AI,才能化 AI 為助力,提高自身的工作效率與生活品質。

有鑑於此,目前正於臺灣當代文化實驗場 C-LAB 展出的「2024 未來媒體藝術節」,特別將展覽主題定調為奇異點(Singularity),透過多重視角探討人工智慧與人類的共生關係。

-----廣告,請繼續往下閱讀-----

C-LAB 策展人吳達坤進一步說明,本次展覽規劃了 4 大章節,共集結來自 9 個國家 23 組藝術家團隊的 26 件作品,帶領觀眾從了解 AI 發展歷史開始,到欣賞各種結合科技的藝術創作,再到與藝術一同探索 AI 未來發展,希望觀眾能從中感受科技如何重塑藝術的創造範式,進而更清楚未來該如何與科技共生與共創。

從歷史看未來:AI 技術發展的 3 個高峰

其中,展覽第一章「流動的錨點」邀請了自牧文化 2 名研究者李佳霖和蔡侑霖,從軟體與演算法發展、硬體發展與世界史、文化與藝術三條軸線,平行梳理 AI 技術發展過程。

圖一、1956 年達特茅斯會議提出「人工智慧」一詞

藉由李佳霖和蔡侑霖長達近半年的調查研究,觀眾對 AI 發展有了清楚的輪廓。自 1956 年達特茅斯會議提出「人工智慧(Artificial Intelligence))」一詞,並明確定出 AI 的任務,例如:自然語言處理、神經網路、計算學理論、隨機性與創造性等,就開啟了全球 AI 研究浪潮,至今將近 70 年的過程間,共迎來三波發展高峰。

第一波技術爆發期確立了自然語言與機器語言的轉換機制,科學家將任務文字化、建立推理規則,再換成機器語言讓機器執行,然而受到演算法及硬體資源限制,使得 AI 只能解決小問題,也因此進入了第一次發展寒冬。

-----廣告,請繼續往下閱讀-----
圖二、1957-1970 年迎來 AI 第一次爆發

之後隨著專家系統的興起,讓 AI 突破技術瓶頸,進入第二次發展高峰期。專家系統是由邏輯推理系統、資料庫、操作介面三者共載而成,由於部份應用領域的邏輯推理方式是相似的,因此只要搭載不同資料庫,就能解決各種問題,克服過去規則設定無窮盡的挑戰。此外,機器學習、類神經網路等技術也在同一時期誕生,雖然是 AI 技術上的一大創新突破,但最終同樣受到硬體限制、技術成熟度等因素影響,導致 AI 再次進入發展寒冬。

走出第二次寒冬的關鍵在於,IBM 超級電腦深藍(Deep Blue)戰勝了西洋棋世界冠軍 Garry Kasparov,加上美國學者 Geoffrey Hinton 推出了新的類神經網路算法,並使用 GPU 進行模型訓練,不只奠定了 NVIDIA 在 AI 中的地位, 自此之後的 AI 研究也大多聚焦在類神經網路上,不斷的追求創新和突破。

圖三、1980 年專家系統的興起,進入第二次高峰

從現在看未來:AI 不僅是工具,也是創作者

隨著時間軸繼續向前推進,如今的 AI 技術不僅深植於類神經網路應用中,更在藝術、創意和日常生活中發揮重要作用,而「2024 未來媒體藝術節」第二章「創造力的轉變」及第三章「創作者的洞見」,便邀請各國藝術家展出運用 AI 與科技的作品。

圖四、2010 年發展至今,高性能電腦與大數據助力讓 AI 技術應用更強

例如,超現代映畫展出的作品《無限共作 3.0》,乃是由來自創意科技、建築師、動畫與互動媒體等不同領域的藝術家,運用 AI 和新科技共同創作的作品。「人們來到此展區,就像走進一間新科技的實驗室,」吳達坤形容,觀眾在此不僅是被動的觀察者,更是主動的參與者,可以親身感受創作方式的轉移,以及 AI 如何幫助藝術家創作。

-----廣告,請繼續往下閱讀-----
圖五、「2024 未來媒體藝術節——奇異點」展出現場,圖為超現代映畫的作品《無限共作3.0》。圖/C-LAB 提供

而第四章「未完的篇章」則邀請觀眾一起思考未來與 AI 共生的方式。臺灣新媒體創作團隊貳進 2ENTER 展出的作品《虛擬尋根-臺灣》,將 AI 人物化,採用與 AI 對話記錄的方法,探討網路發展的歷史和哲學,並專注於臺灣和全球兩個場景。又如國際非營利創作組織戰略技術展出的作品《無時無刻,無所不在》,則是一套協助青少年數位排毒、數位識毒的方法論,使其更清楚在面對網路資訊時,該如何識別何者為真何者為假,更自信地穿梭在數位世界裡。

透過歷史解析引起共鳴

在「2024 未來媒體藝術節」規劃的 4 大章節裡,第一章回顧 AI 發展史的內容設計,可說是臺灣近年來科技或 AI 相關展覽的一大創舉。

過去,這些展覽多半以藝術家的創作為展出重點,很少看到結合 AI 發展歷程、大眾文明演變及流行文化三大領域的展出內容,但李佳霖和蔡侑霖從大量資料中篩選出重點內容並儘可能完整呈現,讓「2024 未來媒體藝術節」觀眾可以清楚 AI 技術於不同階段的演進變化,及各發展階段背後的全球政治經濟與文化狀態,才能在接下來欣賞展區其他藝術創作時有更多共鳴。

圖六、「2024 未來媒體藝術節——奇異點」分成四個章節探究 AI 人工智慧時代的演變與社會議題,圖為第一章「流動的錨點」由自牧文化整理 AI 發展歷程的年表。圖/C-LAB 提供

「畢竟展區空間有限,而科技發展史的資訊量又很龐大,在評估哪些事件適合放入展區時,我們常常在心中上演拉鋸戰,」李佳霖笑著分享進行史料研究時的心路歷程。除了從技術的重要性及代表性去評估應該呈現哪些事件,還要兼顧詞條不能太長、資料量不能太多、確保內容正確性及讓觀眾有感等原則,「不過,歷史事件與展覽主題的關聯性,還是最主要的決定因素,」蔡侑霖補充指出。

-----廣告,請繼續往下閱讀-----

舉例來說,Google 旗下人工智慧實驗室(DeepMind)開發出的 AI 軟體「AlphaFold」,可以準確預測蛋白質的 3D 立體結構,解決科學家長達 50 年都無法突破的難題,雖然是製藥或疾病學領域相當大的技術突破,但因為與本次展覽主題的關聯性較低,故最終沒有列入此次展出內容中。

除了內容篩選外,在呈現方式上,2位研究者也儘量使用淺顯易懂的方式來呈現某些較為深奧難懂的技術內容,蔡侑霖舉例說明,像某些比較艱深的 AI 概念,便改以視覺化的方式來呈現,為此上網搜尋很多與 AI 相關的影片或圖解內容,從中找尋靈感,最後製作成簡單易懂的動畫,希望幫助觀眾輕鬆快速的理解新科技。

吳達坤最後指出,「2024 未來媒體藝術節」除了展出藝術創作,也跟上國際展會發展趨勢,於展覽期間規劃共 10 幾場不同形式的活動,包括藝術家座談、講座、工作坊及專家導覽,例如:由策展人與專家進行現場導覽、邀請臺灣 AI 實驗室創辦人杜奕瑾以「人工智慧與未來藝術」為題舉辦講座,希望透過帶狀活動創造更多話題,也讓展覽效益不斷發酵,讓更多觀眾都能前來體驗由 AI 驅動的未來創新世界,展望 AI 在藝術與生活中的無限潛力。

展覽資訊:「未來媒體藝術節——奇異點」2024 Future Media FEST-Singularity 
展期 ▎2024.10.04 ( Fri. ) – 12.15 ( Sun. ) 週二至週日12:00-19:00,週一休館
地點 ▎臺灣當代文化實驗場圖書館展演空間、北草坪、聯合餐廳展演空間、通信分隊展演空間
指導單位 ▎文化部
主辦單位 ▎臺灣當代文化實驗場

-----廣告,請繼續往下閱讀-----
文章難易度

討論功能關閉中。

0

0
0

文字

分享

0
0
0
從認證到實踐:以智慧綠建築三大標章邁向淨零
鳥苷三磷酸 (PanSci Promo)_96
・2024/11/15 ・4487字 ・閱讀時間約 9 分鐘

本文由 建研所 委託,泛科學企劃執行。 


當你走進一棟建築,是否能感受到它對環境的友善?或許不是每個人都意識到,但現今建築不只提供我們居住和工作的空間,更是肩負著重要的永續節能責任。

綠建築標準的誕生,正是為了應對全球氣候變遷與資源匱乏問題,確保建築設計能夠減少資源浪費、降低污染,同時提升我們的生活品質。然而,要成為綠建築並非易事,每一棟建築都需要通過層層關卡,才能獲得標章認證。

為推動環保永續的建築環境,政府自 1999 年起便陸續著手推動「綠建築標章」、「智慧建築標章」以及「綠建材標章」的相關政策。這些標章的設立,旨在透過標準化的建築評估系統,鼓勵建築設計融入生態友善、能源高效及健康安全的原則。並且政府在政策推動時,為鼓勵業界在規劃設計階段即導入綠建築手法,自 2003 年特別辦理優良綠建築作品評選活動。截至 2024 年為止,已有 130 件優良綠建築、31 件優良智慧建築得獎作品,涵蓋學校、醫療機構、公共住宅等各類型建築,不僅提升建築物的整體性能,也彰顯了政府對綠色、智慧建築的重視。

-----廣告,請繼續往下閱讀-----

說這麼多,你可能還不明白建築要變「綠」、變「聰明」的過程,要經歷哪些標準與挑戰?

綠建築標章智慧建築標章綠建材標章
來源:內政部建築研究所

第一招:依循 EEWH 標準,打造綠建築典範

環境友善和高效率運用資源,是綠建築(green building)的核心理念,但這樣的概念不僅限於外觀或用材這麼簡單,而是涵蓋建築物的整個生命週期,也就是包括規劃、設計、施工、營運和維護階段在內,都要貼合綠建築的價值。

關於綠建築的標準,讓我們先回到 1990 年,當時英國建築研究機構(BRE)首次發布有關「建築研究發展環境評估工具(Building Research Establishment Environmental Assessment Method,BREEAM®)」,是世界上第一個建築永續評估方法。美國則在綠建築委員會成立後,於 1998 年推出「能源與環境設計領導認證」(Leadership in Energy and Environmental Design, LEED)這套評估系統,加速推動了全球綠建築行動。

臺灣在綠建築的制訂上不落人後。由於臺灣地處亞熱帶,氣溫高,濕度也高,得要有一套我們自己的評分規則——臺灣綠建築評估系統「EEWH」應運而生,四個英文字母分別為 Ecology(生態)、Energy saving(節能)、Waste reduction(減廢)以及 Health(健康),分成「合格、銅、銀、黃金和鑽石」共五個等級,設有九大評估指標。

-----廣告,請繼續往下閱讀-----

我們就以「台江國家公園」為例,看它如何躍過一道道指標,成為「鑽石級」綠建築的國家公園!

位於臺南市四草大橋旁的「台江國家公園」是臺灣第8座國家公園,也是臺灣唯一的濕地型的國家公園。同時,還是南部行政機關第一座鑽石級的綠建築,其外觀採白色系列,從高空俯瞰,就像在一座小島上座落了許多白色建築群的聚落;從地面看則有臺南鹽山的意象。

因其地形與地理位置的特殊,生物多樣性的保護則成了台江國家公園的首要考量。園區利用既有的魚塭結構,設計自然護岸,保留基地既有的雜木林和灌木草原,並種植原生與誘鳥誘蟲等多樣性植物,採用複層雜生混種綠化。以石籠作為擋土護坡與卵石回填增加了多孔隙,不僅強化了環境的保護力,也提供多樣的生物棲息環境,使這裡成為動植物共生的美好棲地。

台江國家公園是南部行政機關第一座鑽石級的綠建築。圖/內政部建築研究所

第二招:想成綠建築,必用綠建材

要成為一幢優秀好棒棒的綠建築,使用在原料取得、產品製造、應用過程和使用後的再生利用循環中,對地球環境負荷最小、對人類身體健康無害的「綠建材」非常重要。

-----廣告,請繼續往下閱讀-----

這種建材最早是在 1988 年國際材料科學研究會上被提出,一路到今日,國際間對此一概念的共識主要包括再使用(reuse)、再循環(recycle)、廢棄物減量(reduce)和低污染(low emission materials)等特性,從而減少化學合成材料產生的生態負荷和能源消耗。同時,使用自然材料與低 VOC(Volatile Organic Compounds,揮發性有機化合物)建材,亦可避免對人體產生危害。

在綠建築標章後,內政部建築研究所也於 2004 年 7 月正式推行綠建材標章制度,以建材生命週期為主軸,提出「健康、生態、高性能、再生」四大方向。舉例來說,為確保室內環境品質,建材必須符合低逸散、低污染、低臭氣等條件;為了防溫室效應的影響,須使用本土材料以節省資源和能源;使用高性能與再生建材,不僅要經久耐用、具高度隔熱和防音等特性,也強調材料本身的再利用性。


在台江國家公園內,綠建材的應用是其獲得 EEWH 認證的重要部分。其不僅在設計結構上體現了生態理念,更在材料選擇上延續了對環境的關懷。園區步道以當地的蚵殼磚鋪設,並利用蚵殼作為建築格柵的填充材料,為鳥類和小生物營造棲息空間,讓「蚵殼磚」不再只是建材,而是與自然共生的橋樑。園區的內部裝修選用礦纖維天花板、矽酸鈣板、企口鋁板等符合綠建材標準的系統天花。牆面則粉刷乳膠漆,整體綠建材使用率為 52.8%。

被建築實體圍塑出的中庭廣場,牆面設計有蚵殼格柵。圖/內政部建築研究所

在日常節能方面,台江國家公園也做了相當細緻的設計。例如,引入樓板下的水面蒸散低溫外氣,屋頂下設置通風空氣層,高處設置排風窗讓熱空氣迅速排出,廊道還配備自動控制的微噴霧系統來降溫。屋頂採用蚵殼與漂流木創造生態棲地,創造空氣層及通風窗引入水面低溫外企,如此一來就能改善事內外氣溫及熱空氣的通風對流,不僅提升了隔熱效果,減少空調需求,讓建築如同「與海共舞」,在減廢與健康方面皆表現優異,展示出綠建築在地化的無限可能。

-----廣告,請繼續往下閱讀-----
島式建築群分割後所形成的巷道與水道。圖/內政部建築研究所

在綠建材的部分,另外補充獲選為 2023 年優良綠建築的臺南市立九份子國民中小學新建工程,其採用生產過程中二氧化碳排放量較低的建材,比方提高高爐水泥(具高強度、耐久、緻密等特性,重點是發熱量低)的量,並使用能提高混凝土晚期抗壓性、降低混凝土成本與建物碳足跡的「爐石粉」,還用再生透水磚做人行道鋪面。

2023 年優良綠建築的臺南市立九份子國民中小學。圖/內政部建築研究所
2023 年優良綠建築的臺南市立九份子國民中小學。圖/內政部建築研究所

同樣入選 2023 年綠建築的還有雲林豐泰文教基金會的綠園區,首先,他們捨棄金屬建材,讓高爐水泥使用率達 100%。別具心意的是,他們也將施工開挖的土方做回填,將有高地差的荒地恢復成平坦綠地,本來還有點「工業風」的房舍告別荒蕪,無痛轉綠。

雲林豐泰文教基金會的綠園區。圖/內政部建築研究所

等等,這樣看來建築夠不夠綠的命運,似乎在建材選擇跟設計環節就決定了,是這樣嗎?當然不是,建築是活的,需要持續管理–有智慧的管理。

第三招:智慧管理與科技應用

我們對生態的友善性與資源運用的效率,除了從建築設計與建材的使用等角度介入,也須適度融入「智慧建築」(intelligent buildings)的概念,即運用資通訊科技來提升建築物效能、舒適度與安全性,使空間更人性化。像是透過建築物佈建感測器,用於蒐集環境資料和使用行為,並作為空調、照明等設備、設施運轉操作之重要參考。

-----廣告,請繼續往下閱讀-----

為了推動建築與資通訊產業的整合,內政部建築研究所於 2004 年建立了「智慧建築標章」制度,為消費者提供判斷建築物是否善用資通訊感知技術的標準。評估指標經多次修訂,目前是以「基礎設施、維運管理、安全防災、節能管理、健康舒適、智慧創新」等六大項指標作為評估基準。
以節能管理指標為例,為了掌握建築物生命週期中的能耗,需透過系統設備和技術的主動控制來達成低耗與節能的目標,評估重點包含設備效率、節能技術和能源管理三大面向。在健康舒適方面,則在空間整體環境、光環境、溫熱環境、空氣品質、水資源等物理環境,以及健康管理系統和便利服務上進行評估。

樹林藝文綜合大樓在設計與施工過程中,充分展現智慧建築應用綜合佈線、資訊通信、系統整合、設施管理、安全防災、節能管理、健康舒適及智慧創新 8 大指標先進技術,來達成兼顧環保和永續發展的理念,也是利用建築資訊模型(BIM)技術打造的指標性建築,受到國際矚目。

樹林藝文綜合大樓。圖/內政部建築研究所「111年優良智慧建築專輯」(新北市政府提供)

在興建階段,為了保留基地內 4 棵原有老樹,團隊透過測量儀器對老樹外觀進行精細掃描,並將大小等比例匯入 BIM 模型中,讓建築師能清晰掌握樹木與建築物之間的距離,確保施工過程不影響樹木健康。此外,在大樓啟用後,BIM 技術被運用於「電子維護管理系統」,透過 3D 建築資訊模型,提供大樓內設備位置及履歷資料的即時讀取。系統可進行設備的監測和維護,包括保養計畫、異常修繕及耗材管理,讓整棟大樓的全生命週期狀況都能得到妥善管理。

智慧建築導入 BIM 技術的應用,從建造設計擴展至施工和日常管理,使建築生命周期的管理更加智慧化。以 FM 系統 ( Facility Management,簡稱 FM ) 為例,該系統可在雲端進行遠端控制,根據會議室的使用時段靈活調節空調風門,會議期間開啟通往會議室的風門以加強換氣,而非使用時段則可根據二氧化碳濃度調整外氣空調箱的運轉頻率,保持低頻運作,實現節能效果。透過智慧管理提升了節能效益、建築物的維護效率和公共安全管理。

-----廣告,請繼續往下閱讀-----

總結

綠建築、綠建材與智慧建築這三大標章共同構建了邁向淨零碳排、居住健康和環境永續的基礎。綠建築標章強調設計與施工的生態友善與節能表現,從源頭減少碳足跡;綠建材標章則確保建材從生產到廢棄的全生命週期中對環境影響最小,並保障居民的健康;智慧建築標章運用科技應用,實現能源的高效管理和室內環境的精準調控,增強了居住的舒適性與安全性。這些標章的綜合應用,讓建築不僅是滿足基本居住需求,更成為實現淨零、促進健康和支持永續的具體實踐。

建築物於魚塭之上,採高腳屋的構造形式,尊重自然地貌。圖/內政部建築研究所

-----廣告,請繼續往下閱讀-----
文章難易度

討論功能關閉中。

1

3
0

文字

分享

1
3
0
數據塑造生活與社會,讓人既放心但又不安?——《 AI 世代與我們的未來》
聯經出版_96
・2022/12/28 ・2760字 ・閱讀時間約 5 分鐘

數位世界已經改變了我們日常生活的體驗,一個人從早到晚都會接受到大量數據,受益於大量數據,也貢獻大量數據。這些數據龐大的程度,和消化資訊的方式已經太過繁多,人類心智根本無法處理。

與數位科技建立夥伴關係

所以人會本能地或潛意識地倚賴軟體來處理、組織、篩選出必要或有用的資訊,也就是根據用戶過去的偏好或目前的流行,來挑選要瀏覽的新項目、要看的電影、要播放的音樂。自動策劃的體驗很輕鬆容易,又能讓人滿足,人們只會在沒有自動化服務,例如閱讀別人臉書塗鴉牆上的貼文,或是用別人的網飛帳號看電影時,才會注意到這服務的存在。

有人工智慧協助的網路平臺加速整合,並加深了個人與數位科技間的連結。人工智慧經過設計和訓練,能直覺地解決人類的問題、掌握人類的目標,原本只有人類心智才能管理的各種選擇,現在能由網路平臺來引導、詮釋和記錄(儘管效率比較差)。

日常生活中很少察覺到對自動策劃的依賴。圖/Pexels

網路平臺收集資訊和體驗來完成這些任務,任何一個人的大腦在壽命期限內都不可能容納如此大量的資訊和體驗,所以網路平臺能產出看起來非常恰當的答案和建議。例如,採購員不管再怎麼投入工作,在挑選冬季長靴的時候,也不可能從全國成千上萬的類似商品、近期天氣預測、季節因素、回顧過去的搜尋記錄、調查物流模式之後,才決定最佳的採購項目,但人工智慧可以完整評估上述所有因素。

-----廣告,請繼續往下閱讀-----

因此,由人工智慧驅動的網路平臺經常和我們每個人互動,但我們在歷史上從未和其他產品、服務或機器這樣互動過。當我們個人在和人工智慧互動的時候,人工智慧會適應個人用戶的偏好(網際網路瀏覽記錄、搜尋記錄、旅遊史、收入水準、社交連結),開始形成一種隱形的夥伴關係。

個人用戶逐漸依賴這樣的平臺來完成一串功能,但這些功能過去可能由郵政、百貨公司,或是接待禮賓、懺悔自白的人和朋友,或是企業、政府或其他人類一起來完成。

網路平臺和用戶之間是既親密又遠距的聯繫。圖/Envato Elements

個人、網路平臺和平臺用戶之間的關係,是一種親密關係與遠距聯繫的新穎組合。人工智慧網路平臺審查大量的用戶數據,其中大部分是個人數據(如位置、聯絡資訊、朋友圈、同事圈、金融與健康資訊);網路會把人工智慧當成嚮導,或讓人工智慧來安排個人化體驗。

人工智慧如此精準、正確,是因為人工智慧有能力可以根據數億段類似的關係,以及上兆次空間(用戶群的地理範圍)與時間(集合了過去的使用)的互動來回顧和反應。網路平臺用戶與人工智慧形成了緊密的互動,並互相學習。

-----廣告,請繼續往下閱讀-----

網路平臺的人工智慧使用邏輯,在很多方面對人類來說都難以理解。例如,運用人工智慧的網路平臺在評估圖片、貼文或搜尋時,人類可能無法明確地理解人工智慧會在特定情境下如何運作。谷歌的工程師知道他們的搜尋功能若有人工智慧,就會有清楚的搜尋結果;若沒有人工智慧,搜尋結果就不會那麼清楚,但工程師沒辦法解釋為什麼某些結果的排序比較高。

要評鑑人工智慧的優劣,看的是結果實用不實用,不是看過程。這代表我們的輕重緩急已經和早期不一樣了,以前每個機械的步驟或思考的過程都會由人類來體驗(想法、對話、管理流程),或讓人類可以暫停、檢查、重複。

人工智慧陪伴現代人的生活

例如,在許多工業化地區,旅行的過程已經不需要「找方向」了。以前這過程需要人力,要先打電話給我們要拜訪的對象,查看紙本地圖,然後常常在加油站或便利商店停下來,確認我們的方向對不對。現在,透過手機應用程式,旅行的過程可以更有效率。

透過導航,為旅途帶來不少便利。圖/Pexels

這些應用程式不但可以根據他們「所知」的交通記錄來評估可能的路線與每條路線所花費的時間,還可以考量到當天的交通事故、可能造成延誤的特殊狀況(駕駛過程中的延誤)和其他跡象(其他用戶的搜尋),來避免和別人走同一條路。

-----廣告,請繼續往下閱讀-----

從看地圖到線上導航,這轉變如此方便,很少人會停下來想想這種變化有多大的革命性意義,又會帶來什麼後果。個人用戶、社會與網路平臺和營運商建立了新關係,並信任網路平臺與演算法可以產生準確的結果,獲得了便利,成為數據集的一部分,而這數據集又在持續進化(至少會在大家使用應用程式的時候追蹤個人的位置)。

在某種意義上,使用這種服務的人並不是獨自駕駛,而是系統的一部分。在系統內,人類和機器智慧一起協作,引導一群人透過各自的路線聚集在一起。

持續陪伴型的人工智慧會愈來愈普及,醫療保健、物流、零售、金融、通訊、媒體、運輸和娛樂等產業持續發展,我們的日常生活體驗透過網路平臺一直在變化。

網路平台協助我們完成各種事項。圖/Pexels

當用戶找人工智慧網路平臺來協助他們完成任務的時候,因為網路平臺可以收集、提煉資訊,所以用戶得到了益處,上個世代完全沒有這種經驗。這種平臺追求新穎模式的規模、力量、功能,讓個人用戶獲得前所未有的便利和能力;同時,這些用戶進入一種前所未有的人機對話中。

-----廣告,請繼續往下閱讀-----

運用人工智慧的網路平臺有能力可以用我們無法清楚理解,甚至無法明確定義或表示的方式來形塑人類的活動,這裡有一個很重要的問題:這種人工智慧的目標功能是什麼?由誰設計?在哪些監管參數範圍裡?

類似問題的答案會繼續塑造未來的生活與未來的社會:誰在操作?誰在定義這些流程的限制?這些人對於社會規範和制度會有什麼影響?有人可以存取人工智慧的感知嗎?有的話,這人是誰?

如果沒有人類可以完全理解或查看數據,或檢視每個步驟,也就是說假設人類的角色只負責設計、監控和設定人工智慧的參數,那麼對人工智慧的限制應該要讓我們放心?還是讓我們不安?還是既放心又不安?

——本文摘自《 AI 世代與我們的未來:人工智慧如何改變生活,甚至是世界?》,2022 年 12 月,聯經出版公司,未經同意請勿轉載。

-----廣告,請繼續往下閱讀-----
-----廣告,請繼續往下閱讀-----
所有討論 1
聯經出版_96
27 篇文章 ・ 20 位粉絲
聯經出版公司創立於1974年5月4日,是一個綜合性的出版公司,為聯合報系關係企業之一。 三十多年來已經累積了近六千餘種圖書, 範圍包括人文、社會科學、科技以及小說、藝術、傳記、商業、工具書、保健、旅遊、兒童讀物等。

0

0
0

文字

分享

0
0
0
海量資料萬歲?請三思!
活躍星系核_96
・2013/05/25 ・4971字 ・閱讀時間約 10 分鐘 ・SR值 616 ・十年級

-----廣告,請繼續往下閱讀-----

本文出處:Think Again: Big Data
作者:KATE CRAWFORD
譯者:Leonard Chien

圖片取自 https://team.inria.fr/zenith/ibc-seminar-patrick-valduriez-parallel-techniques-for-big-data-march-22-2pm/

「海量資料」是當今最流行的用語,也是科技界對世上各種棘手難題的萬用解答,意指藉由分析龐大資訊後,歸納出模式、精闢見解,並預測複雜問題的答案,聽來或許有些無趣,但無論是阻止恐怖份子終結貧窮拯救地球,海量資料支持者都深信可迎刃而解。

在《Big Data: A Revolution That Will Transform How We Live, Work, and Think》一書中,兩位作者寫道,「對於氣候變遷、根除疾病、促進良好治理與經濟發展等全球迫切問題,海量資料均可提供部分答案,為社會提供眾多好處」。

-----廣告,請繼續往下閱讀-----

只要握有足夠數據,例如iPhone內部資料、雜貨店購物內容、網路交友檔案、全國匿名醫療紀錄,電腦運算即可拆解這些原始資料,從中挖掘出無數見解。美國歐巴馬政府亦傾力投入,於5月9日「首開先例」,公開「過往無法取用或管理的資料」,供企業家、研究人員及大眾使用。

歐巴馬總統表示,「我們希望促成更多民間創新與發現,因此史上首次釋出大量美國資料,開放人們輕鬆取用,優秀企業家也已開發出眾多用途」。

可是海量資料的威力是否名實相符?在龐大電腦數據裡,是否真能揭露人類行為的秘密?《外交政策》雜誌邀請麻省理工學院「公民媒體中心」成員Kate Crawford,說明數字背後的真相。-編按

「只要資料足夠,數字自會說話。」

不可能。海量資料支持者希望我們相信,在程式碼字裡行間與巨大資料庫內,必有客觀及通用的見解,能解釋人類行為模式,包括消費情況、犯罪或恐怖主義行動、健康習慣、員工產能等,但他們卻總不願正視缺點。數字不會說話,資料不論規模大小,仍受人類設計限制,Apache Hadoop軟體架構等海量資料工具亦無法排除偏斜、落差與假設錯誤。當海量資料試圖歸納社會狀態,這些因素影響格外顯著,但我們卻常誤以為分析結果比個人意見更客觀。其實海量資料、個人觀感及體驗皆然,充滿偏見及盲點,可是許多人卻以為資料量越大就代表品質越好的資料,也以為「相關」與「因果」一樣好。

-----廣告,請繼續往下閱讀-----

例如社群媒體常成為海量資料分析主題,其中也確實充斥大量資訊,據稱從Twitter資料裡可見,人們離家愈遠愈開心,且情緒在每週四晚上最低落。可是我們必須懂得質疑資料背後真正的涵義,例如「皮猶研究中心」指出,美國只有16%的成年網路用戶使用Twitter,亦無法如實代表社會結構,通常年紀較輕、較集中於都會區。此外,許多Twitter帳號均為自動機器人或假檔案,近期估計總數可能高達2000萬,因此討論如何從Twitter分析輿論之前,得先釐清這些反應究竟來自真人或電腦演算式。

縱然各位相信絕大多數Twitter用戶均為真人,偏見依然存在,例如為分析2013年澳洲網球公開賽中,人們在社群媒體對哪些選手「看法最佳」,IBM透過「社會觀感指數」,大量分析Twitter訊息,結果由Victoria Azarenka奪冠,但許多訊息提到她時,都在批評濫用傷停時間,如此看來,很難相信IBM的演算式確能反映現實。

即便排除不良資料問題,演算式本身亦有偏見,新聞彙整網站取用你我的個人偏好與瀏覽紀錄,編排出用戶感興趣的最新消息,其中假設頻率與重要性呈正比,或個人社群最常分享的資訊,也必定與你興趣相符。演算式過濾龐大資料時,也訂定呈現世界的原則,一般用戶不會感受到這些規則,可是大大左右民眾觀點。

不少資訊工程專家正在努力解除疑慮,Ed Felten為普林斯頓大學教授,曾為美國聯邦貿易委員會首席科技專家,最近發起一項計畫,測驗各項演算式的偏見,尤其是美國政府也運用演算式評估個人,例如聯邦調查局與運輸安全局即彙整多項官方海量資料,列出航空旅客黑名單,做為飛安制度之用。

-----廣告,請繼續往下閱讀-----

「海量資料可提高城市智慧及效能。」

仍有上限。海量資料可提供珍貴見解,協助改善城市,但也僅止於此,由於資料生成與收集過程並不均等,其中會出現「信號問題」,造成有些民眾及社區遭到漠視或代表性不足,若以海量資料處理城市規劃問題,必須仰賴官員同時瞭解資料及其侷限。

例如美國波士頓的Street Bump應用程式裡,收集行經坑洞的駕駛人智慧型手機資料,能以低成本途徑收集資訊,類似應用程式也與日俱增,可是城市若完全依賴智慧型手機用戶提供資料,等於自動排除部分樣本,某些社區內智慧型手機用戶比例若較低,通常年齡層較高,經濟條件也較弱勢,因此遭到排擠。波士頓市政單位盡力想彌補潛在資料缺口,但假若官員對此警覺性較低,就可能忽略這項問題,導致資源分配不均,進一步擴大既有社會失衡現象。2012年Google的流感趨勢預測中,就曾犯下相同錯誤,嚴重高估年度流感比例,證明若依賴有瑕疵的海量資料,將大大影響公共服務與政策。

「開放政府」計畫將公部門資料張貼於網路上,如Data.gov或美國白宮「開放政府計畫」,也可能面臨相同問題,資料增加未必可改善透明度、責信等政府功能,必須搭配公眾參與機制,政府也得懂得如何詮釋資料,再運用適當資料因應。這些條件都不簡單,況且目前優秀的資料科學家也不足,各大學仍在趕緊劃定學科領域、編寫課程,希望能滿足需求。

人權團體也希望運用海量資料,瞭解各種衝突和危機,但資料與分析品質同樣令人存疑,麥克阿瑟基金會最近核准17.5萬美元的獎助金,由卡內基梅隆大學人權科學中心投入為期18個月的研究,分析海量資料數據如何改變人權運動發展,例如開發「可信度測驗」,以驗證張貼於Crisis MappersUshahidi、Facebook、YouTube等網站的人權侵害控訴真偽。該中心主任Jay D. Aronson指出,「包括學界及人權組織的消息來源,以及資料使用情況,都產生嚴重問題,有了這些新科技之後,對於通報者的人身安全是利或弊,許多時候仍不得而知」。

-----廣告,請繼續往下閱讀-----

「海量資料對各個社會族群一視同仁。」

未必如此。海量資料號稱客觀,因為原始資料似乎能排除社會偏見,故可減少歧視少數族群的機率,讓大規模分析避免族群歧視,但海量資料之所以存在,就是為了將個人劃入族群之中,再解釋各族群行為有何異同。例如近期一篇論文才提到,在海量資料基因體研究內,科學家如何讓個人立場左右研究方向。

如Alistair Croll所言,人們可能運用海量資料製造價格歧視,引起眾多公民權疑慮,在「個人化」名義下,海量資料卻可能用來針對特定社會族群,給予不一樣的待遇,法律通常禁止企業與個人出現此種歧視行為。企業購買網路廣告宣傳信用卡時,可能依據家戶所得或信貸紀錄,挑選特定目標群眾,導致他人完全無從得知該項優惠。Google甚至握有浮動設定內容價格的專利,例如你過往消費紀錄若顯示,可能花高價購買鞋子,下回在網路上打算買鞋時,搜尋結果也將傾向高價品。雇主如今也希望在人力資源方面運用海量資料,完全透過分析電腦使用習慣,評估如何提高員工生產力,而員工可能對這些資料與用途毫不知情。

其他因素也可能產生歧視,例如《紐約時報》曾報導,量販店Target多年前便已開始收集消費者分析數據,如今消費紀錄相當龐大,在某些情況下,甚至可單純根據消費品項歴史,判斷該名女性顧客是否懷孕,可靠度甚至高達87%。儘管該公司代表在報導內強調,這些資料是用來改善對準媽媽的行銷策略,可是這種手段很容易用於歧視,大大影響社會平等與隱私。

英國劍橋大學最近發表一項海量資料研究,運用58000則Facebook網站的按讚紀錄,預測用戶相當敏感的個人資訊,例如性傾向、族裔、宗教與政治立場、個性、智商、幸福程度、菸毒習慣、父母婚姻狀況、年齡、性別等,記者Tom Foremski指出,「取得如此敏感的資訊後,可能遭雇主、房東、政府機關、教育機構、民間組織利用,刻意歧視與懲罰個人,且對方完全無法抵抗」。

-----廣告,請繼續往下閱讀-----

海量資料也會影響執法,無論是華府德拉瓦州的新堡郡,警方都開始採用海量資料「預防巡邏」模型,希望有助調查懸案,甚至避免犯罪發生,可是若將警力集中在海量資料判斷出的潛在犯罪熱點,卻可能強化某些社會族群的污名,認為他們較可能犯案,也等於將區域警力落差視為常態。一名警官曾表示,雖然預防巡邏演算式刻意避免種族、性別等分類,但若隨意使用這些系統,又未察覺差別待遇可能造成的後果,將會造成「警察與社區關係惡化,欠缺程序正義、遭指控種族歧視,也威脅執法基礎」。

「海量資料屬匿名,不會侵犯隱私。」

大錯特錯。許多海量資料供應者都盡其所能,希望避免個人身分曝光,但風險卻仍存在,大量手機資料或許看似匿名,但近期研究歐洲150萬手機用戶資料顯示,只要四點參考點,即可辨識95%的民眾。研究人員提到,人們往來城市路徑有其獨特性,又能以大量公開資料組推論,讓隱私「疑慮愈來愈強烈」。拜Alessandro Acquisti等學者之賜,只要交叉分析公開資料,即可預測個人社會安全碼。

可是海量資料的隱私問題,不只是一般身分辨識風險,目前醫療資料轉售給分析公司後,可能用來追蹤個人身分,許多人都在討論個人化醫學,希望藥品及其他療程能夠針對個人需求,讓治療效果如同取自個人DNA。此舉可改善療效,但基本上得辨識人體分子和基因,假若使用不當或外流,可能造成高風險。儘管RunKeeperNike+等個人健康資料收集裝置迅速增加,尚無太多海量資料實際改善醫療服務的案例。

海量資料能源計畫亦收集各種私密資訊,智慧電力網即為一例,分析龐大消費者用電量資料後,希望改善住家與企業能源配送效能,雖然前景可期,隱私風險也很高,不僅可預測能源用量及需用時間,亦包括住戶在家中動向及行為的時刻資訊,例如何時洗澡、客人何時離開、何時關燈睡覺。

-----廣告,請繼續往下閱讀-----

這些充滿個人資訊的海量資料,自然成為駭客及洩露情報者下手的目標,「維基解密」為近期釋出海量資料的知名案例,此外,英國境外金融產業資料最近也大量曝光,顯見人們不論貧富,個人資料都可能公諸於世

「海量資料是科學的未來。」

部分屬實,但仍在持續發展。海量資料確實提供科學發展的新方向,例如在發現希格斯玻子的過程中,歐洲核子研究組織CERN即運用Hadoop分散式檔案系統管理資料,可是除非我們正視及處理海量資料反映人類生活的缺陷,就可能依據錯誤假設做出重大公共政策及企業決定。

為處理此事,資料科學家開始與社會科學家合作,因為後者處理資料的經驗相當豐富,包括評估來源、資料收集方式、使用倫理等,發掘結合海量資料策略與少量資料研究的新方式,不只是需要焦點團體、A/B測試等廣告行銷策略。新混成方式能思考行為背後的成因,而不只是計算事物發生頻率,故除了資訊檢索與機器學習,也需要社會學分析及民族誌學見解。

科技公司很早就明白,社會科學家能協助解釋消費者與產品互動的方式,例如PARC就曾聘請知名人類學家Lucy Suchman,資訊工程、統計、社會科學等領域未來將更密切合作,不僅是為測試彼此研究所得,也要以更嚴謹的態度提出各種問題。

-----廣告,請繼續往下閱讀-----

每天各方都收集關於你我的大量資料,包括Facebook點擊習慣、衛星定位資料、醫療處方、Netflix影片觀賞紀錄等,我們必須盡早決定可託付資料的對象及用途。資料永遠不可能中立,也很難匿名,但我們可運用各項專業領域,以察覺種種偏見、落差與假設,進而面對有關隱私及公平性的新挑戰。

 

本文原發表於譯者部落格「我書

-----廣告,請繼續往下閱讀-----
文章難易度
活躍星系核_96
778 篇文章 ・ 127 位粉絲
活躍星系核(active galactic nucleus, AGN)是一類中央核區活動性很強的河外星系。這些星系比普通星系活躍,在從無線電波到伽瑪射線的全波段裡都發出很強的電磁輻射。 本帳號發表來自各方的投稿。附有資料出處的科學好文,都歡迎你來投稿喔。 Email: contact@pansci.asia