[政府資料應用] (巨量)資料分析研究成果發表會心得

今天參與了科技部和工研院的巨量資料成果發表會，那是一場很學術但時間不足的成果發表會，也曝露出：有資源、有關係拿到的資料更齊全的真實狀況。

同樣做空污與健康的研究，同樣是健保資料庫+開放的氣相資料+空污資料，元智大學有資本可以拿到更完整的資料，也因為他們本身是醫事相關學校、願意投入資源，再配合自己的資料庫，做出來的東西更容易令人印象深刻。另一個案子的成員(學生)在發表前在旁邊碎碎念，念人家拿完整的資料，他們得從零開始，還冒出一句值得深思的話：『他們(元智)也不可能分享出來。』

在學術研究的角度，當然不可能，但站在為人民的立場呢？如果是為了全國的健康呢？就像Theranos的創辦人Elizabeth Holmes將研究出來的技術都申請了專利，以商業立場來看是應該的，但能救人、改善醫療檢驗的技術申請專利似乎哪裡『不太清爽』。

Open Street Map的應用和國際案例都被提到了幾次。

另外在台灣的1999因為技術問題一直無法放出資料。在圖像辨識、文字探勘都提到共通問題－人工作業。為了避免法律責任、網站阻擋或是讓資料定位更準確，所以都會再透過人工再分類、定位。在期望的定義裡，可透過『人力』解決/清理/定義的資料都不能叫『巨量資料』。

最後一組是講犯罪資料，有三個子題。其中一個是常看到的犯罪地圖，在英美是透過報案資料來分析，中正大學直接和新北市府合作，結合司法院的開放資料同時直接取得獄政資料庫(校長曾有相關警政背景實在太方便了)，在『合法』、不違反個資法的前提下也做了一些犯罪行為的分析，這個資料很敏感，可能還分析家庭背景、精神疾病狀態。

不過，這些都讓我看到了：政府開放資料並不是同步的。除非部會機關願意，不然民間人士只能拿到垃圾資料，零散、破碎，還要耗費時間清理；但只要進行研究計畫，相關的人員就有『方法』可以拿更齊全的資料。

離開前，做犯罪行為研究的學生(剛好坐在附近)私底下問：『以後還拿得到獄政資料嗎？』看似老師的人回：『…繼續再配合的意願不高，再加上政局轉換……』老師搖搖頭。

今天發表的成果裡，都用了一些時間在講述進行研究前與法務人員確認相關的法律責任，但要講法律責任的話時間依然不足，而成果就只能摘要式的報告了。

最後，對於資料內容的不同步或是取得資料的方式有差異、政局的轉換也影響了各部會、各政策執行的意願，尤其是政府開放資料，這些都讓人感到氣餒。

歡迎參與相關討論：Taipei.io Google group

留言

此網誌的熱門文章

讀歐盟「數位服務法」和「數位市場法」草案心得

在 3 月 24 日時參與了台灣網路講堂所舉辦的活動，這個活動是以在台灣較知名的美國 Parler 案為題，來討論歐盟的「數位市場法」 (Digital Market Act. 簡稱 DMA ) 對於「守門人」(Gatekeeper) 平台的管制，並邀請了從競爭法、經濟學、公平會、傳播及科技法律不同角度的講者來討論這個議題。受限於時間，講者們只能把不同角度的重點讓參與者了解，事後再看 DMA 時，才了解並不是只有單純只對守門人做規範，而是從整個歐盟打算將會員國打造成「數位單一市場」(Digital Single Market)的整個脈絡，並從其發展資料經濟 (Data Economic)所發展不同階段的相關政策、指令與法律，而主管 (也是當天活動的引言人) 也提醒，還可以自歐盟在 2018 年 5 月正式執行的「一般資料保護規範」(General Data Protection Regulation，簡稱 GDPR) 觀察，歐盟當局不是只有外表看到的禁止、設限，更重要的，它是希望藉由明確的「法遵」 (Compliance) 要求，建立一個健全、具有發展與競爭機會的數位經濟市場。這些法遵要求不論是對歐盟會員國境內發展數位服務的廠商、中小企業、不同規模的平台，到跨國企業進入歐盟市場發展，除了要面臨相關的市場調查外，也同樣要遵守。如果無法看整個歐盟的數位單一市場發展，應該要了解 DMA 其實是「The Digital Services Act package」的法案之一，另一個則是「數位服務法」 (Digital Service Act. 簡稱 DSA ) ，DSA 規範了不同規模的「線上中介產業」 (online intermediary) 該做的事及責任，而 DMA 則是針對法案草案中所規範的守門人更加上了「義務」(Obligation)。由於台灣網路資訊中心已在其部落格中有整理相關的摘要，且台灣網路堂也會公布當天活動的錄影，所以在這篇文章就不再解釋 DSA 和 DMA ，有興趣的人可以自己再去閱讀兩個法案的草案內容，歐盟執委會也有整理許多相關的問答在其網站中，十分好閱讀。 DSA、DMA 與歐盟其他法案的關係在歐盟執委會網站中有提到，DSA 是一個水平的計劃，重點關注線上中介業者對第三方內容的責任，網路用戶的安全或對信息社會的不同提供者...

哪個應用、服務、平台可以代表台灣？

大概 2003、 2004 年，我還是個大學生，那個時候「電子商務」是一門選修課，那個時候台灣還在所謂的電子商務泡沫化中復甦，很多熱極一時的「電子商務」就像今天大家看到的 FTX 事件一樣，一點都不真實，很多執行長、總裁瞬間就失業了，也有很多投資人的錢拿不回來。看過歷史上的鴻源事件、經歷過電子商務的虛無飄渺時期，再看到 FTX，其實也不會太驚訝。通常泡沫消散後，未來才會到來。回到大學課堂，穿著輕便但言語犀利的老師談到當時的 Amazon 網路書店，他問大家對 Amazon網路書店的看法，那時的Amazon一直被看壞，所有的媒體都不看好它。甚至會有各種市場傳言，覺得 Amazon會被賣給哪家公司或哪家公司、網路書店會主動併購它。最後老師說，不會，Amazon書店不會那麼輕易就垮掉，它有其代表的意義。這個答案給了我很深的印象，我常會問自己，台灣有哪個服務會具有這樣的意義？偶爾我會問身邊的朋友、同事，對於台灣的哪個服務，會覺得有不能輕易垮掉、要支持它的？我列一下自己所接觸過的，這個世代的應用：通訊服務：ICQ、MSN Messenger、LINE、Cubie Messenger（台灣，已無服務）、Google Talk、WhatsApp、Telegram、Skype、Signal，還有一些台灣可能較少聽到。社群平台：Twitter、Facebook、LinkedIn、無名小站（已停止服務，它雖然是Blog，但比較像社群）、Plurk、PTT、Dcard、Instagram、AKASHA、Pinterest Blog平台或架站：Blogger、Wordpress、Drupal 共享書籤： HemiDemi（已沒有提供書籤服務）、美味書籤delicious 叫車服務：UBER、55688 、呼叫小黄、LINE Taxi、yoxi 當然還有很多是我沒接觸過的，請原諒我的見識不夠廣泛，忽略了哪一個平台、應用或服務。一時想到的大概就這些。有一些服務已經消失或在被併購後就消失了，我也忘了名稱，至於 TikTok 和小紅書，是我不想碰觸的應用服務。在韓國有 Kakao，日本有 LINE、PayPay，東南亞國家有Grab，中國有自己的網路應用，那台灣呢？之前 KaKao 中斷服務，造成民生應用的線上服務也幾乎中斷，過度集中依賴在一個服務上的確是一個缺點。在和...

歐盟 AI Act 2026 年 5 月進度整理

台灣有不少企業直接在歐盟市場做生意，或是與歐盟企業有供應鏈往來。只要產品或服務觸及歐盟，AI Act 的規範就可能適用，這件事與台灣企業的距離很近，而今年5月是AI Act進度發展密集的一個月，值得整理一下發生什麼事。 AI Omnibus 修正案：從提案到5月協議 AI Omnibus 修正案 (一攬子修正案，以下簡稱Omnibus )是指把多項修正打包成一個法案同步處理的立法方式。這次的 AI Omnibus，是《AI Act》2024年正式生效以來的首次實質修正。它的起點在2025年11月。當時歐盟執委會(European Commission)提出修正提案，認為《AI Act》中的高風險 AI 的法遵負擔過重，有必要調整期限並減輕中小企業壓力。歐盟理事會(Council of the European Union)與歐洲議會在2026年3月分別通過各自的談判立場，三方協商正式展開。歐盟理事會與歐洲議會在5月7日凌晨達成暫定協議，打包以下2項修正：時程延後：就業審查、執法、信用評分等領域的AI系統( Annex III )，遵法的截止日從2026年8月延到2027年12月；嵌入醫療器材、機械等產品的AI( Annex I )，則延到2028年8 月。新增禁令： AI生成非自願性親密影像(俗稱AI裸化應用)，以及生成兒童性剝削內容的AI系統，2項均在2026年12月生效。這份協議目前仍是暫定協議，需要歐洲議會全體投票與理事會正式採納，預計2026年6至7月完成。行程緊湊的歐盟AI Office Omnibus 協議簽完，歐盟AI Office在5月做2件事：透明度義務指引草案(5月8日)：歐盟執委會就《AI Act》第 50 條的透明度義務公開徵求意見至6月3日。這份指引將規範「互動式 AI 系統必須主動告知使用者正在與 AI 互動，生成式 AI 的內容也必須植入機器可讀的浮水印」，這項義務沒有延後，依然在2026年8月2日生效，距現在只剩10週。高風險AI分類指引草案(5月19日）： 148 頁的草案出爐，涵括生物辨識、教育、就業、基本服務、執法、移民、司法等7大領域，逐一說明什麼樣的AI系統會被認定為高風險。「高風險AI分類指引草案」公開徵詢意見至6月23日。這份指引原定2月發布，實際延遲整整3個月才出來。但歐盟 AI Of...