跳至主要內容

參與 Taiwan Open Data Census心得(2)

*
讀這篇之前請先讀:About Open Data Census Taiwan(初期心得)、參與 Taiwan Open Data Census心得(1)

資料的所有者不是地方政府機關:
在評批的過程中,採購契約、選舉投票資料、商工公示資料清冊、空氣品質資料、公司登記資料,在地方政府的網站上僅提供連結到政府電子採購網、中選會、經濟部商業司、環保署的監測資訊站,有些地區因為未設置空氣監測站而無法提供數據。
即時路況資訊部份地方政府會直接連結到交通部運輸研究所(以下簡稱運研所)或國道高速公路局單位所建置的即時交通資訊網站,有些地方政府會運用運研所之資料,建立一個即時交通資訊網站,但也無法提供使用者下載使用這些資料。
就大眾運輸時刻表,由於當地的交通規劃,可能是由當地運輸業者提供時刻表供人下載參考。
資料格式不易編修、也不易被機器讀取:
依照「政府網站版型與內容管理規範」中第5項第6條中對政府入口網站及主題網站中檔案下載格式之規定,需要提供一種可編輯(如:純文字檔或其他商業文書檔案)或具開放性(如PDF、.odt、HTML)的檔案格式。在政府開放資料平臺中的資料多屬於開放格式的資料,如.csv、XML、.json等機器可以直接讀取的資料,然而不被刊載於開放資料平台中的資料,在其他的政府網站則多會提供PDF或是Word、Excel、PowerPoint、HTML、格式的檔案,並進行加密,讓使用者下載後也無法取得檔案內的資料進行資料分析或運用,這樣的情況不止出現在縣市政府網站,中央機關部會的網站也有同樣的情況。
如前述的交通事故資料而言,有些地方政府的警察局會提供已處理過的分析資料,提醒用路人哪些路口易發生事故,但若是要讓民眾運用資料進行分析或是設計學童的安全上學路線(如:加拿大的School Zone)是無法自由運用的。
就網站評比機制上,相較於其他各國原有較成熟的評審制度,而台灣今年則第一次將地方政府網站加入評比,同時評比的人選也是開放於網路上自由加入,所以可見到以下的情況:
評比者的來源:
目前的評比者的來源主要以自動參與為主,並未設置任何的要求或規範。
無一致的評分標準:
由於部份地方政府已成立資料開放平台或是利用現有的政府資料開放平台提供資料,但有些政府則是以公開資料的方式呈現,在評比時可能也無法公平評分。
由於前述部份資料的擁有者並非當地縣市政府,造成對評比標的網站之標準無法一致。
同時,因為評比者並未先對評分標準有一致的共識,在給予分數的標準也不一致,同一評比人員可能會因為不同時間的加入或評比資料而給予不同分數。
評比者本身對台灣地方政府網站的熟悉度不同
由於評比者對台灣政府網站資料的熟悉度不同,不了解資料可能會散落於哪些地方政府部門,造成可能會誤判該資料不存在的情況出現。
國情及語言的障礙
目前的評比網站介面還是以英文為主,而設計的項目也是以其他國家的架構來擬定,所以相較於台灣,會有國情不同,調查的項目不同,但提供的資料在台灣可能都是同一部會所提供,或是原本就不存有該份資料,而文字上的不同也容易造成進入障礙,有些使用者可能清楚中文資料放在哪個網站的位置,但因為評比項目為英文,卻因為語言進入障礙而在評比上增加阻力。
填寫後不易修改
因為程式設計及為求公平性,若需要更改前次的錯誤,則需要重新再進行一次評分,還需要透過另一位檢視人員審視過後才能進行更正,若是參與的人少,無法即時修改,也同樣造成評分修改上的阻礙。

結語:
由於部份的地方政府對於「資料開放」的觀念仍保留在「公開資料」的階段,所提供的檔案都不具有前面提到的開放資料的特點,而資料的著作權仍然屬於各地方政府部門,使用者若要使用資料仍然無法自由取用,也不易找尋。不需要急著建立自己的政府資料開放平台,因為國家發展委員會所提供的政府資料開放平台並不是只給中央部會機關使用,目前線上可見到台南市政府與嘉義市政府都有使用這個平台。
就台灣本地的評比者、評比平台來說,可能需要評比者們對於評分制度有一個共識、有共同的評比標準,了解各評比項目的內容是什麼及在各地方政府部門的資料位置所在,以著重其內容、架構、資料品質進行評比,才能達到公平也客觀,較能提供有效的建議,讓公部門與民眾之間能平行的交流與互動。

留言

此網誌的熱門文章

為什麼我支持《數位中介服務法》草案

在經歷許多次反抗台灣政府所立的網路相關法案後,我其實沒想過除了《數位通傳法》草案外,我還會再支持另一部法律草案,雖然 《數位通傳法》草案還壓在某處,但如果有人讀過《數位通傳法》的草案,再讀這部《數位中介服務法》草案,就會知道這部草案的重要性,而且也可以顯示台灣網路使用者的成熟度,更重要的,這是我第一次看到引入國際網路治理多方利害關係人機制的法律草案,而且是用在正確的地方。 有興趣想知道我在讀法條時的筆記和當下的感想,可以看我這則  Tweet 。這篇不使用逐條讀法條的方式來寫,因為那會讓人昏昏欲睡,我也不去比對歐盟《數位服務法》,因為我在讀《數位服務法》草案時,該草案特別強調是加強歐盟 E-Commerce Directive  ,而不是取代它,而且更多著重在預防盜版、仿冒,保護消費者的法案。所以當有輿論提到參考自《數位服務法》的《數位中介服務法》草案限縮言論自由時,我其實是一頭問號的,但一直到今天我才有時間讀《數位中介服務法》草案,這篇文章出自於我的個人經驗和閱讀法案的心得,與擔任的職務無關。 如果最近注意一下網路的資訊,有幾件事該注意一下: 有許多人在社群平台,如Facebook或是其他網路看到一些廣告,而這些廣告可能是要你支持台灣農產品、台灣製的產品,結果你收到時,上面還寫著簡體字,通常這是所謂的一頁式廣告詐騙,而行政院的消費者保護會在 2019 年時就有新聞稿在警告「 一頁式廣告詐騙多 小心查證保障多 」,之後像公視或是其他單位都有相關的活動在提醒大家小心這類廣告。但目前這些廣告其實多數不易處理,因為不容易取證、保留證據,等到追查到時已經找不到對方了。 有不少親密照片與影片在情侶分手後,被報復性的上傳到情色網站或透過即時通訊傳到親友的帳號裡,或是被洩露個資,遭到公開的霸凌。 之前有一個專題:「 青春煉獄:網路獵騙性私密影像事件簿 」,光是讀完這個專題報導我就覺得受傷。 有人使用 Deep Fake 把台灣名人的臉部照片合成至色情影片再上傳至色情影片平台,今年 7 月才被判刑。 還有許多創作者藉由網路分享作品時,被人盜用,甚至有國外的使用者修改台灣人的作品去參與比賽還獲獎。 有一次打電話問某個部會,如果消費者在國外電子商務平台買東西,但資料被外洩怎麼辦?雖然政府願意協助,但衡量至國外打官司的時間和成本,就會讓人卻步。 有些行為在現實世界裡有法...

[movie]虛偽、傲慢與人性--Dogville

片名:厄夜變奏曲DOGVILLE 導演:拉斯馮提爾Lars von Trier 演員:Nicole Kidman… IMDB 花絮:厄夜的告白(Dogville Confession) 續集:命運變奏曲(Manderlay) 目前桌上放著的,是《在黑暗中漫舞》和《命運變奏曲》,克制著自己不要接著看下去,雖然我覺得看完再寫會比較完整,特別是看完《命運變奏曲》。昨晚已先看了《厄夜變奏曲》的花絮,在拍完這部電影後 Nicole Kidman還是沒能再接下去演《命運變奏曲》。 如果沒看過這部電影的人,不建議再繼續看下去,免得壞了看電影的興緻。 這部電影共分為九幕和一個序,沒有任何的「場景」,像是舞台劇般的在每一幕開始時有旁白,所謂的場景則象徵性的在攝影棚的地上劃出房子的地基、動物;在實體場景上,只有商店有門和展示櫃,看不見的McKay家有片落地窗,醫生有藥櫃,作家有書桌,七個孩子的果農家有張床和黑板…每個實際存在的物品都代表了住在那一「格」的居民的職業和對他們最重要的事物。也許因為沒有了場景,演員的表現反而被突顯了出來,劇情更容易讓人印象深刻。 在「序」這一段裡介紹了Dogville和裡面的人物。在第一幕到第五幕裡,從Grace來到這個貧瘠的村莊,而村長Tom的行為與用意也讓人難以忍受,到此為止,大部份村民看起來是善良的,如同在序中介紹的善良正直。雖說在看電影前已經有人提醒我要小心電影情節的黑暗面,在第六幕開始時也有字幕提醒,但在看到第六幕時就想關掉了。因為從這一幕開始,才開始看到什麼是人性,而從第六幕開始,才是真正的人生。 「傲慢(arrogance)」是最常出現在電影中的字詞,當Grace與Tom相遇時,她對Tom表示她必須自己教育自己,所以必須處罰自己不能進食;在第二幕裡,Grace認為Tom很「傲慢」而傲慢是不對的,一直到最後,第九幕,她到了車上依然與父親爭論「傲慢(arrogant)」。從車上兩個人的爭論裡,名字代表優美、優雅Grace終於顯露了她的本性: The Big Man:…but I, I call them dogs… Grace: The dogs only obey their nature. Why shouldn't we forgive them? 直到最後,她的決定讓整個村子燒光只剩下一隻狗,而她原諒了那隻連肉骨頭也不願施捨給她...

AI 提高產出,但誰得到好處?

我收集了 2026 年 3 月至 9 月由 Anthropic 研究團隊公開發表的 5 篇文章,讓 Claude 重新翻譯並編輯,並修改為習慣的閱讀語氣,以利閱讀。 Anthropic 今年 3 月發表的報告顯示,美國整體失業率沒有上升,但 22 到 25 歲的年輕人每月順利進入 AI 高曝露職業的比例比 2022 年低約 14%。這是我讀完今年他們發布的 5 份經濟研究摘要後,最常想起的一句話:「AI 讓產出變多」與「誰能把產出變成自己的收穫」,是兩個得分開回答的問題。 AI 做得到,不代表已經在做 過去大部分研究或媒體在衡量 AI 對工作的影響時,常問「AI 理論上能做哪些任務」。問題在於,AI 做得到,不代表企業或個人真的已經拿來用。 在這次閱讀的文章中,研究團隊提出「觀察曝露度」(Observed Exposure)。這個指標結合 O*NET(美國職業資訊網路,Occupational Information Network)的任務清單、理論可行性評分與 Claude 的實際使用資料,並對「自動化」與「工作用途」給予較高權重。 排名最高的是電腦程式設計師(約 75%)與資料輸入人員(約 67%),客服代表也名列前茅;另有 30% 的勞工觀察到曝露度為零。AI 目前的實際使用與理論能力還有一段距離。 在公布的研究中,高曝露職業的從業者有幾個共同特徵:女性比例高 16 個百分點、平均薪資高 47%、學歷較高、年齡也偏長。受衝擊的是中高薪的知識工作者,和「AI 先淘汰低薪年輕勞工」的直覺相反。 衝擊有多大?研究用差異中差異法比對,發現 ChatGPT 發布前後,高曝露職業的失業率未見系統性上升。唯一較清楚的訊號在 22 到 25 歲:這個年齡進入高曝露職業的新工作起始率,約比 2022 年低 14%。研究團隊也註明,這個結果僅勉強達到統計顯著。 同一套 AI,成果為何不同 在針對使用者研究的報告中,使用 6 個月以上 Claude 的人,其對話成功率為 73.1%,新使用者為 66.7%,相差 6.4 個百分點。控制任務類型後,差距縮到約 3 個百分點;再加上模型、使用情境、國家等變數,差距維持在約 4 個百分點。 Anthropic 曾假設,資深使用者會更傾向於把工作整包交給 AI 自動完成。研究的資料指向相反的方向:資深使用者更常與 Claude 來回...