跳至主要內容

參與 Taiwan Open Data Census心得(1)

TW Open Data Census

首先,我要說這份評比是由許多人合力進行的,而我只就我自己所參與的部份寫下我的心得。
從今年三月至今,看了台灣的各縣市政府的網站,也才了解到平時關注國外網站的時間可能都比瀏覽自己居住地的網站還要多。
在此,我再抄書一下。依照Open Knowledge Foundation對開放資料的定義,開放資料必須具備以下特性:
  1. 能容易取得、可以自由被使用,機器容易讀取,不受著作權法的規範,最多只能註明資料來源及所有人。
  2. 資料允許重覆被使用,也能與其他資料集混合重組後再傳播。
  3. 因為資料可以自由被使用、也允許被使用及散佈,所以不能限定資料的使用範圍。
台灣在今年參與了地方性的開放資料評比,將五都及各縣市政府都列在其中。評比的項目共有15項,分別為:
  1. 即時交通資訊
  2. 年度預決算
  3. 詳細支出(台灣則是觀察是否有提供支付及補助彙整表)
  4. 選舉結果
  5. 空氣品質(空污指數)
  6. 大眾運輸時刻表
  7. 公共設施
  8. 犯罪統計
  9. 採購契約
  10. 食品安全檢驗結果
  11. 交通意外事故記錄
  12. 建築執照許可
  13. 服務意見回饋資料
  14. 營業許可(公司登記資料)
  15. 商工公示資料清冊
台灣地方政府目前有:台北市、新北市、台中市、高雄市、宜蘭縣政府有提供自己的政府資料開放平台,台南市與嘉義市政府則是利用中央的政府資料開放平台提供地方的政府資料使用,多數縣市政府則是以「公開資料的格式」來呈現。在參與評比的過程中有遇到的狀況:
資料查找不易:
依台灣政府資訊公開法第7條的規定,上列的15項項目中,年度預決算、施政計畫、業務統計及研究報告都屬於公開資料。同樣依政府資訊公開法第8條第5項之規定,需要將規定需要公開的資料利用電信網路傳送或其他方式供民眾查找。所以在地方政府網站上所公開的資料,普遍刊載於網站上的公開資料專區中,如台北市政府曾獨立設置一個所謂的公開資料平台,讓瀏覽者直接瀏覽該公開資料網站之資訊。然而有些地方政府可能因為網站版面設計的緣故,將公開資料專區或是放置於不同的功能類別,造成網站瀏覽者在找尋相關資料的困難度。
而犯罪統計的相關資訊只能在內政部的統計資訊網站或是行政院主計處所提供的統計資料網站中查找各地方的犯罪統計數據;而交通意外事故記錄,並無法於縣市政府網站中的公開資料資訊區取得,則需要再連結至縣市政府的警局網站去查找相關的資訊,更可能會因為資料記錄時的行政流程,無法查詢意外事故發生的時間與地點。
關於地方政府所提供的年度預決算及每月的支付補助彙整表則依照行政院主計總處的規定而有一定的格式,一般民眾可能無法自格式中取得足夠的資訊,又或是無法解讀會計報表的意涵。
原始資料取得不易也無法批次下載:
如公共工程採購契約,僅管政府電子採購網上都有提供公開資訊,但需要另外付費下載標案說明書,在結標後卻少見即時更新標案頁面資訊,更無法批次下載相關的資訊。
又如建築執照的查詢,必須透過紙本送件,只能申請人單一申請個案,無法批量的下載資料,又或是無法直接取得資料。

後續:參與 Taiwan Open Data Census心得(2)

留言

此網誌的熱門文章

AI 提高產出,但誰得到好處?

我收集了 2026 年 3 月至 9 月由 Anthropic 研究團隊公開發表的 5 篇文章,讓 Claude 重新翻譯並編輯,並修改為習慣的閱讀語氣,以利閱讀。 Anthropic 今年 3 月發表的報告顯示,美國整體失業率沒有上升,但 22 到 25 歲的年輕人每月順利進入 AI 高曝露職業的比例比 2022 年低約 14%。這是我讀完今年他們發布的 5 份經濟研究摘要後,最常想起的一句話:「AI 讓產出變多」與「誰能把產出變成自己的收穫」,是兩個得分開回答的問題。 AI 做得到,不代表已經在做 過去大部分研究或媒體在衡量 AI 對工作的影響時,常問「AI 理論上能做哪些任務」。問題在於,AI 做得到,不代表企業或個人真的已經拿來用。 在這次閱讀的文章中,研究團隊提出「觀察曝露度」(Observed Exposure)。這個指標結合 O*NET(美國職業資訊網路,Occupational Information Network)的任務清單、理論可行性評分與 Claude 的實際使用資料,並對「自動化」與「工作用途」給予較高權重。 排名最高的是電腦程式設計師(約 75%)與資料輸入人員(約 67%),客服代表也名列前茅;另有 30% 的勞工觀察到曝露度為零。AI 目前的實際使用與理論能力還有一段距離。 在公布的研究中,高曝露職業的從業者有幾個共同特徵:女性比例高 16 個百分點、平均薪資高 47%、學歷較高、年齡也偏長。受衝擊的是中高薪的知識工作者,和「AI 先淘汰低薪年輕勞工」的直覺相反。 衝擊有多大?研究用差異中差異法比對,發現 ChatGPT 發布前後,高曝露職業的失業率未見系統性上升。唯一較清楚的訊號在 22 到 25 歲:這個年齡進入高曝露職業的新工作起始率,約比 2022 年低 14%。研究團隊也註明,這個結果僅勉強達到統計顯著。 同一套 AI,成果為何不同 在針對使用者研究的報告中,使用 6 個月以上 Claude 的人,其對話成功率為 73.1%,新使用者為 66.7%,相差 6.4 個百分點。控制任務類型後,差距縮到約 3 個百分點;再加上模型、使用情境、國家等變數,差距維持在約 4 個百分點。 Anthropic 曾假設,資深使用者會更傾向於把工作整包交給 AI 自動完成。研究的資料指向相反的方向:資深使用者更常與 Claude 來回...

停不下來的更新

一直更新Blog的版型,我必須承認是一件很無聊的事,不過這次除了版型的更動外,連分類和文章內文也做了變動。 先說分類吧!在Blogger叫做Label,不過,Blogger在分類上有一些bugs,只能使用英文,以前這裡的分類大多都是中文分類,結果在link上就是一堆亂七八糟的亂碼,所以我把它改成英文,同時細分一些項目,把出版的文章和一些教學的文章分開來,雖然已經很久沒寫新的,不過既然放上來就做個分類。然而就在新舊label移轉之後,發現中文的label還會存在,而且還會出現莫名奇妙的幽靈數字,Blogger知道這是個bug,不過似乎一直沒有修復的跡象。所以在分類上就出現了如右圖一般的情況,在英文標籤裡會有文章,但是在中文標籤裡是沒有文章出現的,但奇怪的是,有些中文標籤已經不見了,然而在Beauty-Beta這個部落格裡,我也做了分類上的變動,由於以前用英文開頭的Label,所以在label的變動上倒是不用擔心會有這樣的情況。 再來是文章的內容,把以前的文章重新分類,標題前面的一些全形符號或是分類刪掉,除了一些比較特殊的,我會留著,例如壹陸壹,因為在label裡為了統一,我留著原本的E61,但人家的店名是壹陸壹,所以留下文章標題前面的中文分類,另外像是Entertainment項目裡,可能有音樂,可能有電影,就會在前面留下中文分類。 前簡單的CSS和HTML改成現在的XML,這無疑是讓我們再多學些東西,能有時間鑽研當然是好事,可是轉換後,我一直沒有時間去改,當然多半也是因為懶,到現在也是拿別人做好的版型去改配色而已,所以像裡面的設定、安裝的widget和analytics的javascript都要一個一個重新裝,上個星期幾乎每天都弄到天亮才睡,只為了整理這個blog。也因為之前在blog裡放了technorati的分類,所以還要修改以前的文章,把它們加入technorati,還有裡面的語法要更改,所以這個星期甚至下個星期都會一直收到這裡的更新訊息,對於不斷收到訊息干擾的朋友們,在這裡說聲抱歉。 在版面上因為blogger系統在feed接受上的更新,所以還有四個東西沒加進去,分別是最近的文章(Recent Post)、Comments(目前是用別人寫的widget)還有GVO的feed訂閱顯示、Beauty-Beta的訂閱顯示也都還沒放上去。 在Feed訂閱上,以前bl...

當AI給你營養建議:台灣《營養師法》還沒想過的法規空白

之前分享利用 Claude Code 做 飲食營養分析 Bot 的經驗 。我自己有個習慣,就是在做新的專案時,會先評估法遵風險。當我在做飲食營養分析 Bot 時,我才知道原來台灣除《醫師法》外還有《 營養師法 》,而《營養師法》第 12 條列舉營養師的法定業務,包含營養評估、飲食設計、個案諮詢、膳食管理等。 這部《營養師法》在幫大家的健康把關,因為不能隨便一支影片、一段報導,就能提供營養建議。在法規中,需要接受完整的專業教育,並持續進修,每 6 年就要提出繼續教育的證明文件,才能更新執業證照;沒有「營養師」的證照不能自稱「營養師」,法規中列舉了營養師的業務範圍,並規定須親自執行業務,不能由他人代理,如果藉由通訊方式執行業務,還要經過執業登記的主管機關核准;執行業務時還要做紀錄,這些紀錄可能還會成為法律或醫療紀錄文件。 成為「營養師」需要符合嚴格的要求與限制,並不是隨便用AI分析、讓AI提供建議就能取代的。台灣每年會舉辦 2 次營養師的考試,參考自中華民國營養師公會在 2025年的統計資料 ,台灣每年營養科系的畢業生約 1500 人,到 2025年,累計已有 11,860 人通過考試取得執照,及格率約 25%,看起來是一個具有挑戰性的考試。 Bot 的個人化建議,算不算「執行業務」? 在我設計的 Bot 裡,不是只有拍照上傳讓 AI 去分析、評估,事實上還有其他情境的飲食需求,再提供使用者建議,例如由 Bot 提醒當天攝取的蛋白質不足,或我在前篇文章中提到的鈉的攝取量過高,Bot可能提醒要減少鈉的攝取或是多補充哪些蛋白質來源,這些分析與建議是否算「執行業務」?在該法第 29 條中也寫明,如果沒有取得營養師的資格而執行相關業務,本人及其雇主各處新臺幣 5 萬元以上,25 萬元以下罰鍰。 法律規範的對象是「人」,目前法律還沒有明確定義 AI 工具的法律地位,也不知道該找誰負責,是開發的工程師?大語言模型的公司?還是開發的公司?一般開發者通常會在提供的資訊裡加上「僅供參考、非醫療建議」的免責聲明來規避,但無從得知這樣的聲明在法律是否具有效力。另外,由於在 Bot 中可以設定慢性病的個別飲食計算,還可能同時踩到《醫師法》(涉及診療)與《營養師法》(涉及個案管理)。同時,即使開發者已在服務中加入「僅供參考、非醫療建議」的免責聲明,主管機關或法院在判斷是否構成營養師業務的執行時,...