跳至主要內容

生成式AI使用記錄-翻譯

翻譯是一門專業工作,它不只是把另一種語言轉化為日常生活的語言,而是轉化為人人看得懂、聽得懂的語言。在學習的過程裡,老師說過翻譯重視「信、達、雅」,這是一門學問,不是任何一個人、哪種工具可以取代的。這篇不是在談「翻譯」的學問或是翻譯會不會被人工智慧取代,我也不是專業翻譯,沒有能力談這門學問,我只能分享AI在工作上的協助。

因為工作需要閱讀大量的國外文獻,或是參與會議中有大量的英文文獻需要閱讀,Google Translate提供許多協助,同時利用使用者協助修正翻譯的正確度,甚至減少大量閱讀的時間。

隨時間的增加,坊間也愈來愈多更好的翻譯軟體,但遇到會議的錄影與錄音轉譯,還是需要由專業的翻譯公司協助,以節省時間成本,人員可以把時間專注在自己的事業上,遇到需要節省金錢成本時,就會折衷由一般人員來譯出可以接受的成果。

直到 ChatGPT 出現,我拿它來翻譯會譯的逐字稿,它協助節省金錢成本與時間成本,雖然增加編輯成本,但隨著模型逐漸進步,訓練的人愈來愈多,它也會提高準確度,並藉由一次又一次的對話往來,產出比用 Google Translate更能讓人容易接受的版本。相對的,它還是增加使用人員需要編輯、審核的時間成本。但有沒有比人類編輯好?我想現階段,中文可能還有沒比人類編輯好的程度,但已經可以是能接受、初步可以讀懂文字要表達的粗略意思的程度,離「信、達、雅」的標準還很遠。

以往的少見文字,如藏文、閃語、印度語,甚至連死海古卷裡的文字都已經可以藉由AI技術辨識出來,已經是非常大的進步。有天我使用AI翻譯藏文時,突然想到,誰可以幫我核對翻譯出來的正確性?我個人是不懂藏文的,當我想把中、英文用AI翻譯為藏文時,又能請誰幫我確認文法與用字的正確性呢?

所以,使用者本身也是需要一定程度,才能辨識AI結果的正確性,有無過度編撰或錯誤的引用,例如在法規上的引用、宗教信仰經典裡的人物及故事,會不會在一來一往中給AI產生幻覺(Hallucination)的機會。又如同專業的翻譯人員並不是完全了解各行各!業中的知識,工作過程中還要再與委託者討論。又如有次我聽到一場會議的講者,他提到他是專業的執法人員,但是否判定對方有無違法,還需要了解該行業的專業知識,例如建築業、畜牧業,甚至要去了解飼料的投餵方式與成份。所以現階段,AI還是無法取代人類,也無法代替法官做出判決,大概也是短期內的一件好事吧!



Image by Trid India from Pixabay

留言

此網誌的熱門文章

台灣女性在 ICT 相關產業的情況(更新至 2018 的資料)

Image by StockSnap from Pixabay 去年五月時寫了一篇「 願天下的女性都能享受自己選擇的人生 」,事隔一年,主計總處、內政部的詳細報表資料已經找不到了,只找到粗略的分級,所以今年也不打算更新太多項目,只大概更新一下資料。關於資料這件事,如果政府繼續排斥將這些資料完整的公開,我覺得整個開放資料或政府公開資訊都只是做做樣子,有交差就算了。 在我開始更新資料前,先讓大家看一下這是讓我今年在主計總處統計專區裡所下載回來的資料,表頭是「臺灣地區15至64歲已婚女性曾因結婚、生育而變更職務之情形」,但只有依學歷來區分,無法看到以年齡來分組的統計資料,但這份資料的主題不就是以年齡來分組嗎? 臺灣地區15至64歲已婚女性曾因結婚、生育而變更職務之情形 後來我找到 2016年的「 婦女婚育與就業調查報告 」,其實就是去年使用的資料,所以只好再去找尋其他的資料。

為什麼我支持《數位中介服務法》草案

在經歷許多次反抗台灣政府所立的網路相關法案後,我其實沒想過除了《數位通傳法》草案外,我還會再支持另一部法律草案,雖然 《數位通傳法》草案還壓在某處,但如果有人讀過《數位通傳法》的草案,再讀這部《數位中介服務法》草案,就會知道這部草案的重要性,而且也可以顯示台灣網路使用者的成熟度,更重要的,這是我第一次看到引入國際網路治理多方利害關係人機制的法律草案,而且是用在正確的地方。 有興趣想知道我在讀法條時的筆記和當下的感想,可以看我這則  Tweet 。這篇不使用逐條讀法條的方式來寫,因為那會讓人昏昏欲睡,我也不去比對歐盟《數位服務法》,因為我在讀《數位服務法》草案時,該草案特別強調是加強歐盟 E-Commerce Directive  ,而不是取代它,而且更多著重在預防盜版、仿冒,保護消費者的法案。所以當有輿論提到參考自《數位服務法》的《數位中介服務法》草案限縮言論自由時,我其實是一頭問號的,但一直到今天我才有時間讀《數位中介服務法》草案,這篇文章出自於我的個人經驗和閱讀法案的心得,與擔任的職務無關。 如果最近注意一下網路的資訊,有幾件事該注意一下: 有許多人在社群平台,如Facebook或是其他網路看到一些廣告,而這些廣告可能是要你支持台灣農產品、台灣製的產品,結果你收到時,上面還寫著簡體字,通常這是所謂的一頁式廣告詐騙,而行政院的消費者保護會在 2019 年時就有新聞稿在警告「 一頁式廣告詐騙多 小心查證保障多 」,之後像公視或是其他單位都有相關的活動在提醒大家小心這類廣告。但目前這些廣告其實多數不易處理,因為不容易取證、保留證據,等到追查到時已經找不到對方了。 有不少親密照片與影片在情侶分手後,被報復性的上傳到情色網站或透過即時通訊傳到親友的帳號裡,或是被洩露個資,遭到公開的霸凌。 之前有一個專題:「 青春煉獄:網路獵騙性私密影像事件簿 」,光是讀完這個專題報導我就覺得受傷。 有人使用 Deep Fake 把台灣名人的臉部照片合成至色情影片再上傳至色情影片平台,今年 7 月才被判刑。 還有許多創作者藉由網路分享作品時,被人盜用,甚至有國外的使用者修改台灣人的作品去參與比賽還獲獎。 有一次打電話問某個部會,如果消費者在國外電子商務平台買東西,但資料被外洩怎麼辦?雖然政府願意協助,但衡量至國外打官司的時間和成本,就會讓人卻步。 有些行為在現實世界裡有法...

停不下來的更新

一直更新Blog的版型,我必須承認是一件很無聊的事,不過這次除了版型的更動外,連分類和文章內文也做了變動。 先說分類吧!在Blogger叫做Label,不過,Blogger在分類上有一些bugs,只能使用英文,以前這裡的分類大多都是中文分類,結果在link上就是一堆亂七八糟的亂碼,所以我把它改成英文,同時細分一些項目,把出版的文章和一些教學的文章分開來,雖然已經很久沒寫新的,不過既然放上來就做個分類。然而就在新舊label移轉之後,發現中文的label還會存在,而且還會出現莫名奇妙的幽靈數字,Blogger知道這是個bug,不過似乎一直沒有修復的跡象。所以在分類上就出現了如右圖一般的情況,在英文標籤裡會有文章,但是在中文標籤裡是沒有文章出現的,但奇怪的是,有些中文標籤已經不見了,然而在Beauty-Beta這個部落格裡,我也做了分類上的變動,由於以前用英文開頭的Label,所以在label的變動上倒是不用擔心會有這樣的情況。 再來是文章的內容,把以前的文章重新分類,標題前面的一些全形符號或是分類刪掉,除了一些比較特殊的,我會留著,例如壹陸壹,因為在label裡為了統一,我留著原本的E61,但人家的店名是壹陸壹,所以留下文章標題前面的中文分類,另外像是Entertainment項目裡,可能有音樂,可能有電影,就會在前面留下中文分類。 前簡單的CSS和HTML改成現在的XML,這無疑是讓我們再多學些東西,能有時間鑽研當然是好事,可是轉換後,我一直沒有時間去改,當然多半也是因為懶,到現在也是拿別人做好的版型去改配色而已,所以像裡面的設定、安裝的widget和analytics的javascript都要一個一個重新裝,上個星期幾乎每天都弄到天亮才睡,只為了整理這個blog。也因為之前在blog裡放了technorati的分類,所以還要修改以前的文章,把它們加入technorati,還有裡面的語法要更改,所以這個星期甚至下個星期都會一直收到這裡的更新訊息,對於不斷收到訊息干擾的朋友們,在這裡說聲抱歉。 在版面上因為blogger系統在feed接受上的更新,所以還有四個東西沒加進去,分別是最近的文章(Recent Post)、Comments(目前是用別人寫的widget)還有GVO的feed訂閱顯示、Beauty-Beta的訂閱顯示也都還沒放上去。 在Feed訂閱上,以前bl...