Skip to main content

演講筆記

#033⛰️ TY|個資不能上雲,疾管署如何用 3 款地端 AI 工具解放同仁

你的團隊使用 AI 時有多少摩擦力?疾管署 AI 推動辦公室資訊助理 TY,談一支五人小隊如何用兩張顯示卡的伺服器,替全署打造三款地端去識別化工具。

疾管署有一群同仁,每天的工作是和病患個資打交道。疫調報告要把姓名逐一遮掉;手寫病歷要人工謄打再馬賽克;病審會議的錄音檔裡被醫生不小心喊出的個案本名,得靠人耳挑出來剪掉。一份病歷審查會議的逐字稿,人工聽打加消音,要花 27 個小時。

這些苦差事,是 AI 推動辦公室決定先解決的問題。


五個人的綠洲

疾管署在 2025 年 9 月成立了 AI 推動辦公室,英文名 OASIS,取 Office of AI Strategy, Innovation, and Synergy 的縮寫,也自詡為署內「綠洲」。辦公室成員只有五個人:一位簡任技正、一位約用資訊助理 TY,加上三位研發替代役。一台裝了兩張 NVIDIA RTX 2080 Ti 的 Linux Server,就是他們的開發環境。

「我們是公衛單位,手上大量資料都牽涉病患個資,」TY 在五月小聚中分享,「資料要做延伸應用之前,去識別化是第一道關卡。」

他們盤點了署內同仁處理個資的三大場景:文字、圖像、語音,然後針對每一種,各做了一款去識別化工具。

投影片並列文字、圖像、語音三種資料去識別化應用場景,分別對應訪視紀錄、疫調單與病歷審查會議。

場景一|疫調報告裡的人名,逐筆手動換成「陳○○」

處理疫調報告和個案訪視紀錄的同仁,過去在把資料交給其他人員或進一步分析之前,得先把文件中的姓名逐一替換成「陳某」「林某」或「林○○」。文件一長,確認有沒有漏掉名字就很耗神。

AI 推動辦公室做的第一款工具,是一個 Chrome 擴充功能。安裝之後,同仁在瀏覽器上閱讀任何文件或輸入框內文字段落,工具都能自動辨識文中人名,一鍵替換成代名詞(A、B、C),並直接渲染回網頁原文,或置換文字段落內人名。如果想調整某個名字對應的代名詞,也能單筆修改;代名詞職稱也能客製,如:病患A、個案A等。處理完畢後,還能匯出一份 CSV 對照表,記錄「小明 = 病患A、小美 = 病患B」,方便後續查核。

TY 現場示範時,拿了一篇提到疾管署署長羅一鈞的新聞稿,按下辨識,幾秒內人名就被標記出來,點選替換,原文上的名字消失。「它也支援很長的文本,」他說,「不管裡面出現幾十個名字,邏輯是一樣的。」

除了 Chrome 擴充功能,這款工具也提供了 .exe 安裝檔,同仁可以將excel檔放入後跑出去識別化的檔案。讓不同使用習慣的同仁都能找到順手的入口。

黑白資訊漫畫:疾管署同仁用 Chrome 擴充功能一鍵將文件中的姓名改成 A、B、C,並輸出 CSV 對照表供查核。

場景二|手寫疫調單,先辨識、再遮蔽

第二個痛點來自圖像。疫調單和病歷常包含手寫紀錄,過去同仁得先人工謄打內容,再回頭把個資遮掉,兩道工序都費時。

AI 推動辦公室把這件事拆成兩種功能。第一個功能是「選你所要」:同仁上傳疫調單的掃描檔或照片後,框選想辨識的區域,系統就會進行文字辨識(OCR),把印刷體與手寫體一併轉成電子文字,方便後續複製到報告裡。TY 在現場示範了一張疫調紀錄,框選後系統輸出了個案的旅遊史摘要,「可以知道這個人幾月幾號去了泰國,然後他有沒有相關的內容。」

第二個功能是「遮你不要」:上傳一份病歷,系統自動辨識其中的個資欄位並貼上馬賽克,同仁也能手動增刪遮蔽範圍。正面框選與負面遮蔽,兩種需求都能搞定。

黑白資訊漫畫:手寫病歷先前需要人工謄打和人工遮蔽,現在透過 OASIS 工具整合 OCR、個資偵測與遮罩。

場景三|醫生在會議中喊出個案姓名,怎麼辦?

第三個場景,是開頭提到的病審會議錄音。

第三款工具結合了語音轉錄與姓名消音。同仁丟入音檔或影片檔,程式會自動辨識語音中的人名並消音,同時產出逐字稿。TY 在現場播放了一段新聞影片的原音:「疾管署署長羅一鈞親自解析防疫戰略」,接著播放處理後的版本,同一個段落變成了「疾管署署長……親自解析防疫戰略」,名字被抹去、消音留白。

導入這款工具後,同一份病審逐字稿的處理時間,從 27 小時降到了 9 小時。

黑白資訊漫畫:會議音檔中的人名被 OASIS 語音去識別化工具濾掉,同時輸出已消音音檔與整理好的逐字稿。

全部跑在地端,個資不出機房

三款工具背後共用同一套核心技術:中研院開發的 NER(Named Entity Recognition,專有名詞辨識)。NER 能從一段文字中自動抓出人名、地名、機構名等實體。在此基礎上,團隊再疊加了內政部的姓氏統計資料,以及常見職稱和稱謂(如「主任」「醫師」),提升對中文姓名的辨識精準度,最後導入地端模型。

「全部都是地端應用,」TY 說。這是公部門的要求,疾管署的 AI 使用指引明確規定,個資嚴禁上雲。所有運算都在署內那台 Linux Server 或同仁自己的桌機上完成,資料不會離開機房。


讓工具去配合使用者,而非反過來

三款工具分別以 Chrome 擴充功能、網頁工具、.exe 安裝檔的形態部署,背後有一個設計邏輯:盡可能讓工具出現在同仁原本就在取用資料的場景旁邊。

「我們希望減少同仁的情境轉換成本,」TY 說。在瀏覽器上讀文件的人,不需要另外開一個軟體;拿到紙本掃描檔的人,打開網頁就能處理;負責音檔的人,下載一個執行檔就能跑。工具融進既有流程,摩擦力降到最低。

黑白資訊漫畫:OASIS 小工廠在地端機房中處理文字、圖像、語音三種資料,外部雲端被擋在門外,輸出安全可延伸應用的資料。

從一個工具到一座永動機

去識別化工具只是 AI 推動辦公室切入署內的其中一個案例。但這個案例驗證了他們的推動模式:先透過每週五半小時的 AI 分享會讓同仁認識辦公室在做什麼,建立信任之後,業務單位開始主動帶著需求來敲門,辦公室把需求轉化成工具,再把成果案例帶回分享會,吸引更多單位加入。

TY 把這個循環稱為「AI 永動機」。從今年三月啟動至小聚分享當日5/13:

  • AI 分享會已辦 8 場,平均每場 161 人次參與
  • 署內 AI 知識交流聊天室有 227 名同仁加入,約佔全署近四分之一
  • 內部工具平台上架 19 款自製應用,活躍使用者 372 人,佔全署近四成

而讓團隊感到值得的,是那些來自第一線同仁的訊息。一位同仁寫道:「這份工作其實超出我的能力,孤立無援、壓力很大,疲乏無力時有個意念想說問一下 AI 辦看看……」另一位同仁的回饋則是:「超級感謝的!讓我省很多力,心理壓力也瞬間下降!」

五個人的辦公室、兩張顯示卡的伺服器,在公部門的管制環境裡,他們種出了一片綠洲。而這片綠洲正在擴散,成立以來,諮詢與協作交流已觸及近 45 個單位,從健保署、勞動部,到荷蘭和菲律賓,都有了足跡。

「希望每一次和同仁的交流,都能了解業務背後的痛點,」TY 說,「然後慢慢把這些解法,變成署內的文化。」

2026 年 5 月 AI 小聚,TY 演講現場照片。

這篇文章整理自 TY 在 2026 年 5 月小聚的分享,原題《疾管署內的 AI 綠洲》。如果想回到當天的資料,可以看這份演講簡報

TY 是衛福部疾管署 AI 推動辦公室的約用資訊助理,參與署內 AI 工具推動與應用落地。這次分享聚焦在高度管制的公部門環境裡,如何把去識別化工具做成同仁真的用得上的工作流。


Q&A:

這是會眾當天在 Discord 上對於 TY 的提問,以及她給我們的回答:

  1. 這些工具是否都是單位自己開發的?
  • 工具都是單位自己開發的。
  1. 這些工具是否可供民間使用或開源?
  •  開源事宜,正在研究相關法務與行政流程中。
  1. 公部門可用或不可用哪些地端模型,數發部是否有指引?
  • 數發部有建立AIEC檢測中心協助評測模型。另也有相關AI風險分類框架正在草擬中,詳見數發部AI專區
  1. 模糊圖片是否也屬於去識別化展示?
  • 模糊圖片屬小聚現場網路連線不穩所致。