跳到主要內容
台灣 AI 法規指南EVIDENCE WORKBENCH / TAIWAN
搜尋
韓國 / 個資行政裁罰查證 2026-08-26
回案例解讀
主管機關行政處分

韓國 Lee Luda 聊天機器人案:訓練資料來自真實對話,問題出在哪裡?

公司已持有使用者真實對話,可以再拿去訓練另一個聊天機器人嗎?

整理韓國個資保護委員會對 Scatter Lab 的處分:將 KakaoTalk 對話用於 Lee Luda 聊天機器人、開源分享與告知同意缺口,合計韓元 1.033 億元。

更新
2026-08-26
來源狀態
韓國個人資訊保護委員會官方議決資料;屬行政裁罰,不是法院判決

官方確認的結果

韓國個資保護委員會就資料蒐集、利用、兒少與敏感資訊處理及 GitHub 分享等問題作成行政處分。

金錢結果:韓元 5,550 萬附加金加 4,780 萬罰鍰,合計韓元 1.033 億元

台灣讀者先帶走什麼

台灣企業建立 RAG、客服模型或微調資料集時,也要逐批確認原始蒐集目的、可否再利用、去識別程度、供應商存取與對外分享。

先講結論

公司已經拿到資料,不代表後續每一種 AI 用途都自動合法。

真實對話常包含感情、家庭、健康、地點、工作與兒少資訊。把它從原服務搬到聊天機器人訓練、產品營運、外包或開源資料時,目的和風險都可能改變,不能只沿用最初那份同意。

案件發生了什麼

Scatter Lab 原本透過旗下服務取得使用者的 KakaoTalk 對話,之後將資料用於開發與營運 Lee Luda 聊天機器人。主管機關也檢視了資料蒐集與告知方式、兒少與敏感內容,以及部分資料被放到 GitHub 的情況。

爭點不是聊天機器人有沒有說出不當內容而已,而是訓練資料從哪裡來、原本為什麼取得、後來又被怎麼利用。

主管機關確認

韓國個人資訊保護委員會於 2021 年 4 月 28 日作成處分。官方議決資料所列金錢結果,包括韓元 5,550 萬附加金與韓元 4,780 萬罰鍰,合計韓元 1.033 億元。

處分處理的問題包含資料蒐集與利用目的、告知同意、敏感和兒少資料,以及資料安全與對外分享。這是個資主管機關行政處分,不是法院判決。

為什麼去掉姓名仍可能不夠

聊天紀錄的識別力不只在姓名。對話中的公司、學校、住址、事件、關係、時間與特殊經歷,可能和其他資料一起指向特定人。

因此,去識別不能只跑一次字串刪除。企業要看資料整體、外部可取得資訊、模型是否會記憶並重現內容,以及誰能接觸原始資料。

台灣公司可以先做什麼

建立 AI 資料集前,先做資料血緣清冊:每批資料從哪裡來、當時告知什麼、為何蒐集、是否可再利用、誰能存取、保存多久、能否交給模型或供應商。

產品、客服、研究與工程團隊也不能各自留一套測試資料。微調、RAG、評測、除錯、紅隊測試與開源樣本,都要走同一個資料審查入口。

這個案件不代表什麼

這個案件不代表企業永遠不能使用對話資料訓練 AI。實際仍要確認目的、合法基礎、告知、資料類型、必要性、安全措施與權利保障。

它也不代表刪掉姓名就一定匿名,或韓國的罰款會直接套到台灣。台灣企業應回到個人資料保護法、契約和具體資料流重新判斷。

讀完後通常還會問

01

資料是使用者自願提供的,就可以拿來訓練其他 AI 嗎?

不能只看公司是否已取得資料。仍要確認原蒐集目的、告知內容、合法基礎、資料類型、是否涉及兒少或敏感資訊,以及新的訓練與公開用途是否在合理範圍內。

02

把姓名刪掉就算匿名資料嗎?

不一定。對話中的關係、地點、工作、事件、帳號或其他細節可能重新指向特定人;要評估整體資料與可取得的其他資訊。

03

韓國裁罰與台灣個資法有什麼關係?

韓國處分不直接決定台灣案件,但它提醒台灣公司,資料最初的告知與目的不能在 AI 專案開始後被忽略,訓練集、評測集與開源樣本都要另外盤點。

回到官方原始頁面

1 筆來源
  1. 01Scatter Lab personal information protection agenda decisionPersonal Information Protection Commission, Republic of Korea / 查證 2026-08-26開啟