目前關於生成式AI的著作權侵害訴訟多集中於訓練資料庫的建置是否侵權,2024年漢堡地方法院的LAION判決1亦為其中一例。為討論其是否適用歐盟的文字與資料探勘(Text und Data Mining)之權利限制規定,漢堡地方法院將生成式AI的訓練過程區分為3個階段:(1)擷取(Extrahieren)並將訓練素材轉換為機器可讀格式,亦即建立訓練資料階段;(2)分析資料內容,並加入(或補充)後設資訊(metadata),亦即模型訓練階段;(3)後續利用已完成訓練之模型,透過指令(prompts)生成輸出(outputs)階段。 |