胡中瑋/北辰著作權事務所律師、清華大學通識教育中心兼任助理教授
數位發展部啟動「臺灣主權AI訓練語料庫」民間語料徵集,邀請作家、出版社及電子書平台提供作品,並強調「自願參與、明確授權、可退出」三項原則。對創作者而言,「可退出」看似理所當然:今天同意作品供AI訓練,日後改變心意,似乎就能把作品拿回來。
但仔細閱讀數發部公布的「臺灣主權AI訓練語料授權條款-第1版」,「可退出」的法律效果其實比這三個字複雜許多。
依授權條款第二條第2項,即使原語料後續「停止提供使用」,也不影響已完成的訓練成果,包括模型、權重、程式碼、文件或其他輸出成果;相關成果如具著作權保護要件,並得由被授權人或模型操作者後續適法利用。
換句話說,作者退出語料庫,並不等於要求已完成訓練的AI把作品「忘記」。所謂「退出」,比較接近停止原始語料日後繼續提供使用,而不是讓已經形成的模型與權重回復到「從未使用過這些資料訓練」的狀態。
這樣的制度安排未必不合理。一本電子書授權終止後,可以停止提供電子檔;但作品一旦已被用於AI訓練並形成模型與權重,如果每次有一位創作者選擇退出,就要求重新訓練模型,確實可能產生龐大的技術與成本問題。
但問題在於:一般創作者看到「可退出」,是否會理解到這一層?
「可退出」如果只是可以將作品從語料庫下架,卻無法影響已經完成的模型與權重,那麼政策對外強調「可退出」時,更應同步說明:至少就已完成的訓練成果而言,退出並不具有溯及效果,也不能讓既有模型回復到作品從未被拿去訓練的狀態。換言之,「可以退出語料庫」與「可以撤回已經完成的AI訓練」,其實是兩件完全不同的事情。
值得注意的是,這份授權條款對AI訓練成果給予的利用空間其實相當廣泛。第二條第3項雖規定,當AI成果與原語料實質近似、對原語料潛在市場或現在價值造成負面影響,且超出合理學習範疇時,「仍可能」受原著作權拘束;但同條第4項緊接著規定,除上述情形外,授權人同意不將AI訓練成果視為其原著作的改作或編輯,也不對相關產出與輸出的後續使用、修改、再散布或運算施加限制或提出訴訟。
換言之,第二條第3項並不是宣告只要符合條件就一定侵權,而只是保留原著作權可能介入的空間;同條第4項則大幅限制授權人對其餘AI訓練成果後續控制與主張的空間。這意味著,這份授權並非單純讓「作品給AI看一看」;作者一旦同意,除了容許作品進入訓練流程,也等於接受已完成的模型不因日後退出而失效,自己對後續訓練成果可以主張權利的範圍,也受到相當程度限制。
因此,真正值得討論的或許不是政府應不應該設計退出機制,而是「可退出」三個字,是否足以讓一般創作者理解自己究竟能退出到哪裡。
如果制度希望取得創作者信任,比起只強調「可退出」,更應該用白話直接告知:您可以要求停止原語料後續使用,但退出前已完成的模型及訓練成果原則上不受影響;只有在輸出與原語料實質近似、對原語料市場或價值造成負面影響,並超出合理學習範疇時,原著作權才可能重新介入。
主權AI需要臺灣自己的優質內容,也需要創作者願意把作品交給它學習。真正的「明確授權」,不只是讓創作者知道怎麼加入,更應讓他在加入以前就清楚知道:有一天想「退出」時,究竟能退出什麼,又有哪些法律效果已經無法隨著「退出」一併撤回。
AI能不能真正忘記,也許是技術問題;但對創作者而言,更重要的問題其實是:按下「同意」之前,有沒有人把「退出到底代表什麼」說清楚?


