隨着技術的進步,生成式人工智能技術的可靠性迎來大幅提升,但眾所周知該技術需要大量現有資料繼續訓練,所以此前也曾出現過人工智能模型在未經授權的情況下使用個人作品的行為,並且 《紐約時報》 和 Getty Images (蓋蒂圖片社)曾因上述情況對某些人工智能創作者提起訴訟,由此可看出生成式人工智能技術的部分創作行為有構成抄寫和侵權的嫌疑。而今年3月,OpenAI首席技術官Mira Murati在接受《華爾街日報》 訪談 時表示,她不確定她們公司新的文本轉視頻人工智能工具Sora是否從YouTube、Instagram或Facebook帖子中獲取數據來進行訓練。對此,YouTube首席執行官Neal Mohan向OpenAI發出了明確的警告,稱若OpenAI濫用YouTube平台視頻來訓練Sora是一個明顯違反YouTube使用條款的行為。

在接受Bloomberg Originals主持人Emily Chang的 採訪 時,Neal Mohan表示:“從創作者的角度來看,當他們將用心製作的視頻上傳到我們平台後內心肯定是有所期待的,最基本的期待便是平台的服務條款將對他們的創作內容進行保護。我們平台的規則不允許用户下載未經授權的文本或視頻,因此若Sora濫用我們平台視頻進行訓練是明顯違反平台規則的行為”
目前OpenAI尚未公佈訓練Sora、ChatGPT和DALL-E等人工智能模型的具體方法,不過最近《華爾街日報》有 報道 稱,OpenAI計劃使用YouTube的視頻來訓練GPT-5。不過根據Neal Mohan聲稱,谷歌在此方面更尊重YouTube平台規則,谷歌的人工智能模型Gemini同樣需要YouTube的視頻樣本進行訓練,但它們僅使用特定視頻,具體使用哪些內容取決於創作者開放的權限。