維基百科揭露與多家AI巨頭的多項合作,使用其內容

簡要說明

  • 維基媒體基金會宣布與多家人工智慧公司建立合作夥伴關係,允許其使用維基百科內容來訓練大型語言模型(LLMs)。
  • 這些AI公司已簽約使用其企業產品,以大規模重用維基百科的內容。
  • 去年十月,基金會表示由於人們使用AI摘要而非直接訪問網站,網站訪問量正在下降。

維基媒體基金會宣布了一系列與人工智慧公司合作的新計畫,這將允許他們使用維基百科內容來訓練和驅動其AI模型,這家非營利組織在數位行為變化的背景下,試圖鞏固其長期的可持續性。 這些協議是通過維基媒體企業(Wikimedia Enterprise)簽署的,這是基金會為大規模重用和分發維基媒體項目內容而設的商業產品。新加入的合作夥伴包括Ecosia、微軟、Mistral AI、Perplexity、Pleias和ProRata。他們加入了亞馬遜、谷歌和Meta等現有合作夥伴行列。 “在AI時代,維基百科及其由人類創建和策劃的知識比以往任何時候都更有價值,”基金會在聲明中表示。 “它的知識力量[s]生成式AI聊天機器人、搜尋引擎、語音助手等。維基百科是用於訓練大型語言模型的最高品質數據集之一。”

這一公告是為了慶祝維基百科成立25周年而發布的更新內容之一。 這個線上百科全書是全球十大最受訪問網站之一,也是唯一由非營利組織運營的網站。根據基金會的資料,它擁有超過6500萬篇文章,涵蓋超過300種語言,每月瀏覽量接近150億次。 然而,基金會已警告流量模式正在轉變。十月時,它表示人類訪問維基百科的次數同比下降8%,原因是用戶依賴AI生成的摘要而非直接訪問網站。如今,近60%的Google搜尋在沒有點擊的情況下結束,頁面上的回應常常由維基百科內容提供。

AI與出版商 這些合作是在更廣泛的關於AI公司如何獲取訓練資料的辯論中進行的。大型語言模型通常在大量線上資料上進行訓練,這一做法引來作者、出版商和其他權利持有者的批評,他們認為未經許可使用受版權保護的作品屬於侵權。 其中,Reddit正涉及多起與AI公司有關的訴訟,指控其使用Reddit內容來訓練模型,儘管它已與谷歌等公司達成授權協議。 星期四,主要圖書出版商哈切特圖書集團(Hachette Book Group)和Cengage集團提交動議,加入針對谷歌的集體訴訟,指控該公司在建立其Gemini AI平台時進行“歷史性版權侵權”。該訴訟指控谷歌在AI訓練過程中未經授權複製書籍。此案最初由一群作者於2023年提起。 OpenAI也面臨類似的案件,原告包括《權力的遊戲》作者喬治·R·R·馬丁。 娛樂公司也在推動相關議題。12月中旬,迪士尼向谷歌發出停止侵權通知,指控其侵犯版權,即使迪士尼與OpenAI簽訂了涵蓋數百個角色的AI生成影片授權協議。迪士尼也向其他AI公司發出類似通知,並與主要影像生成公司Midjourney一同參與訴訟。 同月,一個由作家、演員和技術專家組成的聯盟成立了一個新行業團體,旨在推動制定可執行的標準,規範AI在娛樂行業的訓練和使用。超過500位知名人士支持這一倡議,包括娜塔莉·波特曼、凱特·布蘭切特、班·阿弗萊克、吉列爾莫·德爾·托羅和泰卡·沃蒂蒂。 歐盟委員會也已展開正式的反壟斷調查,調查谷歌是否在未獲得公平補償或同意的情況下,利用出版商和YouTube內容來推動其AI服務。 版權持有者最終是否能找到救濟途徑尚未可知。美國聯邦法官最近對Meta和Anthropic作出了部分有利判決,裁定它們使用受版權保護的書籍來訓練AI模型屬於合理使用,但也批評這些公司維持著永久的盜版作品庫。

免責聲明:本頁面資訊可能來自第三方來源,僅供參考,不代表 Gate 的立場或觀點,亦不構成任何財務、投資或法律建議。虛擬資產交易具有高風險,請勿僅依賴本頁資訊作出決策。詳情請參閱 免責聲明
回覆
0/400
暫無回覆