维基百科披露与多家AI巨头的合作,使用其内容

简要介绍

  • 维基媒体基金会宣布与多家人工智能公司建立合作伙伴关系,允许其使用维基百科内容来训练大型语言模型(LLMs)。
  • 这些AI公司已签约其企业版产品,以大规模重复使用维基百科的内容。
  • 去年十月,基金会表示,由于用户使用AI摘要而非访问网站,网站访问量正在下降。

维基媒体基金会宣布与人工智能公司建立一系列新合作伙伴关系,允许它们使用维基百科内容来训练和驱动其AI模型,随着在线行为的变化,该非营利组织正努力巩固其长期可持续性。 这些协议通过维基媒体企业版签订,该产品是基金会为大规模重用和分发维基媒体项目内容而设计的商业产品。新签约伙伴包括Ecosia、微软、Mistral AI、Perplexity、Pleias和ProRata。他们加入了现有合作伙伴如亚马逊、谷歌和Meta。 “在AI时代,维基百科及其由人类创建和策划的知识变得比以往任何时候都更有价值,”基金会在一份声明中表示。 “它的知识力量[s]生成式AI聊天机器人、搜索引擎、语音助手等。维基百科是用于训练大型语言模型的最高质量数据集之一。”

这一公告是在维基百科成立25周年的相关更新中发布的。 这部在线百科全书是全球访问量前十的网站之一,也是唯一由非营利组织运营的那一组网站。根据基金会的数据,它拥有超过6500万篇文章,覆盖300多种语言,每月浏览量接近150亿次。 然而,基金会已发出警告,流量模式正在发生变化。十月,它表示人类访问维基百科的次数同比下降8%,原因是用户依赖AI生成的摘要而非直接访问网站。如今,近60%的谷歌搜索在没有点击的情况下结束,页面响应通常由维基百科内容提供支持。 

AI与出版商 这些合作发生在关于AI公司如何获取训练数据的更广泛辩论中。大型语言模型通常在大量的在线资料上进行训练,这一做法引起了作者、出版商和其他权益持有者的批评,他们认为未经许可使用受版权保护的作品属于侵权。 其中,Reddit正涉及多起关于其内容用于训练模型的诉讼,尽管它已与谷歌等达成许可协议。 周四,主要图书出版商哈切特图书集团和Cengage集团提交动议,加入针对谷歌的集体诉讼,指控该公司在构建其Gemini AI平台时进行了“历史性版权侵权”。诉讼指控谷歌在AI训练过程中未经授权复制书籍。该案最初由一群作者于2023年提起。 OpenAI也面临类似案件,原告包括《权力的游戏》作者乔治·R·R·马丁。 娱乐公司也在推动此事。12月中旬,迪士尼向谷歌发出停止侵权信,指控其侵犯版权,尽管迪士尼已与OpenAI达成一项涵盖数百个角色的AI生成视频的许可协议。迪士尼还向其他AI公司发出类似通知,并与主要制片厂一起对图像生成公司Midjourney提起诉讼。 同月,一群作家、演员和技术专家成立了一个新的行业组织,旨在推动制定可执行的行业标准,规范AI在娱乐行业的训练和使用。超过500位知名人士支持该倡议,包括娜塔莉·波特曼、凯特·布兰切特、本·阿弗莱克、吉列尔莫·德尔·托罗和泰卡·维迪提。 欧盟委员会也已正式启动反垄断调查,调查谷歌是否通过使用出版商和YouTube内容为其AI服务提供支持而未给予公平补偿或获得同意,是否违反了欧盟竞争规则。 版权持有者最终是否能寻求救济尚不确定。美国联邦法官最近对Meta和Anthropic作出了部分有利判决,裁定它们使用受版权保护的书籍训练AI模型属于合理使用,同时批评这些公司维持着盗版作品的永久库。

免责声明:本页面信息可能来自第三方,仅供参考,不代表 Gate 的观点或意见,亦不构成任何财务、投资或法律建议。数字资产交易风险较高,请勿仅依赖本页面信息作出决策。具体内容详见声明
评论
0/400
暂无评论