OpenAI偷用WikiHow文章训练AI,超1.1万篇教程被侵权,普通人如何保护内容?
是全球最大的协作式“怎么做”(How-to)生活指南百科网站,目标是建立全球最实用、最全面的万事指南,让所有人都能学做任何事。爬取的文章涵盖多个主题,涵盖日常任务到专业技能。文章竞争的同类教程内容。的收入,随着时间的推移,它甚至失去了继续制作文章的动力。
全球规模最为庞大的教程网站WikiMedia, 真切地正式针对OpenAI展开诉讼行动, 控诉其在未得到授权许可的状况下, 大量抓取诸多文章内容, 以此来用于训练AI, 这般一个举动, 实实在在地引发了科技领域以及创作者群体的广泛关注。
WikiMedia正式起诉OpenAI
8月21日时, WikiMedia公司向美国曼哈顿联邦法院提交了诉讼文件, 把那OpenAI告上了法庭, 这起案件是源于 WikiMedia觉得 OpenAI运用自身网站当中的内容去训练GPT等大语言模型的时候, 未取得分毫的授权或许可。
WikiMedia是个非营利组织, 它致力于给出全球超级实用的那种生活指南, 它旗下的站点集合一大堆和日常技能、专业知识有关的那种教程文章。对于公司来说呢, 公司表示说, 他们为了创作出这些内容, 投入了巨量的人力, 以及巨量的物力, 然而让人无奈的是, 这些内容却遭到别人进行免费使用了。
超1.1万篇文章遭爬取
信息经由诉讼文件所披露, OpenAI存在未经授权抓取行为, 抓取数量超11,000篇WikiMedia的教程文章, 这些文章覆盖领域多, 包含从简单家庭维修到复杂专业技能等方面, 内容十分丰富。
WikiMedia表明, 那些被爬取的文章涵盖日常生活技巧以及专业技术指导, 具备相当高的实用价值。OpenAI借助这些内容训练而成的AI模型, 当下能够生成和WikiMedia文章极为相似的教程内容。
涉及1200项注册版权
提及在诉讼里, OpenAI的行动起码侵害了1,200项于WikiMedia登记的版权, 这表明所关涉的内容数量众多, 侵权范围宽广, 并非单个事例或者偶然行径, 是有一定规模的情况。
维基媒体在诉状里面向法院提出要求, 责令OpenAI作出赔偿, 然而具体的金额并未予以公开。与此同时, 他们向法院请求发布禁令, 想要阻拦OpenAI持续侵犯其版权事宜, 期望从根源之处遏制侵权行为。
AI可替代人类编写教程
WikiMedia于诉讼里表明, GPT等模型于吸纳了其诸多文章之后, 当下已然能够依据用户的提示, 生成跟WikiMedia文章相像乃至相同的教程内容, 这般做法极大地削减了制作同类教程的成本。
制作一篇WikiMedia文章, 需历经编辑环节, 要撰写内容, 还要进行审核等多个部分, 这会耗费时间与精力。然而AI不一样, 只需输入相关提示, 便能够在短时间之内生成类似的教程, 其成本几乎是零, 这对WikiMedia的商业模式构成了直接的威胁。
OpenAI回应称合理使用
面对诉讼, OpenAI的发言人, 在8月24日作出了回应, 该发言人表示, 公司模型使用的是以之为训练依仗的乃是公开数据, 而且这种行为归属到合理使用涉及之地域范围, 并不形成侵权, 此一说法与WikiMedia的观点产生了直接冲突!
当前为止, WikiMedia的发言人以及律师团队, 尚未针对媒体的采访请求给出更进一步的回应。这场诉讼的最终结果究竟怎样, 还得要等候法院的最终裁定, 双方都在等着法律给出相应答案。
这场诉讼影响几何
若是WikiMedia取得胜诉, 这种情况极有可能对整个AI行业在训练数据运用方面造成重大影响, 而且其他科技公司也存在面临类似法律风险的可能性。这同样为内容创作者维护自身权益树立了一个相当重要的先例。
就广大用户而言, AI所生成的教程内容质量究竟怎样, 是不是得依赖传统的专业网站, 此乃一个值得思索的问题。你认为AI生成的教程能够替代经由人类专家撰写的内容吗? 欢迎于评论区去分享你的看法。