慈溪seo优化
最佳回答
1.“中山seo优化推广”🍮慈溪seo优化🤙🍤 ,seo优化方案模板🆑☝,seo关键词优化软件🅱️🐡 2.“论坛优化seo”🤲慈溪seo优化💮🍑 ,seo优化方案模板🐉😙,seo关键词优化软件🤝🌰 3.seo引擎优化怎么赚钱😺慈溪seo优化🦚🦉 ,seo优化方案模板🥒🦛,seo关键词优化软件🤜🍿
一些作品在著作权人不知情、未获酬情况下被用于训练模型,有出版社声明“禁止使用、违者必究”
给AI训练“喂语料”,版权账怎么算?
阅读提示
随着生成式人工智能迅猛发展,一些作品在著作权人不知情、未授权、未获酬的情况下,正被悄悄“喂”给大模型。大模型训练端侵权如何证明?作品的“合理使用”边界在哪里?相关平台是中立方还是内容使用方?
“禁止将本书内容用于人工智能训练,违者必究。”近期,有读者发现,在一家出版社部分图书的版权页上,悄然出现了这样一句话。这一在以往版次中未曾出现的新增声明,表达了版权方对“未经授权收集书中内容用于AI训练”的明确态度。
当前,生成式人工智能迅猛发展,大模型训练对语料的巨量需求与著作权保护之间的冲突也在逐步显现。一个摆在创作者面前的问题是:自己的作品在不知情、未授权、未获酬的情况下,正被悄悄“喂”给大模型。
作为新一轮科技革命和产业变革的核心驱动力,AI的发展离不开海量的数据供给。但当这些数据中包含受著作权保护的作品时,创作者的权益又该如何保护?
当AI训练遇上“著作权保卫战”
“虽然一句声明在事实上很难禁止书籍被用于AI训练,但起码表明了态度,体现了对版权的尊重。”在出版社从事编辑工作多年的程诚告诉《工人日报》记者,出版书籍经过三审三校,内容准确、行文规范,是大模型训练的优质语料,而“坐享其成地攫取”是对智力成果的漠视。
谈及如果自己编辑出版的图书被用于AI训练,程诚说,“在不知情且无偿的情况下,我想大部分从业者都是不愿意的。未来可能会有越来越多书籍加上‘未经许可禁止用于AI训练’的标注。”
不过,反对未经授权的训练使用并不等于反对AI本身。程诚提及,目前,不少出版社都在用自己出版的书籍对自有模型进行训练,希望形成某一专业领域的语料库。
今年5月,中国大百科全书出版社等22家出版和传媒机构联合发布了《人工智能高质量语料库建设倡议书》,倡导坚守“先授权、后使用”原则,聚力打造可确权、可商用的权威正版语料库。从单个出版社的声明到行业集体倡议,反映出行业对著作权的保护从被动防御向主动构建规则迈进。
在司法实践中,多地法院已审结多起涉及AI侵犯著作权的案件,AI产业发展和著作权保护之间的“拉锯”进一步走入公众视野。
在广州互联网法院审结的一起生成式人工智能服务侵犯著作权案中,法院认为,某网站的AI绘画功能按用户提示词直接输出奥特曼作品实质性相似图片,并依靠会员充值算力获利,被告作为该内容生成工具的直接提供者,侵犯了原告对案涉奥特曼作品所享有的复制权和改编权。此外,杭州、上海等地法院审结的涉AI侵犯著作权的案件,分别从不同维度根据个案情况进行裁判,力求在激励AI产业创新发展和保护著作权之间实现平衡。
司法认定面临多重难题
一纸声明表达了著作权人对作品的坚决维护,但证明作品被用于AI训练却并不容易。
在上述广州互联网法院审结的案件中,原告要求被告将奥特曼素材从训练数据集中删除,未获法院支持,该诉请被驳回的理由是缺乏直接证据证明被告实际使用了原告作品进行训练。如何在输入端“看不见摸不着”的情况下证明作品被使用了?在上海首例人工智能大模型著作权侵权案中,上海知识产权法院认为,只有当AI输出内容再现了原作品时,才构成对复制权的侵害。
“从治理的可操作性看,输出端应优先突破。”中国社会科学院大学互联网法治研究中心主任刘晓春在接受《工人日报》采访时表示,相比于训练端,输出端的侵权事实更直观、损害更容易量化。“优先治理输出端成本低、争议小、见效快,也能给行业探索训练端的合规模式留出缓冲空间。”
用未经授权作品训练AI是否落入著作权法意义上的“使用”,是认定训练行为是否构成侵权的关键。在杭州首例涉生成式人工智能平台侵害信息网络传播权案中,法院认为,在内容输出端,平台对用户生成的侵权模型及图片未采取必要措施,构成帮助侵权,但同时表明,训练阶段使用作品,不以再现独创性表达为目的,不损害原作正常使用,可被认定为合理使用。
除了主动采集的语料,在交互式场景中,一旦用户输入的内容本身涉及侵权,平台与用户之间的责任如何分配?对此,北京华苒律师事务所主任王华认为,平台责任需根据其对用户上传内容的实际处理方式进行区分。
王华表示,如果平台将用户上传内容仅用于当次回答,不存储不训练,则角色接近中立的服务提供者,“避风港原则”(注:指网络服务提供者只有在知道侵权行为或侵权内容的存在后才有义务采取措施,如删除、屏蔽或是断开链接等)有一定适用空间,但仍需承担与信息管理能力相匹配的注意义务。
“如果平台将用户上传内容用于训练或改进模型,则不再是中立通道,而是主动利用内容的‘使用人’,对内容来源合法性应承担更高注意义务。”王华说。
寻找保护与创新间的动态平衡
如何在保护著作权和支持创新间找到动态平衡,正是学界和业界持续探索的问题。
中国文字著作权协会常务副会长兼总干事张洪波表示,“希望AI产业能够本着技术向善、以人为本的基本原则,尊重内容创作。AI训练商业性使用版权作品的,应提前依法获得许可并支付合理报酬。”对于海量数据的即时需求与传统事前授权规则之间的矛盾,他认为,可以充分发挥著作权集体管理组织的法定地位和版权资源优势,建立“一揽子”授权和规模化化解版权纠纷机制。
张洪波同时建议,著作权集体管理组织、作协、文联、译协等权利人组织可以与AI企业行业协会建立高效的对话沟通机制,有关主管部门应加强协调和行政监管,规范AI数据训练使用著作权作品的市场秩序。
“保护著作权不等于把AI训练行为一概认定为侵权。”刘晓春表示,如果把全链条合规义务都前置到训练端,会抬高中小企业知识产权核验成本,削弱创新活力。她建议,在著作权法或其实施条例中明确,仅用于AI训练过程且不针对特定作品独立使用,构成非作品性使用,或在合理使用中将其设置为不构成侵权的例外情形。
记者注意到,AI训练语料使用著作权作品是否需要授权的规则仍有待在实务中逐步构建,但语料本身应合法却早已是共识,盗版侵权的内容绝不能拿来“喂模型”。今年5月,国家版权局等4部门联合启动打击网络侵权盗版“剑网2026”专项行动,明确以人工智能领域版权整治为重点,推动解决大模型训练语料版权合规问题。
“我们乐见AI能够在尊重和保护版权的基础上,开展合法合规的开发与应用,推动产业健康规范可持续发展,赋能实体经济。”张洪波说。
本报记者 时斓娜
《工人日报》(2026年09月17日 06版)