您现在的位置:kastop>> Kas信息 Web3信息>>正文内容

香港AI版权立法急刹车:opt-out为何搁浅 中国投资者该看清

2026年9月底,香港特区政府被证实已悄悄把《2025年版权(修订)条例草案》从立法议程上撤下。这部原本要为AI训练数据开"合法口子"的法律,转而先制定操作指引,且没有时间表。对关注香港作为国际创科与知识产权中心的中国投资者和研究者来说,这不是一条小新闻——它意味着未来一到两年内,"用香港版权作品训练大模型到底合不合法"这个问题,依然没有确定答案。

先看懂几个关键词

一、发生了什么

2024年7月,港府下属的商务及经济发展局(CEDB)与知识产权署发布《版权与人工智能公众咨询文件》,核心议题之一,是要不要在《版权条例》(第528章)里新增一条"文本及数据挖掘豁免",明确:为电脑数据分析、包括训练AI模型而复制版权作品,不构成侵权。

按照2025年2月提交立法会工商及创新科技事务委员会的咨询结果文件,政府原本倾向于这样的方案:豁免同时覆盖非商业和商业用途;但附加五项条件——使用者必须"合法取用"作品、不得使用侵权复制品、要留存并披露作品来源、当市场上已有相应特许(licensing)计划时豁免不适用,以及给版权人一个"选择退出"选项。

这部草案原本计划在2025年上半年提交立法会审议。但2025年8月,它被悄然从立法议程中移除;2026年的《施政报告》和香港刚公布的首个五年规划中,都没有再出现这项立法。2026年9月,据《南华早报》报道,官员确认:草案将暂缓提交,政府会先制定"操作指引",说明这套退出机制在实际中怎么运作——但没有给出指引的时间表。

商务及经济发展局局长丘应桦(Algernon Yau)对外的口径是:政府需要先消化2024年咨询期间收到的不同意见。

二、为什么这件事重要:AI训练数据的"原罪"

对非法律背景的读者,需要先理解一件事:今天几乎所有大语言模型、多模态模型的训练,都依赖对互联网上海量版权作品的批量复制。复制这个动作本身,在几乎所有版权法下都构成"复制权"控制的行为——除非法律明确规定了例外。

香港现行《版权条例》并没有针对TDM的一般例外。这意味着:一家总部在香港、或用香港服务器、或面向香港市场的AI公司,批量抓取网页上的小说、新闻、图片、乐谱、论文用于训练,法律上处于一种"灰色但高风险"的状态——理论上每一次复制都可能被版权人主张侵权。

大陆法域的情况类似:中国《著作权法》第24条规定的"合理使用"是封闭式列举,并没有"为AI训练"这一项;司法实践中对AI训练数据的定性仍在摸索——从北互、广互近年审理的多起AI生成内容著作权案看,法院倾向于保护"AI生成图片/视频"的投资者投入,但对"训练阶段是否构成侵权"这一上游问题,始终没有给出正面、系统的回答。

美国则依赖"合理使用"抗辩(fair use),OpenAI、Anthropic、Meta分别被纽约时报、一批畅销书作家、Getty Images起诉,核心争点全部指向"批量复制用于训练"是否能算transformative use。欧盟走得最远:2019年《数字单一市场版权指令》第4条已经规定了商业TDM例外,但版权人可以"以适当方式"(通常是机器可读方式)保留权利——注意,是"保留权利"而不是"事先授权",这是opt-out制度的法律内核。

换句话说,今天全球没有任何一个主要法域真正把"AI训练=侵权"或"AI训练=完全自由"这两句话写死。所有制度都是在这两端之间找位置:美国偏自由、欧盟偏中间、大陆偏封闭、新加坡偏宽。香港这部草案的意义,是想在亚洲版本里搭一个"介于美国开放式合理使用与欧盟强保护之间"的制度。它一旦通过,香港就有机会成为大湾区乃至全亚洲对AI公司最友好的数据训练法域之一——这也是港府过去几年反复强调"香港要成为国际创科中心"在版权侧的一块关键拼图。

三、"Opt-out"到底卡在哪

港府最初方案的核心,是欧盟式的"opt-out":默认AI公司可以挖,版权人必须主动声明退出。对在线公开作品,政府设想的退出方式是"机器可读"标记——类似robots协议、TDM Reservation Protocol那样,版权人在自己网站或元数据里写一行机器可识别的声明,AI爬虫就应尊重。

这个设计在纸面上平衡了两方:AI公司不用一家家去拿授权(降低交易成本);版权人也不必被动挨打(可以一键退出)。但它在2024年咨询期间遭到了两方同时的反对。

要理解为什么"机器可读退出"在纸面上优雅、在实操中却举步维艰,可以把它想成"robots协议"的AI版本:过去网站用robots.txt告诉搜索引擎"别爬我",现在版权人用一种类似的机器可读标记告诉大模型公司"别拿我训练"。

问题是——第一,全网有数十亿个网页、数亿名创作者,绝大多数人不会、也不知道要去写这一行标记;第二,爬取发生在训练之前,而"训练完就不可逆",事后再要求删除,技术上几乎做不到把特定作品从模型权重里"挖"出来;第三,就算AI公司尊重了标记,版权人怎么知道它有没有尊重?这就需要一个全行业可审计的登记库,而这种登记库本身又涉及数据共享、商业秘密和跨国执法。欧盟正是因为这些问题到现在还没真正把登记库建起来,所以才在2026年7月又立了一个可行性研究项目。港府想先写"操作指引",本质上就是想把这些技术细节先谈清楚,再动法条。

创作者与版权方嫌太弱。 消费者委员会在意见书里直白地指出:模型训练是不可逆的——一旦数据被喂进模型,之后即便版权人要求退出,也几乎不可能把数据"从权重里擦掉"。因此必须在训练前就拿到同意或尊重退出,而不是事后补救。

国际唱片业协会(IFPI)香港分会、美国电影协会(MPAA)、美国出版商协会(AAP)、国际复制权组织联合会(IFRRO)等机构的意见书,普遍要求退出机制必须"有效、非负担",AI公司必须公开声明它尊重了哪些退出标记。他们担心的是:大量小创作者、记者、摄影师、音乐人根本不知道要去设置机器可读标记,结果就是"默认被喂"——表面上是opt-out,实际上对真正需要保护的人变成了opt-in才能保护。

AI与科技产业嫌太重。 香港资讯科技联会荣誉会长方保侨(Francis Fong)等人的立场相反:AI训练涉及多法域数据,一个本地的机器可读退出清单,如果没有全行业统一的技术标准,实际执行成本极高;而且如果"已有特许计划可适用"就触发豁免失效,意味着大型出版商可以一边退出、一边另设天价授权池,AI公司要么买、要么违法。亚洲专利律师协会香港组甚至提出:任何TDM例外都应该明确覆盖"生成新作品"的生成式AI训练,并且不应让版权人能借此阻止作品进入训练集。香港工业总会(FHKI)则建议谨慎推进,理由是大模型训练动辄以TB计数据,任何合规义务都会被放大到难以承受的程度。

换句话说,opt-out这个"中间路线",最终被两头都认为是错的一头。版权方要的是opt-in(先授权后训练),科技产业要的是近乎自由使用。政府在2024年咨询后发现:两边都不买账,于是选择先不立法,转而写"操作指引"。

四、"操作指引"是什么意思?为什么这反而是一种推迟

需要特别提醒读者:操作指引不是法律。它没有强制力,不会改写《版权条例》第528章,也不能在法庭上作为免责依据。

港府这一手,在监管风格上很"亚洲":先不定硬规则,用指引、行业最佳实践、自愿性标准来试探;等欧盟(正在建一个全欧范围的TDM退出登记库)、英国(依《数据使用与访问法》须在2026年3月前提交AI版权改革报告)、新加坡(2021年11月已实施宽泛的"计算数据分析"例外,无强制opt-out)的格局更明朗后,再回头决定香港制度长什么样。

短期看,这对AI公司是"利好"——没有新的硬约束。但对真正在香港布局的长期投资者,这其实是不确定性:没有法律,意味着诉讼风险始终存在,版权人仍可以随时起诉一家在港训练模型的公司;也意味着香港作为"AI训练合法港"的叙事,短期内立不住。

五、横向比较:四把尺子


这张表解释了为什么香港的撤退值得警惕:新加坡已经用五年时间证明"宽例外"能吸引AI开发者;欧盟正在用技术登记库把opt-out做实;英国在被自己的创意产业说服后掉头。香港此刻既不选择宽例外,也不选择强保护,而是把决定无限期推后。

六、对中国投资者的三条判断

第一,短期不要把"香港AI训练合法性"作为投资逻辑的一部分。 在指引落地、甚至立法重启之前,一家基金如果要投一家在港训练大模型的公司,必须在尽调中把"训练数据版权风险"作为独立、可量化的负债来看,而不是寄希望于"港府马上会立法豁免"。

一个具体的场景:如果被投公司的训练集里抓了大量香港本地报纸、出版社、图像库的作品,那么即便将来opt-out制度落地,也只能管"未来怎么用",管不了"过去已经喂进模型的部分"——这部分历史风险,本质上要靠被投公司自己的保险条款、indemnity承诺、以及未来可能与权利人的和解池来消化。尽调清单里应单列一项:训练数据来源清单、已获得授权的占比、是否已建立退出标记识别机制、是否购买了IP侵权保险。

第二,关注"机器可读退出"标准这个技术中立战场。 无论最终是opt-out还是opt-in,未来版权人与AI公司之间的接口,一定是某种机器可读协议(TDM Reservation Protocol、AI training opt-out registry、元数据声明)。谁在香港参与制定这套标准,谁就掌握未来交易的入口。对投资人,这是一个比"等法案"更值得布局的赛道——尤其是做合规科技(RegTech)、数据清洗、版权指纹、训练数据溯源的公司,无论香港最终选哪条路,这些工具都是刚需。

第三,大湾区联动要看清。 香港法律一搁置,深圳、上海、北京的AI公司在训练数据合规上其实没有"法域套利"空间——因为模型一旦面向全球提供服务,欧盟、美国的诉讼照样打到你头上。香港的角色更可能是在未来作为"国际仲裁与许可清算中心",而不是"训练避风港"。对中资美元基金和出海美元基金而言,这意味着两件事:一是不要在募资材料里把"香港法域对AI训练友好"当作卖点;二是可以反过来关注香港在国际版权许可清算、跨境授权协议、AI生成内容登记这几条赛道上的卡位机会。

七、对研究者的提示

对做知识产权法、科技法、AI治理方向的学者,这部草案的撤退本身就是一个值得写的样本:它是亚洲法域在"创新—保护"之间摇摆的典型案例。值得追踪的问题包括:操作指引的法律性质是什么?如果指引与未来立法不一致,能否作为合理信赖的抗辩?香港会不会反过来采用新加坡式的"宽例外、无opt-out"路径?以及——当训练不可逆时,"事后退出"在规范设计上是不是一个伪命题?

八、接下来盯三件事

- CEDB/知识产权署何时发布首版"操作指引"草案,公众咨询期多长;

- 2027年《施政报告》或香港第二个五年规划中,这部草案是否重新出现;

- 欧盟全欧TDM退出登记库的进展——它很可能成为香港指引的直接参照系。

在这三件事明朗之前,一句话总结:香港没有否决AI训练数据的使用,它只是把"规则到底是什么"这件事,暂时藏进了抽屉。

参考链接

- 南华早报报道(经GMAsia转引):https://gmasia.ai/news/hong-kong-delays-ai-copyright-law-to-focus-on-guidelines-first

- 立法会工商及创新科技事务委员会文件(咨询结果与建议未来路向,2025年2月):https://www.legco.gov.hk/yr2025/chinese/panels/ci/papers/ci20250218cb2-240-4-c.pdf

- 港府《版权与人工智能公众咨询文件》(2024年7月,中文版):https://www.cedb.gov.hk/assets/resources/cedb/consultations-and-publications/Chi_Copyright%20and%20AI%20Consultation%20paper%20(2024.07.08)_v1.pdf

- 知识产权署英文咨询文件:https://www.ipd.gov.hk/filemanager/ipd/en/share/consultation-papers/Eng-Copyright-and-AI-Consultation-Paper-20240708.pdf

- AI Law Review 事件评述:https://www.reviewofailaw.com/Tool/Evidenza/Single/view_html?id_evidenza=6470

- 欧盟委员会关于TDM退出登记库可行性研究:https://digital-strategy.ec.europa.eu/en/library/new-feasibility-study-introducing-eu-level-registry-text-and-data-mining-opt-out

- WIPO:新加坡计算数据分析例外(新加坡代表团发言):https://www.wipo.int/edocs/mdocs/mdocs/en/wipo_ip_conv_ge_24/wipo_ip_conv_ge_24_ss04.pdf

- 中国保护知识产权网:英国AI版权例外动态:https://ipr.mofcom.gov.cn/article/rgzhn/202603/1995427.html

- Legal 500:香港AI法律概览:https://www.legal500.com/guides/chapter/hong-kong-artificial-intelligence/



感动 同情 无聊 愤怒 搞笑 难过 高兴 路过
【字体:小 大】【收藏】【打印文章】 【 打赏 】 【查看评论】

相关文章

    没有相关内容