- Regulation (EU) 2016/679 — GDPR, Article 27
- Regulation (EU) 2024/1689 — AI Act transparency and deepfake disclosure
- Directive (EU) 2019/790 — copyright and text and data mining
- Regulation (EU) 2022/2065 — DSA where user content is hosted
谁必须指定
向欧盟客户提供翻译、转录或合成媒体服务的欧盟外提供商。提交处理的音频和视频通常包含个人数据,有时还包含特殊类别数据,语音克隆引发的身份问题超出了数据保护的范围。
门槛与豁免
无门槛。根据人工智能法案,合成内容的义务适用于所有规模的生成系统提供商。
标签上必须载明的内容
非物理。隐私通知中的代表,披露内容是AI生成或操控的(在人工智能法案要求的情况下),以及合成输出的机器可读标记。
平台字段
企业买家要求处理条款和保密保证,公共部门客户通常排除那些重用提交内容进行训练的供应商。权利持有者审查文本和数据挖掘的保留条款。
必须保存的文件
第30条记录,第28条条款,第27条指定,提交文件和输出的保留规则,转移机制,以及涉及生成模型时,版权政策和一般用途模型所需的训练内容摘要。
标准与检测
不适用,尽管合成输出的标记必须实际有效:声称在普通编辑中无法存活的水印被批评。
语言要求
用户语言的通知,这对该行业至关重要。
何时开始适用
在处理开始之前的代表。人工智能法案对合成内容的透明度义务自2026年8月2日起适用,而一般用途模型的义务自2025年8月起已适用。
文件保存期限
仅在合同约定的期间内保留提交的内容,完成后删除,除非另行约定保留。没有依据保留客户音频用于模型训练是标准失误。
不合规的后果
根据GDPR最高可达2000万欧元或营业额的4%,根据人工智能法案最高可达1500万欧元或营业额的3%。未经同意的语音克隆还涉及人格权,这在国家层面受到保护,并且可以通过禁令更快地执行,而不是等待监管机构的行动。
由谁执法
数据保护机构,2026年起的人工智能法案市场监管机构,以及国家法院处理人格权和版权索赔。
界限在哪里
声音和肖像受到国家人格权的保护,这与GDPR并存,因此即使可以争辩有数据保护依据,也需要说话者的同意。仅在权利持有者未保留其权利的情况下,才允许进行训练的文本和数据挖掘,而许多人现在以机器可读的方式这样做。
常见问题
- 我们可以使用客户文件来改进我们的模型吗?
- 只有在有单独依据和对录音中个人的透明度的情况下,通常还需要客户的合同许可。
- 我们必须标记AI生成的音频吗?
- 从2026年8月起,提供商必须以机器可读格式标记合成内容,部署者必须披露深度伪造。