中国青年报
AI合成声则是从文字生成语音,或者根据一段参考音频提取音色、语速、停顿和语气特征,再合成新的讲话内容。它不只是把声音的音调升高或降低,还可能模拟说话节🎇奏、情绪变化和发音习惯。音频样本😎越清晰、环境噪声越少,生成效果通常越稳定。
第四步,主动标识合成属性。在视频画面、标题、简介或音频开头,用清晰易懂的方式说明内容经过AI换脸、AI合成声或数字化处理。标识不应藏在难以发现的位置,也不能用模糊表述掩盖真实制作方式。
如果只是进行经过许可的影视制作、广告创意、数字人展示、配音测试或影视修复💫,这类技术能够提高制作效率;如果未经同意模仿明星形象和声音,尤其用于🌈广告背书、直播带货、虚假新闻、诈骗或误导公众,就可能带来肖像、声音、著作权、个人信息和名誉等方面的风险。
明星的脸部形象和声音通常具有较高的识别度与商业价值。未经许可把这些特征用于广告、商品宣传、账号引流或付费内容,可能使公众产生“明星代言”“明星发言🎆”或“明星参与项目”的错误判断。即🤔使发布者标注了“AI生成”,也不能自动消除由误导、侵权或不当使用造成的责任。
AI明星换脸与AI合成声,分别是利用人工智能改变人物面部影像和生成特定声音的技术。前者主要处理视频或图片中的脸部特征、表情和动作,后者则根据文字、录音或声音样本生成新的语音。两种技术结合后,可以让画面中的人物“像某位明星”、声音也“听起来像某位明星”,但技术上能够实现,并不代表使用者自动拥有对方的肖像权、声音权益或商业授权。
需要注意的是,换脸和合成声并不是简单的“复制粘贴”。它们往往会对原始素材进行分析、预测和重新生成,因此即使画面或声音很逼真,也可能在细节处留下痕迹,例如嘴型与语音不同步、咬字过于均匀、背景反射异常、情绪与语境不匹配等。
对普通用户而言,最值得关注的不是如何无限接近某位明星,而是能否证明素材来源合法、生成内容不会误导他人、权利人能够控制使用范围,以及观众能够清楚分辨真实信息和合成内容。把明星脸和声音用于经许可的创作,可以体现人工智能在影视、教育和无障碍服务中的价值;把它们用于冒充、欺骗和虚假背书,则会放大技术带来的社会风险。
第三步,控制生成内容。不得让合成对象发表虚构的政治立场、医疗建议、投资承诺、产品背书或攻击他人的言论。涉及未成年人、敏感人物、公共事件和新闻信息时,应提高审核等级,必要时直接改用原创角色。