随便用别人的声音说话?这个热门功能背后藏着技术与法律双重门道

发布时间:2026/8/3 12:42:40

很多人刷到过“不用本人开口,就能用别人的声音说话”的短视频,以为是后期配音,其实背后是AI声纹复刻技术在支撑,看似简单的一键生成,背后藏着完整的技术逻辑链条。

首先是声纹特征提取环节,工具会从目标人物的公开音频素材里,剥离掉背景噪音、混响等干扰信息,精准抓取音色、语速、咬字习惯、情绪起伏等几十项核心声纹特征,把这些信息转化为专属的数字声纹模型,相当于给声音建了一个“数字副本”。

之后进入语音合成环节,AI会根据你输入的任意文本,匹配这个专属声纹模型,逐字生成符合原说话人发声习惯的语音,甚至能还原对方独有的小停顿、语气助词等细节,让生成的语音几乎听不出合成痕迹。

但这个功能的“门道”不止技术层面:未经授权提取他人声音用于商业用途,已经涉嫌侵犯肖像权与声音人格权,不少平台已经上线了声纹授权校验机制,一旦发现非本人授权的复刻内容,会直接做下架处理,避免技术被滥用。

讯飞星火认知大模型

综合性能显著提升,整体对标OpenAI o3;复杂问题分步拆解,回答效果深入全面,参考信源丰富优质;深入垂直场景与核心需求,为个体和企业提供开箱即用的大模型应用;星火大模型API让您的应用快速拥有领先的AI大模型能力,接口丰富,价格灵活,支持在线调试

扒站工具