前段时间刷手机,看到一条消息说某头部音频平台上的AI配音功能又升级了,输入文字就能生成几十种音色,从醇厚男中音到甜美女声,从方言到外语,几乎能想到的都能合成出来。评论区里有人叫好,说做短视频方便多了,省了请配音的钱;也有人叹气,说认识的配音演员最近接单量掉得厉害,有的报价从一条几百块跌到几十块,收入直接降了八成。

打开网易新闻 查看精彩图片

其实这事不是突然发生的,过去两年AI语音合成技术一直在迭代,只是很多人没注意到它已经渗透到有声书、短视频旁白、广告片、游戏角色、导航语音这些领域。你想,以前一条几十秒的广告配音,找个熟手至少几百上千,现在用AI工具,输入文案,选个音色,几秒钟就出来了,成本几乎为零。对甲方来说,账太好算了。说白了,这不是技术好不好用的问题,是技术用得太顺手,顺手到把人的饭碗端走了。

我有个朋友以前做有声书录制,一个月能接两三本书,每本几千块,虽然累但收入还算稳定。去年开始,平台推AI有声书,同样的文本,AI能一口气录完,还能模仿不同角色,后期剪辑也省事。他现在的活儿少了一大半,剩下的要么是要求特别高的,要么是甲方懒得折腾AI的。他跟我说,最难受的不是没活儿,是那种“你干了十几年,突然发现自己的声音可以被复制、被拼接、被无限次使用,而你一分钱拿不到”的感觉。

打开网易新闻 查看精彩图片

这话听着挺扎心的。其实AI“偷声”这事,比抢活儿更麻烦。抢活儿是市场选择,偷声是侵权。你想想,一个人的声音,跟他的脸、他的笔迹一样,是身份的一部分。现在有些AI工具,只要你上传一段几十秒的录音,就能克隆出你的音色,然后拿去做任何内容,你根本不知道。网上已经有网友发现,某些短视频里的旁白,声音跟自己关注的一个配音演员一模一样,但那个演员根本没授权。这种事放在谁身上都难受,就像有人拿你的照片去相亲,你都不知道该找谁说理。

这事让我想起前几年讨论很热的“换脸”技术,当时大家也慌了一阵,后来出了规定,要求AI生成内容必须标注,不能随便用人脸。声音这块,目前的规定还比较模糊。民法典里提到声音受保护,参照肖像权,但具体怎么界定“模仿”和“侵权”,怎么证明一段AI音频是来自某个人的声音,取证很难。而且很多AI工具在用户协议里藏了一行小字,说你上传的素材你负责,平台不担责。普通人哪会逐字看那些条款?说白了,技术跑得太快,规则还在后面追。我现在的办法是,如果我要用AI配音做东西,尽量选那些明确说“音色来自公开授权库”的工具,或者自己录自己用,不碰别人的声音。虽然麻烦点,但心里踏实。

打开网易新闻 查看精彩图片

其实配音演员收入降八成,不光是AI的锅。整个内容行业都在变。短视频兴起后,长音频的需求被切碎了,有声书、广播剧的付费意愿也在降。再加上经济环境,甲方预算收紧,能省就省。AI只是加速了这个过程。你想,以前一个广告片,配音、配乐、剪辑各是各的活儿,现在一个人用AI工具就能全包。这不是配音一个行业的事,是很多中间环节都在被压缩。我认识一个做后期剪辑的,他说现在AI能自动卡点、自动调色、自动生成字幕,他的活儿也少了很多。这种时候,抱怨技术没用,抱怨时代也没用。我自己也在试,把AI当成一个工具,而不是对手。比如我做短视频,以前要花一两个小时录旁白,现在用AI生成初稿,我再自己调整语气、节奏,效率高了不少。关键是,你得让甲方知道,AI出来的东西和真人调出来的东西,差别在哪里。这个差别,就是你的价值。

打开网易新闻 查看精彩图片

说到差别,我想起一个挺有意思的现象。现在网上有些AI配音,听起来字正腔圆,但总感觉少了点“人味儿”。比如念到“妈妈做的红烧肉”这句话,AI就是平铺直叙,但真人配音会不自觉地放慢一点,带点温度。这种细微的东西,AI暂时还学不会。就像南方人听北方人说话,觉得干脆利落;北方人听南方人说话,觉得软糯温柔。这种地域带来的语感差异,AI可以模仿,但很难真正理解。我有个在成都做配音的朋友,他说他的优势就是能用四川话配出那种“麻辣”的感觉,AI虽然也能合成四川话,但听起来像外地人学说四川话,味道不对。这就是人的空间。说白了,AI能干掉的是标准化、重复性的配音,干不掉的是有个人风格、有情感温度、有文化底蕴的配音。

这事往大了说,其实跟很多行业面临的处境一样。外卖骑手被算法催着跑,网约车司机被平台抽成,现在配音演员被AI抢活儿。技术提升了效率,但效率的红利归谁,是个问题。你想,AI配音省下来的钱,是进了甲方口袋,还是降了消费者的价?好像都没有。有声书还是那个价,广告还是那个价,只是中间干活的人换了。这种时候,光靠个人努力是不够的。我现在的办法是,多学点AI工具的使用,别让自己被落下;同时,如果遇到自己的声音被侵权,该投诉投诉,该发声发声。虽然麻烦,但总比什么都不做强。

打开网易新闻 查看精彩图片

网上有人评论说,AI配音挺好,以后不用听那些千篇一律的播音腔了。也有人反驳,说AI配音才是千篇一律,真人配音才有灵魂。这种争论,跟当年讨论机器翻译会不会取代人工翻译一样,最后发现,简单的活儿机器干了,难的活儿还是得人上。配音这行,以后可能两极分化:一边是AI批量生产的廉价配音,一边是真人精雕细琢的高端配音。中间那层,最难受。我认识的一个配音演员,以前什么活儿都接,现在只接纪录片和高端广告,因为那些甲方要的就是“人味儿”。他说,他现在花更多时间练基本功,研究不同角色的语气,甚至去学方言、学戏曲。这些投入,AI暂时替代不了。

说到方言,我想起一个事。前阵子有个短视频用AI合成了某地方言配音,结果当地网友一听就笑了,说这口音像外地人学了三天。方言这东西,不是简单换个发音就行,它背后有当地的生活节奏、幽默方式、甚至气候影响。比如东北话的豪爽,跟天冷有关系;广东话的绵软,跟湿热有关系。AI能学个大概,但学不到骨子里。这就是人的优势。我自己也在试,如果我要做跟地方文化有关的内容,尽量找当地配音演员,哪怕贵点,出来的东西对味。消费者其实能听出来,只是有时候图便宜不说。

打开网易新闻 查看精彩图片

其实配音演员收入降八成,不光是AI的事,也不光是配音的事。它反映的是整个内容生产链条在重构。以前需要很多人协作的事,现在几个人甚至一个人就能干。这种变化,对消费者来说,可能意味着更多、更便宜的内容;对从业者来说,意味着必须找到自己不可替代的地方。我现在的办法是,不跟AI比效率,跟它比温度、比个性、比文化理解。同时,我也在关注相关的政策,比如声音权怎么保护,AI生成内容怎么标注。这些事,光靠个人解决不了,得靠规则。但规则出来之前,自己得先有意识。

说到规则,最近看到有些平台开始要求AI配音必须标注“AI生成”,这算是个进步。但执行得怎么样,还得看。我试过几个工具,有的标了,有的没标,有的标在角落,不仔细看根本注意不到。这种时候,消费者自己得留个心眼。如果你听到一段配音,感觉像某个人,但又不太确定,可以去查查有没有授权。如果没有,那就是侵权。虽然普通人管不了太多,但至少可以不传播、不点赞。说白了,市场是大家一起养的,你支持什么,什么就活得好。

打开网易新闻 查看精彩图片

其实这事往深了想,跟咱们日常生活中的很多选择一样。比如买菜,你图便宜买AI配音的,还是多花点钱买真人配音的?这没有标准答案,看你在意什么。我在意的是,如果有一天,所有声音都是AI合成的,那世界会多无聊。就像你去饭馆吃饭,全是预制菜,方便是方便,但少了锅气。配音也是一样,真人配音有呼吸、有停顿、有情绪起伏,这些细微的东西,才是内容有温度的原因。我现在的办法是,自己能做的地方自己做,做不了的地方,尽量找真人。虽然慢点,但心里舒服。

说到底,AI是个工具,用它的人决定它干什么。如果用它来偷别人的声音,那就是侵权;如果用它来辅助创作,那就是效率。我现在的办法是,把AI当成一个助手,而不是替身。比如我写文章,会用AI查资料、理思路,但最后成文还是自己写。配音也一样,可以用AI生成初稿,但最终版本自己调。这样既省了时间,又保留了个人风格。关键是,你得知道自己在干什么,别被工具牵着走。

打开网易新闻 查看精彩图片

最后,我想说,配音演员收入降八成,这事听着挺吓人,但也不是没出路。我自己的办法是:第一,多学点AI工具,别让自己被落下;第二,找到自己不可替代的地方,比如方言、情感、文化理解;第三,遇到侵权,该投诉投诉,该发声发声;第四,如果可能,支持那些用真人配音的内容,哪怕贵点;第五,别把AI当敌人,把它当工具,用它省下来的时间,去提升自己。这些事,说起来容易做起来难,但总比干等着强。我自个儿也在试,一边试一边调整。日子还得过,活儿还得干,只是干法得变变了。