(A)介绍:
感谢B站up 麦田农夫 展示了如何用软件识别修音问题,我是这个系列的老观众。
如麦田农夫本人所说,这个方法是有一定的主观成分的:判断一个歌手是否有修音痕迹,主要看的是它的音准。而要判断一个歌手是否唱的“太准了”,默认对比的是他原本的唱功。比如,我们看周深或黄霄云在晚会里唱的很准,我们不会有太多怀疑。但如果范玮琪也唱的和他们一样准,那她铁定是开了。
虽然听众大致上知道谁是实力歌手,谁是偶像歌手,这个方法依然不免有主观成分。粉丝对自己偶像的印象是较好的,所以这种方法对于粉丝的说服力并不高;粉丝可以说“我偶像就是能唱得这么好。”
要移除这个“主观”的推理步骤,其实很简单:我们可以拿一个歌手的清唱数据去代表他的“真唱水平”,再和他的舞台音准做一系列统计学上的对比。这就是我们这篇文章的主旨。
《歌手2026》第一期有挂电嫌疑的有两位歌手,周兴哲和胡彦斌。周兴哲的挂电非常明显,在此不做分析。我们专注于分析“胡彦斌挂电与否”。
不卖关子,先说我的分析结果:芒果所播出的,胡彦斌所演唱的《你要的全拿走》,有修音的概率在99%和100%之间。
(B)前言
首先,我们科普一下,俗称的挂电,也就是实时修音(Autotune)。这类工具在现实应用中,是一个针对“长音”(时值较高的音)的纠正工具。为什么呢?
拿实时翻译软件做比方。 假如你跟翻译软件说“How”,翻译软件可以直接给你一个翻译:“如何“。 但如果你想说的是“How are you?”,正确的翻译应该是“你好吗?”,那前面的“如何”就属于欠佳的翻译了。
所以,实时翻译软件会有延迟;它需要收集了足够信息以后才能确认“正确答案”是什么。
同理,实时修音Autotune也需要延迟解决这个问题。假如你在唱“F”这个音,突然升到了“G”。软件需要分辨以下的两个可能性:
(1) 你还是想唱F,只不过突然跑了;
(2) 你就是想转到G,软件应该把G当作新的目标。
软件对付这个问题的方法就是加入一个延迟,叫“Note Transition”(或称Retune Speed):在你唱了“N”秒以后才开始修音。
打个比方,以下是一个人声音轨,每个 ~ 符号代表着“0.1秒”的时长
E ~ E ~ E ~ E ~ F ~ G ~ G ~ G ~ (唱了0.4秒的E,0.1秒的F…)
如果Note Transition (N)设为0.1秒,这就是修音后的结果:
E ~ E ~ E ~ E ~ F ~ G ~ G ~ G ~ (粗黑体代表着被“修”的音;其余的不被修。)
也就是说,假如一个音的时长是t秒,t<N的音是不会被修的;而如果t>N,只有(t-N)的部分会被修。一个音被修过的比例是:

显然,因为“N”是正的常数,一个音的t越高,被修的比例就越大。因此,我们在分析“有没有实时修音”这个问题的时候,时值越高的音就越能体现出“修音”和“不修音”的区别。
但如果我们只记录每首歌最长的两三个音,又会出现样本太小的问题。因此,我们需要一个折中的方案。我选择了只收录t > 0.5秒的长音。这样能在每首歌里提取到30-50个音。
(C)数据来源
首先,我记录《歌手2026》第一期HYB演唱《你要的全拿走》的所有长音。我下载了B站up“不是学弟是学长”当天发的音源(由于版权问题在已被删)。为确保真实性,我也和铁豆钢蛋直播当天reaction里面的音源做了对比。两个音源一样,比如以下这个长音都是刚刚好的-6ct。


我们选用音源1,用Audacity的OpenVINO做人声分离。然后,我们把人声音轨放到音高软件Vovious里,并记录所有长音的偏差。同时,我也把我收录的每个音,其所对应的音高、歌词,时间也都记录下来。如果粉丝觉得这些数据有问题的话,可以自己用软件去检测一下。

其次,我们需要胡彦斌的清唱数据作为对照。为了避免主观想法影响我的选择,我用了B站胡彦斌粉丝“清新的我“所做成的视频,编号是BV1Mi421Y7qp,标题是“【胡彦斌】音准的神!2024清唱音准实时”。
我记录了up手动点出来的音准偏差。时间范围:0:00 to 1:54 (最后一个带声卡的视频不属于清唱,因此不被录入)。注意,这是粉丝点的音,所以即使这个样本有选择性偏差,粉丝也理应是选了hyb清唱里发挥较好的部分。

(D)分析:
以下是胡彦斌清唱音准偏差,舞台音准偏差的分布图


显然,胡彦斌的清唱音准,和他的舞台音准,是有极大的出入的。
疑问:会不会歌手清唱的时候比较随意,舞台上更准?
首先,这个假设从演唱的角度是说不通的:歌手在清唱的时候能听到自己的音准,而在舞台上需要依赖耳返才能听见自己的声音。舞台表演也有心理因素、体力因素、现场乐器或者program的干扰。因此,职业歌手的共识是,舞台上唱歌比清唱要难很多。
我们也可以用数据印证这个问题。为了参考和对照,我寻找了上季《歌手2025》中有清唱的歌手,发现了单依纯《珠玉》、《有趣》这两首歌都有清唱版本也有舞台版本。我们把这些数据记录下来作为“对照样本”。

接下来,我们把对照样本和胡彦斌的样本放在一起比较一下:


我们可以看出,对照样本(25年单依纯)从清唱到舞台演出是稍微退步的。偏差高了约4ct,“准音”的比例减低约8%。这符合了职业歌手的共识的。
而胡彦斌的偏差却少了整整7倍,“准音”从约四分之一提升到接近一百,属于不正常现象。
那么,有多不正常呢?我们做三个统计学上的测试:
(测试一)我们先用Welch’s t-test去计算“胡彦斌清唱样本,胡彦斌舞台样本 来自同一个分布”的可能性。数学定义:

运算用的是R里面rstatix的t_test功能。
检验结果:

结论:如果胡彦斌清唱样本和舞台样本来源于同一个正态分布,那么观察到这么大的音准偏差差异的概率约为6.40e-19。
也就是: 0.000000000000000064%
(测试二)如果音准不属于正态分布呢?我们可以用Mann–Whitney U test (Wilcoxon rank-sum test)。这个测试不要求数据来自正态分布。
检验结果:

这里, p值已经小到无法用x64算出它的小数点了。换句话说,即使不假设音准偏差符合正态分布,胡彦斌清唱与舞台之间的差异依然极难用随机波动解释。
(测试三)有没有可能,“清唱”和“《歌手》舞台”属于不一样的条件,因此音准也有出入?对付这个问题,我们用对照样本(25年单依纯),进行一个difference-in-difference测试。这里贴一个简单的图。知乎对这个方法有仔细的介绍,有兴趣的可以去读。

运行这个测试,用的是R基础stats的lm()功能。

p值为2.96e-14。因此,胡彦斌舞台音准的提升不能用“舞台环境效应”去解释。
总结:
感谢麦田农夫,感谢催更的各位兄弟。
希望《歌手2026》节目组做出调整,不要破坏舞台竞技的公平性。
我不是周深粉丝,不要发私信给我辱骂周深,这样真的很没素质。我纯粹是为了爱好而去做这个分析。