ACE虚拟歌姬 & ACE Studio 商业化预告
ACE虚拟歌姬
2022年07月06日 19:47

各位用户父亲们,大好,这里是老郭(时域科技的首席摸鱼师)。

首先,开门见山的讲,这是一篇关于 [ACE虚拟歌姬]  以及 [ACE Studio] 即将启动商业化(就是要恰饭了的意思)的预告。(大约1-2个月后)

这里以我个人的口吻,代表一下团队的小伙伴们,给大家啰嗦一下子。

为了节约您宝贵的时间(虽然我写的很啰嗦,所以也不太能节约您的时间),浅列一下提纲,接下来的内容将这样展开:

1.讲一讲我们真心认为的,商业化的重要性,就是【为什么要商业化】

2.讲一讲【商业化的大体方案】

3.【闲聊部分】(全是废话,可以不看,浪费大家的时间了,果咩那塞!)

【1.为什么要商业化】

那当然是为了赚钱!但是赚到的钱,拿去干什么,投入到哪里,这可能才是问题的核心~

投入研发,推动效果/提升体验/开拓场景:

首先,作为一个技术驱动的团队,我们团队具有较高的人力成本开销。

其次是服务器成本,我们希望提供给每个人无妥协的高质量歌声表现,不论PC端/移动端,不管配置如何。因此我们选择了云端渲染架构,而这也意味着高昂的云服务器算力成本。(如果是本地渲染,算力成本分摊给了每个用户,这意味着厂家无需大额的服务器开销,但用户需要购买较好的设备,)

然后是数据成本,AI歌声合成需要收集与标注大量的歌声数据,这部分的成本也非常昂贵。

如果可以进入商业化的可持续发展通道,我们将会有更多的钱建设更完整的团队,投入到歌声效果的提升,为大家带来更丰富的参数、更多样的唱法、更多元的歌手;

将会有更多的钱投入到产品和工程的优化,开设更多服务器,为大家带来更丝滑的产品手感,以及更丝滑的合成速度;

也将会有更多的钱让我们在更多延展领域带来颠覆式的创新,包括语音合成领域、声音转换领域等(就像我们拓展了歌声合成领域的表现力上界、带来了声线唱法混合、全AI参数等技术)。

投入推广,让更多创作者使用 ACE :

很多人可能会忽视的一个道理是:一个产品被更多用户使用,会让其为每个用户创造更多的价值。

这是因为,更多的用户意味着更广泛、更大面积的用户反馈,意味着更快速和高密度的产品改进迭代。稳定丝滑的体验不是开发者做出来的,而是大量用户帮你磨出来的(就好比大量长期的水流可以将粗糙的石头打磨成鹅卵石)。

同时,更多的用户意味着更友好的用户生态,当很多人都在用的时候,新人更容易找到最新的教程,互帮互助的社区论坛,疑难问题的解决方案,以及愿意带带你的老司机...

而良好的商业化,可以支撑可持续的营销推广,从而让更多创作者知道ACE,使用ACE,为ACE付费,产生的收入又可以支撑我们将ACE推广到更多人面前。最终,希望 ACE 成为全球音乐创作者都在使用的日常工具。

利润分成,养起来一个生态:

最后一点,是我最希望看到的。如果能够通过ACE(或者与同行们一起),养活起一个全新的生态,这将是一件无比美妙的事情。

这个生态可能长这个样子:

通过研发不断投入带来的效果提升、体验提升,以及推广投入带来的使用者规模的提升。

我们希望看到的是,未来每年产生的新歌当中,相当比例(例如:超过50%)的人类歌声来自AI合成。

而“歌声调校师”,作为AI歌手背后真正的演唱者、表达者,成为一个体面的职业,就像现在的录音师一样,是音乐生产环节中不可或缺的重要职业。

而人类歌唱家们,将成为AI歌手背后的训练源泉,他们的歌声训练出的AI歌手,代替他们参与到一个又一个具体的音乐作品当中,而每一次参与,都会为其背后的人类歌手提供一定的收入分成。

(我们可能在商业化后的半年内,就会启动利润分成模式,将利润中的一部分按照合成调用量比例,分成给AI歌手背后的中之人、运营者们)

我们这个小团队因为热爱相聚在一起,从戳一下唱一个字的小app做起,到现在能用毫不妥协的AI技术赋能创作者,我们很骄傲。收获大家如此多的喜爱与支持,我们无比荣幸。我们相信热爱可抵漫长岁月,但也意识到,商业是技术的铠甲与翅膀

【2.商业化的大体方案】

这一部分比较简略,因为具体的定价还没有计划好,还在讨论、调研当中。

但是大体上的想法有两个关键点:

1.不提供买断,只采用会员收费的方式:这是由于,我们的歌声渲染基于云服务,并且会持续保持更新,因此无论从成本结构还是从服务性质上讲,会员收费都是更匹配的。

2.不按照单独歌手进行收费,而采用会员制,购买会员的用户将可以使用现有以及未来的所有歌手(以及ACE虚拟歌姬的自制歌手功能):因为我们深感单个歌手售卖,会让创作者陷入选择困难症,除了粉丝向的创作者,大多数人需要的是更丰富的声线,在合适的歌曲中去选择合适的声线。

上述想法都还停留在讨论阶段,请大家给我们一些时间。

【3.闲聊部分(无重要内容,请大家略过)】

最近,我偶尔在ACE虚拟歌姬的B站官号上自己“挖坟”,去看这个“梦开始的地方”:https://www.bilibili.com/video/BV1ab41187Nd?share_source=copy_web​

这个戳一下就开口唱歌的小玩意,是ACE的前身。它甚至不是一个发布过的app,仅仅是在我们手里的一个小demo。之后,我们重新采样了音源,购买了廉价的live2D成稿,发布了 ACE虚拟歌姬0.1版本,有了最开始的“莫挨爷”组合(小夜 小莫 小艾)。起名都起的很随意,被很多用户笑话说像是娱乐会所陪酒姑娘的名字(这是可以说的吗?/狗头)。

我们把这个ACE的0.1版本当作音乐游戏发布到了TapTap以及app Store上,没想到有那么多人喜欢它,瞬间登顶了TapTap三榜第一,用户爸爸们不吝惜的给我们好评。

0.1版本完成了最基本的旋律写作功能,填入歌词,选择BGM,滑动手指就能大致搞出一首勉强能称之为“歌”的东西。

那个时候印象最深的是两首歌,第一首叫《回家过年》,是我在2020年过年期间用ACE随手弄完丢到家人群的(极难听,不建议大家去搜),那个时候已经7年没回老家了。弄完自己再看一遍,把自己看哭了。写了大雪封山的老家,老年痴呆的外公,写了“时间匆忙,人会长大,有人路过,有人留下”...

第二首叫做《一年盛夏》,是一个叫“欧若拉剑”的A主写的(虽然旋律很好,但那时候的歌声合成效果也实在没法听,所以也不建议大家搜)。他写了他跟ACE相遇的故事,他写“手指在屏幕胡乱的划,声音也有些嘈杂,没关系全部交给我吧,奏响你的旋律吧”,他写“你的眉头皱巴巴(指当时的小夜原画),是遇到挫折了吗?没关系的不必害怕,失败是成功的妈妈。不要放弃抬起头吧,一起笑着面对吧”。

那个时候,随着ACE在TapTap上的火热,也引来大量的质疑,大量虚拟歌姬/歌声合成领域的核心粉丝嘲讽ACE是低质作品制造机,歌姬圈毒瘤,仿佛我们在做一件很不好的事情,污染了虚拟歌姬这个领域的纯洁性。同时,我们在启动的第一轮融资也屡屡碰壁,大家也无法理解这个唱歌如此难听的小玩意到底有什么用。我记得当时是2020年的夏天,我坐在马路牙子上,刚打完一个不顺利的融资电话。看到了这首歌,瞬间破防了,哭的像个30岁的孩子。

之后我们开始不断优化创作工具,增加滑音功能,增加调校功能,在移动端实现了钢琴卷帘。试图通过创作功能的优化提高ACE作品质量的上限。然后增加了社区,更换了所有歌姬的原画模型,希望让ACE看起来不再是个廉价的小玩具,希望创作者们有个交流分享的地方。

记得我们2020年7月开了个会,把小伙伴们叫在一起,开最大音量,播放了一首苍穹的《涟漪》,又播放了一首赤羽的《404 not found》(没错当时我们认为std声库就是虚拟歌姬的天花板了)。然后给大家说,ACE要超越这种效果,要成为世界上最强的移动端歌声合成引擎(当时还要带上“移动端”作为修饰词,说明真的不太自信)。

直到2020年下旬,我们逐渐意识到,如果达到超高的歌声表现,仅仅靠创作功能的优化是不够的,必须有更大的技术变量,我们开始研究AI歌声合成。一段时间之后,我们做出了1.0的歌声模型,并在2021年1月份上线,当时还无法在创作中随时合成,必须要先写好一个非AI的作品,然后丢到一个叫“合成站”地方,等上个10来分钟。但即使这样,AI1.0的效果也让我们看到非常大的曙光,原来AI真的可以让虚拟歌姬的歌声如此自然啊。

一入AI深似海,从此天天是挑战。1.0的小夜很小夜,但是用1.0做出的火涟也很小夜,歌手的辨识度被粗糙的模型抹杀。我们开始逐渐打造全流程无妥协的AI模型。神经网络vocoder,高表现力的音色模型,全AI的参数模型等等。

折腾到2021年7月份,终于觉得差不多了,虽然还不够稳定,但是我们还是冒险的把2.0的模型上线了。结果,这个模型过于不稳定,导致歌姬们唱歌开始疯狂跑调,声音也经常非常嘈杂(高频噪声),每天A主们都在抱怨说这个版本不如1.0小夜好听,要原先的小夜回来。

我们很伤心也很羞愧,有的时候努力半天可能发现,你不但没有进步,还退步了...但是我们坚信无妥协全AI的力量,坚信2.0的优化上限要远高于1.0,当时我们没日没夜的改bug,做优化。同时在客户端上,增加触屏式的调参功能,不但在移动端实现了稳定丝滑的钢琴卷帘体验,甚至还实现了丝滑的触屏调参。逐渐逐渐,AI2.0的效果在2021年12月将这个版本稳定下来。

并且在这个过程中,推出了世界第一个民族唱法的AI歌手:鲤沅。鲤沅发布试听曲的那一刻,很多人过来说“这竟然是虚拟歌手??”,我们摸摸额头上的汗,回过头看看过去几年的经历,突然意识到,在歌声合成技术上,我们仿佛已经站在世界顶尖的位置了。自己都觉得不可思议。

接下来的不可思议还在继续。22年过年期间,不愿意走亲戚又闲的无聊的阿元,灵光一闪地发明了4个AI参数,又让歌声的表现力上限和可调性都大幅提高,这带来了3.0版本的AI模型。

然后是洛天依的到来,我们通过N个原创的技术要素,神奇的塑造了一个充满洛天依味道又更加自然的洛AI,而这件事的难度远大于创造一个有音源歌手作为数据源的AI歌手。毕竟,世界上不存在一个人类能够像洛天依一样演唱,这次这个AI是不存在训练数据的。

自22年初第一首洛天依AI的歌曲《一梦千宵》发布以来,到5月份的洛天依AI内测,海量的洛AI作品发布,圈内沉寂的未沉寂的P主们都纷纷出手,就连教主ilem也用小号发布了洛AI的翻调,还创造出了圈内著名的“快的邪门的破自行车”梗。

说到破自行车(ACE Studio),2022年3月才开始启动开发的ACE Studio(电脑版),也于4月底开始内测,申请人数快速突破2000(我们的内测申请还要求带作品链接,门槛还是有点高的)。疯狂的开发速度也带来内测版大量的体验问题和bug,但是就像21年7月我们坚决上线还不成熟的2.0模型一样,我们坚信快速上线、直面批评、快速迭代才是加速优化的最优路径。也辛苦团队的所有小伙伴了。

我们这一路的高歌猛进,也引来了某个很有钱的竞争对手的关注,开始使用钞能力对我们进行狙击,通过远高市场价的薪资对我们进行挖人(同一时间段的几周内,ACE虚拟歌姬自上线以来第一次遭遇举报,并且被举报超过10次,这导致我们迫于压力下架应用,当然这一点我没有证据是被恶意针对)。并且,由于竞争对手的某些操作,使得ACE Studio即将开启的公测计划也受到了极大影响,给公测带来了一个跟之前预期不符的巨大的变量。

这一系列的坏消息给我们造成了非常大的压力和困扰,也确实对我们的产品技术研发造成了影响。但我们没有一刻想过使用同样的手段回击竞争对手,专注在技术突破和产品迭代才能更好的为虚拟歌手圈做出我们自己的贡献。

我们告诉自己要更加努力,坚持做对世界有价值的事情。我们坚持为这个世界带来毫无妥协的高表现力AI歌声,把最先进的AI技术封装进用户的手机和电脑里,让音乐表达成为一件众生平等的事情。

这是我们理解世界的方式:用爱对抗黑暗

商业化能力的建立,将是我们能够可持续良性发展、不断为大家带来更好的技术与体验的动力源泉。