
大伟哥10月29日在其母校上海交通大学进行了人工智能方面的讲座,从中我们可以大概了解米哈游的技术储备情况,许多技术很可能会首先应用在预计2020年公测的“原神”上,让我们一起来看看吧~

本文讲座现场图片主要来自贴吧用户“任凭风渤起”的帖子:上午去听了那个"人工智能遇上逆熵科技"的讲座,就给大家稍微汇总
我在上文的基础上增加了一些资料补充,结合多方资料汇总而成本文。

任凭风渤起:首先是大伟哥被聘为我校创业导师(哪个学院我忘了,不过估计是个虚职,类似于荣誉称号吧)

任凭风渤起:之所以叫逆熵科技,是因为mihoyo创立了一个逆熵研究院,大概也可以叫做米哈游人工智能研究院吧。
金色飞贼:道理我都懂,为啥逆熵研究院ppt上的配图是原神里的琴。

任凭风渤起:和我之前想的差不多,mhy现在正在进行的研究的目标是为了提高工业化生产中的生产效率,解放生产力。主要做了以下几个方面的研究:
1.场景建模
2.纹理迁移
3.布料建模
4.布料动画
5.人脸捕捉
6.声音合成
7.动作风格迁移
任凭风渤起:以下内容均为我听了之后总结的,不保证准确。许多专业内容,没有接触过人工智能的同学可能不太能听懂,采用了概括的方式进行了讲解。
1、场景建模
任凭风渤起:在建造大型场景,如草原、森林、大型建筑物等时,每一个模型都由建模师手动建造是不现实的。以树木为例,传统的方法是由建模师建造一些树木模型,在此基础上对这些模型的一些特征(如:树杈的位置、数量等)进行随机处理(借用高斯函数...)从而获得大量不重复的模型。然而这样的方法得到的模型在大规模应用时还是用规律的、重复的。
逆熵研究院现在在做的是借助深度学习的方法从积累的模型数据集的基础上学习各种模型的有用特征,从而自动生成各种风格的大规模场景建筑模型。

金色飞贼:莫非原神的开放世界地图构建时会采用类似技术?类似的场景合成技术在国外各大开放世界游戏构造中已经有广泛的应用。毕竟树木、房屋这类在地图上的数量很多,复制粘贴容易出戏,人工一个个手动建模工作量又很大。
2、纹理迁移
任凭风渤起:与渲染相关的最重要的部分就是材质和光照,逆熵研究院在做的是:将给定图片上的纹理迁移到3D建模的表面,其好处在于图片作为数据集,数据量很大(图片好找/画)。同时纹理也不再局限于表面,当物体破损后,新露出的表面也拥有相似的纹理。

金色飞贼:我第一反应是这部分主要是为玩家能够破坏地形或破坏物品服务的,许多游戏为了贴近真实都会在游戏内添加场景破坏的内容,甚至场景能否破坏能够影响到游戏的体验(萌新在彩虹6号里不知道死多少次了)。
3、布料建模
任凭风渤起:这部分走神了,没仔细听,不过大概和场景建模相似。

金色飞贼:233 真实的大学生听课状态。
4、布料动画
任凭风渤起:由动补或k帧得到的人物运动信息是没有穿上布料的,要在后期为人物加上衣服布料,并为其配上与人物运动匹配的动画(运动)。
传统方法是由动画师密集的k,每几帧手动调整一次,中间帧自动平滑过渡,这样可以得到任意我们想要的结果,但工作量巨大。
另外的方法就是由物理引擎根据物理规则自动计算布料的运动,但这样的方法生成的动画是严格符合物理规则的,很多时候并不是我们想要的结果,且需要调整许多参数。
逆熵研究院做的是通过增强学习的方法训练模型,从而让动画师根据喜好,调整个别关键帧(很少),通过模型(model)自动解读动画师的想法,生成完整的动画。对生成的结果不满意的地方也可以随时改动,其他部分也会随调整自动调整。

金色飞贼:这图我认识!上图的内容已经在一篇文献中出现过了。具体来说,早在10月17号的崩坏3官方推特转发了一篇报道,主要就是关于米哈游的研究人员写了一篇人工智能在布料渲染方面应用的论文。

虽然报道是日语,但论文是英文论文,感兴趣的可以下载详细阅读。

第一作者为米哈游员工,二三作者来自不同大学。现在校企合作研究在各大公司现在已经十分常见,如果在一些学术文章搜素引擎上搜索第一作者公开发表过的学术文章还会有更多发现,可以一窥米哈游此方面的人才素养和发展方向。因为可能涉及作者个人隐私就不详细分析啦,感兴趣的可以自行搜素。
(查过的表示,真的是大佬)
5、有标记/无标记的人脸捕捉
任凭风渤起:标记就是在脸部标记关键点,根据关键点的运动复原捕捉结果,无标记就是不标记,达到相同的目的。这部分大家应该挺熟悉的,2D/3D动捕通常都会涉及面部捕捉。不过逆熵做的要更加精细,要捕捉到细微的表情之类的。


金色飞贼:面部捕捉技术已经有广泛应用了,许多虚拟主播都采用了此类技术。米哈游利用面部捕捉技术印象里是2018年崩三布洛妮娅的生日特别直播。

6、声音合成
任凭风渤起:通过深度学习,学习声优的声音(包括音色、情感等),做到输入文字自动得到该声优的配音结果,以避免档期不足等情况,同时还能将声优的声音塑造成IP,永久保留。甚至可以出售声音版权(邪恶的商业味道)。这部分和我一年多以前的想法几乎一样,可惜没有动手去实现(实际是太难了)
(动补+人脸捕捉+声音合成=虚拟歌姬,米哈游虚拟偶像成了)

金色飞贼:所以原神中什么时候会有角色为了拯救提瓦特大陆而出道(
印象里米哈游第一次涉及声音合成应该是2016年。

引自萌娘百科
声音合成首先在人工歌姬的歌曲调音中经常用到,后来许多鬼畜视频的制作也用到了声音合成。声音合成的应用基本上都要提前录制并调试好音源,鬼畜区经常听到的葛平音据传就是葛平老师献声提供的音源(鞠躬)。
随着虚拟主播的兴起,现在已经出现了全天24小时均在歌唱直播的Al虚拟歌姬,比如琉璃。

就在b站直播哦
琉璃是在b站全天直播的虚拟歌姬,其声源来自hanser(就是上文提到过的板鸭声优)。理之律者实装后,老司机、骑上我心爱的小摩托等歌曲点歌率直线上升。
琉璃的声音有hanser声音的一些特征,但还是能够听出人工调音的痕迹,大家不要将其和hanser混为一体哦。而且布洛妮娅也只是hanser配音的角色,大家千万不要把配音演员和角色联系到一起哦。

虚拟偶像技术的日渐成熟,大家更希望哪个原神角色出道呢?
7、动作风格迁移
任凭风渤起:没仔细听,大概就是人物在不同状态下的动作风格不同(如饥饿、寒冷、正常状态),如何自动的将这些风格迁移到他们的动作上面(行走,跑步等)。(图二我自己找到,大概能帮助理解)


金色飞贼:原神一测时可以看到地图上有雪山等地貌,有日夜交替等设定。如果上述技术成熟,原神的角色如果能够根据气候或者温度不同有相应的动作变化的话,想必代入感将会进一步提高。
任凭风渤起:剩下的就是大伟哥讲了讲创业经历,逆熵研究院的招聘/合作需求之类的。
(图: 大伟哥当着校领导面放桃源恋歌)

金色飞贼:这个桃源恋歌的视频可以在b站找到,是米哈游在职大佬秀技术力的视频,一般为年更,在以往米哈游对外技术展示时此系列视频也作为案例出场。

所以什么时候原神的角色也可以来一段。
任凭风渤起:最后讲一讲我的想法,我认为米哈游走的道路是正确的道路。大概是理工科背景的原因,我始终坚信"科学技术是第一生产力"这句话的正确性。关心工业和科技的同学应该或多或少从各处听到过第四次工业革命,我也觉得我们已经在第四次工业革命的前夜了,人工智能将会成为这场革命的主角。每一次工业革命都会带来生产力的飞跃,这样的革命通常也会伴随着新旧势力的交替,霸权的易主。mihoyo能顺应时代的趋势,主动拥抱技术,这是他们的优势。相比体量太小,没有能力参与科研的小公司和体量太大患得患失的巨头,mihoyo或许真的未来可期。但不管怎么说,能坚持高投入的研发,这条道路是绝对正确的。只要mihoyo坚持投入研发,我就会一直支持他的
金色飞贼:进步不是一蹴而就的,我很高兴看到米哈游依然投入大量资源进行技术开发,正如他们当年把崩二赚来的钱投入崩三开发一样。希望米哈游勿忘初心,越来越好。

个人总结,如有错误,欢迎大家在评论区补充。
欢迎大家关注米游社查看原神更多消息。
