关闭

语音合成、歌声合成等语音信息处理技术

为了建立一个每个人都可以顺利获取信息并与他人交流的社会,我们正在研究基于深度学习等机器学习的语音合成。我们正在探索的技术不仅可以生成简单的朗读声音,还可以生成包括情感和强调等表达方式的富有表现力的声音。我们还在研究如何指定合成语音的语音质量,例如自然语言语音质量控制语音合成,允许用户使用文本指定语音质量和说话风格,以及跨模态语音合成,从面部图像再现声音。此外,为了实现多种人类语音表达,我们不仅在口语方面,还在歌声合成方面进行研究。我们正在探索产生更优美歌声的技术和再现歌手特征和习惯的技术。除此之外,我们还正在研究说话人识别技术,该技术可以确定声音是否来自于本人,作为使用声音的个人认证技术。

信息工程学院|副教授

桥本耀西(桥本圭)

桥本圭

4 人人享有优质教育
9 让我们为产业和技术创新奠定基础
10 消除人民和国家之间的不平等

关键字

语音信息处理
语音合成
歌声合成
语音质量转换
说话人识别

领域/项目

研究类别

人类信息学

研究主题

  • 语音合成和歌声合成研究
  • 语音质量转换研究
  • 说话人识别研究

留言

我们相信,语音合成技术的研究将导致实现一个每个人都可以顺利获取信息并与他人交流的社会。例如,通过使用语音合成技术朗读文本,可以支持视障人士获取信息,并且可以支持言语障碍人士进行声音交流。我们也相信,对歌声合成技术的研究将导致实现一个人人都可以参与创作的社会。即使没有专门的歌唱技巧或环境也可以创作音乐,有望扩大音乐表现的可能性。除此之外,我们还在利用说话人识别技术进行个人认证和安全方面的研究。通过对这些语音信息处理技术的研究,我们将为实现更加富裕的社会做出贡献。