一种声音采集的方法、装置、设备和计算机存储介质

    公开(公告)号:CN110289010A

    公开(公告)日:2019-09-27

    申请号:CN201910521230.5

    申请日:2019-06-17

    Inventor: 陈昌滨 卞衍尧

    Abstract: 本发明提供了一种声音采集的方法、装置、设备和计算机存储介质,其中方法包括:声音采集装置播放预设的语音片段的同时,采集第一声音数据;采集用户对所述语音片段的跟读声音数据;利用声音干扰系数对所述跟读声音数据进行去干扰处理,得到第二声音数据,其中所述声音干扰系数是利用所述语音片段和所述第一声音数据确定的;利用所述第二声音数据,得到用于语音合成的训练数据。通过本发明提供的方式能够提高采集的声音数据的质量。

    用于输出信息的方法和装置

    公开(公告)号:CN110930975B

    公开(公告)日:2023-08-04

    申请号:CN201811597465.4

    申请日:2018-12-26

    Abstract: 本申请实施例公开了用于输出信息的方法和装置。该方法的一具体实施方式包括:获取待标注的样本音节对应的基频曲线;从基频曲线中提取出基频序列;将基频序列转换成样本值序列;将样本值序列与已知边界调类型的基准序列进行聚类,得到样本值序列的边界调类型作为待标注的样本音节的边界调类型,以及输出待标注的样本音节的边界调类型。该实施方式实现了在英文语音合成系统中的边界调的自动标注,从而缩短了标注时间并节约了成本。

    用于输出信息的方法和装置

    公开(公告)号:CN110930975A

    公开(公告)日:2020-03-27

    申请号:CN201811597465.4

    申请日:2018-12-26

    Abstract: 本申请实施例公开了用于输出信息的方法和装置。该方法的一具体实施方式包括:获取待标注的样本音节对应的基频曲线;从基频曲线中提取出基频序列;将基频序列转换成样本值序列;将样本值序列与已知边界调类型的基准序列进行聚类,得到样本值序列的边界调类型作为待标注的样本音节的边界调类型,以及输出待标注的样本音节的边界调类型。该实施方式实现了在英文语音合成系统中的边界调的自动标注,从而缩短了标注时间并节约了成本。

    韵律预测方法、装置、设备和介质

    公开(公告)号:CN110797005A

    公开(公告)日:2020-02-14

    申请号:CN201911072965.0

    申请日:2019-11-05

    Abstract: 本申请实施例公开了一种韵律预测方法、装置、设备和介质,涉及数据处理领域,尤其涉及语音合成技术。该方法包括:对待预测的中英混合文本进行切分,得到中文文本和英文文本;确定中文文本中文字的字向量和英文文本中单词的词向量;根据确定的字向量和词向量,确定所述中英混合文本的韵律预测结果。本申请实施例提供了一种韵律预测方法、装置、设备和介质,提高了对中英混合文本的韵律预测准确率。

    语言模型预训练方法和装置

    公开(公告)号:CN110941945B

    公开(公告)日:2021-03-23

    申请号:CN201911214094.1

    申请日:2019-12-02

    Abstract: 本申请公开了语言模型预训练方法和装置。该方法的一具体实施方式包括:获取初始语言模型,初始语言模型用于确定输入到初始语言模型的文本数据中包含的字之间的关联关系;获取训练初始语言模型的训练样本集,训练样本集中的训练样本包括样本数据、第一标注信息和第二标注信息;将样本数据作为输入,将第一标注信息作为与初始语言模型的第一输出端连接的初始去噪自编码模型的期望输出,并将第二标注信息作为与初始语言模型的第二输出端连接的初始序列到序列模型的期望输出,对初始语言模型、初始去噪自编码模型和初始序列到序列模型进行预训练,得到训练后的语言模型。该实施方式可以显示捕获文本的音韵信息,有效提升了语言模型输出文本的语义表示效果。

    韵律停顿等级预测的校正方法、装置、设备和介质

    公开(公告)号:CN110853613A

    公开(公告)日:2020-02-28

    申请号:CN201911119829.2

    申请日:2019-11-15

    Inventor: 聂志朋 陈昌滨

    Abstract: 本申请公开了一种韵律停顿等级预测的校正方法、装置、设备和介质,涉及韵律停顿等级预测技术。具体实现方案为:获取输入文本的韵律停顿等级的初始预测结果序列;获取所述初始预测结果序列的状态向量,其中,状态向量用于表示所述初始预测结果序列中各元素之间的依赖关系;将所述输入文本的语义向量与所述状态向量进行融合,得到融合向量;将所述融合向量输入条件随机场网络,得到校正后的预测结果序列。本申请实施例将语义向量与状态向量融合后再进行CRF,由于状态向量能表示预测结果序列中各元素之间的依赖关系,因此融合后不仅结合了语义信息,还结合了预测结果序列中各元素之间的依赖关系,从而提高CRF输出的最终校正后的预测结果序列的准确度。

    基频提取方法和装置
    20.
    发明公开

    公开(公告)号:CN109346109A

    公开(公告)日:2019-02-15

    申请号:CN201811482074.8

    申请日:2018-12-05

    Abstract: 本申请实施例公开了基频提取方法和装置。该方法的一具体实施方式包括:基于待处理语音信号的声学特征,提取待处理语音信号中各语音帧的候选基频点;对语音帧进行清浊音分类,得到各语音帧对应的清浊音类别;基于各语音帧对应的清浊音类别以及预设的基频筛选条件对候选基频点进行修正,并采用动态规划算法从修正后的候选基频点中确定出待处理语音信号的基频序列。该实施方式提升了基频提取的准确性。

Patent Agency Ranking