热门标签 | HotTags
当前位置:  开发笔记 > 编程语言 > 正文

FA

ForceAlignment一、.最好采用做两遍FA1.第一遍词的字典采用两行的silsp的。eg:衣Q[y_i1_k_iu1_sil]yi1kiu1sil衣Q[y

Force Alignment

一、.最好采用做两遍FA

 1. 第一遍词的

    字典采用两行的silsp的。

     eg:衣Q [y_i1_k_iu1_sil] y i1 k iu1 sil
            衣Q [y_i1_k_iu1_sp] y i1 k iu1 sp

           注意字典中不包含sp,包含sil sil;做FA后结果是中括号中的内容

     awk 'NR==FNR{w[$1]=1}NR!=FNR{if(NF>2){z=0;num=split($3,a,"_");for(i=1;itrain.align.pinyin.mlf

     pinyin.dict :所以出现的中文必须包含在里面。中英文混合的按照英文处理

     eg:AB型 [ei1_b_i1_x_i2_ng_sil]    ei1 b i1 x i2 ng sil

           AB型 [ei1_b_i1_x_i2_ng_sp]    ei1 b i1 x i2 ng sp

       map中: ei1_b_i1_x_i2_ng   ei1 b i1 x i2 ng 

 2. 第二遍字的

   采用三行的silsp,第一列是第一遍词括号中的phone标注

    eg:z_y_i1 z y i1 
          z_y_i1 z y i1  sil
          z_y_i1 z y i1  sp

         FA后就是phone级别的标注了

   注意check sil sp

         sp>&#61;5帧替换为sil。sil<5帧替换为sp

         gmm&#xff1a; echo &#39;#!MLF!#&#39; >use.train.align.model.mlf

                    cat train.align.model.mlf|awk &#39;$0!~/MLF/{print}&#39; | awk &#39;BEGIN{RS&#61;"\n[.]\n";FS&#61;"\n"}{printf"%s\n%s\n",$1,$2;for(i&#61;3;i<&#61;NF-1;i&#43;&#43;){num&#61;split($i,a," ");if(a[3]&#61;&#61;"sil"&&(a[2]-a[1])/100000<5){gsub("sil","sp",a[3]);}else{if(a[3]&#61;&#61;"sp"&&(a[2]-a[1])/100000>&#61;5){gsub("sp","sil",a[3]);}};for(j&#61;1;j<&#61;num;j&#43;&#43;)printf"%s ",a[j];printf"\n";}printf"%s\n.\n",$NF}&#39;  >>use.train.align.model.mlf

          dnn&#xff1a;./mlf2dnn.sh train.align.state.mlf tri.xwrd.cluster.list correct_train.align.state.mlf

总结&#xff1a;第一遍采用词可以避免多音字的错误&#xff0c;第二遍可以得到字间的sil和sp

          只采用词做FA得不到字间的sil sp信息&#xff0c;只采用字做FA会有多音的影响

二、DNN做FA和GMM的区别

   1.  对于DNN需要state级别的标注&#xff0c;gmm需要model级别的标注

        hvite中 -m 是得到model级别的&#xff0c;-f 是state级别的

   2.  dnn做FA需要dnn的hvite&#xff0c;gmm做FA普通的hvite就ok




推荐阅读
  • 本文介绍如何使用 Python 将一个字符串按照指定的行和元素分隔符进行两次拆分,最终将字符串转换为矩阵形式。通过两种不同的方法实现这一功能:一种是使用循环与 split() 方法,另一种是利用列表推导式。 ... [详细]
  • 360SRC安全应急响应:从漏洞提交到修复的全过程
    本文详细介绍了360SRC平台处理一起关键安全事件的过程,涵盖从漏洞提交、验证、排查到最终修复的各个环节。通过这一案例,展示了360在安全应急响应方面的专业能力和严谨态度。 ... [详细]
  • 本文详细介绍了如何构建一个高效的UI管理系统,集中处理UI页面的打开、关闭、层级管理和页面跳转等问题。通过UIManager统一管理外部切换逻辑,实现功能逻辑分散化和代码复用,支持多人协作开发。 ... [详细]
  • 本文详细解析了Python中的os和sys模块,介绍了它们的功能、常用方法及其在实际编程中的应用。 ... [详细]
  • 本文详细介绍了Java中org.w3c.dom.Text类的splitText()方法,通过多个代码示例展示了其实际应用。该方法用于将文本节点在指定位置拆分为两个节点,并保持在文档树中。 ... [详细]
  • 本文详细探讨了JDBC(Java数据库连接)的内部机制,重点分析其作为服务提供者接口(SPI)框架的应用。通过类图和代码示例,展示了JDBC如何注册驱动程序、建立数据库连接以及执行SQL查询的过程。 ... [详细]
  • 毕业设计:基于机器学习与深度学习的垃圾邮件(短信)分类算法实现
    本文详细介绍了如何使用机器学习和深度学习技术对垃圾邮件和短信进行分类。内容涵盖从数据集介绍、预处理、特征提取到模型训练与评估的完整流程,并提供了具体的代码示例和实验结果。 ... [详细]
  • 深入了解 Windows 窗体中的 SplitContainer 控件
    SplitContainer 控件是 Windows 窗体中的一种复合控件,由两个可调整大小的面板和一个可移动的拆分条组成。本文将详细介绍其功能、属性以及如何通过编程方式创建复杂的用户界面。 ... [详细]
  • 对象自省自省在计算机编程领域里,是指在运行时判断一个对象的类型和能力。dir能够返回一个列表,列举了一个对象所拥有的属性和方法。my_list[ ... [详细]
  • 利用决策树预测NBA比赛胜负的Python数据挖掘实践
    本文通过使用2013-14赛季NBA赛程与结果数据集以及2013年NBA排名数据,结合《Python数据挖掘入门与实践》一书中的方法,展示如何应用决策树算法进行比赛胜负预测。我们将详细讲解数据预处理、特征工程及模型评估等关键步骤。 ... [详细]
  • Java 实现二维极点算法
    本文介绍了一种使用 Java 编程语言实现的二维极点算法。该算法用于从一组二维坐标中筛选出极点,适用于需要处理几何图形和空间数据的应用场景。文章不仅详细解释了算法的工作原理,还提供了完整的代码示例。 ... [详细]
  • 本文介绍如何在 Android 中通过代码模拟用户的点击和滑动操作,包括参数说明、事件生成及处理逻辑。详细解析了视图(View)对象、坐标偏移量以及不同类型的滑动方式。 ... [详细]
  • 本文详细介绍了Java中org.neo4j.helpers.collection.Iterators.single()方法的功能、使用场景及代码示例,帮助开发者更好地理解和应用该方法。 ... [详细]
  • 本文介绍了一种适用于小型创业公司的小规模每日数据备份及健康检查的自动化解决方案。通过简单的Shell脚本实现本地数据库的每日全量备份,并将备份文件上传至中心备份服务器。同时,编写了自动检测脚本来确保备份的完整性和及时性,一旦发现异常,会通过邮件和短信通知相关人员。 ... [详细]
  • 本教程详细介绍了如何使用 TensorFlow 2.0 构建和训练多层感知机(MLP)网络,涵盖回归和分类任务。通过具体示例和代码实现,帮助初学者快速掌握 TensorFlow 的核心概念和操作。 ... [详细]
author-avatar
狸花殿并
这个家伙很懒,什么也没留下!
PHP1.CN | 中国最专业的PHP中文社区 | DevBox开发工具箱 | json解析格式化 |PHP资讯 | PHP教程 | 数据库技术 | 服务器技术 | 前端开发技术 | PHP框架 | 开发工具 | 在线工具
Copyright © 1998 - 2020 PHP1.CN. All Rights Reserved | 京公网安备 11010802041100号 | 京ICP备19059560号-4 | PHP1.CN 第一PHP社区 版权所有