热门标签 | HotTags
当前位置:  开发笔记 > 编程语言 > 正文

阿里云AIET担任CEO,与蜻蜓FM猫局长展开深度对话

【人机对话】阿里云人工智能ET化身CEO,对话蜻蜓FM猫局长


猛戳链接,直击现场:未来科技局 | 独家连线阿里巴巴未来CEO


11月29日,阿里云人工智能ET化身阿里巴巴CEO,参加蜻蜓FM猫眼未来科技局栏目,对话猫局长。人机对话,妙趣横生。

【人机对话】阿里云人工智能ET化身CEO,对话蜻蜓FM猫局长

此外,12月1日,猫眼科技连线阿里云AI专家,关于阿里云人工智能ET背后的语音识别技术进行了一次深度访谈。

猫:先请我们的科学家自我介绍一下吧?

陈:大家好我是阿里云负责ET智能语音对外服务的陈一宁。

【人机对话】阿里云人工智能ET化身CEO,对话蜻蜓FM猫局长

猫:你好陈工。我们看到et能言善辩还可以模仿马云的声音。这个是怎么实现的呢?

陈:模仿马云的声音这个是我们的语音合成技术。我们的语音合成技术原理是说它会根据一些已有的录音库生成一个与人的声音类似的模拟声音。那这个马云的声音实际上是因为我们收集了一些马老师在大会上的讲话之类或者是一些演讲的材料根据这个我们做了一个音库。根据这个模型生成的一个对应的马老师的语音合成的声音。

猫:语音识别在ET的各项能力中处于一个什么样的地位我看它有很多种能力啊?

陈:我认为语音识别首先是一个我们叫做听觉或者听觉中枢的一个作用它实际上是在ET的这种人机交互的过程中是一个必不可少的很重要的作用。也是相对来说一个比较成熟和比较接近产品化的一种能力。它很多时候在我们需要跟ET交互或者ET需要理性的处理一些非结构化数据的时候,语音时识别都可以帮助我们能够进入到这些数据中,能够让我们的交互可以开始发声。人机交互嘛!所以需要人说一些事情让机器去理解它。语音识别是这些理解的第一步,先把它变成文字然后才能开始做进一步的理解和进一步的交互。

猫:从现在全球的情况来看语音识别的应用情况是怎么样的从专家的角度如何看这个事情?

陈:全球来看的话语音识别应用还是比较火热的吧现在有很多种应用领域,我们一个一个来说吧比如说从这个人机交互的角度来说其实现在有很多这种助手类的产品比如苹果的siri,比如微软的小娜比如亚马逊的echo等等这样的产品。实际上都是在做这种比如手机特别是IOT设备上的语音交互产品。他们都需要语音识别的技术。那么再往下一点比如在做车载系统,如果你想跟车载做一些交互基本上智能汽车对于语音识别技术都是不可或缺的部分。同时如果对于商用的系统对于这种全球的客服比如我们民航的这种退票和改签服务应用,还有比如说在医疗领域一些医生处方或者医疗记录中发挥作用。

猫:现在语音技术还有没有面临挑战的地方阿里云是如何应对这种挑战的

陈:语音识别这个方向上我们觉得现在遇到的挑战有几种吧一个是比如说想噪声的这种挑战那么现在碰到的情况就是在干净的情况下或者说噪声很小的情况下语音识别的效果还是不错的但是在这个噪声比较大的时候这个识别率就会相对有所下降。还包括说话有一定口音的情况下。标准普通话标准语音会好一些但是有口音的情况下识别率也会有下降然后还包括说话的年龄过小或者过老也会有一些影响会打一些折扣。那么阿里云我们认为在这里面最主要的都是数据的问题。包括我们刚才讲到说抗噪声的理由识别率低实际上都是因为我们没有足够的噪声语音在里面。那么我们阿里云会采用一些技术通过人工的方式记录或者采集的方式获得大量的这种含噪声的,含口音的等等的这些语料,通过我们大规模的大数据方式做一些计算把这些海量的数据结合在一起就能够做出很多在各种情况下应用会比较好的语音识别的效果。还有提到比如中英文混杂的效果这是一个很头疼的问题那么我们也会通过各种识别材料增加的方式来达到最终的满意度。

猫:给我们能不能讲几个科学家工程师们的小故事让大家都了解一下他们的付出。了解工程师们是如何努力的?

陈:试试看啊我讲一个前线落地的故事不是一个后台的故事落地的时候我们会碰到一个很正常的问题有时候我们在做语音识别相关的工作的时候有一个事情很重要就是录音质量要好。录音如果本身就有巨大的噪声或者是你根本就没录下来那么肯定这个效果就会不好吧那这个就会有问题我举个例子比如说之前我们在这个湖南卫视我是歌手》这个节目里头去预测这个歌王。我们现场要得到歌手演唱的这些数据那么这样的一些东西我们都需要把声音录下来都录下来以后发现我们跟电视台的设备做的一些连接我们的设备和电台的设备是不兼容的。插上来基本上就是烧设备。然后当时很紧急的要拔掉开始直播了就发现这个设备有问题。然后后来紧急的想了各种办法来解决。从湖南卫视借了他们的一些设备出来才把这个事儿最后解决的这种情况还有很多比如说在双11晚会的过程中。也会遇到这种设备插在一起还会遇到这种电流电源上的干扰这种声音录起来是完全没法听这样的情况都有很多这种需要现场的工程师去解决,他们有时候都是没日没夜加班连轴转,把公司当做自己的家,非常的辛苦。




推荐阅读
  • vivo Y5s配备了联发科Helio P65八核处理器,这款处理器采用12纳米工艺制造,具备两颗高性能Cortex-A75核心和六颗高效能Cortex-A55核心。此外,它还集成了先进的图像处理单元和语音唤醒功能,为用户提供卓越的性能体验。 ... [详细]
  • 本文档旨在帮助开发者回顾游戏开发中的人工智能技术,涵盖移动算法、群聚行为、路径规划、脚本AI、有限状态机、模糊逻辑、规则式AI、概率论与贝叶斯技术、神经网络及遗传算法等内容。 ... [详细]
  • 2018-2019学年第六周《Java数据结构与算法》学习总结
    本文总结了2018-2019学年第六周在《Java数据结构与算法》课程中的学习内容,重点介绍了非线性数据结构——树的相关知识及其应用。 ... [详细]
  • 本文详细介绍了优化DB2数据库性能的多种方法,涵盖统计信息更新、缓冲池调整、日志缓冲区配置、应用程序堆大小设置、排序堆参数调整、代理程序管理、锁机制优化、活动应用程序限制、页清除程序配置、I/O服务器数量设定以及编入组提交数调整等方面。通过这些技术手段,可以显著提升数据库的运行效率和响应速度。 ... [详细]
  • 华为智慧屏:超越屏幕尺寸的智能进化
    继全球发布后,华为智慧屏于9月26日在上海正式亮相,推出65英寸和75英寸版本。该产品不仅在屏幕尺寸上有所突破,更在性能和智能化方面实现了显著提升。 ... [详细]
  • 12月16日JavaScript变量、函数、流程、循环等***线上九期班
    12月16日JavaScript变量、函数、流程、循环等***线上九期班 ... [详细]
  • 本文详细介绍了在不同操作系统中查找和设置网卡的方法,涵盖了Windows系统的具体步骤,并提供了关于网卡位置、无线网络设置及常见问题的解答。 ... [详细]
  • 使用Nginx反向代理实现多域名端口映射
    本文介绍如何通过配置本地hosts文件和Nginx反向代理,实现多个虚拟域名的端口映射,使用户可以通过标准HTTP端口80访问不同后端服务。 ... [详细]
  • 历经三十年的开发,Mathematica 已成为技术计算领域的标杆,为全球的技术创新者、教育工作者、学生及其他用户提供了一个领先的计算平台。最新版本 Mathematica 12.3.1 增加了多项核心语言、数学计算、可视化和图形处理的新功能。 ... [详细]
  • 本文档汇总了Python编程的基础与高级面试题目,涵盖语言特性、数据结构、算法以及Web开发等多个方面,旨在帮助开发者全面掌握Python核心知识。 ... [详细]
  • 本文将详细介绍温莎大学的计算机科学硕士项目,尤其是其应用计算机科学分支,探讨其申请条件、课程设置及为何成为国际学生的热门选择。 ... [详细]
  • 2017年人工智能领域的十大里程碑事件回顾
    随着2018年的临近,我们一同回顾过去一年中人工智能领域的重要进展。这一年,无论是政策层面的支持,还是技术上的突破,都显示了人工智能发展的迅猛势头。以下是精选的2017年人工智能领域最具影响力的事件。 ... [详细]
  • 十大算法书籍助力编程之路
    算法作为编程学习的核心技能,其重要性不容忽视。虽然算法的学习难度较高,但其对提升编程能力、通过技术面试以及应对当前热门的技术领域如人工智能和区块链等都有着不可替代的作用。本文精选十本算法书籍,旨在帮助程序员更好地掌握这一关键技术。 ... [详细]
  • 本文探讨了当前技术发展趋势,特别是大数据和人工智能如何推动工业互联网的发展。文章分析了全球主要国家在工业互联网领域的进展,并展望了未来工业互联网技术的发展方向。 ... [详细]
  • 基于直推式学习的异质人脸图像合成技术
    本文探讨了利用直推式学习与贝叶斯推理相结合的方法,用于提升异质人脸图像合成的质量。通过将所有样本(包括训练和测试样本)纳入学习过程,旨在减少测试样本的风险误差,从而改善最终的图像合成效果。 ... [详细]
author-avatar
西北孤狼2502911947
这个家伙很懒,什么也没留下!
PHP1.CN | 中国最专业的PHP中文社区 | DevBox开发工具箱 | json解析格式化 |PHP资讯 | PHP教程 | 数据库技术 | 服务器技术 | 前端开发技术 | PHP框架 | 开发工具 | 在线工具
Copyright © 1998 - 2020 PHP1.CN. All Rights Reserved | 京公网安备 11010802041100号 | 京ICP备19059560号-4 | PHP1.CN 第一PHP社区 版权所有