专题演讲嘉宾:康魏

小米AI 实验室 高级算法工程师

南京大学 EE 本科,北京大学计算机应用技术方向硕士,从研究生开始一直从事 AI 的研发工作。2019 年开始进入语音行业,深度参与出门问问车载智能座舱离在线语音识别系统的研发。在解码器和系统优化方面积累了较多经验。2021 年春天加入小米,跟随 Kaldi 之父 Daniel Povey 博士开发新一代 Kaldi 项目。当前工作重点主要包含高性能异构计算的实现和语音识别端到端模型的研究与落地。

by 康魏

小米
AI 实验室 高级算法工程师

过去十几年 Kaldi 开源语音识别软件风靡全球,为语音识别的产业化落地做出了杰出贡献。然而,随着深度学习框架的普及和端到端模型的兴起,Kaldi 逐渐显得跟不上技术发展的趋势,于是新一代 Kaldi 应运而生。那么新一代 Kaldi 项目要解决什么问题?它目前的研发现状是什么样的?未来又有哪些开发计划?它里面提出的可微分加权有限状态转换器又是怎么工作的呢?本次分享将为你一一揭晓。

演讲提纲:

  1. 什么是新一代 Kaldi
  2. 可微分加权有限状态自动机
    • k2 中的 FSA
    • 如何实现 FSA 的可微分
    • 使用可微分加权有限状态自动机训练模型
  3. 新一代 Kaldi 在端到端模型上的探索

你将获得:

  • 了解新一代 Kaldi 项目的基本目标和概念
  • 了解可微分加权有限状态自动机的工作原理
  • 了解新一代 Kaldi 在端到端模型上的探索

交通指南

来广营·朝来科技园

Laiguangying Beijing
地址: 北京市朝阳区来广营朝来科技园
  • 微信咨询

  • 电话咨询

    联系电话:+86 13167596032

微信联系我们