跳至内容
chenpaopao

chenpaopao

研究方向:语音识别 语音大模型 职业追求:AI改变世界,语音服务世界

  • 关于我:

人生很长,不必急着给自己答案。且行且思,在岁月里辨认内心,在取舍中靠近想成为的人。愿走过的路有所积累,写下的文字自有回响。

近期文章

  • ParaASR:用 MTP 加速 4B 大模型语音识别,30 分钟音频一次完成转写
  • 语音-LLM 融合再思考:通过交错预训练实现高效的语音-文本联合学习
  • Is Text All You Need? 文本作为语音大模型的通用信息瓶颈
  • Turn Detector v1.0- 语义轮次检测VAD

归档

分类

本网站用于记录人工智能相关论文学习记录,如有文章雷同,敬请见谅。

密码保护:人工智能领域论文相关资源和平台

此内容受密码保护。如需查阅,请在下列字段中输入您的密码。

相关文章:

  1. 2021: A Year Full of Amazing AI papers – A Review
  2. GAN系列之经典GAN(一)
  3. YOLO系列(二):yolov1
  4. MAE:Masked Autoencoders Are Scalable Vision Learners
发布于 2021年12月24日2022年3月28日作者 chenpaopao分类 pytorch、人工智能、机器学习、论文

文章导航

上一篇 上篇文章: 鸡尾酒会问题—语音分离
下一篇 下篇文章: torch模型的保存和读取
自豪地采用WordPress

京公网安备 11010802040332号

京ICP备2022026248号