摩尔线程开源音频理解大模型MooER:38小时训练5000小时数据

摘要 快科技8月23日消息,摩尔线程官方宣布,音频理解大模型“MooER”(摩耳)已经正式开源,并公布在GitHub上:https://github.com/MooreThread...

快科技8月23日消息,摩尔线程官方宣布,音频理解大模型“MooER”(摩耳)已经正式开源,并公布在GitHub上:https://github.com/MooreThreads/MooER

目前开源的内容包括推理代码,以及5000小时数据训练的模型,后续还将开源训练代码,以及基于8万小时数据训练的模型。

摩尔线程希望,能够在语音大模型的方法演进和技术落地方面为社区做出贡献。

MooER是业界首个基于国产全功能GPU进行训练和推理的大型开源语音模型,依托摩尔线程的夸娥(KUAE)智算平台,并得益于自研的创新算法和高效计算资源的结合,仅用38个小时,就完成了5000小时音频数据和伪标签的训练。

郑重声明:本文版权归原作者所有,转载文章仅为传播更多信息之目的,如作者信息标记有误,请第一时候联系我们修改或删除,多谢。