摩尔线程开源音频理解大模型 MooER:基于国产
摩尔线程开源了音频理解大模型 —MooER,基于摩尔线程夸娥智算平台,MooER 大模型用 38 小时完成了 5000 小时音频数据和伪标签的训练。
MooER 不仅支持中文和英文的语音识别,还具备中译英的语音翻译能力。摩尔线程 AI 团队在该工作中开源了推理代码和 5000 小时数据训练的模型,并计划进一步开源训练代码和基于 8 万小时数据训练的模型。
MooER 的模型结构包括 Encoder、Adapter 和 Decoder三个部分,具体的模型参数规模如下:
附相关链接:
Github 地址:
技术文档:
技术演示: