摩尔线程开源音频理解大模型 MooER：基于国产全功能 GPU 训练和推理

作者：沛霖（实习）

2024-08-23 06:21

摩尔线程开源了音频理解大模型 —MooER（摩耳），是业界首个基于国产全功能 GPU 进行训练和推理的大型开源语音模型。基于摩尔线程夸娥（KUAE）智算平台，MooER 大模型用 38 小时完成了 5000 小时音频数据和伪标签的训练。MooER 不仅支持中文和英文的语音识别，还具备中译英的语音翻译能力。在 Covost2 中译英测试集中，MooER-5K 取得了 25.2 的 BLEU 分数，接近工业级效果。摩尔线程 AI 团队在该工作中开源了推理代码和 5000 小时数据训练的模型，并计划进一步开源训练代码和基

摩尔线程开源了音频理解大模型 —MooER（摩耳），是业界首个基于国产全功能 GPU 进行训练和推理的大型开源语音模型。

基于摩尔线程夸娥（KUAE）智算平台，MooER 大模型用 38 小时完成了 5000 小时音频数据和伪标签的训练。

MooER 不仅支持中文和英文的语音识别，还具备中译英的语音翻译能力。在 Covost2 中译英测试集中，MooER-5K 取得了 25.2 的 BLEU 分数，接近工业级效果。

摩尔线程 AI 团队在该工作中开源了推理代码和 5000 小时数据训练的模型，并计划进一步开源训练代码和基于 8 万小时数据训练的模型。

摩尔线程开源音频理解大模型 MooER：基于国产全功能 GPU 训练和推理

MooER 的模型结构包括 Encoder、Adapter 和 Decoder（Large Language Model，LLM）三个部分，具体的模型参数规模如下：

摩尔线程开源音频理解大模型 MooER：基于国产全功能 GPU 训练和推理

AI在线附相关链接：

Github 地址：https://github.com/MooreThreads/MooER

技术文档：https://arxiv.org/pdf/2408.05101

技术演示：https://mooer-speech.mthreads.com:10077/

相关标签：

模型训练开源线程 MooER

相关资讯

摩尔线程：与师者 AI 完成 70 亿参数教育大模型训练测试

摩尔线程：与师者 AI 完成 70 亿参数教育大模型训练测试

IT之家从摩尔线程官方公众号获悉，摩尔线程与全学科教育 AI 大模型“师者 AI”联合宣布，双方已完成大模型训练测试。师者 AI 成⽴于 2020 年，核心模型团队来自清华大学，总部位于北京海淀区。师者 AI 全学科教育大模型自开放内测以来，拥有超过 2.5 万用户，支持 30 个以上学科知识，2000 本以上教材。摩尔线程表示，依托摩尔线程夸娥（KUAE）千卡智算集群，师者 AI 完成了其 70 亿参数大模型的高强度训练测试。整个训练过程用时一周，训练效率达到预期。双方还将在大模型推理上开展适配工作，以更好应对教

大模型迎来「开源季」，盘点过去一个月那些开源的LLM和数据集

大模型迎来「开源季」，盘点过去一个月那些开源的LLM和数据集

前段时间，谷歌泄露的内部文件表达了这样一个观点，虽然表面看起来 OpenAI 和谷歌在 AI 大模型上你追我赶，但真正的赢家未必会从这两家中产生，因为有一个第三方力量正在悄然崛起。这个力量就是「开源」。

百川智能发布开源中英文大模型，多个榜单评测成绩最佳

百川智能发布开源中英文大模型，多个榜单评测成绩最佳

王小川创立的百川智能发布中英文大模型，采用开源模式，可免费商用。报道 | 机器之能2023年6月15日，被称为「中国ChatGPT梦之队」的百川智能公司，推出了70 亿参数量的中英文预训练大模型——baichuan-7B。baichuan-7B不仅在C-Eval、AGIEval和Gaokao中文权威评测榜单上，以显著优势全面超过了ChatGLM-6B等其他大模型，并且在MMLU英文权威评测榜单上，大幅领先LLaMA-7B。目前baichuan-7B大模型已在Hugging Face、Github以及Model Sc

资讯热榜

罗永浩 Jarvis 初创项目“J1 Assistant AI 助理”上线，利用语音与大模型互动类 Mac Mini 大小的个人 AI 超算：英伟达 Project Digits 发布，起价 3000 美元从DeepSeek-V3发布谈大模型的技术突破与未来机遇 3 到 5 秒即可同声传译 40 余种语言，时空壶推出 W4 Pro 实时翻译耳机全网都在扒的DeepSeek团队，是清北应届生撑起一片天 GPT-4o最自私，Claude更慷慨！DeepMind发布全新「AI道德测试」 Just keep scaling！思维链作者Jason Wei 40分钟讲座剖析LLM扩展范式奥特曼回应一切：宫斗、马斯克、ChatGPT两周年

标签云