摩尔线程开源音频理解大模型 MooER:基于国产全功能 GPU 训练和推理

摩尔线程开源了音频理解大模型 —MooER(摩耳),是业界首个基于国产全功能 GPU 进行训练和推理的大型开源语音模型。基于摩尔线程夸娥(KUAE)智算平台,MooER 大模型用 38 小时完成了 5000 小时音频数据和伪标签的训练。MooER 不仅支持中文和英文的语音识别,还具备中译英的语音翻译能力。在 Covost2 中译英测试集中,MooER-5K 取得了 25.2 的 BLEU 分数,接近工业级效果。摩尔线程 AI 团队在该工作中开源了推理代码和 5000 小时数据训练的模型,并计划进一步开源训练代码和基

摩尔线程开源了音频理解大模型 —MooER(摩耳),是业界首个基于国产全功能 GPU 进行训练和推理的大型开源语音模型。

基于摩尔线程夸娥(KUAE)智算平台,MooER 大模型用 38 小时完成了 5000 小时音频数据和伪标签的训练。

MooER 不仅支持中文和英文的语音识别,还具备中译英的语音翻译能力。在 Covost2 中译英测试集中,MooER-5K 取得了 25.2 的 BLEU 分数,接近工业级效果。

摩尔线程 AI 团队在该工作中开源了推理代码和 5000 小时数据训练的模型,并计划进一步开源训练代码和基于 8 万小时数据训练的模型。

摩尔线程开源音频理解大模型 MooER:基于国产全功能 GPU 训练和推理

MooER 的模型结构包括 Encoder、Adapter 和 Decoder(Large Language Model,LLM)三个部分,具体的模型参数规模如下:

摩尔线程开源音频理解大模型 MooER:基于国产全功能 GPU 训练和推理

AI在线附相关链接:

Github 地址:https://github.com/MooreThreads/MooER

技术文档:https://arxiv.org/pdf/2408.05101

技术演示:https://mooer-speech.mthreads.com:10077/

给TA打赏
共{{data.count}}人
人已打赏
应用

AI在用 | 发现一个AI调色板,还真整出了「五彩斑斓的黑」

2024-8-23 16:16:00

应用

Meta 研发新方法:整合语言和扩散 AI 模型,降低计算量、提高运算效率、优化生成图像

2024-8-24 6:57:06

0 条回复 A文章作者 M管理员
    暂无讨论,说说你的看法吧
个人中心
今日签到
搜索