AI在线 AI在线

Mistral 推出其首个专业区域语言模型 Saba :专精阿拉伯语和印度起源语言

作者:溯波(实习)
2025-02-18 10:42
以 Saba 为代表的专精特定语言的较小模型,更适用于对文化背景、区域限定知识要求更高的场景。

法国 AI 初创企业 Mistral AI 当地时间昨日宣布推出其首个专业区域语言模型 Saba。该模型在源自中东与南亚的精选数据集上训练,能以相对较小的规模为上述区域用户提供更准确、相关的回应

Saba 模型参数规模为 32B,支持本地单 GPU 系统部署。Mistral AI 给出的数据显示 Saba 在阿拉伯语的模型基准测试中明显优于同参数规模的 Mistral Small 3 24B,在同更大参数模型的比较里也毫不逊色。

Mistral 推出其首个专业区域语言模型 Saba :专精阿拉伯语和印度起源语言

Mistral 推出其首个专业区域语言模型 Saba :专精阿拉伯语和印度起源语言

Mistral 推出其首个专业区域语言模型 Saba :专精阿拉伯语和印度起源语言

同时,由于中东与南亚持续不断的文化交流,Mistral Saba 除阿拉伯语语外也支持多种印度起源语言,尤其是以泰米尔语为代表的南印度达罗毗荼语系诸语种(AI在线注:该语系使用者总数达 2.5 亿人)。

Mistral AI 认为,要让 AI 无处不在就需要解决各种文化和语言问题。目前较大规模的通用模型在多种语言上都有良好表现,但缺乏语言细微差别、文化背景和深入的区域知识,无法为具有强大区域背景的用例提供服务,而这就是 Mistral Saba 等专精特定语言的较小模型的用武之地。

相关标签:

相关资讯

千页只需7块钱,Mistral发布世界最强文件扫描API,实测仍有缺陷

法国大模型独角兽 Mistral AI 进军 OCR(光学字符识别)领域了。 一出手就是号称「世界上最好的 OCR 模型」! 新产品 Mistral OCR 是一种光学字符识别 API,它为文档理解树立了新标准。
3/7/2025 12:53:00 PM
机器之心

欧洲“DeepSeek”发布了全世界最好的 OCR,网友:蹲蹲中国的免费开源版

就在刚刚,那个曾经开源了首个 MoE 模型的欧洲初创公司 Mistral AI 在沉寂一段时间之后又出新活。 Mistral 团队发布了一个号称“全世界最好的 OCR”的产品 —— Mistral OCR,旨在将一些 AI 难以直接识别的粗糙且复杂的文件进行整理,便于 AI 操作识别。 帖子一经发出,评论区瞬间充满了各种夸夸言论,但在一众赞美声中,也不乏一些真正用过产品的网友的理智发言。
3/14/2025 4:25:00 PM
郑佳美

单个4090就能跑,Mistral开源多模态小模型,开发者:用来构建推理模型足够香

小模型正在变得越来越好,而且越来越便宜。 刚刚,法国 AI 创企 Mistral AI 开源了一个 24B 的多模态小模型,该模型在多个基准上击败了 Gemma 3 和 GPT-4o Mini 等同类模型,而且推理速度达到了 150 个 token / 秒,称得上是又好又快。 重要的是,它只需要一个 RTX 4090 或 32GB RAM 的 Mac 就能运行,而且开源协议是 Apache 2.0,因此既能用于研究,也能商用。
3/18/2025 3:58:00 PM
机器之心