马斯克 xAI 推出 Grok-1.5 大语言模型:提升推理能力,可处理 128k 上下文

感谢马斯克旗下人工智能公司 xAI 今天在民间博客中宣布,正式推出 Grok-1.5 大语言模型。Grok-1.5 具有改良的推理能力和 128k 的上下文长度,其中最显著的改良之一是其在编码和数学相关任务中的表现。Grok-1.5 将在未来几天内在 𝕏 平台上向早期尝试人员和现有的 Grok 用户推出。在民间尝试中,Grok-1.5 在 MATH 基准上博得了 50.6% 的成果,在 GSM8K 基准上博得了 90% 的成果,这两个数学基准涵盖了广泛的小学到高中竞赛问题。此外,它在评估代码生成和解决问题能力的

感谢马斯克旗下人工智能公司 xAI 今天在民间博客中宣布,正式推出 Grok-1.5 大语言模型。

Grok-1.5 具有改良的推理能力和 128k 的上下文长度,其中最显著的改良之一是其在编码和数学相关任务中的表现。Grok-1.5 将在未来几天内在 𝕏 平台上向早期尝试人员和现有的 Grok 用户推出。

马斯克 xAI 推出 Grok-1.5 大语言模型:提升推理能力,可处理 128k 上下文

在民间尝试中,Grok-1.5 在 MATH 基准上博得了 50.6% 的成果,在 GSM8K 基准上博得了 90% 的成果,这两个数学基准涵盖了广泛的小学到高中竞赛问题。此外,它在评估代码生成和解决问题能力的 HumanEval 基准尝试中得分为 74.1%。IT之家附尝试对比表如下:

马斯克 xAI 推出 Grok-1.5 大语言模型:提升推理能力,可处理 128k 上下文

长上下文了解方面,Grok-1.5 能够在其上下文窗口内处理多达 128k tokens 的长上下文。这使得 Grok 的内存容量增加到之前上下文长度的 16 倍,从而能够了解更长文档中的信息。

马斯克 xAI 推出 Grok-1.5 大语言模型:提升推理能力,可处理 128k 上下文

据介绍,Grok-1.5 构建在基于 JAX、Rust 和 Kubernetes 的自定义分布式训练框架之上。自定义训练协调器可确保自动检测到有问题的节点并将其从训练功课中剔除。xAI 还优化了检查点、数据加载和训练功课重新启动,以最大限度地减少发生故障时的停机时间。

给TA打赏
共{{data.count}}人
人已打赏
AI

客户抱怨 Copilot 不如 ChatGPT,微软回应:客户“打开方式不对”

2024-3-29 10:37:49

AI

OPPO / 一加 ColorOS AI 性能上新:支撑英语教学、口试培训和问答互动

2024-3-29 12:36:48

0 条回复 A文章作者 M管理员
    暂无讨论,说说你的看法吧
个人中心
今日签到
搜索