马斯克 xAI 推出 Grok-1.5 大语言模型：提升推理能力，可处理 128k 上下文

AI
3月29日
编辑

汪淼

感谢马斯克旗下人工智能公司 xAI 今天在民间博客中宣布，正式推出 Grok-1.5 大语言模型。Grok-1.5 具有改良的推理能力和 128k 的上下文长度，其中最显著的改良之一是其在编码和数学相关任务中的表现。Grok-1.5 将在未来几天内在 𝕏 平台上向早期尝试人员和现有的 Grok 用户推出。在民间尝试中，Grok-1.5 在 MATH 基准上博得了 50.6% 的成果，在 GSM8K 基准上博得了 90% 的成果，这两个数学基准涵盖了广泛的小学到高中竞赛问题。此外，它在评估代码生成和解决问题能力的

感谢马斯克旗下人工智能公司 xAI 今天在民间博客中宣布，正式推出 Grok-1.5 大语言模型。

Grok-1.5 具有改良的推理能力和 128k 的上下文长度，其中最显著的改良之一是其在编码和数学相关任务中的表现。Grok-1.5 将在未来几天内在 𝕏 平台上向早期尝试人员和现有的 Grok 用户推出。

马斯克 xAI 推出 Grok-1.5 大语言模型：提升推理能力，可处理 128k 上下文

在民间尝试中，Grok-1.5 在 MATH 基准上博得了 50.6% 的成果，在 GSM8K 基准上博得了 90% 的成果，这两个数学基准涵盖了广泛的小学到高中竞赛问题。此外，它在评估代码生成和解决问题能力的 HumanEval 基准尝试中得分为 74.1%。IT之家附尝试对比表如下：

马斯克 xAI 推出 Grok-1.5 大语言模型：提升推理能力，可处理 128k 上下文

长上下文了解方面，Grok-1.5 能够在其上下文窗口内处理多达 128k tokens 的长上下文。这使得 Grok 的内存容量增加到之前上下文长度的 16 倍，从而能够了解更长文档中的信息。

马斯克 xAI 推出 Grok-1.5 大语言模型：提升推理能力，可处理 128k 上下文

据介绍，Grok-1.5 构建在基于 JAX、Rust 和 Kubernetes 的自定义分布式训练框架之上。自定义训练协调器可确保自动检测到有问题的节点并将其从训练功课中剔除。xAI 还优化了检查点、数据加载和训练功课重新启动，以最大限度地减少发生故障时的停机时间。

给TA打赏

共{{data.count}}人

人已打赏

1.5 Grok 上下文基准训练

客户抱怨 Copilot 不如 ChatGPT，微软回应：客户“打开方式不对”

2024-3-29 10:37:49

OPPO / 一加 ColorOS AI 性能上新：支撑英语教学、口试培训和问答互动

2024-3-29 12:36:48

0 条回复 A文章作者 M管理员

更换删除

暂无讨论，说说你的看法吧

TOP1

刚刚，AI颠覆物理模拟：一句话精准仿真，学术圈半壁江山联手耗时24个月研究成果
12月19日
TOP2

历时2年，华人团队力作，震撼开源生成式物理引擎Genesis，可模拟世界万物
12月19日
TOP3

细节表现超Sora，网友：真正的国产之光！MiniMax视频模型再上新
12月16日
2024年AI 编程现在可以做到什么程度？
12月18日
超越所有SOTA！最新UniScene：视频点云Occ三大生成任务全部暴力提升~
12月12日
腾讯基于 RAG 和 Agent 技术的混元大模型业务落地实践
12月11日
抢跑OpenAI！谷歌Gemini 2.0震撼登场：全面转向Agent，多模态输入输出，免费随便玩
12月12日
实测来了！Kimi发布k1视觉思考模型，实力颠覆K12教育赛道，涌现能力强得可怕，免费可用！网友：国产之光！
12月16日

❯

个人中心

今日签到

搜索

幸运之星正在降临...

点击领取今天的签到奖励！

恭喜！您今天获得了{{mission.data.mission.credit}}积分

今日签到

连续签到

{{item.credit}}

连续{{item.count}}天

我的优惠劵

_￥_优惠劵
使用时效：无法使用
使用时效：
之前
使用时效：永久有效

优惠劵ID：
×
限制以下商品使用：限制以下商品分类使用：不限制使用：

[{{ct.name}}]
所有商品和商品类型均可使用

没有优惠劵可用!

购物车

×
删除

购物车空空如也!

清空购物车前往结算

您有新的私信

没有新私信

写新私信查看全部