面壁智能发布 Eurux-8x22B 开源大模型：代码性能逾越 Llama3-70B

AI
5月3日
编辑

泓澄（实习）

感谢面壁智能发布开源大模型 Eurux-8x22B，包括 Eurux-8x22B-NCA 与 Eurux-8x22B-KTO，主打推理能力。民间尝试中，Eurux-8x22B 在 LeetCode（180 道 LeetCode 编程真题）与 TheoremQA （IT之家注：美国大学水准的 STEM 题目）尝试上逾越了 Llama3-70B，在 LeetCode 尝试上逾越闭源的 GPT-3.5-Turbo。▲ 民间尝试结果据介绍，Eurux-8x22B 模型激活参数 39B，支持 64k 上下文，是由 Mixtr

感谢面壁智能发布开源大模型 Eurux-8x22B，包括 Eurux-8x22B-NCA 与 Eurux-8x22B-KTO，主打推理能力。

民间尝试中，Eurux-8x22B 在 LeetCode（180 道 LeetCode 编程真题）与 TheoremQA （IT之家注：美国大学水准的 STEM 题目）尝试上逾越了 Llama3-70B，在 LeetCode 尝试上逾越闭源的 GPT-3.5-Turbo。

面壁智能发布 Eurux-8x22B 开源大模型：代码性能逾越 Llama3-70B

▲ 民间尝试结果

据介绍，Eurux-8x22B 模型激活参数 39B，支持 64k 上下文，是由 Mixtral-8x22B 模型对齐而来，在 UltraInteract 对齐数据集上训练而成。

面壁智能发布 Eurux-8x22B 开源大模型：代码性能逾越 Llama3-70B

▲ 民间尝试数据

UltraInteract 是专门设计用于提升大模型推理能力的大规模、高质量的对齐数据集，包含了覆盖数学、代码和逻辑推理问题的 12 个开源数据集的 86K 条指令和 220K 偏好对，共有五十万条左右数据。

面壁智能发布 Eurux-8x22B 开源大模型：代码性能逾越 Llama3-70B

面壁智能发布 Eurux-8x22B 开源大模型：代码性能逾越 Llama3-70B

给TA打赏

共{{data.count}}人

人已打赏

8x22B Eurux LeetCode 对齐尝试

AI 入侵华尔街，高盛、摩根大通：66% 低级阐明师有被庖代风险

2024-5-3 22:34:44

AI 赛道火爆背后，大厂工程师吐槽：公司为求快而牺牲准确性等

2024-5-4 16:46:20

0 条回复 A文章作者 M管理员

更换删除

暂无讨论，说说你的看法吧

TOP1

刚刚，AI颠覆物理模拟：一句话精准仿真，学术圈半壁江山联手耗时24个月研究成果
12月19日
TOP2

历时2年，华人团队力作，震撼开源生成式物理引擎Genesis，可模拟世界万物
12月19日
TOP3

细节表现超Sora，网友：真正的国产之光！MiniMax视频模型再上新
12月16日
2024年AI 编程现在可以做到什么程度？
12月18日
超越所有SOTA！最新UniScene：视频点云Occ三大生成任务全部暴力提升~
12月12日
腾讯基于 RAG 和 Agent 技术的混元大模型业务落地实践
12月11日
抢跑OpenAI！谷歌Gemini 2.0震撼登场：全面转向Agent，多模态输入输出，免费随便玩
12月12日
实测来了！Kimi发布k1视觉思考模型，实力颠覆K12教育赛道，涌现能力强得可怕，免费可用！网友：国产之光！
12月16日

❯

个人中心

今日签到

搜索

幸运之星正在降临...

点击领取今天的签到奖励！

恭喜！您今天获得了{{mission.data.mission.credit}}积分

今日签到

连续签到

{{item.credit}}

连续{{item.count}}天

我的优惠劵

_￥_优惠劵
使用时效：无法使用
使用时效：
之前
使用时效：永久有效

优惠劵ID：
×
限制以下商品使用：限制以下商品分类使用：不限制使用：

[{{ct.name}}]
所有商品和商品类型均可使用

没有优惠劵可用!

购物车

×
删除

购物车空空如也!

清空购物车前往结算

您有新的私信

没有新私信

写新私信查看全部