上海 AI 实验室书生・浦语大模型升级：仅用 4T 数据训练而成，通用模型首次融合常规对话与深度思考

2025-01-15 03:03

IT之家从上海人工智能实验室获悉，其书生大模型今日获得重要版本升级——书生·浦语3.0（InternLM3）。据官方介绍，其通过精炼数据框架大幅提升了数据效率，实现思维密度的跃升。

AI在线从上海人工智能实验室获悉，其书生大模型今日获得重要版本升级 —— 书生・浦语 3.0（InternLM3）。据官方介绍，其通过精炼数据框架大幅提升了数据效率，实现思维密度的跃升。

InternLM3-8B-Instruct 仅使用 4T 数据训练，官方宣称其综合性能超过同量级开源模型，节约超 75% 训练成本；首次在通用模型中实现了常规对话与深度思考能力融合，可应对更多真实使用场景。

基于司南 OpenCompass 开源评测框架，该模型研究团队使用统一可复现的方法对该模型进行评测。评测采用 CMMLU、GPQA 等十多个权威评测集，维度包括推理、数学、编程、指令跟随、长文本、对话及综合表现等多方面性能，结果显示，书生・浦语 3.0 在大多数评测集得分领先，综合性能“十分接近 GPT-4o-mini”。

上海 AI 实验室书生・浦语大模型升级：仅用 4T 数据训练而成，通用模型首次融合常规对话与深度思考

上海 AI 实验室披露了部分该模型的体验案例，如解答“箭头迷宫问题”等推理谜题，让模型在棋盘格中找到从起点到终点的可行路径。

上海 AI 实验室书生・浦语大模型升级：仅用 4T 数据训练而成，通用模型首次融合常规对话与深度思考

以及“猜数字”问题：

上海 AI 实验室书生・浦语大模型升级：仅用 4T 数据训练而成，通用模型首次融合常规对话与深度思考

此外，其深度思考能力也拓展到了智能体任务，成为了开源社区内首个支持浏览器使用的通用对话模型，支持 20 步以上网页跳转以完成深度信息挖掘。

体验页面：https://internlm-chat.intern-ai.org.cn
GitHub链接：https://github.com/InternLM/InternLM
HuggingFace链接：https://huggingface.co/internlm
ModelScope链接：https://www.modelscope.cn/models/Shanghai_AI_Laboratory/internlm3-8b-instruct

中文大语言模型赶考：商汤与上海AI Lab等新发布「书生·浦语」

今天，一年一度的高考正式拉开帷幕。

6/7/2023 2:48:00 PM

机器之心

彻底开源，免费商用，上海AI实验室把大模型门槛打下来

大模型领域，有人探索前沿技术，有人在加速落地，也有人正在推动整个社区进步。

7/12/2023 6:44:00 PM

机器之心

书生・天际 3.0 实景三维大模型开源发布：城市级 100 平方公里全范围实时渲染，VR 设备可用

据“书生 Intern”官方公众号 28 日推文，书生・天际 3.0 实景三位大模型现已开源发布，渲染效率提速近 6 倍，同时将应用方式拓展至 VR 设备。此前在去年 7 月，上海人工智能实验室联合多家机构发布了书生・天际（LandMark）实景三维大模型，号称首次实现城市级 100 平方公里全范围实时渲染。据介绍，书生・天际 3.0 在 Web 端的基础上，将应用方式拓展至 VR 设备，用户戴上 VR 眼镜，既可在名胜古迹、城市街景或博物馆中自由穿梭、探索，也可在重建的三维实景中对场景进行更直观、更自由的编辑。此

8/29/2024 12:27:13 PM

清源

资讯热榜

上海AI实验室开源InternVL3系列多模态大型语言模型 Haisnap横空出世，小白用户也能轻松打造AI应用「交交」媲美GPT-4o！上海交大推出口语对话情感大模型，首个纯学术界自研！ OpenAI开源超Agent:Codex CLI,五小时内破 5000 颗星 ChatGPT重磅更新：新增图像库功能，可查看自己用GPT生成的所有图片本地部署DeepSeek+DiFy平台构建智能体应用 OPPO 小布助手网页版上线，接入满血版 DeepSeek kimi开源视觉语言模型 Kimi-VL 与 Kimi-VL-Thinking，多项基准超越 GPT-4o

标签云

人工智能 OpenAI AIGC AI ChatGPT DeepSeek AI绘画数据机器人谷歌模型大模型 Midjourney 智能用户学习开源 GPT 微软 Meta AI创作图像技术论文 Stable Diffusion 马斯克 Gemini 算法蛋白质生成式芯片代码英伟达腾讯神经网络计算研究 Sora AI for Science 3D Anthropic AI设计机器学习 GPU 开发者场景华为预测伟达 Transformer 百度苹果深度学习 AI视频模态人形机器人 xAI 驾驶字节跳动文本搜索大语言模型 Claude Copilot 具身智能神器推荐 LLaMA 算力安全应用视频生成科技视觉亚马逊干货合集 2024 AGI 特斯拉训练大型语言模型

顶部

上海 AI 实验室书生・浦语大模型升级：仅用 4T 数据训练而成，通用模型首次融合常规对话与深度思考

相关资讯

中文大语言模型赶考：商汤与上海AI Lab等新发布「书生·浦语」

彻底开源，免费商用，上海AI实验室把大模型门槛打下来

书生・天际 3.0 实景三维大模型开源发布：城市级 100 平方公里全范围实时渲染，VR 设备可用