阿里 Qwen Chat 平台上线“深度思考”功能:基于 QwQ-Max-Preview 推理模型,支持联网搜索

今日阿里 Qwen 团队在 Qwen Chat 平台上线了“深度思考 (QwQ)”功能。深度思考 (QwQ) 由 QwQ-Max-Preview 支持,这是一个基于 Qwen2.5-Max 的推理模型,擅长数学理解、编程、AI 智能体等。目前,“深度思考 (QwQ)”仍处于预览阶段,团队表示模型仍在持续优化中。IT之家注意到,该模型不仅具备推理能力,还支持联网搜索功能。
感谢今日阿里 Qwen 团队在 Qwen Chat 平台上线了“深度思考 (QwQ)”功能。

阿里 Qwen Chat 平台上线“深度思考”功能:基于 QwQ-Max-Preview 推理模型,支持联网搜索

深度思考 (QwQ) 由 QwQ-Max-Preview 支持,这是一个基于 Qwen2.5-Max 的推理模型,擅长数学理解、编程、AI 智能体等。目前,“深度思考 (QwQ)”仍处于预览阶段,团队表示模型仍在持续优化中。AI在线注意到,该模型不仅具备推理能力,还支持联网搜索功能。

阿里 Qwen Chat 平台上线“深度思考”功能:基于 QwQ-Max-Preview 推理模型,支持联网搜索

Qwen 团队同时透露,QwQ-Max 的正式版本即将推出,届时将同步上线 Android 和 iOS 平台的应用程序,并将基于开源软件许可证 Apache 2.0,开放 QwQ-Max 和 Qwen2.5-Max 的权重。

此外,为了满足多样化的需求,Qwen 还计划发布一款更轻量级的模型 QwQ-32B。该模型体积更小,适合在本地设备上部署。

相关资讯

原来,这些顶级大模型都是蒸馏的

「除了 Claude、豆包和 Gemini 之外,知名的闭源和开源 LLM 通常表现出很高的蒸馏度。 」这是中国科学院深圳先进技术研究院、北大、零一万物等机构的研究者在一篇新论文中得出的结论。 前段时间,一位海外技术分析师在一篇博客中提出了一个猜想:一些顶级的 AI 科技公司可能已经构建出了非常智能的模型,比如 OpenAI 可能构建出了 GPT-5,Claude 构建出了 Opus 3.5。

全球开源大模型榜单揭晓,阿里通义千问独占鳌头

近日,全球最大人工智能开源社区 Huggingface 发布了最新的开源大模型排行榜(Open LLM Leaderboard),结果显示,排名前十的开源大模型全都是基于阿里通义千问(Qwen)开源模型进行二次训练的衍生模型。 这一成就标志着 Qwen 在开源 AI 领域的主导地位,进一步推动了其在全球的影响力。 Open LLM Leaderboard 被广泛认为是当前最权威的开源大模型榜单,测试维度涵盖了多个领域,包括阅读理解、逻辑推理、数学计算及事实问答等。

IBM 强化 watsonx.ai:DeepSeek-R1蒸馏版 Llama 模型上线

IBM 近日宣布,其 AI 开发平台 watsonx.ai 现已支持 DeepSeek-R1蒸馏版的 Llama3.18B和 Llama3.370B模型。 DeepSeek 通过知识蒸馏技术,利用 R1模型生成的数据对多个 Llama和 Qwen变体进行了优化,进一步提升了模型性能。 在 watsonx.ai平台上,用户可以通过两种方式使用 DeepSeek 蒸馏模型。