深夜突袭！DeepSeek V3 偷偷更新变强

2025-03-26 09:12

DeepSeek 刚刚悄然发布了 DeepSeek-V3-0324 模型。这次更新远超预期，不仅性能大幅提升，而且新增了多项实用功能，让开发者和企业用户都为之惊叹。回顾之前的 DeepSeek R1 版本，尽管能力出色，但仍存在几个明显短板：缺乏函数调用能力、不支持规范化的 JSON 输出。

DeepSeek 刚刚悄然发布了 DeepSeek-V3-0324 模型。这次更新远超预期，不仅性能大幅提升，而且新增了多项实用功能，让开发者和企业用户都为之惊叹。

回顾之前的 DeepSeek R1 版本，尽管能力出色，但仍存在几个明显短板：缺乏函数调用能力、不支持规范化的 JSON 输出。这些功能对于 AI 在实际业务场景中的应用至关重要。

以下是官方朴实无华的更新日志：

图片

中文写作能力测试

提示词：假设你是一名环保专家，最近你发现了一种新的可持续能源技术。请描述这项技术的原理、优势以及对环境的潜在影响。

1742904958

写作能力有了大幅度提升，毕竟基于 R1 ，「左脚踩右脚」

前端开发能力测试

接下来，我测试了它的前端开发能力：

我问了它：技术栈不限制，帮我实现一个网站登录界面 .html

1742905401

DeepSeek V3 函数调用功能

函数调用是这一功能使大语言模型能够根据用户提示，生成调用特定函数的结构化请求，包含函数名称和必要参数。这为 AI 与外部工具、API 的无缝集成提供了强大支持。

举例来说，众所周知大语言模型在处理复杂数学计算时存在局限性。通过函数调用，您可以为模型提供一个 "数学工具库 "，模型会指示应调用哪个函数以及需要哪些参数。系统执行该函数后，将结果与原始提示一起返回给模型，从而获得完整、准确的回答。

需要明确的是：模型自身不执行函数，它只是指示应该调用什么函数以及如何调用。

1742906059

实际应用示例

添加依赖

复制

<dependency>
  <groupId>dev.langchain4j</groupId>
  <artifactId>langchain4j-open-ai</artifactId>
  <version>1.0.0-beta2</version>
</dependency>

创建 AI 服务接口

复制

public interface FunctionAssistant {
    String chat(String message);
}

用注解实现业务逻辑

复制

public class InvoiceHandler {
    @Tool("根据用户提交的开票信息进行开票 ")
    public String handle(String companyName, String dutyNumber, @P("金额保留两位有效数字 ") String amount) {
        log.info("companyName =>>>> {} dutyNumber =>>>> {} amount =>>>> {}", companyName, dutyNumber, amount);
        return "开票成功 ";
    }
}

测试调用效果

复制

@Test
publicvoidtest2() {
    ChatLanguageModelchatLanguageModel= OpenAiChatModel.builder()
            .apiKey("sk-")
            .modelName("deepseek-chat")
            .baseUrl("https://api.deepseek.com/v1")
            .logRequests(true)
            .logResponses(true)
            .build();

    FunctionAssistantassistant= AiServices.builder(FunctionAssistant.class)
            .chatLanguageModel(chatLanguageModel)
            .tools(newInvoiceHandler())
            .build();

    Stringchat= assistant.chat("帮我开具发票，公司名称：深圳市腾讯计算机系统有限公司，税号：91440300734991234A，金额：100.123456");
    System.out.println(chat);
}

1742906411

总结彩蛋

从笔者近期对 AI Chat2BI 业务落地的研究来看，V3 相比 R1 推理模型具备更高的可玩性。在 Chat2BI 的优化过程中，我们尝试了多种策略，但准确性始终难以显著提升。V3-0324 发布后，我们第一时间进行了实测，结果表明，在国内模型中，唯有 V3-0324 能够稳定地通过 function 实现 Chat2BI 效果（在相同提示词、SQL 字段未进行语义或向量优化的情况下，该模型自身的能力远超大部分调优手段。当然，Claude 3.7 Sonnet 也展现了惊艳的表现）。

本次更新弥补了诸多短板，使 AI 更加深度融入业务流程，未来可期待更多 AI 创新案例的涌现。唯有真正赋能业务，AI 才能创造真正的价值。

1742922457

揭秘Hologres如何支持超高QPS在线服务（点查）场景

Hologres（中文名交互式分析）是阿里云自研的一站式实时数仓，这个云原生系统融合了实时服务和分析大数据的场景，全面兼容PostgreSQL协议并与大数据生态无缝打通，能用同一套数据架构同时支持实时写入实时查询以及实时离线联邦分析。它的出现简化了业务的架构，为业务提供实时决策的能力，让大数据发挥出更大的商业价值。本期将为大家揭秘Hologres如何支持超高QPS点查。传统的 OLAP 系统在业务中往往扮演着比较静态的角色，以通过分析海量的数据得到业务的洞察（比如说预计算好的视图、模型等），从这些海量数据分析到的结

7/29/2021 11:37:00 AM

阿里云大数据AI技术

Spark 大数据处理最佳实践

开源大数据社区 & 阿里云 EMR 系列直播第十一期主题：Spark 大数据处理最佳实践讲师：简锋，阿里云 EMR 数据开发平台负责人内容框架：大数据概览如何摆脱技术小白Spark SQL 学习框架EMR Studio 上的大数据最佳实践直播回放：扫描文章底部二维码加入钉群观看回放，或进入链接、大数据概览大数据处理 ETL (Data → Data)大数据分析 BI (Data → Dashboard)机器学习 AI (Data → Model)二、如何摆脱技术小白什么是技术小白？只懂表

8/11/2021 3:11:00 PM

阿里云大数据AI技术

都2022年了，Python继续霸榜，SQL写得溜，面试或能加分

熟练掌握 SQL，或将成为职业香饽饽。

8/26/2022 8:16:00 AM

机器之心

资讯热榜

上海AI实验室开源InternVL3系列多模态大型语言模型「交交」媲美GPT-4o！上海交大推出口语对话情感大模型，首个纯学术界自研！ Haisnap横空出世，小白用户也能轻松打造AI应用 kimi开源视觉语言模型 Kimi-VL 与 Kimi-VL-Thinking，多项基准超越 GPT-4o 本地部署DeepSeek+DiFy平台构建智能体应用韩国初创公司 RLWRLD 获 1480 万美元融资，致力于机器人基础模型开发 ChatGPT重磅更新：新增图像库功能，可查看自己用GPT生成的所有图片击败DeepSeek-R1！豆包新推理模型仅用前者参数量1/3！还将开源两个基准，瞄准通用推理能力！

标签云

人工智能 OpenAI AIGC AI ChatGPT DeepSeek AI绘画数据机器人谷歌模型大模型 Midjourney 智能用户学习开源 GPT 微软 Meta AI创作图像技术论文 Stable Diffusion 马斯克 Gemini 算法蛋白质生成式芯片代码英伟达神经网络腾讯计算研究 Sora AI for Science 3D Anthropic AI设计机器学习 GPU 开发者场景华为预测伟达 Transformer 百度苹果深度学习 AI视频模态人形机器人驾驶 xAI 文本搜索字节跳动大语言模型 Copilot Claude 具身智能神器推荐 LLaMA 算力安全应用视频生成科技视觉亚马逊干货合集 2024 AGI 特斯拉 DeepMind 训练

顶部