交互效果对标 GPT-4o,商汤发布国内首个所见即所得模型“日日新 5o”

商汤科技发布“日日新 SenseNova 5.5”大模型体系,并发布国内首个所见即所得模型“日日新 5o”,交互效果对标 GPT-4o。通过整合跨模态信息,基于声音、文本、图像和视频等多种形式,“日日新 5o”带来全新的 AI 交互模式 —— 实时的流式多模态交互。据介绍,“日日新 5o”能听、会看、更会找话题,就如同“真人聊天一般”,这种交互模式适用于实时对话和语音识别等应用,能够在同一模型中自然处理多种任务,且根据不同上下文自适应调整行为和输出。日日新 5.5 是国内首个正式发布的流式原生多模态交互模型,模型训

商汤科技发布“日日新 SenseNova 5.5”大模型体系,并发布国内首个所见即所得模型“日日新 5o”,交互效果对标 GPT-4o。

交互效果对标 GPT-4o,商汤发布国内首个所见即所得模型“日日新 5o”

通过整合跨模态信息,基于声音、文本、图像和视频等多种形式,“日日新 5o”带来全新的 AI 交互模式 —— 实时的流式多模态交互。

据介绍,“日日新 5o”能听、会看、更会找话题,就如同“真人聊天一般”,这种交互模式适用于实时对话和语音识别等应用,能够在同一模型中自然处理多种任务,且根据不同上下文自适应调整行为和输出。

日日新 5.5 是国内首个正式发布的流式原生多模态交互模型,模型训练基于超过 10TB tokens 高质量训练数据,包括大量高质量的人工合成数据,构建了高阶思维链。模型采用混合端云协同架构,拥有 6000 亿参数,可最大限度发挥云边端协同,达到 109.5 字 / 秒的推理速度。

据IT之家此前报道,商汤科技在世界人工智能大会上还发布了首个“可控”人物视频生成大模型 Vimi,通过一张任意风格的照片就能生成和目标动作一致的人物类视频,并支持多种驱动方式,可通过已有人物视频、动画、声音、文字等多种元素进行驱动。

相关资讯

国内首个!商汤科技发布“日日新5o”,实时多模态流式交互对标GPT-4o

2024 年 7 月 5 日,上海 ——2024 世界人工智能大会暨人工智能全球治理高级别会议(WAIC 2024)战略合作伙伴商汤科技召开 “大爱无疆・向新力” 人工智能论坛,发布国内首个所见即所得模型 “日日新 5o”,交互体验对标 GPT-4o,实现全新 AI 交互模式。通过整合跨模态信息,基于声音、文本、图像和视频等多种形式,国内首个所见即所得模型 “日日新 5o” 带来一种全新的 AI 交互模式,即实时的流式多模态交互。现场也为大家展示了这种创新交互模式 ——工作人员刚开始仅是和 “日日新 5o” 打个招

商汤科技拟募资 20.08 亿港元用于产品开发,7 月 5 日发布日日新 5.5 大模型

商汤科技今日发布公告,拟配售 B 类股份,总筹 20.08 亿港元(当前约 18.71 亿元人民币)。据《科创板日报》报道,商汤本次配售有多家战略投资人及头部海外基金入股,现有股东增持,募集资金将用于大模型研究及产品开发等。报道称,商汤将于 7 月 5 日世界人工智能大会上发布日日新 5.5 大模型。官方没有透露关于日日新 5.5 大模型的更多信息,而此前有国内媒体报道称,商汤日日新大模型“近期”将迎来重大升级。在长文本处理能力上,升级后的商汤大模型将最新支持 100 万字以上超长文本,同时最多一次支持 50 多个

OpenAI 突然断供中国!商汤推出0成本“搬家服务”,还送大礼包

6月25日,商汤科技宣布推出大模型0元购计划,即日起成为商汤“日日新SenseNova”新注册企业用户,将获得涉及调用、迁徙、训练等多项免费服务大礼包,0元GO!“日日新SenseNova”平台覆盖商量大语言模型、商量图文多模态大模型、秒画文生图大模型、语音大模型、向量模型等多类模型API接口,满足企业用户不同需求。商汤始终坚持AI原创,技术安全且自主可控,并自有商汤大装置SenseCore这类高效率、低成本、规模化的新一代AI基础设施,算力有保障。商汤将为“日日新SenseNova”新注册企业用户赠送5000万T