TRACE
TRACE:因果事件建模助力视频理解大模型的时间定位能力
论文第一作者为香港中文大学(深圳)理工学院在读博士生郭永新,指导老师为通讯作者为香港中文大学(深圳)理工学院 / 人工智能学院助理教授唐晓莹,课题组研究方向包括大模型、联邦学习、充电智能优化与博弈等。 下班回家后你正深陷于一部两小时的综艺节目中,渴望找到那些让人捧腹的爆笑片段,却如同大海捞针。 或者,在紧张刺激的足球赛中,你渴望捕捉到那决定性的绝杀瞬间,但传统 AI 视频处理技术效率低下,且模型缺乏泛化能力。
3/15/2025 11:58:00 PM
机器之心
- 1
资讯热榜
OpenAI开源超Agent:Codex CLI,五小时内破 5000 颗星
基于 Spring AI + MCP + DeepSeek-R1-7B 构建企业级智能 Agent 工具调用系统
OpenAI 发布“智能体构建实战指南”实用性文档(附文档资源)
ChatGPT重磅更新:新增图像库功能,可查看自己用GPT生成的所有图片
OpenAI发布34页智能体实践指南:从网络搜索到代码编写
Figma 推 AI 革命:开发智能应用制作器与网站创建工具
Midjourney图像编辑器迎来重大更新:全新UI、图层功能与智能工具上线
别再只玩ChatGPT了!OpenAI悄悄发布《构建 Agent 实战指南》 手把手教你打造智能体
标签云
人工智能
OpenAI
AIGC
AI
ChatGPT
DeepSeek
AI绘画
数据
机器人
谷歌
模型
大模型
Midjourney
智能
用户
学习
开源
GPT
微软
Meta
AI创作
图像
技术
论文
Stable Diffusion
马斯克
Gemini
算法
蛋白质
生成式
芯片
代码
英伟达
腾讯
神经网络
计算
研究
Sora
Anthropic
AI for Science
3D
AI设计
机器学习
GPU
开发者
场景
华为
预测
人形机器人
伟达
Transformer
百度
深度学习
苹果
AI视频
模态
xAI
字节跳动
驾驶
文本
搜索
Claude
大语言模型
具身智能
Copilot
神器推荐
LLaMA
算力
安全
应用
视频生成
视觉
科技
亚马逊
大型语言模型
干货合集
特斯拉
2024
AGI
训练