VLM²-Bench
人类秒懂,AI却懵圈:VLM²-Bench揭示视觉语言模型「视觉关联」能力短板
本文来自港科与 MIT 教授团队。 本文有两个共同一作:张鉴殊为武汉大学本科四年级,本篇为其在港科大访问期间完成,将于 2025 秋季前往美国西北大学攻读 CS PhD。 姚栋宇目前就读于 CMU CS 系下的 MSCV 项目。
3/14/2025 3:48:00 PM
机器之心
- 1
资讯热榜
OpenAI开源超Agent:Codex CLI,五小时内破 5000 颗星
基于 Spring AI + MCP + DeepSeek-R1-7B 构建企业级智能 Agent 工具调用系统
OpenAI 发布“智能体构建实战指南”实用性文档(附文档资源)
OpenAI发布34页智能体实践指南:从网络搜索到代码编写
ChatGPT重磅更新:新增图像库功能,可查看自己用GPT生成的所有图片
别再只玩ChatGPT了!OpenAI悄悄发布《构建 Agent 实战指南》 手把手教你打造智能体
Figma 推 AI 革命:开发智能应用制作器与网站创建工具
Midjourney图像编辑器迎来重大更新:全新UI、图层功能与智能工具上线
标签云
人工智能
OpenAI
AIGC
AI
ChatGPT
DeepSeek
AI绘画
数据
机器人
谷歌
模型
大模型
Midjourney
智能
用户
学习
开源
GPT
微软
Meta
AI创作
图像
技术
论文
Stable Diffusion
马斯克
Gemini
算法
蛋白质
生成式
芯片
代码
英伟达
腾讯
神经网络
计算
研究
Sora
Anthropic
AI for Science
3D
AI设计
机器学习
GPU
开发者
场景
华为
预测
人形机器人
伟达
Transformer
百度
深度学习
苹果
AI视频
模态
xAI
字节跳动
驾驶
文本
搜索
Claude
大语言模型
具身智能
Copilot
神器推荐
LLaMA
算力
安全
应用
视频生成
视觉
科技
亚马逊
大型语言模型
干货合集
特斯拉
2024
AGI
训练