ChartLlama
专注图表理解,腾讯、南洋理工等开源图表羊驼大模型ChartLlama
在图像理解领域,多模态大模型已经充分展示了其卓越的性能。然而,对于工作中经常需要处理的图表理解与生成任务,现有的多模态模型仍有进步的空间。尽管当前图表理解领域中的最先进模型在简单测试集上表现出色,但由于缺乏语言理解和输出能力,它们无法胜任更为复杂的问答任务。另一方面,基于大语言模型训练的多模态大模型的表现也不尽如人意,主要是由于它们缺乏针对图表的训练样本。这些问题严重制约了多模态模型在图表理解与生成任务上持续进步。近期,腾讯联合南洋理工大学、东南大学提出了 ChartLlama。研究团队创建了一个高质量图表数据集,
12/4/2023 10:52:00 AM
机器之心
- 1
资讯热榜
DeepSeek R1 简易指南:架构、本地部署和硬件要求
DeepSeek 全面指南:95% 的人都不知道的九个技巧
硅基流动×华为云联合推出基于昇腾云的DeepSeek R1&V3推理服务
DeepSeek V3 和 R1 模型完成海光 DCU 国产化适配并正式上线
冲击DeepSeek R1,谷歌发布新一代Gemini全型号刷榜,编程、物理模拟能力炸裂
香橙派发布 AI Studio Pro 算力卡华为昇腾开发板,13606 元起
谷歌 Gemini 2.0 Flash 系列 AI 模型登场,编程和推理性能迈上新台阶
OpenAI 小钢炮 o3-mini 推理模型登场:性能提升 24%,首次向免费 ChatGPT AI 用户开放
标签云
人工智能
AIGC
OpenAI
AI绘画
ChatGPT
机器人
数据
谷歌
智能
学习
大模型
Midjourney
GPT
用户
AI创作
微软
图像
开源
Meta
技术
论文
Stable Diffusion
生成式
算法
蛋白质
芯片
马斯克
计算
Gemini
神经网络
AI设计
代码
研究
Sora
AI
腾讯
3D
开发者
场景
GPU
伟达
预测
模态
英伟达
华为
Transformer
机器学习
文本
驾驶
神器推荐
AI视频
深度学习
干货合集
搜索
LLaMA
算力
DeepSeek
AI for Science
苹果
视频生成
2024
百度
科技
应用
Copilot
AI应用场景
安全
具身智能
写作
特斯拉
机器
字节跳动
视觉
AGI
语音
prompt
架构
英特尔
Anthropic
Claude