LISA
比LoRA还快50%的微调方法来了!一张3090性能超越全参调优,UIUC联合LMFlow团队提出LISA
2022 年底,随着 ChatGPT 的爆火,人类正式进入了大模型时代。然而,训练大模型需要的时空消耗依然居高不下,给大模型的普及和发展带来了巨大困难。面对这一挑战,原先在计算机视觉领域流行的 LoRA 技术成功转型大模型 [1][2],带来了接近 2 倍的时间加速和理论最高 8 倍的空间压缩,将微调技术带进千家万户。但 LoRA 技术仍存在一定的挑战。一是 LoRA 技术在很多任务上还没有超过正常的全参数微调 [2][3][4],二是 LoRA 的理论性质分析比较困难,给其进一步的研究带来了阻碍。UIUC 联合
4/1/2024 2:37:00 PM
机器之心
- 1
资讯热榜
标签云
人工智能
OpenAI
AIGC
ChatGPT
AI
AI绘画
DeepSeek
数据
机器人
谷歌
大模型
智能
Midjourney
用户
学习
模型
GPT
开源
微软
AI创作
图像
Meta
技术
论文
Stable Diffusion
马斯克
算法
生成式
蛋白质
芯片
Gemini
代码
神经网络
计算
腾讯
研究
Sora
AI设计
3D
开发者
GPU
AI for Science
英伟达
机器学习
场景
伟达
预测
华为
Transformer
模态
Anthropic
百度
驾驶
深度学习
文本
AI视频
苹果
搜索
神器推荐
算力
LLaMA
科技
视频生成
安全
应用
xAI
干货合集
Copilot
2024
字节跳动
特斯拉
人形机器人
具身智能
亚马逊
语音
视觉
AI应用场景
写作
AGI
Claude