LISA
比LoRA还快50%的微调方法来了!一张3090性能超越全参调优,UIUC联合LMFlow团队提出LISA
2022 年底,随着 ChatGPT 的爆火,人类正式进入了大模型时代。然而,训练大模型需要的时空消耗依然居高不下,给大模型的普及和发展带来了巨大困难。面对这一挑战,原先在计算机视觉领域流行的 LoRA 技术成功转型大模型 [1][2],带来了接近 2 倍的时间加速和理论最高 8 倍的空间压缩,将微调技术带进千家万户。但 LoRA 技术仍存在一定的挑战。一是 LoRA 技术在很多任务上还没有超过正常的全参数微调 [2][3][4],二是 LoRA 的理论性质分析比较困难,给其进一步的研究带来了阻碍。UIUC 联合
4/1/2024 2:37:00 PM
机器之心
- 1
资讯热榜
标签云
人工智能
AIGC
OpenAI
AI绘画
ChatGPT
机器人
数据
谷歌
智能
学习
大模型
Midjourney
GPT
用户
AI创作
微软
图像
开源
Meta
技术
论文
Stable Diffusion
生成式
算法
蛋白质
芯片
马斯克
计算
Gemini
神经网络
AI设计
代码
研究
Sora
AI
腾讯
3D
开发者
场景
GPU
伟达
预测
模态
英伟达
华为
Transformer
机器学习
文本
驾驶
神器推荐
AI视频
深度学习
干货合集
搜索
LLaMA
算力
DeepSeek
AI for Science
苹果
视频生成
2024
百度
科技
应用
Copilot
AI应用场景
安全
具身智能
写作
特斯拉
机器
字节跳动
视觉
AGI
语音
prompt
架构
英特尔
Anthropic
Claude