实时偏好优化
无需训练实现价值观实时动态对齐:上交开源价值观对齐方法OPO,闭源与开源大模型均适用
随着人工智能技术的发展,以 GPT-4 为代表的大语言模型依靠其强大的能力正在对社会产生深远的影响。与此同时,大模型本身的安全性问题也变得尤为重要。如何确保大语言模型可以和人类的价值、真实的意图相一致,防止模型被滥用、输出有害的信息,这是大模型安全治理的核心问题。之前的大多数对齐方法需要收集新数据重新训练模型,然而对训练数据质量要求高以及优化模型参数耗时耗力是对齐中的痛点。除此之外,待对齐的价值观可能是动态变化的,这进一步给大模型价值观对齐带来了挑战。有鉴于此,上海交通大学生成式人工智能实验室 GAIR 迅速采取行
1/24/2024 10:51:00 AM
机器之心
- 1
资讯热榜
使用 VLLM 部署 DeepSeek:基于 Ubuntu 22.04 + RTX 4090 + Docker 的完整指南
RAGFlow自动化脚本套件:自定义解析+回答质量评估+参数自动调优
DeepSeek官方澄清:R2模型3月17日发布传闻为假消息
百度AI开源表格识别模型PP-TableMagic
32B IOI奥赛击败DeepSeek-R1!Open R1开源复刻第三弹,下一步R1-Zero
OpenAI突然发布智能体API!支持网络和文件搜索以及computer use
FP8模型不再挑卡!DeepSeek推理成本减半速度翻番,清华团队开源「赤兔」推理引擎
清华团队开源 “赤兔 Chitu” 推理引擎,助力国产 AI 生态发展
标签云
人工智能
OpenAI
AIGC
AI
ChatGPT
AI绘画
DeepSeek
数据
机器人
谷歌
大模型
Midjourney
智能
模型
用户
学习
GPT
开源
微软
AI创作
图像
Meta
技术
论文
Stable Diffusion
马斯克
算法
生成式
蛋白质
芯片
Gemini
代码
神经网络
腾讯
计算
研究
Sora
AI设计
3D
AI for Science
英伟达
GPU
开发者
机器学习
场景
预测
华为
伟达
Anthropic
Transformer
模态
百度
深度学习
AI视频
驾驶
文本
苹果
搜索
神器推荐
算力
LLaMA
Copilot
xAI
安全
科技
视频生成
应用
人形机器人
字节跳动
具身智能
干货合集
2024
视觉
大语言模型
AGI
特斯拉
亚马逊
语音
Claude
AI应用场景