183
104
569
61
覆盖逾800篇文献,北大联合剑桥、CMU等高校,发布AI Alignment全面性综述 AI 对齐是一个庞大的领域,既包括 RLHF/RLAIF 等成熟的基础方法,也包括可扩展监督、机制可解释性等诸多前沿研究方向。 AI 对齐的宏观目标可以总结为 RICE 原则 :鲁棒性 (Robustness) 、可解释性 (Interpretability) 、可控性 (Controllability) 和 道德性 (Ethicality) 。 从反馈学习 (Learning from Feedback) 、 应对分布偏移 (Addressing Distributional Shift) 、 对齐保证 (Assurance) 是当下 AI Alignment 的三个核心子领域。它们构成了一个不断更新、迭代改进的对齐环路。 论文arxiv地址:https://arxiv.org/abs/2310.19852 作者在论文中注明将持续更新 Survey 以及相关资源网站,收录了许多外部资源、原创材料、定期论文推荐等。可参考 www.alignmentsurvey.com ,alignmentsurvey.substack.com ,github.com/PKU-Alignment/AlignmentSurvey 。
AI Alignment 北大人工智能对齐团队官方唯一账号,旨在交流分享AI对齐领域前沿进展,转载请标明出处
默认收藏夹
122/154
loading
加载中...
矩阵SVD分解可视化表达| Chapter1.4
1.5万播放
英伟达机器学习研究主管、加州理工学院计算机系教授【神经算子: 学习偏微分方程的新范式】——阿尼玛什雷 (Anima) 阿南德库玛
1.5万播放
最强可视化!肉眼理解resnet、unet中跳连接skip-connection的作用
1.3万播放
playing
Alignment Survey Chapter1 Introduction |人工智能对齐综述第一章 总体逻辑介绍
6798播放
Qt Fluent Studio 软件正式上线,开启 Qt 界面开发新纪元
11.8万播放
ChatGPT背后大佬【双重下降现象 The phenomenon of Deep Double Descent】—Ilya Sutskever
1.2万播放
Dataset 与 DataLoader(上)| DataLoader 迭代规则
1.7万播放
【渣渣讲课】试图做一个正常讲解Latent / Stable Diffusion的成年人
3.5万播放
概率生成模型与AIGC-3D
6035播放
【VALSE2023】0610 胡瀚《视觉自监督学习年度进展评述》
5057播放
AI内容生成模型-Diffusion
2778播放
【attention、transformer公式推导和矩阵变换】保姆级讲解!带你手推公式,快速理解!(含学习资料)
5684播放
如何一直精神稳定地撰写你的博士毕业论文/James Hayton/全英语/How to write your PhD thesis (without going
6.5万播放
Segment Anything上线一天8.2k star
16.3万播放
Github5.2k星开源项目ChatPaper读pdf论文网站上线了!
4.2万播放
2022B站最好最全的【三维重建】课程!!!北邮教授竟然把三维重建讲的如此通俗易懂,学不会UPZHIJIE 退网下架!!!-人工智能/计算机视觉/三维重建
10.8万播放
电棍活字印刷1.3傻瓜式软件版下载使用教程(可自行添加原声语音,支持变调、变速、支持linux)
16.7万播放
【包含550篇的人工智能核心论文仓库】你可以在当中找到几乎任何热门方向的核心论文代码!-人工智能/计算机视觉/深度学习/机器学习
32.6万播放
【麻尤米/补档】为蓝头发妹妹唱BGM的麻尤米
2.1万播放
真-极简爬坡式强化学习入门(代码现编,PyTorch版)
4.5万播放
电棍:Spade♿
29.9万播放
来自retard的励志演讲
9.5万播放
loading
加载中...
客服
顶部