Jul, 2023

强化学习从人类反馈中的开放问题与基本限制

TL;DR强化学习来自人类反馈是一种训练 AI 系统与人类目标对齐的技术,但其自身存在的问题、局限性以及相关改进技术的概述,以及提出用于改善社会监督的审计和公开标准的重要性。