FANDEX-Index
首页/.../标签/RLHF

RLHF

5 篇文档 | 3 个模块

AI伦理与安全2

  • 指令遵循作为对齐信号
  • 谄媚作为RLHF放大器

大语言模型1

  • RLHF人类反馈强化学习

机器学习2

  • PPO近端策略优化
  • 奖励建模与RLHF
首页