BriefGPT.xyz
Ask
alpha
关键词
hard reasoning tasks
搜索结果 - 1
易于困难泛化:超越人类监督的可扩展对齐
通过从易到难的泛化和评估者的使用,本文提出一种可扩展的 AI 对齐方法,用于解决超越人类监督水平的困难推理任务,提升生成器模型在数学问题上的准确率。
PDF
4 months ago
Prev
Next