刚刚出炉!大语言模型在道德方面的自我修正能力

谷歌投资的Anthropic(核心成员来自OpenAI)刚才发了一篇论文,提出大语言模型能够更好地遵循指令,可以从训练数据中学习规范的伤害概念,避免产生有害的输出。
 
 
Back to Top