4. 安全性
• 收集安全/有帮助的数据进行监督微调。
• 训练独立的安全性奖励模型。
• 使用内容蒸馏等方法增强安全性。
5. 评估
• 在4K提示上进行有用性人类评估,与ChatGPT等旗鼓相当。
• 在2K提示上进行安全性人类评估,优于多个基准模型。
链接:https://ai.meta.com/llama/
• 收集安全/有帮助的数据进行监督微调。
• 训练独立的安全性奖励模型。
• 使用内容蒸馏等方法增强安全性。
5. 评估
• 在4K提示上进行有用性人类评估,与ChatGPT等旗鼓相当。
• 在2K提示上进行安全性人类评估,优于多个基准模型。
链接:https://ai.meta.com/llama/