根据 Meta 自有模型和GPT4的打分比较。
通过自有模型打分,Llama2在v3的时候就打赢了ChatGPT3.5
v5 的时候胜率接近 70%,都没用到 PPO
v5 加了PPO之后进一步拔高了上限,到达 75% 左右。
通过GPT4打分的话,在v5才超过 ChatGPT 3.5 https://t.co/FRgv75J6kc
 
 
Back to Top