漫话开发者 - UWL.ME 精选全球AI前沿科技和开源产品
2023-09-04 talkingdev

RLHF与RLAIF的首次公开比较:性能相当,受人类青睐

近日,研究人员第一次公开比较了RLHF和RLAIF两种技术的性能。结果发现,这两种技术在最终模型性能方面基本相同,相比于基线模型,有大约70%的人类用户更青睐使用这两种技术。RLHF和RLAIF的研究和开发,推动了人工智...

Read More
2023-05-04 talkingdev

开放数据集“Pick-a-Pic”用于生成文本到图像的用户偏好研究

一个名为“Pick-a-Pic”的网络应用程序被创建,让人们生成图像并分享他们的喜好,从而形成了一个大型的开放数据集,用于训练一个智能评分系统PickScore。PickScore非常擅长预测人们的喜好,并且在评估文本到图像模型方...

Read More
  1. Prev Page