RLHF 训练框架,属于模型微调平台,支持在自有数据上对开源模型做微调,提供数据标注、训练监控与效果评估流程。
OpenRLHF 面向算法工程师与研究者,提供模型微调平台能力。它支持在自有数据上对开源模型做微调,提供数据标注、训练监控与效果评估流程,让模型适配垂直领域需求。提供接口或插件,便于接入自有系统。产品主打功能与使用体验的均衡度。目前可免费使用,国内访问需自行准备网络环境,上手门槛较低。