PaLM-rlhf-pytorch
PaLM-rlhf-pytorch 属于训练与微调方向,主要用于用企业数据训练或微调专用模型。
7.9kstar近 30 天仍在维护维护状态MIT · 可评估商用商用提醒
在 GitHub 查看官方项目适合解决用企业数据训练或微调专用模型
更适合已有数据、评测集和算法能力的团队
投入判断上手门槛:较高。投入较高,建议先验证通用模型是否足够
一分钟看懂
基于项目分类与公开字段整理这个项目值得继续研究吗?
PaLM-rlhf-pytorch 属于训练与微调方向,主要用于用企业数据训练或微调专用模型。
本项目暂无 AI 中文解读:上游可读取的资料还不足以支撑一次可靠的解读, 我们不会据此编写项目价值判断。下面三答来自该项目所属的能力分类通用说明, 仅供快速定位方向;项目本身的可核验信息见下方「可核对的事实层」。
- 解决什么问题
- 用企业数据训练或微调专用模型
- 适合什么团队
- 已有数据、评测集和算法能力的团队
- 使用前注意
- 投入较高,建议先验证通用模型是否足够;MIT · 可评估商用。
本页用于缩短初步筛选时间,不构成技术、采购或法律结论。 正式使用前请在真实业务数据上验证,并以官方说明与许可证为准。
可核对的事实层
官方资料与来源
- artificial-intelligence
- attention-mechanisms
- deep-learning
- human-feedback
- reinforcement-learning
- transformers
核对上游原始说明
Implementation of RLHF (Reinforcement Learning with Human Feedback) on top of the PaLM architecture. Basically ChatGPT but with PaLM