国内首个!千帆ModelBuilder支持RFT,打破传统SFT训练效果天花板
在OpenAI连续12天的技术发布会上,一项名为RFT(Reinforcement-based Fine-Tuning,基于强化学习的微调)的新型训练方法引发全球关注。该方法通过结合强化学习与监督微调,仅需少量标注数据即可显著提升模型在特定场景下的性能。2月2
千帆 rft 千帆modelbuilder modelbui 2025-03-14 21:50 3
在OpenAI连续12天的技术发布会上,一项名为RFT(Reinforcement-based Fine-Tuning,基于强化学习的微调)的新型训练方法引发全球关注。该方法通过结合强化学习与监督微调,仅需少量标注数据即可显著提升模型在特定场景下的性能。2月2
千帆 rft 千帆modelbuilder modelbui 2025-03-14 21:50 3