扫描下载APP
其它方式登录
北京大学DCAI团队联合多家机构开源DataFlex-RL,一个面向强化学习后训练的动态数据策略框架,支持数据选择、样本重加权和领域混合三大维度,复用现有训练信号与verl流程,实现策略灵活接入与公平对比,已在Qwen2.5、Llama-3.1等模型上验证有效性。
北京大学张文涛教授、鄂维南院士团队联合多家机构推出大模型数据中心动态训练框架DataFlex,统一集成动态样本选择、数据混合与样本加权能力,构建可复现、可调度、可扩展的训练基础设施,显著提升训练效率与模型性能,推动以数据为中心的AI范式落地。