扫描下载APP
其它方式登录
PolicyTrim是一种面向VLA机器人的后训练优化框架,通过两阶段强化学习提升策略效率:先扩展可靠动作序列长度,再压缩冗余物理步骤,在不降低任务成功率的前提下实现最高5.83倍端到端加速,显著减少真实机器人执行步数和时间。