扫描下载APP
其它方式登录
CMU等机构提出新型记忆巩固机制,让大语言模型在推理间隙进入‘睡眠’状态,通过离线递归前向传播更新状态空间模型的快速权重,从而将短期上下文转化为可调用的长期记忆,在复杂多步推理任务中显著提升性能,同时保持推理延迟不变。