正在补充深度解读,当前内容可以先阅读 论文解决了什么问题 该方法把长时间推理和试错中可复用的解题经验蒸馏为 reasoning skills,并在推理时检索相关技能,引导模型避开重复探索。论文在代码与数学任务上同时减少推理 token、提升准确率,为以外部技能替代部分从零思考提供了实证。 可核验的原论文来源和作者 作者作者信息暂未从原始元数据中确认 来源arXiv 论文 ID2604.21764 查看原论文