论文·2026-07-23·约 1 分钟读完·arxiv.org北大与阿里提出GEAR优化长上下文推理该方法通过证据感知奖励减少长上下文模型无关复制,提升推理准确率与效率。A原文来源arxiv.orghttps://arxiv.org/abs/2607.19345 打开原文