外观
双向独立重建的软件补丁验证
摘要
RETRACE 用两个方向交叉验证代码修复:正向阶段根据问题描述和执行轨迹解释补丁;反向阶段隐藏原问题,仅根据补丁与轨迹重建它要解决的问题。系统比较两份表述,定位不一致之处并做定向修订。
在 SWE-bench Verified 上,该方法用于 GPT-5-mini 和 MiniMax-2.5。配合 mini-SWE-agent 时 Pass@1 分别提高 7.0 和 3.6 个百分点,在 OpenHands 上也观察到相近趋势;消融实验支持双向核验而非单纯增加一次自我反思是主要增益来源。
方法的独特价值
反向验证减少修复 Agent 同时读取需求、生成补丁和自评时的共同偏差。它并不替代测试,而是增加一个与原问题文本部分隔离的语义一致性检查。
落地流程
保留原始问题、工具轨迹、补丁和测试证据;由独立上下文生成正向解释和反向问题重建;把差异转成可验证假设,再运行针对性测试。高风险变更仍需静态分析、回归测试和人工审批。
局限与待验证问题
SWE-bench 主要衡量功能修复,不等同于安全补丁验证。两个方向仍可能共享模型偏差,Pass@1 提升也不能证明补丁没有引入安全回归。