RESEARCHMonitorNEXT 12 MONTHS
SWE Refactor Bench: Can Coding Agents Complete a Long-Horizon, Whole-Repository Stack Migration?
arXiv cs.CL — Computation and Language
Factual evidence
What the source reports
Researchers introduced SWE Refactor Bench to evaluate LLM coding agents on complex, long-horizon whole-repository code migrations.
Open source