RESEARCHInvestigateNEXT 12 MONTHS
Thinking in a Low-Resource Language: What SFT Builds, What RL Fixes, What Accuracy Cannot See
arXiv cs.LG — Machine Learning
Factual evidence
What the source reports
Research reveals 7.7-point accuracy benchmark variance from seed changes alone when fine-tuning MoE models for low-resource reasoning.
Open source