RESEARCHInvestigateNEXT 12 MONTHS
GRASP: Reinforcing Language Model Anonymizers with Group Relative Policy Optimization
arXiv cs.CL — Computation and Language
Factual evidence
What the source reports
Researchers propose GRASP, a method using Group Relative Policy Optimization to train lightweight, local LLM-based data anonymizers.
Open source