OneBench
Safety Training May Persist Through Helpfulness Optimization in LLM Agents | OneBench: AI Insights