OneBench
Large Language Models Generate Harmful Content Using a Distinct, Unified Mechanism | OneBench: AI Insights