OneBench
When Explanations Betray Backdoors: Black-Box Auditing for Language Model Classifiers | OneBench: AI Insights