OneBench
When LLMs Benchmark Themselves: Deconstructing Self-Bias in Automated Evaluation | OneBench: AI Insights