OneBench
Passes Alone, Fails Together: Benchmarking Semantic Coordination in Parallel LLM-Agent Development | OneBench: AI Insights