arXiv cs.AI / cs.LG / cs.CL·10d agoBeyond Outcomes: Dual-View Relational Learning for Efficient Agent Benchmarking#agent-benchmarks#benchmark-compression#dualviewevalAI research2