TY - RPRT TI - Can LLM-as-a-Judge Reliably Verify Rubrics in Agentic Scenarios? AU - Yangda Peng AU - Yunjia Qi AU - Haotian Xia AU - Guanzhong He AU - Xintong Shi AU - Richeng Xuan AU - Songyuanyi Lu AU - Yixian Liu AU - Zhichao Hu AU - Yuhong Liu AU - Hao Peng PY - 2026 UR - https://arxiv.org/abs/2606.29920 ID - 2606.29920 ER -