Evaluation ability does not imply optimization utility; LLM-as-a-judge signals in closed-loop table recognition show weak judge signals on FinTabNet and OmniDocBench
Read the original at arxiv.org→arXiv:2607.13347v1 Announce Type: new Abstract: LLM-as-a-judge is widely used to provide feedback and selection signals in closedloop regeneration, but this use remains insufficiently validated. We study it in table...
Original headline: "Evaluation Ability Does Not Imply Optimization Utility: LLM-as-a-Judge Signals in Closed-Loop Table Recognition"
Coverage timeline
- Jul 16, 04:00 UTC arXiv cs.CL lead source Evaluation Ability Does Not Imply Optimization Utility: LLM-as-a-Judge Signals in Closed-Loop Table Recognition