Calibrated selective fact-checking via evidence chain evaluation.
Read the original at arxiv.org→arXiv:2607.18240v1 Announce Type: new Abstract: Large language models (LLMs) can achieve strong fact-checking accuracy, yet forced binary decisions conceal a critical reliability problem: systems may issue confident...
Original headline: "Calibrated Selective Fact-Checking via Evidence Chain Evaluation"