Toolkit for confidence-corpus consistency via fine-tuning on a fabricated corpus shows post-fine-tuning confidence aligns with fabricated answers for single-digit addition pairs
Read the original at arxiv.org→arXiv:2609.28747v1 Announce Type: new Abstract: A language model's confidence in an answer is often read as a proxy for how well it knows the corresponding fact. This manual documents an open toolkit built to test...
Original headline: "Technical Manual for Toolkit for Confidence-Corpus Consistency via Fine-Tuning on a Fabricated Corpus"
Coverage timeline
- Sep 25, 04:00 UTC arXiv cs.CL lead source Technical Manual for Toolkit for Confidence-Corpus Consistency via Fine-Tuning on a Fabricated Corpus