RAG-TESTER: automated end-to-end testing of retrieval-augmented large language models
Read the original at arxiv.org→arXiv:2608.00054v1 Announce Type: new Abstract: Retrieval-Augmented Generation (RAG) enables Large Language Models (LLMs) to use external and domain-specific knowledge, but its reliability depends on the interaction...
Original headline: "RAG-TESTER: Automated End-to-End Testing of Retrieval-Augmented Large Language Models"
Coverage timeline
- Aug 4, 04:00 UTC arXiv cs.AI lead source RAG-TESTER: Automated End-to-End Testing of Retrieval-Augmented Large Language Models