PetQA benchmark assesses veterinary knowledge and clinical reasoning with 10,076 text QA pairs and 8,751 multimodal QA pairs for dogs and cats
Read the original at arxiv.org→arXiv:2609.04598v1 Announce Type: new Abstract: We introduce PetQA, a Korean long-form question-answering (QA) benchmark for evaluating veterinary knowledge and clinical reasoning in large language models (LLMs) and...
Original headline: "PetQA: Benchmarking Veterinary Knowledge and Clinical Reasoning"
Coverage timeline
- Sep 7, 04:00 UTC arXiv cs.CL lead source PetQA: Benchmarking Veterinary Knowledge and Clinical Reasoning