RRS-10K: a benchmark for rare remote sensing image interpretation with 10,738 military-related images
Read the original at arxiv.org→arXiv:2607.24810v1 Announce Type: new Abstract: Vision-language models (VLMs) have achieved strong performance on general remote sensing tasks. However, their capability for rare scenes remains insufficiently...
Original headline: "RRS-10K: A Multitask Vision-Language Model Benchmark for Rare Remote Sensing Image Interpretation"
Coverage timeline
- Jul 29, 04:00 UTC arXiv cs.AI lead source RRS-10K: A Multitask Vision-Language Model Benchmark for Rare Remote Sensing Image Interpretation