Certifying concept unlearning in text-to-image diffusion models
Read the original at arxiv.org→arXiv:2609.12163v1 Announce Type: new Abstract: Existing evaluations of concept unlearning in text-to-image (T2I) diffusion models primarily rely on attack success rates obtained through automated adversarial prompt...
Original headline: "Certifying Concept Unlearning in Text-to-Image Diffusion Models"
Coverage timeline
- Sep 14, 04:00 UTC arXiv cs.LG lead source Certifying Concept Unlearning in Text-to-Image Diffusion Models