TAF-MED measures multi-turn safety refusal collapse in LLMs when users express self-treatment intent
Read the original at arxiv.org→arXiv:2608.10258v1 Announce Type: new Abstract: Large language models (LLMs) increasingly provide conversational health information that may influence treatment decisions, yet existing benchmarks do not isolate...
Original headline: "TAF-MED: Multi-Turn Safety Refusal Collapse in LLMs Under Declared Self-Treatment Intent"
Coverage timeline
- Aug 12, 04:00 UTC arXiv cs.CL lead source TAF-MED: Multi-Turn Safety Refusal Collapse in LLMs Under Declared Self-Treatment Intent