Defending against prompt injection with Structured Queries (StruQ) and Preference Optimization (SecAlign)
Read the original at bair.berkeley.edu→Recent advances in Large Language Models (LLMs) enable exciting LLM-integrated applications. However, as LLMs have improved, so have the attacks against them. Prompt injection attack is listed as the #1 threat by...
Original headline: "Defending against Prompt Injection with Structured Queries (StruQ) and Preference Optimization (SecAlign)"