Book
Open access
Jul 2026
LLMSafeGuard: A Training-Free Framework for Safeguarding LLM Decoding via Context-Wise Similarity Validation
This work proposes LLMSafeGuard, a lightweight real-time framework that integrates an external validator into decoding, rejecting unsafe outputs while allowing valid ones, and introduces a similarity-based validation approach, simplifying safety constraint validation and eliminating the need for external control model training.
Ximing Dong, Shaowei Wang, Dayi Lin et al.
· SIGSOFT FSE Companion · 0 citations