MarkSec: Capability-Aware Evaluation of Adversarial Attacks Against LLM Watermarks
Results show that apparent attack winners depend on text-quality constraints, attack generality, and capability assumptions, and that apparent attack winners depend on text-quality constraints, attack generality, and capability assumptions.