An adversarial suffix for detecting prompt-level vulnerabilities in large language models

Jingyi Yu, Wolfgang Mayer, Liang Zhu, Wanli Li 0002, Zaiwen Feng. An adversarial suffix for detecting prompt-level vulnerabilities in large language models. Neurocomputing, 699:134358, 2026. [doi]

References

No references recorded for this publication.

Cited by

No citations of this publication recorded.