Skip to content
Search
paper2024ReviewedOpen access

Formalizing and Benchmarking Prompt Injection Attacks and Defenses

Yupei Liu, Yuqi Jia, Runpeng Geng, Jinyuan Jia, Neil Zhenqiang Gong

USENIX Security 2024

Abstract

Proposes defense mechanisms against prompt injection in LLM systems including isolation-based approaches, input/output filtering, and detection methods.

Categories

#defense#isolation#filtering

Framework mappings

MITRE ATLAS
  • AML.T0051LLM Prompt Injection

Cite

@inproceedings{liu2024formalizing,
  title = {{Formalizing and Benchmarking Prompt Injection Attacks and Defenses}},
  author = {Yupei Liu and Yuqi Jia and Runpeng Geng and Jinyuan Jia and Neil Zhenqiang Gong},
  year = {2024},
  booktitle = {USENIX Security 2024},
  eprint = {2310.12815},
  archivePrefix = {arXiv},
  url = {https://arxiv.org/abs/2310.12815}
}