[控场AI]
概念Prompt Injection

提示词注入攻击

提示词注入攻击(Prompt Injection Attack)是一种针对大型语言模型(LLM)及其应用的安全攻击手段。攻击者通过在输入内容中嵌入经过精心构造的恶意指令,干扰或覆盖模型原有的系统提示,从而操纵模型执行非预期行为,如绕过安全限制、泄露敏感信息或执行有害操作。该攻击利用了模型难以区分正常用户输入与恶意指令的固有局限性。

来源文章