MENTAL MODEL · M3898
提示注入
Prompt Injection
Version 1.0.0 · 更新于 2026-07-30
CORE DEFINITION · 核心定义
一种针对大型语言模型(LLM)的安全漏洞,攻击者通过设计特殊的提示词,诱导模型执行原本不应该执行的操作,绕过安全限制,或者泄露训练数据中的敏感信息。
SCAFFOLDING EFFECT · 脚手架效应
psychology
降低认知负荷
安全意识提升。在使用或开发AI系统时,需要意识到即使是看起来无害的用户输入也可能包含恶意指令。这要求我们在设计AI应用时,必须考虑鲁棒性和安全性,不能盲目信任模型输出。
anchor
锚定快速决策
模型无真正“指令/数据”边界,会把用户输入连同其中的隐藏指令一并执行。攻击者在文本中嵌入“忽略上文、执行X”等指令,劫持模型行为(越权、泄密、越狱)。根源是提示与数据同处一个token流。
MINIMUM ACTION · 最小行动
进行中 0/1在一个真实场景中练习这个模型:
勾选记录你的进度(本机暂存)
掌握进度0%
account_tree知识谱系 Genealogyexpand_more
menu_book信源参考 Sourcesexpand_more
来源明确性: 明确
- zh.wikipedia.orghttps://zh.wikipedia.org/wiki/%E6%8F%90%E7%A4%BA%E8%AF%8D%E6%B3%A8%E5%85%A5verified
PRIVATE NOTES · 仅自己可见
已保存问答
ENTRY Q&A · 可保存至我的笔记
在清晰边界内提问
thinkingmodels 仅基于已发布的条目上下文回答。
你的问题会发送给 thinkingmodels;回答仅使用公开词条上下文。
RELATED MODELS · 相关模型