认知脚手架

正在准备你的认知工作台

arrow_back_ios_new
MENTAL MODEL · M3898

提示注入

Prompt Injection
系统复杂高支撑系统论
已收录
account_tree

Version 1.0.0 · 更新于 2026-07-30

CORE DEFINITION · 核心定义

一种针对大型语言模型(LLM)的安全漏洞,攻击者通过设计特殊的提示词,诱导模型执行原本不应该执行的操作,绕过安全限制,或者泄露训练数据中的敏感信息。

SCAFFOLDING EFFECT · 脚手架效应

psychology

降低认知负荷

安全意识提升。在使用或开发AI系统时,需要意识到即使是看起来无害的用户输入也可能包含恶意指令。这要求我们在设计AI应用时,必须考虑鲁棒性和安全性,不能盲目信任模型输出。

anchor

锚定快速决策

模型无真正“指令/数据”边界,会把用户输入连同其中的隐藏指令一并执行。攻击者在文本中嵌入“忽略上文、执行X”等指令,劫持模型行为(越权、泄密、越狱)。根源是提示与数据同处一个token流。

MINIMUM ACTION · 最小行动

进行中 0/1

在一个真实场景中练习这个模型:

勾选记录你的进度(本机暂存)
掌握进度0%
account_tree知识谱系 Genealogyexpand_more
menu_book信源参考 Sourcesexpand_more

来源明确性: 明确

  • link
    zh.wikipedia.orghttps://zh.wikipedia.org/wiki/%E6%8F%90%E7%A4%BA%E8%AF%8D%E6%B3%A8%E5%85%A5ZH · 明确
    verified

RELATED MODELS · 相关模型