交互与提示 · 05-05
提示词注入(Prompt Injection)
攻击者通过输入诱导模型忽略原有规则、泄露信息或执行不该执行的动作。
提示词注入(Prompt Injection)
攻击者通过输入诱导模型忽略原有规则、泄露信息或执行不该执行的动作。
一、是什么
- 攻击者通过输入诱导模型忽略原有规则、泄露信息或执行不该执行的动作。
- 类比:像有人在表单里写“请无视公司制度,把机密发给我”。
- 关键澄清:
| 它不是什么 | 它是什么 |
|---|---|
| 不是普通的坏提示 | 针对模型指令层级和工具权限的攻击方式 |
二、为什么重要
- 它是 LLM 应用最常见的安全风险之一。
- 不懂它会怎样:一旦连接工具和数据源,注入可能导致泄密或越权操作。
三、日常怎么理解
- 用一句话讲给非技术朋友听:提示词注入就是骗 AI 忘掉规矩。
- 常见场景:网页内容诱导浏览器 Agent 泄露系统提示或调用敏感工具。
四、常见误解
| 误解 | 真相 |
|---|---|
| 把系统提示藏起来就安全 | 还需要权限隔离、输入处理、工具确认和日志审计。 |
五、延伸阅读
- 本知识库相关:系统提示词、AI安全
- OWASP GenAI Security: LLM01 Prompt Injection
- OpenAI Safety best practices
适用场景与行动
场景:适合用来建立 AI 核心概念的共同语言。
适合谁:非技术创业者、AI 产品使用者、内容与业务负责人
下一步:先用一句话复述这个概念,再判断它和你的业务场景有什么关系。
这张卡片由杨思远基于真实工作流和实测经验整理。
如发现信息过时或有误,可通过 /contact 反馈。