"每个接入互联网的大模型应用,都是一个潜在的攻击面。安全不是选项,而是必需。"
引言:大模型安全的新挑战
传统软件安全的攻击面是代码漏洞,而大模型安全的攻击面是语言本身。因为大模型的输入是自然语言,任何能发消息的人都是潜在的攻击者。
┌──────────────────────────────────────────────────────┐
│ 大模型安全威胁全景 │
│ │
│ ┌─────────┐ ┌─────────┐ ┌─────────┐ ┌────────┐ │
│ │Prompt │ │越狱 │ │数据投毒 │ │模型窃取│ │
│ │注入 │ │Jailbreak│ │Poisoning│ │Extraction│ │
│ └─────────┘ └─────────┘ └─────────┘ └────────┘ │
│ │
│ ┌─────────┐ ┌─────────┐ ┌─────────┐ ┌────────┐ │
│ │信息泄露 │ │拒绝服务 │ │供应链 │ │对抗样本│ │
│ │Leakage │ │DoS │ │Supply │ │Adversarial│ │
│ └─────────┘ └─────────┘ └─────────┘ └────────┘ │
│ │
│ 本篇重点:Prompt 注入 + 越狱 + 防护策略 │
└──────────────────────────────────────────────────────┘