提示词注入防御
prompt-guard · 智能体基建 · OpenClaw
给智能体应用做输入安全把关,识别多语言的直接与间接提示词注入,按严重度分级并留档。
这个技能能做什么
- 检测中英等多语言的直接注入攻击
- 识别藏在文档与网页里的间接注入
- 按严重度打分并输出判定理由
- 自动留存拦截日志供后续审计
什么时候用
- 智能体要读用户上传文档,上线前先加一道防线
- 机器人被恶意提示词绕过,需要定位与拦截
什么时候别用
只是想调整模型的语气风格时,不需要动用攻击检测。
适用场景与行业
配合这些工具用
- 扣子Coze
- Dify
- LangGPT
怎么安装
从公开技能市场获取:https://lobehub.com/skills/openclaw-skills-prompt-guard;下载后放入 ~/.claude/skills/ 或项目内的 .claude/skills/ 目录
来源:https://lobehub.com/skills/openclaw-skills-prompt-guard
原始英文描述(未经改写)
提示词注入防御:多语言检测直接与间接注入攻击,含严重度评分、自动记录与可配置策略。