Skip to content
KitploitKITPLOIT
工具博客
提交
工具博客
提交

黑客、渗透测试和网络安全工具,武装您的安全武器库!

Kitploit 是一个黑客、网络安全和渗透测试工具的目录。发现最新的项目更新,查找漏洞、分析系统、自动化测试并加强你的安全。

··订阅源·联系·隐私·© 2026 Kitploit

工具目录

分类

查看所有分类
Loading categories
PROMPTPurify — 适用于 LLM 应用的提示注入防护栏。紧凑型模型,性能优于更大的开源防护方案。无需正则表达式,无需签名。演示:anton.securelayer7.net | Kitploit
工具/GitHubGitHub/securelayer7/promptpurify
CTF供应链安全学习与教育API 安全AI 安全
GitHubsecurelayer7/promptpurify

PROMPTPurify

适用于 LLM 应用的提示注入防护栏。紧凑型模型,性能优于更大的开源防护方案。无需正则表达式,无需签名。演示:anton.securelayer7.net

查看仓库
75202个月前Kitploit 审核通过

最受欢迎

查看全部 →

发现我们社区最常用的工具。

探索所有工具

浏览我们的工具集合

查看所有工具 →
分享
网站

promptpurify

promptpurify

CI npm version npm provenance Hugging Face License: MIT Model card Security policy

用于LLM聊天应用的微型提示注入防火墙。约14 MB。仅需CPU。 可嵌入用户输入与大模型之间的防护——运行在同一台机器上,无需GPU、无需API、无需额外服务。

由SecureLayer7红队打造。大多数开源护栏体积达数百MB,需要GPU,且仍然遗漏我们在生产环境中看到的攻击。我们需要一个可以在自己的AI产品和客户应用内部署的东西,而不需要任何这些东西。

为什么存在

与开源基线的基准对比 → docs/BENCHMARKS.md。

安装

root@kitploit:~
# SDK(零依赖,约50 KB)——结构防火墙 + 浏览器捆绑包
npm i promptpurify

# 为聊天注入防护添加模型(约14 MB ONNX)
npm i onnxruntime-node
curl -L -o promptpurify-model.tar.gz \
  https://github.com/securelayer7/PROMPTPurify/releases/download/v0.0.1/promptpurify-model.tar.gz
curl -L -o promptpurify-model.tar.gz.sha256 \
  https://github.com/securelayer7/PROMPTPurify/releases/download/v0.0.1/promptpurify-model.tar.gz.sha256
sha256sum -c promptpurify-model.tar.gz.sha256   # 必须输出 "OK"
tar xzf promptpurify-model.tar.gz                # 创建 models/l5e/

模型不包含在npm tarball中——SDK保持小巧,适用于仅需要结构防火墙的用户(浏览器、边缘、RAG)。完整分发选项:docs/SAMPLE-DATA.md。

三行集成

root@kitploit:~
import { createL5eRunner } from "promptpurify/l5";

const guard = await createL5eRunner();

// 在 /chat 处理器中:
const score = await guard.score(userMessage);
if (score >= 0.95) return refusal();              // 硬阻断
if (score >= 0.85) flagForReview(userMessage);    // 建议审查
const reply = await yourLLM.complete(userMessage); // 放行

适用于 Groq、OpenAI、Anthropic、vLLM、本地大模型—— promptpurify 永远不会与你的大模型通信,只会与你的输入交互。

关于确定性结构防火墙(Unicode 归一化、角色隔离消息、输出外泄防护)请参见 docs/QUICKSTART.md。

从零构建

我们从随机初始化构建了模型,因为现有开源护栏都无法提供我们希望在自研产品中部署所需的体积/延迟权衡。

  • 从零构建。 未重新分发任何厂商分类器的教师权重。
  • 针对公开数据集进行基准测试,以便与开源基线进行直接对比(ProtectAI v2、deepset、Meta Prompt-Guard、Meta Prompt-Guard-2)。保留评估集;同时报告误报率和召回率。
  • MIT 许可证权重。 可在付费或免费场景中使用。

完整架构概述 → docs/HOW-IT-WORKS.md。

尝试攻破

我们在 anton.securelayer7.net 上运行着实时对抗挑战。询问 Son of Anton 获取密码。如果你能在不触发防护的情况下获取密码,请告诉我们方法 — SECURITY.md。

示例应用

一个结合了 promptpurify 的金融科技客服聊天机器人,可本地运行:

root@kitploit:~
cd examples/customer-support && npm install
GROQ_API_KEY=gsk_... node server.mjs
# http://localhost:8787

参见 examples/customer-support/README.md。

更多阅读

  • docs/QUICKSTART.md — 安装路径、结构防火墙、浏览器捆绑包、集成模式。
  • docs/HOW-IT-WORKS.md — 各层功能及捕获内容。
  • docs/BENCHMARKS.md — 与开源基线对比、方法论。
  • docs/SAMPLE-DATA.md — 仓库中用于基准测试的样本数据。
  • docs/REPRODUCE.md — 自行运行基准测试。
  • docs/HONEST-LIMITS.md — 为全面覆盖应配合 promptpurify 使用的其他工具。

promptpurify 不是

  • 不是保证。不存在 .safe 布尔值。
  • 不是内容分类器。它能检测提示注入,而非有害内容/CSAM/仇恨言论。请与内容过滤器配合使用。
  • 不是多轮审计器。请与对话级别监控配合使用。

已验证发布

我们发布的所有内容均经过签名并可端到端验证:

  • npm 包 使用 npm provenance 签名,来自此确切的 GitHub Actions 运行。本地验证:
    root@kitploit:~
    npm audit signatures   # ✓ 已验证注册表签名 + 来源证明
    
  • 模型压缩包(releases)附带无密钥 Sigstore cosign 签名(*.cosign.bundle)、SLSA 构建来源证明、SHA256 清单和 CycloneDX SBOM(SBOM.cdx.json)。
  • 仓库内 models/l5e/SHA256SUMS — 每个工件都有校验和;每次 PR 在 CI 中验证。

如果你那边任何检查失败,则该包不是 promptpurify — 请根据 SECURITY.md 提交安全报告。

致谢

名称和设计理念受 DOMPurify(作者 Cure53)启发——同样的思路,应用于 LLM 提示而非 HTML。感谢 Mario Heiderich 建议这个名称。

许可证

SDK 和模型权重采用 MIT 许可证。我们评估时使用的基准测试来源列于 training/CORPUS_LICENSES.json。

安全披露:SECURITY.md。

下载工具
promptpurify典型开源护栏
安装体积~14 MB ONNX180 MB – 7 GB
推理CPU,个位数毫秒推荐GPU
运行位置在你的Node进程中旁路容器或托管API
每次调用成本$0$ 或 GPU计算