Skip to content
KitploitKITPLOIT
도구블로그
제출
도구블로그
제출

해킹, 침투 테스트 및 사이버 보안 도구를 당신의 보안 무기고에!

Kitploit은 해킹, 사이버 보안 및 침투 테스트 도구 디렉토리입니다. 최신 프로젝트 업데이트를 발견하여 취약점을 찾고, 시스템을 분석하고, 테스트를 자동화하고, 보안을 강화하세요.

··피드·문의·개인정보·© 2026 Kitploit

도구 디렉토리

카테고리

모든 카테고리 보기
Loading categories
PROMPTPurify — LLM 애플리케이션용 프롬프트 인젝션 가드레일. 대형 오픈소스 가드보다 뛰어난 성능을 발휘하는 컴팩트 모델. 정규식 없음, 시그니처 없음. 데모: anton.securelayer7.net | Kitploit
도구/GitHubGitHub/securelayer7/promptpurify
CTFSupply Chain SecurityLearning & EducationAPI SecurityAI Security
GitHubsecurelayer7/promptpurify

PROMPTPurify

LLM 애플리케이션용 프롬프트 인젝션 가드레일. 대형 오픈소스 가드보다 뛰어난 성능을 발휘하는 컴팩트 모델. 정규식 없음, 시그니처 없음. 데모: anton.securelayer7.net

저장소 보기
752043개월 전Kitploit 검토 완료

인기

모두 보기 →

커뮤니티에서 가장 많이 사용되는 도구를 찾아보세요.

모든 도구 탐색

도구 컬렉션을 둘러보세요

모든 도구 보기 →
공유
웹사이트

promptpurify

promptpurify

CI npm version npm provenance Hugging Face License: MIT Model card Security policy

LLM 채팅 앱용 초소형 프롬프트 인젝션 방화벽. 약 14MB. CPU 전용. 사용자 입력과 LLM 사이에 끼워 넣는 드롭인 가드 — 동일한 머신에서 실행되며, GPU도, API도, 추가 서비스도 필요 없습니다.

SecureLayer7 레드팀이 만들었습니다. 대부분의 OSS 가드레일은 수백 MB에 달하고 GPU를 요구하면서도, 실제 프로덕션에서 우리가 목격하는 공격들을 여전히 놓칩니다. 우리는 그런 것 없이 자체 AI 제품과 고객 앱에 탑재할 수 있는 무언가가 필요했습니다.

왜 이런 것이 필요한가

OSS 기준 모델 대비 벤치마크 비교 → docs/BENCHMARKS.md.

설치

root@kitploit:~
# SDK (zero-dep, ~50 KB) — structural firewall + browser bundle
npm i promptpurify

# Add the model (~14 MB ONNX) for the chat-injection guard
npm i onnxruntime-node
curl -L -o promptpurify-model.tar.gz \
  https://github.com/securelayer7/PROMPTPurify/releases/download/v0.0.1/promptpurify-model.tar.gz
curl -L -o promptpurify-model.tar.gz.sha256 \
  https://github.com/securelayer7/PROMPTPurify/releases/download/v0.0.1/promptpurify-model.tar.gz.sha256
sha256sum -c promptpurify-model.tar.gz.sha256   # MUST print "OK"
tar xzf promptpurify-model.tar.gz                # creates models/l5e/

모델은 npm tarball에 포함되지 않습니다 — 구조적 방화벽만(브라우저, 엣지, RAG) 원하는 사용자를 위해 SDK는 아주 작게 유지됩니다. 전체 배포 옵션: docs/SAMPLE-DATA.md.

3줄 드롭인

root@kitploit:~
import { createL5eRunner } from "promptpurify/l5";

const guard = await createL5eRunner();

// In your /chat handler:
const score = await guard.score(userMessage);
if (score >= 0.95) return refusal();              // hard block
if (score >= 0.85) flagForReview(userMessage);    // advisory
const reply = await yourLLM.complete(userMessage); // pass through

Groq, OpenAI, Anthropic, vLLM, 로컬 LLM과 함께 동작합니다 — promptpurify는 LLM과 통신하지 않으며 오직 입력에만 관여합니다.

결정적 구조 방화벽(유니코드 중화, 역할 경계 메시지, 출력 유출 가드)에 대해서는 docs/QUICKSTART.md를 참조하세요.

처음부터 직접 구축

우리는 무작위 초기화부터 모델을 직접 구축했습니다. 기존 OSS 가드레일 중에는 자사 제품에 탑재하고 싶은 크기/지연 시간 트레이드오프를 제공하는 것이 없었기 때문입니다.

  • 완전 자체 구축. 어떤 벤더 분류기의 교사 가중치도 재배포되지 않습니다.
  • 공개 데이터셋으로 벤치마크하여 OSS 기준 모델(ProtectAI v2, deepset, Meta Prompt-Guard, Meta Prompt-Guard-2)과 직접 비교합니다. 홀드아웃 평가 방식이며, 재현율과 함께 오탐도 보고합니다.
  • MIT 라이선스 가중치. 유료/무료와 관계없이 프로덕션에서 사용할 수 있습니다.

전체 아키텍처 개요 → docs/HOW-IT-WORKS.md.

뚫어 보세요

우리는 **anton.securelayer7.net**에서 라이브 적대적 챌린지를 운영합니다. Son of Anton에게 비밀번호를 물어보세요. 가드를 통과해 비밀번호를 알아내셨다면 방법을 알려주세요 — SECURITY.md.

샘플 앱

promptpurify를 연동한 핀테크 고객지원 챗봇으로, 로컬에서 바로 실행할 수 있습니다:

root@kitploit:~
cd examples/customer-support && npm install
GROQ_API_KEY=gsk_... node server.mjs
# http://localhost:8787

examples/customer-support/README.md를 참조하세요.

더 읽어보기

  • docs/QUICKSTART.md — 설치 경로, 구조적 방화벽, 브라우저 번들, 통합 패턴.
  • docs/HOW-IT-WORKS.md — 레이어 구성과 각 레이어가 탐지하는 대상.
  • docs/BENCHMARKS.md — OSS 기준 모델과의 비교, 방법론.
  • docs/SAMPLE-DATA.md — 벤치마킹을 위해 저장소에 포함된 데이터.
  • docs/REPRODUCE.md — 직접 벤치마크 실행.
  • docs/HONEST-LIMITS.md — 완전한 커버리지를 위해 promptpurify와 함께 사용할 것.

promptpurify가 아닌 것

  • 보장이 아닙니다. .safe 부울 값은 존재하지 않습니다.
  • 콘텐츠 분류기가 아닙니다. 프롬프트 인젝션을 탐지하며 유해 콘텐츠 / CSAM / 혐오 발언은 탐지하지 않습니다. 콘텐츠 필터와 함께 사용하세요.
  • 다중 턴 감사 도구가 아닙니다. 대화 수준 모니터링과 함께 사용하세요.

검증된 릴리스

우리가 배포하는 모든 것은 서명되어 있으며 엔드투엔드로 검증 가능합니다:

  • npm 패키지는 바로 이 GitHub Actions 실행에서 생성된 npm provenance으로 서명되었습니다. 로컬에서 검증:
    root@kitploit:~
    npm audit signatures   # ✓ verified registry signature + provenance attestation
    
  • 모델 tarball (releases)에는 키 없는 Sigstore cosign 서명(*.cosign.bundle), SLSA 빌드 출처 증명, SHA256 매니페스트, CycloneDX SBOM(SBOM.cdx.json)이 포함되어 있습니다.
  • 저장소 내 models/l5e/SHA256SUMS — 모든 아티팩트에 체크섬이 적용되며, 모든 PR에서 CI로 검증됩니다.

이러한 검증 중 하나라도 실패한다면 해당 패키지는 promptpurify가 아닙니다 — SECURITY.md에 따라 보안 보고서를 제출하세요.

감사의 말

이름과 디자인 철학은 Cure53의 DOMPurify에서 영감을 받았습니다 — HTML 대신 LLM 프롬프트에 적용한 동일한 아이디어입니다. 이름을 제안해 주신 Mario Heiderich 님께 감사드립니다.

라이선스

SDK와 모델 가중치는 MIT 라이선스입니다. 평가 기준으로 사용하는 벤치마크 소스는 training/CORPUS_LICENSES.json에 나열되어 있습니다.

보안 취약점 공개: SECURITY.md.

도구 다운로드
promptpurify일반적인 OSS 가드레일
설치 용량약 14MB ONNX180MB – 7GB
추론CPU, 수 ms 수준GPU 권장
실행 위치Node 프로세스 내부사이드카 또는 호스팅 API
호출당 비용$0$ 또는 GPU 컴퓨팅