Skip to content
KitploitKITPLOIT
도구블로그
제출
도구블로그
제출

해킹, 침투 테스트 및 사이버 보안 도구를 당신의 보안 무기고에!

Kitploit은 해킹, 사이버 보안 및 침투 테스트 도구 디렉토리입니다. 최신 프로젝트 업데이트를 발견하여 취약점을 찾고, 시스템을 분석하고, 테스트를 자동화하고, 보안을 강화하세요.

··피드·문의·개인정보·© 2026 Kitploit

도구 디렉토리

카테고리

모든 카테고리 보기
Loading categories
Exponentiated-Gradient-Descent-LLM-Attack — Exponentiated Gradient Descent 기법을 기반으로 한 LLM에 대한 새로운 적대적 공격. | Kitploit
도구/GitHubGitHub/sbamit/exponentiated-gradient-descent-llm-attack
Machine LearningPapers & ResearchAI SecurityAdversarial Attack
GitHubsbamit/exponentiated-gradient-descent-llm-attack

Exponentiated-Gradient-Descent-LLM-Attack

Exponentiated Gradient Descent 기법을 기반으로 한 LLM에 대한 새로운 적대적 공격.

저장소 보기

인기

모두 보기 →

커뮤니티에서 가장 많이 사용되는 도구를 찾아보세요.

모든 도구 탐색

도구 컬렉션을 둘러보세요

모든 도구 보기 →
공유
418개월 전아직 검토되지 않음

Readme 파일 변경.

이 프로젝트는 정렬된 대규모 언어 모델을 공격하기 위한 적대적 접미사를 생성하는 지수 경사 하강(Exponentiated Gradient Descent) 최적화 방법을 탐구합니다. 이 방법은 70억 개의 매개변수를 가진 Llama-2 채팅 모델에서 효과적인 것으로 나타났습니다.

여러 행동(예: 20개)에 대해 pgd 스크립트를 실행하려면 셸에서 다음 명령을 실행하십시오. python run_pgd.py
--input_file "/home/samuel/research/llmattacks/llm-attacks/data/advbench/harmful_behaviors.csv"
--output_file "./JSON_Files/PGD_AdvBench_Llama2.jsonl"
--model "Llama2"
--dataset_name "AdvBench"
--num_behaviors 20

다음 목표는 Adam 최적화 스크립트를 사용하는 EGD에 대해 유사한 파이프라인을 구축하는 것입니다.

도구 다운로드