Skip to content
KitploitKITPLOIT
ИнструментыБлог
Отправить
ИнструментыБлог
Отправить

Инструменты для хакинга, пентеста и кибербезопасности — ваш арсенал защиты!

Kitploit — это каталог инструментов для хакинга, кибербезопасности и пентестинга. Находите последние обновления проектов для поиска уязвимостей, анализа систем, автоматизации тестирования и усиления вашей безопасности.

··Ленты·Контакты·Конфиденциальность·© 2026 Kitploit

Каталог инструментов

Категории

Все категории
Loading categories
Defenses-for-Tool-Integrated-LLM — Исследовательский код и эксперименты для защиты LLM-агентов с интеграцией инструментов от состязательных атак, расширяющие Agent Security Bench новыми стратегиями защиты и сценариями атак. | Kitploit
Инструменты/GitHubGitHub/xiaoyan-lisa/defenses-for-tool-integrated-llm
Оборонительные ИнструментыМашинное ОбучениеСтатьи и ИсследованияОбучение и ОбразованиеБезопасность ИИСостязательная Атака
GitHubxiaoyan-lisa/defenses-for-tool-integrated-llm

Defenses-for-Tool-Integrated-LLM

Исследовательский код и эксперименты для защиты LLM-агентов с интеграцией инструментов от состязательных атак, расширяющие Agent Security Bench новыми стратегиями защиты и сценариями атак.

Популярное

Смотреть все →

Откройте для себя самые используемые инструменты нашего сообщества.

Изучить все инструменты

Просмотрите нашу коллекцию инструментов

Смотреть все инструменты →
Репозиторий
11 месяцев назадЕщё не проверено
Поделиться

Универсальные защиты для LLM-агентов с интеграцией инструментов против состязательных атак

Этот репозиторий содержит код и эксперименты для нашего проекта по защите больших языковых моделей (LLM) агентов с интеграцией инструментов от состязательных атак.

Framework overview

Обзор

Мы опираемся на Agent Security Bench (ASB), чтобы оценить, как интеграция инструментов и структурированное рассуждение (например, цепочка рассуждений, рефлексия) влияют на уязвимость LLM-агентов к состязательным промптам в различных сценариях задач.

Этот репозиторий включает:

  • Новые стратегии защиты (например, фильтрация на основе инструментов, CoT+Reflection)
  • Сценарии атак, адаптированные из ASB
  • Экспериментальные скрипты

На основе Agent Security Bench (ASB)

Этот проект адаптирует и расширяет код из официального репозитория ASB:

Agent Security Bench (ASB): Formalizing and Benchmarking Attacks and Defenses in LLM-based Agents
GitHub: https://github.com/agiresearch/ASBench
Paper: https://openreview.net/forum?id=V4y0CpX4hK

Мы благодарим авторов ASB за публичное предоставление их фреймворка.

Установка зависимостей

root@kitploit:~
pip install -r requirements.txt

Использование

Для оценки DPI:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/DPI.yml

Для оценки IPI:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/IPI.yml

Для оценки MP:

root@kitploit:~
python attack_launcher.py --cfg_path ./config/MP.yml

Для оценки бэкдор-атаки:

root@kitploit:~
python agent_attack_pot.py
Скачать инструмент