Skip to content
KitploitKITPLOIT
ИнструментыБлог
Log in
Отправить
ИнструментыБлог
Отправить

Инструменты для хакинга, пентеста и кибербезопасности — ваш арсенал защиты!

Kitploit — это каталог инструментов для хакинга, кибербезопасности и пентестинга. Находите последние обновления проектов для поиска уязвимостей, анализа систем, автоматизации тестирования и усиления вашей безопасности.

ЛентыКонтактыКонфиденциальность© 2026 Kitploit

Каталог инструментов

Категории

Все категории
Loading categories
giskard-oss — 🐢 Библиотека с открытым исходным кодом для оценки и тестирования LLM-агентов | Kitploit
Инструменты/GitHubGitHub/giskard-ai/giskard-oss
Сканеры уязвимостейФаззингМашинное ОбучениеRed TeamingБезопасность ИИСостязательная АтакаТоп в Состязательная Атака №11Топ в Безопасность ИИ №6Топ в Машинное Обучение №10
5.9k547931 день назадПроверено Kitploit
GitHub
giskard-ai/giskard-oss

giskard-oss

🐢 Библиотека с открытым исходным кодом для оценки и тестирования LLM-агентов

РепозиторийСайт

Популярное

Смотреть все →

Откройте для себя самые используемые инструменты нашего сообщества.

Изучить все инструменты

Просмотрите нашу коллекцию инструментов

Смотреть все инструменты →
Поделиться

giskardlogo giskardlogo

Эвалы, Red Teaming и генерация тестов для агентных систем

Модульный, лёгкий, динамичный и async-first

GitHub release License Downloads CI Giskard on Discord

Документация • Веб-сайт • Сообщество


[!IMPORTANT] Giskard v3 — это полностью переписанная версия, предназначенная для динамического многоходового тестирования AI-агентов. Этот релиз отбрасывает тяжёлые зависимости ради повышения эффективности, одновременно внедряя более мощный сканер уязвимостей ИИ и улучшенную оценку RAG — обе функции теперь поставляются нативно в giskard-scan без зависимости от v2. Только устаревшее сканирование для табличных/ML-моделей остаётся доступным только в v2. Giskard v2 остаётся доступным, но больше не поддерживается активно. Следите за прогрессом → Прочитайте анонс v3 · Дорожная карта

Установка

pip install giskard           # проверки (+ agents, llm, core)
pip install "giskard[scan]"   # + сканирование уязвимостей / качества
pip install "giskard[openai]" # SDK провайдера для LLM-судей / генераторов

Требуется Python 3.12+.

ExtraДобавляет
(нет)giskard-checks и зависимости
scangiskard-scan
openai / anthropic / …SDK провайдеров (см. опциональные зависимости в pyproject.toml)

Телеметрия: опциональная агрегированная аналитика через giskard-core. Промпты и выходные данные не отправляются. Отключите до импорта Giskard: export DO_NOT_TRACK=1 или export GISKARD_TELEMETRY_DISABLED=1. Подробности: giskard-core README.


Giskard — это библиотека Python с открытым исходным кодом для тестирования и оценки агентных систем. Архитектура v3 представляет собой модульный набор узкоспециализированных пакетов — каждый несёт только те зависимости, которые ему нужны, — созданных с нуля для обёртывания чего угодно: LLM, black-box агента или многоэтапного конвейера.

СтатусПакетОписание
✅ Стабильныйgiskard-checksТестирование и оценка — API сценариев, встроенные проверки, LLM-как-судья
✅ Стабильныйgiskard-scanСканер уязвимостей агентов + оценка RAG/качества — red teaming, prompt injection, jailbreaks и вредоносный контент (vulnerability_scan, преемник v2 Scan), а также оценка качества базы знаний (quality_scan, преемник v2 RAGET)

Они построены на трёх фундаментальных библиотеках — giskard-core (общие утилиты и телеметрия), giskard-llm (независимая от провайдера маршрутизация LLM) и giskard-agents (оркестрация агентов и рабочих процессов) — которые подтягиваются автоматически и редко используются напрямую.

Giskard Checks — создание и применение эвалов для тестирования агентов

pip install giskard-checks

Giskard Checks — это лёгкая библиотека для создания оценок (эвалов), которые тестируют системы на основе LLM — от простых утверждений до оценок LLM-как-судья. В отличие от традиционных модульных тестов, эвалы предназначены для недетерминированных выходных данных, где один и тот же вход может давать разные допустимые ответы.

Используйте Giskard Checks для:

  • Выявления регрессий — проверки, что ваша система по-прежнему ведёт себя корректно после изменений
  • Проверки качества RAG — проверки, что ответы основаны на извлечённом контексте
  • Обеспечения соблюдения правил безопасности — проверки, что выходные данные соответствуют вашим политикам контента
  • Оценки многоходовых агентов — тестирование полных диалогов, а не только отдельных обменов

Встроенные эвалы включают сопоставление строк, сравнения, регулярные выражения, семантическое сходство и проверки LLM-как-судья (Groundedness, Conformity, LLMJudge).

Концепции

  • Target (Цель) — ваша тестируемая система: любой синхронный/асинхронный вызываемый объект (inputs) -> outputs (опционально с trace)
  • Scenario (Сценарий) — один эвал: взаимодействия + проверки
  • Check (Проверка) — утверждение или LLM-судья по трассе
  • Suite (Набор) — множество сценариев, выполняемых вместе

giskard.agents.Generator — это LLM-клиент для рабочих процессов/судей — не то же самое, что генераторы входных данных giskard.checks (LLMGenerator), которые синтезируют пользовательские сообщения.

Быстрый старт

import asyncio
from giskard.checks import Scenario, Groundedness


def get_answer(inputs: str) -> str:
    return "Paris"  # замените на вашу модель / агента


async def main() -> None:
    scenario = (
        Scenario("test_france_capital")
        .interact(inputs="What is the capital of France?", outputs=get_answer)
        .check(
            Groundedness(
                name="answer is grounded",
                context="France is in Western Europe. Its capital is Paris.",
            )
        )
    )
    result = await scenario.run()
    result.print_report()


asyncio.run(main())

Groundedness — это LLM-судья — установите extra провайдера (например, pip install "giskard[openai]") и задайте соответствующий API-ключ. Модель по умолчанию: openai/gpt-4o-mini.

См. полную документацию о Suites, LLMJudge, многоходовых сценариях и многом другом.


Giskard Scan — сканер уязвимостей для AI-агентов

pip install "giskard[scan]"   # или: pip install giskard-scan

Giskard Scan — это уровень red teaming и сканирования уязвимостей для агентных систем. Он автоматически генерирует наборы состязательных тестов на основе описания вашего агента на простом языке, охватывая prompt injection, вредоносный контент, стереотипы, дезинформацию и многое другое.

Скачать инструмент