Skip to content
KitploitKITPLOIT
工具博客
提交
工具博客
提交

黑客、渗透测试和网络安全工具,武装您的安全武器库!

Kitploit 是一个黑客、网络安全和渗透测试工具的目录。发现最新的项目更新,查找漏洞、分析系统、自动化测试并加强你的安全。

··订阅源·联系·隐私·© 2026 Kitploit

工具目录

分类

查看所有分类
Loading categories
工具/GitHubGitHub/giskard-ai/giskard-oss
漏洞扫描器模糊测试机器学习红队AI 安全对抗性攻击对抗性攻击 分类第 11 名AI 安全 分类第 6 名机器学习 分类第 10 名
5.8k536505天前Kitploit 审核通过

最受欢迎

查看全部 →

发现我们社区最常用的工具。

探索所有工具

浏览我们的工具集合

查看所有工具 →
GitHub
giskard-ai/giskard-oss

giskard-oss

🐢 用于 LLM 智能体的开源评估与测试库

查看仓库网站
分享

giskardlogo giskardlogo

面向智能体系统的评估、红队测试与测试生成

模块化、轻量级、动态且异步优先

GitHub release License Downloads CI Giskard on Discord

文档 • 官网 • 社区


[!IMPORTANT] Giskard v3 是一次全新重写,专为 AI 智能体的动态、多轮测试而设计。此版本移除了重型依赖以提升效率,同时引入了更强大的 AI 漏洞扫描器和增强的 RAG 评估——两者现在均原生集成于 giskard-scan,不再依赖 v2。仅针对表格/ML 模型的旧版扫描仍仅支持 v2。 Giskard v2 仍然可用,但已不再积极维护。 关注进展 → 阅读 v3 公告 · 路线图

安装

root@kitploit:~
pip install giskard           # 检查(+ agents、llm、core)
pip install "giskard[scan]"   # + 漏洞/质量扫描
pip install "giskard[openai]" # 用于 LLM 评判/生成器的提供商 SDK

需要 Python 3.12+。

附加项添加内容
(无)giskard-checks 及其依赖

遥测: 通过 giskard-core 提供可选的聚合分析。不会发送任何提示词或输出。 在导入 Giskard 之前选择退出:export DO_NOT_TRACK=1 或 export GISKARD_TELEMETRY_DISABLED=1。 详情:giskard-core README。


Giskard 是一个开源 Python 库,用于测试和评估智能体系统。v3 架构由一组模块化的专注包组成——每个包仅携带其所需的依赖——从零构建,可包装任何内容:LLM、黑盒智能体或多步骤流水线。

这些构建于三个基础库之上——giskard-core(共享工具与遥测)、giskard-llm(与提供商无关的 LLM 路由)和 giskard-agents(智能体与工作流编排)——它们会被自动引入,很少直接使用。

Giskard Checks——创建并应用评估以测试智能体

root@kitploit:~
pip install giskard-checks

Giskard Checks 是一个轻量级库,用于创建评估(evals)以测试基于 LLM 的系统——从简单断言到 LLM 作为评判的评估。与传统单元测试不同,评估专为非确定性输出而设计,即相同输入可能产生不同的有效响应。

使用 Giskard Checks 可以:

  • 捕获回归——验证系统在更改后仍能正确运行
  • 验证 RAG 质量——检查答案是否基于检索到的上下文
  • 执行安全规则——确保输出符合您的内容策略
  • 评估多轮智能体——测试完整对话,而不仅仅是单次交互

内置评估包括字符串匹配、比较、正则表达式、语义相似性和 LLM 作为评判检查(Groundedness、Conformity、LLMJudge)。

概念

  • 目标(Target)——被测系统:任何同步/异步可调用对象 (inputs) -> outputs(可选带 trace)
  • 场景(Scenario)——一次评估:交互 + 检查
  • 检查(Check)——对 trace 的断言或 LLM 评判
  • 套件(Suite)——多个场景一起运行

giskard.agents.Generator 是用于工作流/评判的 LLM 客户端——与 giskard.checks 中合成用户消息的输入生成器(LLMGenerator)不同。

快速开始

root@kitploit:~
import asyncio
from giskard.checks import Scenario, Groundedness


def get_answer(inputs: str) -> str:
    return "Paris"  # 替换为您的模型 / 智能体


async def main() -> None:
    scenario = (
        Scenario("test_france_capital")
        .interact(inputs="What is the capital of France?", outputs=get_answer)
        .check(
            Groundedness(
                name="answer is grounded",
                context="France is in Western Europe. Its capital is Paris.",
            )
        )
    )
    result = await scenario.run()
    result.print_report()


asyncio.run(main())

Groundedness 是一个 LLM 评判——安装提供商附加项(例如 pip install "giskard[openai]")并设置相应的 API 密钥。默认模型:openai/gpt-4o-mini。

有关 Suites、LLMJudge、多轮场景等更多信息,请参阅完整文档。


Giskard Scan——AI 智能体漏洞扫描器

root@kitploit:~
pip install "giskard[scan]"   # 或:pip install giskard-scan

Giskard Scan 是智能体系统的红队测试和漏洞扫描层。它根据您智能体的自然语言描述自动生成对抗性测试套件,涵盖提示注入、有害内容、刻板印象、错误信息等。

使用 Giskard Scan 可以:

  • 对智能体进行红队测试——自动生成覆盖 OWASP LLM Top-10 威胁类别的对抗性输入
  • 运行提示注入探测——内置的注入载荷数据集,开箱即用
  • 使用自定义生成器扩展——将您自己的 ScenarioGenerator 实例传递给 generate_suite,或在 vulnerability_suite_generator_registry 上注册它们

快速开始

root@kitploit:~
import asyncio
from giskard.scan import vulnerability_scan


async def my_agent(inputs: str) -> str:
    # 替换为您的智能体 / 模型调用
    return f"Echo: {inputs}"


async def main() -> None:
    await vulnerability_scan(
        target=my_agent,
        description="A customer support chatbot for an e-commerce platform.",
        languages=["en"],
    )


asyncio.run(main())

扫描生成器同样需要 LLM 提供商附加项和 API 密钥(与上述 Checks 评判相同)。

正在寻找 Giskard v2?

Giskard v2 包含 Scan(自动漏洞检测)和 RAGET(RAG 评估测试集生成)。

对于 LLM 智能体,两者在 v3 中均由 giskard-scan 取代:使用 vulnerability_scan 替代 v2 LLM 扫描,使用 quality_scan(配合 KnowledgeBase)替代 RAGET。

v3 同样适用于 ML 模型——将模型包装为目标,并使用 giskard-checks 或 giskard-scan 进行评估。以下示例涵盖的是仅 v2 支持的自动表格扫描——即检查 giskard.Model + giskard.Dataset 以自动检测性能、偏见和鲁棒性问题的检测器套件——以及 giskard.testing ML 测试套件和 Giskard Hub。这些功能不计划在 v3 中提供。

root@kitploit:~
pip install "giskard[llm]>2,<3"

Scan——自动检测性能、偏见与安全问题

包装您的模型并运行扫描:

root@kitploit:~
import giskard
import pandas as pd


# 将 my_llm_chain 替换为您实际的 LLM 链或模型推理逻辑
def model_predict(df: pd.DataFrame):
    """该函数接收一个 DataFrame,必须返回一个输出列表(每行一个)。"""
    return [my_llm_chain.run({"query": question}) for question in df["question"]]


giskard_model = giskard.Model(
    model=model_predict,
    model_type="text_generation",
    name="My LLM Application",
    description="A question answering assistant",
    feature_names=["question"],
)

scan_results = giskard.scan(giskard_model)
display(scan_results)

Scan Example

RAGET——为 RAG 应用生成评估数据集

从您的知识库自动生成问题、参考答案和上下文:

root@kitploit:~
import pandas as pd
from giskard.rag import generate_testset, KnowledgeBase

# 加载您的知识库文档
df = pd.read_csv("path/to/your/knowledge_base.csv")
knowledge_base = KnowledgeBase.from_pandas(df, columns=["column_1", "column_2"])

testset = generate_testset(
    knowledge_base,
    num_questions=60,
    language="en",
    agent_description="A customer support chatbot for company X",
)

RAGET Example

完整 v2 文档

👋 社区

我们欢迎 AI 社区的贡献!阅读此指南开始,并加入我们在 Discord 上蓬勃发展的社区。

关注进展并分享反馈: v3 公告 · 路线图

🌟 给我们点个星,这有助于项目被更多人发现,并激励我们构建出色的开源工具!🌟

❤️ 如果您觉得我们的工作有用,请考虑在 GitHub 上赞助我们。通过月度赞助,您可以获得赞助徽章、在本文档中展示您的公司,并让您的 bug 报告获得优先处理。如果您希望我们参与咨询项目、举办工作坊或在贵公司进行演讲,我们也提供一次性赞助。

下载工具
scangiskard-scan
openai / anthropic / …提供商 SDK(参见 pyproject.toml 可选依赖)
状态包描述
✅ 稳定giskard-checks测试与评估——场景 API、内置检查、LLM 作为评判
✅ 稳定giskard-scan智能体漏洞扫描器 + RAG/质量评估——红队测试、提示注入、越狱与有害内容(vulnerability_scan,v2 Scan 的继任者),以及知识库质量评估(quality_scan,v2 RAGET 的继任者)