#1Инструменты безопасности LLM, инъекции промптов, извлечения моделей, состязательного ИИ и ред-тиминга ИИ.
Рекомендация Kitploit

Открытый шлюз, который обеспечивает безопасность, управление и мониторинг вызовов инструментов MCP и трафика LLM AI-агентов, с аутентификацией по…

Каталог фреймворка OWASP, в котором перечислены 10 главных рисков безопасности в инфраструктуре неоклаудов и дата-центров ИИ, охватывающий аппаратное…

Набор инструментов для анализа среды выполнения Windows, объединяющий сканирование памяти, отладку, автоматизацию и API, удобные для ИИ.

Исследовательский код для HARDE — обвязки агента, которая исследует и адаптивно оптимизирует компоненты для обнаружения рисков во время выполнения и…

Встраивает и обнаруживает ключевые, основанные на стиле водяные знаки в сгенерированном LLM коде на Python, Java и C++ посредством перезаписи CST,…

Стенд для бенчмаркинга, измеряющий, на каком этапе срабатывают защиты от prompt injection в конвейерах LLM-агентов, использующих инструменты,…

Эффективная по потреблению ОЗУ терминальная агентная среда для программирования, кибербезопасности и автоматизации.

Эксплойт proof-of-concept для CVE-2026-33017 — неаутентифицированная RCE в эндпоинте build_public_tmp Langflow, внедряющая вредоносный…

Движок безопасности на стандартной библиотеке Python для триажа, сканирующий веб-приложения, API, LLM и мобильные пакеты посредством пассивной…

Статический анализатор кода на основе AST с агентным сопоставлением связей на базе LLM для обнаружения путей RCE в Python и глубоких цепочек…

Отладчик уровня ядра Windows с интерфейсом в стиле OllyDbg/IDA, программными и аппаратными точками останова, символами PDB, декомпилятором и 17…

Курируемый индекс атак и защит на основе глубокого обучения, направленных на задержку, энергопотребление-задержку и тайминги (доступность) —…

Открытые LLM и код для обучения/оценки защиты от атак prompt injection, с бенчмарками для безопасности агентного вызова инструментов и следования…

UI с участием человека в цикле, который преобразует описания протоколов на естественном языке или C/C++ в проверяемый Protocol IR, а затем генерирует…

Стенд для бенчмаркинга и оценки, проверяющий, сопротивляются ли LLM-агенты вредоносным инструкциям, скрытым в мультимодальных изображениях навыков,…

Фреймворк агентного джейлбрейка для агентов на основе LLM, использующий декомпозицию задач на основе схем, многоходовые стратегии маскировки и…

Эволюционная платформа для обхода защиты LLM и тестирования guardrail-механизмов, которая формирует переиспользуемый пул стратегий с помощью…

Открытый фреймворк для red teaming промпт-инъекций на основе RL, с общим тренером, curriculum learning и бенчмарками, такими как AgentDojo,…