Назад к обновлениям
New releaseAug 4, 2026

promptfoo v0.122.0

Тестируйте свои промпты, агенты и RAG. Red teaming/пентестинг/сканирование уязвимостей для ИИ. Сравнивайте производительность GPT, Claude, Gemini, DeepSeek и других. Простые декларативные конфиги с интеграцией командной строки и CI/CD. Используется OpenAI и Anthropic.

Поделиться

Promptfoo: оценка LLM и red teaming

npm npm GitHub Workflow Status Лицензия MIT Discord

promptfoo — это CLI и библиотека для оценки и red teaming LLM-приложений. Прекратите метод проб и ошибок — начинайте создавать безопасные и надёжные AI-приложения.

Веб-сайт · Начало работы · Red Teaming · Документация · Discord

Promptfoo теперь часть OpenAI. Promptfoo остаётся open source и лицензирован по MIT. Читайте обновление компании.

Быстрый старт

Требуется Node.js ^20.20.0 или >=22.22.0 для использования npm и npx. Поддержка Node.js 20 заканчивается 30 июля 2026 года в 00:00 UTC; обновитесь до Node.js 24 LTS перед обновлением promptfoo после этой даты.

npm install -g promptfoo
promptfoo init --example getting-started

Также доступен через brew install promptfoo и pip install promptfoo. Вы также можете использовать npx promptfoo@latest для запуска любой команды без установки.

Большинство LLM-провайдеров требуют API-ключ. Установите его как переменную окружения:

export OPENAI_API_KEY=sk-abc123

После того как вы окажетесь в каталоге примера, запустите оценку и просмотрите результаты:

cd getting-started
promptfoo eval
promptfoo view

Смотрите разделы Начало работы (оценка) или Red Teaming (сканирование уязвимостей) для получения дополнительной информации.

Что можно делать с Promptfoo?

  • Тестировать свои промпты и модели с помощью автоматизированных оценок
  • Защищать свои LLM-приложения с помощью red teaming и сканирования уязвимостей
  • Сравнивать модели бок о бок (OpenAI, Anthropic, Azure, Bedrock, Ollama и другие)
  • Автоматизировать проверки в CI/CD
  • Просматривать pull request'ы на предмет проблем безопасности и соответствия, связанных с LLM, с помощью сканирования кода
  • Делиться результатами с командой

Вот как это выглядит в действии:

матрица оценки промптов — веб-просмотрщик

Также работает в командной строке:

командная строка promptfoo

Кроме того, может генерировать отчёты об уязвимостях безопасности:

генеративный AI red team

Почему Promptfoo?

  • Ориентирован на разработчиков: Быстрый, с функциями вроде live reload и кэширования
  • Конфиденциальность: Оценка LLM выполняется полностью локально — ваши промпты никогда не покидают вашу машину
  • Гибкость: Работает с любым LLM API или языком программирования
  • Проверен в бою: Питает LLM-приложения, обслуживающие 10M+ пользователей в production
  • Основан на данных: Принимайте решения на основе метрик, а не интуиции
  • Open source: Лицензия MIT, активное сообщество

Узнать больше

Участие в разработке

Мы приветствуем любой вклад! Ознакомьтесь с руководством по участию, чтобы начать.

Присоединяйтесь к нашему сообществу в Discord для помощи и обсуждений.

Категории