Volver a actualizaciones
Nuevo releaseOct 6, 2026

promptfoo v0.124.0

Prueba tus prompts, agentes y RAGs. Red teaming/pentesting/escaneo de vulnerabilidades para IA. Compara el rendimiento de GPT, Claude, Gemini, DeepSeek y más. Configuraciones declarativas simples con integración en línea de comandos y CI/CD. Utilizado por OpenAI y Anthropic.

Compartir

Promptfoo: evaluaciones de LLM y red teaming

npm npm GitHub Workflow Status MIT license Discord

promptfoo es una CLI y biblioteca para evaluar y hacer red teaming de aplicaciones basadas en LLM. Deja de usar prueba y error... empieza a desplegar agentes seguros y confiables

Sitio web · Primeros pasos · Red Teaming · Documentación · Discord

Promptfoo ahora forma parte de OpenAI. Promptfoo sigue siendo de código abierto y con licencia MIT. Lee la actualización de la compañía.

Inicio rápido

npm install -g promptfoo
promptfoo init --example getting-started

También disponible mediante brew install promptfoo y pip install promptfoo. O usa npx promptfoo@latest para ejecutar cualquier comando sin instalarlo.

La mayoría de los proveedores de LLM requieren una clave de API. Configura la tuya como variable de entorno:

export OPENAI_API_KEY=sk-abc123

Ejecuta una evaluación y visualiza los resultados:

cd getting-started
promptfoo eval
promptfoo view

¡Consulta Primeros pasos (evaluaciones) o Red Teaming (escaneo de vulnerabilidades) para más información!

¿Qué puedes hacer con Promptfoo?

  • Probar tus prompts y modelos con evaluaciones automatizadas
  • Proteger tus aplicaciones LLM con red teaming y escaneo de vulnerabilidades
  • Comparar modelos en paralelo (OpenAI, Anthropic, Azure, Bedrock, Ollama y más)
  • Automatizar comprobaciones en CI/CD
  • Revisar pull requests en busca de problemas de seguridad y cumplimiento relacionados con LLM con escaneo de código
  • Compartir resultados con tu equipo

Así se ve en acción:

prompt evaluation matrix - web viewer

También funciona en la línea de comandos:

promptfoo command line

También puede generar informes de vulnerabilidades de seguridad:

gen ai red team

¿Por qué Promptfoo?

  • Enfocado en el desarrollador: Rápido, con funciones como recarga en vivo y caché
  • Privado: Las evaluaciones de LLM se ejecutan 100% localmente - tus prompts nunca salen de tu máquina
  • Flexible: Funciona con cualquier API de LLM o lenguaje de programación
  • Probado en batalla: Impulsa aplicaciones LLM que sirven a más de 10M de usuarios en producción
  • Basado en datos: Toma decisiones basadas en métricas, no en intuiciones
  • Código abierto: Licencia MIT, con una comunidad activa

Más información

Contribuir

¡Aceptamos contribuciones! Consulta nuestra guía de contribución para empezar.

Únete a nuestra comunidad de Discord para obtener ayuda y participar en debates.

Categorías