
Escalonamento de inferência para garantia de segurança de LLMs

O código foi testado com as seguintes dependências:
typing_extensions==4.14.0numpy==2.2.6torch==2.5.1huggingface_hub==0.30.2accelerate==1.1.1datasets==3.1.0evaluate==0.4.3transformers==4.45.2peft==0.15.0deepspeed==0.16.7Veja saffron.py. Mais descrições em breve...
