
Cacher des informations précieuses là où on s'y attend le moins
[!WARNING] Ce projet est entièrement codé à l'instinct (probablement partiellement plagié de ce dépôt) et l'auteur est un gros niais qui a juste trouvé l'idée amusante.
Utilisez les préambules de recettes optimisés pour le référencement comme véhicule pour coder des messages secrets (le prompt peut en réalité être n'importe quoi, le prompt partagé est simplement une clé que l'encodeur et le décodeur acceptent).
Cache des messages secrets dans un texte d'apparence naturelle en utilisant la stéganographie linguistique neuronale.
Les deux côtés doivent utiliser exactement le même modèle, la même quantification, la même valeur top-k et le même prompt. Toute différence entraîne un échec du décodage.
--device cpu --no-4bit mais sera nettement plus lent# Créez et activez un environnement virtuel, puis installez les paquets requis
python -m venv env
source env/bin/activate
pip install -r requirements.txt
# ou, avec `uv`
uv sync
uv pip install -r requirements.txt
[!NOTE] Définissez la variable d'environnement
HF_TOKENpour vous authentifier auprès de HuggingFace
python main.py encode --message "attack at dawn"
Ceci utilise le prompt de préambule de recette par défaut et Llama-3.2-3B. Le texte stéganographié est affiché sur la sortie standard et sauvegardé dans stego_output.txt.
python main.py decode --stego-file stego_output.txt
# Encoder avec un prompt personnalisé
python main.py encode \
--message "meet me at noon" \
--prompt "The best thing about making scrambled eggs is: "
# Décoder (le prompt doit correspondre exactement !)
python main.py decode \
--stego-file stego_output.txt \
--prompt "The best thing about making scrambled eggs is: "
# Utiliser un modèle différent
python main.py encode \
--model "mistralai/Mistral-7B-v0.3" \
--message "secret message" \
--prompt "Every Sunday morning my grandmother would"
| Option | Défaut | Description |
|---|
--model | meta-llama/Llama-3.2-3B | Nom/chemin du modèle HuggingFace |
--prompt | (préambule SEO de recette) | Prompt contextuel (doit correspondre entre encodage et décodage) |
--message | (interactif) | Message secret à encoder |
--stego-text | Chaîne de texte stéganographié à décoder | |
--stego-file | stego_output.txt | Fichier de texte stéganographié (sortie pour encode, entrée pour decode) |
--top-k | 256 | Taille du vocabulaire top-k pour la CDF |
--max-tokens | (illimité) | Nombre maximal de tokens à générer |
--device | cuda | Périphérique : cuda ou cpu |
--no-4bit | désactivé | Désactiver la quantification 4 bits (utilise fp16 ; nécessite plus de VRAM) |