
Automatise la résolution de CAPTCHA avec des modèles d'IA multimodaux (GPT-4o, Gemini) et Selenium, prenant en charge le texte, l'audio, les puzzles à glissière et reCAPTCHA v2 via une interface en ligne de commande.
Ce projet est un outil en ligne de commande basé sur Python qui utilise de grands modèles multimodaux (LMM) comme GPT-4o d'OpenAI et Gemini de Google pour résoudre automatiquement différents types de CAPTCHA. Il s'appuie sur Selenium pour l'automatisation du navigateur web afin d'interagir avec les pages web et de résoudre les CAPTCHA en temps réel.
Une résolution réussie est enregistrée sous forme de GIF dans le répertoire successful_solves.
Article de blog détaillé : https://aydinnyunus.github.io/2025/12/08/ai-captcha-bypass/
L'outil peut résoudre les types de CAPTCHA suivants trouvés sur les pages 2captcha.com/demo/ :
🔥 Pourquoi les utilisateurs adorent CapMonster.Cloud
💡 Taux de réussite très élevés (jusqu'à 99 %)
⚡ Résolution ultra rapide
💲 Tarification transparente et abordable (paiement par 1 000 CAPTCHA)
🔌 Intégration facile via API + extensions de navigateur
⭐ Excellentes évaluations sur TrustPilot, SourceForge, SaaSHub, AlternativeTo
--
🔗 Liens utiles
💲 Tarifs et types de CAPTCHA pris en charge (plus de 25 types pris en charge)
📘 Documentation de l'API
💡 Site web principal → capmonster.cloud
⭐ Avis → TrustPilot
Clonez le dépôt :
git clone https://github.com/aydinnyunus/ai-captcha-bypass
cd ai-captcha-bypass
Installez les dépendances :
pip install -r requirements.txt
Configurez vos clés API :
Créez un fichier .env dans le répertoire racine en copiant le fichier d'exemple :
cp .env.example .env
Ouvrez le fichier .env et ajoutez vos clés API pour OpenAI et/ou Google Gemini :
OPENAI_API_KEY="sk-..."
GOOGLE_API_KEY="..."
Le script principal pour exécuter le solveur est main.py. Vous devez spécifier le type de CAPTCHA à tester. Vous pouvez également spécifier le fournisseur d'IA et le modèle.
captcha_type : (Obligatoire) Le type de CAPTCHA à résoudre.
puzzle, text, complicated_text, recaptcha_v2, audio--provider : Le fournisseur d'IA à utiliser.
openai, gemini (par défaut : openai)--model : Le modèle spécifique à utiliser (par exemple, gpt-4o, gemini-2.5-flash).--file : Chemin vers un fichier audio pour le test . (Défaut : )Résoudre un CAPTCHA texte simple avec OpenAI (par défaut) :
python main.py text
Résoudre un CAPTCHA texte complexe avec Gemini :
python main.py complicated_text --provider gemini
Résoudre un défi reCAPTCHA v2 avec Gemini :
python main.py recaptcha_v2 --provider gemini
Transcrire un CAPTCHA audio :
python main.py audio --file files/radio.wav --provider openai
Résoudre un CAPTCHA puzzle avec un modèle OpenAI spécifique :
python main.py puzzle --provider openai --model gpt-4o
Voici quelques exemples du solveur contournant avec succès différents types de CAPTCHA.
main.py : Le point d'entrée principal pour exécuter les tests du solveur de CAPTCHA. Gère les arguments de la ligne de commande et appelle les fonctions de test appropriées.ai_utils.py : Contient toutes les fonctions pour interagir avec les API OpenAI et Gemini. C'est ici que les invites sont définies et que les appels API sont effectués.puzzle_solver.py : Implémente la logique spécifiquement pour résoudre le CAPTCHA puzzle à glissière en plusieurs étapes.benchmark.py : Un script pour exécuter plusieurs tests afin d'évaluer les performances et le taux de réussite des différents solveurs.requirements.txt : Une liste de tous les paquets Python requis pour le projet.screenshots/ : Répertoire où les captures d'écran des CAPTCHA sont temporairement enregistrées.successful_solves/ : Répertoire où les GIF des solutions réussies sont enregistrés.audiofiles/audio.mp3| Type de CAPTCHA | OpenAI (GPT-4o) | Gemini (2.5 Pro) |
|---|
| reCAPTCHA v2 | ![]() | ![]() |
| Puzzle | ![]() | ![]() |
| Texte complexe | ![]() | ![]() |