
Automatizza la risoluzione dei CAPTCHA con modelli AI multimodali (GPT-4o, Gemini) e Selenium, con supporto per testo, audio, puzzle a slider e reCAPTCHA v2 tramite un'interfaccia a riga di comando.
Questo progetto è uno strumento da riga di comando basato su Python che utilizza grandi modelli multimodali (LMM) come GPT-4o di OpenAI e Gemini di Google per risolvere automaticamente vari tipi di CAPTCHA. Sfrutta Selenium per l'automazione del browser web al fine di interagire con le pagine web e risolvere i CAPTCHA in tempo reale.
Una risoluzione riuscita viene registrata come GIF nella directory successful_solves.
Post del blog dettagliato: https://aydinnyunus.github.io/2025/12/08/ai-captcha-bypass/
Lo strumento può risolvere i seguenti tipi di CAPTCHA presenti nelle pagine 2captcha.com/demo/:
🔥 Perché gli utenti amano CapMonster.Cloud
💡 Tassi di successo molto elevati (fino al 99%)
⚡ Tempi di risoluzione rapidissimi
💲 Prezzi convenienti e trasparenti (paghi per 1.000 CAPTCHA)
🔌 Integrazione semplice tramite API + estensioni del browser
⭐ Recensioni eccellenti su TrustPilot, SourceForge, SaaSHub, AlternativeTo
--
🔗 Link Utili
💲 Prezzi e Tipi di CAPTCHA Supportati (oltre 25 tipi supportati)
📘 Documentazione API
💡 Sito Web Principale → capmonster.cloud
⭐ Recensioni → TrustPilot
Clona il repository:
git clone https://github.com/aydinnyunus/ai-captcha-bypass
cd ai-captcha-bypass
Installa le dipendenze:
pip install -r requirements.txt
Configura le tue chiavi API:
Crea un file .env nella directory principale copiando il file di esempio:
cp .env.example .env
Apri il file .env e aggiungi le tue chiavi API per OpenAI e/o Google Gemini:
OPENAI_API_KEY="sk-..."
GOOGLE_API_KEY="..."
Lo script principale per eseguire il risolutore è main.py. Devi specificare il tipo di CAPTCHA da testare. Puoi anche specificare il provider IA e il modello.
captcha_type: (Obbligatorio) Il tipo di CAPTCHA da risolvere.
puzzle, text, complicated_text, recaptcha_v2, audio--provider: Il provider IA da utilizzare.
openai, gemini (Predefinito: openai)--model: Il modello specifico da utilizzare (ad es. gpt-4o, gemini-2.5-flash).--file: Percorso di un file audio per il test . (Predefinito: )Risolvi un semplice CAPTCHA di testo utilizzando OpenAI (predefinito):
python main.py text
Risolvi un CAPTCHA di testo complicato utilizzando Gemini:
python main.py complicated_text --provider gemini
Risolvi una sfida reCAPTCHA v2 utilizzando Gemini:
python main.py recaptcha_v2 --provider gemini
Trascrivi un CAPTCHA audio:
python main.py audio --file files/radio.wav --provider openai
Risolvi un CAPTCHA puzzle utilizzando un modello OpenAI specifico:
python main.py puzzle --provider openai --model gpt-4o
Ecco alcuni esempi del risolutore che bypassa con successo diversi tipi di CAPTCHA.
main.py: Il punto di ingresso principale per eseguire i test del risolutore di CAPTCHA. Gestisce gli argomenti della riga di comando e chiama le funzioni di test appropriate.ai_utils.py: Contiene tutte le funzioni per interagire con le API di OpenAI e Gemini. È qui che vengono definiti i prompt e vengono effettuate le chiamate API.puzzle_solver.py: Implementa la logica specifica per risolvere il CAPTCHA puzzle a scorrimento in più passaggi.benchmark.py: Uno script per eseguire più test al fine di valutare le prestazioni e il tasso di successo dei diversi risolutori.requirements.txt: Un elenco di tutti i pacchetti Python richiesti per il progetto.screenshots/: Directory in cui gli screenshot dei CAPTCHA vengono salvati temporaneamente.successful_solves/: Directory in cui vengono salvate le GIF delle soluzioni riuscite.audiofiles/audio.mp3| Tipo di CAPTCHA | OpenAI (GPT-4o) | Gemini (2.5 Pro) |
|---|
| reCAPTCHA v2 | ![]() | ![]() |
| Puzzle | ![]() | ![]() |
| Complicated Text | ![]() | ![]() |