
Automatiza a resolução de CAPTCHAs com modelos de IA multimodais (GPT-4o, Gemini) e Selenium, suportando texto, áudio, sliders e reCAPTCHA v2 por meio de uma interface de linha de comando.
Este projeto é uma ferramenta de linha de comando baseada em Python que utiliza grandes modelos multimodais (LMMs), como o GPT-4o da OpenAI e o Gemini do Google, para resolver automaticamente vários tipos de CAPTCHAs. Ele usa o Selenium para automação de navegador web, a fim de interagir com páginas da web e resolver CAPTCHAs em tempo real.
Uma solução bem-sucedida é salva como um GIF no diretório successful_solves.
Postagem detalhada no blog: https://aydinnyunus.github.io/2025/12/08/ai-captcha-bypass/
A ferramenta pode resolver os seguintes tipos de CAPTCHA encontrados nas páginas 2captcha.com/demo/:
🔥 Por que os usuários adoram o CapMonster.Cloud
💡 Taxas de sucesso muito altas (até 99%)
⚡ Tempos de resolução super rápidos
💲 Preços acessíveis e transparentes (pague por 1.000 CAPTCHAs)
🔌 Integração fácil via API + extensões de navegador
⭐ Excelentes avaliações no TrustPilot, SourceForge, SaaSHub, AlternativeTo
--
🔗 Links Úteis
💲 Preços e tipos de CAPTCHA suportados (mais de 25 tipos suportados)
📘 Documentação da API
💡 Site principal → capmonster.cloud
⭐ Avaliações → TrustPilot
Clone o repositório:
git clone https://github.com/aydinnyunus/ai-captcha-bypass
cd ai-captcha-bypass
Instale as dependências:
pip install -r requirements.txt
Configure suas chaves de API:
Crie um arquivo .env no diretório raiz copiando o arquivo de exemplo:
cp .env.example .env
Abra o arquivo .env e adicione suas chaves de API para OpenAI e/ou Google Gemini:
OPENAI_API_KEY="sk-..."
GOOGLE_API_KEY="..."
O script principal para executar o solucionador é o main.py. Você precisa especificar o tipo de CAPTCHA a ser testado. Também é possível especificar o provedor de IA e o modelo.
captcha_type: (Obrigatório) O tipo de CAPTCHA a ser resolvido.
puzzle, text, complicated_text, recaptcha_v2, audio--provider: O provedor de IA a ser usado.
openai, gemini (Padrão: openai)--model: O modelo específico a ser usado (ex.: gpt-4o, gemini-2.5-flash).--file: Caminho para um arquivo de áudio para o teste de . (Padrão: )Resolva um CAPTCHA de texto simples usando a OpenAI (padrão):
python main.py text
Resolva um CAPTCHA de texto complicado usando o Gemini:
python main.py complicated_text --provider gemini
Resolva um desafio reCAPTCHA v2 usando o Gemini:
python main.py recaptcha_v2 --provider gemini
Transcreva um CAPTCHA de áudio:
python main.py audio --file files/radio.wav --provider openai
Resolva um CAPTCHA de quebra-cabeça usando um modelo específico da OpenAI:
python main.py puzzle --provider openai --model gpt-4o
Aqui estão alguns exemplos do solucionador contornando com sucesso diferentes tipos de CAPTCHA.
main.py: O ponto de entrada principal para executar os testes do solucionador de CAPTCHA. Ele processa os argumentos de linha de comando e chama as funções de teste apropriadas.ai_utils.py: Contém todas as funções para interagir com as APIs da OpenAI e do Gemini. É aqui que os prompts são definidos e as chamadas de API são feitas.puzzle_solver.py: Implementa a lógica especificamente para resolver o CAPTCHA de quebra-cabeça deslizante em várias etapas.benchmark.py: Um script para executar vários testes a fim de avaliar o desempenho e a taxa de sucesso dos diferentes solucionadores.requirements.txt: Uma lista de todos os pacotes Python necessários para o projeto.screenshots/: Diretório onde as capturas de tela dos CAPTCHAs são salvas temporariamente.successful_solves/: Diretório onde os GIFs das soluções bem-sucedidas são salvos.audiofiles/audio.mp3| Tipo de CAPTCHA | OpenAI (GPT-4o) | Gemini (2.5 Pro) |
|---|
| reCAPTCHA v2 | ![]() | ![]() |
| Quebra-cabeça | ![]() | ![]() |
| Texto complicado | ![]() | ![]() |