该项目是一个基于 Python 的命令行工具,利用大型多模态模型(LMM),如 OpenAI 的 GPT-4o 和 Google 的 Gemini,来自动解决各种类型的 CAPTCHA。它借助 Selenium 实现浏览器自动化,与网页交互并实时解决 CAPTCHA。
成功求解的动图会以 GIF 格式保存在 successful_solves 目录中。
详细博客文章:https://aydinnyunus.github.io/2025/12/08/ai-captcha-bypass/
该工具可以解决 2captcha.com/demo/ 页面上的以下 CAPTCHA 类型:
🔥 为什么用户喜爱 CapMonster.Cloud
💡 非常高的成功率(高达 99%)
⚡ 超快的求解速度
💲 经济实惠、透明定价(每 1,000 个验证码付费)
🔌 通过 API + 浏览器扩展轻松集成
⭐ 在 TrustPilot、SourceForge、SaaSHub、AlternativeTo 上获得极佳评价
--
🔗 实用链接
💲 定价及支持的验证码类型(支持 25+ 种类型)
📘 API 文档
💡 官方网站 → capmonster.cloud
⭐ 评论 → TrustPilot
克隆仓库:
git clone https://github.com/aydinnyunus/ai-captcha-bypass
cd ai-captcha-bypass
安装依赖:
pip install -r requirements.txt
设置 API 密钥:
通过复制示例文件,在根目录中创建 .env 文件:
cp .env.example .env
打开 .env 文件,并添加你的 OpenAI 和/或 Google Gemini API 密钥:
OPENAI_API_KEY="sk-..."
GOOGLE_API_KEY="..."
运行求解器的主要脚本是 main.py。你需要指定要测试的 CAPTCHA 类型。你也可以指定 AI 提供商和模型。
captcha_type:(必需)要解决的 CAPTCHA 类型。
puzzle、text、complicated_text、recaptcha_v2、audio--provider:要使用的 AI 提供商。
openai、gemini(默认:openai)--model:要使用的具体模型(例如 gpt-4o、gemini-2.5-flash)。--file:用于 audio 测试的音频文件路径。(默认:)使用 OpenAI 解决简单文本验证码(默认):
python main.py text
使用 Gemini 解决复杂文本验证码:
python main.py complicated_text --provider gemini
使用 Gemini 解决 reCAPTCHA v2 挑战:
python main.py recaptcha_v2 --provider gemini
转录音频验证码:
python main.py audio --file files/radio.wav --provider openai
使用特定的 OpenAI 模型解决拼图验证码:
python main.py puzzle --provider openai --model gpt-4o
以下是一些求解器成功绕过不同类型验证码的示例。
main.py:运行 CAPTCHA 求解器测试的主要入口点。处理命令行参数并调用相应的测试函数。ai_utils.py:包含与 OpenAI 和 Gemini API 交互的所有函数。这里定义了提示词并进行了 API 调用。puzzle_solver.py:专门实现用于解决多步骤滑块拼图 CAPTCHA 的逻辑。benchmark.py:用于运行多次测试以评估不同求解器性能和成功率的脚本。requirements.txt:项目所需的所有 Python 包列表。screenshots/:临时保存 CAPTCHA 屏幕截图的目录。successful_solves/:保存成功解决方案的 GIF 文件的目录。files/audio.mp3| CAPTCHA 类型 | OpenAI (GPT-4o) | Gemini (2.5 Pro) |
|---|
| reCAPTCHA v2 | ![]() | ![]() |
| 拼图 | ![]() | ![]() |
| 复杂文本 | ![]() | ![]() |