
Servidor MCP para búsqueda en Google y obtención de páginas usando Chromium sin cabeza.
Si quieres apoyar noapi-google-mcp o gpt-oss-20B/120B-Vision y otros modelos de código abierto en desarrollo, por favor contribuye a mi fondo de cómputo en GPU: se necesitan alrededor de $3000.
Si encuentras esto útil, considera apoyar el desarrollo continuo y nuevas funciones.
BTC:16DT4AHemLyn7C6P116YepjY518gu9wUUH
ETH:
0x7287D1F9c77832cFF246937af0443622bFdACD04
38 herramientas. Cero claves API. Dale a cualquier LLM local búsqueda real en Google, feeds en vivo, visión, OCR y comprensión completa de video.
Un servidor MCP que convierte tu LLM local en un asistente completamente conectado. Resultados reales de Google, noticias en vivo y feeds sociales, búsqueda inversa de imágenes, OCR sin conexión, transcripción de YouTube y extracción de clips — todo ejecutándose localmente mediante Chromium sin interfaz gráfica y modelos de ML de código abierto. Sin claves API, sin límites de uso, sin dependencia en la nube.
Funciona con LM Studio, Claude Desktop, OpenClaw, Ollama y cualquier cliente compatible con MCP.
Google comenzó a detectar navegadores Chromium sin interfaz gráfica y a mostrar CAPTCHAs en lugar de resultados de búsqueda (#2). Lo solucionamos adecuadamente y luego añadimos un solucionador de CAPTCHA con red neuronal solo porque podíamos.
Parches anti-detección:
navigator.webdriver, falsificar plugins del navegador, chrome.runtime y eliminar las huellas de Playwrightaarch64, ahora coincide con el binario de Chromium real)Solucionador de CAPTCHA con red neuronal (MobileNetV2 + OpenCV):
¿Resolverá todos los CAPTCHA? No. Pero logrará superar algunos, y honestamente lo construimos principalmente porque podíamos.
Una tubería completa de recuperación-aumentada local para YouTube. Suscríbete a cualquier canal y, cuando revises los feeds, el servidor descarga automáticamente el audio, lo transcribe con Whisper y almacena la transcripción completa en SQLite con búsqueda de texto completo FTS5. Cada palabra de cada video se vuelve buscable: tu LLM hace una pregunta y obtiene la respuesta del video correcto.
¿Encontraste algo interesante? Pídele al LLM que extraiga ese segmento como un clip. Lee la transcripción, encuentra las marcas de tiempo exactas y recorta el video por ti. Este es el comienzo de la edición de video impulsada por IA/LLM — tu LLM comprende el contenido y recorta clips según lo que se dice, no solo las marcas de tiempo.
Cómo funciona:
suscribir a un canal de YouTube — por identificador (@3Blue1Brown), URL o ID del canalcheck_feeds — los videos nuevos se obtienen y se transcriben automáticamente localmente con faster-whisper. Las transcripciones se escriben en la base de datos para búsqueda instantánea. Hasta 5 videos por revisión, en caché para que nada se descargue de nuevo.search_feeds — búsqueda de texto completo en todas las transcripciones. Soporta AND, OR, NOT y frases entre comillas. Tu LLM encuentra el video y el pasaje exactos que responden tu pregunta.extract_video_clip — dile al LLM qué te interesa y recorta el clip del video. El LLM usa la transcripción para encontrar el segmento correcto y lo extrae automáticamente.```
"Subscribe to @AndrejKarpathy on YouTube"
"Check my feeds"
"Search my feeds for backpropagation explained"
"What did Karpathy say about tokenization?"
"Extract the part where he explains gradient descent"
"Cut a clip of the hardware comparison section"Sin embeddings, sin base de datos vectorial, sin API — solo Whisper + SQLite FTS5 ejecutándose en tu máquina.
> **Hoja de ruta:** La extracción de clips es el primer paso hacia la edición de video completamente impulsada por IA. Futuras versiones añadirán superposición de música/audio, remezcla de video, compilación de múltiples clips, reformateo vertical para TikTok/Reels/Shorts y resúmenes automáticos de momentos destacados — todo impulsado por tu LLM al comprender el contenido.
---
### Suscripciones a Fuentes en Vivo
Suscríbete a noticias, Reddit, Hacker News, canales de YouTube, perfiles de Twitter/X, repositorios de GitHub, artículos de arXiv y podcasts. El contenido se obtiene, se almacena localmente en SQLite con búsqueda de texto completo y está disponible para tu LLM al instante.
| Nueva Herramienta | Qué Hace |
|----------|-------------|
| `subscribe` | Agregar cualquier fuente — RSS de noticias, Reddit, HN, GitHub, arXiv, YouTube, podcasts, Twitter/X |
| `unsubscribe` | Eliminar una suscripción y su contenido almacenado |
| `list_subscriptions` | Ver todas las fuentes activas con conteos de elementos |
| `check_feeds` | Consultar todas las suscripciones, obtener contenido nuevo, transcribir automáticamente videos de YouTube |
| `search_feeds` | Búsqueda de texto completo en todo lo que tus fuentes han recolectado |
| `get_feed_items` | Explorar elementos recientes, filtrados por fuente o tipo |
**Fuentes de noticias preconfiguradas** — suscríbete con una sola palabra: `bbc`, `cnn`, `nyt`, `guardian`, `npr`, `aljazeera`, `techcrunch`, `ars`, `verge`, `wired`, `reuters`
**Atajos de arXiv** — `ai`, `ml`, `cv`, `nlp`, `robotics`, `crypto`, `systems`, `hci````
"Subscribe to BBC News, r/LocalLLaMA, and Hacker News"
"Follow @elonmusk on Twitter"
"Subscribe to the YouTube channel @3Blue1Brown"
"Watch anthropics/claude-code on GitHub for new releases"
"Subscribe to the machine learning arXiv category"
"Check my feeds"
"Search my feeds for transformer architecture"
"What's new in my Reddit feeds?"
Transcribe reuniones, convierte formatos, lee documentos — todo local, sin nube.
| Nueva Herramienta | Qué Hace |
|---|---|
transcribe_local | Transcribe cualquier archivo de audio o video local con Whisper (mp3, wav, mp4, mkv, etc.) |
convert_media | Conversión de formatos con FFmpeg — video a audio, formato a formato, video a GIF |
read_document | Extrae texto de PDF, DOCX, HTML, CSV, JSON y más de 30 formatos de texto |