En una sola tarde cambiamos nuestro clúster interno de Playwright por Yozh. El punto final de MCP se integró directamente en nuestro agente Claude: sin necesidad de código de enlace, el rastreador y el extractor funcionaron a la primera.
Extracción
de datos web sencilla para agentes
de IA y personas
Una herramienta de código abierto para la recopilación y extracción de datos. Empieza con una sola URL, rastrea el sitio y obtén datos estructurados a medida que se cargan las páginas. Funciona con MCP y herramientas como Claude y Cursor, y cuenta con configuraciones predefinidas para plataformas de venta como Amazon y eBay.
Explora páginas web completas y obtén datos de una sola vez
Yozh Crawler genera un mapa de toda la estructura del sitio y procesa las páginas a medida que las va encontrando. De este modo, obtienes tanto cobertura como resultados útiles en una sola ejecución, sin necesidad de gestionar por separado los pasos de rastreo y extracción de datos. Funciona directamente dentro de tus flujos de trabajo existentes de recopilación de datos y extracción.
Yozh Crawler, integrado NEW
Empieza por una URL y rastrea todo el sitio web. Las páginas se detectan y procesan en una sola pasada, por lo que obtienes una cobertura completa sin pasos adicionales.
Modo Descubrimiento NEW
¿Solo necesitas enlaces? Cambia al modo de exploración y genera un mapa del sitio sin analizar el código. Es más rápido, más ligero y útil para auditorías y comprobaciones de estructura.
Navegador de incógnito
Sincroniza los encabezados, la ubicación y las señales del navegador con tu proxy. Ayuda a mantener la coherencia de las sesiones en diferentes regiones.
Extracción por lotes
Ejecuta cientos de URL en una sola solicitud. Procesa todo en paralelo con un único resultado claro.
Cancelación en dos fases NEW
Detén las tareas sin afectar a los resultados. Deja que las páginas activas terminen o detén todo al instante cuando sea necesario.
Integración de MCP
Conéctate directamente con herramientas como Claude y Cursor. Incorpora el scraping y el crawling a tus flujos de trabajo actuales.
10 preajustes integrados
Amazon, eBay, Walmart, Google, Google Shopping, YouTube, LinkedIn, Bing, Yandex: introduce el nombre de la fuente y los parámetros, y obtén una respuesta normalizada. No hay que escribir ningún selector.
Autorreparación de LLM NEW
¿Una página web implementa un cambio en el diseño y tus selectores CSS devuelven un resultado vacío? El analizador solicita a un modelo de lenguaje grande (LLM) (OpenAI / Anthropic / Gemini / OpenRouter) que vuelva a generar el selector sobre la marcha. El proceso continúa ejecutándose.
Ajustes predefinidos generados por IA NEW
¿Necesitas una página web para la que no ofrecemos una configuración predefinida? Describe qué hay que extraer y pega una URL de ejemplo — POST /api/v1/presets/generate devuelve un JSON de configuración predefinida listo para usar.
Sesiones autenticadas NEW
Inicia sesión una vez mediante un lenguaje de programación declarativo (ir a / rellenar / hacer clic / esperar) o pega las cookies exportadas. Reutiliza la sesión en cada rastreo. Es necesario para objetivos con acceso restringido, como la configuración preestablecida de LinkedIn.
Una infraestructura sencilla de extracción de datos bajo tu control
Configura tu flujo de trabajo en un solo lugar y ejecútalo como mejor te convenga. Todo está claro, organizado y es fácil de gestionar sin necesidad de herramientas adicionales.
Proxies integrados, listos para usar
Accede a proxies residenciales, móviles y de centros de datos en más de 120 países. Más de 50 millones de direcciones IP con un tiempo de actividad del 99,9 %. Incluye compatibilidad con la identificación de dispositivos para adaptar el comportamiento de estos, del navegador y de la red, lo que garantiza sesiones estables y un mayor control.
Extracción flexible de datos
Utiliza selectores CSS, XPath o la detección automática para sitios web populares. Obtén datos JSON limpios y estructurados sin necesidad de configuraciones complejas.
Todos los datos en un solo lugar
Obtén código HTML sin formato, capturas de pantalla y datos analizados, todo en un mismo lugar. Todo lo que necesitas, sin tener que cambiar de herramienta.
Control sencillo y acceso a MCP
Detén las tareas en cualquier momento con un solo clic y cambia entre el modo «scraper» y el modo «crawler». Tu flujo de trabajo sigue siendo sencillo y lo tienes todo bajo control.
Agentes de IA diseñados para el scraping y el rastreo web
Conecta Yozh Crawler y Yozh Scraper a Claude, Cursor o cualquier cliente MCP. Cambia de herramienta con un solo clic, sin necesidad de código adicional.
Funcionalidades de web scraping
Todas las funciones de Yozh Scraper están disponibles como funciones para tu agente, incluyendo el scraping, las ejecuciones por lotes y las capturas de pantalla.
Un minuto para conectarse
Copia la configuración, reinicia el cliente y ya está todo listo.
Funciona con cualquier cliente MCP
Claude Desktop, Cursor, Cline o agentes personalizados.
Control total del conjunto de herramientas
Elige cómo quiere que tu agente ejecute las tareas, desde páginas individuales hasta lotes completos.
Hazlo a tu manera
Utiliza un servidor MCP local o impleméntalo en tu propia infraestructura.
// ~/Library/Application Support/Claude/claude_desktop_config.json { "mcpServers": { "yozh-scraper": { "type": "http", "url": "http://localhost:8000/mcp" }, "yozh-crawler": { "type": "http", "url": "http://localhost:8001/mcp" } } }
// Cursor → Settings → MCP → Add new MCP Server { "mcpServers": { "yozh-scraper": { "type": "http", "url": "http://localhost:8000/mcp" }, "yozh-crawler": { "type": "http", "url": "http://localhost:8001/mcp" } } }
// Cline → MCP Servers → Edit cline_mcp_settings.json { "mcpServers": { "yozh-scraper": { "type": "http", "url": "http://localhost:8000/mcp", "disabled": false }, "yozh-crawler": { "type": "http", "url": "http://localhost:8001/mcp", "disabled": false } } }
// Anthropic Messages API · MCP via Streamable HTTP // Note: scraper must be reachable from Anthropic's servers (deploy publicly) import Anthropic from "@anthropic-ai/sdk"; const response = await new Anthropic().messages.create({ model: "claude-opus-4-8", mcp_servers: [ { type: "url", url: "https://your-host/mcp", name: "yozh-scraper" }, { type: "url", url: "https://your-host:8001/mcp", name: "yozh-crawler" } ], messages: [...] });
Rastrear, transmitir y analizar páginas en tiempo real
Yozh Crawler parte de una URL, descubre las páginas de todo el sitio web y las procesa a medida que se cargan, lo que te proporciona una estructura completa y datos útiles en una sola ejecución.
Retransmisión en directo
Las páginas aparecen a medida que se detectan y se procesan. Accede directamente desde tu cliente, agente o canal de ventas sin tener que esperar a que se completen los procesos.
Modo Descubrimiento
¿Solo necesitas enlaces? Genera un mapa del sitio sin necesidad de analizar el código. Es más rápido y más económico para las comprobaciones de estructura y las auditorías.
Cancelación en dos fases
Detén los procesos de forma segura. Deja que las páginas activas terminen de cargarse o detén todo al instante cuando sea necesario.
Interruptor de destino MCP
Cambia entre el «scraper» y el «crawler» con un solo botón. Tu agente utiliza la herramienta adecuada para cada tarea.
Árbol de la página web en tiempo real en la interfaz de usuario
Observa cómo se va creando la estructura del sitio web en tiempo real. Sigue el progreso página a página sin salir del panel de control.
Result
▶ Site Map (0 pages)
| URL | Parent | Depth | Status | Took |
|---|
De una URL a la cobertura completa del sitio web
El rastreador encuentra páginas, el extractor las procesa y tu agente de IA utiliza los resultados; todo ello diseñado tanto para principiantes como para expertos.
Crawler
Detecta todas las URL
Yozh Scraper
Extracto en formato JSON
Agente de IA
Analiza y decide
Análisis de la competencia
Realiza un seguimiento de los catálogos, los precios y los detalles de los productos de la competencia en un solo lugar. Detecta las carencias en tus propios listados y reacciona más rápido a los cambios del mercado.
Seguimiento de precios
Realiza un seguimiento automático de los cambios de precios en los distintos mercados. Configura alertas y recibe notificaciones en Telegram o Slack cuando los precios varíen.
Datos de entrenamiento de ML
Recopila conjuntos de datos limpios y estructurados procedentes de fuentes públicas, listos para su análisis o para el entrenamiento de modelos. Diseñado para una recopilación de datos fiable a gran escala.
Empieza a hacer scraping ahora mismo con ajustes predefinidos listos para usar
Configuración regional, divisas, selectores y gestión antibots: todo ya configurado. Elige un perfil predefinido para ver qué datos se extraen.
Every Amazon listing, normalized
All fields below are extracted automatically — no selectors to write.
¿Necesitas una página web que aún no hayamos incluido?
Abre una incidencia en GitHub o comparte tu propio ajuste predefinido; revisamos las solicitudes de incorporación de cambios en el plazo de una semana.
Proxies diseñados para el scraping
Tres tipos, seis configuraciones. Elige según el trabajo, la velocidad y el presupuesto.
Móvil 4G/5G
Dispositivos móviles reales conectados a redes de operadores. El nivel más alto de fiabilidad, con estrictos sistemas contra los bots.
Dispositivo personal, rotación manual de IP a través de la API
Un dispositivo, varios usuarios
Más información sobre los proxies móviles
Cómo funciona
Cada dirección IP procede de un smartphone real o de un módem LTE/5G conectado a un operador de telefonía móvil importante. La dirección IP la comparten miles de suscriptores habituales, por lo que bloquearla supondría bloquear a usuarios reales; de ahí que los sistemas antibots confíen sobre todo en las direcciones IP móviles.
Ideal para
- Gestión de cuentas en redes sociales
- Medidas agresivas contra los bots (Cloudflare, PerimeterX)
- Trabajo de afiliados y verificación de anuncios
- Tareas que requieren una confianza «similar a la humana» de forma continuada
Características técnicas
- Redes 4G LTE y 5G en todo el mundo
- Compatibilidad con UDP, conectividad VPN VLS
- Rotación manual de direcciones IP a través de la API o del enlace al panel de control
- Ajuste de la huella digital del sistema operativo
- Ancho de banda ilimitado en la mayoría de los planes
Residencial
Direcciones IP de usuarios reales de Internet doméstico en más de 120 países. Acceso a más de 50 millones de direcciones IP con un equilibrio óptimo entre fiabilidad y coste.
Routers auténticos, con dirección IP fija durante todo el periodo de alquiler
Más de 100 millones de direcciones IP, rotación automática por temporizador o por solicitud
Más información sobre los proxies residenciales
Cómo funciona
Las direcciones IP residenciales proceden de auténticos abonados a Internet doméstico que aceptan compartir ancho de banda a cambio de una compensación, a través de una red transparente de participación voluntaria. Su conexión es idéntica a la de cualquier otro usuario doméstico, porque lo es.
Ideal para
- Extracción de datos web a gran escala (el punto óptimo)
- Recopilación de datos de mercados online
- Investigación de SEO, extracción de datos de SERP
- Seguimiento de marcas y precios
- Campañas de verificación de anuncios
Características técnicas
- Más de 120 países, más de 100 millones de direcciones IP únicas en un grupo rotativo
- Elige entre estático o rotativo en función de la tarea
- Posibilidad de segmentación por ciudad y ASN
- Compatible con los protocolos HTTPS y SOCKS5
- Sesiones persistentes de hasta 30 minutos
Centro de datos
Máxima velocidad, mínimo coste. Más de 2 millones de direcciones IP en centros de datos de todo el mundo.
Una dirección IP asignada a ti, tráfico ilimitado
Shared Pool, la opción económica para trabajos sencillos
Más información sobre los proxies de centros de datos
Cómo funciona
Las direcciones IP están alojadas en centros de datos y no están conectadas a usuarios domésticos ni móviles. Son más baratas y rápidas que las residenciales, pero los sistemas antibots pueden identificarlas como no humanas, por lo que conviene utilizarlas en casos en los que la confianza no sea un factor crítico.
Ideal para
- Extracción masiva de datos de sitios web amigos
- Herramientas internas y pruebas de carga
- Puntos finales de API sin filtros de confianza de IP
- Tareas en las que la velocidad es más importante que el camuflaje
Características técnicas
- Más de 2 millones de direcciones IPv4 e IPv6
- Configuraciones dedicadas o compartidas
- Ancho de banda ilimitado en los planes dedicados
- Compatible con los protocolos HTTPS y SOCKS5
- La latencia más baja de los tres tipos
La ética forma parte integral del funcionamiento de nuestra plataforma
El código abierto es solo el punto de partida. La forma en que se recopilan los datos y cómo se obtienen los proxies es igual de importante. Estas son las normas que seguimos en la práctica, no meras declaraciones en una página.
Recopilación ética de datos
Creamos herramientas, no lagunas legales. Yozh Scraper está diseñado para garantizar la fiabilidad de la extracción de datos públicos legítimos, no para vulnerar lo que debe permanecer privado.
- Solo datos de acceso público: por defecto, no se permite el scraping a usuarios registrados
- Los límites de velocidad integrados evitan la sobrecarga del servidor
- Cumplimiento de «robots.txt» y del mapa del sitio de forma predeterminada (se puede anular)
- No se recopilan ni almacenan datos de carácter personal, ni por nuestra parte ni, por defecto, por parte de los usuarios.
- Herramientas que te ayudan a cumplir con el RGPD y la CCPA
Red de proxy transparente
El origen de las direcciones IP residenciales es la prueba de honestidad para cualquier proveedor de proxies. A continuación te explicamos de dónde proceden las nuestras, de forma explícita:
- Red de participación voluntaria. Los usuarios reales dan su consentimiento y obtienen ingresos por compartir su ancho de banda.
- Puedes darte de baja en cualquier momento con un solo clic, sin que te hagan preguntas.
- Cadena de suministro auditada con un proceso de abastecimiento documentado
- Sin malware, sin inyección oculta de SDK — en ningún momento
- Direcciones IP móviles de dispositivos que poseemos y gestionamos, no de teléfonos móviles que hayan sido objeto de un ataque
Respuesta rápida ante los abusos
Si alguien hace un uso indebido de nuestra infraestructura para causar daño a otras personas, queremos saberlo y tomar medidas antes de que la situación empeore.
- Línea directa con una persona de verdad, sin tener que esperar en una cola de tickets
- Un proceso de investigación transparente para cada denuncia legítima
- Cooperación activa con las fuerzas del orden en los casos confirmados
- Política sobre el abuso público, sin esconderla entre la letra pequeña
Si un caso de uso implica un uso indebido o causa daños, nuestras herramientas no están diseñadas para ello. Damos prioridad al uso responsable frente al crecimiento de la clientela.
Si un caso de uso implica ocultar la identidad con el fin de causar daño a otras personas, nuestras herramientas no sirven para eso. Y punto. Preferimos perder al cliente antes que traicionar nuestros principios.
Nuestras políticas y normas
Normas claras que rigen nuestro funcionamiento, desde la recopilación de datos hasta la contratación de servidores proxy y el uso de la plataforma. Se trata de las políticas concretas que sigue nuestro equipo, no de resúmenes.
Política de uso
Define qué está permitido en nuestra infraestructura y qué está restringido, con una justificación clara.
Política de respuesta ante abusos
Explica cómo se revisan, gestionan y resuelven los reportes, incluidos los tiempos de respuesta.
Normas de obtención de la red
Detalla cómo se obtienen las IP residenciales y móviles, con un modelo de participación voluntaria y suministro verificado.
Política de verificación de clientes
Cubre la incorporación, cuándo se requiere verificación y cómo se gestionan los datos del usuario.
Objetivos restringidos
Enumera los dominios y casos de uso bloqueados, incluidos sectores sensibles como el gobierno y las finanzas.
Política de tratamiento de datos
Explica qué datos se recopilan, qué no se almacena, los límites de retención y el intercambio con terceros.
Cómo utilizan
los equipos los datos de CyberYozh
Implementaciones en el mundo real
Extracción de datos web y análisis
Automatiza la recopilación a gran escala de datos públicos: catálogos de productos, valoraciones, reseñas y datos geográficos. Yozh Scraper junto con proxies residenciales: legales, estables y limpios.
Más información
Agentes de IA y automatización
Crea agentes autónomos que recopilen datos, los analicen y actúen. La integración con MCP convierte a Yozh Scraper en una herramienta nativa para Claude y Cursor, sin necesidad de ninguna integración personalizada.
Más información
Comercio electrónico y plataformas de venta
Realiza un seguimiento de los precios, el stock y la disponibilidad de los productos en Amazon, eBay y el resto de mercados internacionales. Las configuraciones predefinidas te ahorran semanas de trabajo de ingeniería.
Más informaciónLo que dicen la prensa y las empresas
Opiniones sinceras procedentes de fuentes independientes
Todos los artículos
AFFMaven Reviews CyberYozh's Proxy & Multi-Accounting Platform
"CyberYozh stands out as a powerful platform for affiliates and arbitrage teams, combining reliable proxy infrastructure, identity tools, and strong support in one ecosystem."
TechBullion Covers CyberYozh's B2B Platform Expansion
"CyberYozh App enables businesses to launch, test, and operate digital products across more than 30 countries through a scalable infrastructure built for global connectivity, verification, and digital operations."
Grit Daily Highlights CyberYozh's Infrastructure for Enterprise Proxy Workloads
"Built for organizations that rely on proxies every day, CyberYozh App delivers infrastructure designed for stability, scalability, and high-volume workloads rather than one-off sessions."
Apreciado por los equipos de datos y los desarrolladores de IA
Lo que dicen quienes crean con Yozh
El sistema de preajustes es la característica estrella. Introducimos el nombre de una fuente y obtenemos un JSON limpio; la función de autocorrección incluso detectó dos cambios en el diseño de Amazon antes de que nos diéramos cuenta.
Por fin, un rastreador de código abierto que trata los proxies y las sesiones como elementos de primer orden. Lo ejecutamos tras las barreras de inicio de sesión de los portales de nuestros socios: las sesiones se mantienen y los resultados son coherentes en todas las regiones.
Lo he conectado a Cursor a través de MCP y ahora mi agente extrae datos web en tiempo real mientras realiza la tarea. El rastreo en tiempo real a través de SSE es justo lo que les faltaba a los flujos de trabajo de los agentes.
Dejamos de utilizar una API de extracción de datos de pago para reducir costes y nos preparamos para un empeoramiento del servicio, pero ocurrió todo lo contrario. Es autohospedada, no hay facturación por solicitud y el esquema de salida es más claro que el que solíamos pagar.
Acerca del web scraping, el rastreo y los agentes de IA
Blog y artículos
Todos los artículos
Proxies móviles dedicados en 2026: por qué los túneles UDP y VLESS son necesarios para superar el DPI
Los sistemas de inspección profunda de paquetes (DPI) escanean activamente las conexiones VPN estándar y las descartan. OpenVPN y WireGuard fallan en minutos. Esto se debe…
La mejor alternativa a Instant Data Scraper en 2026
Compara Instant Data Scraper con CyberYozh y descubre cuándo se vuelven necesarios los crawlers escalables, la rotación de proxies, la geolocalización, las sesiones y la automatización.
Los mejores proxies móviles para la automatización de redes sociales (Reddit, Instagram, TikTok)
Ejecutar la automatización en Reddit, Instagram o TikTok suele funcionar al principio, pero luego empieza a fallar sin una razón clara. Las cuentas se marcan, las…
Registro de cambios y actualizaciones de Web scraping
Yozh Scraper es un proyecto de código abierto, y todas las actualizaciones están disponibles en GitHub. A continuación se detallan las novedades más destacadas.
v0.1.8
fingerprint_profileonPOST /scrape/page,POST /scrape/pagesand the crawler/searchscrape_options: pin the Camoufox fingerprint's OS and WebGL vendor instead of Camoufox's per-launch random draw (which claimed an OS the server is not two launches in three). Profiles:auto(default, resolves toCAMOUFOX_FINGERPRINT_PROFILE, shipswindows_on_host),windows_on_host,host,random, and the bare nameswindows/macos/linux. The oldspoof_oskeeps working and equals the three bare names; a caller stating both must not name conflicting operating systems.meta.applied_fingerprintreports what actually ran, including when a profile degraded. New env varsCAMOUFOX_FINGERPRINT_PROFILE(defaultwindows_on_host) andHOST_GPU_VENDOR.- Extraction warns when a
post_processpipeline nulls an entire column (every row) — a fourth class of silent failure the invalid/empty/length-mismatch selector checks did not cover. Reported only for a fully-nulled column with more than one row, or a scalar field; an optional value missing on a single row stays quiet. - GitHub Actions CI:
pylintandpytest -m "not e2e"on every push and pull request, the checks the repo already defined but never enforced. run_scrapenow returns a typed envelope (ScrapeOk/ScrapeErr) built as the same pydantic models the API validates on the way out, withmypyover the queue surface. An older worker meeting a metadata value a newer API introduced degrades that field and keeps the fetched page, rather than dropping it. Internal refactor; the public HTTP response is unchanged.session_id,cookiesandrenderare now rejected with 422 on the Camoufox engine instead of being accepted and silently ignored (which returned a logged-out or non-rendered page that read as the site having changed)./searchmaps the rejection to a 400 rather than a 500.
v0.1.7 — Pin mcp<2.0 so a fresh image build starts
mcp2.0.0 madeServer.__init__keyword-only, whichfastapi-mcp0.4.x still calls positionally, so a cleandocker buildshipped services that raisedTypeErrorincreate_app()before serving anything. Bothrequirements.txtandyozh-crawler/requirements.txtnow pinmcp>=1.28.1,<2. The floor keeps the fix for GHSA-vj7q-gjh5-988w (HIGH — WebSocket Host/Origin validation). Drop the ceiling oncefastapi-mcpships a release built againstmcp2.x.
v0.1.6 — Extraction/preset fixes (eBay, Walmart, Yandex, price) + selector-timeout classification
- Preset extraction repaired for current site layouts:
- eBay search — new s-card layout; price regex hardened against the was-price / prefix-class / nested-tag traps.
- Walmart — recovered price and rating extraction (anchored so a strikethrough "was" price can't win); dropped google_shopping's dead
urlsfield. - Yandex search — one row per organic block, so titles, links and snippets no longer drift out of alignment (a title could previously come back paired with the wrong result's link).
- Price parsing no longer lets a label before the price swallow it: a leading digit is now required, so
From $19.99/Now 19.99parse the number rather than the label. Currency symbols, thousands separators (US and EU), leading decimals and negatives still parse as before.
v0.1.5 — Queue goto-timeout retry fix + dependency security updates
- The queue no longer retries a slow page as if the proxy were bad. A navigation (
goto) timeout — the page was simply slow, the proxy is fine — used to burn the retry budget and rotate the proxy; it now gets one rotation at most and otherwise returns a timeout to the caller instead of looping. Genuine proxy failures (connection reset, tunnel/auth errors,net::ERR_*) still rotate and retry as before. - Dependency bumps clearing the outstanding advisories in the auxiliary tooling:
examples/(langchain-anthropic) and the localscraper-testerdev harness (express,qs,http-proxy-middleware,follow-redirects). No shipped scraper runtime or API change.
v0.1.0 - Durable queue, Camoufox engine & CyberYozh proxy v2
- New required services. Browsers no longer run inside the API process. You must now run the
redisandscraper-workerservices (both are already indocker-compose.yml). Scale capacity withdocker compose up -d --scale scraper-worker=N. POST /scrape/pageand/scrape/pagescan now return503 queue_fullwhen the Redis stream depth exceedsQUEUE_MAXSIZE(previously the in-memory queue was unbounded).- Removed env vars (ignored, warned at startup if set):
JOB_TIMEOUT_MS→ usePAGE_TASK_TIMEOUT_S;JOB_RESULT_MAX→ eviction is now a native Redis TTL (JOB_RESULT_TTL_S);JOBS_ENABLED→ the queue is always on. - New env vars:
REDIS_URL,PAGE_TASK_TIMEOUT_S,LOGIN_TASK_TIMEOUT_S,LOGIN_RESULT_GRACE_S,RECLAIM_IDLE_S,JOB_RESULT_TTL_S,BROWSER_MAX_PAGES,BROWSER_IDLE_SHUTDOWN_S,WARMUP_DWELL_MS. - The in-process job queue and browser worker pool are replaced by a taskiq stream on Redis. The
web-scrapercontainer only enqueues page tasks and reads results; browsers run in separate, horizontally scalablescraper-workercontainers.
Empieza a extraer datos de la web en cuestión de segundos
Tres comandos y ya tienes un scraper y un crawler en funcionamiento con puntos de conexión HTTP y MCP.
git clone https://github.com/\ CyberYozh-data/yozh-scraper cd yozh-scraper
cp .env.example .env docker compose up --build
curl -X POST localhost:8000/api/v1/scrape/page \
-H 'Content-Type: application/json' \
-d '{"url":"https://example.com"}'
Ponte en contacto con nosotros
Una persona de verdad lee todo lo que llega. Elige el canal que más te convenga: Telegram es el más rápido.
¿Listo para raspar?
Yozh Crawler + Scraper es gratis. Para siempre. Danos una estrella si te resulta útil: cada estrella cuenta.
Yozh Crawler + Scraper se distribuye bajo la licencia MIT. Úsalo. Haz un fork. Desarrolla con él.