Integramos Bright Data en tus scrapers, fuente a fuente
Cuando una web devuelve 403, muestra CAPTCHAs o corta por IP, conectamos tu scraper con Bright Data: Web Unlocker para peticiones HTTP, Scraping Browser para páginas con JavaScript y proxies residenciales o ISP para el resto. Lo activamos en las fuentes que lo necesitan y medimos la tasa de éxito de cada una, para que el consumo se corresponda con el problema.
Bright Data es una plataforma de acceso a datos web con redes de proxies (residenciales, de centro de datos, ISP y móviles) y productos que resuelven el desbloqueo por ti. Web Unlocker gestiona CAPTCHAs, huellas de navegador y reintentos detrás de una sola petición. Scraping Browser es un navegador remoto al que te conectas por CDP desde Playwright o Puppeteer. SERP API devuelve resultados de buscadores ya estructurados, y Web Scraper API ofrece extractores listos para dominios grandes. En Soamee lo integramos como una estrategia más dentro del scraper: cada fuente decide por configuración si sale directa o a través de Bright Data, con métricas de éxito y consumo por fuente.
Los productos de Bright Data que conectamos
Bright Data tiene muchos productos y no todos encajan en cada proyecto. Elegimos por fuente, empezando por el más sencillo que resuelva el bloqueo.
Web Unlocker
Para fuentes que bloquean clientes HTTP pero tienen el contenido en el HTML. Se usa como un proxy o vía API: la petición sale igual que antes y Bright Data resuelve CAPTCHAs, huellas y reintentos. Encaja en scrapers que ya tienes sin reescribirlos.
Scraping Browser
Un navegador remoto en la infraestructura de Bright Data. Tu código de Playwright o Puppeteer se conecta con connectOverCDP y lo demás no cambia: esperas a selectores, scroll, clic en «cargar más». Y dejas de mantener Chromium en tu servidor.
Proxies residenciales, ISP y datacenter
Cuando el problema es la IP o la geolocalización: precios por país, contenido regional, límites por dirección. Configuramos zonas, país y sesiones fijas o rotativas según lo que pida cada fuente.
SERP API
Resultados de Google, Bing y otros buscadores en JSON, por país e idioma. Sirve para seguimiento de posiciones, análisis de competencia o para dar a un agente de IA acceso a búsquedas.
Web Scraper API y Datasets
Para dominios grandes que Bright Data ya extrae (marketplaces, redes profesionales, fichas de negocio en mapas) lanzamos la extracción por API y recogemos el resultado, en lugar de mantener un scraper propio. Antes lo comparamos con el coste de hacerlo a medida.
Control de consumo
Métricas por fuente: peticiones, tasa de éxito, volumen y coste estimado. Si una fuente deja de necesitar desbloqueo, vuelve a salir directa. Y salta una alerta cuando el consumo se desvía de lo normal.
Qué producto para cada bloqueo
Así decidimos en cada fuente. Si la primera prueba lo resuelve, no pasamos a Bright Data.
| Síntoma | Primera prueba | Si no basta |
|---|---|---|
| 403 o redirección a una página de verificación con un cliente HTTP | Navegador headless propio con cabeceras de navegador real | Web Unlocker |
| El contenido solo aparece al ejecutar JavaScript y hay protección anti-bots | Playwright propio | Scraping Browser |
| Funciona unas cuantas peticiones y después 429 o bloqueo por IP | Bajar el ritmo y respetar Retry-After | Proxies residenciales o ISP con rotación |
| El contenido cambia según el país del visitante | No hay alternativa propia razonable | Proxies con país fijado |
| Necesitas resultados de buscadores | No hay alternativa propia razonable | SERP API |
Bright Data como una estrategia más
No reescribimos el scraper para usar Bright Data. El transporte se elige en la configuración de cada fuente, y el resto del pipeline (normalización, deduplicación, alertas) no cambia.
Playwright y Puppeteer se conectan al Scraping Browser sin tocar la lógica de extracción
Web Unlocker entra como un proxy más en clientes como axios, fetch o got
es la unidad: cada web decide si sale directa o por Bright Data
cuando la tasa de éxito o el consumo de una fuente se salen de lo normal
Antes de activar Bright Data en una fuente probamos el camino directo. Muchas webs que parecen blindadas solo rechazan el User-Agent por defecto de una librería HTTP.
Ver el servicio de web scraping →Integración en cuatro pasos
Del diagnóstico de bloqueos al seguimiento del consumo, fuente por fuente.
Diagnóstico de bloqueos
Lanzamos cada fuente en directo y apuntamos qué falla: código HTTP, CAPTCHA, contenido vacío, corte por IP.
Producto y zona
Elegimos el producto de Bright Data para cada fuente y guardamos zonas, países y credenciales como secretos del entorno, nunca en el código.
Integración y tests
Conectamos el cliente HTTP o el navegador, añadimos smoke tests que pasan por Bright Data y medimos la tasa de éxito real.
Seguimiento del consumo
Panel por fuente y alertas. Cada mes revisamos qué fuentes podrían volver a salir directas.
Preguntas frecuentes sobre Bright Data
¿Necesito una cuenta propia de Bright Data? +
Sí. La cuenta y la facturación quedan a tu nombre y nosotros trabajamos con credenciales de zona que puedes revocar cuando quieras. Así no dependes de nosotros para seguir usándola.
¿Web Unlocker o Scraping Browser? +
Web Unlocker si el contenido está en el HTML de la respuesta: es más rápido y se integra como un proxy. Scraping Browser si hay que interactuar con la página (scroll, clics, esperar a que cargue un componente). En un mismo proyecto es habitual usar los dos, cada uno en fuentes distintas.
¿Podéis integrarlo en un scraper que ya tenemos? +
Sí. Web Unlocker y los proxies entran como configuración del cliente HTTP, y Scraping Browser sustituye el lanzamiento local del navegador por una conexión remota. Revisamos tu código, lo conectamos y añadimos las métricas por fuente.
¿Usar Bright Data hace legal cualquier scraping? +
No. Bright Data resuelve el acceso técnico, pero los límites legales son los mismos: términos de uso, derechos sobre bases de datos y RGPD si hay datos personales. Bright Data aplica además su propia política de cumplimiento y puede rechazar ciertos usos. Lo revisamos antes de empezar.
¿Cuánto cuesta Bright Data? +
Depende del producto y del volumen: según el producto cobra por petición, por GB o por resultado, y publica sus tarifas. Antes de activar nada estimamos el consumo de cada fuente con una prueba real, para que la factura no sea una sorpresa.
¿Hay alternativas a Bright Data? +
Sí: Oxylabs, Zyte, ScraperAPI o Decodo ofrecen productos parecidos. Trabajamos sobre todo con Bright Data por la variedad de productos, y como el transporte se elige por fuente, cambiar de proveedor en una web no obliga a tocar las demás.
También te puede interesar
Revisemos tus fuentes bloqueadas
Pásanos las URLs que te devuelven 403 o CAPTCHA. Te decimos qué producto de Bright Data necesita cada una, o si basta con ajustar el scraper.
Revisemos tus fuentes bloqueadasCuéntanos tu reto. Te proponemos solución.
Sin compromiso. En menos de 24 h recibes una propuesta con alcance, plazos y presupuesto. Sin letra pequeña.