Summary
Full Transcript
En este video te muestro cómo hacer web scraping en 2026 usando Python y Playwright, paso a paso y desde cero, sin magia y sin código que “funciona solo en el tutorial”. Código (Patreon) 👉 https://www.patreon.com/posts/web-scraping-en-149794112 Únete a este canal para apoyarme: https://www.youtube.com/channel/UCTyCe-0QDRju-yC5Cr83eeQ/join ¿Regalame un Café?: https://ko-fi.com/ivespino Curso de Python desde cero 2023: https://youtu.be/fJ4KoCeKyeQ ✈ Unete a nuestra comunidad de Telegram: https://t.me/+F9c-RdxQYRk4YTdh 💎Únete a nuestra comunidad de Discord: https://discord.gg/ZGWhzKz2qj 📥Correo de Contacto: [email protected] Si alguna vez intentaste scrapear una web moderna con BeautifulSoup y te devolvió una página vacía, no es culpa tuya. La mayoría de los sitios actuales cargan su contenido con JavaScript, y las herramientas clásicas simplemente no están hechas para eso. En esta guía completa vas a ver el proceso real, incluyendo lo que NO funciona primero, para que entiendas por qué Playwright se ha convertido en la herramienta estándar para scraping y automatización web en Python. 🚀 Qué vas a aprender en este tutorial: • Por qué BeautifulSoup falla en sitios modernos cargados con JavaScript • La diferencia real entre Selenium y Playwright en 2026 • Cómo instalar Playwright correctamente (sin drivers ni configuraciones absurdas) • Cómo identificar selectores usando DevTools como lo haría un scraper profesional • Cómo ejecutar JavaScript dentro del navegador para extraer datos reales • Cómo scrapear un sitio completo con paginación automática • Cómo extraer más de 1000 productos en minutos • Cómo guardar los datos en CSV y JSON listos para Excel o análisis • Cómo hacer scraping en sitios con login y autenticación • Buenas prácticas para evitar bloqueos y errores comunes 📦 Usamos Books to Scrape y Quotes to Scrape, dos sandboxes diseñados específicamente para practicar scraping de forma segura y legal, para que puedas aprender sin miedo a bloqueos ni problemas. Este no es un video de “copia y pega código”. Es una guía pensada para que entiendas el flujo completo del scraping moderno: Página web → JavaScript → Selectores → Datos → Archivos → Automatización. ⚠️ También hablamos de cosas que muchos tutoriales ignoran: • Por qué los delays NO son opcionales • Cómo evitar bombardear servidores • Cómo manejar errores y timeouts • Cómo guardar progreso para no perder horas de trabajo • Cuándo tiene sentido usar scraping y cuándo no 💡 Al final del video tendrás un scraper funcional, escalable y adaptable a casi cualquier sitio web moderno. El mismo tipo de base que se usa en proyectos reales, no solo en demos. Pero el scraping es solo el comienzo. Una vez que sabes extraer datos, la pregunta importante es: ¿cómo los limpias, los actualizas automáticamente y los conviertes en un sistema que funcione solo? Ese es el siguiente nivel, y es exactamente lo que cubro en el próximo video, donde te muestro las 7 librerías de Python que uso para construir sistemas completos de automatización, desde scraping hasta reportes y servicios reutilizables. 📌 Si te interesa Python, automatización, scraping moderno, datos o crear herramientas que realmente funcionen en 2026, este video es para ti. 👨💻 Código real, errores reales, resultados reales. 📊 Mil productos en minutos. 🔥 Sin drivers. Sin hacks frágiles. Sin tutoriales basura.
