Automatización y No-Code #6 de 14 en su categoría

Reseña honesta: “Curso maestro de Web Scraping” de Leonardo Kuffo [2026] – ¿Vale la pena?

El recorrido más completo en español de web scraping con Python, en cinco niveles y con 20 sitios reales; su base es de 2020, no usa Playwright y dedica solo 4 clases a la ética y la legalidad.

Portada oficial del curso Curso maestro de Web Scraping: Extracción de Datos de la Web

Qué promete y qué encontré al analizarlo

El Curso maestro de Web Scraping, de Leonardo Kuffo, promete llevarte de cero a extraer datos de más de 20 sitios reales con Python: páginas estáticas, sitios con varias páginas, carga dinámica, APIs, iframes, autenticación y CAPTCHAs, y al final automatizar las extracciones y guardar los datos en MongoDB. Son 19 horas en 97 clases, con 11,320 alumnos y 2,307 reseñas que le dan un 4.67. Se creó en marzo de 2020 y se actualizó el 20 de octubre de 2025.

Al revisar sus 11 secciones, lo mejor es la progresión por niveles: cada uno añade una dificultad concreta (13, 13, 14, 10 y 9 elementos) y el recorrido termina con un nivel de automatización, almacenamiento y actualización de datos. Usa siete librerías (Requests, lxml, Beautiful Soup, Scrapy, Selenium, Requests-HTML y Cloudscraper) y empieza con 19 elementos de Python para quien no programa. Hay 7 cuestionarios y una sección de ética de 4 elementos.

El temario, en resumen

  • Preparación (34 elementos): bienvenida (2), Python desde cero (19) e introducción al web scraping (13).
  • Niveles 1 y 2 (26): una sola página estática (13) y varias páginas del mismo dominio (13).
  • Niveles 3 a 5 (33): páginas dinámicas (14), APIs, iframes y scripts (10) y autenticación y CAPTCHAs (9).
  • Cierre (11): ética para evitar problemas (4), nivel final de automatización, almacenamiento y actualización de datos (6) y otros cursos del autor (1).
  • En total: 87 videos, 10 artículos y 7 cuestionarios, con subtítulos automáticos en español.

Puntos fuertes

  • Progresión por niveles muy bien pensada. Pasar de una página estática a sitios con paginación, contenido dinámico, APIs y autenticación sigue el orden en que aparecen los problemas reales, y cada nivel justifica la herramienta que introduce.
  • Varias herramientas, con criterio. Ver Requests con lxml, Beautiful Soup, Scrapy y Selenium en casos distintos enseña a elegir: no todo sitio necesita un navegador automatizado, y saberlo ahorra tiempo y recursos.
  • Buscar la API antes que el HTML. El nivel 4 trata APIs, iframes y scripts. Extraer los datos del JSON que consume la propia página suele ser más estable y eficiente que analizar el HTML, y pocos cursos lo enseñan.
  • Del script al proceso. El nivel final cubre automatización, almacenamiento en MongoDB y actualizaciones incrementales, lo que convierte un script suelto en una fuente de datos útil. Las 2,307 reseñas con 4.67 respaldan la explicación.

Aspectos mejorables

  • Ética y legalidad en 4 elementos. Que exista la sección ya es más de lo habitual, pero es breve, y los objetivos la enfocan en proteger tus IPs y evitar bloqueos. En los títulos no aparecen los términos de uso, robots.txt ni la protección de datos personales, y varios sitios del curso, como redes sociales o reseñas de Google, prohíben en sus términos la extracción automatizada y contienen datos personales.
  • Saltar protecciones, una zona gris. El nivel 5 y la librería Cloudscraper enseñan a sortear CAPTCHAs y la protección de Cloudflare. Técnicamente es interesante, pero eludir esas medidas suele violar los términos del sitio y puede tener consecuencias legales; úsalo solo con autorización.
  • Herramientas con años encima. El curso nació en 2020 y no menciona Playwright, hoy una de las opciones más usadas para páginas dinámicas, ni la extracción asíncrona; además, Requests-HTML lleva años sin mantenimiento activo.
  • Scrapers que caducan y sin ejercicios evaluados. Facebook, X o Airbnb cambian su estructura a menudo y la última actualización es de octubre de 2025, así que es probable que algunos ejemplos ya no funcionen tal cual. Hay 7 cuestionarios, pero ningún ejercicio de código.

Conclusión honesta

El Curso maestro de Web Scraping es, por estructura, la forma más completa de aprender a extraer datos de la web en español: la progresión por niveles, la variedad de librerías y el cierre con automatización y almacenamiento lo ponen muy por encima de la sección de 12 elementos que el tema ocupa en Python TOTAL.

Como ingeniero, mi advertencia es de criterio más que técnica: saber extraer datos no significa poder hacerlo. Prioriza las APIs oficiales cuando existan, respeta robots.txt y los términos de uso, no recolectes datos personales sin base legal según la ley de protección de datos de tu país y limita la frecuencia de tus peticiones. Para trabajar los datos extraídos, sigue con Análisis de Datos con Pandas; si solo necesitas automatizar tareas en sitios de tu propia empresa sin programar, Power Automate Desktop es otra vía.

8.1

Puntaje final: 8.1/10 · Muy bueno

Para quien necesita extraer datos de la web para un proyecto, una investigación o una tesis, incluso sin saber programar. No es para quien busca las herramientas más recientes ni una guía legal sobre la extracción de datos.

Este curso sí es para ti si…

  • Necesitas datos de la web para un proyecto, una investigación o una tesis
  • Quieres aprender desde cero, incluso sin saber programar
  • Te interesa entender cuándo usar Requests, Scrapy o Selenium
  • Quieres automatizar extracciones periódicas y guardarlas en una base de datos

Mejor busca otro curso si…

  • Buscas las herramientas más recientes, como Playwright o la extracción con IA
  • Necesitas una guía legal o de cumplimiento sobre la extracción de datos
  • Quieres ejercicios de código evaluados
  • Los datos que necesitas ya están disponibles en una API oficial

Curso maestro de Web Scraping: Extracción de Datos de la Web

Leonardo Kuffo · 19 h · 4.7 ★

Ver el curso en Udemy

Enlace directo a Udemy. Esta reseña no está patrocinada. Revisa el precio: Udemy tiene ofertas casi siempre.

Preguntas frecuentes

¿Necesito saber programar?

No. Los requisitos dicen que no hay ninguno y la segunda sección enseña Python desde cero en 19 elementos. Aun así, te ayudará reforzar Python por tu cuenta, porque el curso va directo al grano.

¿Es legal hacer web scraping?

Depende del sitio, de los datos y de tu país. Revisa los términos de uso y el robots.txt, evita los datos personales si no tienes base legal según la ley de protección de datos aplicable y no eludas protecciones sin autorización. La sección de ética del curso tiene 4 elementos y no sustituye una revisión legal.

¿El código sigue funcionando?

Se actualizó en octubre de 2025, pero los sitios reales cambian a menudo, así que espera que algunos selectores hayan dejado de funcionar. Adaptarlos es buena práctica: es exactamente lo que implica mantener un scraper.

Roberto Delgado

Ingeniero en Sistemas Inteligentes · San Luis Potosí, México

Analizo cursos de tecnología con el mismo criterio con el que evaluaría un sistema: qué promete, qué entrega y dónde falla. Si una reseña tiene un dato desactualizado, avísame y la corrijo.

8.1 Muy bueno
Ver en Udemy