Recursos · Blog

Blog sobre recopilación de datos

Guías, estudios y casos de éxito sobre web scraping, monitorización de precios y entrega de datos para análisis, marketing y producto.

Guía general de web scraping
¿En qué lenguaje escribir un scraper? Panorama de soluciones

Comparamos lenguajes para escribir scrapers (Python, JavaScript, PHP, Go, Java y C#): velocidad, ecosistema, barrera de entrada y cuándo elegir cada uno.

6 febrero · 12 min
Tecnologías y protecciones
Parser del DOM: análisis detallado

Qué es un parser del DOM y cómo funciona por dentro: construcción del árbol del documento, navegación por nodos y diferencias con los enfoques en flujo y con regex.

4 febrero · 6 min
Tecnologías y protecciones
Selectores CSS para web scraping: repaso de construcciones

Guía rápida de selectores CSS para extraer datos: clases, atributos, pseudoclases, combinadores y errores típicos al seleccionar elementos de una página.

2 febrero · 8 min
Guía general de web scraping
Bibliotecas para web scraping

Catálogo de bibliotecas de scraping para Python, JavaScript, PHP, Java, C# y Go: qué elegir para páginas estáticas, contenido dinámico y APIs.

31 enero · 11 min
Scraping por lenguaje
Scraping de búsquedas de Google: palabras clave para mercados internacionales

Cómo recopilar palabras clave de Google: sugerencias, Keyword Planner, competidores y Search Console, con herramientas para proyectos internacionales.

29 enero · 3 min
Scraping por lenguaje
Parseo de XML en Python: ElementTree, lxml y procesamiento en flujo

Trabajar con XML en Python: ElementTree para tareas simples, lxml para XPath y parseo en flujo de archivos de varios gigabytes con iterparse.

27 enero · 8 min
SEO y buscadores
Volúmenes de búsqueda: Google Keyword Planner y alternativas

Cómo recopilar volúmenes de búsqueda con Google Keyword Planner y Google Trends: concordancias, palabras clave negativas, estacionalidad y automatización vía API.

25 enero · 3 min
SEO y buscadores
Recopilar y agrupar palabras clave para SEO: del listado bruto a los clústeres

Recopilación y agrupación de palabras clave con Keyword Planner, Search Console, Ahrefs y SEMrush: fuentes, limpieza, volúmenes y clústeres por el top de Google.

23 enero · 3 min
Scraping por lenguaje
Web scraping en Python con lxml: velocidad y XPath

Por qué lxml es uno de los parsers de HTML y XML más rápidos de Python: consultas XPath, comparación con BeautifulSoup y técnicas para documentos de gran tamaño.

21 enero · 6 min