Mostrando entradas con la etiqueta beautifulSoup. Mostrar todas las entradas
Mostrando entradas con la etiqueta beautifulSoup. Mostrar todas las entradas

domingo, 26 de julio de 2026

Día 27 — Web scraping: extrayendo datos de internet

El web scraping consiste en extraer información automáticamente de páginas web. Python destaca en esta tarea gracias a la combinación de dos librerías: requests, que descarga el contenido HTML de cualquier página, y BeautifulSoup, que permite recorrer y extraer elementos concretos de ese HTML de forma sencilla.

Es importante mencionar que antes de hacer scraping a cualquier sitio web conviene revisar su archivo robots.txt y sus términos de servicio, ya que no todas las páginas permiten la extracción automatizada de su contenido.

Código de ejemplo:

import requests from bs4 import BeautifulSoup url = "https://ejemplo.com" respuesta = requests.get(url) soup = BeautifulSoup(respuesta.text, "html.parser") titulos = soup.find_all("h2") for titulo in titulos: print(titulo.text.strip()) # Instalación: pip install requests beautifulsoup4




viernes, 6 de agosto de 2021

sábado, 6 de julio de 2019

87 Python. WebScrapping 02

En el video vemos como obtener datos de una web real, comparando los precios obtenidos usando beautifulSoup y request con Python.