¿Sabes hacer web scrapping con R?

Para hacer el web scrapping vamos a usar la librería rvest. Vamos a usar dplyr para hacer el manejo de los datos.

library(rvest)
library(dplyr)

Definimos la página a la que vamos a acceder para hacer el web scrapping.

url <- "https://sports.caliente.mx/es_MX"
html <- read_html(url) # Lee el url para traer todos los elementos de la página
tabla <- html |>
  html_elements("table") # Jala los elementos con clase tabla (class="table")
# Jala (a mano) los datos de la Liga MX (que están en el elemento 3)
tabla_ligamx <- tabla[3] |> html_table() 
tabla_ligamx[[1]][, c("X5", "X6", "X7")] # Extrae las columnas señaladas
## # A tibble: 4 × 3
##   X5                                         X6                            X7   
##   <chr>                                      <chr>                         <chr>
## 1 "★\n\n\nEE.UU\n\n\n4/11\n1.363\n-275"      "Empate\n\n\n4/1\n5.00\n+400" "★\n…
## 2 "★\n\n\nPanamá\n\n\n4/1\n5.00\n+400"       "Empate\n\n\n53/20\n3.65\n+2… "★\n…
## 3 "★\n\n\nCanada\n\n\n1/10\n1.10\n-1000"     "Empate\n\n\n15/2\n8.50\n+75… "★\n…
## 4 "★\n\n\nCosta Rica\n\n\n23/20\n2.15\n+115" "Empate\n\n\n11/5\n3.20\n+22… "★\n…

Comentarios

Entradas más populares de este blog

¿Cómo comparar nombres de equipos de distintas fuentes?

¿Cómo hacemos filtrado y extracción de listas anidadas utilizando `purrr`?