<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Web scraping on Bastián Olea</title>
    <link>https://bastianolea.rbind.io/tags/web-scraping/</link>
    <description>Recent content in Web scraping on Bastián Olea</description>
    <generator>Hugo</generator>
    <language>es-ES</language>
    <lastBuildDate>Thu, 26 Mar 2026 00:00:00 +0000</lastBuildDate>
    <atom:link href="https://bastianolea.rbind.io/tags/web-scraping/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Web scraping con R</title>
      <link>https://bastianolea.rbind.io/blog/web_scraping/</link>
      <pubDate>Thu, 17 Jul 2025 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/web_scraping/</guid>
      <description>&lt;a href=&#34;featured.jpg&#34; target=&#34;_blank&#34;&gt;&#xA;&#xA;  &lt;img src=&#34;featured.jpg&#34; style=&#34;border-radius: 5px; width: 80%; max-width: 700px; display: block; margin: auto; margin-bottom: 8px; margin-top: 8px;&#34;&gt;&#xA;  &#xA;&lt;/a&gt;&#xA;&lt;p&gt;Se denomina &#xA;&lt;a href=&#34;https://bastianolea.rbind.io/tags/web-scraping/&#34;&gt;web scraping&lt;/a&gt; al conjunto de técnicas que permiten &lt;strong&gt;extraer datos e información alojada en páginas web&lt;/strong&gt;, usualmente en formatos que no son fácilmente convertibles a tablas de datos.&lt;/p&gt;&#xA;&lt;p&gt;Al ser R un lenguaje enfocado completamente el análisis de datos, es la plataforma ideal para este tipo de tareas, dado que puedes usar un sólo lenguaje para controlar las herramientas de extracción de datos, programar la lógica para automatizar la extracción, procesar y limpiar los datos, y finalmente analizar y presentar tus resultados.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Galería de libros de _Goodreads_ para tu blog o sitio web con R y Quarto</title>
      <link>https://bastianolea.rbind.io/blog/2026-03-26/</link>
      <pubDate>Thu, 26 Mar 2026 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/2026-03-26/</guid>
      <description>&lt;p&gt;Para mi &#xA;&lt;a href=&#34;https://bastimapache.cl&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;blog personal, bastimapache.cl&lt;/a&gt; quise crear &#xA;&lt;a href=&#34;https://bastimapache.cl/blog.html#category=libros&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;publicaciones que muestren los libros que he leído cada año&lt;/a&gt;, los cuales registro en mi cuenta de &#xA;&lt;a href=&#34;https://www.goodreads.com/user/show/53224910-basti-n-olea-herrera&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;Goodreads&lt;/a&gt;.&lt;/p&gt;&#xA;&lt;a href=&#34;galeria_libros.jpg&#34; target=&#34;_blank&#34;&gt;&#xA;&#xA;  &lt;img src=&#34;galeria_libros.jpg&#34; style=&#34;border-radius: 5px; width: 80%; max-width: 700px; display: block; margin: auto; margin-bottom: 8px; margin-top: 8px;&#34;&gt;&#xA;  &#xA;&lt;/a&gt;&#xA;&lt;p&gt;Para esto, usé R para cargar el archivo de &#xA;&lt;a href=&#34;https://help.goodreads.com/s/article/How-do-I-import-or-export-my-books-1553870934590&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;exportación&lt;/a&gt; de datos de Goodreads, que te entrega un archivo &lt;code&gt;.csv&lt;/code&gt; con tus libros leídos, puntuación, fecha de lectura, etc.&lt;/p&gt;&#xA;&lt;div style=&#34;display: flex; align-items: center; gap: 15px; padding: 14px; &#xA;            /*background-color: #A985C650;*/&#xA;            background-color: #DEC4F2;&#xA;            border-radius: 6px;&#xA;            margin: 20px 40px 20px 40px;&#34;&gt;&#xA;  &#xA;  &lt;div style=&#34;flex-shrink: 0;&#34;&gt;&#xA;    &lt;i class=&#34;fas fa-info-circle&#34; style=&#34;font-size: 130%; margin-left: 2px; opacity: 1; color: #9069C0;&#34;&gt;&lt;/i&gt;&#xA;  &lt;/div&gt;&#xA;  &#xA;  &lt;aside style = &#34;font-size: 90%;&#34;&gt;&#xA;    Si quieres crear tu propio sitio web o blog con Quarto + R y subirlo a internet &lt;strong&gt;gratis&lt;/strong&gt;, &#xA;&lt;a href=&#34;https://bastianolea.rbind.io/blog/tutorial_quarto_github_pages/&#34;&gt;sigue este tutorial que hice!&lt;/a&gt;&#xA;  &lt;/aside&gt;&#xA;  &#xA;&lt;/div&gt;&#xA;&#xA;&#xA;&#xA;&#xA;&lt;h2 id=&#34;cargar-datos-de-goodreads&#34;&gt;Cargar datos de &lt;em&gt;Goodreads&lt;/em&gt;&#xA;  &lt;a href=&#34;#cargar-datos-de-goodreads&#34;&gt;&lt;svg class=&#34;anchor-symbol&#34; aria-hidden=&#34;true&#34; height=&#34;26&#34; width=&#34;26&#34; viewBox=&#34;0 0 22 22&#34; xmlns=&#34;http://www.w3.org/2000/svg&#34;&gt;&#xA;      &lt;path d=&#34;M0 0h24v24H0z&#34; fill=&#34;currentColor&#34;&gt;&lt;/path&gt;&#xA;      &lt;path d=&#34;M3.9 12c0-1.71 1.39-3.1 3.1-3.1h4V7H7c-2.76.0-5 2.24-5 5s2.24 5 5 5h4v-1.9H7c-1.71.0-3.1-1.39-3.1-3.1zM8 13h8v-2H8v2zm9-6h-4v1.9h4c1.71.0 3.1 1.39 3.1 3.1s-1.39 3.1-3.1 3.1h-4V17h4c2.76.0 5-2.24 5-5s-2.24-5-5-5z&#34;&gt;&lt;/path&gt;&#xA;    &lt;/svg&gt;&lt;/a&gt;&#xA;&lt;/h2&gt;&#xA;&lt;p&gt;Carguemos los datos que obtenemos de la exportación de &lt;em&gt;Goodreads:&lt;/em&gt;&lt;/p&gt;</description>
    </item>
    <item>
      <title>Automatizar el scroll de una página web desde R con `{RSelenium}`</title>
      <link>https://bastianolea.rbind.io/blog/2025-12-16/</link>
      <pubDate>Tue, 16 Dec 2025 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/2025-12-16/</guid>
      <description>&lt;p&gt;Para publicitar &#xA;&lt;a href=&#34;https://bastianolea.github.io/aprende_r/&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;mi nueva página para &lt;strong&gt;aprender R&lt;/strong&gt; gratis y de manera autodidacta&lt;/a&gt;, quise grabar un video mostrando los contenidos.&lt;/p&gt;&#xA;&lt;div style=&#34;width: 100%; text-align: center;&#34;&gt;&#xA;&lt;iframe src=&#34;https://www.linkedin.com/embed/feed/update/urn:li:ugcPost:7406413050523840512?compact=1&#34; height=&#34;399&#34; width=&#34;504&#34; frameborder=&#34;0&#34; allowfullscreen=&#34;&#34; title=&#34;Publicación integrada&#34;&gt;&lt;/iframe&gt;&#xA;&lt;/div&gt;&#xA;&lt;p&gt;Pero al grabar el video, no me gustaba cómo quedaba cuando yo iba haciendo &lt;em&gt;scroll&lt;/em&gt; manualmente, porque a veces me quedaban cortados los contenidos o se veía muy errático.&lt;/p&gt;&#xA;&lt;p&gt;Así que hice lo que cualquier persona racional y ocupada haría, y automatizé el &lt;em&gt;scroll&lt;/em&gt; con R, para que &lt;strong&gt;la página se moviera solita&lt;/strong&gt; sin que yo intervenga. Así la grabación sale perfecta 💖&lt;/p&gt;</description>
    </item>
    <item>
      <title>Visualización y scraping de resultados de las elecciones presidenciales 2025</title>
      <link>https://bastianolea.rbind.io/blog/elecciones_presidenciales_2025/</link>
      <pubDate>Mon, 17 Nov 2025 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/elecciones_presidenciales_2025/</guid>
      <description>&lt;p&gt;Hoy domingo 17 de noviembre celebramos una nueva fecha electoral en Chile, esta vez eligiendo presidente.&lt;/p&gt;&#xA;&lt;p&gt;Apliqué el &#xA;&lt;a href=&#34;https://bastianolea.rbind.io/blog/elecciones_municipales_2024/&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;código que he usado en elecciones pasadas&lt;/a&gt; para obtener los datos del Servicio Electoral (Servel) en tiempo real, para así ir &lt;strong&gt;generando gráficos, tablas y mapas&lt;/strong&gt; con los resultados preliminares.&lt;/p&gt;&#xA;&lt;p&gt;&#xA;&lt;a href=&#34;https://github.com/bastianolea/servel_scraping_votaciones&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;El repositorio contiene todo el código&lt;/a&gt; para acceder en tiempo real a los &#xA;&lt;a href=&#34;https://elecciones.servel.cl&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;datos preliminares publicados en la web del Servel&lt;/a&gt;.&lt;/p&gt;&#xA;&lt;p&gt;El sistema que programé usa &#xA;&lt;a href=&#34;https://bastianolea.rbind.io/blog/webscraping_selenium/&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;RSelenium para hacer web scraping&lt;/a&gt; de las tablas, a las que se debe acceder presionando botones en el sitio para elegir elección, región, y comuna, por lo que Selenium resulta ideal para ir probando junto al navegador &lt;em&gt;títere&lt;/em&gt; las formas de controlar la navegación por medio de código, y eventualmente &lt;strong&gt;automatizar el acceso a todas las tablas&lt;/strong&gt; mediante un loop. Luego se aplica un script de &lt;strong&gt;limpieza de datos&lt;/strong&gt;, y finalmente, según las comunas del país que se definan, el sistema genera gráficos, tablas, mapas y textos en base a los resultados de cada comuna, los cuales se guardan y se ordenan en una carpeta llamada &lt;code&gt;salidas&lt;/code&gt;, la que me permite obtener todos los resultados juntos (las imágenes y el texto con cifras y otros datos) y listos para subir a redes sociales.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Descargar todos los archivos de la página web del Censo 2024 con `{rvest}`</title>
      <link>https://bastianolea.rbind.io/blog/2025-07-27/</link>
      <pubDate>Sun, 27 Jul 2025 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/2025-07-27/</guid>
      <description>&lt;p&gt;Veamos un mini ejemplo de automatización de tareas con R: los resultados del Censo 2024 vienen en 20 archivos, en 20 enlaces distintos!&lt;/p&gt;&#xA;&lt;p&gt;¿El problema? para obtenerlos, tendríamos que entrar al sitio con el navegador, ir al enlace de descargas, bajar cada uno de los 20 archivos manualmente, y guardarlos en una carpeta para poder usarlos.&lt;/p&gt;&#xA;&lt;p&gt;En un script de R, con &lt;code&gt;{rvest}&lt;/code&gt; extraemos todos los enlaces del sitio, y con &lt;code&gt;{purrr}&lt;/code&gt; descargamos todos los archivos de una 🚀&lt;/p&gt;</description>
    </item>
    <item>
      <title>Video: Taller Medición y Análisis de la Corrupción en Chile desde el Análisis de Datos y Herramientas Abiertas</title>
      <link>https://bastianolea.rbind.io/blog/taller_corrupcion_cesi/</link>
      <pubDate>Wed, 23 Jul 2025 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/taller_corrupcion_cesi/</guid>
      <description>&lt;p&gt;Taller online que impartí para el &lt;em&gt;Congreso Estudiantil de Sociología Interdisciplinaria.&lt;/em&gt; En este taller introduje a estudiantes de sociología al lenguaje de programación R, explicando los beneficios del análisis de datos desarrollado en flujos de trabajo basados en la programación, y las posibilidades que se abren para producir estudios y obtener resultados usando código. Puse énfasis en el uso de tecnologías y datos abiertos, y en el principal beneficio de la programación (en mi opinión): el poder actualizar resultados, aplicaciones y visualizaciones automáticamente.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Web scraping usando Google Chrome desde R con `{chromote}`</title>
      <link>https://bastianolea.rbind.io/blog/webscraping_chromote/</link>
      <pubDate>Thu, 17 Jul 2025 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/webscraping_chromote/</guid>
      <description>&lt;p&gt;En este blog ya hemos cubierto un par de herramientas de &#xA;&lt;a href=&#34;../../../tags/web-scraping/&#34;&gt;web scraping&lt;/a&gt;, cada una con sus características y beneficios: &#xA;&lt;a href=&#34;../../../blog/webscraping_rvest/&#34;&gt;&lt;code&gt;{rvest}&lt;/code&gt;&lt;/a&gt;, un paquete fácil y rápido de usar para extraer datos desde sitios webs comunes, y &#xA;&lt;a href=&#34;../../../blog/webscraping_selenium/&#34;&gt;&lt;code&gt;{RSelenium}&lt;/code&gt;&lt;/a&gt;, una interfaz en R para utilizar un software de automatización de navegadores bastante popular, aunque un poco menos amigable.&lt;/p&gt;&#xA;&lt;p&gt;Ahora veremos cómo extraer datos desde páginas web usando un paquete de R que, a grandes rasgos, hace web scraping controlando Google Chrome.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Extrae datos desde páginas de internet controlando un navegador web con `{RSelenium}` en R</title>
      <link>https://bastianolea.rbind.io/blog/webscraping_selenium/</link>
      <pubDate>Tue, 15 Jul 2025 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/webscraping_selenium/</guid>
      <description>&lt;p&gt;Selenium es un programa para automatizar y controlar navegadores web, lo que lo vuelve en una buena herramienta para realizar &lt;strong&gt;&#xA;&lt;a href=&#34;../../../tags/web-scraping/&#34;&gt;web scraping&lt;/a&gt;&lt;/strong&gt;. El &#xA;&lt;a href=&#34;https://docs.ropensci.org/RSelenium/&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;paquete de R &lt;code&gt;{RSelenium}&lt;/code&gt;&lt;/a&gt; nos permitirá controlar un navegador por medio de código de R, lo cual abre infinitas posibilidades al momento de automatizar la obtención de datos e información desde sitios web dinámicos y/o complejos.&lt;/p&gt;&#xA;&lt;p&gt;En este tutorial aprenderemos a usar &lt;code&gt;{RSelenium}&lt;/code&gt; para programar scripts de R que automaticen el control de un navegador para interactuar con sitios web y así scrapear datos más difíciles de obtener.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Video: Taller Aplicación de la Ciencia de Datos en la Gestión Municipal</title>
      <link>https://bastianolea.rbind.io/blog/unim/taller_ciencia_de_datos_gestion_municipal/</link>
      <pubDate>Fri, 24 Jan 2025 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/unim/taller_ciencia_de_datos_gestion_municipal/</guid>
      <description>&lt;p&gt;Tuve el privilegio de exponer en la &lt;strong&gt;Universidad Internacional de la Municipalidad de Rancagua&lt;/strong&gt;, un espacio de diálogo, aprendizaje y colaboración, organizado por el &lt;strong&gt;Programa de Gobierno Local Abierto&lt;/strong&gt; (GOBLA) de la Municipalidad de Rancagua.&lt;/p&gt;&#xA;&lt;p&gt;Presenté un taller dirigido a funcionarios y funcionarias municipales sobre Aplicación de la ciencia de datos en la Gestión Municipal, donde comuniqué la importancia de manejar herramientas de progamación para le análisis de datos, favoreciendo el desarrollo de herramientas reutilizables, reproducibles, transparentes y abiertas.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Actualización de app Análisis de prensa: visualización de análisis de sentimiento de noticias recientes</title>
      <link>https://bastianolea.rbind.io/blog/2025-01-14/</link>
      <pubDate>Tue, 14 Jan 2025 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/2025-01-14/</guid>
      <description>&lt;h3 id=&#34;actualización-de-app-análisis-de-prensa-&#34;&gt;Actualización de app análisis de prensa 🗞️&#xA;  &lt;a href=&#34;#actualizaci%c3%b3n-de-app-an%c3%a1lisis-de-prensa-&#34;&gt;&lt;svg class=&#34;anchor-symbol&#34; aria-hidden=&#34;true&#34; height=&#34;26&#34; width=&#34;26&#34; viewBox=&#34;0 0 22 22&#34; xmlns=&#34;http://www.w3.org/2000/svg&#34;&gt;&#xA;      &lt;path d=&#34;M0 0h24v24H0z&#34; fill=&#34;currentColor&#34;&gt;&lt;/path&gt;&#xA;      &lt;path d=&#34;M3.9 12c0-1.71 1.39-3.1 3.1-3.1h4V7H7c-2.76.0-5 2.24-5 5s2.24 5 5 5h4v-1.9H7c-1.71.0-3.1-1.39-3.1-3.1zM8 13h8v-2H8v2zm9-6h-4v1.9h4c1.71.0 3.1 1.39 3.1 3.1s-1.39 3.1-3.1 3.1h-4V17h4c2.76.0 5-2.24 5-5s-2.24-5-5-5z&#34;&gt;&lt;/path&gt;&#xA;    &lt;/svg&gt;&lt;/a&gt;&#xA;&lt;/h3&gt;&#xA;&lt;p&gt;&lt;strong&gt;Nuevo:&lt;/strong&gt; gráfico de análisis de sentimiento: elige un tema y revisa si las noticias recientes fueron mayormente positivas o negativas. Compara cómo distintos medios abordan las temáticas. ¡Pronto más detalle!&lt;/p&gt;&#xA;&lt;p&gt;&lt;img style = &#34;border-radius: 7px; width: 100%; max-width: 400px; display: block; margin: auto;&#34;&#xA;src = analisis_sentimiento_1.png&gt;&lt;/p&gt;</description>
    </item>
    <item>
      <title>Web scraping de noticias: avances de fin de año</title>
      <link>https://bastianolea.rbind.io/blog/2024-12-31/</link>
      <pubDate>Tue, 31 Dec 2024 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/2024-12-31/</guid>
      <description>&lt;p&gt;A largo de todo el año 2024 he estado realizando &#xA;&lt;a href=&#34;https://bastianolea.rbind.io/tags/web-scraping/&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;web scraping&lt;/a&gt; de distintas fuentes de noticias digitales de Chile. Casi todos los días ejecuto un script que a su vez se ejecuta decenas de otros scripts, que realizan el scraping diario de noticias. El resultado de estos procesos, día tras día, va aumentando la cantidad total de noticias que he ido recolectando. De vez en cuando, algún sitio cambia, o algo falla, y tengo que corregir manualmente los scripts. Cada cierto tiempo ejecuto versiones alternativas de los scripts para hacer una extracción de datos desde fechas anteriores, aumentando la cantidad total de noticias de fechas pasadas, lo que me permite rellenar vacíos en las obtenciones anteriores de noticias diarias, como también aumentar la cantidad total de noticias con datos desde años antes de que empezara este proyecto.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Extrae datos desde páginas de internet haciendo web scraping en R con `{rvest}`</title>
      <link>https://bastianolea.rbind.io/blog/webscraping_rvest/</link>
      <pubDate>Fri, 27 Dec 2024 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/webscraping_rvest/</guid>
      <description>&lt;p&gt;Se denomina web scraping a un conjunto de técnicas usadas para &lt;strong&gt;obtener datos desde páginas web&lt;/strong&gt;. Esto significa poder transformar la información que vemos en distintos sitios de internet en datos que podamos utilizar.&lt;/p&gt;&#xA;&lt;p&gt;Se usa el web scraping cuando un sitio web presenta información, cifras, datos, números, o cualquier otro elemento que nos pueda servir, pero sin facilitar acceso a los datos, como sería un enlace de descarga, una API para obtener los datos, o alguna forma de exportar la información. En estos casos tenemos que recurrir al scraping para transformar lo que vemos en la web en datos analizables.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Crea tablas atractivas y personalizables en R con `{gt}`</title>
      <link>https://bastianolea.rbind.io/blog/tablas_gt/</link>
      <pubDate>Tue, 19 Nov 2024 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/tablas_gt/</guid>
      <description>&lt;p&gt;&#xA;&lt;a href=&#34;https://gt.rstudio.com&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;El paquete de R &lt;code&gt;{gt}&lt;/code&gt;&lt;/a&gt; (llamado así por generar &lt;em&gt;great tables&lt;/em&gt;) permite producir tablas atractivas con R para presentar tus datos. Sus cualidades principales son que produce &lt;strong&gt;resultados atractivos con muy pocas líneas de código&lt;/strong&gt;, pero al mismo tiempo ofrece una &lt;strong&gt;alta capacidad de personalización&lt;/strong&gt;, teniendo opciones para personalizar prácticamente todos los aspectos de la tabla.&lt;/p&gt;&#xA;&lt;p&gt;Otro beneficio de usar este paquete es que contiene funciones que hacen muy fácil darle el &lt;strong&gt;formato correcto a las variables numéricas,&lt;/strong&gt; como porcentajes, números grandes, cifras en dinero, etc., Y además, ofrece funciones para darle estilos personalizados a las columnas o celdas de tu tabla de forma programática. Esto permite generar ciertas reglas para que las &lt;strong&gt;celdas cambien de colores dependiendo de su valor&lt;/strong&gt;, ciertas cifras &lt;strong&gt;cambian su tipo de letra bajo determinadas circunstancias&lt;/strong&gt;, y mucho más.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Scraping de datos del Sistema de Información del Mercado Laboral</title>
      <link>https://bastianolea.rbind.io/blog/simel_scraping/</link>
      <pubDate>Fri, 01 Nov 2024 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/simel_scraping/</guid>
      <description>&lt;p&gt;El &#xA;&lt;a href=&#34;https://www.simel.gob.cl&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;Sistema de Información del Mercado Laboral (SIMEL)&lt;/a&gt; es una plataforma virtual desarrollada por las instituciones que componen la Mesa para la Coordinación de las Estadísticas del Trabajo 1 con el apoyo técnico de la Organización Internacional del Trabajo (OIT).&lt;/p&gt;&#xA;&lt;p&gt;El SIMEL permite obtener información objetiva y actualizada sobre el mercado del trabajo, la que estará disponible para investigadores, tomadores de decisiones y la ciudadanía en general.&lt;/p&gt;&#xA;&lt;hr&gt;&#xA;&lt;p&gt;&#xA;&lt;a href=&#34;https://github.com/bastianolea/simel_scraping&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;Repositorio&lt;/a&gt; que permite descargar los datos estadísticos de SIMEL con un solo script, obteniendo cada conjunto de datos en archivos &lt;code&gt;csv&lt;/code&gt; individuales.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Visualización y scraping de resultados en vivo de las elecciones municipales 2024</title>
      <link>https://bastianolea.rbind.io/blog/elecciones_municipales_2024/</link>
      <pubDate>Wed, 30 Oct 2024 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/elecciones_municipales_2024/</guid>
      <description>&lt;p&gt;&lt;img src=&#34;https://bastianolea.rbind.io/blog/elecciones_municipales_2024/servel_resultados_multi_featured.png&#34;&gt;&lt;/p&gt;&#xA;&lt;p&gt;Con motivo de las elecciones municipales, estuve generando algunas visualizaciones ”en tiempo real” de los resultados de las elecciones de alcaldías. Los datos de conteo de votos los fui obteniendo minuto a minuto mediante web scraping con &lt;code&gt;{RSelenium}&lt;/code&gt;, que permite programar un navegador web para que interactúe con un sitio como si fuera humano. Entonces, el navegador robot (marioneta, le llaman) iba apretando todos los botones, sin intervención de mi parte, para encontrar y copiar los resultados de cada comuna del país.&lt;/p&gt;</description>
    </item>
    <item>
      <title>App: Análisis de prensa chilena</title>
      <link>https://bastianolea.rbind.io/blog/app_prensa_chile/</link>
      <pubDate>Thu, 08 Aug 2024 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/app_prensa_chile/</guid>
      <description>&lt;p&gt;Proyecto de ciencia de datos desarrollado en R para analizar texto de noticias chilenas. Comprende módulos para realizar web scraping de sitios web de prensa para obtener el texto de sus noticias, procesos para transformar ese texto en palabras (tokens), y procesos para analizar dicho corpus de palabras usando distintas técnicas estadísticas.&lt;/p&gt;&#xA;&lt;p&gt;Actualmente, el corpus de noticias obtenido supera las 800.000 noticias individuales, las cuales suman un total de 140 millones (!) de palabras, abarcando más de 30 fuentes periodísticas distintas.&lt;/p&gt;</description>
    </item>
    <item>
      <title>App: Indicadores económicos de Chile</title>
      <link>https://bastianolea.rbind.io/blog/app_economia_chile/</link>
      <pubDate>Sat, 25 May 2024 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/app_economia_chile/</guid>
      <description>&lt;p&gt;&#xA;&lt;a href=&#34;https://bastianoleah.shinyapps.io/economia_chile/&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;Aplicación web&lt;/a&gt; tipo dashboard que busca presentar de forma sencilla y compacta los principales indicadores de la economía chilena.&lt;/p&gt;&#xA;&lt;p&gt;Los datos de este repositorio se actualizan automáticamente cada 12 horas por medio de GitHub Actions. Estos datos se obtienen realizando web scraping al &#xA;&lt;a href=&#34;https://www.bcentral.cl/web/banco-central&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;sitio web del Banco Central.&lt;/a&gt; usando el &#xA;&lt;a href=&#34;https://rvest.tidyverse.org&#34; target=&#34;_blank&#34; rel=&#34;noopener&#34;&gt;paquete de R &lt;code&gt;{rvest}&lt;/code&gt;&lt;/a&gt;.&lt;/p&gt;&#xA;&#xA;&#xA;&#xA;&#xA;&lt;h3 id=&#34;indicadores-disponibles&#34;&gt;Indicadores disponibles&#xA;  &lt;a href=&#34;#indicadores-disponibles&#34;&gt;&lt;svg class=&#34;anchor-symbol&#34; aria-hidden=&#34;true&#34; height=&#34;26&#34; width=&#34;26&#34; viewBox=&#34;0 0 22 22&#34; xmlns=&#34;http://www.w3.org/2000/svg&#34;&gt;&#xA;      &lt;path d=&#34;M0 0h24v24H0z&#34; fill=&#34;currentColor&#34;&gt;&lt;/path&gt;&#xA;      &lt;path d=&#34;M3.9 12c0-1.71 1.39-3.1 3.1-3.1h4V7H7c-2.76.0-5 2.24-5 5s2.24 5 5 5h4v-1.9H7c-1.71.0-3.1-1.39-3.1-3.1zM8 13h8v-2H8v2zm9-6h-4v1.9h4c1.71.0 3.1 1.39 3.1 3.1s-1.39 3.1-3.1 3.1h-4V17h4c2.76.0 5-2.24 5-5s-2.24-5-5-5z&#34;&gt;&lt;/path&gt;&#xA;    &lt;/svg&gt;&lt;/a&gt;&#xA;&lt;/h3&gt;&#xA;&lt;ul&gt;&#xA;&lt;li&gt;PIB&lt;/li&gt;&#xA;&lt;li&gt;IMACEC&lt;/li&gt;&#xA;&lt;li&gt;IPC&lt;/li&gt;&#xA;&lt;li&gt;IPSA&lt;/li&gt;&#xA;&lt;li&gt;UF&lt;/li&gt;&#xA;&lt;li&gt;Tasa de desempleo&lt;/li&gt;&#xA;&lt;li&gt;Índice de remuneraciones reales&lt;/li&gt;&#xA;&lt;li&gt;Inversión extranjera &lt;strong&gt;(nuevo)&lt;/strong&gt;&lt;/li&gt;&#xA;&lt;li&gt;Precio del cobre &lt;strong&gt;(nuevo)&lt;/strong&gt;&lt;/li&gt;&#xA;&lt;/ul&gt;&#xA;&lt;p&gt;&lt;img src=&#34;https://bastianolea.rbind.io/blog/app_economia_chile/otros/pantallazos/pantallazo1.png&#34;&gt;&lt;/p&gt;</description>
    </item>
    <item>
      <title>Tutorial: Scraping de estadísticas delictuales del Centro de Estudios y Análisis del Delito con R</title>
      <link>https://bastianolea.rbind.io/blog/tutorial_delitos_cead/</link>
      <pubDate>Wed, 27 Sep 2023 00:00:00 +0000</pubDate>
      <guid>https://bastianolea.rbind.io/blog/tutorial_delitos_cead/</guid>
      <description>&lt;p&gt;En este script detallaré cómo descargar datos de estadísticas delictuales del Centro de Estudios y Análisis del Delito (CEAD) de Chile utilizando técnicas de web scraping en R. Las estadísticas disponibles en el sitio web de CEAD corresponden a los siguientes datos oficiales: &lt;em&gt;Estadísticas Oficiales de Delitos de Mayor Connotación Social (DMCS), Violencia Intrafamiliar (VIF), Incivilidades y otros hechos informados por Carabineros y la Policía de Investigaciones de Chile al Ministerio del Interior y Seguridad Pública.&lt;/em&gt;&lt;/p&gt;</description>
    </item>
  </channel>
</rss>
