Esta pregunta sobre si el web scraping es legal o no en España es muy recurrente por muchas empresas, sobre todo, las que están comenzando en el mercado. Por ello, intentaremos contestar a todo lo relacionado con el tema jurídico para aquellos que quieren empezar a hacer la extracción de datos online.

Para responder claramente: el web scraping sí es legal en España y es utilizado por muchos negocios como técnica informática que puede aportar mucho valor a la empresa. Pero claro, eso va a depender mucho del uso que le des, ya que puede no ser todo positivo.
Lo que ocurre es que el web scraping se ha asociado en muchas ocasiones a la ciberdelincuencia ya que se trata de extraer datos, por lo que muchos lo pueden considerar spam o que viole la protección de datos. Por ejemplo, un correo spam sí es ilegal, pero el email no lo es. Eso tan sencillo es lo que marca la diferencia.
Por ello, se puede decir que en la práctica no es ilegal hacer el webscraping en España, pero a través de esta práctica, sí se puede considerar ilegal violar los derechos de autor, propiedad intelectual o hacer algún tipo de competencia desleal.
Este tratamiento debe seguir unas reglas y todas está recogidas en el Reglamento General de Protección de Datos (RGPD) o en la Ley Orgánica 3/2018, de 5 de diciembre, de protección de Datos de Carácter Personal y Garantía de los Derechos Digitales, los cuales vas a poder visitar fácilmente.
Y es que el scraping se usa de forma ilegal cuando básicamente se copia material para usarlo como uno propio, algo que suele ocurrir en muchas páginas webs y que es difícil de detectar. Esto es un claro ejemplo de violación de los derechos de autor.
Por ello, en caso de que te ocurra esto, tienes que acudir al RGPD que te dictará cuáles son los puntos como guía para entender si realmente te puede estar pasando y cómo actuar. Algunas de las novedades en este reglamento que vas a encontrar son: el consentimiento del almacenamiento de tus datos y en caso de robo, avisar a los usuarios afectados. Además, solo se van a poder usar los datos que realmente la empresa necesita, un tema bastante discutible y por el que los tribunales no se ponen de acuerdo en la actualidad al ser un tema bastante nuevo.
Pero, ¿cómo se hace el scraping?
Vas a poder encontrar diferentes maneras para extraer los datos de un sitio web pero, por lo general, se suelen hacer con softwares, pero si es poco lo que vas a necesitar, podrías hacerlo incluso de forma manual.
Con algunas de esas herramientas, lo que se permite es hacer una extracción de los datos después de rastrear la web y remitirle por tanto al usuario todos los datos. Otras pueden hacer el llamado screen scraping, que básicamente va a extraer esos datos con extensiones en tu ordenador.
Pero también lo vas a poder hacer manualmente sabiendo los algoritmos para realizar tus búsquedas únicamente con lo que necesites, algo que te va a ayudar mucho a filtrar.
Si te encuentras en el otro lado y quieres evitar que otros hagan un scrapeo de tu web, lo más recomendable es que vayas cambiando con frecuencia tu estructura de HTML, así como intentar impedir que otros bots entren gracias al firewall que tendrás que reforzar en tu servidor. Siempre has de poner un aviso legal sobre la prohibición de realizar el scrapping en tu sitio web, aunque sinceramente, eso no va a impedir a los bots que lo realicen, por desgracia.















