{"id":2956,"date":"2023-12-28T12:01:57","date_gmt":"2023-12-28T11:01:57","guid":{"rendered":"https:\/\/supremecourt.qodeinteractive.com\/?p=2956"},"modified":"2024-10-23T10:04:27","modified_gmt":"2024-10-23T08:04:27","slug":"web-scraping-iag-e-diritto-alla-protezione-dei-dati-personali","status":"publish","type":"post","link":"https:\/\/www.lvmholding.it\/index.php\/2023\/12\/28\/web-scraping-iag-e-diritto-alla-protezione-dei-dati-personali\/","title":{"rendered":"Web scraping, IAG e diritto alla protezione dei dati personali"},"content":{"rendered":"\t\t<div data-elementor-type=\"wp-post\" data-elementor-id=\"2956\" class=\"elementor elementor-2956\">\n\t\t\t\t\t\t<section class=\"elementor-section elementor-top-section elementor-element elementor-element-7430ced elementor-section-full_width elementor-section-height-default elementor-section-height-default\" data-id=\"7430ced\" data-element_type=\"section\">\n\t\t\t\t\t\t<div class=\"elementor-container elementor-column-gap-default\">\n\t\t\t\t\t<div class=\"elementor-column elementor-col-100 elementor-top-column elementor-element elementor-element-0d0fb10\" data-id=\"0d0fb10\" data-element_type=\"column\">\n\t\t\t<div class=\"elementor-widget-wrap elementor-element-populated\">\n\t\t\t\t\t\t<div class=\"elementor-element elementor-element-2c2e2d0 elementor-widget elementor-widget-text-editor\" data-id=\"2c2e2d0\" data-element_type=\"widget\" data-widget_type=\"text-editor.default\">\n\t\t\t\t<div class=\"elementor-widget-container\">\n\t\t\t\t\t\t\t<p><span style=\"font-weight: 400;\">Il Garante per la Protezione dei Dati personali ha fornito le prime indicazioni sul fenomeno della raccolta massiva di dati personali dal web (<\/span><i><span style=\"font-weight: 400;\">web scraping<\/span><\/i><span style=\"font-weight: 400;\">) per finalit\u00e0 di addestramento dei modelli di intelligenza artificiale generativa (di seguito anche \u201cIAG\u201d) e ha segnalato possibili azioni di contrasto che i gestori di siti internet e di piattaforme online, sia pubblici che privati, operanti in Italia, quali titolari del trattamento dei dati personali oggetto di pubblicazione, potrebbero implementare al fine di prevenire, ove ritenuta incompatibile con le basi giuridiche e le finalit\u00e0 della pubblicazione, la raccolta di dati da parte di terzi per finalit\u00e0 di addestramento dei modelli di intelligenza artificiale.<\/span><\/p><p><span style=\"font-weight: 400;\">Il Garante fa riferimento esclusivamente a dati personali oggetto di diffusione in quanto pubblicati su siti web e piattaforme online, che vengono raccolti dai <\/span><i><span style=\"font-weight: 400;\">bot <\/span><\/i><span style=\"font-weight: 400;\">di terze parti. Al riguardo, pare opportuno ricordare che ogni titolare del trattamento di dati personali, soggetto pubblico o privato, ai sensi del GDPR, pu\u00f2 rendere disponibili al pubblico tali dati personali esclusivamente per finalit\u00e0 specifiche e sulla base di una o pi\u00f9 condizioni di legittimit\u00e0 tra quelle previste all\u2019art. 6 del Regolamento (es: obblighi di trasparenza, pubblicit\u00e0 legale, procedure a evidenza pubblica, diritto di cronaca, contratto in essere con gli interessati).<\/span><\/p><p><span style=\"font-weight: 400;\">L\u2019Autorit\u00e0 ritiene utile fornire alcune indicazioni ai gestori dei siti web e di piattaforme online, operanti in Italia, in merito alle possibili cautele che potrebbero essere adottate per mitigare gli effetti del web scraping di terze parti, ovvero:<\/span><\/p>\t\t\t\t\t\t<\/div>\n\t\t\t\t<\/div>\n\t\t\t\t<div class=\"elementor-element elementor-element-9c16a6d elementor-widget elementor-widget-text-editor\" data-id=\"9c16a6d\" data-element_type=\"widget\" data-widget_type=\"text-editor.default\">\n\t\t\t\t<div class=\"elementor-widget-container\">\n\t\t\t\t\t\t\t<ol><li><b>Creazione di aree riservate<\/b> <span style=\"font-weight: 400;\">\ud83e\udc6a<\/span><span style=\"font-weight: 400;\"> la creazione di aree riservate, a cui si pu\u00f2 accedere solo previa registrazione, rappresenta una valida cautela in quanto sottrae dati dalla ritenuta pubblica disponibilit\u00e0. Tale tipologia di cautela tecnico-organizzativa pu\u00f2, sebbene indirettamente contribuire ad una maggiore tutela dei dati personali rispetto ad attivit\u00e0 di web scraping.<\/span><\/li><li><b>Inserimento di clausole ad hoc nei termini di servizio<\/b> <span style=\"font-weight: 400;\">\ud83e\udc6a<\/span><span style=\"font-weight: 400;\"> L\u2019inserimento nei Termini di Servizio (ToS) di un sito web o di una piattaforma online dell\u2019espresso divieto di utilizzare tecniche di web scraping costituisce una clausola contrattuale che, se non rispettata, consente ai gestori di detti siti e piattaforme di agire in giudizio per far dichiarare l\u2019inadempimento contrattuale della controparte. Si tratta di una cautela di mera natura giuridica che opera, in quanto tale ex post, ma che pu\u00f2 fungere da strumento di carattere special-preventivo e, in tal modo, fungere da deterrente, contribuendo ad una maggiore tutela dei dati personali rispetto ad attivit\u00e0 di web scraping.\u00a0<\/span><\/li><li><b>Monitoraggio del traffico di rete<\/b> <span style=\"font-weight: 400;\">\ud83e\udc6a<\/span><span style=\"font-weight: 400;\"> Un semplice accorgimento tecnico quale il monitoraggio delle richieste HTTP ricevute da un sito web o da una piattaforma consente di individuare eventuali flussi anomali di dati in ingresso ed in uscita da un sito web o da una piattaforma online e di intraprendere adeguate contromisure di protezione. Tale cautela pu\u00f2 essere accompagnata anche da un Rate Limiting, una misura tecnica che permette di limitare il traffico di rete ed il numero di richieste selezionando solo quelle provenienti da determinati indirizzi IP, al fine di impedire a priori un traffico eccessivo di dati (in particolare attacchi DDoS o web scraping).\u00a0<\/span><\/li><li><b>Intervento sui bot<\/b> <span style=\"font-weight: 400;\">\ud83e\udc6a<\/span><span style=\"font-weight: 400;\"> il web scraping si basa sull\u2019utilizzo di bot. Qualunque tecnica in grado di limitare l\u2019accesso ai bot si rivela, pertanto, un efficace metodo per arginare l\u2019attivit\u00e0 automatizzata di raccolta dati che viene effettuata tramite tali software. \u00c8 doveroso sottolineare che nessuna tecnica che agisce sui bot \u00e8 in grado di annullarne l\u2019operativit\u00e0 al 100%, ma anche che alcune azioni di contrasto possono indubbiamente contribuire a prevenire\/mitigare il web scraping non desiderato per finalit\u00e0 di addestramento dell\u2019intelligenza artificiale generativa.<\/span><\/li><\/ol>\t\t\t\t\t\t<\/div>\n\t\t\t\t<\/div>\n\t\t\t\t<div class=\"elementor-element elementor-element-64c117e elementor-widget elementor-widget-qi_addons_for_elementor_section_title\" data-id=\"64c117e\" data-element_type=\"widget\" data-widget_type=\"qi_addons_for_elementor_section_title.default\">\n\t\t\t\t<div class=\"elementor-widget-container\">\n\t\t\t<div class=\"qodef-shortcode qodef-m  qodef-qi-section-title  qodef-decoration--italic  qodef-link--underline-draw qodef-subtitle-icon--left\">\n\t\t\t\t\t\t\t\t<div class=\"qodef-m-text\"><p><span style=\"font-weight: 400\">In definitiva, I gestori di siti web e di piattaforme online che rivestano al tempo stesso il ruolo di titolari del trattamento, fermi restando gli obblighi di pubblicit\u00e0, accesso, riuso e di adozione delle misure di sicurezza previste dal RGPD, dovrebbero valutare, caso per caso, quando risulti necessario, in conformit\u00e0 alla vigente disciplina, sottrarre i dati personali che trattano ai bot di terze parti mediante l\u2019adozione di azioni di contrasto come quelle indicate che, sebbene non esaustive n\u00e9 per metodo, n\u00e9 per risultato, possono contenere gli effetti dello scraping finalizzato all\u2019addestramento degli algoritmi di intelligenza artificiale generativa.<\/span><\/p><\/div>\n\t<\/div>\n\t\t<\/div>\n\t\t\t\t<\/div>\n\t\t\t\t\t<\/div>\n\t\t<\/div>\n\t\t\t\t\t<\/div>\n\t\t<\/section>\n\t\t\t\t<\/div>\n\t\t","protected":false},"excerpt":{"rendered":"<p>Il Garante per la Protezione dei Dati personali ha fornito le prime indicazioni sul fenomeno della raccolta massiva di dati personali dal web (web scraping) per finalit\u00e0 di addestramento dei modelli di intelligenza artificiale generativa (di seguito anche \u201cIAG\u201d) e ha segnalato possibili azioni di contrasto&#8230;<\/p>\n","protected":false},"author":1,"featured_media":6330,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"footnotes":""},"categories":[16],"tags":[],"class_list":["post-2956","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-tecnologia-e-diritto"],"_links":{"self":[{"href":"https:\/\/www.lvmholding.it\/index.php\/wp-json\/wp\/v2\/posts\/2956","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/www.lvmholding.it\/index.php\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/www.lvmholding.it\/index.php\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/www.lvmholding.it\/index.php\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/www.lvmholding.it\/index.php\/wp-json\/wp\/v2\/comments?post=2956"}],"version-history":[{"count":7,"href":"https:\/\/www.lvmholding.it\/index.php\/wp-json\/wp\/v2\/posts\/2956\/revisions"}],"predecessor-version":[{"id":6367,"href":"https:\/\/www.lvmholding.it\/index.php\/wp-json\/wp\/v2\/posts\/2956\/revisions\/6367"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/www.lvmholding.it\/index.php\/wp-json\/wp\/v2\/media\/6330"}],"wp:attachment":[{"href":"https:\/\/www.lvmholding.it\/index.php\/wp-json\/wp\/v2\/media?parent=2956"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/www.lvmholding.it\/index.php\/wp-json\/wp\/v2\/categories?post=2956"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/www.lvmholding.it\/index.php\/wp-json\/wp\/v2\/tags?post=2956"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}