infinitelaws
regolamento sull'intelligenza artificiale
Articolo 10#

Dati e governance dei dati

1.  I sistemi di IA ad alto rischio che utilizzano tecniche che prevedono l'uso di dati per l'addestramento di modelli di IA sono sviluppati sulla base di set di dati di addestramento, convalida e prova che soddisfano i criteri di qualità di cui al presente articolo, paragrafi 2, 3 e 4, e all'articolo 4 bis, paragrafo 1, ogniqualvolta siano utilizzati tali set di dati.

2.  I set di dati di addestramento, convalida e prova sono soggetti a pratiche di governance e gestione dei dati adeguate alla finalità prevista del sistema di IA ad alto rischio. Tali pratiche riguardano in particolare:

a) 

le scelte progettuali pertinenti;

b) 

i processi di raccolta dei dati e l'origine dei dati, nonché la finalità originaria della raccolta nel caso di dati personali;

c) 

le operazioni di trattamento pertinenti ai fini della preparazione dei dati, quali annotazione, etichettatura, pulizia, aggiornamento, arricchimento e aggregazione;

d) 

la formulazione di ipotesi, in particolare per quanto riguarda le informazioni che si presume che i dati misurino e rappresentino;

e) 

una valutazione della disponibilità, della quantità e dell'adeguatezza dei set di dati necessari;

f) 

un esame atto a valutare le possibili distorsioni suscettibili di incidere sulla salute e sulla sicurezza delle persone, di avere un impatto negativo sui diritti fondamentali o di comportare discriminazioni vietate dal diritto dell'Unione, specie laddove gli output di dati influenzano gli input per operazioni future;

g) 

le misure adeguate per individuare, prevenire e attenuare le possibili distorsioni individuate conformemente alla lettera f);

h) 

l'individuazione di lacune o carenze pertinenti nei dati tali da pregiudicare il rispetto del presente regolamento e il modo in cui tali lacune e carenze possono essere colmate.

3.  I set di dati di addestramento, convalida e prova sono pertinenti, sufficientemente rappresentativi e, nella misura del possibile, esenti da errori e completi nell'ottica della finalità prevista. Essi possiedono le proprietà statistiche appropriate anche, ove applicabile, per quanto riguarda le persone o i gruppi di persone relativamente ai quali il sistema di IA ad alto rischio è destinato a essere usato. Queste caratteristiche dei set di dati possono essere soddisfatte a livello di singoli set di dati o a livello di una combinazione degli stessi.

4.  I set di dati tengono conto, nella misura necessaria per la finalità prevista, delle caratteristiche o degli elementi particolari dello specifico ambito geografico, contestuale, comportamentale o funzionale all'interno del quale il sistema di IA ad alto rischio è destinato a essere usato.

 —————

6.  Per lo sviluppo di sistemi di IA ad alto rischio che non utilizzano tecniche che prevedono l'addestramento di modelli di IA, i paragrafi 2, 3 e 4 del presente articolo e l'articolo 4 bis, paragrafo 1, si applicano solo ai set di dati di prova.

Per questa disposizione non esiste ancora un commento

Richiedetelo: l'interesse dei lettori determina la nostra coda. Vi avviseremo appena il commento uscirà.

Useremo il vostro indirizzo solo per comunicarvi l'uscita del commento.

Version history

Changes: Původní znění (OJ L 2024/1689) → Znění po Omnibusu (k 27. 7. 2026)
Added in green, removed in red (word level).

Computing…

Znění po Omnibusu (k 27. 7. 2026) · CELEX 02024R1689-20260727