Modul 07 AI Risk Mitigation
Modul 07 AI Risk Mitigation
inteligenței artificiale
Sursele riscurilor
Sursele riscurilor
Crearea datelor
• Prejudecăți de raportare Dezvoltarea procesului
• Stereotipuri implicite • Alegerea setului de date pentru
Comportamentul utilizatorului
etice
• Ar trebui făcută o distincție între datele care sunt sensibile la prima vedere
și datele care nu sunt sensibile în mod inerent, dar care necesită agregare
ulterioară pentru a trage concluzii plauzibile în scopul creării de profiluri.
© ECPC 2024
IA și prelucrarea categoriilor speciale de date cu caracter personal
Categorii speciale de date cu caracter personal (date cu caracter personal sensibile):
o Acestea sunt date cu caracter personal care sunt atât de sensibile încât ar trebui prelucrate numai în cazuri foarte specifice
o Există, totuși, excepții
o Când o persoană vizată își dă consimțământul explicit;
o În cazul în care acest lucru este în interesul public, în special prelucrarea datelor cu caracter personal în domeniul
dreptului muncii, al protecției sociale sau al amenințărilor grave la adresa sănătății publice.
o În cazul în care este necesar pentru a proteja interesele vitale ale persoanei vizate sau ale unei alte persoane fizice, în
cazul în care persoana vizată este incapabilă din punct de vedere fizic sau juridic să își dea consimțământul;
o În cursul activităților sale legitime, cu garanții adecvate de către o fundație, asociație sau orice altă
organism non-profit cu scop politic, filozofic, religios sau sindical;
o Atunci când prelucrarea se referă la date cu caracter personal care sunt făcute publice în mod evident de către
persoana vizată;
o În cazul în care este necesar pentru constatarea, exercitarea sau apărarea unor pretenții în justiție, fie în cadrul unei
proceduri judiciare, fie într-o procedură administrativă sau extrajudiciară.
© ECPC 2024
IA și prelucrarea categoriilor speciale de date cu caracter personal
Luarea automată a deciziilor = procesul de luare a unei decizii prin mijloace automate, fără nicio implicare umană,
inclusiv profilarea
• Exemplu:
• O comisie de examinare folosește un sistem automat pentru a marca foile de răspuns la examenul cu răspunsuri
multiple. Sistemul este preprogramat cu numărul de răspunsuri corecte necesare pentru a obține note de
trecere și distincție. Scorurile sunt atribuite automat candidaților în funcție de numărul de răspunsuri corecte,
iar rezultatele sunt disponibile online.
Profilare = orice formă de prelucrare automată a datelor cu caracter personal care constă în utilizarea datelor cu caracter
personal pentru a evalua anumite aspecte cu caracter personal referitoare la o persoană fizică
• Exemplu:
- Utilizarea postărilor pe rețelele de socializare pentru a analiza personalitatea șoferilor de mașini prin utilizarea
unui algoritm pentru a analiza cuvinte și expresii care sugerează conducerea "sigură" și "nesigură" pentru a
atribui un nivel de risc unei persoane și a stabili prima de asigurare în consecință.
© ECPC 2024
IA și prelucrarea categoriilor speciale de date cu caracter personal
CJUE, 7 decembrie 2023, cauza C-634/21 (Schufa): acesta poate fi, de asemenea, un simplu act pregătitor!
• "Efecte juridice" = un impact asupra drepturilor juridice sau a statutului juridic al persoanei (de exemplu, dreptul
său de a vota)
• "Afectare semnificativă" = o influență asupra circumstanțelor personale, a comportamentului sau a alegerilor
(de exemplu, refuzul unei cereri de credit online)
• Permis când:
• Necesar pentru încheierea sau executarea unui contract între persoana vizată și un operator de date;
• autorizate de dreptul Uniunii sau de dreptul intern la care se supune operatorul și care stabilește, de
asemenea,
măsuri adecvate pentru a proteja drepturile și libertățile și interesele legitime ale persoanei vizate;
• Pe baza consimțământului explicit al persoanei vizate.
© ECPC 2024
IA și prelucrarea categoriilor speciale de date cu caracter personal
și sunt în vigoare măsuri adecvate pentru a proteja drepturile, libertățile și interesele legitime ale
persoanei vizate.
© ECPC 2024
IA și prelucrarea categoriilor speciale de date cu caracter personal
© ECPC 2024
IA și prelucrarea categoriilor speciale de date cu caracter personal
Luarea automată a deciziilor cu categorii speciale de date conform GDPR
Ar trebui evitate deciziile automatizate cu privire la datele copiilor, deoarece aceștia reprezintă un grup mai
vulnerabil al societății (considerentul 71 din RGPD)
• WP29 recomandă ca operatorii de date să nu se bazeze pe excepții de la interzicerea procesului
decizional automatizat pentru a justifica acest lucru. Mai mult, WP29 recomandă să nu se
efectueze profilarea copiilor în scopuri de marketing.
- Exemplu de carcasă TikTok
• Cu toate acestea, în cazul în care este necesar să se efectueze un proces decizional automat în legătură cu
(de exemplu, pentru a le proteja bunăstarea), trebuie luate în considerare următoarele principii:
• Trebuie să existe garanții adecvate pentru copii pentru a-și proteja drepturile, libertățile și
interesele legitime;
• Ar trebui respectate codurile de conduită care încorporează astfel de garanții și descriu modul în
care se poate obține consimțământul titularilor răspunderii părintești asupra copiilor.
© ECPC 2024
IA și prelucrarea categoriilor speciale de date cu caracter personal
Luarea automată a deciziilor cu privire la categorii speciale de date în conformitate cu
Legea privind IA
Articolul 14 din Legea privind IA:
Sistemele de IA cu grad ridicat de risc sunt proiectate și dezvoltate astfel încât, inclusiv cu instrumente adecvate
de interfață om-mașină, încât să poată fi supravegheate în mod eficace de către persoanele fizice în perioada
în care sunt utilizate.
Supravegherea umană urmărește să prevină sau să reducă la minimum riscurile pentru sănătate, siguranță
sau drepturile fundamentale care pot apărea atunci când un sistem de IA cu grad ridicat de risc este utilizat
în conformitate cu scopul preconizat sau în condiții de utilizare abuzivă previzibilă în mod rezonabil, în
special în cazul în care astfel de riscuri persistă în pofida aplicării altor cerințe prevăzute în prezenta
secțiune.
© ECPC 2024
IA și prelucrarea categoriilor speciale de date cu caracter personal
Exemplu:
• O agenție guvernamentală folosește un sistem AI pentru a evalua eligibilitatea pentru beneficii
sociale pe baza venitului, a statutului profesional și a situației familiale.
• În conformitate cu GDPR, persoanele fizice au dreptul de a nu fi supuse exclusiv prelucrării automate
pentru eligibilitatea pentru prestații sociale (art. 22). Aceasta înseamnă că pot solicita o reexaminare a
unei decizii automate de către un factor de decizie uman.
• În conformitate cu Legea AI, acest sistem AI este clasificat ca un sistem cu risc ridicat (deoarece are un
impact semnificativ asupra mijloacelor de trai ale indivizilor). Acest lucru necesită ca agenția
guvernamentală să implementeze supravegherea umană pe tot parcursul dezvoltării, implementării și
utilizării sistemului AI.
© ECPC 2024
Drepturile individuale în ciclul de viață al IA
• Provocări:
- Anonimizarea completă a datelor, păstrându-le utilitatea poate fi dificilă
- Agregarea datelor poate reidentifica neintenționat persoane
• Exemplu: Google folosește differential privacy în sistemele sale pentru a permite analiza statistică
fără a expune puncte de date individuale
© ECPC 2024
Drepturile individuale în ciclul de viață al IA
• Provocări:
- Consimțământul informat este o provocare în sistemele complexe în care utilizările din aval ale datelor pot să nu
fie clare
- Gestionarea continuă a consimțământului poate consuma resurse
• Exemplu: aplicații precum Apple Health oferă controale de consimțământ granulare, permițând
utilizatorilor să specifice ce date pot fi utilizate și în ce scopuri.
© ECPC 2024
Drepturile individuale în ciclul de viață al IA
• Implementare: construiți modele interpretabile sau utilizați tehnici de explicabilitate pentru a face deciziile
ușor de înțeles
- Oferiți explicații ușor de utilizat ale rezultatelor AI
• Provocări:
- Echilibrarea performanței modelului cu interpretabilitatea, în special în modelele complexe de învățare
profundă
- Obligațiile legale, cum ar fi "dreptul la explicație" al GDPR, pot fi greu de îndeplinit în modele opace
• Exemplu: Un sistem AI utilizat în scorul de credit oferă motive detaliate pentru decizii, cum ar fi "venituri
mici" sau "istoric de credit limitat"
© ECPC 2024
Drepturile individuale în ciclul de viață al IA
• Provocări:
- Datele istorice sau agregate nu au adesea identificatori clari, ceea ce face dificilă rectificarea
- Reantrenarea modelelor cu date corectate poate consuma resurse
• Exemplu: Un model predictiv de sănătate antrenat pe înregistrări învechite ale pacienților duce
la rezultate inexacte. Corectarea înregistrărilor și recalificarea sunt necesare.
© ECPC 2024
Drepturile individuale în ciclul de viață al IA
• Implementare: dezvoltarea mecanismelor de eliminare a punctelor sau modelelor de date specifice din
modele
- Menținerea pistelor de audit pentru ștergerea datelor
• Provocări:
- Modelele mari pot codifica neintenționat date sensibile, ceea ce face dificilă conformitatea
deplină
- Eliminarea datelor dintr-un model fără reinstruire poate fi complexă din punct de vedere tehnic
• Exemplu: OpenAI s-a confruntat cu provocări cu modelele sale GPT în care datele sensibile furnizate
de utilizatori ar putea apărea în rezultate. Rezolvarea acestui lucru necesită instruirea, igienizarea
datelor și politici mai stricte de guvernanță a datelor.
© ECPC 2024
Drepturile individuale în ciclul de viață al IA
© ECPC 2024
Drepturile individuale în ciclul de viață al IA
• Provocări:
- Asigurarea faptului că datele sunt transferate într-un format interoperabil și sigur
- Echilibrarea portabilității cu preocupările legate de proprietate
© ECPC 2024
Drepturile individuale în ciclul de viață al IA
• Provocări:
- Modelele pot generaliza din date incorecte, ceea ce face ca eliminarea punctelor specifice să fie insuficientă
- Reinstruirea modelelor poate fi costisitoare și consumatoare de timp
• Exemplu: Un client solicită eliminarea datelor financiare inexacte dintr-un sistem de recomandare.
Reantrenarea modelului, menținând în același timp acuratețea acestuia, este complexă.
© ECPC 2024
Drepturile individuale în ciclul de viață al IA
2. În ceea ce privește rezultatele sistemului de IA
Dreptul la un tratament echitabil
• Implementare: efectuarea de audituri de părtinire și teste de corectitudine în
timpul fazelor de instruire și validare
- Utilizați seturi de date reprezentative pentru a reduce rezultatele părtinitoare.
• Provocări:
- Prejudecățile sistematice în datele de antrenament pot perpetua inegalitățile
- Operaționalizarea corectitudinii este subiectivă și specifică contextului
© ECPC 2024
Drepturile individuale în ciclul de viață al IA
© ECPC 2024
Exercițiu
Spitalul „Nemesis” dorește să își previzioneze mai bine achizițiile de
echipamente, consumabile și medicamente. Pentru acest lucru, dorește să
cumpere un software de inteligență artificială predictivă, SpitaliaBong, care
trebuie train-uit cu toate datele tuturor pacienților care au trecut vreodată prin
Spitalul „Nemesis”: fișe de intrare, fișe de externalizare, diagnostice,
tratamente, fișe pacient etc.
Identificați riscuri și măsuri de atenuare a riscurilor
Sisteme de recunoaștere facială
© ECPC 2024
Sisteme de recunoaștere facială
Dreptul la confidențialitate
• Monitorizați dacă nu sunt utilizate date cu caracter personal în antrenamentul sistemului AI
- Provocare: anonimizarea completă a datelor, păstrându-le utilitatea poate fi dificilă pentru antrenament
Consimțământ:
• Încorporați consimțământul înainte de colectarea datelor
- Provocare: asigurarea consimțământului în spațiile publice este aproape imposibilă
© ECPC 2024
Sisteme de recunoaștere facială
Dreptul la explicație
• Activați transparența pe parcursul întregului ciclu de viață al IA
- Provocare: "Cutia neagră" – problema IA
Supravegherea umană:
• Asigurați-vă că deciziile cu miză mare sunt monitorizate de un intermediar
uman
- Provocare: determinarea responsabilității finale
© ECPC 2024
Sisteme de recunoaștere facială
© ECPC 2024
Sisteme de inteligență artificială generativă
Dreptul la confidențialitate
• Instruiți-vă pe date din surse responsabile cu protecții solide ale confidențialității
- Provocare: eliminarea materialului personal încorporat în datele de antrenament poate
fi o provocare din punct de vedere tehnic
Dreptul la explicație
• Activați transparența pe parcursul întregului ciclu de viață al IA
- Provocare: "Cutia neagră" – problema IA
© ECPC 2024
Dreptul de a obiecta
© ECPC 2024
Ce sunt datele pseudonimizate?
© ECPC 2024
Noua definiție a pseudonimizării în conformitate cu GDPR
Feminin
Alexis Smith Vârsta mijlocie
47
Valoarea
Identitate informației
© ECPC 2024
© ECPC 2024
Beneficiile pseudonimizării
© ECPC 2024
Guvernanța cazurilor de utilizare
Tip de date Date ca atare Varianta 1: ușor minimizată Varianta 2: minimizată și mai mult Varianta 3: pseudonimizat
• Fotografie •/ •/ •/
• Nume • Ioana Popescu • Ioana Popescu • ID_RE3Kjj33 • ID_345aZJ98
• Data naşterii • 2 iunie 1992 •/ •/ • ID vârstă 125687
• Sex • Feminin • Feminin • Feminin • ID de gen ABC13
• Adresa (strada) • Sapienței 4 •/ •/ •/
• Adresa (oraș) • Oradea • Oradea • Oradea • Jud Bihor
concluzionează NU.
2Cumpărătorii presupun NU; comentariul informat concluzionează
© Anonos DA. 46 46
2021
Provocări de anonimizare
• Eliminarea identificatorilor direcți (nume, prenume, număr național de
identificare) NU este, în majoritatea circumstanțelor, suficientă
• Conectarea diferitelor puncte de date poate identifica persoana vizată
• Situația clienților:
• Școală în mediul rural, cu doar câteva clase.
• Copiii au trebuit să facă teste online pentru a determina nivelul de alfabetizare digitală al școlii.
• Rezultatele:
Grup vârstă Rezultate băieți Rezultate fete
One person: Ana B.
8-10 …% …%
10-12 …% …%
12-14 …% …%
14-17 …% …%
Estimating the success of re-identifications in incomplete datasets
using generative models
Source: [Link]
Privacy Enhancing
Technologies
Criptare homomorfă
• Definiție: Criptare care permite calcule pe texte cifrate fără a le decripta mai întâi, asigurând că datele rămân confidențiale
în timpul operațiunilor.
• Două tipuri:
• Criptare homomorfă parțială (PHE): Acceptă doar un set limitat de operațiuni.
• Criptare complet homomorfă (FHE): Acceptă atât adunarea, cât și înmulțirea pe texte cifrate.
• Confidențialitatea datelor: Oferă un nivel ridicat de securitate a datelor, chiar și în timpul procesării sau analizei,
asigurând confidențialitatea datelor sensibile.
• Cloud Computing: Permite stocarea și procesarea datelor criptate în cloud fără a dezvălui datele brute furnizorilor de
cloud.
• Cercetare medicală: Permite cercetătorilor să efectueze calcule pe date medicale criptate, asigurând confidențialitatea
pacientului.
• Finanțe: Permite tranzacții și analize financiare criptate fără a expune date financiare sensibile.
• Complexitate: Deși puternică, este intensivă din punct de vedere computațional și poate fi mai lentă decât operațiunile
necriptate.
• Potențial: Cu progresele în eficiența computațională, are potențialul de a revoluționa domeniile care necesită
confidențialitatea datelor.
• Barieră în calea calculului cuantic: Deoarece computerele cuantice amenință multe scheme de criptare, criptarea
homomorfă rămâne rezistentă.
Secure Multiparty Computation (SMC)
• Definiție: Un protocol criptografic care permite mai multor părți să calculeze împreună o funcție peste intrările lor, păstrând
confidențialitatea fiecărei intrări.
• Colaborare fără compromisuri: Părțile pot colabora fără a-și dezvălui datele private altora, chiar dacă unele părți sunt
rău intenționate.
• Two-Party (2PC) și Multi-Party (MPC): În timp ce 2PC implică două entități, MPC extinde acest lucru la mai multe părți,
toate funcțiile de calcul pe datele lor private.
• Aplicații în comerțul electronic: SMPC poate fi folosit pentru compararea prețurilor fără a dezvălui prețurile reale
concurenților.
• Cercetare medicală: Permite cercetătorilor din instituții să analizeze seturi de date combinate fără a partaja datele
individuale ale pacienților.
• Sectorul financiar: Băncile pot calcula indicatorii de risc în mod colectiv, fără a dezvălui date individuale ale clienților sau
algoritmi proprietari.
• Sisteme de vot: SMPC poate facilita votul electronic securizat, asigurând confidențialitatea alegătorilor și acuratețea
numărării.
• Piețe de date: Permite monetizarea datelor în care companiile pot vinde informații bazate pe date fără a expune datele
brute.
• Provocări: SMPC este intensiv din punct de vedere computațional, iar optimizarea eficienței fără a compromite securitatea
este o provocare continuă.
• Evoluție: Odată cu progresele în criptografie și hardware, SMPC devine mai practic și ar putea redefini colaborările de date
în diverse sectoare.
Federated Learning
• Definiție: O abordare de învățare automată în care modelele sunt antrenate la sursa de date, de obicei la dispozitivul de margine, fără a partaja
date brute la nivel central.
• Antrenament descentralizat: Antrenamentul modelului are loc pe dispozitive locale (de exemplu, smartphone-uri) folosind date locale.
• Agregarea modelului global: actualizările locale sunt trimise către un server central, unde sunt agregate pentru a îmbunătăți un model
global, care este apoi trimis înapoi la dispozitive.
• Confidențialitate îmbunătățită a datelor: Datele rămân pe dispozitivul utilizatorului, reducând riscul de încălcare a datelor și asigurând
confidențialitatea utilizatorului.
• Transmisie redusă de date: Sunt trimise numai actualizările modelului, nu datele brute, ceea ce poate duce la reducerea consumului de
lățime de bandă.
• Personalizare în timp real: dispozitivele pot utiliza instantaneu actualizările modelului local pentru experiențe îmbunătățite ale utilizatorilor,
fără a aștepta actualizări centralizate.
• Aplicații: Folosit în domenii precum textul predictiv pe smartphone-uri, predicțiile de sănătate de pe dispozitivele portabile și multe altele.
• Provocări: Necesită algoritmi sofisticați pentru a gestiona actualizările asincrone și pentru a asigura convergența modelului.
• Scalabilitate: Pe măsură ce mai multe dispozitive participă, procesul de agregare poate deveni complex, necesitând tehnici optimizate.
• Viitorul: Pe măsură ce dispozitivele edge continuă să crească în putere de calcul, învățarea federativă va juca un rol și mai mare în dezvoltarea
AI și a învățării automate.
Medii de execuție de încredere (TEE)
• Definiție: O zonă securizată a unui procesor principal care garantează că codul și datele încărcate în interiorul acestuia sunt
protejate împotriva interferențelor externe sau a manipulării.
• Protecția datelor: Asigură izolarea datelor sensibile de restul dispozitivului/sistemului, protejându-le de potențialele
amenințări.
• Integritate și confidențialitate: Garantează că datele și operațiunile efectuate în interiorul TEE nu sunt modificate sau
dezvăluite entităților neautorizate.
• Utilizare în dispozitive mobile: Oferă o enclavă securizată pentru operațiuni precum date de amprentă sau recunoaștere
facială, informații de plată mobilă și multe altele.
• Cloud Computing: Permite procesarea securizată a datelor în medii cloud, asigurând confidențialitatea și integritatea
datelor utilizatorilor.
• Securitate bazată pe hardware: În timp ce soluțiile de securitate software pot fi vulnerabile, TEE-urile, fiind bazate pe
hardware, oferă un nivel suplimentar de apărare.
• Autentificare de la distanță: Cu TEE, părțile de la distanță pot autentifica dispozitivul, asigurându-se că rulează software
autentic.
• Provocări: Atacuri fizice, potențiale vulnerabilități în implementare și asigurarea integrității software-ului TEE în sine.
• Integrare cu alte tehnologii: Poate fi combinat cu alte tehnici criptografice pentru o securitate sporită, cum ar fi Secure
Multiparty Computation sau Homomorphic Encryption.
• Potențial viitor: Pe măsură ce dispozitivele IoT proliferează și nevoia de securitate edge crește, TEE-urile vor juca un rol
esențial în asigurarea unei execuții de încredere a operațiunilor.
Differential Privacy
• Definiție: O tehnică matematică pentru a maximiza acuratețea interogărilor din bazele de date statistice, minimizând în
același timp șansele de identificare a intrărilor sale.
• Adăugare zgomot: Adaugă zgomot statistic controlat la datele brute, asigurându-se că punctele de date individuale sunt
ascunse, dar tendințele generale rămân.
• Parametru ε (Epsilon): Definește pierderea confidențialității în date. Valorile mai mici indică o confidențialitate mai mare,
dar pot reduce acuratețea datelor.
• Aplicații în cercetare: Permite studiul seturilor de date sensibile (cum ar fi dosarele medicale) prin furnizarea de informații
agregate fără a risca expunerea individuală a datelor.
• Publicarea datelor: Permite partajarea rezumatelor datelor sau a rezultatelor fără a dezvălui detalii despre persoanele din
setul de date.
• Act de echilibru: Necesită o calibrare atentă între utilitatea datelor și confidențialitate. Mai mult zgomot crește
confidențialitatea, dar poate reduce utilitatea datelor.
• Locală vs. central: "Local" aplică zgomot punctelor de date individuale, în timp ce "Central" aplică zgomot după agregarea
datelor.
• Provocări: Determinarea valorilor ε adecvate, menținerea utilității datelor și asigurarea alinierii implementărilor din lumea
reală cu modelele teoretice.
• Viitorul: Pe măsură ce partajarea datelor devine omniprezentă și preocupările legate de confidențialitate cresc, differential
privacy va fi un instrument cheie pentru a facilita în mod responsabil informațiile bazate pe date.
Întrebări?
Mulțumesc!
contact@[Link]
+[Link]
[Link]
LinkedIn: tudorgalos ([Link]
Facebook: tudorgalos ([Link]
Facebook: tudorgconsulting ([Link]