0% au considerat acest document util (0 voturi)
14 vizualizări62 pagini

Modul 04 Deep Learning

Modulul 4 al cursului AI Essentials se concentrează pe învățarea profundă, o clasă de algoritmi de învățare automată care utilizează rețele neuronale pentru a extrage caracteristici din date și a face predicții. Documentul detaliază conceptele fundamentale ale învățării profunde, inclusiv structura rețelelor neuronale, metodele de învățare supravegheată și nesupravegheată, precum și aplicațiile acestora în recunoașterea imaginilor și procesarea vocală. De asemenea, se discută despre importanța datelor mari și despre cum rețelele neuronale pot învăța prin ajustarea ponderilor și a pragurilor în funcție de datele de intrare.

Încărcat de

Andra Mihalache
Drepturi de autor
© All Rights Reserved
Respectăm cu strictețe drepturile privind conținutul. Dacă suspectați că acesta este conținutul dumneavoastră, reclamați-l aici.
Formate disponibile
Descărcați ca PDF, TXT sau citiți online pe Scribd
0% au considerat acest document util (0 voturi)
14 vizualizări62 pagini

Modul 04 Deep Learning

Modulul 4 al cursului AI Essentials se concentrează pe învățarea profundă, o clasă de algoritmi de învățare automată care utilizează rețele neuronale pentru a extrage caracteristici din date și a face predicții. Documentul detaliază conceptele fundamentale ale învățării profunde, inclusiv structura rețelelor neuronale, metodele de învățare supravegheată și nesupravegheată, precum și aplicațiile acestora în recunoașterea imaginilor și procesarea vocală. De asemenea, se discută despre importanța datelor mari și despre cum rețelele neuronale pot învăța prin ajustarea ponderilor și a pragurilor în funcție de datele de intrare.

Încărcat de

Andra Mihalache
Drepturi de autor
© All Rights Reserved
Respectăm cu strictețe drepturile privind conținutul. Dacă suspectați că acesta este conținutul dumneavoastră, reclamați-l aici.
Formate disponibile
Descărcați ca PDF, TXT sau citiți online pe Scribd

AI Essentials

Modulul 4: Deep Learning


Agenda
• Învățare profundă
• Definiție
• Detalii tehnice
• Aplicaţii
• Deep Qualia: Învățarea profundă și creierul
• Concluzie
Definiție conceptuală:
Învățarea profundă este un program de calculator
care poate identifica ce este ceva
Definiție tehnică:
Învățarea profundă este o clasă de algoritmi de
învățare automată sub forma unei rețele
neuronale care utilizează o cascadă de straturi
(niveluri) de unități de procesare pentru a extrage
caracteristici din date și a face presupuneri
predictive despre date noi

Source: Extending Jann LeCun, [Link]


on-deep-learning
3
Teoria învățării profunde
• Sistemul este "prost" (adică mecanic)
• "Învață" cu big data (o mulțime de exemple de intrare) și presupuneri de
încercare și eroare pentru a ajusta ponderile și pragurile pentru a stabili
caracteristicile cheie
• Creează un sistem predictiv pentru a identifica noi exemple
• Același argument AI: datele suficient de mari sunt ceea ce fac diferența
(algoritmii "simpli" rulează pe seturi mari de date)

Intrare: Big Data (de Metodă: Presupuneri de încercare Rezultat: sistemul identifică
exemplu, multe exemple) și eroare pentru a ajusta ponderile exemple noi
nodurilor
Exemplu: este o mașină?
• Crearea unui sistem de recunoaștere a imaginilor care determină ce
caracteristici sunt relevante (la niveluri din ce în ce mai ridicate de
abstractizare) și identifică corect noi exemple
Context informatic mai larg
• În cadrul disciplinei Informatică, în domeniul
Inteligenței Artificiale, Deep Learning este o clasă de
algoritmi de Machine Learning, care sunt sub forma
unor rețele neuronale

Source: Machine Learning Guide, 9. Deep Learning


6
Mecanica statistică
Deep Learning este inspirat de fizică
• Funcția sigmoidă sugerată ca model pentru neuroni,
conform comportamentului mecanic statistic (Jack
Cowan)
• Soluții staționare pentru modele dinamice (ponderile
asimetrice creează un oscilator pentru a modela
semnalizarea neuronilor)
• Hopfield Neural Network: sistem de memorie
adresabil conținutului cu noduri de prag binare,
converge la un minim local (John Hopfield)
• Poate folosi un model Ising (de feromagnetism) pentru
neuroni
• Mașină Boltzmann restricționată (Geoffrey Hinton)
• A studiat fizica teoretică, teoria câmpului materiei
condensate; Concepte de mecanică statistică:
renormalizare, distribuție Boltzmann, energii libere,
eșantionare Gibbs
Ce este o rețea neuronală?
• Motivație: crearea unei rețele neuronale artificiale pentru a rezolva
problemele în același mod în care ar face-o un creier uman
Ce este o rețea neuronală?
• Structura: intrare-procesare-ieșire
• Imită structura de declanșare a semnalului neuronal a creierului cu unități de procesare
computațională
Ce este o rețea neuronală artificială?
• Colecție de unități conectate numite neuroni
artificiali (analogi cu axonii dintr-un creier biologic)
• Organizat în straturi de cascade de semnalizare
• Fiecare neuron transmite un semnal altui neuron
• Neuronii pot avea stare
• Reprezentată de un număr între 0 și 1
• Parametri variabili
• Neuronii pot avea o pondere care variază pe măsură ce
învățarea avansează, ceea ce poate crește sau scădea
puterea semnalului pe care îl trimite în aval
• Neuronii pot avea un prag (bias) astfel încât numai dacă
semnalul agregat este sub (sau peste) acel nivel este
semnalul trimis în aval
De ce se numește Deep Learning?
• Deep: straturi ascunse (niveluri în cascadă) de procesare
• Rețele "adânci" (5+ straturi) versus "superficiale" (1-2 straturi)
• Învățare: Algoritmii "învață" din date prin modelarea caracteristicilor
și actualizarea ponderilor de probabilitate atribuite nodurilor de
caracteristici în testarea relevanței caracteristicilor specifice în
determinarea tipului general de element

Deep: Straturi de procesare Învățare: Actualizarea ponderilor


ascunse de probabilitate în ceea ce privește
importanța caracteristicilor
Învățare supravegheată și nesupravegheată
• Supravegheat (clasificarea
datelor etichetate)

• Nesupravegheat (găsirea
modelelor în date neetichetate)
Succes timpuriu în învățarea supravegheată (2011)
• YouTube: date clasificate de utilizatori
perfecte pentru învățarea supravegheată
Tipuri principale de rețele neuronale de învățare profundă
• Convolutional Neural Nets
• Recunoașterea imaginilor
• Convoluție: rulează la niveluri mai
ridicate de abstractizare în seturile
de caracteristici
• Recurrent Neural Nets
• Recunoaștere vocală, text, audio
• Recurent: iterează peste intrări
secvențiale cu o funcție de
memorie
• LSTM (Long Short-Term Memory) își
amintește secvențele și evită
dispariția gradientului
Recunoașterea imaginilor și viziunea computerizată
History

Marv Minsky, 1966 Jeff Hawkins, 2004, Memoria Quoc Le, 2011, Google Brain
"Proiect de vară" temporală ierarhică (HTM) recunoașterea pisicii
De ce avem nevoie de Deep Learning?
• O metodă contemporană de știință a datelor
pentru a ține pasul cu creșterea datelor, algoritmii
de învățare mai vechi nu mai funcționează

Source: [Link]
16
3 principii tehnice cheie ale învățării profunde
Funcția sigmoidă Structura perceptronului Loss Function

Aproximează valorile în curba S Unitate de procesare de Reduce


sigmoidală
-Valori binare (Y/N, 0/1) bază dimensionalitatea
Ce
-Valori de probabilitate (0 până (intrare-procesare-ieșire) combinatorică
la 1) Pârghii: ponderi și polarizare
-Valori Tanh 9(-1) la 1)
Formulare neliniară ca Sistemul "prost" învață prin Funcția Loss
De ce problemă de regresie ajustarea parametrilor și optimizează eficiența
logistică înseamnă o verificarea rezultatelor soluției
manipulare matematică
mai mare
Regresie liniară
Prețul casei vs. dimensiunea (metri pătrați)

Prețul caselor

y=mx+b Dimensiune (metri pătrați)


Regresie logistică
Regresie logistică
• Formulare matematică de ordin
superior
Sigmoid Function
• Funcția sigmoidă
• În formă de S și delimitate
• Mapează întreaga axă reală într-un
interval finit (0-1)
• Neliniar
• Se poate potrivi probabilității
• Poate aplica tehnici de optimizare
• Predicțiile de clasificare Deep
Learning sunt sub forma unei valori
de probabilitate
Unit Step Function
Funcția sigmoidă: Taleb
• Teză: dacă poate cartografia un
fenomen pe o curbă sigmoidă
("convexifică"), atunci poate controla
riscul acestuia
• Antifragilitate = convexitate = gestionabil
• Fragilitate = concavitate
• Neliniaritatea doză-răspuns în
medicină și, prin urmare, a sugerat
optimalitatea tratamentului

Source: [Link]
21
Regresie

Linear Regression Logistic Regression (Sigmoid function)


(0-1) or Tanh ((-1)-1)

 Regresie liniară • Regresie logistică


 Prezice setul continuu de • Prezice rezultatele binare:
valori (prețurile • Perceptron (0 sau 1)
locuințelor) • Anticipați probabilitățile:
• Neuronul sigmoid (valori 0-1)
• Neuronul tangent hiperbolic
Tanh (valori (-1)-1)
Arhitectura de învățare profundă
Unitate de procesare, Perceptron, Neuron
• Unitate (unitate de procesare, unitate de
regresie logistică), perceptron ("perceptron
multistrat"), neuron artificial
1. Input 2. Straturi ascunse 3. Output

X X X X X
X X X X X
X X X X X
X X X X X
X X X X X
X X X X X
X X X X X
Exemplu: Recunoașterea imaginilor
1. Obțineți setul de date de antrenament

2. Digitizați pixeli (convertiți imagini în numere)


• Împărțiți imaginea în grile de 28x28, atribuiți o valoare (0-
255) fiecărui pătrat în funcție de luminozitate

3. Asignare în vector (matrice; listă de numere)


• 28x28 = 784 elemente pe imagine)
Deep Learning Architecture
4. Încărcați foaia de calcul a vectorilor în sistemul de învățare profundă
• Fiecare rând de foaie de calcul (matrice de 784 de elemente) este o intrare

1. Input 2. Straturi ascunse 3. Output


Vector de date

Matrice de 784 de elemente


X X X X X
X X X X X
X X X X X
X X X X X
X X X X X
X X X X X
X X X X X
Ce se întâmplă în straturile ascunse?
• Primul strat învață caracteristici primitive (linie, margine, cea mai mică unitate de
sunet) prin găsirea combinațiilor de date vectoriale de intrare care apar mai
frecvent decât întâmplător
• Regresie logistică efectuată și codificată la fiecare nod de procesare (Da/Nn (0,1)), acest
exemplu are această caracteristică?
• Alimentează aceste caracteristici de bază în stratul următor, care se antrenează să
recunoască caracteristici puțin mai complicate (colț, combinație de sunete de
vorbire)
• Alimentează entitățile în straturi noi până când recunoaște obiectele complete
Recunoașterea imaginilor
Abstracțiuni superioare ale recunoașterii caracteristicilor

Margini Părți din obiecte Modele de obiecte


(combinații de margini)
Recunoaștere vocală, text, audio

Recunoaștere secvență la secvență + LSTM

Source: Andrew Ng
29
Exemplu: Recunoaștere facială NVIDIA
• Primul strat ascuns extrage toate caracteristicile posibile de nivel scăzut
din date (linii, margini, contururi); straturile următoare abstractizează în
caracteristici mai complexe de posibilă relevanță

Source: Nvidia
31
Deep Learning
Arhitectura de învățare profundă

1. Input 2. Straturi ascunse 3. Output


(0,1)

Source: Michael A. Nielsen, Neural Networks and Deep Learning


33
Structura unui nod: grafic de calcul
Valoare de intrare
3

Nod
(operațiune) Adunare
Valoare de ieșire ??

Valoare de intrare
4

Arhitectură Exemplul 1

Înmulțire
??

Exemplul 2
Unitate de rețea neuronală: perceptron, neuron, nod
• Funcția sigmoidă înseamnă că toate intrările și
ieșirile din sistem sunt (0,1)

(0,1)
Operație

(0,1) (0,1)

(0,1)
Other parameters: weights and bias
• Ponderea și pragul sunt parametri variabili care sunt
ajustați pe măsură ce sistemul iterează și învață
Valorile au Nodul operațional Valorile au Nodul operațional
ponderi are prag ponderi are prag
B=3 =0 B=3
W1 = (-2) W1 = (-2)

Output
=0
=0
W2 = (-2) W2 = (-2)

Input (0,1) X1, X2 W1*X1 + W2*X2 + Bias = n Output (0,1)


0,0 (-2)*0 + (-2)*0 + 3 = 3 1
Ponderea și Pragul sunt
“random” asignate la început: 0,1 (-2)*0 + (-2)*1 + 3 = 1 1
(aici (-2) and 3) 1,0 (-2)*1 + (-2)*0 + 3 = 1 1
Mimics NAND gate 1,1 (-2)*1 + (-2)*1 + 3 = (-1) 0

36
Real: aceeași structură, mai complicată

37
Rețea neuronală: extinderea masivă a nodurilor
Aceeași structură

39
Cum învață de fapt rețeaua neuronală?
 Sistem structural bazat pe straturi în cascadă de neuroni
cu parametri variabili: pondere și prag
• Variați ponderile și
pragurile pentru a
vedea dacă se
obține un rezultat
mai bun
• Repetați până când
rețeaua clasifică
corect datele
Backpropagation
• Problemă: Ineficient pentru a testa explozia combinatorică
a tuturor variațiilor posibile ale parametrilor

• Soluție: Backpropagation (1986 Nature paper)


• Backpropagation este o metodă de optimizare utilizată
pentru a calcula contribuția de eroare a fiecărui neuron
după procesarea unui lot de date

Source: [Link]
41
Propagarea inversă a erorii
• Calculați eroarea totală
• Calculați contribuția la eroare la fiecare pas înapoi
• Varietate de metode de calcul al erorilor: Eroare
pătratică medie (MSE), suma erorilor pătratice de
predicție (SSE), Entropie încrucișată (Softmax), Softplus
Backpropagation

• Inima învățării profunde


• Retropropagare: algoritmul calculează dinamic gradientul
(derivata) funcției de pierdere în raport cu ponderile dintr-
o rețea pentru a găsi minimul și a optimiza funcția de acolo
• Algoritmii optimizează performanța rețelei prin ajustarea ponderii,
de exemplu; în algoritmul de coborâre a gradientului
• Eroarea și gradientul sunt calculate pentru fiecare nod
• Erori intermediare transmise invers prin rețea (backpropagation)
• Obiectiv: optimizarea ponderilor astfel încât rețeaua
neuronală să poată învăța cum să mapeze corect intrările
arbitrare la ieșiri
Coborâre gradient
• Gradient: derivată pentru a găsi minimul unei funcții
• Coborârea gradientului: algoritm de optimizare pentru a găsi
cele mai mari erori (minime) cel mai rapid
• Eroare = MSE, pierdere logaritmică, entropie încrucișată; de exemplu;
predicții cel mai puțin corecte pentru a identifica corect datele
Funcția de pierdere
• Tehnica de optimizare
• Instrument matematic utilizat în statistică, finanțe, teoria deciziilor, modelare biologică,
computație neuroștiințifică Laplace

• Stare ca ecuație neliniară pentru optimizare


• Minimizați pierderile sau costurile
• Maximizați recompensa, utilitatea, profitul sau fitness
• Funcția de pierdere leagă instanța unui eveniment de costul acestuia
• Accident (eveniment) înseamnă daune medii de 1.000 USD (cost)
• 5 cm înălțime (eveniment) conferă un avantaj de 5% fitness (recompensă)
• Învățare profundă: bucla de feedback a sistemului
• Utilizați costul penalizării pentru clasificări incorecte pentru sistemul de antrenament
• CNN (clasificare): entropie încrucișată; RNN (regresie): MSE

45
Overfitting
• Regularizare
• Introduceți informații suplimentare, cum ar fi un
parametru lambda în funcția cost (pentru a actualiza
parametrii theta în algoritmul de coborâre a
gradientului)
• Abandon: previne adaptările complexe ale datelor de
antrenament prin renunțarea la unități (atât ascunse,
cât și vizibile)
• Testarea seturilor de date noi

46
Rețea convoluțională: Îmbunătățirea imaginii
• Google DeepDream: Rețeaua neuronală convoluțională
îmbunătățește modelele (potențiale) din imagini;
supraprocesarea deliberată a imaginilor

Source: Georges Seurat, Un dimanche après-midi à l'Île de la Grande Jatte, 1884-1886;


[Link] Google DeepDream uses algorithmic pareidolia (seeing an image
when none is present) to create a dream-like hallucinogenic appearance 47
Aplicații: De la pisici la cancer la cogniție
Recunoașterea imaginii tumorale
• Diagnoză asistată
de calculator cu
arhitectură de
învățare profundă
• Leziuni ale
țesutului mamar
în imagini și
noduli pulmonari
în scanări CT

Source: [Link]
49
Recunoașterea imaginii: melanom

Source: [Link]
50
Recunoaștere imagine : utilizarea contrast
Măr sau portocală? Risc de melanom sau piele sănătoasă?

Gradul de contrast în culorile fotografiilor?

Câți pixeli portocalii?

51
Învățare profundă și genomică
• Clase mari de corelații ipotetice, dar necunoscute
• Legătura genotip-fenotip a bolii necunoscută
• Modele de identificare computerizată în datele genomice
• CNN: simetrii ale genomului; RNN: analiza textuală

Source: [Link]
52
Învățarea profundă și creierul

54
Mașini Deep Qualia. General purpose AI
Inspirație reciprocă a cercetării neurologice și informatice

• Rețelele neuronale de învățare profundă sunt inspirate de


structura cortexului cerebral
• Unitatea de procesare, perceptronul, neuronul artificial este
reprezentarea matematică a unui neuron biologic
• În cortexul cerebral, pot exista mai multe straturi de perceptroni
interconectați
Mașină Deep Qualia
• Cortexul vizual este ierarhic cu straturi intermediare
• Calea ventrală (recunoaștere) din cortexul vizual are mai
multe etape: Retina - LGN - V1 - V2 - V4 - PIT – AIT
• Proiecte de simulare a creierului uman
• Proiectul Swiss Blue Brain, Proiectul European Human Brain
Viitorul nostru
• Suntem condamnați?

57
Colaborarea om-mașină
• Membrii echipei excelează în diferite
lucruri
• Agenți cu diverse abilități în societate

58
Tipuri de AI
Întrebări?
Mulțumesc!

contact@[Link]
+[Link]
[Link]
LinkedIn: tudorgalos ([Link]
Facebook: tudorgalos ([Link]
Facebook: tudorgconsulting ([Link]

S-ar putea să vă placă și