Rapporto Su Machine Learning Con Python
Rapporto Su Machine Learning Con Python
SU
APPRENDIMENTO AUTOMATICO CON PYTHON
Sessione 2020-2021
Io
CERTIFICATO
Inviato a
[Link] Anima Sharma
II
RICONOSCIMENTO
L'opportunità di formazione che ho avuto con [ED Apply Pvt. Ltd.] è stata una grande occasione
Tenendo presente ciò che è stato detto in precedenza, approfitto di questa opportunità per esprimere il mio più profondo
ringraziamento e un ringraziamento speciale al CEO di [ED Apply Pvt. Ltd.] che, nonostante
di essere straordinariamente occupato con i suoi doveri, ha preso tempo per ascoltare, guidare
Percepisco questa opportunità come un grande traguardo nello sviluppo della mia carriera.
mi impegnerò a utilizzare le competenze e le conoscenze acquisite nel migliore dei modi, e io
continueranno a lavorare al loro miglioramento, al fine di raggiungere la carriera desiderata
INDICE PAGINA
III
SR. TITOLO NUMERO DI PAGINA
NO.
ASTRATTO 1
ESITI DELL'APPRENDIMENTO DEL CORSO DI FORMAZIONE 2
1. INTRODUZIONE ALL'APPRENDIMENTO AUTOMATICO 3
1.1 COS'È L'APPRENDIMENTO AUTOMATICO? 3
1.2 SCOPE FUTURO DEL MACHINE LEARNING 4
1.3 PERCHÉ IL LINGUAGGIO DI PROGRAMMAZIONE PYTHON? 5
5. PROGETTI
5.1 ANALISI DELLA QUALITÀ DEL VINO 28
5.2 SISTEMA DI RICONOSCIMENTO FACCIALE 30
CONCLUSIONE 36
BIBLIOGRAFIA 37
IV
FIGURA TITOLO DELLA FIGURA NUMERO DI PAGINA
NO.
V
ASTRATTO
VI
ESITI DELLA FORMAZIONE
VII
CAPITOLO 1
INTRODUZIONE AL MACHINE LEARNING
VIII
•Definizione 1
L'apprendimento automatico è una disciplina che si occupa di programmare i sistemi in modo che
•Definizione 2
Si dice che un programma apprenda dall'esperienza E rispetto a qualche
misura di performance P, se la sua performance su T, misurata da P, migliora
con esperienza E.
Industria Automotive
Robotica
La robotica è uno dei settori che attira sempre l'interesse dei ricercatori.
come il comune
Siamo ancora in uno stato infantile nel campo dell'Apprendimento Automatico. Ci sono molte
dei progressi da raggiungere in questo campo. Uno di essi che porterà la Macchina
Portare l'apprendimento al livello successivo è il calcolo quantistico.
IX
1.2.4 Ambito di lavoro del ML
L'ambito del Machine Learning in India, così come in altre parti del mondo,
è elevato rispetto ad altri settori professionali quando si tratta di opportunità di lavoro.
Secondo Gartner, ci saranno 2,3 milioni di posti di lavoro nel campo dell'Intelligenza Artificiale
X
tutto il loro sforzo nella risoluzione di un problema di ML invece di concentrarsi sul tecnico
Implementare algoritmi di intelligenza artificiale e apprendimento automatico può essere complicato e richiede molto
un'altra macchina senza alcuna (o con solo minimi) modifiche. Una chiave per
La popolarità di Python è dovuta al fatto che è un linguaggio indipendente dalla piattaforma. Python è
sistemi operativi, il che significa che il software Python può essere facilmente distribuito
Nel Developer Survey 2018 di Stack Overflow, Python era tra i primi
10 linguaggi di programmazione più popolari, il che significa che tu
possono trovare eassumere una società di sviluppocon le competenze necessarie per costruire
il tuo progetto basato sull'IA.
XI
CAPITOLO 2
TIPI DI APPRENDIMENTO AUTOMATICO
L'apprendimento automatico (ML) è un apprendimento automatizzato con poco o nessun intervento umano.
XII
2.1 Concetti di Apprendimento
Apprendimento semi-supervisionato
Allo stesso modo, ci sono quattro categorie di algoritmi di apprendimento automatico come mostrato
sotto:
Algoritmo di apprendimento supervisionato
L'apprendimento supervisionato è comunemente utilizzato in applicazioni del mondo reale, come il riconoscimento facciale.
Regressione e Classificazione.
XIII
La regressione allena e prevede una risposta a valore continuo, ad esempio
prevedere i prezzi degli immobili.
sentimento positivo
tumori, prestiti garantiti e non garantiti, ecc.
Nel apprendimento supervisionato, i dati di apprendimento vengono forniti con descrizioni, etichette, obiettivi o
output desiderati e l'obiettivo è trovare una regola generale che mappi gli input a
output. Questo tipo di dati di apprendimento è chiamato dati etichettati. La regola appresa è
quindi usato per etichettare nuovi dati con output sconosciuti.
L'apprendimento supervisionato si occupa di apprendere una funzione dai dati di addestramento disponibili
XIV
Esempi comuni di apprendimento supervisionato includono la classificazione delle e-mail in
categorie di spam e non spam, etichettatura delle pagine web in base al loro contenuto, e
riconoscimento vocale.
L'apprendimento non supervisionato è utilizzato per rilevare anomalie, valori anomali, come frodi o
attrezzature difettose, o per raggruppare i clienti con comportamenti simili per una vendita
Quando i dati di apprendimento contengono solo alcune indicazioni senza alcuna descrizione o
Gli algoritmi di apprendimento non supervisionato sono strumenti estremamente potenti per analizzare
XV
Se alcuni campioni di apprendimento sono etichettati, ma altri non lo sono, allora è
apprendimento semi-supervisionato. Fa uso di una grande quantità di dati non etichettati
per l'addestramento e una piccola quantità di dati etichettati per il test. Semi-supervisionato
l'apprendimento è applicato nei casi in cui è costoso acquisire un set completamente etichettato
Qui i dati di apprendimento forniscono feedback affinché il sistema si adatti in modo dinamico
AlphaGo.
Il machine learning può essere visto come un ramo dell'IA o Intelligenza Artificiale,
poiché, la capacità di trasformare l'esperienza in competenza o di rilevare schemi in
I dati complessi sono un segno dell'intelligenza umana o animale.
Come campo della scienza, l'apprendimento automatico condivide concetti comuni con altri
ottimizzazione.
XVI
Come sottocampo della tecnologia dell'informazione, il suo obiettivo è programmare le macchine
Tuttavia, bisogna notare che lo scopo del machine learning non è costruire
una duplicazione automatizzata del comportamento intelligente, ma utilizzando il potere di
XVII
CAPITOLO 3
ALLENARE UN MODELLO DI APPRENDIMENTO AUTOMATICO
Definire un Problema
Importazione del dataset
Migliorare i risultati
Analizzando i risultati
Un dataset è una raccolta didati. Nel caso di dati tabellari, un set di dati
corrisponde a uno o piùtabelle del database, dove ognicolonnadi un
la tabella rappresenta una particolare variabile, e ciascunafilacorrisponde a un
dato registrato del set di dati in questione.
XVIII
3.2 Pre-elaborazione dei dati
Nel mondo reale, di solito ci imbattiamo in molti dati grezzi che non sono
adatto per essere elaborato facilmente da algoritmi di apprendimento automatico.
1. Valori mancanti
2. Dati categorici
3. Normalizzazione delle Caratteristiche
Possiamo aggiornare il set di dati sostituendo i valori nan con la media di quella colonna.
Significa che i dati testuali sono presenti al posto dei dati numerici
NOTA: Gli algoritmi di ML funzionano solo su dati numerici e non su
dati testuali/categoriali
Quindi, per convertire i dati categoriali in dati numerici, dobbiamo
seguire un processo in due fasi:
XIX
Figura 3.1 Etichetta e Codifica One Hot
A volte in un insieme di dati due quantità non sono nella stessa gamma
Pertanto, la normalizzazione delle caratteristiche viene eseguita per rendere tutte le quantità nella stessa scala.
gamma
•La scalatura delle caratteristiche è un metodo utilizzato per normalizzare l'intervallo delle variabili indipendenti
variabili o caratteristiche
XX
Una semplice tecnica di regressione lineare variabile è un tipo di algoritmo di apprendimento automatico.
XXI
Vantaggi: Facile da implementare e interpretare. Adatto bene per una linea.
dataset separabile.
XXII
La tecnica della foresta casuale è semplice, altamente accurata e ampiamente utilizzata
da ingegneri.
3.3.4 K-Means
XXIII
I punti all'interno di un cluster sono omogenei e sono eterogenei rispetto ai peer
gruppi.
Come K-means forma i cluster K-means forma i cluster nei passaggi sottoelencati:
Ogni punto dati forma un cluster con i centri più vicini, ovvero k cluster.
Trova il centroide di ciascun cluster in base ai membri esistenti del cluster. Qui
abbiamo nuovi centroids.
Poiché abbiamo nuovi centri, ripeti il passaggio 2 e 3. Trova la distanza più vicina per
cambiamento.
Sappiamo che man mano che il numero di cluster aumenta, questo valore continua a
XXIV
Fig 3.5 Algoritmo K-Means
casi e classifica nuovi casi tramite un voto di maggioranza dei suoi k vicini.
Il caso assegnato alla classe è il più comune tra i suoi K più vicini.
i vicini misurati da una funzione di distanza. Queste funzioni di distanza possono essere
Distanza euclidea, distanza di Manhattan, distanza di Makowski e distanza di Hamming. Prime tre funzioni
XXV
Se K = 1, allora il caso viene semplicemente assegnato alla classe del suo vicino più vicino.
punti a questo.
Puoi utilizzare KNN sia per problemi di classificazione che di regressione. Tuttavia, esso
è più ampiamente utilizzato nei problemi di classificazione nell'industria. KNN può facilmente
essere mappati alle nostre vite reali.
Le variabili dovrebbero essere normalizzate, altrimenti le variabili con intervallo più ampio possono distorcerne i risultati.
Lavora di più sulla fase di pre-elaborazione prima di passare al KNN come l'outlier,
rimozione del rumore
XXVI
Fig 3.6 K-Nearest Neighbour
CAPITOLO 4
VISUALIZZAZIONE DEI DATI
XXVII
Fig 4.1 Matrice di Confusione
problema in cui l'output può essere due o più classi. È una tabella con 4 diverse
combinazioni di valori previsti e reali.
Vero Positivo
Vero Negativo
XXVIII
Interpretazione: Hai previsto negativo ed è vero. Hai previsto che un uomo è
non incinta e lui in realtà non lo è.
classificare i tumori maligni è un errore più grave che classificare i tumori benigni come
Possiamo misurare ciascuno dei possibili risultati delle previsioni per creare diverse
istantanee delle prestazioni del classificatore. Quando il sistema classifica correttamente
XXIX
un tumore è classificato come maligno, la previsione è chiamata vero positivo. Quando il
misure di performance della classificazione, come accuratezza, precisione, richiamo e così via
su.
Dove,
TP è il numero di veri positivi
TN è il numero di veri negativi
FP è il numero di falsi positivi
FN è il numero di falsi negativi.
La precisione è la frazione dei tumori che sono stati previsti come maligni che
sono effettivamente maligni. La precisione è calcolata con la seguente formula:
R = TP / (TP + FN)
XXX
In questo esempio, la precisione misura la frazione di tumori che sono stati previsti.
essere maligni che sono effettivamente maligni. Il richiamo misura la frazione di
tumori veramente maligni che sono stati rilevati. Le misure di precisione e richiamo
potrebbe rivelare che un classificatore con un'accuratezza impressionante in realtà non riesce a rilevare
la maggior parte dei tumori maligni. Se la maggior parte dei tumori è benigna, anche un classificatore che
non predice mai la malignità potrebbe avere un'alta accuratezza. Un classificatore diverso
con una minore precisione e un maggiore richiamo potrebbe essere più adatto al compito, poiché
CAPITOLO 5
PROGETTI
Utilizzando il dataset di analisi della qualità del vino rosso, addestra un modello utilizzando un appropriato ML
algoritmo che può prevedere la qualità di un vino come fine, buono o ottimo.
XXXI
Fig 5.1 Screenshot del progetto 1
XXXII
Figura 5.3 Screenshot del progetto 3
XXXIII
Fig 5.5 Cattura d'écran del progetto 5
Sviluppa un sistema di riconoscimento facciale che possa rilevare i volti umani e possa anche
XXXIV
Fig 5.6 Screenshot del progetto
CAPITOLO 6
APPLICAZIONI DEL MACHINE LEARNING
XXXV
L'intelligenza artificiale (AI) e il machine learning sono ovunque. Opportunità
sono che li stai usando e nemmeno ne sei consapevole. In Macchina
L'apprendimento (ML), i computer, il software e i dispositivi funzionano tramite la cognizione
riconoscimento
previsioni, analisi del mercato azionario e previsioni, e così via. Questo capitolo
discute queste applicazioni in dettaglio.
Siri, Google Now, Alexa sono alcuni dei comuni esempi di virtuale
assistenti personali. Queste applicazioni aiutano a trovare informazioni, quando
chiesto a voce. Tutto ciò che serve è attivarli e porre domande
Quali sono i miei appuntamenti per oggi?
voli da Delhi a New York
loro a costruire una mappa del traffico attuale. Questo aiuta a prevenire il traffico
congestioni. L'apprendimento automatico in tali scenari aiuta a stimare le aree
dove si possono trovare congestioni in base ai registri precedenti.
XXXVI
I sistemi di videosorveglianza oggigiorno sono alimentati da AI e macchine.
L'apprendimento automatico è ampiamente utilizzato nella rilevazione dello spam e del malware.
XXXVII
6.7 Supporto Clienti Online
Su diversi siti web al giorno d'oggi, c'è un'opzione per chattare con il supporto clienti
rappresentativa mentre gli utenti navigano nel sito. Nella maggior parte dei casi, invece
di un vero dirigente, parli con un chatbot. Questi bot estraggono informazioni da
il sito web e fornirlo ai clienti per assisterli. Nel corso di
col tempo, i chatbot imparano a comprendere meglio le richieste degli utenti e a servire loro
con risposte migliori, e questo è reso possibile dagli algoritmi di apprendimento automatico.
Google e motori di ricerca simili stanno utilizzando l'apprendimento automatico per migliorare il
risultati di ricerca per i loro utenti. Ogni volta che viene eseguita una ricerca, gli algoritmi presso
Il machine learning viene utilizzato per tracciare frodi monetarie online. Ad esempio:
PayPal sta utilizzando l'IA per prevenire il riciclaggio di denaro. L'azienda sta utilizzando un insieme
XXXVIII
di strumenti che li aiutano a confrontare milioni di transazioni e fare un
distinzione tra transazioni legali o illegali che avvengono tra il
acquirenti e venditori.
CONCLUSIONE
XXXIX
Il Machine Learning è una tecnica di addestramento delle macchine per svolgere le attività
un cervello umano può fare, sebbene un po' più velocemente e meglio di un umano medio
essere. Oggi abbiamo visto che le macchine possono battere i campioni umani in
giochi come gli Scacchi, Alpha-Go che sono considerati molto complessi. Tu
ho visto che le macchine possono essere addestrate a svolgere attività umane in diversi
aree e possono aiutare gli esseri umani a vivere meglio. Il Machine Learning può essere un
Supervisionato o non supervisionato.
Se hai una quantità inferiore di dati e dati chiaramente etichettati per l'addestramento, opta per
Apprendimento supervisionato. L'apprendimento non supervisionato darebbe generalmente risultati migliori.
prestazioni e risultati per grandi set di dati. Se hai un enorme set di dati facilmente
disponibile, vai per tecniche di deep learning. Hai anche imparato
Apprendimento per rinforzo e Apprendimento profondo per rinforzo. Ora sai
cosa sono le reti neurali, le loro applicazioni e limitazioni. Infine, quando è che
riguardo allo sviluppo di modelli di apprendimento automatico di tua proprietà, tu
XL
BIBLIOGRAFIA
XLI