0% found this document useful (0 votes)
2 views8 pages

ML Lab

The document contains multiple Python scripts demonstrating various machine learning techniques using libraries such as scikit-learn and pandas. It covers data visualization, correlation analysis, PCA, hypothesis generation, K-Nearest Neighbors, linear regression, decision trees, and clustering on datasets like California housing, Boston housing, and breast cancer. Each section includes data preparation, model training, and visualization of results.

Uploaded by

na7259397
Copyright
© All Rights Reserved
We take content rights seriously. If you suspect this is your content, claim it here.
Available Formats
Download as PDF, TXT or read online on Scribd
0% found this document useful (0 votes)
2 views8 pages

ML Lab

The document contains multiple Python scripts demonstrating various machine learning techniques using libraries such as scikit-learn and pandas. It covers data visualization, correlation analysis, PCA, hypothesis generation, K-Nearest Neighbors, linear regression, decision trees, and clustering on datasets like California housing, Boston housing, and breast cancer. Each section includes data preparation, model training, and visualization of results.

Uploaded by

na7259397
Copyright
© All Rights Reserved
We take content rights seriously. If you suspect this is your content, claim it here.
Available Formats
Download as PDF, TXT or read online on Scribd

M.

L Lab programs
P1
from [Link] import fetch_california_housing
california = fetch_california_housing()
import pandas as pd
df = [Link]([Link], columns=california.feature_names)
df["Target"]= [Link]
import [Link] as plt
import seaborn as sns
[Link](bins=30, edgecolor="black", figsize=(20,10))
[Link](figsize=(15,9))
for i, feature in enumerate([Link], 1):
[Link](3,3,i)
[Link](df[feature])
plt.tight_layout()
[Link]()

P2
from [Link] import fetch_california_housing

california = fetch_california_housing()

import pandas as pd

df = [Link]([Link], columns=california.feature_names)
df["Target"] = [Link]

correlation = [Link]()

import seaborn as sns


[Link](correlation, annot=True, cmap="coolwarm", fmt=".2f")

[Link](df)

P3
from [Link] import load_iris

iris = load_iris()

data = [Link]

from [Link] import StandardScaler


from [Link] import PCA

scaler = StandardScaler().fit_transform(data)
pc = PCA(n_components=2).fit_transform(scaler)

import pandas as pd

df = [Link](pc,columns=["pc1","pc2"])
df["Target"] = [Link]

import seaborn as sns

[Link](x="pc1",y="pc2", hue="Target", data=df)


P4
import pandas as pd

data = [Link]({
"Sky":["Sunny","Sunny","Rainy","Sunny"],
"AirTemp":["Warm","Warm","Cold","Warm"],
"Humidity":["Normal","High","High","High"],
"Wind":["Strong","Strong","Strong","Strong"],
"Water":["Warm","Warm","Warm","Cool"],
"Forecast":["Same","Same","Change","Same"],
"EnjoySport":["Yes","Yes","No","Yes"]
})

print(data)

positiveData = data[data["EnjoySport"] == "Yes"].drop(columns="EnjoySport")

def findS(data):
hypo = [0] * len([Link])

for i in range(len(data)):
for j in range(len([Link])):
value = [Link][i, j]

if hypo[j] == 0:
hypo[j] = value
elif hypo[j] != value:
hypo[j] = "?"

return hypo

finds = findS(positiveData)
print("Final Hypothesis:", finds)

P5

import numpy as np

x = [Link](100).reshape(-1,1)
y = [Link]([1 if val <= 0.5 else 2 for val in x[:50]])

xtrain = x[:50]
ytrain = y
xtest = x[50:]

kValues = [1,2,3,20,40]

import [Link] as plt


from [Link] import KNeighborsClassifier

[Link](figsize=(20,15))
for i, value in enumerate(kValues, 1):
predicted = KNeighborsClassifier(n_neighbors=value).fit(xtrain,ytrain).predict(xtest)
[Link](5,2,i)
[Link](xtrain, ytrain, c="red", label="Tested")
[Link](xtest, predicted, c="blue", label="Predicted")
[Link]()
[Link](predicted)
plt.tight_layout()
[Link]()

P7
from [Link] import fetch_openml

boston = fetch_openml(name="boston", version=1)

import pandas as pd

df = [Link]([Link], columns=boston.feature_names)
df["Target"] = [Link]

x = df[["RM"]]
y = df["Target"]

from sklearn.model_selection import train_test_split

xtrain,xtest, ytrain, ytest = train_test_split(x,y,test_size=0.2,random_state=42)

from sklearn.linear_model import LinearRegression

predict = LinearRegression().fit(xtrain,ytrain).predict(xtest)

import [Link] as plt

[Link](xtest,ytest)
[Link](xtest,predict, c="red")

from [Link] import PolynomialFeatures


from [Link] import make_pipeline

url = "[Link]

data = pd.read_csv(url)
data = [Link]()

predict = make_pipeline(PolynomialFeatures(degree=2),
LinearRegression()).fit(data[["horsepower"]], data["mpg"]).predict(data[["horsepower"]])

import seaborn as sns

[Link](data["horsepower"], data["mpg"])
[Link](x=data["horsepower"], y=predict, c="red")

P8
from [Link] import load_breast_cancer

cancer = load_breast_cancer()

from sklearn.model_selection import train_test_split

xtrain,xtest, ytrain, ytest = train_test_split([Link], [Link], test_size=0.2, random_state=42)

from [Link] import DecisionTreeClassifier, plot_tree

tree = DecisionTreeClassifier(criterion="gini").fit(xtrain,ytrain)

import [Link] as plt

[Link](figsize=(20,25))
plot_tree(tree,filled=True)
[Link]()

P9
from [Link] import fetch_olivetti_faces
faces = fetch_olivetti_faces()

[Link]()

from sklearn.model_selection import train_test_split

xtrain,xtest,ytrain,ytest, imgtrain,imgtest = train_test_split([Link], [Link], [Link],


test_size=0.2, random_state=42)

from sklearn.naive_bayes import GaussianNB

prediction = GaussianNB().fit(xtrain,ytrain).predict(xtest)

import [Link] as plt

[Link](figsize=(20,15))
for i in range(10):
[Link](5,5,i+1)
[Link](imgtest[i])
[Link](f"Predicted:{prediction[i]}\nOriginal:{ytest[i]}")
plt.tight_layout()
[Link]()

10
from [Link] import load_breast_cancer

cancer = load_breast_cancer()

from [Link] import KMeans

predict = KMeans(n_clusters=2).fit_predict([Link])
import [Link] as plt

[Link]([Link][:,0],[Link][:,1],c=predict)

You might also like