UNIT 1: Data Science Basics & Preprocessing
Define Data Science and explain its applications.
Differentiate Data Science with Business Intelligence and Artificial Intelligence.
Explain Data Warehousing and Data Mining.
Explain different types of Data Sources.
Explain Data Transformation techniques.
Explain Data Cleaning and handling missing values and outliers.
Explain Data Wrangling and its techniques.
Explain Feature Engineering and Time Series data.
Explain structured, unstructured and semi-structured data.
Explain Data Preprocessing and its importance.
Explain challenges in handling unstructured data.
Explain libraries: NumPy, Pandas, Scikit-learn.
UNIT 2: EDA & Machine Learning
Explain Exploratory Data Analysis (EDA) and visualization techniques.
Define Descriptive Statistics (Mean, Median, Mode, Standard Deviation).
Explain Hypothesis Testing (t-test, chi-square).
Differentiate supervised and unsupervised learning.
Explain Bias-Variance Tradeoff.
Explain Classification and Regression analysis.
Explain Ensemble Learning (Bagging and Boosting).
Explain Support Vector Machine (SVM).
Explain Decision Trees and Random Forest.
Explain Artificial Neural Networks (ANN).
Explain K-NN algorithm.
Explain Gradient Descent.
Explain Dimensionality Reduction.
UNIT 3: Evaluation, Visualization & Data
Management
Define Accuracy, Precision, Recall, F1 Score and Confusion Matrix.
Explain ROC curve and AUC.
Explain model evaluation techniques and cross-validation.
Explain Hyperparameter Tuning.
Explain Data Visualization tools (Matplotlib, Seaborn, Tableau).
Explain Data Storytelling.
Explain Data Management Activities.
Explain Data Governance.
Explain ETL (Extraction, Transformation, Loading).
Explain Data Quality and its importance.
Explain Data Privacy and Security.
Explain Data Pipelines.