El lenguaje R es una herramienta potentísima para análisis estadístico, visualización y
manejo de datos, muy usada en investigación científica y agronómica. Te guío paso a
paso para que tengas un mapa claro de por dónde empezar:
🔑 Primeros pasos para entender R
1. Concepto básico
R es un lenguaje de programación estadístico y un entorno de trabajo.
Su fortaleza está en el análisis de datos, gráficos y paquetes especializados (por
ejemplo, en agricultura, economía o biología).
2. Instalación y entorno
Descarga R desde CRAN.
Instala RStudio, que es el entorno más amigable para trabajar (editor, consola,
paneles de gráficos).
3. Fundamentos del lenguaje
Objetos básicos: vectores, matrices, data frames, listas.
Operaciones simples:
x <- c(1, 2, 3, 4) # vector
mean(x) # promedio
summary(x) # resumen estadístico
datos <- [Link]("[Link]")
head(datos)
4. Paquetes esenciales
tidyverse: manipulación y visualización de datos.
ggplot2: gráficos avanzados.
dplyr: transformación de datos (filtrar, agrupar, resumir).
readxl: importar datos de Excel.
5. Aplicación práctica
Empieza con un dataset sencillo (ejemplo: producción de arroz por hectárea).
Practica operaciones: calcular medias, hacer gráficos de barras, correlaciones.
📊 Ejemplo aplicado (agronomía)
Supongamos que tienes datos de rendimiento de arroz en tres parcelas:
parcelas <- [Link](
parcela = c("A", "B", "C"),
rendimiento = c(5.2, 4.8, 6.1) # toneladas/ha
)
mean(parcelas$rendimiento) # promedio
ggplot(parcelas, aes(x=parcela, y=rendimiento)) +
geom_bar(stat="identity", fill="green")
🛠 Ruta de aprendizaje sugerida
1. Familiarízate con RStudio y los objetos básicos.
2. Aprende a importar y limpiar datos.
3. Practica con dplyr y ggplot2.
4. Aplica ejemplos reales de tus investigaciones (banano, arroz, supermercados).
5. Avanza hacia análisis estadísticos más complejos (ANOVA, regresiones,
modelos lineales).
📊 Mini-ejercicio: Rendimiento de arroz por parcela
1. Crear un dataset
Imagina que tienes tres parcelas de arroz con sus rendimientos (ton/ha):
# Crear un pequeño dataset
parcelas <- [Link](
parcela = c("A", "B", "C"),
rendimiento = c(5.2, 4.8, 6.1) # toneladas/ha
)
# Ver los datos
print(parcelas)
# Promedio de rendimiento
mean(parcelas$rendimiento)
# Resumen estadístico
summary(parcelas$rendimiento)
# Instalar tidyverse si no lo tienes
# [Link]("tidyverse")
library(ggplot2)
# Gráfico de barras
ggplot(parcelas, aes(x = parcela, y = rendimiento)) +
geom_bar(stat = "identity", fill = "darkgreen") +
labs(title = "Rendimiento de arroz por parcela",
x = "Parcela",
y = "Toneladas/ha")
🔎 ¿Qué obtienes?
Una tabla con los rendimientos.
El promedio y resumen estadístico.
Un gráfico de barras comparando las parcelas.
🍌 Ejemplo con datos de banano
1. Crear un dataset
# Datos ficticios de producción y ventas de banano
banano <- [Link](
empresa = c("AgroBanana SA", "ExportBanana", "OroBanana"),
hectareas = c(120, 90, 75),
produccion_tm = c(3600, 2700, 2250), # toneladas métricas
ventas_usd = c(1200000, 950000, 800000)
)
# Ver los datos
print(banano)
# Promedio de producción
mean(banano$produccion_tm)
# Total de ventas
sum(banano$ventas_usd)
# Resumen estadístico
summary(banano$produccion_tm)
library(ggplot2)
# Gráfico de barras: Producción por empresa
ggplot(banano, aes(x = empresa, y = produccion_tm)) +
geom_bar(stat = "identity", fill = "goldenrod") +
labs(title = "Producción de banano por empresa",
x = "Empresa",
y = "Producción (Tm)")
📂 Importar un archivo real en R
1. Importar un CSV
Supongamos que tienes un archivo llamado [Link] con columnas: Empresa,
Hectáreas, Producción, Ventas.
# Importar archivo CSV
datos_banano <- [Link]("[Link]", header = TRUE, sep = ",")
# Ver primeras filas
head(datos_banano)
# Instalar y cargar paquete readxl
# [Link]("readxl")
library(readxl)
# Importar archivo Excel
datos_banano <- read_excel("[Link]")
# Ver primeras filas
head(datos_banano)
🔎 Diferencia clave
[Link]() → para archivos separados por comas.
read_excel() → para archivos Excel (.xlsx o .xls).
👉 Con esto ya tienes:
1. Un ejemplo práctico con datos ficticios de banano.
2. La forma de importar archivos reales en R para analizarlos.
📂 Mini-dataset (CSV)
Contenido del archivo [Link]:
Cultivo,Provincia,Hectareas,Produccion_Tm,Ventas_USD
Banano,Los Ríos,120,3600,1200000
Banano,Guayas,90,2700,950000
Banano,El Oro,75,2250,800000
Arroz,Guayas,60,300,150000
Arroz,Los Ríos,80,400,200000
Arroz,Palestina,50,250,125000
🔎 Cómo importarlo en R
1. Guardar el archivo
Copia el contenido en un editor de texto (ej. Bloc de notas).
Guárdalo como [Link].
# Importar el archivo CSV
cultivos <- [Link]("[Link]", header = TRUE, sep = ",")
# Ver primeras filas
head(cultivos)
# Promedio de producción por cultivo
aggregate(Produccion_Tm ~ Cultivo, data = cultivos, mean)
# Total de ventas por provincia
aggregate(Ventas_USD ~ Provincia, data = cultivos, sum)
# Gráfico de barras: Producción por provincia
library(ggplot2)
ggplot(cultivos, aes(x = Provincia, y = Produccion_Tm, fill = Cultivo)) +
geom_bar(stat = "identity", position = "dodge") +
labs(title = "Producción agrícola por provincia",
x = "Provincia",
y = "Producción (Tm)")
👉 Con este mini-dataset puedes practicar:
Importación de datos ([Link]).
Estadísticas básicas (promedios, sumas).
Visualización con ggplot2.
📂 Mini-dataset (Excel)
Imagina que guardas un archivo llamado [Link] con una hoja llamada
Producción y este contenido:
Cultivo Provincia Hectareas Produccion_Tm Ventas_USD
Banano Los Ríos 120 3600 1200000
Banano Guayas 90 2700 950000
Banano El Oro 75 2250 800000
Arroz Guayas 60 300 150000
Arroz Los Ríos 80 400 200000
Arroz Palestina 50 250 125000
# Instalar y cargar paquete readxl si no lo tienes
# [Link]("readxl")
library(readxl)
# Importar la hoja "Producción" del archivo Excel
cultivos <- read_excel("[Link]", sheet = "Producción")
# Ver primeras filas
head(cultivos)
# Promedio de producción por cultivo
aggregate(Produccion_Tm ~ Cultivo, data = cultivos, mean)
# Total de ventas por provincia
aggregate(Ventas_USD ~ Provincia, data = cultivos, sum)
# Gráfico de barras: Producción por provincia
library(ggplot2)
ggplot(cultivos, aes(x = Provincia, y = Produccion_Tm, fill = Cultivo)) +
geom_bar(stat = "identity", position = "dodge") +
labs(title = "Producción agrícola por provincia",
x = "Provincia",
y = "Producción (Tm)")
👉 Con este mini-dataset en Excel puedes practicar la importación con readxl, y luego aplicar
análisis y visualización igual que con CSV.