0% encontró este documento útil (0 votos)
0 vistas12 páginas

Pasos R

El documento proporciona una guía completa para aprender el lenguaje R, destacando su uso en análisis estadístico y visualización de datos. Incluye pasos para la instalación, fundamentos del lenguaje, paquetes esenciales y ejemplos prácticos en agronomía. Además, sugiere una ruta de aprendizaje y ejercicios para practicar la importación y análisis de datos reales.

Cargado por

bbchito2024
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como DOCX, PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
0 vistas12 páginas

Pasos R

El documento proporciona una guía completa para aprender el lenguaje R, destacando su uso en análisis estadístico y visualización de datos. Incluye pasos para la instalación, fundamentos del lenguaje, paquetes esenciales y ejemplos prácticos en agronomía. Además, sugiere una ruta de aprendizaje y ejercicios para practicar la importación y análisis de datos reales.

Cargado por

bbchito2024
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como DOCX, PDF, TXT o lee en línea desde Scribd

El lenguaje R es una herramienta potentísima para análisis estadístico, visualización y

manejo de datos, muy usada en investigación científica y agronómica. Te guío paso a


paso para que tengas un mapa claro de por dónde empezar:
🔑 Primeros pasos para entender R
1. Concepto básico
 R es un lenguaje de programación estadístico y un entorno de trabajo.
 Su fortaleza está en el análisis de datos, gráficos y paquetes especializados (por
ejemplo, en agricultura, economía o biología).
2. Instalación y entorno
 Descarga R desde CRAN.
 Instala RStudio, que es el entorno más amigable para trabajar (editor, consola,
paneles de gráficos).
3. Fundamentos del lenguaje
 Objetos básicos: vectores, matrices, data frames, listas.
 Operaciones simples:

x <- c(1, 2, 3, 4) # vector


mean(x) # promedio
summary(x) # resumen estadístico

datos <- [Link]("[Link]")


head(datos)

4. Paquetes esenciales
 tidyverse: manipulación y visualización de datos.
 ggplot2: gráficos avanzados.
 dplyr: transformación de datos (filtrar, agrupar, resumir).
 readxl: importar datos de Excel.
5. Aplicación práctica
 Empieza con un dataset sencillo (ejemplo: producción de arroz por hectárea).
 Practica operaciones: calcular medias, hacer gráficos de barras, correlaciones.
📊 Ejemplo aplicado (agronomía)
Supongamos que tienes datos de rendimiento de arroz en tres parcelas:
parcelas <- [Link](
parcela = c("A", "B", "C"),
rendimiento = c(5.2, 4.8, 6.1) # toneladas/ha
)

mean(parcelas$rendimiento) # promedio
ggplot(parcelas, aes(x=parcela, y=rendimiento)) +
geom_bar(stat="identity", fill="green")

🛠 Ruta de aprendizaje sugerida


1. Familiarízate con RStudio y los objetos básicos.
2. Aprende a importar y limpiar datos.
3. Practica con dplyr y ggplot2.
4. Aplica ejemplos reales de tus investigaciones (banano, arroz, supermercados).
5. Avanza hacia análisis estadísticos más complejos (ANOVA, regresiones,
modelos lineales).
📊 Mini-ejercicio: Rendimiento de arroz por parcela
1. Crear un dataset
Imagina que tienes tres parcelas de arroz con sus rendimientos (ton/ha):

# Crear un pequeño dataset


parcelas <- [Link](
parcela = c("A", "B", "C"),
rendimiento = c(5.2, 4.8, 6.1) # toneladas/ha
)

# Ver los datos


print(parcelas)

# Promedio de rendimiento
mean(parcelas$rendimiento)

# Resumen estadístico
summary(parcelas$rendimiento)
# Instalar tidyverse si no lo tienes
# [Link]("tidyverse")

library(ggplot2)

# Gráfico de barras
ggplot(parcelas, aes(x = parcela, y = rendimiento)) +
geom_bar(stat = "identity", fill = "darkgreen") +
labs(title = "Rendimiento de arroz por parcela",
x = "Parcela",
y = "Toneladas/ha")

🔎 ¿Qué obtienes?
 Una tabla con los rendimientos.
 El promedio y resumen estadístico.
 Un gráfico de barras comparando las parcelas.
🍌 Ejemplo con datos de banano
1. Crear un dataset

# Datos ficticios de producción y ventas de banano


banano <- [Link](
empresa = c("AgroBanana SA", "ExportBanana", "OroBanana"),
hectareas = c(120, 90, 75),
produccion_tm = c(3600, 2700, 2250), # toneladas métricas
ventas_usd = c(1200000, 950000, 800000)
)

# Ver los datos


print(banano)

# Promedio de producción
mean(banano$produccion_tm)

# Total de ventas
sum(banano$ventas_usd)

# Resumen estadístico
summary(banano$produccion_tm)
library(ggplot2)

# Gráfico de barras: Producción por empresa


ggplot(banano, aes(x = empresa, y = produccion_tm)) +
geom_bar(stat = "identity", fill = "goldenrod") +
labs(title = "Producción de banano por empresa",
x = "Empresa",
y = "Producción (Tm)")
📂 Importar un archivo real en R
1. Importar un CSV
Supongamos que tienes un archivo llamado [Link] con columnas: Empresa,
Hectáreas, Producción, Ventas.

# Importar archivo CSV


datos_banano <- [Link]("[Link]", header = TRUE, sep = ",")

# Ver primeras filas


head(datos_banano)

# Instalar y cargar paquete readxl


# [Link]("readxl")
library(readxl)

# Importar archivo Excel


datos_banano <- read_excel("[Link]")

# Ver primeras filas


head(datos_banano)
🔎 Diferencia clave
 [Link]() → para archivos separados por comas.
 read_excel() → para archivos Excel (.xlsx o .xls).
👉 Con esto ya tienes:
1. Un ejemplo práctico con datos ficticios de banano.
2. La forma de importar archivos reales en R para analizarlos.
📂 Mini-dataset (CSV)
Contenido del archivo [Link]:

Cultivo,Provincia,Hectareas,Produccion_Tm,Ventas_USD
Banano,Los Ríos,120,3600,1200000
Banano,Guayas,90,2700,950000
Banano,El Oro,75,2250,800000
Arroz,Guayas,60,300,150000
Arroz,Los Ríos,80,400,200000
Arroz,Palestina,50,250,125000

🔎 Cómo importarlo en R
1. Guardar el archivo
 Copia el contenido en un editor de texto (ej. Bloc de notas).
 Guárdalo como [Link].

# Importar el archivo CSV


cultivos <- [Link]("[Link]", header = TRUE, sep = ",")

# Ver primeras filas


head(cultivos)
# Promedio de producción por cultivo
aggregate(Produccion_Tm ~ Cultivo, data = cultivos, mean)

# Total de ventas por provincia


aggregate(Ventas_USD ~ Provincia, data = cultivos, sum)

# Gráfico de barras: Producción por provincia


library(ggplot2)
ggplot(cultivos, aes(x = Provincia, y = Produccion_Tm, fill = Cultivo)) +
geom_bar(stat = "identity", position = "dodge") +
labs(title = "Producción agrícola por provincia",
x = "Provincia",
y = "Producción (Tm)")

👉 Con este mini-dataset puedes practicar:


 Importación de datos ([Link]).
 Estadísticas básicas (promedios, sumas).
 Visualización con ggplot2.
📂 Mini-dataset (Excel)
Imagina que guardas un archivo llamado [Link] con una hoja llamada
Producción y este contenido:
Cultivo Provincia Hectareas Produccion_Tm Ventas_USD
Banano Los Ríos 120 3600 1200000
Banano Guayas 90 2700 950000
Banano El Oro 75 2250 800000
Arroz Guayas 60 300 150000
Arroz Los Ríos 80 400 200000
Arroz Palestina 50 250 125000

# Instalar y cargar paquete readxl si no lo tienes


# [Link]("readxl")
library(readxl)

# Importar la hoja "Producción" del archivo Excel


cultivos <- read_excel("[Link]", sheet = "Producción")

# Ver primeras filas


head(cultivos)
# Promedio de producción por cultivo
aggregate(Produccion_Tm ~ Cultivo, data = cultivos, mean)

# Total de ventas por provincia


aggregate(Ventas_USD ~ Provincia, data = cultivos, sum)

# Gráfico de barras: Producción por provincia


library(ggplot2)
ggplot(cultivos, aes(x = Provincia, y = Produccion_Tm, fill = Cultivo)) +
geom_bar(stat = "identity", position = "dodge") +
labs(title = "Producción agrícola por provincia",
x = "Provincia",
y = "Producción (Tm)")

👉 Con este mini-dataset en Excel puedes practicar la importación con readxl, y luego aplicar
análisis y visualización igual que con CSV.

También podría gustarte