“Efectos de los distintos
programas de reforzamiento en la
adquisición de conductas
aprendidas de sujetos simulados”
Integrantes:
Cabrera Palomino Alexia
Galindo Muñante Alex
Ramirez Espino Maria Fernanda
Vega Mantari Irma
Yllanes Llamoca Adaliz
[Link] del problema:
Formulación del problema
Objetivos de la investigación
tenido Justificacion de la investigación
Con 2. Marco teórico
Antecedentes de la investigación
Bases teóricas
Definición de variables
Formulacion de hipotesis
Planteamiento del problema:
Formulacion del problema
Problema general:
¿Cuáles son los efectos de los distintos programas de reforzamiento en la
adquisición de conductas aprendidas de sujetos simulados?
Problemas específicos:
¿Cuál es el efecto del programa de razón fija en la adquisición de conductas
aprendidas de sujetos simulados?
¿Cómo influye el programa de reforzamiento continuo en la adquisición de
conductas aprendidas de sujetos simulados?
¿Cuál es el efecto del programa de razón variable en la adquisición de
conductas aprendidas de sujetos simulados?
Objetivos de la investigación:
Objetivo general:
Determinar el efecto de los programas de
reforzamiento en la adquisición de
conductas aprendidas en los sujetos
simulados según su peso (bajo peso, peso
promedio, sobrepeso).
Objetivos específicos:
1. Analizar el efecto del programa de razón fija en la adquisición
de conductas aprendidas de sujetos simulados según su
peso (bajo peso, peso promedio, sobrepeso).
2. Examinar el efecto del programa de razón variable en la
adquisición de conductas aprendidas de sujetos simulados
según su peso (bajo peso, peso promedio, sobrepeso).
3. Evaluar el efecto del programa de reforzamiento continuo
en la adquisición de conductas aprendidas de sujetos
simulados según su peso (bajo peso, peso promedio,
sobrepeso).
Justificación de la
investigación:
La presente investigación se justifica
por su aporte teórico, metodológico y
formativo dentro del campo de la
psicología experimental. En el ámbito
metodológico, el uso del software
CyberRat 2025 ofrece una
plataforma controlada para replicar
las condiciones de la caja de Skinner
de manera virtual.
Antecedentes de la -Johnson, A. R., Christensen, B. A., Kelly, S. J., y Calipari, E. S.
(2022) realizaron un estudio experimental con ratones para
investigación: analizar cómo los distintos programas de reforzamiento
influyen en los cambios motivacionales dependientes de la
experiencia. Sustenta la comparación entre programas de
-Reed (2023) investigó cómo la señalización del
reforzamiento (CRF, FR, VR) en la adquisición de conductas, eje
reforzamiento influye en la variabilidad operante en
principal del experimento con sujetos simulados.
ratas 🐀 durante tareas de presión de palanca. Esto Variable independiente: programa de reforzamiento
apoya la idea de que los estímulos asociados al
Variable dependiente: motivación dependiente de la experiencia
reforzamiento modifican la forma en que se Variable de control: ratones del mismo sexo, edad
adquiere y mantiene la conducta, principio que se
analiza en CyberRat 2025 bajo diferentes programas
-Gutiérrez y Escobar (2022) examinaron cómo distintos niveles de
(CRF, FR y VR).
variabilidad operante afectan la estabilidad de la conducta
Variable Independiente: Señalización del reforzamiento
aprendida en ratas. Esto refuerza la importancia de evaluar cómo
Variable Dependiente: Variabilidad y persistencia de la
los programas de reforzamiento afectan la estabilidad del
conducta operante
aprendizaje, base de los experimentos en CyberRat 2025.
Variables de Control: Ambiente, ratas y condiciones de
Variable Independiente: Nivel de variabilidad entrenado
entrenamiento
Variable Dependiente: Persistencia y flexibilidad de la respuesta
operante
Variables de Control: Ambiente y condiciones experimentales
Bases teóricas: Reforzamiento:
Es el proceso mediante el cual una conducta
Condicionamiento operante:
incrementa su probabilidad de repetirse a
Desde una perspectiva crítica, el modelo de
causa de la consecuencia que la sigue. Este
Skinner ha sido cuestionado por su carácter
puede ser positivo, cuando la respuesta
mecanicista; sin embargo, investigaciones
produce la aparición de un estímulo
contemporáneas han demostrado su validez
agradable, o negativo, cuando la respuesta
más allá del laboratorio. Actualmente se
permite eliminar o evitar un estímulo
reconoce que los principios del
aversivo.
condicionamiento operante también operan
Investigaciones recientes destacan que la
en entornos sociales, tecnológicos y
efectividad del reforzamiento puede variar
digitales, donde las consecuencias pueden
según el entorno, la motivación y la historia
ser simbólicas o informacionales (Patterson-
previa del sujeto (Patterson-Kane et al.,
Kane, Pittman y Pajor, 2023; Robayo-Pinzón,
2023)
Rojas-Berrío, Paredes y Foxall, 2023).
Bases teóricas
Programas de reforzamiento:
En el experimento con CyberRat 2025, se
aplicaron distintos programas de
reforzamiento para analizar cómo influyen
en la adquisición de la conducta de presionar
la palanca. En primer lugar, el reforzamiento
continuo (CRF) consiste en que cada vez que
la rata realiza la acción correcta recibe una
recompensa,
Por otro lado, el programa de razón fija (FR)
establece que la recompensa no se otorga
con cada respuesta, sino después de un
número determinado de acciones.
Definición de variables (Definición conceptual) :
Variable Independiente Variable de control (sujetos
Programa de reforzamiento (continuo, simulados):
razón fija y razón variable). Se definen como participantes
Se refiere al tipo de esquema mediante el experimentales cuyo comportamiento
cual se administra el reforzador según el está previamente programado o guiado
número de respuestas emitidas por el por un protocolo estandarizado, en lugar de
sujeto. surgir de respuestas espontáneas
Variable Dependiente:
Conducta operante.
Corresponde a la frecuencia y patrón
de respuestas del sujeto (presionar la
palanca) bajo los distintos programas
de reforzamiento aplicados.
Definición operacional:
Formulación de hipotesis:
Hipótesis general:
Existen efectos de programas de reforzamiento en la adquisición de
conductas en sujetos simulados.
Hipótesis específicas:
1. El programa de razón fija (FR) produce patrones regulares de
respuesta y un ritmo estable en la adquisición de la conducta
operante en sujetos simulados.
2. El programa de razón variable (VR) incrementa la tasa de respuesta y
la persistencia conductual, favoreciendo una adquisición más
sostenida de la conducta operante en sujetos simulados.
3. El programa de reforzamiento continuo (CRF) facilita una adquisición
más rápida de la conducta operante, pero con menor resistencia a la
extinción, en comparación con los programas de razón fija y variable.
Metodología :
Diseño Metodológico: Técnicas e instrumentos de
El presente estudio adopta un diseño bicondicional A–B. En la recolección de datos:
fase A (línea base) se registran las respuestas del sujeto sin la
aplicación de ningún programa de reforzamiento, La presente investigación utilizará técnicas cuantitativas
estableciendo un patrón conductual inicial. Posteriormente, en basadas en la observación sistemática y el registro
la fase B (intervención) se introduce el programa de automatizado de respuestas operantes dentro del entorno
reforzamiento correspondiente, De acuerdo con Manolov virtual CyberRat 2025 Además, el software produce
gráficos y reportes de desempeño que permiten
(2025), este tipo de diseño permite evaluar los efectos de una
analizar la evolución del aprendizaje bajo cada programa de
intervención en un mismo sujeto que actúa como su propio
reforzamiento (continuo, razón fija y razón variable). .
control.
Sujeto Experimental:
El sujeto experimental de esta investigación corresponde a
un organismo simulado generado por el software educativo
CyberRat 2025, diseñado para reproducir virtualmente el
comportamiento de una rata de laboratorio bajo condiciones
controladas de aprendizaje operante. Este modelo digital
permite observar con precisión la adquisición de conductas
en función de distintos programas de reforzamiento (Reed,
2023; Revolledo , 2022).
Definición operacional:
Aspectos éticos:
Este trabajo es ético, sostenible y
responsable, pues promueve la
enseñanza y el aprendizaje del
condicionamiento operante mediante
recursos digitales que reemplazan de
manera efectiva la experimentación
animal, contribuyendo al avance
científico y educativo sin
comprometer el bienestar de los
seres vivos.
Resultados:
Resultados generales:
En el programa de reforzamiento continuo (CRF), los sujetos
alcanzaron una adquisición rápida y estable, aunque con menor
número total de respuestas y menor resistencia a la extinción, dado
que el refuerzo inmediato reduce la variabilidad conductual.
En el programa de razón fija (RF), se observó un incremento más
progresivo y constante de las respuestas, con ligeras fluctuaciones
atribuibles a la fatiga o la saciedad.
Finalmente, el programa de razón variable (RV) generó las tasas de
respuesta más altas y consistentes, reflejando una conducta más
persistente y resistente al cambio.
Tabla General:
:Resultados del efecto de los distintos programas de reforzamiento
en la adquisición de conductas aprendidas en sujetos simulados según
su peso (bajo peso, peso promedio, sobrepeso).
Nota. Datos expresan el rango de
presiones de palanca obtenidas
en cinco sesiones por cada sujeto
simulado según peso corporal y
programa de reforzamiento.
Resultados específicos:
Resultados del objetivo 1:
Rata Virtual 1 (BP): Digital / Peso 190 gr
Rata Virtual 2 (PP): Cicerone / Peso 280 gr
Rata Virtual 3 (SP): Queeny / Peso 320 gr
En el programa de razón fija el sujeto de bajo peso evidenció un aumento sostenido en
las presiones de palanca, pasando de 366 a 691 respuestas bajo 23 a 24 horas de
privación de agua y una dosis constante de 0.10 ml. Este incremento muestra una
adquisición progresiva y estable de la conducta operante.
El sujeto de peso promedio presentó un patrón similar, iniciando con 376 presiones y
alcanzando 890 al finalizar las sesiones, manteniendo 24 horas de privación. El sujeto
simulado aprendió rápidamente la relación entre respuesta y consecuencia.
En el caso del sujeto con sobrepeso, se registró un aumento notable desde 714 hasta 1
132 presiones de palanca, bajo 27 a 30 horas de privación de agua. Sin embargo, se
observaron dos pequeñas disminuciones en la tasa de respuesta (de 780 a 676 y de 1 140
a 1 132), posiblemente asociadas a fatiga o saciedad momentánea durante la tarea. Aun
así, la tendencia general se mantuvo ascendente.
Tabla 1:
Resultados del efecto del programa de razón fija (RF) en la
adquisición de conductas aprendidas de sujetos simulados según
su peso (bajo peso, peso promedio, sobrepeso).
Resultados del objetivo 2:
Rata Virtual 1 (BP): Arsenios / Peso 190 gr
Rata Virtual 2 (PP): Rush / Peso 260 gr
Rata Virtual 3 (SP): Count / Peso 300 gr
En el programa de razón variable (RV) los tres sujetos con bajo peso, peso
promedio y sobrepeso, mostraron un aumento constante en la presión
de palanca a lo largo de las cinco sesiones. El sujeto de bajo peso pasó de
334 a 973 respuestas, evidenciando un aprendizaje gradual; el de peso
promedio aumentó de 441 a 1 680 respuestas, mostrando un patrón más
acelerado; y el de sobrepeso registró el incremento más alto, de 688 a 2
113 respuestas, influido por un mayor nivel de privación. En general, todos
los organismos respondieron más a medida que avanzaban las sesiones,
confirmando que el programa RV favorece la persistencia y la motivación,
especialmente en sujetos con mayor privación del reforzador, en
concordancia con los principios del condicionamiento operante.
Tabla 2:
Resultados de efecto del programa de razón variable (RV) en la
adquisición de conductas aprendidas en sujetos simulados según
su peso (bajo peso, peso promedio, sobrepeso).
Resultados del objetivo 3:
Rata Virtual 1 (BP): Extreme / Peso 150 gr
Rata Virtual 2 (PP): Erudite / Peso 260 gr
Rata Virtual 3 (SP): Caesar / Peso 330 gr
En el programa de reforzamiento continuo (CRF), los tres sujetos
mostraron un aprendizaje rápido debido a que cada respuesta correcta
fue reforzada. El sujeto de bajo peso mantuvo entre 148 y 149 presiones
por sesión, mostrando una asociación rápida pero poco persistente. El
sujeto de peso promedio respondió entre 235 y 248 veces, con un
desempeño más activo pero estable y predecible, propio del CRF. El
sujeto con sobrepeso presentó la mayor frecuencia, entre 271 y 326
respuestas, impulsado por mayores horas de privación. En general, el CRF
produjo una adquisición rápida pero menos resistente al cambio, ya que
la conducta dependió directamente de la entrega constante del refuerzo.
Tabla 3:
Resultados del efecto del programa de reforzamiento continuo
(CRF) en la adquisición de conductas aprendidas en sujetos
simulados según su peso (bajo peso, peso promedio, sobrepeso).
Discusion :
Coincidencias con los antecedentes sobre el efecto Coincidencias con estudios sobre aprendizaje
de los programas de reforzamiento: rápido en CRF:
Uno de los hallazgos más claros de nuestro estudio fue que Otro de nuestros resultados fue que el
el programa de razón variable (VR) produjo la mayor cantidad reforzamiento continuo (CRF) generó una
de respuestas y la conducta más estable en los tres tipos de adquisición rápida pero con valores más bajos que
sujetos (bajo peso, peso promedio y sobrepeso). Esto los programas intermitentes. Este resultado es
coincide con lo que plantean Gutiérrez y Escobar (2022), coherente con Aguilar Rodríguez (2023), quien
quienes encontraron que la variabilidad del reforzamiento mencionó que el CRF facilita el aprendizaje inicial
favorece una conducta más persistente y flexible. porque cada respuesta recibe un reforzador
Comparación con estudios sobre pausas y
patrones de respuesta:
En el programa de razón fija (FR), nuestros sujetos
mostraron incrementos progresivos en la cantidad de
respuestas, pero también pequeñas caídas o pausas
breves, especialmente en el sujeto de sobrepeso. Esto
coincide con lo descrito por Herrnstein et al. (2024),
quienes explican que en este tipo de programa aparece
la “pausa post-reforzamiento”, un periodo breve en el
que el sujeto deja de responder después de recibir el
reforzador.
Discusion :
Relación entre nuestros resultados y el reforzamiento Confirmación del valor del uso de sujetos
cualitativamente variado: simulados:
Revolledo (2022) mostró que la variación en el reforzador Finalmente, el comportamiento observado en nuestras
incrementa la estabilidad y la ejecución en cadenas ratas virtuales coincide con patrones documentados en
conductuales. Aunque nuestro reforzador no varió estudios con animales reales, lo cual respalda lo
cualitativamente, sí hubo cambios en la estructura del mencionado por Aldarondo et al. (2024) y Manolov (2025):
los ambientes virtuales pueden reproducir con alta
programa de reforzamiento, y nuestros resultados en VR
fidelidad el comportamiento operante, permitiendo
reflejan un efecto similar al reportado por este autor: mayor
estudiar patrones reales sin necesidad de animales vivos.
estabilidad, persistencia y un patrón continuo de respuesta.
Aporte del estudio respecto al peso del sujeto:
Nuestros resultados sugieren que el peso
interactúa con el programa de
reforzamiento para intensificar la
conducta, lo cual abre espacio a futuras
investigaciones.
Conclusiones:
Existe un efecto significativo de los programas de
reforzamiento en particular de razón variable en la
adquisición de conductas aprendidas con sujetos de
sobrepeso; en comparación con las técnicas de razón fija y
reforzamiento continuo.
Se concluye que la razón fija muestra un efecto significativo
en adquisición de conductas aprendidas de sujetos con
sobrepeso en comparación con los de bajo peso y peso
promedio.
Se concluye que existe un efecto significativo de Razón
variable en la adquisición de conductas aprendidas en
sujetos de sobrepeso; en comparación de bajo peso y peso
promedio.
Se encontró un efecto significativo de reforzamiento
continuo en la adquisición de conductas aprendidas de
sujetos simulados de sobrepeso; en comparación con peso
promedio y bajo peso.
Recomendaciones:
Se recomienda expandir el modelo de simulación
para incluir la comparación de los programas de
reforzamiento de Intervalo Fijo (FI) e Intervalo
Variable (IV)
Se sugiere manipular en el programa CyberRat la
inclusión en la colonia o la caja de Skinner virtual más
de una rata virtual para mayor precisión de los
resultados.
Se recomienda que futuras investigaciones
controlen de manera más estricta las horas de
privación del reforzador.
ANEXO:
ANEXO:
Y COMO DIJO M
I EX
TERMINAMOS
!
GRA C IA S,
CUAL Q UIE R
DA C O N EL
DU
PRO FE S O R