Informe Final
Informe Final
PRESENTADO POR:
DAYANA ABANTO CASTRO
ASTRID BERROSPI TINOCO
ALIZE CUBA ROJAS
MARIBEL CHOCCE CONDORI
YERALDIN HINOSTROZA RODRÍGUEZ
KAREN INGA RAMÍREZ
HUANCAYO, PERÚ
2026
2
La psicología experimental constituye una de las áreas fundamentales para comprender los
condicionamiento operante propuesto por Skinner (1953) ha permitido explicar cómo las
consecuencias de una respuesta influyen en la probabilidad de que esta vuelva a ocurrir. Según esta
De acuerdo con este enfoque, las conductas seguidas por consecuencias favorables o
1953). Esta perspectiva ha permitido explicar una amplia variedad de comportamientos humanos y
animales, convirtiéndose en una de las bases teóricas más importantes para el estudio científico del
determinan las condiciones bajo las cuales se administra un reforzador. Entre ellos destacan los
programas de razón fija (FR) y razón variable (VR), los cuales han demostrado producir patrones
después de una cantidad constante y predecible de respuestas, mientras que el programa de razón
promedio establecido.
comportamiento. Los programas de razón variable han mostrado una mayor capacidad para
mantener conductas durante periodos prolongados, mientras que los programas de razón fija
generan respuestas intensas, pero con intervalos de pausa más marcados (Mazur, 2017). Estos
hallazgos han sido aplicados en diversos contextos, como la educación, las organizaciones, en el
programas establecen las reglas mediante las cuales se administra un reforzador después de la
emisión de una respuesta determinada. Skinner (1953) y Ferster y Skinner (1957) demostraron que
no solo la presencia del reforzamiento es importante, sino también la forma en que este se
CyberRat, software diseñado para reproducir procedimientos propios del laboratorio conductual
emitidas, constituyendo una alternativa ética y accesible frente al uso de animales reales.
reforzamiento de razón fija y razón variable sobre la frecuencia de respuesta de presión de palanca
en CyberRat, con la finalidad de determinar cuál de ellos genera una mayor frecuencia de respuestas
condicionamiento operante.
4
Problema general:
CyberRat?
Problemas específicos:
Objetivo general: Comparar los efectos de los programas de reforzamiento de Razón Fija 5
simulador CyberRat.
Objetivos específicos:
sobre cómo reacciona la conducta de un sujeto ante exigencias bajas de reforzamiento, comparando
5
directamente los programas de Razón Fija 5 (RF-5) y Razón Variable 5 (RV-5). La relevancia de
este estudio radica en que nos permitirá comprobar si los conceptos clásicos del condicionamiento
operante como la pausa que hace la rata después de recibir el premio o la constancia al presionar la
palanca se cumplen con la misma exactitud dentro de un entorno virtual. Esto ayuda a entender
Desde el punto de vista práctico, los principales beneficiados con este estudio somos los
obtenemos un modelo claro y real de cómo analizar datos de la conducta sin la necesidad de usar
animales vivos, respetando las normas éticas actuales. Además, nos ayuda a ver cómo las reglas de
fijeza y variabilidad que estudiamos en los libros se pueden observar y medir en la pantalla,
sirviendo como una base práctica para entender conductas humanas complejas más adelante (como
software CyberRat como una técnica y procedimiento moderno de laboratorio virtual. Este método
nos permite registrar y cuantificar cada presión de palanca de manera exacta y automática,
eliminando los errores que podríamos cometer si contáramos las conductas a mano. De esta manera,
se demuestra que los simuladores digitales son herramientas confiables, ordenadas y seguras para
sobre los procesos conductuales y farmacológicos implicados. El estudio se desarrolló con seis
se registraron variables como la frecuencia de respuestas, los intervalos entre respuestas y los
Los resultados evidenciaron que los programas de reforzamiento influyen en los patrones
de respuesta emitidos por las ratas. Bajo los programas de razón progresiva se observaron
incrementos en la cantidad de respuestas requeridas para obtener el reforzador, así como cambios
en la frecuencia y persistencia de la conducta operante. Sin embargo, los autores concluyeron que
tanto los programas de razón fija como los de razón progresiva proporcionan información
relacionados con los efectos del reforzador y las condiciones del programa de reforzamiento.
Este estudio resulta relevante para la presente investigación debido a que evidencia cómo
operante en ratas, aspecto que también se analiza al comparar los programas de Razón Fija 5 (RF
mediante el uso de simuladores virtuales, así como determinar su nivel de usabilidad y aceptación
por parte de los estudiantes. El estudio se desarrolló bajo un diseño cuasi experimental con pre y
criterio establecido por la Escala de Usabilidad de Sistemas (SUS). Los autores concluyeron que
los simuladores virtuales constituyen una herramienta eficaz para el entrenamiento de competencias
controlados e interactivos.
Este antecedente resulta relevante para la presente investigación debido a que respalda el
condiciones controladas para el estudio de la conducta operante y los efectos de distintos programas
differentially affect learning in neuronal operant conditioning in rats", evaluaron el impacto de los
con sujetos animales (ratas Wistar) en estado de privación hídrica, divididos en condiciones de
Razón Fija (RF) y Razón Variable (RV). El procedimiento consistió en una fase inicial de
condicionamiento conductual clásico donde los programas variables sostienen tasas de respuesta
más elevadas, las frecuencias de disparo neuronal aumentaron significativamente bajo el programa
de Razón Fija, pero no bajo el de Razón Variable. Este estudio constituye un antecedente teórico
de alto valor para la presente investigación, puesto que resalta la universalidad de los programas de
razón para moldear respuestas biológicas en roedores, al mismo tiempo que establece una distinción
celular interna.
experimentos en los que los animales respondían mediante presión de palanca bajo diferentes
emitidas.
9
existían programas que reforzaban dicha variabilidad. Los autores concluyeron que las
Este antecedente aporta evidencia para la presente investigación, ya que confirma que las
sujetos experimentales, permitiendo comprender mejor las diferencias observadas entre los
Bramido y Lattal (2023) realizaron una investigación con el objetivo de analizar la conducta
de elección bajo programas concurrentes de reforzamiento de razón fija (FR) y razón variable (VR).
reforzamiento.
Los resultados evidenciaron que los programas de razón variable produjeron una mayor
respecto a los programas de razón fija. Asimismo, se observó que el tipo de programa influye
significativamente en la distribución de las respuestas emitidas por los sujetos experimentales. Los
Este antecedente resulta pertinente para la presente investigación porque demuestra que los
programas de razón fija y razón variable generan diferencias en la frecuencia y distribución de las
respuestas conductuales, aspecto que también se analiza al comparar los programas RF-5 y RV-5
extinguida en función de las consecuencias que produce en el entorno (Skinner, 1953). A diferencia
del condicionamiento clásico o respondiente, donde el sujeto reacciona ante estímulos antecedentes
opera activamente sobre el medio para generar un cambio (Skinner, 1974). El principio fundamental
dictamina que aquellas respuestas que son seguidas por consecuencias biológicamente relevantes
Para explicar el mecanismo a través del cual las consecuencias modifican la conducta, se
del análisis conductual aplicado a laboratorios, la adecuada sincronización de esta triple relación es
lo que permite el moldeamiento y control preciso del comportamiento del sujeto experimental.
requiere ocurrir de manera continua. Los programas de reforzamiento intermitente se definen como
aquellas reglas de contingencia donde solo se refuerzan algunas de las respuestas emitidas por el
organismo, dejando otras sin consecuencia biológica (Staddon & Cerutti, 2003, como se cita en
Dentro de la taxonomía del análisis de la conducta, estos programas se bifurcan en dos grandes
categorías: los programas de intervalo, gobernados por el paso del tiempo, y los programas de
razón, gobernados estrictamente por el conteo acumulativo de las respuestas del sujeto. Estos
y variables.
las respuestas emitidas por el organismo, estableciendo que la entrega del estímulo consecuente
(Domjan, 2016). A diferencia de los programas de intervalo, donde la variable crítica es el mero
transcurso del tiempo, en las contingencias de razón el factor determinante es la tasa acumulada de
la acción operante, lo que significa que la velocidad de obtención del reforzador depende
directamente de la frecuencia del sujeto. Dentro de esta categoría, la distribución del reforzador
puede estructurarse mediante dos modalidades cardinales: la razón fija, donde el requerimiento
12
emite una cantidad específica y constante de respuestas. Por ejemplo, en un programa RF-10, el
sujeto recibe el reforzador cada diez respuestas emitidas. Este programa suele generar elevadas
tasas de respuesta acompañadas de una pausa posterior al reforzamiento, conocida como pausa post
reforzamiento, debido a que el organismo discrimina el momento en que deberá volver a responder
promedio de diez. Este programa produce tasas elevadas y constantes de respuesta, además de una
mayor resistencia a la extinción, debido a que el organismo no puede anticipar cuándo ocurrirá el
reforzamiento sobre el comportamiento. Según Catania (2013), la tasa de respuesta hace referencia
al número de veces que una conducta es emitida durante un periodo determinado de tiempo. Esta
13
manipulaciones experimentales.
investigación conductual. Consiste en la acción ejecutada por el sujeto experimental para obtener
esta conducta constituye un indicador válido de aprendizaje operante, debido a que permite registrar
con precisión la frecuencia, persistencia y variabilidad de las respuestas emitidas bajo diferentes
programas de reforzamiento.
Entre estas herramientas destaca CyberRat, software diseñado para facilitar el aprendizaje
sujetos experimentales.
complejos.
14
de razón fija y razón variable. que establecen la entrega del aplicación de programas RF y
sobre la probabilidad de
ocurrencia de la conducta
operante.
a contingencias de experimental.
reforzamiento.
15
Hipótesis general:
Hipótesis específica 1:
El sujeto expuesto al programa de Razón Fija 5 (RF-5) mostrará una frecuencia de respuesta
Hipótesis específica 2:
ya que su propósito es medir datos numéricos exactos para ampliar el conocimiento teórico sobre
variable independiente (los programas de Razón Fija 5 y Razón Variable 5) para observar y analizar
sus efectos directos sobre la variable dependiente (la frecuencia de respuestas de presión de
palanca).
seleccionaron los dos sujetos experimentales virtuales, los cuales contaban con un periodo
programado de 30 horas de privación de agua para asegurar el estado de motivación biológica (sed)
se programó al primer sujeto bajo la condición de Razón Fija 5 (RF-5) y al segundo sujeto bajo la
Etapa 2: Ejecución de las sesiones experimentales. Una vez configurados los programas, se
iniciaron las sesiones de simulación de manera controlada. Cada sesión tuvo una duración continua
de 20 minutos, tiempo durante el cual el software registró de forma automática cada palancazo
emitido por las ratas virtuales y cada entrega del estímulo reforzador, operando sin interrupciones
externas.
17
herramientas del mismo software para extraer los reportes estadísticos y los gráficos del registro
acumulativo. Estos datos numéricos fueron trasladados a hojas de cálculo para ser organizados y
Los sujetos experimentales fueron dos ratas virtuales (Sujeto A, sujeto B ), del software
CyberRat, utilizadas como modelo de simulación para el estudio de los principios del
durante seis sesiones experimentales, mientras que el Sujeto B fue sometido a un programa de
reforzamiento de razón variable durante seis sesiones experimentales. Ambos sujetos fueron
recolección de datos
cronológica y detallada las conductas emitidas por los sujetos experimentales virtuales durante el
observados.
consignaron las observaciones relevantes sobre la conducta de los sujetos experimentales virtuales
antes, durante y después de la obtención del reforzador, describiendo la secuencia de los eventos
cual permitió programar los esquemas de reforzamiento RF-5 y RV-5 y registrar de manera
reportes generados por el simulador constituyeron la fuente principal para el análisis de los
experimentación, el presente estudio no utilizó sujetos biológicos vivos (ratas reales). En su lugar,
se empleó el software de simulación virtual CyberRat, lo cual responde de manera estricta a las
Principio de Reemplazo (Las Tres R): La ciencia experimental moderna se rige bajo el
principio internacional de las "Tres R" (Reemplazo, Reducción y Refinamiento). Este trabajo
cumple directamente con el criterio de Reemplazo total, ya que sustituye el uso de un organismo
vivo por un modelo digital avanzado. Esto permite alcanzar los objetivos de aprendizaje sobre los
programas de reforzamiento sin someter a un animal real a situaciones de estrés, privación de agua
o confinamiento.
N° 30407 (Ley de Protección y Bienestar Animal) del Perú. Esta ley señala que en los centros de
Código de Ética APA y del Colegio de Psicólogos del Perú: Se consideraron los principios
sujetos experimentales. Al utilizar un entorno virtual, se garantiza una práctica científica 100%
libre de daño físico o biológico, cumpliendo con la responsabilidad social y ética que se nos exige
Integridad y Rigor Académico: Más allá del bienestar animal, el equipo de investigación
respetó los derechos de autor del software proporcionado por la universidad. Asimismo, se
garantiza la honestidad científica en el manejo de los datos, utilizando únicamente los registros
numéricos reales y automáticos que generó el simulador durante las sesiones de 20 minutos, sin
4.1 Comparación de la frecuencia total bajo el programa de Razón Fija y Razón Variable
programas de reforzamiento por el Sujeto A y Sujeto B durante las seis sesiones experimentales.
Tabla 1
Sesión 2 26 13
Sesión 4 40 7
Sesión 5 64 14
Sesión 6 115 4
presentó una mayor cantidad de respuestas en todas las sesiones en comparación con el Sujeto B.
Ambos sujetos evidencian un patrón similar de variabilidad: las frecuencias más altas se registraron
en la Sesión 1 y la Sesión 3, con 265 y 239 respuestas para el Sujeto A, y 172 y 203 para el Sujeto
ambos casos, siendo esta caída mucho más pronunciada en el Sujeto B, que pasa de 203 respuestas
21
más estables en las sesiones intermedias y finales, con un repunte en la Sesión 6 con 115 respuestas.
ambos sujetos y entre condiciones, con una tendencia general a la baja más acentuada en el Sujeto
B.
Figura 1
Tabla 2
Frecuencia de respuestas registradas por el Sujeto A durante las seis sesiones experimentales bajo
el programa RF-5.
Sesiones Sujeto A
Sesión 1 265
Sesión 2 26
Sesión 3 239
Sesión 4 40
Sesión 5 64
Sesión 6 115
A bajo el programa RF-5 durante 6 sesiones. Se observa un patrón fluctuante a lo largo de las
sesiones. Las frecuencias más elevadas se registraron en la Sesión 1 y la Sesión 3, con 265 y 239
respuestas, seguida de una recuperación parcial en la Sesión 3. A partir de ahí, las respuestas
vuelven a disminuir en la Sesión 4 con 40 respuestas, para luego mostrar una tendencia ascendente
moderada en las Sesiones 5 y 6, alcanzando 64 y 115 respuestas. En conjunto, los datos indican
una alta variabilidad intra-sujeto en la emisión de respuestas bajo RF-5, con dos picos marcados al
inicio y en la parte media del registro, y una recuperación gradual hacia el final de las sesiones.
23
Figura 2
La Tabla 3 presenta la frecuencia de respuestas registradas por el Sujeto B durante las seis
Tabla 3
Sesión 1 172
Sesión 2 13
Sesión 3 203
Sesión 4 7
Sesión 5 14
Sesión 6 4
Nota. Elaboración propia a partir de los registros obtenidos en CyberRat.
24
bajo el programa RV-5 en 6 sesiones. Al igual que en el caso anterior, se evidencia una alta
Sesión 3, con 172 y 203 respuestas respectivamente. Sin embargo, a partir de la Sesión 2 se observa
una disminución drástica, con solo 13 respuestas, y esta tendencia a la baja se mantiene y acentúa
6. En conjunto, los datos sugieren que bajo RV-5 el Sujeto B tuvo dos momentos de alta tasa de
respuesta al inicio y en la parte media, seguidos de un descenso sostenido y marcado hacia el final
del registro.
Figura 3
Capítulo V: Discusión
Objetivo general. El presente estudio tuvo como objetivo comparar los efectos de los
programas de reforzamiento de Razón Fija 5 (RF-5) y Razón Variable 5 (RV-5) sobre la frecuencia
evidenciaron que el sujeto expuesto al programa de Razón Fija 5 emitió un total de 749 respuestas
durante las seis sesiones experimentales, mientras que el sujeto sometido al programa de Razón
Variable 5 registró un total de 413 respuestas. Estos hallazgos indican que, bajo las condiciones del
presente estudio, el programa RF-5 produjo una mayor frecuencia de respuestas que el programa
RV-5, rechazándose la hipótesis planteada inicialmente, la cual proponía que el programa de razón
propuesta por Skinner (1953), quien sostiene que la conducta aumenta su probabilidad de
ocurrencia cuando es seguida por consecuencias reforzantes. Desde esta perspectiva, no solo es
importante la presencia del reforzador, sino también la forma en que este es administrado.
Asimismo, Ferster y Skinner (1957) explican que los programas de razón fija generan tasas
elevadas de respuesta debido a que el sujeto aprende rápidamente la relación constante entre el
contraste, Reynolds (1975) señala que los programas de razón variable suelen producir respuestas
Los resultados obtenidos coinciden con la investigación desarrollada por Song et al.
(2019), quienes evaluaron el efecto de los programas de reforzamiento de razón fija y razón variable
26
sobre el aprendizaje operante en ratas. Los autores encontraron que las frecuencias de respuesta
aumentaron significativamente bajo el programa de razón fija, mientras que el programa de razón
el programa RF-5 generó una frecuencia considerablemente mayor que el programa RV-5, lo cual
evidencia que las características del esquema de reforzamiento influyen directamente sobre la
conducta operante.
Asimismo, los resultados también guardan relación con lo reportado por Bramido y
Lattal (2023), quienes concluyeron que los programas de razón fija y razón variable producen
distribución de las respuestas emitidas por los sujetos experimentales. Aunque en dicho estudio no
se estableció que un programa fuera superior al otro en todas las condiciones experimentales, los
Reynolds (1975), quien plantea que los programas de razón variable generalmente mantienen tasas
estudio ocurrió lo contrario, ya que el programa RF-5 produjo una frecuencia total superior. Esta
experimentales de veinte minutos cada una, lo cual probablemente no permitió que el patrón
27
configuración específica del programa RV-5 utilizada en el simulador pudo influir sobre la
sujeto expuesto al programa de Razón Fija 5 emitió un total de 749 respuestas durante las seis
sesiones experimentales, registrándose la mayor frecuencia en la primera sesión con 265 presiones
de palanca. Posteriormente, las respuestas disminuyeron durante las siguientes sesiones, aunque
continuaron mostrando una frecuencia superior a la obtenida por el sujeto sometido al programa de
razón variable.
Estos resultados son consistentes con lo planteado por Ferster y Skinner (1957), quienes
sostienen que los programas de razón fija producen elevadas tasas de respuesta debido a que el
sujeto conoce exactamente cuántas respuestas debe emitir para obtener el reforzador. Una vez
recibida la recompensa, suele aparecer una pausa post-reforzamiento antes de reiniciar nuevamente
Del mismo modo, Skinner (1953) señala que cuando el reforzamiento ocurre bajo reglas constantes
Los resultados obtenidos coinciden con el estudio realizado por Tsibulsky y Norman
frecuencia y persistencia de la conducta operante. Los autores concluyen que las características del
programa de reforzamiento determinan la forma en que el organismo organiza sus respuestas para
maximizar la obtención del reforzador. Esta situación también pudo observarse en el presente
28
estudio, donde el sujeto expuesto al programa RF-5 respondió con mayor frecuencia que el sujeto
Reed (2023), quien encontró que las características propias del programa de reforzamiento
que cualquier modificación en las contingencias del reforzamiento altera la forma en que los sujetos
resultados obtenidos en el presente estudio, ya que evidencia que las diferencias observadas entre
las sesiones no dependen únicamente del reforzador, sino también de la estructura del programa
aplicado.
La coincidencia entre estas investigaciones podría explicarse porque tanto en los estudios
Asimismo, el estado de privación hídrica programado antes del inicio de cada sesión incrementó la
motivación del sujeto para responder continuamente con el propósito de obtener agua,
En relación con el segundo objetivo específico, los resultados mostraron que el sujeto
sometido al programa de Razón Variable 5 emitió un total de 413 respuestas durante las seis
sesiones experimentales, registrándose la mayor frecuencia en la tercera sesión con 203 presiones
29
de palanca. Aunque el sujeto mantuvo respuestas durante todas las sesiones, la frecuencia total fue
Desde el punto de vista teórico, Reynolds (1975) sostiene que los programas de razón
variable generan patrones de respuesta elevados y constantes debido a que el sujeto desconoce el
momento exacto en que aparecerá el reforzador. De manera similar, Domjan (2016) explica que la
Lattal (2023), quienes demostraron que los programas de razón variable generan patrones
conductuales distintos respecto a los programas de razón fija y que las contingencias de
sujetos experimentales. Del mismo modo, Song et al. (2019) señalan que los diferentes programas
No obstante, existe una discrepancia importante entre la teoría clásica y los resultados
frecuencia de respuestas esperada. Una posible explicación radica en las características del
simulador CyberRat, el cual representa una simulación computacional del comportamiento animal
y, por tanto, puede responder de manera diferente a un organismo vivo. Asimismo, el número
limitado de sesiones experimentales pudo impedir que el patrón estable propio del programa de
específica de las razones variables programadas durante la simulación haya influido sobre la
Tanto la evidencia teórica como los antecedentes revisados respaldan que las características propias
Razón
de Razón Variable 5, resultado que coincide con algunos antecedentes experimentales y difiere
razón y condiciones metodológicas diversas que permitan ampliar la comprensión del aprendizaje
psicología experimental.
31
6.1. Conclusiones
determinó que el programa de reforzamiento de Razón Fija 5 (RF-5) produjo una mayor frecuencia
condiciones del presente estudio, el programa RF-5 fue el que generó una mayor frecuencia de
Respecto al primer objetivo específico, se concluye que el programa de Razón Fija 5 (RF-
Variable 5 (RV-5) permitió mantener la conducta operante; sin embargo, la frecuencia total de
respuestas fue inferior a la obtenida con el programa RF-5, lo que indica que, en las condiciones
del presente estudio, este esquema de reforzamiento no produjo la mayor tasa de respuestas
esperada.
32
6.2. Recomendaciones
2. Se recomienda incorporar diferentes valores de razón (por ejemplo, RF-10, RF-20, RV-10
o RV-20) para analizar si las variaciones en los requisitos de respuesta producen cambios
como los programas de intervalo fijo e intervalo variable, con el propósito de ampliar el
aprendizaje.
de competencias investigativas.
estabilidad del programa, reduciendo errores, bloqueos y fallos técnicos durante las prácticas
las actividades, asimismo brindar soporte técnico y actualizaciones periódicas, para corregir
Referencias
[Link]
[Link]
Carvalho, L. C., dos Santos, L., Regaço, A., Barbosa, T. B., da Silva, R. F., de Souza, D. G., &
[Link]
Domjan, M. (2016). The principles of learning and behavior (7th ed.). Cengage Learning.
Iversen, I. H. (1993). Techniques for establishing schedules with wheel running as reinforcement
Martin, G., & Pear, J. (2019). Behavior modification: What it is and how to do it (11th ed.).
Routledge.
Pierce, W. D., & Cheney, C. D. (2017). Behavior analysis and learning (6th ed.). Routledge.
34
Reed, P. (2023). Efecto del refuerzo señalado en la variabilidad de la respuesta. Revista de análisis
Crofts.
Song, W., et al. (2019). Reinforcement schedules differentially affect learning in neuronal operant
Tsibulsky, V.L., Norman, A.B. The progressive ratio and fixed ratio 1 schedules of cocaine
selfadministration in rats convey the same information. Sci Rep 12, 19683 (2022).
[Link]