1
UNIVERSIDAD DE HUANUCO
FACULTAD DE CIENCIAS DE LA SALUD
ESCUELA ACADEMICA DE PSICOLOGIA
CONDICIONAMIENTO OPERANTE – APRENDIZAJE ESPACIAL
Curso:
PSICOLOGIA DEL APRENDIZAJE II
Integrantes:
- LIVIA ESTRADA ALEXANDER (96%)
- ROSALES ALBORNOZ KIARA SARAHY (96%)
- SILVA PEÑA BELEN MARYCIELO (96%)
- REYES ALEJO ROMER BENJAMIN (96%)
- ESTRELLA PULIDO ALEXANDRA XIMENA (3%)
Docente:
PSICO. RUIZ PEÑA YESSICA FIORELLA
HUÁNUCO – PERÚ
2
INTRODUCCION
El aprendizaje es un proceso fundamental mediante el cual los organismos incorporan nuevas
conductas a partir de la interacción con su entorno. Entre las formas más estudiadas de
aprendizaje se encuentra el condicionamiento operante, una teoría desarrollada por B. F.
Skinner, quien demostró que el comportamiento puede modificarse en función de las
consecuencias que lo siguen, ya sea a través de recompensas o castigos. En otras palabras,
una acción tiende a repetirse o extinguirse según las contingencias que la acompañen.
El presente estudio tiene como propósito aplicar los principios del condicionamiento operante
en un experimento realizado con una rata, empleando un laberinto como instrumento para
evaluar su proceso de adquisición conductual. El objetivo principal fue reforzar positivamente al
animal cada vez que completara correctamente el recorrido, proporcionándole una recompensa
al llegar a la meta. De este modo, se buscó examinar si el roedor lograba aprender la ruta
adecuada mediante la repetición y la asociación entre su conducta y la consecuencia favorable.
La presente investigación también se fundamenta en la teoría del encadenamiento, un principio
del condicionamiento operante que explica cómo una conducta compleja puede formarse a
partir de una secuencia ordenada de respuestas simples que se enlazan entre sí. En este
proyecto, el laberinto de cuatro niveles permitió observar cómo la rata albina macho no solo
aprendía a descender cada tramo de manera aislada, sino que progresivamente integraba
estos pasos en una cadena conductual coherente y funcional.
Cada descenso exitoso reforzaba el siguiente, de modo que el comportamiento final, completar
todo el recorrido, surgió como el resultado de múltiples respuestas encadenadas. El progreso
observado sesión a sesión confirma que el encadenamiento es un proceso real, medible y
efectivo, donde la ejecución de una acción sirve como estímulo discriminativo para la siguiente.
Así, este experimento demuestra cómo una conducta compleja puede construirse mediante
reforzamientos sistemáticos, validando el encadenamiento como un mecanismo fundamental
en el aprendizaje animal.
3
I. BASES TEORICAS
El aprendizaje es un proceso mediante el cual los seres vivos modifican su conducta
a partir de la experiencia. Dentro del enfoque conductista, autores como Edward
Thorndike y B. F. Skinner han explicado cómo los estímulos y las consecuencias
influyen directamente en el comportamiento. Thorndike, mediante su Ley del Efecto,
señaló que las acciones seguidas de resultados satisfactorios tienden a repetirse.
Más adelante, Skinner amplió estos principios a través del condicionamiento
operante, demostrando que los refuerzos y castigos pueden moldear de manera
sistemática la conducta.
Estas propuestas teóricas permiten comprender cómo un organismo en este caso,
una rata albina puede aprender a recorrer un laberinto cuando recibe un refuerzo
positivo al ejecutar la respuesta correcta. A través de la repetición y la asociación
entre conducta y consecuencia, el animal logra adquirir y fortalecer la ruta
adecuada.
B.F. Skinner
Burrhus Frederic Skinner, destacado representante del conductismo, formuló la
teoría del condicionamiento operante, la cual plantea que el comportamiento de un
organismo está determinado por las consecuencias que recibe después de
ejecutarlo. De acuerdo con su propuesta, una conducta tiende a incrementarse
cuando es seguida por un reforzador positivo como alimento o estímulos agradables
o por un reforzador negativo, que implica la eliminación de un estímulo aversivo. Por
el contrario, la probabilidad de que una conducta se repita disminuye cuando esta se
acompaña de un castigo.
4
A través de sus experimentos con animales, especialmente ratas y palomas, Skinner
demostró que los organismos pueden aprender nuevas conductas si estas son
reforzadas de manera contingente. Utilizó para ello la conocida caja de Skinner, un
dispositivo en el que los animales aprendían a presionar una palanca para obtener
comida. Este enfoque resulta aplicable al caso de la rata en el laberinto, ya que el
propósito es que el animal aprenda a completar el recorrido con mayor rapidez
mediante la administración de un refuerzo positivo como alimento al llegar a la meta
fortaleciendo así la conducta deseada.
Edward Thorndike
Edward Thorndike es considerado uno de los precursores fundamentales en el
estudio científico del aprendizaje animal y un antecedente directo del
condicionamiento operante. Su contribución más influyente, la denominada Ley del
Efecto, plantea que las respuestas que producen consecuencias satisfactorias
incrementan su probabilidad de ocurrencia futura, mientras que aquellas asociadas
a resultados desfavorables tienden a debilitarse o desaparecer.
Para sustentar esta formulación, Thorndike diseñó sus célebres “cajas-problema”,
en las que gatos debían resolver mecanismos simples como presionar una palanca
o tirar de un cordón para lograr salir y acceder a alimento. A medida que los
ensayos se repetían, la latencia para emitir la respuesta correcta disminuía
progresivamente, mostrando que el aprendizaje se producía a través de un proceso
gradual de ensayo y error.
Las implicancias de estos hallazgos sirven como sustento teórico para el
experimento realizado con el sujeto de nombre “Stuard”, pues demuestran que los
organismos pueden aprender secuencias de respuestas complejas cuando ciertas
acciones son reforzadas de forma consistente. Aunque B. F. Skinner posteriormente
formalizó un modelo más sistemático del condicionamiento operante, ambos autores
coinciden en que la conducta se organiza en función de sus consecuencias, lo que
5
explica por qué un sujeto es capaz de adquirir patrones estables como recorrer un
laberinto multinivel mediante reforzamiento positivo y encadenamiento de
respuestas.
II. ANTECEDENTES
El condicionamiento operante ha sido objeto de extensas investigaciones en
contextos internacionales, nacionales y locales, consolidándose como uno de los
procedimientos más eficaces para la modificación conductual y la adquisición
progresiva de repertorios complejos. Diversos estudios han demostrado que este
tipo de aprendizaje permite moldear conductas específicas mediante la
manipulación sistemática de reforzadores y consecuencias, lo que lo convierte en
una herramienta esencial dentro de la psicología experimental.
EN EL NIVEL LOCAL
Entre las investigaciones desarrolladas en el contexto local , destaca el trabajo de
Solórzano Campo et al. (2015) en la Universidad de Huánuco, titulado “Efecto del
programa para lograr la conducta operante de bajar la palanca”. En este estudio se
emplearon dos ratas albinas (Mus musculus), las cuales fueron colocadas en una
caja operante tipo Skinner que incluía una palanca y un dispensador de alimento.
Para modelar la conducta, los autores implementaron un programa de reforzamiento
de intervalo variable, mediante el cual las ratas recibían comida cada vez que
presionaban la palanca dentro del intervalo establecido. Adicionalmente, en ciertos
momentos se aplicó castigo positivo para reducir respuestas no funcionales y
fortalecer la conducta objetivo.
6
Como resultado, ambas ratas lograron adquirir y mantener de forma estable la
conducta de presionar la palanca, mostrando incrementos progresivos en la tasa de
respuesta y una disminución en conductas distractoras. Este estudio constituye una
evidencia significativa de la eficacia del condicionamiento operante en entornos
controlados, y además aporta datos relevantes sobre cómo la combinación de
reforzamiento y contingencias aversivas puede optimizar la adquisición de
respuestas instrumentalizadas.
EN EL NIVEL NACIONAL
En este estudio, Revolledo (2022) analiza cómo diferentes tipos de reforzadores
tanto constantes como cualitativamente variados influyen en la adquisición y
mantenimiento de una cadena conductual compleja en ratas albinas. El experimento
se desarrolló utilizando una caja operante equipada con múltiples componentes que
debían ejecutarse en secuencia, lo que permitió evaluar no solo la velocidad de
aprendizaje, sino también la solidez de la cadena bajo distintas condiciones de
reforzamiento.
El procedimiento incluyó fases de moldeamiento, reforzamiento diferencial y
posteriormente la implementación de programas de reforzamiento específicos para
cada segmento de la cadena conductual. Revolledo determinó que los reforzadores
cualitativamente variados (por ejemplo, alternancia entre tipos de comida o
intensidades del estímulo) incrementaban la tasa de respuesta y favorecían la
estabilidad de la conducta encadenada, en comparación con reforzadores
constantes que mantenían un refuerzo homogéneo a lo largo de todas las fases.
Los resultados muestran una contribución importante al análisis experimental del
comportamiento en contextos peruanos, pues demuestran que las cadenas
conductuales base fundamental en estudios complejos de aprendizaje operante
7
pueden ser moduladas con eficacia mediante variaciones en la calidad del
reforzador. Este estudio es especialmente relevante porque replica y fortalece
paradigmas clásicos del condicionamiento operante, ofreciendo evidencia aplicable
a investigaciones contemporáneas sobre encadenamiento, reforzamiento diferencial
y dinámica del control conductual en animales de laboratorio.
EN EL NIVEL INTERNACIONAL
Entre los modelos de laberintos más utilizados en la investigación con roedores se
encuentran diversas estructuras estandarizadas que permiten evaluar procesos
cognitivos específicos. Uno de los más clásicos es el laberinto en T, empleado para
estudiar patrones de elección, especialmente la alternancia espontánea. También
destaca el laberinto radial, desarrollado por Olton y Samuelson en 1976, cuyo
diseño en múltiples brazos facilita el análisis simultáneo de la memoria de trabajo y
de la memoria de referencia. Por otro lado, el Morris Water Maze (1981–1982)
constituye un paradigma fundamental para evaluar la memoria espacial mediante la
búsqueda de una plataforma oculta en un estanque de agua, mientras que el Barnes
Maze (1979) representa una alternativa menos aversiva, ya que permite examinar
las mismas capacidades sin exponer al animal a inmersión o estrés hídrico.
Asimismo, se han llevado a cabo investigaciones centradas en formas más
complejas de aprendizaje. Un ejemplo notable es el Time–Place learning, que
evidencia que especies como abejas y hormigas pueden integrar información
temporal y espacial para identificar lugares específicos vinculados a momentos
determinados del día. De manera paralela, los principios del condicionamiento
operante también han sido extendidos al comportamiento humano. En estudios
aplicados al deporte, como en jugadores de baloncesto, se ha observado que el uso
estratégico del reforzamiento modifica la selección espacial de jugadas y decisiones
8
tácticas durante el juego, mostrando la aplicabilidad del enfoque conductual en
contextos cotidianos y de alto desempeño.
III OBJETIVOS
Objetivo general:
Diseñar y poner en práctica un experimento sustentado en los principios del
condicionamiento operante con el propósito de analizar el proceso mediante el cual
un organismo en este caso, una rata adquiere la habilidad de resolver un laberinto a
través del uso de reforzadores positivos. La evaluación contempla variables como el
tiempo de ejecución, la frecuencia de errores y la progresión del aprendizaje a lo
largo de los ensayos. Este procedimiento se fundamenta en las aportaciones
teóricas de Edward Thorndike, particularmente su Ley del Efecto, y en el modelo de
condicionamiento operante propuesto por B. F. Skinner, quienes demostraron que la
conducta se fortalece o debilita en función de las consecuencias que la siguen.
OBJETIVO ESPECÍFICO:
• Implementar un programa de condicionamiento operante sustentado en refuerzos
positivos con el fin de moldear gradualmente la conducta de la rata, orientándola
hacia el cumplimiento adecuado de la tarea prevista dentro del laberinto.
• Determinar, mediante un registro sistemático y comparativo, cuántas sesiones
requiere la rata para recorrer el laberinto de forma precisa, sin cometer errores ni
retrocesos, identificando el momento en que se evidencia un aprendizaje estable y
una ejecución automatizada de la cadena conductual.
9
IV. HIPOTESIS
Hipótesis Nula (H₀)
El refuerzo positivo administrado mediante los principios del condicionamiento
operante no genera un cambio significativo en la conducta de la rata durante la
ejecución del laberinto. En este sentido, aun cuando se le proporcione un estímulo
reforzador (por ejemplo, alimento) al completar el recorrido, no se evidenciaría una
disminución relevante en el tiempo total, en la frecuencia de errores ni en la
eficiencia general de su desplazamiento. Bajo esta hipótesis, el desempeño de la
rata podría atribuirse a variables ajenas al reforzamiento, tales como exploración
espontánea, habituación al entorno o factores ambientales no controlados.
Hipótesis Alterna (H₁)
El refuerzo positivo aplicado dentro del marco del condicionamiento operante sí
produce un efecto significativo en la conducta de la rata al recorrer el laberinto. Esto
implica que, al recibir una recompensa contingente al logro de la respuesta objetivo,
la rata aprende progresivamente la secuencia adecuada, mostrando mejoras
sistemáticas en su tiempo de ejecución, disminución de errores y un patrón
conductual más dirigido y eficiente. En consecuencia, el aprendizaje observado se
interpretaría como producto directo de la asociación entre la conducta emitida y el
reforzador administrado.
10
V. VARIABLES
VARIABLE INDEPENDIENTE (VI)
Administración inmediata de un reforzador positivo, consistente en una semilla o un
pequeño trozo de fruta, otorgado cada vez que la rata ejecuta la conducta objetivo.
Este reforzador se entrega de manera contingente al comportamiento deseado,
específicamente cuando la rata inicia correctamente el recorrido en el punto de
partida y logra avanzar hasta la zona de meta dentro del laberinto.
VARIABLE DEPENDIENTE (VD)
Frecuencia de emisión de la conducta objetivo por parte de la rata dentro de un
periodo de tiempo predeterminado. Esta variable permite evaluar el impacto del
reforzamiento sobre la probabilidad de repetición de la conducta aprendida.
NÚMERO DE ACIERTOS
Cantidad de ocasiones en que la rata realiza de manera correcta la conducta
esperada, como por ejemplo identificar y seguir la ruta adecuada dentro del
laberinto, entrar en el compartimiento correspondiente o ejecutar la secuencia
conductual sin desviaciones.
NÚMERO DE ERRORES
Total, de veces en que la rata presenta conductas inadecuadas o no deseadas, tales
como ingresar en bifurcaciones incorrectas, retroceder sin motivo aparente,
11
detenerse por largos periodos o explorar áreas que no forman parte del trayecto
objetivo.
TIEMPO DE RECORRIDO
Duración total que tarda la rata en completar la tarea desde el momento en que
ingresa al laberinto hasta llegar a la meta donde recibe el reforzador. Esta medida
permite evaluar la eficiencia, rapidez y consolidación del aprendizaje a lo largo de
las sesiones experimentales.
VI. METODOLOGIA
Diseño del experimento: Se utilizó un diseño de aprendizaje por ensayo y error
dentro de un laberinto, con un único camino correcto hacia la recompensa. El
experimento consistió en sesiones diarias de entrenamiento para observar el
aprendizaje del hámster a través del reforzamiento.
- Sesiones (6):
- Descanso: 1 día después de cada sesión
- Sujetos: 1 rata albina (Rattus norvegicus)
Procedimiento
*Fase de adaptación (3 días): Se colocó al sujeto en el espacio experimental
(un laberinto) durante 10 minutos por día, sin ningún tipo de estímulo o refuerzo,
para que se familiarice con en el ambiente.
*Fase de entrenamiento (6 sesiones): Se inició el condicionamiento operante
utilizando refuerzo positivo (una semilla de almendra) cada vez que el hámster
12
realizaba correctamente la conducta deseada: recorrer el camino correcto del
laberinto y activar una palanca o pisar una zona meta. Cada sesión consistió en
una prueba individual, con una duración máxima de 5 minutos. Si el hámster
realizaba la conducta objetivo, recibía el refuerzo de inmediato. En caso de error
(camino equivocado o inactividad), no recibía recompensa.
*Fase de evaluación:
Se analiza el desempeño según:
- frecuencia de aciertos.
- número de errores.
. tiempo para completar el recorrido (meta 30 segundos).
INSTRUMENTOS
1. Laberinto:
- Estructura descendente de 4 pisos, diseñada para que el sujeto recorra un
camino hasta la parte inferior.
2. Temporizador o cronómetro:
- Se usa para registrar el tiempo que el hámster tarda en recorrer el laberinto y
tomar una decisión.
3. Recompensa (refuerzo positivo):
- Semilla de almendra, entregada manualmente solo cuando el sujeto entra y
logra completar el laberinto.
- Funciona como estímulo apetitivo incrementa la probabilidad de repetición de
la conducta deseada.
13
VII. PROGRAMA DE REFORZAMIENTO
En este experimento se aplicó el principio del condicionamiento operante,
utilizando refuerzos positivos, con el fin de entrenar al sujeto para que lograra
completar el recorrido del laberinto de cuatro niveles. Cada vez que el sujeto
alcanzaba el final del trayecto, se le entregaba una recompensa como estímulo
para reforzar su comportamiento. A través de este método, se buscaba fomentar
el aprendizaje y la repetición de la conducta deseada mediante la asociación con
una consecuencia agradable.
VI. METODOLOGÍA
Diseño del experimento
Se empleó un diseño de aprendizaje por condicionamiento operante basado en
ensayo y error, utilizando un laberinto de cuatro niveles con un único trayecto
correcto que conduce a la zona de reforzamiento. El objetivo fue analizar cómo la
rata adquiría progresivamente la conducta adecuada mediante el uso de refuerzos
positivos.
El estudio se estructuró en seis sesiones experimentales, cada una separada por un
día de descanso para evitar fatiga o interferencia entre aprendizajes.
Número de sesiones: 6 sesiones de entrenamiento
Intervalo entre sesiones: 24 horas de descanso
Sujeto experimental: 1 rata albina (Rattus norvegicus)
14
Reforzador: semillas y pequeñas porciones de alimento
Procedimiento
1. Fase de Adaptación (3 días)
Durante tres días consecutivos, la rata fue expuesta al entorno experimental —el
laberinto de cuatro niveles— por un periodo de 10 minutos diarios. En esta etapa no
se administró ningún tipo de reforzador, ya que el objetivo era permitir que el animal
desarrollara habituación al ambiente físico, disminuyendo conductas de estrés,
evitación o exploración excesiva.
2. Fase de Entrenamiento (6 sesiones)
En esta fase se aplicó el condicionamiento operante, administrando un reforzador
positivo (semillas o pequeñas porciones de comida) de manera contingente a la
ejecución correcta de la conducta objetivo:
recorrer el camino adecuado a través de los cuatro niveles y llegar a la zona de
meta.
Cada sesión estuvo conformada por un ensayo único, con una duración máxima de
5 minutos.
La lógica de reforzamiento se estableció así:
15
Respuesta correcta: si la rata completaba el recorrido sin desviaciones, recibía el
reforzador de manera inmediata.
Respuesta incorrecta: si ingresaba a rutas erróneas, retrocedía o demostraba
inactividad prolongada, no recibía recompensa.
El diseño permitió observar la progresiva adquisición del patrón conductual a través
de la asociación entre conducta y consecuencia.
3. Fase de Evaluación
El análisis final se realizó considerando tres indicadores fundamentales:
Frecuencia de aciertos: número total de recorridos correctos completados en cada
sesión.
Número de errores: cantidad de veces que la rata ingresó a rutas equivocadas,
retrocedió o interrumpió el recorrido.
Tiempo de ejecución: duración total desde que la rata ingresaba al laberinto hasta
alcanzar la zona de meta (criterio óptimo: ≤ 30 segundos).
Instrumentos
1. Laberinto de cuatro niveles
Estructura ascendente de diseño progresivo, compuesta por cuatro niveles
interconectados, creada para evaluar la capacidad espacial de la rata y su
aprendizaje secuencial mediante un único trayecto correcto.
2. Temporizador / Cronómetro
Utilizado para registrar con precisión el tiempo de recorrido en cada ensayo,
permitiendo medir mejoras en velocidad, eficiencia y consolidación del aprendizaje.
16
3. Reforzador alimenticio
Semillas y pequeñas porciones de alimento entregadas manualmente únicamente
cuando la rata completaba correctamente el recorrido.
Este reforzador funciona como estímulo apetitivo, incrementando la probabilidad de
repetición de la conducta adecuada.
VII. PROGRAMA DE REFORZAMIENTO
El estudio se fundamentó en los principios del condicionamiento operante
propuestos por B. F. Skinner, aplicando un esquema de reforzamiento positivo
continuo durante las primeras sesiones. Cada vez que la rata lograba desplazarse
correctamente por los cuatro niveles y alcanzar la zona de meta, recibía de
inmediato una semilla o porción de comida.
Este procedimiento buscó fortalecer la asociación entre la conducta objetivo y su
consecuencia gratificante, promoviendo así la repetición del comportamiento
adecuado a través de la consolidación progresiva del aprendizaje. En etapas
posteriores, el reforzamiento permitió observar una mayor precisión conductual,
reducción de errores y tiempos más breves de ejecución, lo que evidencia la
efectividad del programa aplicado.
SESIÓN 1 – Fase de Exploración No Dirigida (Sin Refuerzo)
Ensayo 1
Durante su primera exposición al laberinto, El sujeto presentó una conducta
predominantemente exploratoria de tipo desorganizada. Se observaron
desplazamientos sin trayectoria definida, retornos frecuentes al punto de inicio y
múltiples intentos de trepar por las paredes del aparato, lo que indica una activación
17
elevada y ausencia de discriminación de estímulos relevantes. El dispositivo de
descenso (ascensor) fue totalmente ignorado. Tras varios minutos sin progreso
operante, se dio por concluido el ensayo sin que el sujeto completara el recorrido.
Ensayo 2
En el segundo intento se evidenció un incremento en la conducta investigativa: El sujeto
inspeccionó esquinas, recorrió pasillos con mayor sistematicidad y se aproximó
repetidamente a la puerta del ascensor, aunque sin emitir la respuesta operante de
ingreso funcional. Después de 38 minutos, logró descender por primera vez sin
asistencia, constituyendo su primer logro sin reforzamiento explícito.
Ensayo 3
El sujeto mostró una mayor fluidez motora y menor conducta de vacilación. Recorrió los
niveles de forma más lineal, con menor tasa de retrocesos. Ingresó al ascensor y
permaneció en su interior algunos segundos, pero sin completarlo adecuadamente.
Tiempo total del ensayo: 18 minutos con 45 segundos.
SESIÓN 2 – Introducción del Reforzamiento Continuo
Ensayo 1
Se incorporó un reforzador positivo (almendra) al final del recorrido. El sujeto descendió
los dos primeros niveles sin dificultad, pero al ingresar al ascensor permaneció inmóvil,
exhibiendo conducta de orientación y escaneo del entorno. Tras varios minutos, retomó
el comportamiento operante y completó el descenso en 7 minutos y 10 segundos.
18
Ensayo 2
La anticipación del reforzador generó una mayor direccionalidad conductual. El sujeto
ingresó al ascensor con rapidez, aunque volvió a detenerse brevemente por curiosidad.
Finalizó el recorrido en 3 minutos y 50 segundos.
Ensayo 3
Se mantuvo el mismo programa de reforzamiento. El sujeto descendió sin pausas en los
primeros niveles y solo presentó un breve periodo de detención en el cuarto piso antes
de continuar. Tiempo total: 2 minutos con 30 segundos.
Ensayo 4
El sujeto ejecutó el encadenamiento conductual con mayor precisión y consistencia,
completando todo el trayecto sin necesidad de barreras o guía externa. Tiempo
registrado: 1 minuto y 45 segundos.
SESIÓN 3 – Fase de Consolidación del Encadenamiento
Ensayo 1
El sujeto fue colocado directamente en el primer nivel. Sin titubeo inicial, se dirigió al
ascensor, deteniéndose solo algunos segundos dentro de él antes de continuar. Tiempo
total: 1 minuto y 20 segundos.
Ensayo 2
19
El sujeto inició el recorrido con elevada motivación, realizando un tránsito continuo entre
niveles sin retrocesos. La única pausa observada correspondió a una conducta
autolítica (aseo). Tiempo: 1 minuto y 18 segundos.
Ensayo 3
El comportamiento presentó características de automatización: respuestas
encadenadas sin demoras y orientación directa hacia la zona de reforzamiento. Tiempo
final: 1 minuto y 15 segundos.
SESIÓN 4 – Implementación de Reforzamiento Parcial
Ensayo 1
Se introdujo un programa de reforzamiento parcial. Ante la ausencia de reforzador al
final del recorrido, El sujeto mostró breves conductas de búsqueda y exploración
adicional, pero aun así completó el trayecto en 1 minuto y 7 segundos.
Ensayo 2
Pese a la falta de reforzamiento en el ensayo previo, el sujeto mantuvo la eficacia en la
ejecución del encadenamiento. Únicamente se observó una detención breve en el
segundo nivel. Tiempo: 1 minuto y 9 segundos.
Ensayo 3
El sujeto prolongó su permanencia dentro del ascensor respecto a ensayos previos, sin
embargo, al salir ejecutó el descenso con rapidez y sin errores. Tiempo estimado: 59
segundos.
20
SESIÓN 5 – Respuesta Estabilizada con Alta Eficiencia
Ensayo 1
El sujeto inició el trayecto con respuesta inmediata al estímulo discriminativo del
ascensor. Realizó una breve pausa olfativa en el cuarto piso, pero mantuvo un patrón
conductual eficiente. Tiempo: 52 segundos.
Ensayo 2
Completó el recorrido con mínima interferencia de estímulos distractores. El descenso
fue continuo y sin correcciones. Tiempo total: 54 segundos.
Ensayo 3
Se reintrodujo el reforzador positivo. El desempeño fue altamente preciso, sin pausas ni
respuestas de exploración colateral. Tiempo final: 50 segundos.
SESIÓN 6 – Fase Final: Máximo Nivel de Ejecución
Ensayo 1
El sujeto mostró un patrón conductual plenamente consolidado: tránsito rápido,
sin retrocesos y con mínima latencia. Tiempo registrado: 53 segundos.
Ensayo 2
En este ensayo no se presentaron conductas distractoras. El descenso se
realizó de manera directa y continua hasta el nivel inferior. Tiempo: 42 segundos.
21
Ensayo 3
El sujeto completó el recorrido sin pausas, sin exploraciones innecesarias y sin repetir
trayectos. Tiempo total: 45 segundos.
Ensayo 4 (Final)
Última ejecución del experimento. El sujeto realizó el encadenamiento completo como
una unidad conductual fluida, sin interrupciones y sin detenerse en el ascensor. Tiempo
récord: 40 segundos.
VIII. CONTROL DE VARIABLES
OLOR:
Con el fin de minimizar la influencia de estímulos olfativos externos en el
desempeño de la rata, el laberinto fue higienizado cuidadosamente entre cada
sesión experimental. El personal utilizó guantes durante todas las manipulaciones
para evitar la transferencia de olor humano, y el ambiente se ventiló previamente
para mantener condiciones olfativas neutras. Este control permitió reducir la
probabilidad de que la rata guiara su comportamiento por rastros olorosos residuales
en lugar de por el aprendizaje esperado.
CONTROL DE LA MOTIVACIÓN:
La alimentación de la rata se reguló de manera precisa para asegurar un nivel
adecuado de motivación hacia el refuerzo, constituido por una porción pequeña de
comida. Se evitó inducir un estado de privación excesiva, manteniendo un equilibrio
entre motivación y bienestar. Asimismo, se cuidó que las sesiones no se realizaran
inmediatamente después de que el animal hubiera ingerido alimento, con el fin de
garantizar que la respuesta al refuerzo se mantuviera consistente a lo largo del
22
experimento. Este ajuste permitió que la conducta observada fuese atribuible al
condicionamiento y no a fluctuaciones momentáneas del apetito.
CONTROL DEL HORARIO:
El entrenamiento se desarrolló bajo un horario previamente estandarizado,
específicamente entre las 9:00 a. m. y las 11:00 a. m., durante los días martes y
viernes. Dicho rango se seleccionó tras identificar que la rata presentaba niveles
más altos de actividad en ese periodo, lo que favorecía la ejecución de la tarea.
Mantener un horario constante permitió reducir la variabilidad derivada de los ritmos
circadianos y asegurar condiciones más homogéneas para el registro de la
conducta.
IX. RESULTADOS
Sesió Ensayo Reforzamiento Conducta Observada Tiempo
n
1 1 Ninguno Inquieta, desorientada, no usó el No completado
ascensor
2 Ninguno Exploración activa, primer uso del 38 min
ascensor sin ayuda
3 Ninguno Menos retrocesos, más fluidez, dudó 18 min 45 seg
dentro del ascensor
2 1 Refuerzo Baja 2 niveles, se queda en el ascensor, 7 min 10 seg
positivo luego avanza
2 Refuerzo Uso más decidido del ascensor, breve 3 min 50 seg
positivo pausa
3 Refuerzo Bajó sin pausas iniciales, breve detención 2 min 30 seg
positivo
4 Refuerzo Recorrido fluido, sin ayuda 1 min 45 seg
positivo
3 1 Refuerzo Se dirige directo al ascensor, breve 1 min 20 seg
positivo pausa
2 Refuerzo Recorrido fluido, detención breve para 1 min 18 seg
positivo aseo
3 Refuerzo Comportamiento automático, sin errores 1 min 15 seg
positivo
4 1 Refuerzo parcial Completó con eficacia, leve confusión por 1 min 7 seg
ausencia de premio
2 Refuerzo parcial Eficaz a pesar de falta de recompensa 1 min 9 seg
3 Refuerzo parcial Pausa breve en ascensor, bajada rápida 59 seg
5 1 Sin refuerzo Movimiento fluido, breve olfateo en cuarto 52 seg
23
piso
2 Sin refuerzo Ignoró distracciones, recorrido preciso 54 seg
3 Refuerzo Fluido, preciso, sin pausas 50 seg
positivo
6 1 Sin refuerzo Bajada rápida, sin pausas 53 seg
2 Sin refuerzo Desplazamiento directo y continuo 42 seg
3 Sin refuerzo Ejecución perfecta, sin errores 45 seg
4 Refuerzo Movimiento continuo, sin detenerse ni en 40 seg
positivo el ascensor (récord)
FRECUENCIA, TIEMPO Y LATENCIA
Sesión Ensayo ¿Completó recorrido? Tiempo total del Latencia estimada
(Frecuencia) recorrido
1 1 ❌ (0) — Alta (no inició
conducta)
2 ✅ (1) 38 min 10 min (hasta usar
el ascensor)
3 ✅ (1) 18 min 45 seg 4 min
2 1 ✅ (1) 7 min 10 seg 2 min
2 ✅ (1) 3 min 50 seg 1 min
3 ✅ (1) 2 min 30 seg 45 seg
4 ✅ (1) 1 min 45 seg 20 seg
3 1 ✅ (1) 1 min 20 seg 15 seg
2 ✅ (1) 1 min 18 seg 10 seg
3 ✅ (1) 1 min 15 seg 5 seg
4 1 ✅ (1) 1 min 7 seg 8 seg
2 ✅ (1) 1 min 9 seg 6 seg
3 ✅ (1) 59 seg 5 seg
5 1 ✅ (1) 52 seg 4 seg
2 ✅ (1) 54 seg 3 seg
3 ✅ (1) 50 seg 2 seg
6 1 ✅ (1) 53 seg 2 seg
2 ✅ (1) 42 seg 2 seg
3 ✅ (1) 45 seg 1.5 seg
4 ✅ (1) 40 seg 1 seg
24
X. CONCLUSIONES
El presente experimento permitió corroborar que el reforzamiento positivo constituye
una estrategia altamente eficaz para moldear, fortalecer y mantener conductas
específicas en una rata mediante los principios del condicionamiento operante. A lo
largo de las sesiones experimentales, la rata evidenció una clara progresión en su
capacidad para orientarse dentro del laberinto de cuatro niveles, manifestando una
reducción sostenida en el tiempo de recorrido, una disminución en la frecuencia de
errores y un incremento gradual en los aciertos, lo cual refleja un proceso de
aprendizaje consistente y dirigido.
Asimismo, se observó que la conducta adquirida no dependió exclusivamente del
reforzador inmediato, sino que, en fases posteriores, el animal logró ejecutar la tarea
aun en momentos donde el refuerzo no fue aplicado de manera continua. Esto
sugiere que la conducta alcanzó un nivel de consolidación y automatización,
indicando la presencia de memoria espacial estable y capacidad de transferencia del
aprendizaje. El éxito del procedimiento estuvo estrechamente relacionado con la
utilización de un estímulo alimenticio altamente motivador, así como con el riguroso
25
control de variables externas, tales como el mantenimiento de un ambiente libre de
estímulos olfativos.
En conclusión, los hallazgos respaldan la eficacia del reforzamiento positivo como
un mecanismo fundamental para promover el aprendizaje espacial y la modificación
conductual en roedores. Además, este estudio ofrece una base sólida para el
desarrollo de investigaciones futuras que incluyan múltiples sujetos, variaciones en
el tipo de refuerzo, laberintos de mayor complejidad o análisis comparativos entre
especies, contribuyendo así al avance del conocimiento en el campo de la
psicología experimental y la conducta animal. en estudios más amplios o con
diferentes especies.
XI. ANEXOS
26
27
BIBLIOGRAFIA
o Bermúdez, K. A. (2012). La adquisición de presionar la palanca en ratas
bajo condicionamiento operante. Revista Peruana de Psicología
Experimental.
o Castro Vásquez, C. E., et al. (2024). Condicionamiento de palanca en
una rata con reforzamiento bajo razón fija 5 (Tesis de pregrado).
Universidad Nacional del Centro del Perú.
28
o Coloma Manrique, C. R. (1992). Aplicación de las técnicas de
condicionamiento operante en el aula (Tesis). Pontificia Universidad
Católica del Perú.
o Cruz, J., & García, G. (2021). Videojuego para mejorar el análisis
experimental del comportamiento con condicionamiento operante en
estudiantes de psicología (Trabajo de investigación). Universidad César
Vallejo.
o Maldonado Cruz, M. J. (2018). Didáctica de la enseñanza y
condicionamiento operante. Consejo Nacional de Ciencia, Tecnología e
Innovación Tecnológica (CONCYTEC).
o Monografía de Psicología del Aprendizaje. (2024). Principios del
condicionamiento clásico y operante. Universidad de Huánuco.
o Ortega La Torre, Y., & Roldán Aguirre, J. L. (2023). Estudio de caso:
Condicionamiento operante de un sujeto experimental en el laberinto
rectangular. Universidad César Vallejo.
o Prado Seijas, R. (2021). Condicionamiento clásico y operante en el
paradigma de evitación activa (Tesis de licenciatura). Universidad de
Huánuco.
o Revolledo, M. (2022). Efectos del reforzamiento cualitativamente variado
y constante sobre una cadena conductual en ratas (Tesis de
licenciatura). Universidad Nacional Mayor de San Marcos.
29
o Reynaga Huimán, M. A. (2017). Procesos de condicionamiento operante
en comportamientos adictivos (Tesis de licenciatura). Universidad de
Huánuco.
o Schunk, D. H. (2012). Condicionamiento operante. Pontificia Universidad
Católica del Perú.