0% encontró este documento útil (0 votos)
2 vistas29 páginas

INFORME RATATATATA Modificado

El documento presenta un estudio sobre el condicionamiento operante aplicado al aprendizaje espacial en ratas, basado en la teoría de B.F. Skinner. Se realizó un experimento utilizando un laberinto para evaluar cómo las ratas aprenden a completar un recorrido mediante refuerzos positivos. Los resultados confirmaron que el encadenamiento de respuestas y el refuerzo sistemático son efectivos en la adquisición de conductas complejas.

Cargado por

2022110181
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como DOCX, PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
2 vistas29 páginas

INFORME RATATATATA Modificado

El documento presenta un estudio sobre el condicionamiento operante aplicado al aprendizaje espacial en ratas, basado en la teoría de B.F. Skinner. Se realizó un experimento utilizando un laberinto para evaluar cómo las ratas aprenden a completar un recorrido mediante refuerzos positivos. Los resultados confirmaron que el encadenamiento de respuestas y el refuerzo sistemático son efectivos en la adquisición de conductas complejas.

Cargado por

2022110181
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como DOCX, PDF, TXT o lee en línea desde Scribd

1

UNIVERSIDAD DE HUANUCO

FACULTAD DE CIENCIAS DE LA SALUD

ESCUELA ACADEMICA DE PSICOLOGIA

CONDICIONAMIENTO OPERANTE – APRENDIZAJE ESPACIAL

Curso:

PSICOLOGIA DEL APRENDIZAJE II

Integrantes:

- LIVIA ESTRADA ALEXANDER (96%)


- ROSALES ALBORNOZ KIARA SARAHY (96%)
- SILVA PEÑA BELEN MARYCIELO (96%)
- REYES ALEJO ROMER BENJAMIN (96%)
- ESTRELLA PULIDO ALEXANDRA XIMENA (3%)

Docente:

PSICO. RUIZ PEÑA YESSICA FIORELLA

HUÁNUCO – PERÚ
2

INTRODUCCION

El aprendizaje es un proceso fundamental mediante el cual los organismos incorporan nuevas


conductas a partir de la interacción con su entorno. Entre las formas más estudiadas de
aprendizaje se encuentra el condicionamiento operante, una teoría desarrollada por B. F.
Skinner, quien demostró que el comportamiento puede modificarse en función de las
consecuencias que lo siguen, ya sea a través de recompensas o castigos. En otras palabras,
una acción tiende a repetirse o extinguirse según las contingencias que la acompañen.

El presente estudio tiene como propósito aplicar los principios del condicionamiento operante
en un experimento realizado con una rata, empleando un laberinto como instrumento para
evaluar su proceso de adquisición conductual. El objetivo principal fue reforzar positivamente al
animal cada vez que completara correctamente el recorrido, proporcionándole una recompensa
al llegar a la meta. De este modo, se buscó examinar si el roedor lograba aprender la ruta
adecuada mediante la repetición y la asociación entre su conducta y la consecuencia favorable.

La presente investigación también se fundamenta en la teoría del encadenamiento, un principio


del condicionamiento operante que explica cómo una conducta compleja puede formarse a
partir de una secuencia ordenada de respuestas simples que se enlazan entre sí. En este
proyecto, el laberinto de cuatro niveles permitió observar cómo la rata albina macho no solo
aprendía a descender cada tramo de manera aislada, sino que progresivamente integraba
estos pasos en una cadena conductual coherente y funcional.

Cada descenso exitoso reforzaba el siguiente, de modo que el comportamiento final, completar
todo el recorrido, surgió como el resultado de múltiples respuestas encadenadas. El progreso
observado sesión a sesión confirma que el encadenamiento es un proceso real, medible y
efectivo, donde la ejecución de una acción sirve como estímulo discriminativo para la siguiente.
Así, este experimento demuestra cómo una conducta compleja puede construirse mediante
reforzamientos sistemáticos, validando el encadenamiento como un mecanismo fundamental
en el aprendizaje animal.
3

I. BASES TEORICAS

El aprendizaje es un proceso mediante el cual los seres vivos modifican su conducta

a partir de la experiencia. Dentro del enfoque conductista, autores como Edward

Thorndike y B. F. Skinner han explicado cómo los estímulos y las consecuencias

influyen directamente en el comportamiento. Thorndike, mediante su Ley del Efecto,

señaló que las acciones seguidas de resultados satisfactorios tienden a repetirse.

Más adelante, Skinner amplió estos principios a través del condicionamiento

operante, demostrando que los refuerzos y castigos pueden moldear de manera

sistemática la conducta.

Estas propuestas teóricas permiten comprender cómo un organismo en este caso,

una rata albina puede aprender a recorrer un laberinto cuando recibe un refuerzo

positivo al ejecutar la respuesta correcta. A través de la repetición y la asociación

entre conducta y consecuencia, el animal logra adquirir y fortalecer la ruta

adecuada.

B.F. Skinner

Burrhus Frederic Skinner, destacado representante del conductismo, formuló la


teoría del condicionamiento operante, la cual plantea que el comportamiento de un
organismo está determinado por las consecuencias que recibe después de
ejecutarlo. De acuerdo con su propuesta, una conducta tiende a incrementarse
cuando es seguida por un reforzador positivo como alimento o estímulos agradables
o por un reforzador negativo, que implica la eliminación de un estímulo aversivo. Por
el contrario, la probabilidad de que una conducta se repita disminuye cuando esta se
acompaña de un castigo.
4

A través de sus experimentos con animales, especialmente ratas y palomas, Skinner


demostró que los organismos pueden aprender nuevas conductas si estas son
reforzadas de manera contingente. Utilizó para ello la conocida caja de Skinner, un
dispositivo en el que los animales aprendían a presionar una palanca para obtener
comida. Este enfoque resulta aplicable al caso de la rata en el laberinto, ya que el
propósito es que el animal aprenda a completar el recorrido con mayor rapidez
mediante la administración de un refuerzo positivo como alimento al llegar a la meta
fortaleciendo así la conducta deseada.

Edward Thorndike

Edward Thorndike es considerado uno de los precursores fundamentales en el

estudio científico del aprendizaje animal y un antecedente directo del

condicionamiento operante. Su contribución más influyente, la denominada Ley del

Efecto, plantea que las respuestas que producen consecuencias satisfactorias

incrementan su probabilidad de ocurrencia futura, mientras que aquellas asociadas

a resultados desfavorables tienden a debilitarse o desaparecer.

Para sustentar esta formulación, Thorndike diseñó sus célebres “cajas-problema”,

en las que gatos debían resolver mecanismos simples como presionar una palanca

o tirar de un cordón para lograr salir y acceder a alimento. A medida que los

ensayos se repetían, la latencia para emitir la respuesta correcta disminuía

progresivamente, mostrando que el aprendizaje se producía a través de un proceso

gradual de ensayo y error.

Las implicancias de estos hallazgos sirven como sustento teórico para el

experimento realizado con el sujeto de nombre “Stuard”, pues demuestran que los

organismos pueden aprender secuencias de respuestas complejas cuando ciertas

acciones son reforzadas de forma consistente. Aunque B. F. Skinner posteriormente

formalizó un modelo más sistemático del condicionamiento operante, ambos autores

coinciden en que la conducta se organiza en función de sus consecuencias, lo que


5

explica por qué un sujeto es capaz de adquirir patrones estables como recorrer un

laberinto multinivel mediante reforzamiento positivo y encadenamiento de

respuestas.

II. ANTECEDENTES

El condicionamiento operante ha sido objeto de extensas investigaciones en

contextos internacionales, nacionales y locales, consolidándose como uno de los

procedimientos más eficaces para la modificación conductual y la adquisición

progresiva de repertorios complejos. Diversos estudios han demostrado que este

tipo de aprendizaje permite moldear conductas específicas mediante la

manipulación sistemática de reforzadores y consecuencias, lo que lo convierte en

una herramienta esencial dentro de la psicología experimental.

EN EL NIVEL LOCAL

Entre las investigaciones desarrolladas en el contexto local , destaca el trabajo de

Solórzano Campo et al. (2015) en la Universidad de Huánuco, titulado “Efecto del

programa para lograr la conducta operante de bajar la palanca”. En este estudio se

emplearon dos ratas albinas (Mus musculus), las cuales fueron colocadas en una

caja operante tipo Skinner que incluía una palanca y un dispensador de alimento.

Para modelar la conducta, los autores implementaron un programa de reforzamiento

de intervalo variable, mediante el cual las ratas recibían comida cada vez que

presionaban la palanca dentro del intervalo establecido. Adicionalmente, en ciertos

momentos se aplicó castigo positivo para reducir respuestas no funcionales y

fortalecer la conducta objetivo.


6

Como resultado, ambas ratas lograron adquirir y mantener de forma estable la

conducta de presionar la palanca, mostrando incrementos progresivos en la tasa de

respuesta y una disminución en conductas distractoras. Este estudio constituye una

evidencia significativa de la eficacia del condicionamiento operante en entornos

controlados, y además aporta datos relevantes sobre cómo la combinación de

reforzamiento y contingencias aversivas puede optimizar la adquisición de

respuestas instrumentalizadas.

EN EL NIVEL NACIONAL

En este estudio, Revolledo (2022) analiza cómo diferentes tipos de reforzadores

tanto constantes como cualitativamente variados influyen en la adquisición y

mantenimiento de una cadena conductual compleja en ratas albinas. El experimento

se desarrolló utilizando una caja operante equipada con múltiples componentes que

debían ejecutarse en secuencia, lo que permitió evaluar no solo la velocidad de

aprendizaje, sino también la solidez de la cadena bajo distintas condiciones de

reforzamiento.

El procedimiento incluyó fases de moldeamiento, reforzamiento diferencial y

posteriormente la implementación de programas de reforzamiento específicos para

cada segmento de la cadena conductual. Revolledo determinó que los reforzadores

cualitativamente variados (por ejemplo, alternancia entre tipos de comida o

intensidades del estímulo) incrementaban la tasa de respuesta y favorecían la

estabilidad de la conducta encadenada, en comparación con reforzadores

constantes que mantenían un refuerzo homogéneo a lo largo de todas las fases.

Los resultados muestran una contribución importante al análisis experimental del

comportamiento en contextos peruanos, pues demuestran que las cadenas

conductuales base fundamental en estudios complejos de aprendizaje operante


7

pueden ser moduladas con eficacia mediante variaciones en la calidad del

reforzador. Este estudio es especialmente relevante porque replica y fortalece

paradigmas clásicos del condicionamiento operante, ofreciendo evidencia aplicable

a investigaciones contemporáneas sobre encadenamiento, reforzamiento diferencial

y dinámica del control conductual en animales de laboratorio.

EN EL NIVEL INTERNACIONAL

Entre los modelos de laberintos más utilizados en la investigación con roedores se

encuentran diversas estructuras estandarizadas que permiten evaluar procesos

cognitivos específicos. Uno de los más clásicos es el laberinto en T, empleado para

estudiar patrones de elección, especialmente la alternancia espontánea. También

destaca el laberinto radial, desarrollado por Olton y Samuelson en 1976, cuyo

diseño en múltiples brazos facilita el análisis simultáneo de la memoria de trabajo y

de la memoria de referencia. Por otro lado, el Morris Water Maze (1981–1982)

constituye un paradigma fundamental para evaluar la memoria espacial mediante la

búsqueda de una plataforma oculta en un estanque de agua, mientras que el Barnes

Maze (1979) representa una alternativa menos aversiva, ya que permite examinar

las mismas capacidades sin exponer al animal a inmersión o estrés hídrico.

Asimismo, se han llevado a cabo investigaciones centradas en formas más

complejas de aprendizaje. Un ejemplo notable es el Time–Place learning, que

evidencia que especies como abejas y hormigas pueden integrar información

temporal y espacial para identificar lugares específicos vinculados a momentos

determinados del día. De manera paralela, los principios del condicionamiento

operante también han sido extendidos al comportamiento humano. En estudios

aplicados al deporte, como en jugadores de baloncesto, se ha observado que el uso

estratégico del reforzamiento modifica la selección espacial de jugadas y decisiones


8

tácticas durante el juego, mostrando la aplicabilidad del enfoque conductual en

contextos cotidianos y de alto desempeño.

III OBJETIVOS

Objetivo general:

Diseñar y poner en práctica un experimento sustentado en los principios del

condicionamiento operante con el propósito de analizar el proceso mediante el cual

un organismo en este caso, una rata adquiere la habilidad de resolver un laberinto a

través del uso de reforzadores positivos. La evaluación contempla variables como el

tiempo de ejecución, la frecuencia de errores y la progresión del aprendizaje a lo

largo de los ensayos. Este procedimiento se fundamenta en las aportaciones

teóricas de Edward Thorndike, particularmente su Ley del Efecto, y en el modelo de

condicionamiento operante propuesto por B. F. Skinner, quienes demostraron que la

conducta se fortalece o debilita en función de las consecuencias que la siguen.

OBJETIVO ESPECÍFICO:

• Implementar un programa de condicionamiento operante sustentado en refuerzos

positivos con el fin de moldear gradualmente la conducta de la rata, orientándola

hacia el cumplimiento adecuado de la tarea prevista dentro del laberinto.

• Determinar, mediante un registro sistemático y comparativo, cuántas sesiones

requiere la rata para recorrer el laberinto de forma precisa, sin cometer errores ni

retrocesos, identificando el momento en que se evidencia un aprendizaje estable y

una ejecución automatizada de la cadena conductual.


9

IV. HIPOTESIS

Hipótesis Nula (H₀)

El refuerzo positivo administrado mediante los principios del condicionamiento

operante no genera un cambio significativo en la conducta de la rata durante la

ejecución del laberinto. En este sentido, aun cuando se le proporcione un estímulo

reforzador (por ejemplo, alimento) al completar el recorrido, no se evidenciaría una

disminución relevante en el tiempo total, en la frecuencia de errores ni en la

eficiencia general de su desplazamiento. Bajo esta hipótesis, el desempeño de la

rata podría atribuirse a variables ajenas al reforzamiento, tales como exploración

espontánea, habituación al entorno o factores ambientales no controlados.

Hipótesis Alterna (H₁)

El refuerzo positivo aplicado dentro del marco del condicionamiento operante sí

produce un efecto significativo en la conducta de la rata al recorrer el laberinto. Esto

implica que, al recibir una recompensa contingente al logro de la respuesta objetivo,

la rata aprende progresivamente la secuencia adecuada, mostrando mejoras

sistemáticas en su tiempo de ejecución, disminución de errores y un patrón

conductual más dirigido y eficiente. En consecuencia, el aprendizaje observado se

interpretaría como producto directo de la asociación entre la conducta emitida y el

reforzador administrado.
10

V. VARIABLES

VARIABLE INDEPENDIENTE (VI)

Administración inmediata de un reforzador positivo, consistente en una semilla o un

pequeño trozo de fruta, otorgado cada vez que la rata ejecuta la conducta objetivo.

Este reforzador se entrega de manera contingente al comportamiento deseado,

específicamente cuando la rata inicia correctamente el recorrido en el punto de

partida y logra avanzar hasta la zona de meta dentro del laberinto.

VARIABLE DEPENDIENTE (VD)

Frecuencia de emisión de la conducta objetivo por parte de la rata dentro de un

periodo de tiempo predeterminado. Esta variable permite evaluar el impacto del

reforzamiento sobre la probabilidad de repetición de la conducta aprendida.

NÚMERO DE ACIERTOS

Cantidad de ocasiones en que la rata realiza de manera correcta la conducta

esperada, como por ejemplo identificar y seguir la ruta adecuada dentro del

laberinto, entrar en el compartimiento correspondiente o ejecutar la secuencia

conductual sin desviaciones.

NÚMERO DE ERRORES
Total, de veces en que la rata presenta conductas inadecuadas o no deseadas, tales

como ingresar en bifurcaciones incorrectas, retroceder sin motivo aparente,


11

detenerse por largos periodos o explorar áreas que no forman parte del trayecto

objetivo.

TIEMPO DE RECORRIDO

Duración total que tarda la rata en completar la tarea desde el momento en que

ingresa al laberinto hasta llegar a la meta donde recibe el reforzador. Esta medida

permite evaluar la eficiencia, rapidez y consolidación del aprendizaje a lo largo de

las sesiones experimentales.

VI. METODOLOGIA

Diseño del experimento: Se utilizó un diseño de aprendizaje por ensayo y error

dentro de un laberinto, con un único camino correcto hacia la recompensa. El

experimento consistió en sesiones diarias de entrenamiento para observar el

aprendizaje del hámster a través del reforzamiento.

- Sesiones (6):

- Descanso: 1 día después de cada sesión

- Sujetos: 1 rata albina (Rattus norvegicus)

Procedimiento

*Fase de adaptación (3 días): Se colocó al sujeto en el espacio experimental

(un laberinto) durante 10 minutos por día, sin ningún tipo de estímulo o refuerzo,

para que se familiarice con en el ambiente.

*Fase de entrenamiento (6 sesiones): Se inició el condicionamiento operante

utilizando refuerzo positivo (una semilla de almendra) cada vez que el hámster
12

realizaba correctamente la conducta deseada: recorrer el camino correcto del

laberinto y activar una palanca o pisar una zona meta. Cada sesión consistió en

una prueba individual, con una duración máxima de 5 minutos. Si el hámster

realizaba la conducta objetivo, recibía el refuerzo de inmediato. En caso de error

(camino equivocado o inactividad), no recibía recompensa.

*Fase de evaluación:

Se analiza el desempeño según:

- frecuencia de aciertos.

- número de errores.

. tiempo para completar el recorrido (meta 30 segundos).

INSTRUMENTOS

1. Laberinto:

- Estructura descendente de 4 pisos, diseñada para que el sujeto recorra un

camino hasta la parte inferior.

2. Temporizador o cronómetro:

- Se usa para registrar el tiempo que el hámster tarda en recorrer el laberinto y

tomar una decisión.

3. Recompensa (refuerzo positivo):

- Semilla de almendra, entregada manualmente solo cuando el sujeto entra y

logra completar el laberinto.

- Funciona como estímulo apetitivo incrementa la probabilidad de repetición de

la conducta deseada.
13

VII. PROGRAMA DE REFORZAMIENTO

En este experimento se aplicó el principio del condicionamiento operante,

utilizando refuerzos positivos, con el fin de entrenar al sujeto para que lograra

completar el recorrido del laberinto de cuatro niveles. Cada vez que el sujeto

alcanzaba el final del trayecto, se le entregaba una recompensa como estímulo

para reforzar su comportamiento. A través de este método, se buscaba fomentar

el aprendizaje y la repetición de la conducta deseada mediante la asociación con

una consecuencia agradable.

VI. METODOLOGÍA

Diseño del experimento

Se empleó un diseño de aprendizaje por condicionamiento operante basado en

ensayo y error, utilizando un laberinto de cuatro niveles con un único trayecto

correcto que conduce a la zona de reforzamiento. El objetivo fue analizar cómo la

rata adquiría progresivamente la conducta adecuada mediante el uso de refuerzos

positivos.

El estudio se estructuró en seis sesiones experimentales, cada una separada por un

día de descanso para evitar fatiga o interferencia entre aprendizajes.

Número de sesiones: 6 sesiones de entrenamiento

Intervalo entre sesiones: 24 horas de descanso

Sujeto experimental: 1 rata albina (Rattus norvegicus)


14

Reforzador: semillas y pequeñas porciones de alimento

Procedimiento

1. Fase de Adaptación (3 días)

Durante tres días consecutivos, la rata fue expuesta al entorno experimental —el

laberinto de cuatro niveles— por un periodo de 10 minutos diarios. En esta etapa no

se administró ningún tipo de reforzador, ya que el objetivo era permitir que el animal

desarrollara habituación al ambiente físico, disminuyendo conductas de estrés,

evitación o exploración excesiva.

2. Fase de Entrenamiento (6 sesiones)

En esta fase se aplicó el condicionamiento operante, administrando un reforzador

positivo (semillas o pequeñas porciones de comida) de manera contingente a la

ejecución correcta de la conducta objetivo:

recorrer el camino adecuado a través de los cuatro niveles y llegar a la zona de

meta.

Cada sesión estuvo conformada por un ensayo único, con una duración máxima de

5 minutos.

La lógica de reforzamiento se estableció así:


15

Respuesta correcta: si la rata completaba el recorrido sin desviaciones, recibía el

reforzador de manera inmediata.

Respuesta incorrecta: si ingresaba a rutas erróneas, retrocedía o demostraba

inactividad prolongada, no recibía recompensa.

El diseño permitió observar la progresiva adquisición del patrón conductual a través

de la asociación entre conducta y consecuencia.

3. Fase de Evaluación

El análisis final se realizó considerando tres indicadores fundamentales:

Frecuencia de aciertos: número total de recorridos correctos completados en cada

sesión.

Número de errores: cantidad de veces que la rata ingresó a rutas equivocadas,

retrocedió o interrumpió el recorrido.

Tiempo de ejecución: duración total desde que la rata ingresaba al laberinto hasta

alcanzar la zona de meta (criterio óptimo: ≤ 30 segundos).

Instrumentos

1. Laberinto de cuatro niveles

Estructura ascendente de diseño progresivo, compuesta por cuatro niveles

interconectados, creada para evaluar la capacidad espacial de la rata y su

aprendizaje secuencial mediante un único trayecto correcto.

2. Temporizador / Cronómetro

Utilizado para registrar con precisión el tiempo de recorrido en cada ensayo,

permitiendo medir mejoras en velocidad, eficiencia y consolidación del aprendizaje.


16

3. Reforzador alimenticio

Semillas y pequeñas porciones de alimento entregadas manualmente únicamente

cuando la rata completaba correctamente el recorrido.

Este reforzador funciona como estímulo apetitivo, incrementando la probabilidad de

repetición de la conducta adecuada.

VII. PROGRAMA DE REFORZAMIENTO

El estudio se fundamentó en los principios del condicionamiento operante

propuestos por B. F. Skinner, aplicando un esquema de reforzamiento positivo

continuo durante las primeras sesiones. Cada vez que la rata lograba desplazarse

correctamente por los cuatro niveles y alcanzar la zona de meta, recibía de

inmediato una semilla o porción de comida.

Este procedimiento buscó fortalecer la asociación entre la conducta objetivo y su

consecuencia gratificante, promoviendo así la repetición del comportamiento

adecuado a través de la consolidación progresiva del aprendizaje. En etapas

posteriores, el reforzamiento permitió observar una mayor precisión conductual,

reducción de errores y tiempos más breves de ejecución, lo que evidencia la

efectividad del programa aplicado.

SESIÓN 1 – Fase de Exploración No Dirigida (Sin Refuerzo)

Ensayo 1

Durante su primera exposición al laberinto, El sujeto presentó una conducta

predominantemente exploratoria de tipo desorganizada. Se observaron

desplazamientos sin trayectoria definida, retornos frecuentes al punto de inicio y

múltiples intentos de trepar por las paredes del aparato, lo que indica una activación
17

elevada y ausencia de discriminación de estímulos relevantes. El dispositivo de

descenso (ascensor) fue totalmente ignorado. Tras varios minutos sin progreso

operante, se dio por concluido el ensayo sin que el sujeto completara el recorrido.

Ensayo 2

En el segundo intento se evidenció un incremento en la conducta investigativa: El sujeto

inspeccionó esquinas, recorrió pasillos con mayor sistematicidad y se aproximó

repetidamente a la puerta del ascensor, aunque sin emitir la respuesta operante de

ingreso funcional. Después de 38 minutos, logró descender por primera vez sin

asistencia, constituyendo su primer logro sin reforzamiento explícito.

Ensayo 3

El sujeto mostró una mayor fluidez motora y menor conducta de vacilación. Recorrió los

niveles de forma más lineal, con menor tasa de retrocesos. Ingresó al ascensor y

permaneció en su interior algunos segundos, pero sin completarlo adecuadamente.

Tiempo total del ensayo: 18 minutos con 45 segundos.

SESIÓN 2 – Introducción del Reforzamiento Continuo

Ensayo 1

Se incorporó un reforzador positivo (almendra) al final del recorrido. El sujeto descendió

los dos primeros niveles sin dificultad, pero al ingresar al ascensor permaneció inmóvil,

exhibiendo conducta de orientación y escaneo del entorno. Tras varios minutos, retomó

el comportamiento operante y completó el descenso en 7 minutos y 10 segundos.


18

Ensayo 2

La anticipación del reforzador generó una mayor direccionalidad conductual. El sujeto

ingresó al ascensor con rapidez, aunque volvió a detenerse brevemente por curiosidad.

Finalizó el recorrido en 3 minutos y 50 segundos.

Ensayo 3

Se mantuvo el mismo programa de reforzamiento. El sujeto descendió sin pausas en los

primeros niveles y solo presentó un breve periodo de detención en el cuarto piso antes

de continuar. Tiempo total: 2 minutos con 30 segundos.

Ensayo 4

El sujeto ejecutó el encadenamiento conductual con mayor precisión y consistencia,

completando todo el trayecto sin necesidad de barreras o guía externa. Tiempo

registrado: 1 minuto y 45 segundos.

SESIÓN 3 – Fase de Consolidación del Encadenamiento

Ensayo 1

El sujeto fue colocado directamente en el primer nivel. Sin titubeo inicial, se dirigió al

ascensor, deteniéndose solo algunos segundos dentro de él antes de continuar. Tiempo

total: 1 minuto y 20 segundos.

Ensayo 2
19

El sujeto inició el recorrido con elevada motivación, realizando un tránsito continuo entre

niveles sin retrocesos. La única pausa observada correspondió a una conducta

autolítica (aseo). Tiempo: 1 minuto y 18 segundos.

Ensayo 3

El comportamiento presentó características de automatización: respuestas

encadenadas sin demoras y orientación directa hacia la zona de reforzamiento. Tiempo

final: 1 minuto y 15 segundos.

SESIÓN 4 – Implementación de Reforzamiento Parcial

Ensayo 1

Se introdujo un programa de reforzamiento parcial. Ante la ausencia de reforzador al

final del recorrido, El sujeto mostró breves conductas de búsqueda y exploración

adicional, pero aun así completó el trayecto en 1 minuto y 7 segundos.

Ensayo 2

Pese a la falta de reforzamiento en el ensayo previo, el sujeto mantuvo la eficacia en la

ejecución del encadenamiento. Únicamente se observó una detención breve en el

segundo nivel. Tiempo: 1 minuto y 9 segundos.

Ensayo 3

El sujeto prolongó su permanencia dentro del ascensor respecto a ensayos previos, sin

embargo, al salir ejecutó el descenso con rapidez y sin errores. Tiempo estimado: 59

segundos.
20

SESIÓN 5 – Respuesta Estabilizada con Alta Eficiencia

Ensayo 1

El sujeto inició el trayecto con respuesta inmediata al estímulo discriminativo del

ascensor. Realizó una breve pausa olfativa en el cuarto piso, pero mantuvo un patrón

conductual eficiente. Tiempo: 52 segundos.

Ensayo 2

Completó el recorrido con mínima interferencia de estímulos distractores. El descenso

fue continuo y sin correcciones. Tiempo total: 54 segundos.

Ensayo 3

Se reintrodujo el reforzador positivo. El desempeño fue altamente preciso, sin pausas ni

respuestas de exploración colateral. Tiempo final: 50 segundos.

SESIÓN 6 – Fase Final: Máximo Nivel de Ejecución

Ensayo 1

El sujeto mostró un patrón conductual plenamente consolidado: tránsito rápido,

sin retrocesos y con mínima latencia. Tiempo registrado: 53 segundos.

Ensayo 2

En este ensayo no se presentaron conductas distractoras. El descenso se

realizó de manera directa y continua hasta el nivel inferior. Tiempo: 42 segundos.


21

Ensayo 3

El sujeto completó el recorrido sin pausas, sin exploraciones innecesarias y sin repetir

trayectos. Tiempo total: 45 segundos.

Ensayo 4 (Final)

Última ejecución del experimento. El sujeto realizó el encadenamiento completo como

una unidad conductual fluida, sin interrupciones y sin detenerse en el ascensor. Tiempo

récord: 40 segundos.

VIII. CONTROL DE VARIABLES

OLOR:

Con el fin de minimizar la influencia de estímulos olfativos externos en el

desempeño de la rata, el laberinto fue higienizado cuidadosamente entre cada

sesión experimental. El personal utilizó guantes durante todas las manipulaciones

para evitar la transferencia de olor humano, y el ambiente se ventiló previamente

para mantener condiciones olfativas neutras. Este control permitió reducir la

probabilidad de que la rata guiara su comportamiento por rastros olorosos residuales

en lugar de por el aprendizaje esperado.

CONTROL DE LA MOTIVACIÓN:

La alimentación de la rata se reguló de manera precisa para asegurar un nivel

adecuado de motivación hacia el refuerzo, constituido por una porción pequeña de

comida. Se evitó inducir un estado de privación excesiva, manteniendo un equilibrio

entre motivación y bienestar. Asimismo, se cuidó que las sesiones no se realizaran

inmediatamente después de que el animal hubiera ingerido alimento, con el fin de

garantizar que la respuesta al refuerzo se mantuviera consistente a lo largo del


22

experimento. Este ajuste permitió que la conducta observada fuese atribuible al

condicionamiento y no a fluctuaciones momentáneas del apetito.

CONTROL DEL HORARIO:

El entrenamiento se desarrolló bajo un horario previamente estandarizado,

específicamente entre las 9:00 a. m. y las 11:00 a. m., durante los días martes y

viernes. Dicho rango se seleccionó tras identificar que la rata presentaba niveles

más altos de actividad en ese periodo, lo que favorecía la ejecución de la tarea.

Mantener un horario constante permitió reducir la variabilidad derivada de los ritmos

circadianos y asegurar condiciones más homogéneas para el registro de la

conducta.

IX. RESULTADOS

Sesió Ensayo Reforzamiento Conducta Observada Tiempo


n
1 1 Ninguno Inquieta, desorientada, no usó el No completado
ascensor
2 Ninguno Exploración activa, primer uso del 38 min
ascensor sin ayuda
3 Ninguno Menos retrocesos, más fluidez, dudó 18 min 45 seg
dentro del ascensor
2 1 Refuerzo Baja 2 niveles, se queda en el ascensor, 7 min 10 seg
positivo luego avanza
2 Refuerzo Uso más decidido del ascensor, breve 3 min 50 seg
positivo pausa
3 Refuerzo Bajó sin pausas iniciales, breve detención 2 min 30 seg
positivo
4 Refuerzo Recorrido fluido, sin ayuda 1 min 45 seg
positivo
3 1 Refuerzo Se dirige directo al ascensor, breve 1 min 20 seg
positivo pausa
2 Refuerzo Recorrido fluido, detención breve para 1 min 18 seg
positivo aseo
3 Refuerzo Comportamiento automático, sin errores 1 min 15 seg
positivo
4 1 Refuerzo parcial Completó con eficacia, leve confusión por 1 min 7 seg
ausencia de premio
2 Refuerzo parcial Eficaz a pesar de falta de recompensa 1 min 9 seg
3 Refuerzo parcial Pausa breve en ascensor, bajada rápida 59 seg
5 1 Sin refuerzo Movimiento fluido, breve olfateo en cuarto 52 seg
23

piso
2 Sin refuerzo Ignoró distracciones, recorrido preciso 54 seg
3 Refuerzo Fluido, preciso, sin pausas 50 seg
positivo
6 1 Sin refuerzo Bajada rápida, sin pausas 53 seg
2 Sin refuerzo Desplazamiento directo y continuo 42 seg
3 Sin refuerzo Ejecución perfecta, sin errores 45 seg
4 Refuerzo Movimiento continuo, sin detenerse ni en 40 seg
positivo el ascensor (récord)

FRECUENCIA, TIEMPO Y LATENCIA

Sesión Ensayo ¿Completó recorrido? Tiempo total del Latencia estimada


(Frecuencia) recorrido
1 1 ❌ (0) — Alta (no inició
conducta)
2 ✅ (1) 38 min 10 min (hasta usar
el ascensor)
3 ✅ (1) 18 min 45 seg 4 min
2 1 ✅ (1) 7 min 10 seg 2 min
2 ✅ (1) 3 min 50 seg 1 min
3 ✅ (1) 2 min 30 seg 45 seg
4 ✅ (1) 1 min 45 seg 20 seg
3 1 ✅ (1) 1 min 20 seg 15 seg
2 ✅ (1) 1 min 18 seg 10 seg
3 ✅ (1) 1 min 15 seg 5 seg
4 1 ✅ (1) 1 min 7 seg 8 seg
2 ✅ (1) 1 min 9 seg 6 seg
3 ✅ (1) 59 seg 5 seg
5 1 ✅ (1) 52 seg 4 seg
2 ✅ (1) 54 seg 3 seg
3 ✅ (1) 50 seg 2 seg
6 1 ✅ (1) 53 seg 2 seg
2 ✅ (1) 42 seg 2 seg
3 ✅ (1) 45 seg 1.5 seg
4 ✅ (1) 40 seg 1 seg
24

X. CONCLUSIONES

El presente experimento permitió corroborar que el reforzamiento positivo constituye

una estrategia altamente eficaz para moldear, fortalecer y mantener conductas

específicas en una rata mediante los principios del condicionamiento operante. A lo

largo de las sesiones experimentales, la rata evidenció una clara progresión en su

capacidad para orientarse dentro del laberinto de cuatro niveles, manifestando una

reducción sostenida en el tiempo de recorrido, una disminución en la frecuencia de

errores y un incremento gradual en los aciertos, lo cual refleja un proceso de

aprendizaje consistente y dirigido.

Asimismo, se observó que la conducta adquirida no dependió exclusivamente del

reforzador inmediato, sino que, en fases posteriores, el animal logró ejecutar la tarea

aun en momentos donde el refuerzo no fue aplicado de manera continua. Esto

sugiere que la conducta alcanzó un nivel de consolidación y automatización,

indicando la presencia de memoria espacial estable y capacidad de transferencia del

aprendizaje. El éxito del procedimiento estuvo estrechamente relacionado con la

utilización de un estímulo alimenticio altamente motivador, así como con el riguroso


25

control de variables externas, tales como el mantenimiento de un ambiente libre de

estímulos olfativos.

En conclusión, los hallazgos respaldan la eficacia del reforzamiento positivo como

un mecanismo fundamental para promover el aprendizaje espacial y la modificación

conductual en roedores. Además, este estudio ofrece una base sólida para el

desarrollo de investigaciones futuras que incluyan múltiples sujetos, variaciones en

el tipo de refuerzo, laberintos de mayor complejidad o análisis comparativos entre

especies, contribuyendo así al avance del conocimiento en el campo de la

psicología experimental y la conducta animal. en estudios más amplios o con

diferentes especies.

XI. ANEXOS
26
27

BIBLIOGRAFIA

o Bermúdez, K. A. (2012). La adquisición de presionar la palanca en ratas


bajo condicionamiento operante. Revista Peruana de Psicología
Experimental.

o Castro Vásquez, C. E., et al. (2024). Condicionamiento de palanca en


una rata con reforzamiento bajo razón fija 5 (Tesis de pregrado).
Universidad Nacional del Centro del Perú.
28

o Coloma Manrique, C. R. (1992). Aplicación de las técnicas de


condicionamiento operante en el aula (Tesis). Pontificia Universidad
Católica del Perú.

o Cruz, J., & García, G. (2021). Videojuego para mejorar el análisis


experimental del comportamiento con condicionamiento operante en
estudiantes de psicología (Trabajo de investigación). Universidad César
Vallejo.

o Maldonado Cruz, M. J. (2018). Didáctica de la enseñanza y


condicionamiento operante. Consejo Nacional de Ciencia, Tecnología e
Innovación Tecnológica (CONCYTEC).

o Monografía de Psicología del Aprendizaje. (2024). Principios del


condicionamiento clásico y operante. Universidad de Huánuco.

o Ortega La Torre, Y., & Roldán Aguirre, J. L. (2023). Estudio de caso:


Condicionamiento operante de un sujeto experimental en el laberinto
rectangular. Universidad César Vallejo.

o Prado Seijas, R. (2021). Condicionamiento clásico y operante en el


paradigma de evitación activa (Tesis de licenciatura). Universidad de
Huánuco.

o Revolledo, M. (2022). Efectos del reforzamiento cualitativamente variado


y constante sobre una cadena conductual en ratas (Tesis de
licenciatura). Universidad Nacional Mayor de San Marcos.
29

o Reynaga Huimán, M. A. (2017). Procesos de condicionamiento operante


en comportamientos adictivos (Tesis de licenciatura). Universidad de
Huánuco.

o Schunk, D. H. (2012). Condicionamiento operante. Pontificia Universidad


Católica del Perú.

También podría gustarte