Video Experimental Relacionado
Updated: Sep 9, 2025

A Conflict Model of Reward-seeking Behavior in Male Rats
Published on: February 20, 2019
Cómo interactúan la memoria de trabajo y el aprendizaje por refuerzo al evitar el castigo y buscar la recompensa
Peter F Hitchcock1, Joonhwa Kim2, Michael J Frank3
1Department of Psychology, Emory University.
Los humanos utilizan sistemas separados de aprendizaje por refuerzo (RL) y memoria de trabajo (WM). Este estudio muestra que WM ayuda a evitar el castigo inmediato, mientras que RL lucha con la memoria del castigo, con diferencias individuales que afectan esta interacción.
Área de la Ciencia:
- La neurociencia cognitiva
- Psicología del comportamiento
- Psiquiatría computacional
Sus antecedentes:
- El comportamiento adaptativo humano se basa en el aprendizaje por refuerzo (RL) y los sistemas de memoria de trabajo (WM).
- La interacción entre RL y WM durante el aprendizaje simultáneo de recompensa y castigo es poco conocida.
- El impacto de los síntomas psiquiátricos en estos sistemas de aprendizaje requiere más investigación.
Objetivo del estudio:
- Para investigar la interacción entre RL y WM en el aprendizaje para evitar el castigo.
- Examinar cómo WM influye en RL durante el aprendizaje simultáneo de recompensa y castigo.
- Para evaluar los efectos de la depresión, la ansiedad y la rumia en estos procesos de aprendizaje.
Principales métodos:
- Se administró una nueva tarea de recompensa / castigo RL-WM a una muestra en línea (N = 298).
- El modelado computacional se utilizó para analizar los patrones de aprendizaje y las interacciones del sistema.
- Las fases de ensayo intercaladas evaluaron la retención basada en RL y la influencia de WM en RL.
Principales resultados:
- La memoria de trabajo (WM) facilitó la evitación inmediata del castigo, pero esto fue mal retenido por el sistema de aprendizaje por refuerzo (RL).
- Se observó evidencia de que el EM embotó la RL a mitad del aprendizaje, pero este efecto disminuyó después de un aprendizaje adicional.
- Las diferencias individuales modularon la interacción WM-RL, y algunos individuos mostraron que WM facilitaba la retención.
- El desempeño de la tarea se mantuvo en gran medida intacto a pesar de la depresión, la ansiedad y la rumia.
Conclusiones:
- El sistema WM admite la evitación del castigo a corto plazo, mientras que el sistema RL muestra una retención limitada de la información del castigo.
- Las diferencias individuales influyen significativamente en el grado en que WM afecta a RL.
- El rendimiento conductual en esta tarea es resistente a la internalización de síntomas psiquiátricos como la depresión y la ansiedad.
Más Videos Relacionados
14:24An Appetitive Spatial Working Memory Task for Mice in a Semi-Automated 8-Arm Radial Maze, Reducing Fearful Memory Association in the Maze
Published on: July 29, 2025
08:05A Prediction Error-driven Retrieval Procedure for Destabilizing and Rewriting Maladaptive Reward Memories in Hazardous Drinkers
Published on: January 5, 2018
Videos de Conceptos Relacionados
Avoidance Learning and Learned Helplessness
Avoidance learning occurs when an organism learns that a specific behavior can prevent an unpleasant outcome. For example, a student who receives a bad grade may start studying harder to avoid future poor grades. This behavior persists even when the negative outcome is no longer present. Avoidance learning is powerful because it maintains behavior in the absence of the...
Timing and Consequences on Behavior
Humans, however, can respond to delayed reinforcers. We often make decisions between immediate small rewards and delayed larger rewards. This ability to delay gratification is a significant...
Cognitive Learning
E. C. Tolman's theory of purposive behavior emphasizes that much behavior is goal-directed. He argued that to understand behavior, we must look at the entire sequence of actions leading to a goal. For instance, high school students study hard, not just due to past reinforcement but also to achieve the goal of getting into a good college.
Tolman introduced the idea that behavior is influenced by...
Associative Learning
Classical conditioning, also known...
Working Memory
Operant Conditioning
Reinforcement in operant conditioning can be positive or negative, both of which serve to increase the likelihood of a behavior. Positive...