Cámara de condicionamiento operante para entrenamiento por refuerzo En psicología conductual , el refuerzo se refiere a las consecuencias que aumentan la probabilidad de que un ...
Hispanopedia WikiContenido en espanolLectura gratuita
En psicología conductual , el refuerzo se refiere a las consecuencias que aumentan la probabilidad de que un organismo repita un comportamiento futuro, generalmente en presencia de un estímulo antecedente particular . [ 1 ] Por ejemplo, se puede entrenar a una rata para que presione una palanca y reciba comida cada vez que se enciende una luz; en este ejemplo, la luz es el estímulo antecedente, presionar la palanca es la conducta operante y la comida es el reforzador . De igual manera, un estudiante que recibe atención y elogios al responder la pregunta de un profesor tendrá más probabilidades de responder preguntas futuras en clase; la pregunta del profesor es el antecedente, la respuesta del estudiante es la conducta y los elogios y la atención son los reforzadores. El castigo es lo opuesto al refuerzo y se refiere a cualquier conducta que disminuye la probabilidad de que ocurra una respuesta. En términos de condicionamiento operante , el castigo no necesita implicar ningún tipo de dolor, miedo o acciones físicas; incluso una breve expresión verbal de desaprobación es un tipo de castigo. [ 2 ]
Las consecuencias que conducen a conductas apetitivas, como el "deseo" y el "gusto" subjetivos (deseo y placer), funcionan como recompensas o refuerzo positivo . [ 3 ] También existe el refuerzo negativo , que implica la eliminación de un estímulo indeseable. Un ejemplo de refuerzo negativo sería tomar una aspirina para aliviar un dolor de cabeza.
El refuerzo es un componente importante del condicionamiento operante y la modificación de la conducta . Este concepto se ha aplicado en diversas áreas prácticas, como la crianza de los hijos, el entrenamiento, la terapia, el desarrollo personal, la educación y la gestión.
Terminología
En las ciencias del comportamiento, los términos positivo y negativo , cuando se usan en su sentido técnico estricto, se refieren a la naturaleza de la acción realizada por el condicionamientor, más que a la evaluación que el operante responde de dicha acción y sus consecuencias. Las acciones positivas son aquellas que añaden un factor, ya sea agradable o desagradable, al entorno, mientras que las negativas son aquellas que eliminan o suprimen del entorno un factor de cualquiera de los dos tipos.
A su vez, el sentido estricto del refuerzo se refiere únicamente al condicionamiento basado en la recompensa; la introducción de factores desagradables y la eliminación o retención de factores agradables se denominan castigo , que, cuando se utiliza en su sentido estricto, se contrapone al refuerzo.
Así, el refuerzo positivo se refiere a la adición de un factor agradable, el castigo positivo (a veces llamado castigo de tipo I) se refiere a la adición de un factor desagradable, [ 7 ] el refuerzo negativo se refiere a la eliminación o retención de un factor desagradable, y el castigo negativo (castigo de tipo II) se refiere a la eliminación o retención de un factor agradable. [ 7 ]
Este uso está en desacuerdo con algunos usos no técnicos de las combinaciones de cuatro términos, especialmente en el caso del término refuerzo negativo , que a menudo se usa para denotar lo que el lenguaje técnico describiría como castigo positivo , ya que el uso no técnico interpreta el refuerzo como englobando tanto la recompensa como el castigo, y negativo como referido a la percepción del operante que responde de que el factor fue desagradable. Por el contrario, el lenguaje técnico usaría el término refuerzo negativo para describir el fomento de una conducta determinada mediante la creación de un escenario en el que un factor desagradable está o estará presente, pero la realización de la conducta resulta en escapar de ese factor o prevenir su aparición, como en el experimento de Martin Seligman con perros que aprenden a evitar descargas eléctricas .
Descripción general
BF Skinner fue un investigador reconocido e influyente que articuló muchos de los constructos teóricos del reforzamiento y el conductismo . Skinner definió los reforzadores según el cambio en la intensidad de la respuesta (tasa de respuesta) en lugar de criterios más subjetivos, como lo que resulta placentero o valioso para una persona. Por consiguiente, las actividades, los alimentos o los objetos considerados agradables o placenteros no necesariamente son reforzantes (ya que no producen un aumento en la respuesta que los precede). Los estímulos, los entornos y las actividades solo se ajustan a la definición de reforzadores si la conducta que precede inmediatamente al posible reforzador aumenta en situaciones similares en el futuro; por ejemplo, un niño que recibe una galleta cuando la pide. Si la frecuencia de la "conducta de pedir galletas" aumenta, la galleta puede considerarse un reforzador de dicha conducta. Sin embargo, si la "conducta de pedir galletas" no aumenta, la galleta no puede considerarse un reforzador.
El único criterio para determinar si un estímulo es reforzante es el cambio en la probabilidad de una conducta tras la administración de dicho reforzador potencial. Otras teorías pueden centrarse en factores adicionales, como si la persona esperaba que una conducta produjera un resultado determinado, pero en la teoría conductual, el reforzamiento se define por un aumento en la probabilidad de una respuesta.
La investigación de laboratorio sobre el refuerzo suele datarse a partir del trabajo de Edward Thorndike , conocido por sus experimentos con gatos que escapaban de cajas de rompecabezas. [ 8 ] Varios otros continuaron esta investigación, en particular BF Skinner, quien publicó su obra fundamental sobre el tema en El comportamiento de los organismos , en 1938, y desarrolló esta investigación en muchas publicaciones posteriores. [ 9 ] Cabe destacar que Skinner argumentó que el refuerzo positivo es superior al castigo para moldear el comportamiento. [ 10 ] Aunque el castigo pueda parecer justo lo opuesto al refuerzo, Skinner afirmó que difieren enormemente, diciendo que el refuerzo positivo produce una modificación conductual duradera (a largo plazo) mientras que el castigo cambia el comportamiento solo temporalmente (a corto plazo) y tiene muchos efectos secundarios perjudiciales.
Numerosos investigadores ampliaron posteriormente nuestra comprensión del reforzamiento y cuestionaron algunas de las conclusiones de Skinner. Por ejemplo, Azrin y Holz definieron el castigo como una «consecuencia de la conducta que reduce la probabilidad futura de dicha conducta» [ 11 ] , y algunos estudios han demostrado que el reforzamiento positivo y el castigo son igualmente eficaces para modificar la conducta. La investigación sobre los efectos del reforzamiento positivo, el reforzamiento negativo y el castigo continúa hoy en día, ya que estos conceptos son fundamentales para la teoría del aprendizaje y se aplican a muchas aplicaciones prácticas de dicha teoría.
Condicionamiento operante
El término condicionamiento operante fue introducido por Skinner para indicar que, en su paradigma experimental, el organismo tiene libertad para interactuar con el entorno. En este paradigma, el experimentador no puede provocar la respuesta deseada; espera a que esta se produzca (sea emitida por el organismo) y luego se administra un reforzador potencial. En el paradigma de condicionamiento clásico , el experimentador provoca la respuesta deseada presentando un estímulo que desencadena un reflejo, el estímulo incondicionado (EI), el cual se asocia (precede) con un estímulo neutro, el estímulo condicionado (EC).
El refuerzo es un término básico en el condicionamiento operante. Para el aspecto del castigo en el condicionamiento operante, véase castigo (psicología) .
Refuerzo positivo
El refuerzo positivo se produce cuando un evento o estímulo deseable se presenta como consecuencia de una conducta y aumenta la probabilidad de que esta conducta se manifieste en entornos similares. [ 12 ] : 253 Por ejemplo, si leer un libro es divertido, experimentar esa diversión refuerza positivamente la conducta de leer libros divertidos. La persona que recibe el refuerzo positivo (es decir, que se divierte leyendo el libro) leerá más libros para divertirse más.
El refuerzo negativo aumenta la frecuencia de una conducta que evita o escapa de una situación o estímulo aversivo . [ 12 ] : 252–253 Es decir, algo desagradable ya está ocurriendo, y la conducta ayuda a la persona a evitar o escapar de lo desagradable. A diferencia del refuerzo positivo, que implica añadir un estímulo agradable, en el refuerzo negativo, el enfoque está en la eliminación de una situación o estímulo desagradable. Por ejemplo, si alguien se siente infeliz, puede realizar una conducta (p. ej., leer libros) para escapar de la situación aversiva (p. ej., sus sentimientos de infelicidad). [ 12 ] : 253 El éxito de esa conducta de evitación o escape para eliminar la situación o estímulo desagradable refuerza la conducta.
Hacer algo desagradable a las personas para prevenir o eliminar que un comportamiento vuelva a ocurrir es castigo , no refuerzo negativo. [ 12 ] : 252 La principal diferencia es que el refuerzo siempre aumenta la probabilidad de un comportamiento (por ejemplo, cambiar de canal cuando uno está aburrido alivia temporalmente el aburrimiento; por lo tanto, habrá más cambios de canal cuando uno está aburrido), mientras que el castigo la disminuye (por ejemplo, la resaca es un estímulo desagradable, por lo que las personas aprenden a evitar el comportamiento que llevó a ese estímulo desagradable).
Extinción
La extinción se produce cuando se ignora una conducta determinada (es decir, cuando no hay consecuencias). Las conductas desaparecen con el tiempo cuando no reciben refuerzo de forma continua. Durante una extinción deliberada, la conducta objetivo aumenta inicialmente (en un intento de producir los efectos esperados, previamente reforzados) y luego disminuye con el tiempo. Ni el refuerzo ni la extinción necesitan ser deliberados para tener un efecto en la conducta de un sujeto. Por ejemplo, si un niño lee libros porque le divierten, la decisión de los padres de ignorar la lectura no eliminará el refuerzo positivo (es decir, la diversión) que el niño recibe al leer libros. Sin embargo, si un niño realiza una conducta para llamar la atención de sus padres, la decisión de estos de ignorarla provocará su extinción, y el niño buscará otra conducta para obtener su atención.
Refuerzo versus castigo
Los reforzadores sirven para aumentar las conductas, mientras que los castigos sirven para disminuirlas; por lo tanto, los reforzadores positivos son estímulos que el sujeto se esforzará por obtener, y los reforzadores negativos son estímulos de los que el sujeto se esforzará por deshacerse o eliminar. [ 13 ] La siguiente tabla ilustra la suma y la resta de estímulos (agradables o aversivos) en relación con el refuerzo frente al castigo.
Otras ideas y conceptos
Distinguir entre refuerzo positivo y negativo puede ser difícil y no siempre necesario. Centrarse en lo que se elimina o se añade y cómo afecta al comportamiento puede resultar más útil.
Un evento que castiga una conducta para algunos puede reforzarla para otros.
Algunos tipos de refuerzo pueden incluir características tanto positivas como negativas, como por ejemplo, un drogadicto que consume drogas para obtener la euforia adicional (refuerzo positivo) y también para eliminar los síntomas de abstinencia (refuerzo negativo).
En el mundo empresarial, el refuerzo positivo es fundamental para impulsar la productividad. Los empleados se motivan constantemente al recibir un estímulo positivo, como un ascenso o una bonificación. También se ven motivados por el refuerzo negativo, como la eliminación de tareas desagradables.
Aunque el refuerzo negativo tiene un efecto positivo a corto plazo en el lugar de trabajo (es decir, fomenta una acción económicamente beneficiosa), la dependencia excesiva del refuerzo negativo dificulta la capacidad de los trabajadores para actuar de forma creativa y comprometida, lo que genera crecimiento a largo plazo. [ 14 ]
Reforzadores primarios y secundarios
Un reforzador primario , a veces llamado reforzador incondicionado , es un estímulo que no requiere emparejarse con otro estímulo para funcionar como reforzador y que probablemente ha adquirido esta función a través de la evolución y su papel en la supervivencia de las especies. [ 15 ] Ejemplos de reforzadores primarios incluyen la comida, el agua y el sexo. Algunos reforzadores primarios, como ciertas drogas, pueden imitar los efectos de otros reforzadores primarios. Si bien estos reforzadores primarios son bastante estables a lo largo de la vida y entre individuos, el valor de refuerzo de los diferentes reforzadores primarios varía debido a múltiples factores (por ejemplo, genética, experiencia). Así, una persona puede preferir un tipo de alimento mientras que otra lo evita. O una persona puede comer mucho mientras que otra come muy poco. Por lo tanto, aunque la comida sea un reforzador primario para ambos individuos, el valor de la comida como reforzador difiere entre ellos.
Un reforzador secundario , también llamado reforzador condicionado , es un estímulo o situación que ha adquirido su función como reforzador tras asociarse con un estímulo que funciona como tal. Este estímulo puede ser un reforzador primario u otro reforzador condicionado (como el dinero).
Al intentar distinguir entre reforzadores primarios y secundarios en ejemplos humanos, utilice la "prueba del cavernícola". Si el estímulo es algo que un cavernícola consideraría deseable de forma natural (por ejemplo, un dulce), entonces es un reforzador primario. Si, por el contrario, el cavernícola no reaccionaría ante él (por ejemplo, un billete de un dólar), es un reforzador secundario. Al igual que con los reforzadores primarios, un organismo puede experimentar satisfacción y privación con los reforzadores secundarios.
Otros términos de refuerzo
Un reforzador generalizado es un reforzador condicionado que ha adquirido la función de reforzador al asociarse con muchos otros reforzadores y funciona como tal bajo una amplia variedad de operaciones motivadoras . (Un ejemplo de esto es el dinero, ya que se asocia con muchos otros reforzadores). [ 16 ] : 83
En el muestreo de reforzadores, se presenta a un organismo un estímulo potencialmente reforzante pero desconocido, sin tener en cuenta ningún comportamiento previo.
El refuerzo socialmente mediado implica la administración de un refuerzo que requiere el comportamiento de otro organismo. Por ejemplo, otra persona proporciona el refuerzo.
El principio de Premack es un caso especial de refuerzo elaborado por David Premack , que establece que una actividad muy preferida puede utilizarse eficazmente como reforzador de una actividad menos preferida. [ 16 ] : 123
La jerarquía de reforzamiento es una lista de acciones que ordena las consecuencias, desde las más deseables hasta las menos deseables, que pueden funcionar como reforzadores. Esta jerarquía se puede utilizar para determinar la frecuencia relativa y la deseabilidad de diferentes actividades, y se emplea con frecuencia al aplicar el principio de Premack.
Los resultados contingentes tienen más probabilidades de reforzar la conducta que las respuestas no contingentes. Los resultados contingentes son aquellos directamente vinculados a una conducta causal , como el encendido de una luz, que depende de accionar un interruptor. Cabe destacar que los resultados contingentes no son necesarios para demostrar el refuerzo, pero la percepción de contingencia puede aumentar el aprendizaje.
Los estímulos contiguos son aquellos que están estrechamente asociados, tanto en el tiempo como en el espacio, con comportamientos específicos. Reducen el tiempo necesario para aprender un comportamiento y, al mismo tiempo, aumentan su resistencia a la extinción . Darle comida a un perro inmediatamente después de que se siente es un estímulo más contiguo (y, por lo tanto, más propenso a reforzar) el comportamiento que una demora de varios minutos en la entrega de la comida tras dicho comportamiento.
El reforzamiento no contingente se refiere a la administración independiente de la respuesta de estímulos identificados como reforzadores para ciertas conductas de ese organismo. Sin embargo, esto generalmente implica la administración temporal de estímulos identificados como mantenedores de la conducta aberrante, lo que disminuye la frecuencia de la conducta objetivo. [ 17 ] Dado que no se identifica ninguna conducta medida como fortalecida, existe controversia en torno al uso del término "reforzamiento" no contingente. [ 18 ]
Refuerzo natural y artificial
En su artículo de 1967, Refuerzo arbitrario y natural , Charles Ferster propuso clasificar el refuerzo en eventos que aumentan la frecuencia de una conducta operante como consecuencia natural de la conducta en sí, y eventos que afectan la frecuencia por requerir la mediación humana, como en una economía de fichas donde los sujetos son recompensados por ciertas conductas por el terapeuta.
En 1970, Baer y Wolf desarrollaron el concepto de "trampas conductuales". [ 19 ] Una trampa conductual requiere solo una respuesta simple para entrar en ella; sin embargo, una vez dentro, la trampa resulta irresistible para generar un cambio general en la conducta. Es el uso de una trampa conductual lo que aumenta el repertorio de una persona, al exponerla al refuerzo natural de dicha conducta. Las trampas conductuales tienen cuatro características:
Se les "atrae" con reforzadores deseables que "conducen" al estudiante a la trampa.
Para entrar en la trampa, basta con una respuesta que requiera poco esfuerzo y que ya forme parte del repertorio.
Las contingencias interrelacionadas de refuerzo dentro de la trampa motivan a la persona a adquirir, extender y mantener las habilidades objetivo. [ 20 ]
Pueden seguir siendo eficaces durante largos periodos de tiempo porque la persona muestra pocos o ningún efecto de saciedad.
Así, el refuerzo artificial puede utilizarse para desarrollar habilidades generalizables, pasando finalmente al refuerzo natural para mantener o incrementar la conducta. Otro ejemplo es una situación social que, por lo general, se desencadenará por una conducta específica una vez que cumpla con un determinado criterio.
Programas de refuerzo intermitente
No siempre se refuerza la conducta cada vez que se emite, y el patrón de reforzamiento influye notablemente en la rapidez con que se aprende una respuesta operante, en su frecuencia en un momento dado y en su duración una vez que cesa el reforzamiento. Las reglas más sencillas que controlan el reforzamiento son el reforzamiento continuo, donde se refuerza cada respuesta, y la extinción, donde no se refuerza ninguna respuesta. Entre estos extremos, los programas de reforzamiento más complejos especifican las reglas que determinan cómo y cuándo una respuesta será seguida por un reforzador.
Un gráfico que muestra las diferentes tasas de respuesta de los cuatro programas de refuerzo simples; cada marca de sombreado designa un reforzador que se está administrando.
Programa de refuerzo de razón : el refuerzo depende únicamente del número de respuestas que haya realizado el organismo.
Refuerzo continuo (RCC) : un programa de refuerzo en el que cada aparición de la respuesta instrumental (respuesta deseada) es seguida por el reforzador. [ 16 ] : 86
Los programas de refuerzo simples tienen una sola regla para determinar cuándo se administra un solo tipo de reforzador para una respuesta específica.
Programas de razón fija (FR): los programas proporcionan refuerzo después de cada n- ésima respuesta. [ 16 ] : 88 Un programa FR 1 es sinónimo de un programa CRF.
(Ej. Cada tres veces que una rata presiona un botón, esa rata recibe una rebanada de queso)
Programa de razón variable (VR): reforzado en promedio cada n- ésima respuesta, pero no siempre en la n- ésima respuesta. [ 16 ] : 88
(Por ejemplo, los jugadores ganan 1 de cada 10 giros en una máquina tragamonedas; sin embargo, esto es un promedio y, hipotéticamente, podrían ganar en cualquier giro).
Intervalo fijo (IF): se refuerza después de una cantidad de tiempo n.
(Ej. Cada 10 minutos, una rata recibe una loncha de queso al pulsar un botón. Con el tiempo, la rata aprenderá a ignorar el botón hasta que transcurran 10 minutos).
Intervalo variable (IV): se refuerza en un promedio de n veces, pero no siempre exactamente n veces. [ 16 ] : 89
(Por ejemplo, un locutor de radio regala entradas para conciertos aproximadamente cada hora, pero los minutos exactos pueden variar).
Programa de tiempo fijo (FT): Proporciona un estímulo reforzador a una hora fija desde la última administración del refuerzo, independientemente de si el sujeto ha respondido o no. En otras palabras, es un programa no contingente.
Tiempo variable (TV): proporciona refuerzo en un tiempo variable promedio desde el último refuerzo, independientemente de si el sujeto ha respondido o no.
Los programas simples se utilizan en muchos procedimientos de refuerzo diferencial [ 21 ] :
Refuerzo diferencial de conductas alternativas (RDCA): un procedimiento de condicionamiento en el que se disminuye una respuesta no deseada mediante su extinción o, con menos frecuencia, mediante un castigo contingente, mientras se proporciona simultáneamente un refuerzo contingente a una respuesta deseable. Un ejemplo sería un profesor que presta atención a un alumno solo cuando levanta la mano, ignorándolo cuando interrumpe.
Refuerzo diferencial de otras conductas (DRO): también conocido como procedimiento de entrenamiento por omisión, es un procedimiento de condicionamiento instrumental en el que se administra periódicamente un reforzador positivo solo si el participante realiza una acción distinta a la respuesta objetivo. Un ejemplo sería reforzar cualquier acción manual que no sea hurgarse la nariz. [ 16 ] : 338
Refuerzo diferencial de conductas incompatibles (RDI): se utiliza para reducir una conducta frecuente sin castigarla , reforzando una respuesta incompatible. Un ejemplo sería reforzar el acto de aplaudir para reducir el hábito de hurgarse la nariz.
Refuerzo diferencial de baja tasa de respuesta (RDR): se utiliza para incentivar tasas bajas de respuesta. Es similar a un programa de intervalos, con la diferencia de que las respuestas prematuras reinician el tiempo requerido entre comportamientos.
Refuerzo diferencial de alta frecuencia (DRH): se utiliza para aumentar las tasas de respuesta elevadas. Es similar a un programa de intervalos, con la diferencia de que se requiere un número mínimo de respuestas en el intervalo para recibir refuerzo.
Efectos de diferentes tipos de horarios simples
Razón fija: la actividad disminuye después de que se administra el reforzador, luego las tasas de respuesta aumentan hasta la siguiente administración del reforzador (pausa posterior al refuerzo).
Razón variable: tasa de respuesta rápida y constante; más resistente a la extinción .
Intervalo fijo: la respuesta aumenta hacia el final del intervalo; escasa resistencia a la extinción.
Intervalo variable: resultados de actividad constante, buena resistencia a la extinción.
Los programas de razón producen tasas de respuesta más altas que los programas de intervalo, cuando las tasas de refuerzo son similares en otros aspectos.
Los programas de refuerzo variables generan tasas de éxito más altas y mayor resistencia a la extinción que la mayoría de los programas de refuerzo fijos. Esto también se conoce como el Efecto de Extinción por Refuerzo Parcial (ERPR).
El programa de refuerzo de razón variable produce tanto la mayor tasa de respuesta como la mayor resistencia a la extinción (por ejemplo, el comportamiento de los jugadores en las máquinas tragamonedas ).
Los programas fijos producen "pausas posteriores al refuerzo" (PPR), donde las respuestas cesan brevemente inmediatamente después del refuerzo, aunque la pausa es una función del requisito de respuesta subsiguiente más que del refuerzo previo. [ 22 ]
El PRP de un programa de intervalo fijo suele ir seguido de una tasa de respuesta acelerada en forma de "vieira", mientras que los programas de razón fija producen una respuesta más "angular".
Patrón de intervalo fijo: el patrón de respuesta que se desarrolla con un programa de refuerzo de intervalo fijo, el desempeño en un intervalo fijo refleja la precisión del sujeto al decir la hora.
Los organismos cuyos programas de reforzamiento se "reducen" (es decir, que requieren más respuestas o un mayor tiempo de espera antes de recibir el reforzamiento) pueden experimentar una "tensión de ratio" si la reducción es demasiado rápida. Esto produce un comportamiento similar al observado durante la extinción.
Tensión de relación: la alteración de la respuesta que se produce cuando se aumenta demasiado rápido un requisito de respuesta de relación fija.
Relación de refuerzo: tasa de respuesta alta y constante que completa cada requisito de la razón. Generalmente, un requisito de razón más alto provoca pausas posteriores al refuerzo más prolongadas.
Los programas de refuerzo parcial son más resistentes a la extinción que los programas de refuerzo continuo.
Los programas de razón son más resistentes que los programas de intervalo, y los programas variables son más resistentes que los fijos.
Los cambios momentáneos en el valor del refuerzo conducen a cambios dinámicos en el comportamiento. [ 23 ]
Horarios compuestos
Los programas compuestos combinan dos o más programas simples diferentes utilizando el mismo reforzador para la misma conducta. Existen muchas posibilidades; entre las más utilizadas se encuentran:
Programas alternativos : un tipo de programa compuesto donde dos o más programas simples están en vigor y el programa que se complete primero produce el refuerzo. [ 24 ]
Programas conjuntivos : un programa de refuerzo complejo en el que dos o más programas simples están en vigor independientemente unos de otros, y deben cumplirse los requisitos de todos los programas simples para que se produzca el refuerzo.
Programas múltiples : Dos o más programas se alternan a lo largo del tiempo, con un estímulo que indica cuál está vigente. Se proporciona refuerzo si se cumple el requisito de respuesta mientras un programa está activo.
Programas mixtos : Pueden presentarse dos o más programas sin que ningún estímulo indique cuál está vigente. Se proporciona refuerzo si se cumple el requisito de respuesta mientras un programa está activo.
Administrar dos programas de refuerzo al mismo tiempo.Programas concurrentes : Un procedimiento de reforzamiento complejo en el que el participante puede elegir entre dos o más programas de reforzamiento simples disponibles simultáneamente. Los organismos pueden alternar entre las alternativas de respuesta en cualquier momento.
Programa de refuerzo en cadena concurrente : un procedimiento de refuerzo complejo en el que se permite al participante elegir, durante el primer enlace, cuál de varios programas de refuerzo simples estará vigente en el segundo enlace. Una vez realizada la elección, las alternativas rechazadas dejan de estar disponibles hasta el inicio del siguiente ensayo.
Programaciones interconectadas : una programación única con dos componentes donde el progreso en un componente afecta el progreso en el otro. En una programación interconectada FR 60 FI 120-s, por ejemplo, cada respuesta resta tiempo al componente de intervalo, de modo que cada respuesta es "igual" a restar dos segundos a la programación FI.
Programas encadenados : El refuerzo se produce después de que se hayan completado dos o más programas sucesivos, con un estímulo que indica cuándo se ha completado un programa y ha comenzado el siguiente.
Programas en tándem : El refuerzo se produce cuando se han completado dos o más requisitos sucesivos del programa, sin que ningún estímulo indique cuándo se ha completado un programa y ha comenzado el siguiente.
Programas de orden superior : la finalización de un programa se refuerza según un segundo programa; por ejemplo, en FR2 (FI10 segundos), se requiere la finalización de dos programas sucesivos de intervalo fijo antes de que se refuerce una respuesta.
Horarios superpuestos
El término psicológico " programas de refuerzo superpuestos" se refiere a una estructura de recompensas donde dos o más programas de refuerzo simples operan simultáneamente. Los reforzadores pueden ser positivos, negativos o ambos. Un ejemplo es una persona que llega a casa después de un largo día de trabajo. El comportamiento de abrir la puerta principal es recompensado con un gran beso en los labios de su pareja y un tirón en los pantalones provocado por el perro de la familia, que salta con entusiasmo. Otro ejemplo de programas de refuerzo superpuestos es una paloma en una jaula experimental que picotea un botón. Cada 20 picotazos, recibe una tolva de grano y, después de 200, acceso a agua.
Los programas de reforzamiento superpuestos son un tipo de programa compuesto que evolucionó a partir del trabajo inicial sobre programas de reforzamiento simples realizado por B.F. Skinner y sus colegas (Skinner y Ferster, 1957). Demostraron que los reforzadores podían administrarse según los programas y, además, que los organismos se comportaban de manera diferente bajo distintos programas. En lugar de que un reforzador, como comida o agua, se administrara cada vez como consecuencia de una conducta, este podría administrarse después de más de una instancia de dicha conducta. Por ejemplo, una paloma podría tener que picotear un interruptor diez veces antes de que aparezca la comida. Este es un "programa de razón". Asimismo, un reforzador podría administrarse después de un intervalo de tiempo transcurrido tras una conducta objetivo. Un ejemplo es una rata a la que se le da una bolita de comida inmediatamente después de la primera respuesta que ocurre dos minutos después de haber presionado la palanca por última vez. Este es un "programa de intervalo".
Además, los programas de razón pueden proporcionar refuerzo tras un número fijo o variable de conductas por parte del organismo. Del mismo modo, los programas de intervalo pueden proporcionar refuerzo tras intervalos de tiempo fijos o variables después de una única respuesta del organismo. Las conductas individuales tienden a generar tasas de respuesta que difieren según cómo se cree el programa de refuerzo. Numerosas investigaciones posteriores en diversos laboratorios han examinado los efectos de la programación de reforzadores en las conductas.
Si a un organismo se le ofrece la oportunidad de elegir entre dos o más programas de refuerzo simples al mismo tiempo, la estructura de refuerzo se denomina "programa de refuerzo concurrente". Brechner (1974, 1977) introdujo el concepto de programas de refuerzo superpuestos en un intento de crear una analogía de laboratorio de trampas sociales , como cuando los humanos sobreexplotan sus pesquerías o destruyen sus selvas tropicales. Brechner creó una situación en la que los programas de refuerzo simples se superponían entre sí. En otras palabras, una sola respuesta o grupo de respuestas de un organismo conducía a múltiples consecuencias. Los programas de refuerzo concurrentes pueden pensarse como programas "o", y los programas de refuerzo superpuestos pueden pensarse como programas "y". Brechner y Linder (1981) y Brechner (1987) ampliaron el concepto para describir cómo los programas superpuestos y la analogía de la trampa social podrían usarse para analizar la forma en que la energía fluye a través de los sistemas .
Los programas de refuerzo superpuestos tienen muchas aplicaciones en el mundo real, además de generar trampas sociales . Se pueden crear diversas situaciones individuales y sociales superponiendo programas de refuerzo simples. Por ejemplo, una persona podría tener adicciones simultáneas al tabaco y al alcohol. Incluso se pueden crear o simular situaciones más complejas superponiendo dos o más programas concurrentes. Por ejemplo, un estudiante de último año de secundaria podría tener que elegir entre ir a la Universidad de Stanford o a la UCLA, y al mismo tiempo tener la opción de ingresar al Ejército o a la Fuerza Aérea, y simultáneamente la opción de aceptar un trabajo en una empresa de internet o en una empresa de software. Esa es una estructura de refuerzo de tres programas de refuerzo concurrentes superpuestos.
Los programas de refuerzo superpuestos pueden crear las tres situaciones de conflicto clásicas (conflicto de aproximación-aproximación, conflicto de aproximación-evitación y conflicto de evitación-evitación) descritas por Kurt Lewin (1935) y pueden operacionalizar otras situaciones lewinianas analizadas mediante su análisis de campo de fuerzas . Otros ejemplos del uso de programas de refuerzo superpuestos como herramienta analítica son su aplicación a las contingencias del control de alquileres (Brechner, 2003) y al problema del vertido de residuos tóxicos en el sistema de drenaje pluvial del condado de Los Ángeles (Brechner, 2010).
Horarios simultáneos
En el condicionamiento operante , los programas de reforzamiento concurrentes son programas de reforzamiento que están disponibles simultáneamente para un sujeto animal o participante humano, de modo que el sujeto o participante puede responder a cualquiera de los dos programas. Por ejemplo, en una tarea de elección forzada entre dos alternativas , una paloma en una caja de Skinner se enfrenta a dos teclas para picotear; puede picotear cualquiera de ellas, y el reforzamiento alimenticio puede ocurrir después de picotear cualquiera de las dos. Los programas de reforzamiento establecidos para los picoteos en las dos teclas pueden ser diferentes. Pueden ser independientes o estar vinculados, de modo que el comportamiento en una tecla afecte la probabilidad de reforzamiento en la otra.
No es necesario que las respuestas a los dos programas sean físicamente distintas. En una forma alternativa de organizar programas concurrentes, introducida por Findley en 1958, ambos programas se organizan en una sola tecla u otro dispositivo de respuesta, y el sujeto puede presionar una segunda tecla para cambiar entre los programas. En este procedimiento de "programación concurrente de Findley", un estímulo (por ejemplo, el color de la tecla principal) indica qué programa está activo.
Los horarios simultáneos suelen provocar una rápida alternancia entre las teclas. Para evitarlo, se suele introducir un "retraso de cambio": cada horario se desactiva durante un breve periodo después de que el sujeto cambie a él.
El moldeamiento consiste en el refuerzo de aproximaciones sucesivas a una respuesta instrumental deseada. Por ejemplo, al entrenar a una rata para que presione una palanca, al principio se refuerza simplemente girar hacia ella. Luego, solo se refuerza girar y dar un paso hacia ella. Finalmente, la rata será reforzada por presionar la palanca. El logro exitoso de una conducta inicia el proceso de moldeamiento para la siguiente. A medida que avanza el entrenamiento, la respuesta se asemeja cada vez más a la conducta deseada, y cada conducta subsiguiente se convierte en una aproximación más cercana a la conducta final. [ 26 ]
La intervención de moldeamiento se utiliza en diversas situaciones de entrenamiento, así como en personas con autismo y otras discapacidades del desarrollo. Cuando el moldeamiento se combina con otras prácticas basadas en la evidencia, como el Entrenamiento en Comunicación Funcional (ECF), [ 27 ] puede generar resultados positivos en el comportamiento humano. El moldeamiento generalmente utiliza refuerzo continuo, pero posteriormente la respuesta puede modificarse a un programa de refuerzo intermitente.
El moldeamiento también se utiliza para el rechazo de alimentos. [ 28 ] El rechazo de alimentos se produce cuando un individuo tiene una aversión parcial o total a ciertos alimentos. Esto puede ser tan leve como ser un comensal quisquilloso o tan grave que puede afectar la salud de la persona. El moldeamiento se ha utilizado con una alta tasa de éxito para la aceptación de alimentos. [ 29 ]
Encadenamiento
El encadenamiento consiste en vincular conductas discretas en una serie, de modo que la consecuencia de cada conducta sea tanto el refuerzo de la conducta anterior como el estímulo antecedente de la siguiente. Existen muchas maneras de enseñar el encadenamiento, como el encadenamiento hacia adelante (que comienza con la primera conducta de la cadena), el encadenamiento hacia atrás (que comienza con la última conducta) y el encadenamiento de tareas totales (que enseña cada conducta de la cadena simultáneamente). Las rutinas matutinas de las personas son un ejemplo típico de encadenamiento, donde una serie de conductas (por ejemplo, ducharse, secarse, vestirse) ocurren en secuencia como un hábito bien aprendido.
Los comportamientos desafiantes observados en personas con autismo y otras discapacidades relacionadas se han manejado y mantenido con éxito en estudios que utilizan un programa de refuerzos encadenados. [ 30 ] El entrenamiento en comunicación funcional es una intervención que a menudo utiliza programas de refuerzo encadenados para promover eficazmente la respuesta de comunicación funcional apropiada y deseada. [ 31 ]
Modelos matemáticos
Se han realizado investigaciones para construir un modelo matemático de refuerzo. Este modelo se conoce como MPR, acrónimo de principios matemáticos de refuerzo . Peter Killeen ha realizado descubrimientos clave en este campo con su investigación sobre palomas. [ 32 ]
Aplicaciones
El refuerzo y el castigo son omnipresentes en las interacciones sociales humanas, y se han propuesto e implementado numerosas aplicaciones de los principios del condicionamiento operante. A continuación, se presentan algunos ejemplos.
Adicción y dependencia
El refuerzo positivo y negativo juegan papeles centrales en el desarrollo y mantenimiento de la adicción y la dependencia de drogas . Una droga adictiva es intrínsecamente gratificante ; es decir, funciona como un reforzador positivo primario del consumo de drogas. El sistema de recompensa del cerebro le asigna saliencia de incentivo (es decir, es "deseada" o "deseada"), [ 33 ] [ 34 ] [ 35 ] de modo que, a medida que se desarrolla una adicción, la privación de la droga conduce al deseo compulsivo. Además, los estímulos asociados con el consumo de drogas , por ejemplo, la vista de una jeringa y el lugar de consumo , se asocian con el refuerzo intenso inducido por la droga. [ 33 ] [ 34 ] [ 35 ] Estos estímulos previamente neutros adquieren varias propiedades: su aparición puede inducir el deseo compulsivo y pueden convertirse en reforzadores positivos condicionados del consumo continuado. [ 33 ] [ 34 ] [ 35 ] Por lo tanto, si una persona adicta se encuentra con uno de estos estímulos relacionados con las drogas, puede reaparecer el deseo de consumir la droga asociada. Por ejemplo, las agencias antidrogas utilizaban anteriormente carteles con imágenes de parafernalia de drogas para mostrar los peligros del consumo. Sin embargo, estos carteles ya no se utilizan debido a los efectos de la saliencia del incentivo, que provoca recaídas al ver los estímulos ilustrados en ellos.
Los adiestradores de animales y los dueños de mascotas aplicaban los principios y prácticas del condicionamiento operante mucho antes de que estas ideas fueran nombradas y estudiadas, y el adiestramiento animal sigue proporcionando uno de los ejemplos más claros y convincentes de control operante. De los conceptos y procedimientos descritos en este artículo, algunos de los más destacados son: la disponibilidad de refuerzo inmediato (por ejemplo, la omnipresente bolsa de golosinas para perros); la contingencia, que asegura que el refuerzo sigue al comportamiento deseado y no a otra cosa; el uso de refuerzo secundario, como hacer sonar un clicker inmediatamente después de una respuesta deseada; el moldeamiento, como lograr gradualmente que un perro salte cada vez más alto; el refuerzo intermitente, que reduce la frecuencia de esas golosinas para inducir un comportamiento persistente sin saciedad; el encadenamiento, donde un comportamiento complejo se va construyendo gradualmente. [ 36 ]
Comportamiento infantil: formación para padres sobre el manejo de la conducta infantil.
Proporcionar refuerzo positivo para conductas apropiadas en los niños es un enfoque principal de la capacitación para padres. Por lo general, los padres aprenden a recompensar la conducta apropiada mediante recompensas sociales (como elogios, sonrisas y abrazos) y recompensas concretas (como pegatinas o puntos para una recompensa mayor como parte de un sistema de incentivos creado en colaboración con el niño). [ 37 ] Además, los padres aprenden a seleccionar conductas simples como enfoque inicial y a recompensar cada uno de los pequeños pasos que su hijo logra para alcanzar una meta mayor (este concepto se llama "aproximaciones sucesivas"). [ 37 ] [ 38 ] También pueden usar recompensas indirectas, como tablas de progreso . Proporcionar refuerzo positivo en el aula puede ser beneficioso para el éxito del estudiante. Al aplicar refuerzo positivo a los estudiantes, es crucial individualizarlo según las necesidades de cada estudiante. De esta manera, el estudiante entiende por qué recibe el elogio, puede aceptarlo y, eventualmente, aprende a continuar la acción que se ganó con el refuerzo positivo. Por ejemplo, el uso de recompensas o tiempo extra de recreo podría ser más efectivo para algunos estudiantes, mientras que otros podrían aceptar la medida al recibir pegatinas o marcas de verificación que indiquen elogios.
Ciencias económicas
Tanto psicólogos como economistas se han interesado en aplicar conceptos y hallazgos del condicionamiento operante al comportamiento humano en el mercado. Un ejemplo es el análisis de la demanda del consumidor, medida por la cantidad de un bien que se compra. En economía, el grado en que el precio influye en el consumo se denomina "elasticidad precio de la demanda". Ciertos bienes son más elásticos que otros; por ejemplo, un cambio en el precio de ciertos alimentos puede tener un gran efecto en la cantidad comprada, mientras que la gasolina y otros productos básicos pueden verse menos afectados por los cambios de precio. En términos de análisis operante, estos efectos pueden interpretarse en función de las motivaciones de los consumidores y el valor relativo de los bienes como reforzadores. [ 39 ]
Juegos de azar: programación de ratio variable
Como se mencionó anteriormente en este artículo, un programa de refuerzo de razón variable produce refuerzo tras la emisión de un número impredecible de respuestas. Este programa suele generar respuestas rápidas y persistentes. Las máquinas tragamonedas pagan según un programa de razón variable y producen precisamente este tipo de comportamiento persistente de accionar la palanca en los jugadores. Dado que las máquinas están programadas para pagar menos dinero del que ingresan, el jugador persistente de tragamonedas invariablemente pierde a largo plazo. Las máquinas tragamonedas, y por ende el refuerzo de razón variable, a menudo han sido señaladas como un factor subyacente a la adicción al juego. [ 40 ]
Elogio
El concepto de elogio como medio de refuerzo conductual en humanos tiene sus raíces en el modelo de condicionamiento operante de BF Skinner. Desde esta perspectiva, el elogio se ha considerado un medio de refuerzo positivo, en el que se hace más probable que ocurra una conducta observada al elogiarla contingentemente. [ 41 ] Cientos de estudios han demostrado la eficacia del elogio para promover conductas positivas, especialmente en el estudio del uso del elogio por parte de maestros y padres en niños para promover una mejor conducta y rendimiento académico, [ 42 ] [ 43 ] pero también en el estudio del rendimiento laboral. [ 44 ] También se ha demostrado que el elogio refuerza conductas positivas en individuos adyacentes no elogiados (como un compañero de clase del receptor del elogio) a través del refuerzo vicario. [ 45 ] El elogio puede ser más o menos eficaz para cambiar la conducta dependiendo de su forma, contenido y manera de ser transmitido. Para que el elogio produzca un cambio de comportamiento positivo, debe estar supeditado al comportamiento positivo (es decir, solo debe administrarse después de que se haya realizado el comportamiento deseado), debe especificar los detalles del comportamiento que se va a reforzar y debe expresarse con sinceridad y credibilidad. [ 46 ]
Reconociendo el efecto del elogio como estrategia de refuerzo positivo, numerosas intervenciones conductuales y cognitivo-conductuales han incorporado el uso del elogio en sus protocolos. [ 47 ] [ 48 ] El uso estratégico del elogio se reconoce como una práctica basada en la evidencia tanto en la gestión del aula [ 47 ] como en las intervenciones de capacitación para padres, [ 43 ] aunque el elogio a menudo se subsume en la investigación de intervenciones dentro de una categoría más amplia de refuerzo positivo, que incluye estrategias como la atención estratégica y las recompensas conductuales.
Vínculo traumático
El vínculo traumático se produce como resultado de ciclos continuos de abuso en los que el refuerzo intermitente de recompensa y castigo crea vínculos emocionales poderosos que son resistentes al cambio. [ 49 ] [ 50 ]
La otra fuente indicó que [ 51 ] «Las condiciones necesarias para el vínculo traumático son que una persona debe dominar a la otra y que el nivel de abuso aumenta y luego disminuye crónicamente. La relación se caracteriza por períodos de comportamiento permisivo, compasivo e incluso afectuoso por parte de la persona dominante, puntuados por episodios intermitentes de abuso intenso. Para mantener el control, el victimario manipula el comportamiento de la víctima y limita las opciones de la víctima para perpetuar el desequilibrio de poder. Cualquier amenaza al equilibrio de dominación y sumisión puede ser respondida con un ciclo de castigo creciente que va desde la intimidación furiosa hasta los estallidos de violencia intensa. El agresor también aísla a la víctima de otras fuentes de apoyo, lo que reduce la probabilidad de detección e intervención, perjudica su capacidad para recibir retroalimentación autorreferencial que la contrarreste y refuerza su sentimiento de dependencia unilateral . Los efectos traumáticos de estas relaciones abusivas pueden incluir el deterioro de la capacidad de la víctima para autoevaluarse con precisión, lo que genera un sentimiento de insuficiencia personal y una dependencia subordinada hacia la persona dominante. Las víctimas también pueden enfrentar diversas consecuencias sociales y legales desagradables derivadas de su vinculación emocional y conductual con alguien que perpetró actos agresivos, incluso si ellas mismas fueron las víctimas de la agresión.
Juegos de vídeo
La mayoría de los videojuegos están diseñados en torno a algún tipo de bucle compulsivo, añadiendo un tipo de refuerzo positivo a través de un programa de tasa variable para mantener al jugador jugando, aunque esto también puede conducir a la adicción a los videojuegos . [ 52 ]
Como parte de una tendencia en la monetización de videojuegos en la década de 2010, algunos juegos ofrecían "cajas de botín" como recompensas o comprables con dinero real, que contenían una selección aleatoria de objetos del juego, distribuidos según su rareza. Esta práctica se ha vinculado a los mismos métodos que utilizan las máquinas tragamonedas y otros dispositivos de juego para repartir recompensas, ya que sigue un esquema de tasa variable. Si bien la percepción general es que las cajas de botín son una forma de juego, esta práctica solo se clasifica como tal en algunos países, donde se considera legal. Sin embargo, los métodos para usar estos objetos como moneda virtual en juegos de azar en línea o intercambiarlos por dinero real han creado un mercado de apuestas con objetos virtuales que está siendo evaluado legalmente. [ 53 ]
Críticas
La definición estándar de refuerzo conductual ha sido criticada por ser circular , ya que parece argumentar que la fuerza de respuesta aumenta con el refuerzo, y define el refuerzo como algo que aumenta la fuerza de respuesta (es decir, la fuerza de respuesta aumenta con cosas que aumentan la fuerza de respuesta). Sin embargo, el uso correcto [ 54 ] del refuerzo es que algo es un reforzador debido a su efecto sobre la conducta, y no al revés. Se vuelve circular si se dice que un estímulo particular fortalece la conducta porque es un reforzador, y no se explica por qué un estímulo produce ese efecto sobre la conducta. Se han propuesto otras definiciones, como la de FD Sheffield de "conducta consumatoria contingente a una respuesta", pero estas no se utilizan ampliamente en psicología. [ 55 ]
Cada vez más, la comprensión del papel que desempeñan los reforzadores se aleja de un efecto de "fortalecimiento" para adoptar un efecto de "señalización". [ 56 ] Es decir, la perspectiva de que los reforzadores aumentan la respuesta porque señalan las conductas que probablemente resulten en reforzamiento. Si bien en la mayoría de las aplicaciones prácticas, el efecto de cualquier reforzador dado será el mismo independientemente de si el reforzador es de señalización o de fortalecimiento, este enfoque ayuda a explicar varios fenómenos conductuales, incluidos los patrones de respuesta en programas de reforzamiento intermitente (escalones de intervalo fijo) y el efecto de resultados diferenciales . [ 57 ]
↑ Definición de refuerzo de la Asociación Americana de Psicología. Consultado el 30 de enero de 2024.
1 2 Leaf, Justin B.; Cihon, Joseph H.; Leaf, Ronald; McEachin, John; Liu, Nicholas; Russell, Noah; Unumb, Lorri; Shapiro, Sydney; Khosrowshahi, Dara (junio de 2022). "Preocupaciones sobre la intervención basada en ABA: una evaluación y recomendaciones" . Journal of Autism and Developmental Disorders . 52 (6): 2838– 2853. doi : 10.1007/s10803-021-05137-y . ISSN 1573-3432 . PMC 9114057. PMID 34132968 . Desde una perspectiva de análisis conductual, el castigo describe cualquier contexto en el que una respuesta va seguida de un evento (es decir, un cambio de estímulo) que resulta en una disminución de la probabilidad de respuestas similares en situaciones similares. Esta definición no incluye elementos como el dolor, el miedo, la incomodidad, etc. Supongamos que una persona estaciona su auto ocupando dos espacios y un transeúnte comenta: «¡Qué desconsiderado!». Si la probabilidad de ocupar dos espacios al estacionar disminuye posteriormente, podemos presumir razonablemente que se produjo un castigo.
↑ Schultz W (julio de 2015). "Señales neuronales de recompensa y decisión: de las teorías a los datos" . Physiological Reviews . 95 (3): 853– 951. doi : 10.1152/physrev.00023.2014 . PMC 4491543. PMID 26109341. Las recompensas en el condicionamiento operante son reforzadores positivos. ... El comportamiento operante da una buena definición de recompensas. Cualquier cosa que haga que un individuo vuelva por más es un reforzador positivo y, por lo tanto, una recompensa. Aunque proporciona una buena definición, el refuerzo positivo es solo una de varias funciones de recompensa. ... Las recompensas son atractivas. Son motivadoras y nos hacen esforzarnos. ... Las recompensas inducen un comportamiento de aproximación, también llamado comportamiento apetitivo o preparatorio, y un comportamiento consumatorio. ... Por lo tanto, cualquier estímulo, objeto, evento, actividad o situación que tenga el potencial de hacernos acercarnos y consumirlo es, por definición, una recompensa. Las recompensas intrínsecas son actividades placenteras por sí mismas, que se realizan por el mero placer que brindan, sin ser un medio para obtener recompensas extrínsecas. Son recompensas genuinas en sí mismas, ya que inducen al aprendizaje, la aproximación y el placer, como perfeccionar, tocar y disfrutar del piano. Si bien pueden servir para condicionar recompensas de orden superior, no son recompensas condicionadas de orden superior, puesto que alcanzar sus propiedades de recompensa no requiere estar asociado a una recompensa incondicionada.
↑ Malenka RC, Nestler EJ, Hyman SE (2009). «Capítulo 15: Refuerzo y trastornos adictivos». En Sydor A, Brown RY (eds.). Neurofarmacología molecular: Fundamentos de la neurociencia clínica (2.ª ed.). Nueva York: McGraw-Hill Medical. págs. 364–375 . ISBN9780071481274.
↑ Nestler EJ (diciembre de 2013). " Bases celulares de la memoria para la adicción" . Dialogues in Clinical Neuroscience . 15 (4): 431– 443. PMC 3898681. PMID 24459410. A pesar de la importancia de numerosos factores psicosociales, en su esencia, la adicción a las drogas implica un proceso biológico: la capacidad de la exposición repetida a una droga de abuso para inducir cambios en un cerebro vulnerable que impulsan la búsqueda y el consumo compulsivo de drogas, y la pérdida de control sobre el consumo de drogas, que definen un estado de adicción. ... Una gran cantidad de literatura ha demostrado que dicha inducción de ΔFosB en neuronas de tipo D1 [núcleo accumbens] aumenta la sensibilidad de un animal a las recompensas naturales y a las drogas y promueve la autoadministración de drogas, presumiblemente a través de un proceso de refuerzo positivo ... Otro objetivo de ΔFosB es cFos: a medida que ΔFosB se acumula con la exposición repetida a las drogas, reprime c-Fos y contribuye al interruptor molecular mediante el cual ΔFosB se induce selectivamente en el estado de tratamiento crónico con drogas. 41 . ... Además, hay evidencia creciente de que, a pesar de una variedad de riesgos genéticos para la adicción en toda la población, la exposición a dosis suficientemente altas de una droga durante largos períodos de tiempo puede transformar a alguien que tiene una carga genética relativamente menor en un adicto.
↑ Volkow ND, Koob GF, McLellan AT (enero de 2016). "Avances neurobiológicos del modelo de enfermedad cerebral de la adicción" . New England Journal of Medicine . 374 (4): 363– 371. doi : 10.1056/NEJMra1511480 . PMC 6135257. PMID 26816013. Trastorno por consumo de sustancias: Un término diagnóstico en la quinta edición del Manual diagnóstico y estadístico de los trastornos mentales (DSM-5) que se refiere al uso recurrente de alcohol u otras drogas que causa deterioro clínica y funcionalmente significativo, como problemas de salud, discapacidad y falta de cumplimiento de responsabilidades importantes en el trabajo, la escuela o el hogar. Dependiendo del nivel de gravedad, este trastorno se clasifica como leve, moderado o grave. Adicción: Término utilizado para indicar la etapa más grave y crónica del trastorno por consumo de sustancias, en la que existe una pérdida sustancial del autocontrol, manifestada por el consumo compulsivo de drogas a pesar del deseo de dejar de consumirlas. En el DSM-5, el término adicción es sinónimo de trastorno grave por consumo de sustancias.
1 2 3 4 Zane, Thomas; Field, Sean; Nichols, Brandon (2021). «Castigo». En Volkmar, Fred R. (ed.). Enciclopedia de los trastornos del espectro autista (2.ª ed.). Cham: Springer International Publishing AG. ISBN978-3-319-91280-6.
↑ Thorndike E (junio de 1898). "Algunos experimentos sobre la inteligencia animal" . Science . 7 (181): 818–24 . Bibcode : 1898Sci.....7..818T . doi : 10.1126/science.7.181.818 . PMID 17769765 .
↑ Skinner, BF " El comportamiento de los organismos: un análisis experimental ", 1938 Nueva York: Appleton-Century-Crofts
↑ Skinner BF (1948). Walden Dos . Toronto: The Macmillan Company.
↑ Honig W (1966). Comportamiento operante: áreas de investigación y aplicación . Nueva York: Meredith Publishing Company. pág. 381.
1 2 3 4 Flora S (2004). El poder del refuerzo . Albany: State University of New York Press.
↑ D'Amato MR (1969). Marx MH (ed.). Procesos de aprendizaje: Condicionamiento instrumental . Toronto: The Macmillan Company.
↑ Harter JK (2002). Keyes CL (ed.). Bienestar en el lugar de trabajo y su relación con los resultados empresariales: una revisión de los estudios de Gallup (PDF) . Washington DC: Asociación Americana de Psicología.
↑ Tucker M, Sigafoos J, Bushell H (octubre de 1998). "Uso del refuerzo no contingente en el tratamiento de conductas desafiantes. Una revisión y guía clínica". Modificación de la conducta . 22 (4): 529– 47. doi : 10.1177/01454455980224005 . PMID 9755650 . S2CID 21542125 .
↑ Droleskey RE, Andrews K, Chiarantini L, DeLoach JR (1992). "Uso de sondas fluorescentes para describir el proceso de encapsulación mediante diálisis hipotónica". El uso de eritrocitos resellados como portadores y biorreactores . Avances en Medicina Experimental y Biología. Vol. 326. págs. 73–80 . doi : 10.1007/978-1-4615-3030-5_9 . ISBN978-1-4613-6321-7. PMID 1284187 .
↑ Baer DM, Wolf MM. "La entrada en comunidades naturales de refuerzo". En Ulrich R, Stachnik T, Mabry J (eds.). Control del comportamiento humano . Vol. 2. Glenview, IL: Scott Foresman. págs. 319–24 .
↑ Kohler FW, Greenwood CR (1986). "Hacia una tecnología de generalización: La identificación de contingencias naturales de refuerzo" . The Behavior Analyst . 9 (1): 19– 26. doi : 10.1007/bf03391926 . PMC 2741872. PMID 22478644 .
↑ Vollmer TR, Iwata BA (1992). "Refuerzo diferencial como tratamiento para trastornos de la conducta: variaciones procedimentales y funcionales". Investigación en Discapacidades del Desarrollo . 13 (4): 393– 417. doi : 10.1016/0891-4222(92)90013-v . PMID 1509180 .
↑ Derenne A, Flannery KA (2007). "Pausa FR dentro de la sesión" . The Behavior Analyst Today . 8 (2): 175– 86. doi : 10.1037/h0100611 .
↑ McSweeney FK, Murphy ES, Kowal BP (2001). "Cambios dinámicos en el valor del reforzador: algunos conceptos erróneos y por qué debería importarte" . The Behavior Analyst Today . 2 (4): 341– 349. doi : 10.1037/h0099952 .
^ Iversen IH, Lattal KA (1991). Análisis Experimental del Comportamiento . Ámsterdam: Elsevier. ISBN9781483291260.
↑ Martin TL, Yu CT, Martin GL, Fazzio D (2006). "Sobre la elección, la preferencia y la preferencia por la elección" . The Behavior Analyst Today . 7 (2): 234– 48. doi : 10.1037/h0100083 . PMC 3558524. PMID 23372459 .
↑ Ghaemmaghami, Mahshid; Hanley, Gregory P.; Jessel, Joshua; Landa, Robin (14 de mayo de 2018). "Moldeando respuestas de comunicación funcional complejas" . Journal of Applied Behavior Analysis . 51 (3): 502– 520. doi : 10.1002/jaba.468 . ISSN 0021-8855 . PMID 29761485 .
↑ Tarbox y Lanagan Bermudez, Jonathan y Taira (2017). Tratamiento de las dificultades de alimentación en el autismo . San Diego: Academic Press. págs. 1–6 . ISBN978-0-12-813563-1.
↑ Turner, Virginia R; et al. (2020). "Moldeado de respuestas para mejorar la aceptación de alimentos en niños con autismo: efectos de conjuntos de alimentos pequeños y grandes". Investigación en discapacidades del desarrollo . 98 103574. doi : 10.1016/j.ridd.2020.103574 . PMID 31982827. S2CID 210922007 .
↑ "CORRECCIÓN al artículo "Evaluaciones adicionales del entrenamiento en comunicación funcional y los programas de refuerzo encadenados para tratar múltiples funciones de conductas problemáticas"" . Modificación de la conducta . 46 (1): 254. 24 de julio de 2020. doi : 10.1177/0145445520945810 . ISSN 0145-4455 . PMID 32706269 . S2CID 241136859 .
↑ Falcomata, Terry S.; Roane, Henry S.; Muething, Colin S.; Stephenson, Kasey M.; Ing, Anna D. (9 de febrero de 2012). "Entrenamiento en comunicación funcional y programas encadenados de refuerzo para tratar conductas desafiantes mantenidas por terminaciones de interrupciones de actividad" . Modificación de la conducta . 36 (5): 630– 649. doi : 10.1177/0145445511433821 . ISSN 0145-4455 . PMID 22327267. S2CID 29108702 .
↑ Killeen PR (4 de febrero de 2010). "Principios matemáticos del refuerzo" . Behavioral and Brain Sciences . 17 (1): 105– 135. doi : 10.1017/S0140525X00033628 .
1 2 3 4 Edwards S (2016). "Principios de refuerzo para la medicina de las adicciones; del consumo recreativo de drogas al trastorno psiquiátrico". Neurociencia para la medicina de las adicciones: de la prevención a la rehabilitación - Constructos y fármacos . Progress in Brain Research. Vol. 223. pp. 63–76 . doi : 10.1016/bs.pbr.2015.07.005 . ISBN9780444635457. PMID 26806771 . Las sustancias de abuso (que van desde el alcohol hasta los psicoestimulantes) se ingieren inicialmente en ocasiones regulares según sus propiedades de refuerzo positivo. Es importante destacar que la exposición repetida a sustancias gratificantes desencadena una cadena de eventos de refuerzo secundario, por los cuales las señales y los contextos asociados con el consumo de drogas pueden volverse reforzadores y, por lo tanto, contribuir al uso continuado y al posible abuso de la(s) sustancia(s) de elección. ... Una dimensión importante del refuerzo altamente relevante para el proceso de adicción (y particularmente la recaída) es el refuerzo secundario (Stewart, 1992). Los reforzadores secundarios (en muchos casos también considerados reforzadores condicionados) probablemente impulsan la mayoría de los procesos de refuerzo en los humanos. En el caso específico de la adicción a las drogas, las señales y los contextos íntimamente y repetidamente asociados con el consumo de drogas a menudo se convierten en reforzadores ... Una pieza fundamental de la teoría de la sensibilización al incentivo de la adicción de Robinson y Berridge postula que el valor de incentivo o la naturaleza atractiva de tales procesos de refuerzo secundario, además de los reforzadores primarios en sí mismos, puede persistir e incluso sensibilizarse con el tiempo en conjunción con el desarrollo de la adicción a las drogas (Robinson y Berridge, 1993). ... El refuerzo negativo es una condición especial asociada con un fortalecimiento de las respuestas conductuales que terminan algún estímulo continuo (presumiblemente aversivo). En este caso, podemos definir un reforzador negativo como un estímulo motivacional que fortalece dicha respuesta de "escape". Históricamente, en relación con la adicción a las drogas, este fenómeno se ha observado consistentemente en humanos, donde las drogas de abuso se autoadministran para saciar una necesidad motivacional en el estado de abstinencia (Wikler, 1952).
1 2 3 Berridge KC (abril de 2012). "Del error de predicción a la saliencia del incentivo: computación mesolímbica de la motivación de recompensa" . The European Journal of Neuroscience . 35 (7): 1124– 43. doi : 10.1111/j.1460-9568.2012.07990.x . PMC 3325516. PMID 22487042. Cuando a un EC+ pavloviano se le atribuye saliencia de incentivo , no solo desencadena el "deseo" de su ECI, sino que a menudo la señal en sí misma se vuelve muy atractiva, incluso hasta un grado irracional. Esta atracción de la señal es otra característica distintiva de la saliencia de incentivo. El EC se vuelve difícil de ignorar (Wiers y Stacy, 2006; Hickey et al., 2010a; Piech et al., 2010; Anderson et al., 2011). El EC incluso adquiere propiedades de incentivo similares a las de su EI. Un EC atractivo suele provocar una conducta motivada, y a veces un individuo puede incluso intentar "consumirlo" como si fuera su EI (por ejemplo, comer, beber, fumar, tener relaciones sexuales, tomar una droga). El "deseo" de un EC también puede convertir el estímulo previamente neutro en un reforzador condicionado instrumental, de modo que un individuo se esforzará por obtener la señal (sin embargo, también existen mecanismos psicológicos alternativos para el reforzamiento condicionado).
1 2 3 Berridge KC, Kringelbach ML (mayo de 2015). "Sistemas de placer en el cerebro". Neuron. 86 (3): 646– 64. doi: 10.1016/j.neuron.2015.02.018. PMC 4425246. PMID 25950633. Un objetivo importante en el futuro para la neurociencia de la adicción es comprender cómo la motivación intensa se enfoca estrechamente en un objetivo particular. Se ha sugerido que la adicción se debe en parte a la excesiva saliencia de incentivo producida por sistemas de dopamina sensibilizados o hiperreactivos que producen un "deseo" intenso (Robinson y Berridge, 1993). Pero por qué un objetivo se vuelve más "deseado" que todos los demás no se ha explicado completamente. En adictos o pacientes estimulados por agonistas, la repetición de la estimulación dopaminérgica de la saliencia de incentivo se atribuye a búsquedas individualizadas particulares, como tomar la droga adictiva o las compulsiones particulares. En situaciones de recompensa pavloviana, algunas señales de recompensa se vuelven más "deseadas" que otras como poderosos imanes motivacionales, de maneras que difieren entre individuos (Robinson et al., 2014b; Saunders y Robinson, 2013). ... Sin embargo, los efectos hedónicos bien podrían cambiar con el tiempo. A medida que se tomaba una droga repetidamente, la sensibilización dopaminérgica mesolímbica podría ocurrir en consecuencia en individuos susceptibles para amplificar el "deseo" (Leyton y Vezina, 2013; Lodge y Grace, 2011; Wolf y Ferrario, 2010), incluso si los mecanismos hedónicos opioides sufrieron una regulación negativa debido a la estimulación continua de la droga, produciendo tolerancia al "placer". La sensibilización a los incentivos produciría adicción, al magnificar selectivamente el "deseo" desencadenado por señales para volver a tomar la droga, y por lo tanto causaría una poderosa motivación incluso si la droga se volviera menos placentera (Robinson y Berridge, 1993).
↑ McGreevy PD, Boakes RA (2007). Zanahorias y palos: principios del adiestramiento animal . Cambridge: Cambridge University Press. ISBN978-0-521-68691-4.
1 2 Kazdin AE (2010). Entrenamiento en habilidades de resolución de problemas y entrenamiento en manejo parental para el trastorno negativista desafiante y el trastorno de conducta. Psicoterapias basadas en la evidencia para niños y adolescentes (2.ª ed.) , 211–226. Nueva York: Guilford Press.
↑ Forgatch MS, Patterson GR (2010). Entrenamiento para el manejo parental: modelo de Oregón: una intervención para el comportamiento antisocial en niños y adolescentes. Psicoterapias basadas en la evidencia para niños y adolescentes (2.ª ed.) , 159-178. Nueva York: Guilford Press.
↑ Domjan, M. (2009). Los principios del aprendizaje y el comportamiento. Wadsworth Publishing Company. 6.ª edición. páginas 244–249.
↑ Lozano Bleda JH, Pérez Nieto MA (noviembre de 2012). "Impulsividad, inteligencia y contingencias de refuerzo discriminatorias en un programa de razón fija 3". The Spanish Journal of Psychology . 15 (3): 922– 9. doi : 10.5209/rev_sjop.2012.v15.n3.39384 . PMID 23156902. S2CID 144193503 .
↑ Kazdin, Alan (1978). Historia de la modificación de la conducta: Fundamentos experimentales de la investigación contemporánea . Baltimore: University Park Press. ISBN9780839112051.
↑ Baker GL, Barnes HJ (1992). "Síndrome de la vena cava superior: etiología, diagnóstico y tratamiento". American Journal of Critical Care . 1 (1): 54– 64. doi : 10.4037/ajcc1992.1.1.54 . PMID 1307879 .
1 2 Garland AF, Hawley KM, Brookman-Frazee L, Hurlburt MS (mayo de 2008). "Identificación de elementos comunes de tratamientos psicosociales basados en la evidencia para problemas de conducta disruptiva en niños". Journal of the American Academy of Child and Adolescent Psychiatry . 47 (5): 505– 14. doi : 10.1097/CHI.0b013e31816765c2 . PMID 18356768 .
↑ Crowell CR, Anderson DC, Abel DM, Sergio JP (1988). "Aclaración de tareas, retroalimentación del desempeño y elogios sociales: procedimientos para mejorar el servicio al cliente de los cajeros bancarios" . Journal of Applied Behavior Analysis . 21 (1): 65– 71. doi : 10.1901/jaba.1988.21-65 . PMC 1286094. PMID 16795713 .
↑ Goldman NC (1992). "Carcinoma adenoide quístico del conducto auditivo externo". Otolaryngology–Head and Neck Surgery . 106 (2): 214– 5. doi : 10.1177/019459989210600211 . PMID 1310808 . S2CID 23782303 .
↑ Brophy J (1981). "Sobre elogiar eficazmente". The Elementary School Journal . 81 (5): 269– 278. doi : 10.1086/461229 . JSTOR 1001606. S2CID 144444174 .
1 2 Simonsen B, Fairbanks S, Briesch A, Myers D, Sugai G (2008). "Prácticas basadas en la evidencia en la gestión del aula: consideraciones para la investigación y la práctica". Educación y tratamiento de los niños . 31 (1): 351– 380. doi : 10.1353/etc.0.0007 . S2CID 145087451 .
↑ Weisz JR , Kazdin AE (2010). Psicoterapias basadas en la evidencia para niños y adolescentes . Guilford Press. ISBN9781606235256.
↑ Dutton; Painter (1981). "Vínculo traumático: El desarrollo de vínculos emocionales en mujeres maltratadas y otras relaciones de abuso intermitente". Victimología (7).
↑ Chrissie Sanderson. Asesoramiento a supervivientes de violencia doméstica . Jessica Kingsley Publishers; 15 de junio de 2008. ISBN978-1-84642-811-1pág. 84.
↑ Hopson J (27 de abril de 2001). "Diseño de juegos conductuales" . Gamasutra .
↑ Hood V (12 de octubre de 2017). "¿Son las cajas de botín una forma de juego de azar?" . Eurogamer . Consultado el 12 de octubre de 2017 .
↑ Skinner BF (1982). Epstein R (ed.). Skinner para el aula : artículos seleccionados . Champaign, Ill.: Research Press. ISBN978-0-87822-261-2.
↑ Vaccarino FJ, Schiff BB, Glickman SE (1989). Mowrer RR, Klein SB (eds.). Teorías contemporáneas del aprendizaje . Hillsdale, NJ: Lawrence Erlbaum Associates. ISBN978-0-89859-915-2.
↑ Cowie S, Davison M, Elliffe D (julio de 2011). "Refuerzo: la comida indica el momento y el lugar de la comida futura" . Journal of the Experimental Analysis of Behavior . 96 (1): 63–86 . doi : 10.1901/jeab.2011.96-63 . PMC 3136894. PMID 21765546 .
↑ McCormack J, Arnold-Saritepe A, Elliffe D (junio de 2017). "El efecto de resultados diferenciales en niños con autismo". Intervenciones conductuales . 32 (4): 357– 369. doi : 10.1002/bin.1489 .
Brechner KC (1977). "Un análisis experimental de las trampas sociales". Journal of Experimental Social Psychology . 13 (6): 552– 64. doi : 10.1016/0022-1031(77)90054-3 .
Brechner KC (1987). Trampas sociales, trampas individuales y teoría en psicología social . Boletín n.° 870001. Pasadena, CA: Time River Laboratory.
Brechner KC (28 de febrero de 2003). "Calificaciones superpuestas aplicadas al control de alquileres". En Levine DK, Pesendorfer W (eds.). Teoría económica y de juegos . Archivado del original el 23 de septiembre de 2015. Recuperado el 29 de febrero de 2008 .
Brechner KC, Linder DE (1981). "Análisis de trampa social de los sistemas de distribución de energía". En Baum A, Singer JE (eds.). Avances en psicología ambiental . Vol. 3. Hillsdale, NJ: Lawrence Erlbaum & Associates.
Chance P (2003). Aprendizaje y comportamiento (5.ª ed.). Toronto: Thomson-Wadsworth.
Cowie S (2019). "Algunas debilidades de una explicación de los efectos del reforzador basada en la fuerza de respuesta". European Journal of Behavior Analysis . 21 (2): 1– 16. doi : 10.1080/15021149.2019.1685247 . S2CID 210503231 .
Dinsmoor JA (noviembre de 2004). " La etimología de los conceptos básicos en el análisis experimental del comportamiento" . Journal of the Experimental Analysis of Behavior . 82 (3): 311– 6. doi : 10.1901/jeab.2004.82-311 . PMC 1285013. PMID 15693525 .
Ferster CB , Skinner BF (1957). Programas de refuerzo . Nueva York: Appleton-Century-Crofts. ISBN0-13-792309-0.{{cite book}}: Incompatibilidad de ISBN/Fecha ( ayuda )
Lewin K (1935). Una teoría dinámica de la personalidad: Artículos seleccionados . Nueva York: McGraw-Hill. ISBN9781447497134.{{cite book}}: Incompatibilidad de ISBN/Fecha ( ayuda )
Skinner BF (1938). El comportamiento de los organismos . Nueva York: Appleton-Century-Crofts. ISBN9780996453905.{{cite book}}: Incompatibilidad de ISBN/Fecha ( ayuda )
Skinner BF (1956). "Un estudio de caso sobre el método científico". American Psychologist . 11 (5): 221– 33. doi : 10.1037/h0047662 .
Zeiler MD (julio de 1968). " Programas fijos y variables de reforzamiento independiente de la respuesta" . Journal of the Experimental Analysis of Behavior . 11 (4): 405–14 . doi : 10.1901/jeab.1968.11-405 . PMC 1338502. PMID 5672249 .
Glosario de términos de refuerzo . Universidad de Iowa. Archivado del original el 13 de abril de 2007.
Harter JK, Shmidt FL, Keyes CL (2002). «El bienestar en el lugar de trabajo y su relación con los resultados empresariales: una revisión de los estudios de Gallup». En Keyes CL, Haidt J (eds.). Florecer: la persona positiva y la buena vida . Washington D. C.: Asociación Americana de Psicología. pp. 205–224 .
Enlaces externos
Tutorial en línea sobre refuerzo positivo
Refuerzo de Scholarpedia
scienceofbehavior.com Archivado el 2 de octubre de 2011 en Wayback Machine
↑ Burdon, William M.; St. De Lore, Jef; Prendergast, Michael L. (7 de septiembre de 2011). "Desarrollo e implementación de una intervención de refuerzo conductual positivo en el tratamiento de drogas en prisión: Proyecto BRITE" . Journal of Psychoactive Drugs . 43 (supl. 1 ): 40–50 . doi : 10.1080/02791072.2011.601990 . ISSN 0279-1072 . PMC 3429341. PMID 22185038 .
Categorías :
terapia conductual
Conceptos de comportamiento
Behaviorismo
Adicción
Categorías ocultas:
Artículos con breve descripción
La descripción breve es diferente de Wikidata.
Utilice el formato de fecha dmy a partir de octubre de 2017.
Artículos que necesitan referencias adicionales a partir de julio de 2026.
Todos los artículos que necesiten referencias adicionales
Todos los artículos con afirmaciones sin fuentes
Artículos con afirmaciones sin fuentes de enero de 2024
Artículos que necesitan referencias adicionales a partir de diciembre de 2024.
Artículos de Wikipedia que necesitan citas con número de página a partir de diciembre de 2024.
Artículos con afirmaciones sin fuentes de enero de 2008.
Artículos que necesitan revisión desde enero de 2024
Todas las páginas necesitan limpieza
Limpieza de artículos etiquetados con un campo de motivo desde enero de 2024.
Páginas de Wikipedia que necesitan limpieza desde enero de 2024
Artículos que se ampliarán a partir de febrero de 2024.
Todos los artículos se ampliarán
Errores de CS1: Fecha del ISBN
Enlaces de Wayback Machine para plantillas de Webarchive