Condicionamiento operante en perros: ¿Cómo aprende de las consecuencias? (2.5)

1. Resumen ejecutivo

Tema

Condicionamiento operante en perros.

Pregunta central

¿Cómo aprende un perro de las consecuencias de su propia conducta?

Conclusión principal

El condicionamiento operante describe un conjunto de procesos mediante los cuales la probabilidad futura de una conducta cambia en función de las consecuencias que la siguen y de las condiciones en que esas consecuencias ocurren.

En su forma más útil para esta biblioteca:

Una conducta que produce consecuencias que la fortalecen tenderá a ocurrir más en condiciones similares; una conducta seguida por consecuencias que la debilitan tenderá a ocurrir menos.

Pero esta definición necesita varios matices.

Primero, en ciencia del comportamiento:

  • refuerzo significa que una conducta aumenta o se mantiene;
  • castigo significa que una conducta disminuye;
  • positivo significa que algo se presenta o añade;
  • negativo significa que algo se retira, reduce o evita.

Por tanto:

positivo ≠ bueno

y

negativo ≠ malo.

Las cuatro contingencias tradicionales son:

ConsecuenciaSe presenta algoSe retira/evita algo
La conducta aumentaRefuerzo positivo (R+)Refuerzo negativo (R−)
La conducta disminuyeCastigo positivo (P+)Castigo negativo (P−)

Ejemplos simplificados:

R+
Perro se sienta → recibe alimento → sentarse aumenta.

R−
Perro realiza una respuesta → cesa una presión aversiva → la respuesta aumenta.

P+
Perro realiza una conducta → se presenta una consecuencia aversiva → la conducta disminuye.

P−
Perro realiza una conducta → pierde temporalmente acceso a algo apetitivo → la conducta disminuye.

Sin embargo, el famoso “cuadro de cuatro cuadrantes” es sólo una herramienta didáctica. El análisis operante real requiere estudiar:

  • antecedentes;
  • contingencia;
  • motivación;
  • reforzadores;
  • valor de las consecuencias;
  • timing;
  • discriminación;
  • generalización;
  • programas de refuerzo;
  • extinción;
  • competencia entre fuentes de refuerzo;
  • efectos colaterales;
  • bienestar.

Regla funcional fundamental

Una consecuencia se clasifica por su efecto sobre la conducta, no por la intención de la persona.

Dar comida no es automáticamente refuerzo positivo.

Sólo puede llamarse reforzador si la conducta que la precede:

  • aumenta;
  • se mantiene;
  • se vuelve más resistente a la extinción;
  • o cambia sistemáticamente según la contingencia estudiada.

Del mismo modo, gritar “¡no!” no es automáticamente castigo técnico. Si la conducta no disminuye, no se ha demostrado función punitiva.

Segunda distinción central

RECOMPENSA ≠ REFORZADOR

“Recompensa” describe normalmente un objeto o acontecimiento que el humano considera valioso.

“Reforzador” describe una función demostrada.

La investigación con perros muestra que:

  • las preferencias individuales predicen parcialmente la eficacia reforzante;
  • la calidad de la recompensa puede modificar vigor y rendimiento;
  • comida, elogio, juego y acceso ambiental no tienen el mismo valor para todos los perros;
  • el valor cambia con saciedad, contexto y competencia ambiental.

Tercera distinción central

CASTIGO ≠ VIOLENCIA, en sentido técnico.

“Castigo” es una relación funcional:

consecuencia → conducta disminuye.

Puede incluir procedimientos de muy diferente intensidad.

Pero esto no significa que todos sean equivalentes desde la perspectiva de bienestar.

La literatura canina sobre métodos aversivos indica que el uso de castigo positivo y refuerzo negativo puede asociarse con:

  • conductas de estrés;
  • miedo;
  • peor estado afectivo;
  • respuestas agresivas;
  • riesgos de aprendizaje colateral.

Por tanto:

una contingencia puede ser operantemente eficaz y, al mismo tiempo, plantear problemas de bienestar.

Cuarta distinción central

EXTINCIÓN ≠ CASTIGO NEGATIVO

En extinción:

una conducta que antes producía un reforzador deja de producirlo.

En castigo negativo:

una conducta produce la retirada contingente de un estímulo apetitivo.

Puede existir solapamiento práctico, pero conceptualmente son procesos distintos.

Historia científica

El desarrollo del condicionamiento operante puede entenderse a través de:

Thorndike
→ ensayo y error + ley del efecto.

Skinner
→ conducta operante + análisis experimental de contingencias.

Ferster y Skinner
→ programas de reforzamiento.

Skinner distinguió con claridad la conducta respondiente/pavloviana de aquella cuya frecuencia se modifica por sus consecuencias, utilizando el término operante para describir clases de respuestas funcionalmente relacionadas con sus consecuencias.

Tesis recomendada

El condicionamiento operante no enseña que el perro “hace caso porque recibe premios”. Enseña algo mucho más general: los perros ajustan su conducta a las consecuencias que producen sus acciones. Entender qué refuerza realmente una conducta, cuándo ocurre y en qué contexto permite explicar tanto habilidades deseadas como muchos problemas que las personas entrenan accidentalmente.


2. Pregunta principal

Pregunta principal

¿Cómo aprende un perro de las consecuencias de sus propias acciones y cómo podemos utilizar ese conocimiento para enseñar, mantener o reducir conductas sin confundir eficacia con bienestar?

Preguntas secundarias

  1. ¿Qué significa operante?
  2. ¿En qué se diferencia del condicionamiento clásico?
  3. ¿Qué aportó Thorndike?
  4. ¿Qué aportó Skinner?
  5. ¿Qué es la ley del efecto?
  6. ¿Qué es una contingencia?
  7. ¿Qué es refuerzo?
  8. ¿Qué es castigo?
  9. ¿Qué significa positivo?
  10. ¿Qué significa negativo?
  11. ¿Qué es R+?
  12. ¿Qué es R−?
  13. ¿Qué es P+?
  14. ¿Qué es P−?
  15. ¿Cómo saber si una consecuencia está reforzando?
  16. ¿Qué diferencia existe entre recompensa y reforzador?
  17. ¿Qué diferencia existe entre castigo coloquial y técnico?
  18. ¿Qué es escape?
  19. ¿Qué es evitación?
  20. ¿Qué es extinción?
  21. ¿Cómo se diferencia de P−?
  22. ¿Qué es shaping?
  23. ¿Qué es capturing?
  24. ¿Qué es luring?
  25. ¿Qué es refuerzo diferencial?
  26. ¿Qué es control estimular?
  27. ¿Cómo adquiere una señal control sobre una respuesta?
  28. ¿Qué es un programa de reforzamiento?
  29. ¿Qué diferencia existe entre reforzamiento continuo e intermitente?
  30. ¿Qué son FR, VR, FI y VI?
  31. ¿Son útiles los programas variables en entrenamiento canino?
  32. ¿Qué es resistencia a extinción?
  33. ¿Qué es behavioral momentum?
  34. ¿Qué es razón de respuesta?
  35. ¿Qué es latencia?
  36. ¿Por qué importa el timing?
  37. ¿Cómo influye la magnitud/calidad del reforzador?
  38. ¿Qué es una operación motivacional?
  39. ¿Qué es reforzamiento no contingente?
  40. ¿Qué errores humanos refuerzan conductas no deseadas?
  41. ¿Cuándo el castigo puede producir efectos colaterales?
  42. ¿Qué dice la evidencia sobre métodos basados en recompensas y métodos aversivos?
  43. ¿Qué puede concluirse y qué no?
  44. ¿Cómo medir si una conducta está realmente bajo control operante?
  45. ¿Cómo integrar aprendizaje operante y bienestar?

Alcance

Este dossier es fundamental.

No pretende sustituir dossiers específicos sobre:

  • refuerzo positivo;
  • refuerzo negativo;
  • castigo;
  • extinción;
  • programas de reforzamiento;
  • shaping;
  • control estimular;
  • métodos aversivos.

Su función es construir el marco técnico común.


3. Conceptos fundamentales

3.1 Conducta operante

Una operante es una clase de conducta cuya probabilidad está relacionada con las consecuencias que históricamente ha producido bajo determinadas condiciones.

No se define únicamente por su forma.

Por ejemplo:

“poner las cuatro patas en el suelo” puede pertenecer a una clase funcional si sistemáticamente produce atención o acceso.

Skinner (1937, 1938) distinguió la conducta operante de la conducta respondiente.

3.2 Antecedente

Evento o contexto que ocurre antes de una respuesta y puede alterar su probabilidad.

Ejemplos:

  • señal verbal;
  • presencia de una persona;
  • puerta abierta;
  • correa;
  • comida visible;
  • otro perro;
  • postura del humano.

3.3 Respuesta

Conducta observable.

Ejemplo:

  • sentarse;
  • aproximarse;
  • ladrar;
  • tirar;
  • mirar;
  • tocar una mano;
  • soltar un objeto.

3.4 Consecuencia

Evento que ocurre después de la respuesta.

Puede o no modificar la conducta futura.

3.5 Contingencia

Relación funcional:

si ocurre la conducta, ¿qué cambia en el ambiente?

Una contingencia operante puede representarse:

A → B → C

Antecedente → conducta → consecuencia.

Pero la consecuencia sólo es funcionalmente relevante si altera comportamiento futuro.


3.6 Refuerzo

Proceso mediante el cual una consecuencia aumenta o mantiene la probabilidad futura de una conducta.

No se define por:

  • agradable;
  • amable;
  • comida;
  • intención.

Se define por el efecto sobre la conducta.

3.7 Castigo

Proceso mediante el cual una consecuencia reduce la probabilidad futura de una conducta.

No implica automáticamente:

  • dolor;
  • violencia;
  • abuso.

Pero numerosos procedimientos utilizados como castigo sí pueden involucrar estímulos aversivos y riesgos de bienestar.


3.8 Positivo y negativo

En esta terminología:

positivo (+)
algo se presenta.

negativo (−)
algo se retira, termina o evita.

No significan:

positivo = moralmente bueno

negativo = moralmente malo.

Éste es el mito central del artículo.


3.9 Refuerzo positivo (R+)

Estructura:

conducta
se presenta estímulo/consecuencia
conducta aumenta.

Ejemplo:

sentarse → alimento → sentarse aumenta.

Otros posibles reforzadores:

  • juego;
  • interacción;
  • acceso a olfatear;
  • apertura de puerta;
  • persecución permitida;
  • contacto social.

Regla

Si se da comida pero la conducta no aumenta:

no se ha demostrado R+ para esa conducta en esas condiciones.


3.10 Refuerzo negativo (R−)

Estructura:

conducta
se retira/reduce/evita un estímulo aversivo
conducta aumenta.

Ejemplo abstracto:

presión aparece
→ perro realiza respuesta
→ presión termina
→ respuesta aumenta.

El estímulo eliminado funciona como condición aversiva.

Escape

La conducta termina un estímulo ya presente.

Evitación

La conducta impide o retrasa un estímulo aversivo esperado.

Ambos pueden mantener conducta mediante R−.

Error común

“Refuerzo negativo es regañar.”

No.

Si el regaño se presenta después de una respuesta y la reduce, sería conceptualmente P+, no R−.


3.11 Castigo positivo (P+)

Estructura:

conducta
se presenta consecuencia
conducta disminuye.

Ejemplos pueden incluir:

  • sobresalto;
  • presión;
  • reprimenda;
  • estímulo eléctrico;
  • ruido.

Pero sólo son técnicamente castigo si la conducta disminuye.

Importante

Que una conducta se suprima durante la presencia del entrenador no significa necesariamente:

  • aprendizaje generalizado;
  • cambio emocional saludable;
  • ausencia de efectos colaterales.

3.12 Castigo negativo (P−)

Estructura:

conducta
se retira temporalmente estímulo apetitivo/acceso
conducta disminuye.

Ejemplos:

  • se interrumpe juego;
  • se retira atención;
  • se pierde acceso temporal.

Procedimientos clásicos:

  • response cost;
  • time-out from positive reinforcement.

Riesgo conceptual

No toda retirada es P−.

La retirada debe:

  1. ser contingente a la conducta;
  2. reducir la conducta.

3.13 Recompensa

Término coloquial.

Puede describir:

  • comida;
  • juguete;
  • elogio.

Pero “recompensa” no garantiza función reforzante.

Riemer et al. (2018) mostró que la calidad de la recompensa alimentaria podía influir en eficacia de respuesta, mientras que aumentar simplemente cantidad no producía necesariamente el mismo efecto.


3.14 Reforzador primario y condicionado

Primario / no condicionado
→ tiene valor sin condicionamiento específico dentro del entrenamiento.

Ejemplo típico:
comida.

Condicionado
→ adquiere valor mediante asociación.

Ejemplo:
clicker, marcador verbal, ficha.

En la práctica:

conducta → click → comida

combina procesos operantes y pavlovianos.


3.15 Refuerzo automático

Una conducta puede producir consecuencias reforzantes sin mediación humana.

Ejemplo:

perro rompe un objeto
→ obtiene estimulación sensorial.

o:

rasca una puerta
→ modifica sensaciones/ambiente.

Esto explica por qué algunas conductas persisten aunque nadie “las premie”.


3.16 Motivación y operaciones motivacionales

El valor de un reforzador cambia.

Variables:

  • hambre;
  • saciedad;
  • acceso reciente;
  • estrés;
  • temperatura;
  • contexto;
  • competencia ambiental.

Por ello:

“mi perro ama el pollo” no significa que pollo tenga el mismo valor en todas las situaciones.


3.17 Timing

Una consecuencia demasiado tardía puede relacionarse con otra respuesta distinta.

Yamamoto et al. (2009) evaluó retrasos de acciones del propietario en 10 perros. A medida que aumentaban retrasos de 0.13 a 2 segundos, disminuían respuestas correctas y atención en varias condiciones.

La muestra es pequeña, pero refuerza un principio general bien establecido:

la proximidad temporal entre conducta y consecuencia facilita claridad contingencial.


3.18 Extinción operante

Procedimiento mediante el cual una conducta previamente reforzada deja de producir el reforzador que la mantenía.

Resultado esperado:

reducción gradual.

Pero pueden aparecer:

  • aumento temporal;
  • variabilidad;
  • frustración;
  • recuperación;
  • persistencia.

Hall (2017) revisa persistencia y resistencia a extinción específicamente en perros.


3.19 Extinction burst

En uso aplicado se describe como:

  • aumento temporal de frecuencia;
  • intensidad;
  • variabilidad;

al comenzar extinción.

Debe explicarse con cuidado:

no toda extinción produce un “burst” claro y no debe tratarse como ley inevitable.


3.20 Shaping

Construcción de una conducta mediante reforzamiento diferencial de aproximaciones sucesivas.

Ejemplo:

objetivo:
entrar en transportín.

Refuerzo:

  1. mirar transportín;
  2. acercarse;
  3. introducir cabeza;
  4. una pata;
  5. dos patas;
  6. entrar completamente.

No es simplemente “esperar y premiar”.

Exige:

  • criterios;
  • timing;
  • progresión.

3.21 Capturing

Reforzar una conducta que el perro ofrece espontáneamente.

Ejemplo:

perro se tumba relajado
→ marcar/reforzar.


3.22 Luring

Utilizar un estímulo atractivo para guiar movimiento inicialmente.

Ejemplo:

comida cerca del hocico
→ movimiento.

Después conviene retirar gradualmente el señuelo para evitar dependencia.


3.23 Targeting

Enseñar contacto/orientación hacia un objetivo.

Puede convertirse en herramienta para:

  • posicionamiento;
  • cuidado cooperativo;
  • movimiento.

3.24 Refuerzo diferencial

Refuerzo selectivo de ciertas respuestas.

Ejemplos:

DRA
→ conducta alternativa.

DRI
→ conducta incompatible.

DRO
→ ausencia de una conducta durante intervalo.

Debe diseñarse según función y contexto.


3.25 Control estimular

Una conducta está bajo control estimular cuando la probabilidad cambia sistemáticamente según estímulos antecedentes.

Ejemplo:

“sentado” produce alta probabilidad de sentarse.

Pero si el perro responde sólo cuando:

  • persona inclina cuerpo;
  • mano tiene comida;
  • está en cocina;

el control real puede ser compuesto.


3.26 Señal discriminativa (SD)

En análisis operante, un SD señala que una respuesta tiene una historia de producir determinada consecuencia.

Simplificación práctica:

“En presencia de esta señal, esta respuesta suele funcionar.”

No significa que la palabra “ordene” causalmente el movimiento de manera automática.


3.27 Generalización

La respuesta se extiende a estímulos/contextos similares.

Discriminación

La respuesta se concentra en condiciones donde históricamente ha sido reforzada.


4. Evolución

4.1 Aprender de consecuencias es una capacidad adaptativa general

El condicionamiento operante no es exclusivo del perro.

Permite a un animal ajustar conducta según:

  • recursos;
  • peligros;
  • competencia;
  • refugio;
  • interacción social.

4.2 Función adaptativa

Si una acción produce alimento:

→ repetirla puede ser útil.

Si produce daño:

→ reducirla puede ser útil.

El mecanismo permite flexibilidad sin depender exclusivamente de respuestas genéticamente fijadas.

4.3 Restricciones biológicas

No todas las respuestas son igualmente enseñables.

Influyen:

  • anatomía;
  • sistemas motivacionales;
  • repertorio;
  • predisposición;
  • historia.

Por tanto:

el refuerzo selecciona dentro de un repertorio biológicamente posible.

4.4 Domesticación

La domesticación no creó el aprendizaje operante.

Pero convivir con humanos multiplicó contingencias relacionadas con:

  • alimento;
  • puertas;
  • correas;
  • atención;
  • objetos;
  • señales;
  • espacios urbanos.

El perro doméstico vive en un ambiente extraordinariamente controlado por decisiones humanas.


5. Domesticación e historia

5.1 Thorndike y el ensayo y error

Edward Thorndike estudió animales en dispositivos conocidos como puzzle boxes.

El principio histórico central fue la ley del efecto:

respuestas seguidas de resultados satisfactorios tenderían a fortalecerse, mientras que respuestas seguidas de resultados insatisfactorios tenderían a debilitarse.

Thorndike (1898) ayudó a desplazar explicaciones anecdóticas hacia experimentos controlados.

5.2 De Thorndike a Skinner

Skinner desarrolló una metodología basada en:

  • respuestas repetibles;
  • tasa de respuesta;
  • consecuencias;
  • control experimental.

En 1937 distinguió dos tipos de reflejo condicionado y articuló la noción de operante.

En The Behavior of Organisms (1938) consolidó su análisis experimental.

5.3 Qué significa “operante”

La conducta “opera” sobre el ambiente.

No necesita un estímulo elicitador identificado como en el modelo pavloviano.

Su probabilidad se analiza según consecuencias.

5.4 Programas de reforzamiento

Ferster y Skinner (1957) estudiaron cómo diferentes reglas de entrega de reforzador producen patrones distintos de conducta.

Su investigación fue mayoritariamente con palomas.

Debe evitarse extrapolar mecánicamente todos los patrones a perros de compañía, pero los principios inspiraron gran parte del análisis operante contemporáneo.

5.5 Dog training moderno

La terminología R+/R−/P+/P− llegó ampliamente al entrenamiento canino a través de:

  • análisis de conducta;
  • psicología comparada;
  • entrenamiento animal;
  • medicina conductual.

Sin embargo, el sector profesional no utiliza las palabras con completa consistencia.

Por eso el artículo debe insistir:

describir contingencia concreta > etiquetar cuadrante.


6. Etología

6.1 El perro no es una caja vacía

El aprendizaje operante selecciona conducta dentro de un repertorio influido por:

  • especie;
  • genética;
  • desarrollo;
  • experiencia;
  • motivación.

6.2 Tinbergen: causación

¿Por qué aparece la respuesta ahora?

  • señal;
  • estado motivacional;
  • historia de refuerzo;
  • valor del resultado;
  • emoción.

6.3 Ontogenia

¿Cómo se desarrolló?

Una conducta puede adquirir una historia larga.

Ejemplo:

cachorro salta
→ personas ríen/tocan.

Meses después:

salto altamente persistente.

El problema no necesita explicación por “dominancia”.

Puede existir una historia de reforzamiento.

6.4 Función

En análisis conductual, función significa:

qué consecuencias ayudan a mantener el comportamiento.

Funciones comunes:

  • acceso;
  • atención;
  • escape;
  • estimulación.

No es idéntico a función adaptativa evolutiva.

6.5 Filogenia

Algunas respuestas son más probables por repertorio de especie.

Ejemplo:

olfatear, perseguir, masticar.

El entrenamiento puede:

  • canalizar;
  • poner bajo señal;
  • reforzar alternativas.

No puede eliminar la biología del perro.


7. Cognición y aprendizaje

7.1 La unidad fundamental es relación, no objeto

No preguntar sólo:

“¿qué premio usas?”

Preguntar:

“¿qué conducta produce qué consecuencia y con qué consistencia?”


7.2 El reforzador se demuestra

Vicars et al. (2014) evaluó preferencia y eficacia de reforzadores en ocho perros.

Las preferencias medidas sistemáticamente podían predecir qué estímulos mantendrían mejor la respuesta.

Esto demuestra:

preferencia y reforzamiento están relacionados, pero el reforzador debe verificarse funcionalmente.


7.3 Calidad vs cantidad

Riemer et al. (2018) estudió valor de recompensas alimentarias.

La calidad de alimento afectó vigor de respuesta más claramente que simplemente aumentar cantidad en determinadas condiciones.

No significa:

“usa comida premium”.

Significa:

valor reforzante depende de propiedades del resultado, no sólo de número de piezas.


7.4 Contingencia

Si alimento aparece independientemente de conducta:

puede perderse claridad operante.

Pfaller-Sadovsky et al. (2022) estudió reforzamiento no contingente en perros de compañía y mostró que la entrega temporal de reforzadores puede alterar conducta incluso sin depender de la respuesta.

Esto demuestra que:

la comida puede modificar conducta aunque no esté funcionando como R+ contingente a la respuesta objetivo.


7.5 Refuerzo no contingente

NCR

Reforzador se entrega según tiempo, no respuesta.

Puede:

  • reducir valor de conducta mantenida por ese reforzador;
  • competir;
  • producir efectos de abolición/saciedad;
  • cambiar condiciones.

No es “reforzar nada”.

Es un procedimiento diferente.


7.6 Extinción y omisión

Bentosela et al. (2008) estudió mirada hacia humanos en una situación de solicitud de comida.

Encontraron cambios rápidos:

  • aumento con reforzamiento diferencial;
  • disminución con omisión;
  • disminución con extinción.

Esto es evidencia directa de sensibilidad canina a contingencias operantes.


7.7 Timing

Yamamoto et al. (2009):

10 perros.

Retrasos:
0.13, 0.27, 0.5, 1 y 2 s.

Mayores retrasos redujeron respuestas apropiadas y atención.

La muestra es pequeña, pero ilustra:

una consecuencia mal temporizada puede seleccionar otra conducta distinta a la que el humano cree estar reforzando.


7.8 Programas de reforzamiento

Refuerzo continuo (CRF/FR1)

Cada respuesta objetivo produce reforzador.

Útil para:

  • adquisición.

Refuerzo intermitente

Sólo algunas respuestas producen reforzador.

Puede utilizarse para:

  • mantenimiento;
  • persistencia.

7.9 Ratio vs intervalo

Ratio
→ depende de número de respuestas.

Interval
→ depende del paso del tiempo + respuesta.

Fixed
→ criterio constante.

Variable
→ criterio cambia alrededor de promedio.

Así:

  • FR;
  • VR;
  • FI;
  • VI.

Advertencia

La literatura aplicada específica en perros sobre comparación sistemática de estos programas es mucho menor que la literatura clásica en palomas/roedores.

Hall et al. (2021) señala precisamente la necesidad de estudios paramétricos en perros de trabajo.


7.10 Partial reinforcement extinction effect

En muchas especies, respuestas adquiridas bajo reforzamiento parcial pueden mostrar mayor persistencia durante extinción que respuestas continuamente reforzadas.

Pero:

no debe simplificarse como “haz premios aleatorios y será más fuerte”.

Cambios de programa demasiado rápidos pueden:

  • reducir rendimiento;
  • generar ratio strain;
  • debilitar conducta.

7.11 Behavioral momentum

Hall (2017) revisa aplicaciones de teoría de momentum conductual en perros.

Idea simplificada:

una conducta en un contexto con historia rica de reforzamiento puede ser más resistente a disrupción.

Útil en perros de detección:

  • trabajar ante distractores;
  • mantener búsqueda cuando blancos son raros.

7.12 Cadenas conductuales

Muchos trabajos complejos implican secuencias:

buscar
→ localizar
→ indicar
→ recibir reforzador.

Thrailkill et al. (2016) estudió persistencia de cadenas heterogéneas en perros de detección y mostró que las condiciones de reforzamiento pueden alterar resistencia a extinción de la cadena.


7.13 Shaping y creatividad conductual

En shaping:

  1. definir objetivo;
  2. observar repertorio;
  3. seleccionar aproximación;
  4. reforzar;
  5. elevar criterio;
  6. dejar de reforzar aproximaciones antiguas.

Error común:

elevar criterio demasiado rápido.

Puede producir:

  • caída de tasa;
  • frustración;
  • abandono.

7.14 Señuelo vs refuerzo

Un alimento puede cumplir distintas funciones:

antes de la conducta
→ señuelo.

después de conducta y contingente
→ potencial reforzador.

entregado por tiempo
→ NCR.

El objeto es el mismo.

La función cambia.


7.15 Señales y control estimular

Una conducta no está “bajo comando” porque el humano pronuncie una palabra.

Debe existir historia de:

señal → oportunidad de respuesta → consecuencia.

La señal gana control porque informa sobre contingencia.


8. Desarrollo

8.1 Cachorros aprenden consecuencias desde muy temprano

Antes de clases formales:

llorar
→ humano aparece.

morder
→ juego continúa.

sentarse
→ se abre puerta.

Estas contingencias construyen repertorio.

8.2 Educación accidental

Muchos “malos hábitos” fueron funcionalmente reforzados.

Ejemplo:

perro ladra en mesa
→ recibe comida.

Tres veces por semana durante meses.

Después:

familia pregunta por qué “no entiende que está mal”.

Desde análisis operante:

la conducta ha sido reforzada intermitentemente.

Eso puede producir alta persistencia.

8.3 Adolescencia

Cambios de:

  • exploración;
  • motivación;
  • activación;
  • competencia ambiental;

pueden modificar eficacia de reforzadores.

No implica que el perro “olvide”.

8.4 Senior

Puede seguir aprendiendo.

Pero deben considerarse:

  • dolor;
  • audición;
  • visión;
  • movilidad;
  • cognición.

Una caída de respuesta no debe atribuirse automáticamente a motivación.


9. Análisis del comportamiento

9.1 ABC ampliado

Operación motivacional
+
Antecedente

Conducta

Consecuencia

cambio futuro de probabilidad


9.2 Caso: saltar sobre personas

A: persona llega.

B: perro salta.

C: persona toca y habla.

Si salto aumenta:

→ interacción funciona como R+.

Solución

Manejo:
evitar ensayo.

Refuerzo diferencial:
cuatro patas en suelo → atención.


9.3 Caso: tirar de correa

A: estímulo atractivo delante.

B: perro tira.

C: avanza hacia estímulo.

Si tirar aumenta:

→ avance puede reforzar tirar.

No hace falta que el humano entregue comida.

Lección

el ambiente refuerza.


9.4 Caso: ladrido para abrir puerta

B: ladra.

C: puerta se abre.

Si aumenta:

→ acceso funciona como R+.


9.5 Caso: presión y liberación

A: presión.

B: respuesta.

C: presión termina.

Si respuesta aumenta:

→ R−.


9.6 Caso: interrumpir juego

A: juego.

B: mordida fuerte.

C: juego termina.

Si mordida fuerte disminuye:

→ P−.


9.7 Caso: reprimenda

Perro roba objeto.

Humano grita.

¿P+?

Sólo si:

→ robar disminuye.

Si el perro interpreta grito como interacción y roba más:

la misma consecuencia podría estar funcionando como reforzador social.

Lección

la función la determina la conducta futura, no la intención humana.


9.8 Error de causalidad

Una conducta puede disminuir después de una intervención por:

  • fatiga;
  • saciedad;
  • contexto;
  • miedo;
  • extinción;
  • cambio ambiental.

Una sola observación no demuestra P+ o P−.


10. Bienestar

10.1 Eficacia operante no equivale a bienestar

Un estímulo aversivo puede funcionar operantemente.

Eso no resuelve:

  • intensidad;
  • miedo;
  • dolor;
  • generalización;
  • asociación con humano;
  • estrés;
  • alternativas disponibles.

10.2 Métodos aversivos

Ziv (2017) revisó 17 estudios.

Conclusión general:

  • riesgos para bienestar;
  • no evidencia de superioridad general de castigo positivo frente a estrategias basadas en refuerzo.

Guilherme-Fernandes et al. (2017) también encontró asociación entre aversivos e indicadores de bienestar comprometido, aunque destacó limitaciones metodológicas.


10.3 Evidencia fisiológica y cognitiva

Vieira de Castro et al. (2020):

92 perros.

Grupos:

  • reward;
  • mixed;
  • aversive.

Mayor uso de aversivos se asoció con:

  • más conductas de estrés;
  • mayores cambios de cortisol;
  • sesgo cognitivo más pesimista.

Limitación:

no asignación aleatoria.


10.4 Eficacia y eficiencia

Vieira de Castro et al. (2021) comparó métodos reward vs mixed en perros entrenados en tareas.

En ese contexto, el grupo basado en recompensas mostró mejor o comparable eficacia/eficiencia en medidas estudiadas.

La literatura todavía es más limitada de lo deseable.


10.5 Evidencia que complica una narrativa absoluta

Johnson y Wynne (2024) encontró que en una tarea específica de inhibición de persecución un grupo con collar electrónico mostró mayor inhibición que condiciones no aversivas concretas.

Limitaciones:

  • pequeña muestra final;
  • tarea específica;
  • diferencias de protocolo;
  • dificultades para extrapolar.

Esto obliga a distinguir:

“puede modificar conducta”

de:

“es necesario, óptimo o preferible en términos de bienestar”.


10.6 Confrontación y agresión

Herron et al. (2009) estudió respuestas reportadas a intervenciones confrontativas en perros con problemas conductuales.

Varias técnicas aversivas/confrontativas provocaron respuestas agresivas en una proporción importante.

Esto no demuestra que todo P+ cause agresión.

Demuestra:

algunos procedimientos pueden aumentar riesgo en perros susceptibles.


10.7 La ética no está contenida en el cuadrante

R+, R−, P+ y P− describen relaciones funcionales.

No determinan automáticamente:

  • aceptabilidad;
  • intensidad;
  • bienestar;
  • proporcionalidad.

Por eso un artículo científico debe separar:

descripción operante
de
evaluación ética y de bienestar.


11. Adiestramiento y manejo

11.1 Secuencia recomendada para enseñar

1. definir conducta observable

“tumbado” mejor que “calmado”.

2. identificar reforzador

3. crear oportunidad

4. marcar respuesta

5. entregar consecuencia

6. repetir

7. elevar criterio

8. introducir señal

9. generalizar

10. pasar a mantenimiento


11.2 Adquisición

Durante adquisición:

  • alta tasa de refuerzo;
  • criterio alcanzable;
  • pocas distracciones.

Error:

retirar reforzamiento demasiado pronto.


11.3 Shaping

Ideal cuando:

  • no puede inducirse fácilmente;
  • queremos iniciativa;
  • conducta tiene etapas.

Riesgo:

criterios confusos.


11.4 Captura

Ideal para:

  • calma;
  • posturas naturales;
  • conductas espontáneas.

11.5 Refuerzo diferencial

Para problemas:

perro salta
→ reforzar cuatro patas en suelo.

perro tira
→ reforzar correa floja / orientación.

Pero:

si la conducta problema continúa produciendo reforzadores potentes:

el plan puede fracasar.


11.6 Manejo

El manejo altera contingencias.

Ejemplo:

no dejar comida en mesa.

Evita:

robar → comida.

Esto reduce práctica y autorrefuerzo.


11.7 Refuerzo ambiental

Los mejores reforzadores no siempre están en la bolsa.

Ejemplos:

  • olfatear;
  • avanzar;
  • saludar;
  • acceder a puerta;
  • subir al coche.

Puede utilizarse:

conducta deseada → acceso ambiental.


11.8 Programas de mantenimiento

Después de adquisición:

no es obligatorio alimentar cada respuesta de por vida.

Pero el cambio debe:

  • ser gradual;
  • mantener valor;
  • incorporar reforzadores naturales.

No reducir a:

“pasa a variable ratio porque crea adicción”.

Esa frase es científicamente deficiente.


11.9 Ratio strain

Si exigencia aumenta demasiado:

  • respuestas pueden deteriorarse;
  • latencia aumenta;
  • conducta desaparece.

Regla práctica:

adelgazar programa de refuerzo lentamente.


11.10 Extinción en problemas cotidianos

Ejemplo:

ladrido obtiene atención.

Extinción:
atención deja de seguir al ladrido.

Pero:

si ocasionalmente obtiene atención:

la conducta puede volverse altamente persistente.


11.11 Extinción no siempre es recomendable

Puede ser:

  • peligrosa;
  • frustrante;
  • difícil.

Especialmente con:

  • agresión;
  • miedo;
  • conductas de alto riesgo.

Preferir con frecuencia:

manejo + refuerzo de alternativa.


12. Aplicaciones prácticas

Esto significa que…

Antes de preguntar:

“¿Cómo corrijo esto?”

preguntar:

“¿Qué consecuencia está manteniendo la conducta?”


En la vida cotidiana…

Caso 1 — saltar

Perro salta
→ humano toca.

Si aumenta:

contacto es reforzador.

Solución:
atención para cuatro patas en suelo.


Caso 2 — tirar

Tira
→ llega al árbol.

Árbol/olfato puede reforzar.

Uso:

correa floja
→ acceso al olor.


Caso 3 — ladrar en puerta

Ladra
→ puerta se abre.

Entrenamiento accidental.

Cambiar:

silencio/orientación
→ puerta abre.


Caso 4 — robar calcetín

Roba
→ humano persigue.

Si el juego de persecución tiene valor:

robar puede aumentar.


Caso 5 — llamada

“ven”
→ perro llega
→ se termina diversión.

La llamada puede adquirir consecuencias poco competitivas.

Mejor:

llegar
→ premio + a veces volver a jugar.


Un responsable puede observar…

  • frecuencia;
  • latencia;
  • duración;
  • tasa;
  • contexto;
  • consecuencia;
  • variabilidad;
  • cambios después de intervención.

Conviene evitar…

  1. etiquetar una consecuencia sin comprobar efecto;
  2. llamar “R+” a cualquier premio;
  3. llamar “P+” a cualquier regaño;
  4. creer que negativo significa malo;
  5. retirar reforzadores demasiado rápido;
  6. usar programas variables sin conducta estable;
  7. ignorar refuerzos ambientales;
  8. aplicar extinción a conductas peligrosas sin plan;
  9. usar castigo sin valorar bienestar;
  10. atribuir persistencia a “terquedad”.

Podría ayudar…

  • registrar 10–20 ensayos;
  • calcular porcentaje;
  • medir latencia;
  • comparar contextos;
  • identificar reforzadores competidores;
  • entrenar alternativas;
  • manejar ambiente.

13. Mitos y controversias

AfirmaciónClasificaciónEvaluación
“Positivo significa bueno.”ContradichaSignifica añadir/presentar.
“Negativo significa malo.”ContradichaSignifica retirar/reducir.
“Dar comida siempre es R+.”ContradichaDebe aumentar la conducta.
“Quitar algo siempre es castigo.”ContradichaSi aumenta conducta puede ser R−.
“Castigo significa pegar.”Contradicha como definición técnicaCastigo es reducción funcional.
“Si regaño, estoy castigando.”No necesariamenteSólo si conducta disminuye.
“R− es malo y R+ es bueno por definición.”ContradichaLos términos no contienen evaluación moral.
“Los cuatro cuadrantes explican todo entrenamiento.”Contradicha / incompletaFaltan antecedentes, motivación, programas, emoción, Pavloviano, contexto.
“Extinción es P−.”Contradicha como equivalenciaSon procedimientos funcionalmente distintos.
“Ignorar siempre elimina conductas.”ContradichaSólo si atención es reforzador relevante y otras fuentes no mantienen conducta.
“Un perro hace cosas sólo para obtener premios.”ContradichaExisten múltiples reforzadores y aprendizaje pavloviano.
“Hay que dejar de premiar lo antes posible.”ContradichaRetirada prematura puede deteriorar conducta.
“Variable ratio es siempre el mejor programa.”No respaldada como regla universalDepende de tarea, adquisición, mantenimiento y bienestar.
“Los castigos nunca funcionan.”Demasiado absolutaPueden reducir conducta; cuestión adicional es bienestar, necesidad y efectos secundarios.
“Si funciona, es buen método.”Contradicha por evaluación de bienestarEficacia conductual no agota el análisis.
“Una conducta reforzada nunca se extingue.”ContradichaDepende de programa, contexto y nuevas contingencias.
“Si refuerzo mucho, el perro se vuelve dependiente de comida.”SimplificaciónDepende de diseño, transferencia a reforzadores naturales y control estimular.
“El perro sabe la orden pero elige desobedecer.”No demostrado por el fallo de respuestaPueden intervenir motivación, contexto y generalización.

Controversia 1 — ¿cuadrantes o análisis funcional?

Los cuadrantes ayudan a enseñar terminología.

Pero pueden fomentar errores:

  • etiquetar sin medir;
  • ignorar antecedentes;
  • ignorar Pavloviano;
  • ignorar bienestar.

Conclusión:

usar cuadrantes como mapa inicial, no como análisis completo.

Controversia 2 — ¿castigo puede ser eficaz?

Sí, por definición una consecuencia que reduce conducta es castigo.

La controversia relevante es:

  • rapidez;
  • necesidad;
  • efectos secundarios;
  • bienestar;
  • alternativas.

Controversia 3 — ¿reward-only existe?

En la práctica, entrenamiento puede incluir:

  • R+;
  • P−;
  • extinción;
  • manejo.

Por eso términos populares como:

“positive-only”

pueden ser menos precisos que describir procedimientos concretos.

Controversia 4 — reforzar emoción

Una emoción no se maneja exactamente como una respuesta operante simple.

Dar comida en presencia de miedo no significa automáticamente “reforzar miedo”.

Puede participar en contracondicionamiento pavloviano.

Este tema conecta con el dossier 4.


14. Estado de la evidencia

14.1 Muy alta confianza

Principios básicos:

  • refuerzo;
  • castigo;
  • contingencia;
  • extinción;
  • programas.

Respaldados por más de un siglo de investigación comparada.

14.2 Alta confianza específica en perros

Sensibilidad a contingencias

Bentosela et al. (2008).

Extinción/persistencia

Hall (2017).

Timing

Yamamoto et al. (2009), aunque muestra pequeña.

Valor del reforzador

Vicars et al. (2014);
Riemer et al. (2018).


14.3 Evidencia moderada-alta

Métodos aversivos y bienestar

Convergencia de:

  • revisiones;
  • encuestas;
  • observación;
  • cortisol;
  • sesgo cognitivo.

Pero:

muchos estudios no son ensayos aleatorizados.


14.4 Áreas con evidencia canina limitada

  • comparación sistemática FR/VR/FI/VI;
  • ratio strain;
  • programas concurrentes;
  • matching law;
  • operaciones motivacionales;
  • shaping optimizado;
  • NCR aplicado;
  • behavioral momentum fuera de perros de trabajo.

Hall et al. (2021) señala múltiples oportunidades de investigación aplicada.


14.5 Evaluación de fuentes clave

FuenteTipoPoblación/muestraHallazgoLimitacionesConfianzaUso
Thorndike (1898)Monografía experimentalgatos y otros animalesEnsayo/error y ley del efectoHistórica; conceptos revisadosMuy alta históricaOrigen
Skinner (1937)Artículo teórico/experimentalliteratura experimentalDistingue operante/respondienteTerminología históricaMuy alta históricaDefinición
Skinner (1938)Monografía experimentalprincipalmente ratasAnálisis sistemático de conducta operanteNo perrosMuy alta teóricaFundamentos
Ferster & Skinner (1957)Monografía experimentalprincipalmente palomasProgramas de refuerzo producen patrones sistemáticosExtrapolación a perros requiere cautelaMuy alta generalProgramas
Bentosela et al. (2008)Experimentos caninosperros domésticosMirada cambia rápidamente con refuerzo, omisión y extinciónParadigma específicoAltaContingencia
Yamamoto et al. (2009)Experimento10 perrosRetrasos empeoran respuesta/atenciónMuestra pequeñaModeradaTiming
Rooney & Cowan (2011)Encuesta + tarea53 díadasMétodos del dueño asociados con conducta/aprendizajeCorrelacionalModeradaAplicación
Vicars et al. (2014)Experimento8 perrosPreferencia predice eficacia reforzanteMuestra pequeñaModeradaReforzador
Hall (2017)RevisiónperrosPersistencia y resistencia a extinciónCampo canino limitadoAlta como síntesisExtinción
Riemer et al. (2018)ExperimentoperrosCalidad de recompensa influye en eficaciaTarea concretaModerada-altaMagnitud
Vieira de Castro et al. (2020)Estudio aplicado92 perrosMás aversivos, peores indicadores de bienestarNo aleatorizadoModerada-altaBienestar
Vieira de Castro et al. (2021)Estudio comparativoperros de escuelasReward-based igual/mejor en medidas de eficacia/eficienciaContexto específicoModeradaMétodos
Hall et al. (2021)Revisiónperros de trabajoCiencia del aprendizaje puede optimizar entrenamientoVarias recomendaciones aún no probadasAlta como agendaAplicación
Pfaller-Sadovsky et al. (2022)Experimentoperros de compañíaNCR y extinción alteran respuesta arbitrariaÁrea pequeñaModeradaNCR
Johnson & Wynne (2024)Ensayo aleatorizado30 reclutados; muestra final menorE-collar superior en tarea específica de persecuciónMuestra pequeña/protocolos distintosModerada para tarea, baja generalizaciónControversia

14.6 Conflictos entre fuentes

Conflicto 1 — métodos aversivos y eficacia

Algunos estudios:
reward-based comparable o mejor.

Johnson & Wynne (2024):
e-collar mejor en una tarea específica.

Interpretación:

eficacia depende de conducta, procedimiento, reforzadores, entrenadores y medida.

No convertir un estudio en regla universal.


Conflicto 2 — castigo como categoría vs aversivos

No todo castigo técnico es idéntico.

P− puede utilizar retirada de juego.

P+ puede variar enormemente.

Por ello:

“castigo” no debe utilizarse como sinónimo automático de “aversivo intenso”.


Conflicto 3 — programa variable siempre resistente

La literatura básica muestra efectos de reforzamiento parcial.

Pero entrenamiento aplicado es más complejo.

No asumir:

“VR produce siempre mejor conducta”.


15. Banco de evidencia

Evidencia 1

Afirmación:
La conducta puede modificarse según sus consecuencias.

Qué demuestra la investigación:
Thorndike y Skinner desarrollaron evidencia experimental sistemática de selección de respuestas por consecuencias.

Fuente:
Thorndike (1898); Skinner (1938).

Nivel de certeza:
Muy alto.

Matiz importante:
Las teorías modernas son más amplias que sus formulaciones históricas.

Dónde utilizarse:
Introducción.


Evidencia 2

Afirmación:
R+/R−/P+/P− se definen funcionalmente.

Qué demuestra la teoría:
Refuerzo/castigo requieren cambio posterior de conducta.

Fuente:
Skinner (1938, 1953); literatura de análisis de conducta.

Nivel de certeza:
Muy alto.

Matiz importante:
Una sola observación no basta siempre para demostrar función.

Dónde:
Cuatro contingencias.


Evidencia 3

Afirmación:
Los perros ajustan rápidamente respuestas a refuerzo, omisión y extinción.

Qué demuestra la investigación:
Bentosela et al. observó aumento y disminución rápida de mirada humana según contingencias.

Fuente:
Bentosela et al. (2008).

Nivel de certeza:
Alto para paradigma.

Matiz:
Mirada para comida no representa toda conducta canina.


Evidencia 4

Afirmación:
El timing humano importa.

Qué demuestra:
Retrasos de acciones del propietario redujeron respuesta correcta en perros entrenados.

Fuente:
Yamamoto et al. (2009).

Nivel de certeza:
Moderado.

Matiz:
n=10.


Evidencia 5

Afirmación:
Un estímulo preferido puede ser mejor reforzador.

Qué demuestra:
Evaluaciones de preferencia predijeron eficacia posterior.

Fuente:
Vicars et al. (2014).

Nivel:
Moderado.

Matiz:
n=8.


Evidencia 6

Afirmación:
La calidad del alimento puede importar más que simplemente aumentar cantidad.

Qué demuestra:
Riemer et al. encontró cambios en vigor relacionados con calidad.

Fuente:
Riemer et al. (2018).

Nivel:
Moderado-alto.

Matiz:
Tarea específica.


Evidencia 7

Afirmación:
Extinción y persistencia tienen relevancia aplicada en perros.

Qué demuestra:
Hall sintetiza trabajos sobre resistencia a extinción y momentum.

Fuente:
Hall (2017).

Nivel:
Alto como síntesis.


Evidencia 8

Afirmación:
Refuerzo no contingente puede modificar conducta sin depender de una respuesta objetivo.

Qué demuestra:
Pfaller-Sadovsky et al. comparó NCR con y sin extinción.

Fuente:
Pfaller-Sadovsky et al. (2022).

Nivel:
Moderado.


Evidencia 9

Afirmación:
La historia de refuerzo puede afectar persistencia de cadenas de trabajo.

Qué demuestra:
Estudios con perros de detección muestran que condiciones de refuerzo influyen en resistencia a disrupción/extinción.

Fuente:
Thrailkill et al. (2016); Hall (2017).

Nivel:
Moderado-alto.


Evidencia 10

Afirmación:
Métodos aversivos se asocian con indicadores de bienestar comprometido.

Qué demuestra:
Revisiones de 2017 y estudio de 2020 convergen en esa dirección.

Fuente:
Guilherme-Fernandes et al. (2017); Ziv (2017); Vieira de Castro et al. (2020).

Nivel:
Moderado-alto.

Matiz:
No todos los estudios son experimentales.


Evidencia 11

Afirmación:
Recompensa no implica automáticamente peor eficacia.

Qué demuestra:
Vieira de Castro et al. (2021) encontró reward-based comparable o superior en variables del estudio.

Fuente:
Vieira de Castro et al. (2021).

Nivel:
Moderado.


Evidencia 12

Afirmación:
No puede afirmarse que procedimientos aversivos nunca cambien conducta.

Qué demuestra:
Johnson y Wynne encontró mayor inhibición en una tarea concreta con e-collar.

Fuente:
Johnson & Wynne (2024).

Nivel:
Moderado para esa tarea.

Matiz:
No demuestra superioridad general ni resuelve bienestar.


Evidencia 13

Afirmación:
La ciencia del aprendizaje todavía está infrautilizada en entrenamiento de perros de trabajo.

Qué demuestra:
Hall et al. identifica oportunidades en schedules, discriminación, generalización, memoria y persistencia.

Fuente:
Hall et al. (2021).

Nivel:
Alto como revisión.


16. Propuesta de estructura del artículo

H1 — Condicionamiento operante en perros: cómo las consecuencias cambian la conducta

Objetivo:
Explicar mecanismo sin reducirlo a premios/castigos.


H2 — De Thorndike a Skinner

H3 — Ensayo y error

H3 — Ley del efecto

H3 — Qué significa “operante”

Fuentes:
Thorndike (1898); Skinner (1937, 1938).


H2 — La idea fundamental: conducta → consecuencia

Objetivo:
Presentar ABC y contingencia.


H2 — Qué significan realmente positivo y negativo

H3 — Añadir

H3 — Retirar

H3 — No significan bueno/malo


H2 — Las cuatro contingencias

H3 — R+

H3 — R−

H3 — P+

H3 — P−

Incluir tabla.


H2 — La regla que evita casi todos los errores

Una consecuencia se define por lo que hace a la conducta futura.

H3 — Recompensa vs reforzador

H3 — Reprimenda vs castigo


H2 — Refuerzo positivo

H3 — Comida

H3 — Juego

H3 — Atención

H3 — Acceso ambiental

Evidencia:
Vicars et al. (2014); Riemer et al. (2018).


H2 — Refuerzo negativo

H3 — Escape

H3 — Evitación

H3 — Por qué no significa “castigo negativo”


H2 — Castigo positivo y negativo

H3 — Definición funcional

H3 — Riesgos

H3 — Bienestar

Evidencia:
Ziv (2017); Vieira de Castro et al. (2020).


H2 — Timing

Evidencia:
Yamamoto et al. (2009).


H2 — Cómo se construye una conducta

H3 — Capturing

H3 — Luring

H3 — Shaping

H3 — Targeting


H2 — Refuerzo diferencial

H3 — alternativa

H3 — incompatible

H3 — ausencia


H2 — Señales y control estimular

H3 — SD

H3 — discriminación

H3 — generalización


H2 — Programas de reforzamiento

H3 — continuo

H3 — intermitente

H3 — ratio

H3 — intervalo

Advertencia:
no convertir “variable ratio” en mantra.


H2 — Extinción

H3 — qué significa

H3 — persistencia

H3 — por qué puede reaparecer

Evidencia:
Bentosela et al. (2008); Hall (2017).


H2 — Lo que tu perro puede estar entrenándote a ti

Ejemplos:

  • ladrar → abrir puerta;
  • saltar → atención;
  • traer objeto → persecución.

H2 — Cuando el ambiente es el reforzador

H3 — olfato

H3 — acceso

H3 — movimiento

H3 — interacción


H2 — Eficacia no es la única pregunta

H3 — efectos secundarios

H3 — emoción

H3 — bienestar


H2 — Qué debería observar un responsable

  1. antecedente;
  2. conducta;
  3. consecuencia;
  4. cambio en frecuencia;
  5. contexto;
  6. valor del reforzador.

H2 — Idea final

Para saber qué está aprendiendo un perro, no basta mirar lo que hacemos nosotros: hay que observar qué consecuencia obtiene él y cómo cambia después su conducta.


17. Preguntas todavía abiertas

  1. ¿Qué programas de reforzamiento son óptimos para diferentes tareas caninas?
  2. ¿Cuánto difieren perros individuales en sensibilidad a ratio e intervalo?
  3. ¿Qué programas generan mayor persistencia sin frustración?
  4. ¿Cómo medir ratio strain en perros?
  5. ¿Qué papel tiene saciedad en rendimiento?
  6. ¿Cómo cambia valor de comida ante distractores?
  7. ¿Cómo comparar juego, alimento, elogio y acceso ambiental?
  8. ¿Qué reforzadores sociales funcionan de manera fiable?
  9. ¿Cómo cambia eficacia reforzante con edad?
  10. ¿Cómo afecta dolor?
  11. ¿Qué razas/clados muestran diferencias replicables?
  12. ¿Cómo separar genética de historia de entrenamiento?
  13. ¿Qué timing es óptimo según tarea?
  14. ¿Cómo afecta un marcador a retraso de reforzador?
  15. ¿Cuánto puede “puentear” un clicker la demora?
  16. ¿Qué combinaciones de shaping producen aprendizaje más rápido?
  17. ¿Cuándo shaping genera frustración?
  18. ¿Qué criterios de progresión son óptimos?
  19. ¿Cómo medir operaciones motivacionales en ambiente real?
  20. ¿Qué efectos tiene NCR en problemas de comportamiento?
  21. ¿Cuándo es preferible NCR frente a DRA?
  22. ¿Cómo interactúa extinción con Pavloviano?
  23. ¿Qué produce recuperación de conductas operantes?
  24. ¿Cómo influye contexto en extinción?
  25. ¿Cómo afectan programas variables a recaída?
  26. ¿Qué diferencia existe entre entrenamiento de compañía y trabajo?
  27. ¿Cómo optimizar perros de detección cuando blancos son raros?
  28. ¿Cómo reforzar cadenas largas?
  29. ¿Cómo influyen señales accidentales humanas?
  30. ¿Qué consecuencias ambientales refuerzan reactividad?
  31. ¿Cómo medir conducta sin depender de informes del dueño?
  32. ¿Cómo comparar eficacia y bienestar simultáneamente?
  33. ¿Qué efectos colaterales específicos produce cada procedimiento aversivo?
  34. ¿Qué intensidad convierte una contingencia en clínicamente problemática?
  35. ¿Qué papel tiene predictibilidad?
  36. ¿Qué papel tiene control?
  37. ¿Cómo afecta elección voluntaria?
  38. ¿Qué procedimientos reducen necesidad de castigo?
  39. ¿Cómo enseñar análisis funcional a responsables sin simplificarlo?
  40. ¿Qué términos deberían estandarizarse en entrenamiento canino?

18. Referencias

Bentosela, M., Barrera, G., Jakovcevic, A., Elgier, A. M., & Mustaca, A. E. (2008). Effect of reinforcement, reinforcer omission and extinction on a communicative response in domestic dogs (Canis familiaris). Behavioural Processes, 78(3), 464–469. https://doi.org/10.1016/j.beproc.2008.03.004

Ferster, C. B., & Skinner, B. F. (1957). Schedules of reinforcement. Appleton-Century-Crofts.

Guilherme-Fernandes, J., Olsson, I. A. S., & Vieira de Castro, A. C. (2017). Do aversive-based training methods actually compromise dog welfare? A literature review. Applied Animal Behaviour Science, 196, 1–12. https://doi.org/10.1016/j.applanim.2017.07.001

Hall, N. J. (2017). Persistence and resistance to extinction in the domestic dog: Basic research and applications to canine training. Behavioural Processes, 141(Part 1), 67–74. https://doi.org/10.1016/j.beproc.2017.04.001

Hall, N. J., Johnston, A. M., Bray, E. E., Otto, C. M., MacLean, E. L., Udell, M. A. R., & Wynne, C. D. L. (2021). Working dog training for the twenty-first century. Frontiers in Veterinary Science, 8, 646022. https://doi.org/10.3389/fvets.2021.646022

Herron, M. E., Shofer, F. S., & Reisner, I. R. (2009). Survey of the use and outcome of confrontational and non-confrontational training methods in client-owned dogs showing undesired behaviors. Applied Animal Behaviour Science, 117(1–2), 47–54. https://doi.org/10.1016/j.applanim.2008.12.011

Hiby, E. F., Rooney, N. J., & Bradshaw, J. W. S. (2004). Dog training methods: Their use, effectiveness and interaction with behaviour and welfare. Animal Welfare, 13(1), 63–69. https://doi.org/10.1017/S0962728600026683

Johnson, A. C., & Wynne, C. D. L. (2024). Comparison of the efficacy and welfare of different training methods in stopping chasing behavior in dogs. Animals, 14(18), 2632. https://doi.org/10.3390/ani14182632

Pfaller-Sadovsky, N., Arnott, G., & Hurtado-Parrado, C. (2022). The effects of noncontingent reinforcement on an arbitrary response in companion dogs. Journal of the Experimental Analysis of Behavior. https://pubmed.ncbi.nlm.nih.gov/36283576/

Reisner, I. (2017). The learning dog: A discussion of training methods. In J. Serpell (Ed.), The domestic dog: Its evolution, behavior and interactions with people (2nd ed., pp. 210–226). Cambridge University Press. https://doi.org/10.1017/9781139161800.011

Riemer, S., Ellis, S. L. H., Thompson, H., & Burman, O. H. P. (2018). Reinforcer effectiveness in dogs—The influence of quantity and quality. Applied Animal Behaviour Science, 206, 87–93. https://doi.org/10.1016/j.applanim.2018.05.016

Rooney, N. J., & Cowan, S. (2011). Training methods and owner–dog interactions: Links with dog behaviour and learning ability. Applied Animal Behaviour Science, 132(3–4), 169–177. https://doi.org/10.1016/j.applanim.2011.03.007

Skinner, B. F. (1937). Two types of conditioned reflex: A reply to Konorski and Miller. The Journal of General Psychology, 16(1), 272–279.

Skinner, B. F. (1938). The behavior of organisms: An experimental analysis. Appleton-Century.

Skinner, B. F. (1953). Science and human behavior. Macmillan.

Thorndike, E. L. (1898). Animal intelligence: An experimental study of the associative processes in animals. Psychological Review Monograph Supplements, 2(4). https://doi.org/10.1037/10780-000

Thrailkill, E. A., Kacelnik, A., Porritt, F., & Bouton, M. E. (2016). Increasing the persistence of a heterogeneous behavior chain: Studies of extinction in a rat model and a working dog model. Behavioural Processes, 129, 74–85. https://doi.org/10.1016/j.beproc.2016.06.006

Vicars, S. M., Miguel, C. F., & Sobie, J. L. (2014). Assessing preference and reinforcer effectiveness in dogs. Behavioural Processes, 103, 75–83. https://doi.org/10.1016/j.beproc.2013.11.006

Vieira de Castro, A. C., Araújo, Â., Fonseca, A., & Olsson, I. A. S. (2021). Improving dog training methods: Efficacy and efficiency of reward and mixed training methods. PLOS ONE, 16(2), e0247321. https://doi.org/10.1371/journal.pone.0247321

Vieira de Castro, A. C., Fuchs, D., Morello, G. M., Pastur, S., de Sousa, L., & Olsson, I. A. S. (2020). Does training method matter? Evidence for the negative impact of aversive-based methods on companion dog welfare. PLOS ONE, 15(12), e0225023. https://doi.org/10.1371/journal.pone.0225023

Yamamoto, M., Kikusui, T., & Ohta, M. (2009). Influence of delayed timing of owners’ actions on the behaviors of their dogs, Canis familiaris. Journal of Veterinary Behavior, 4(1), 11–18. https://doi.org/10.1016/j.jveb.2008.08.006

Ziv, G. (2017). The effects of using aversive training methods in dogs—A review. Journal of Veterinary Behavior, 19, 50–60. https://doi.org/10.1016/j.jveb.2017.02.004


Nota para el futuro redactor

El artículo debe evitar dos errores opuestos.

Error 1:
convertir condicionamiento operante en una tabla memorizada de cuatro cuadrantes.

Error 2:
hablar de “premios y correcciones” sin precisión funcional.

La progresión recomendada es:

conducta

consecuencia

¿la conducta aumenta o disminuye?

¿la consecuencia se presentó o se retiró?

Entonces:

aumenta + se presenta
→ R+

aumenta + se retira
→ R−

disminuye + se presenta
→ P+

disminuye + se retira
→ P−.

Pero inmediatamente después debe añadirse:

La tabla sólo clasifica consecuencias. No explica por sí sola por qué el perro hace algo.

Para explicar una conducta real también necesitamos:

  • antecedentes;
  • contexto;
  • motivación;
  • emoción;
  • historial;
  • reforzadores competidores;
  • programas;
  • generalización;
  • bienestar.

La idea final que debería conservar el lector es:

No entrenamos con “premios” o “castigos” como objetos. Entrenamos modificando contingencias: qué conducta tiene qué consecuencia, cuándo, con qué valor y en qué contexto.

Comentarios

Deja un comentario

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *