1. Resumen ejecutivo
Tema
Condicionamiento operante en perros.
Pregunta central
¿Cómo aprende un perro de las consecuencias de su propia conducta?
Conclusión principal
El condicionamiento operante describe un conjunto de procesos mediante los cuales la probabilidad futura de una conducta cambia en función de las consecuencias que la siguen y de las condiciones en que esas consecuencias ocurren.
En su forma más útil para esta biblioteca:
Una conducta que produce consecuencias que la fortalecen tenderá a ocurrir más en condiciones similares; una conducta seguida por consecuencias que la debilitan tenderá a ocurrir menos.
Pero esta definición necesita varios matices.
Primero, en ciencia del comportamiento:
- refuerzo significa que una conducta aumenta o se mantiene;
- castigo significa que una conducta disminuye;
- positivo significa que algo se presenta o añade;
- negativo significa que algo se retira, reduce o evita.
Por tanto:
positivo ≠ bueno
y
negativo ≠ malo.
Las cuatro contingencias tradicionales son:
| Consecuencia | Se presenta algo | Se retira/evita algo |
|---|---|---|
| La conducta aumenta | Refuerzo positivo (R+) | Refuerzo negativo (R−) |
| La conducta disminuye | Castigo positivo (P+) | Castigo negativo (P−) |
Ejemplos simplificados:
R+
Perro se sienta → recibe alimento → sentarse aumenta.
R−
Perro realiza una respuesta → cesa una presión aversiva → la respuesta aumenta.
P+
Perro realiza una conducta → se presenta una consecuencia aversiva → la conducta disminuye.
P−
Perro realiza una conducta → pierde temporalmente acceso a algo apetitivo → la conducta disminuye.
Sin embargo, el famoso “cuadro de cuatro cuadrantes” es sólo una herramienta didáctica. El análisis operante real requiere estudiar:
- antecedentes;
- contingencia;
- motivación;
- reforzadores;
- valor de las consecuencias;
- timing;
- discriminación;
- generalización;
- programas de refuerzo;
- extinción;
- competencia entre fuentes de refuerzo;
- efectos colaterales;
- bienestar.
Regla funcional fundamental
Una consecuencia se clasifica por su efecto sobre la conducta, no por la intención de la persona.
Dar comida no es automáticamente refuerzo positivo.
Sólo puede llamarse reforzador si la conducta que la precede:
- aumenta;
- se mantiene;
- se vuelve más resistente a la extinción;
- o cambia sistemáticamente según la contingencia estudiada.
Del mismo modo, gritar “¡no!” no es automáticamente castigo técnico. Si la conducta no disminuye, no se ha demostrado función punitiva.
Segunda distinción central
RECOMPENSA ≠ REFORZADOR
“Recompensa” describe normalmente un objeto o acontecimiento que el humano considera valioso.
“Reforzador” describe una función demostrada.
La investigación con perros muestra que:
- las preferencias individuales predicen parcialmente la eficacia reforzante;
- la calidad de la recompensa puede modificar vigor y rendimiento;
- comida, elogio, juego y acceso ambiental no tienen el mismo valor para todos los perros;
- el valor cambia con saciedad, contexto y competencia ambiental.
Tercera distinción central
CASTIGO ≠ VIOLENCIA, en sentido técnico.
“Castigo” es una relación funcional:
consecuencia → conducta disminuye.
Puede incluir procedimientos de muy diferente intensidad.
Pero esto no significa que todos sean equivalentes desde la perspectiva de bienestar.
La literatura canina sobre métodos aversivos indica que el uso de castigo positivo y refuerzo negativo puede asociarse con:
- conductas de estrés;
- miedo;
- peor estado afectivo;
- respuestas agresivas;
- riesgos de aprendizaje colateral.
Por tanto:
una contingencia puede ser operantemente eficaz y, al mismo tiempo, plantear problemas de bienestar.
Cuarta distinción central
EXTINCIÓN ≠ CASTIGO NEGATIVO
En extinción:
una conducta que antes producía un reforzador deja de producirlo.
En castigo negativo:
una conducta produce la retirada contingente de un estímulo apetitivo.
Puede existir solapamiento práctico, pero conceptualmente son procesos distintos.
Historia científica
El desarrollo del condicionamiento operante puede entenderse a través de:
Thorndike
→ ensayo y error + ley del efecto.
Skinner
→ conducta operante + análisis experimental de contingencias.
Ferster y Skinner
→ programas de reforzamiento.
Skinner distinguió con claridad la conducta respondiente/pavloviana de aquella cuya frecuencia se modifica por sus consecuencias, utilizando el término operante para describir clases de respuestas funcionalmente relacionadas con sus consecuencias.
Tesis recomendada
El condicionamiento operante no enseña que el perro “hace caso porque recibe premios”. Enseña algo mucho más general: los perros ajustan su conducta a las consecuencias que producen sus acciones. Entender qué refuerza realmente una conducta, cuándo ocurre y en qué contexto permite explicar tanto habilidades deseadas como muchos problemas que las personas entrenan accidentalmente.
2. Pregunta principal
Pregunta principal
¿Cómo aprende un perro de las consecuencias de sus propias acciones y cómo podemos utilizar ese conocimiento para enseñar, mantener o reducir conductas sin confundir eficacia con bienestar?
Preguntas secundarias
- ¿Qué significa operante?
- ¿En qué se diferencia del condicionamiento clásico?
- ¿Qué aportó Thorndike?
- ¿Qué aportó Skinner?
- ¿Qué es la ley del efecto?
- ¿Qué es una contingencia?
- ¿Qué es refuerzo?
- ¿Qué es castigo?
- ¿Qué significa positivo?
- ¿Qué significa negativo?
- ¿Qué es R+?
- ¿Qué es R−?
- ¿Qué es P+?
- ¿Qué es P−?
- ¿Cómo saber si una consecuencia está reforzando?
- ¿Qué diferencia existe entre recompensa y reforzador?
- ¿Qué diferencia existe entre castigo coloquial y técnico?
- ¿Qué es escape?
- ¿Qué es evitación?
- ¿Qué es extinción?
- ¿Cómo se diferencia de P−?
- ¿Qué es shaping?
- ¿Qué es capturing?
- ¿Qué es luring?
- ¿Qué es refuerzo diferencial?
- ¿Qué es control estimular?
- ¿Cómo adquiere una señal control sobre una respuesta?
- ¿Qué es un programa de reforzamiento?
- ¿Qué diferencia existe entre reforzamiento continuo e intermitente?
- ¿Qué son FR, VR, FI y VI?
- ¿Son útiles los programas variables en entrenamiento canino?
- ¿Qué es resistencia a extinción?
- ¿Qué es behavioral momentum?
- ¿Qué es razón de respuesta?
- ¿Qué es latencia?
- ¿Por qué importa el timing?
- ¿Cómo influye la magnitud/calidad del reforzador?
- ¿Qué es una operación motivacional?
- ¿Qué es reforzamiento no contingente?
- ¿Qué errores humanos refuerzan conductas no deseadas?
- ¿Cuándo el castigo puede producir efectos colaterales?
- ¿Qué dice la evidencia sobre métodos basados en recompensas y métodos aversivos?
- ¿Qué puede concluirse y qué no?
- ¿Cómo medir si una conducta está realmente bajo control operante?
- ¿Cómo integrar aprendizaje operante y bienestar?
Alcance
Este dossier es fundamental.
No pretende sustituir dossiers específicos sobre:
- refuerzo positivo;
- refuerzo negativo;
- castigo;
- extinción;
- programas de reforzamiento;
- shaping;
- control estimular;
- métodos aversivos.
Su función es construir el marco técnico común.
3. Conceptos fundamentales
3.1 Conducta operante
Una operante es una clase de conducta cuya probabilidad está relacionada con las consecuencias que históricamente ha producido bajo determinadas condiciones.
No se define únicamente por su forma.
Por ejemplo:
“poner las cuatro patas en el suelo” puede pertenecer a una clase funcional si sistemáticamente produce atención o acceso.
Skinner (1937, 1938) distinguió la conducta operante de la conducta respondiente.
3.2 Antecedente
Evento o contexto que ocurre antes de una respuesta y puede alterar su probabilidad.
Ejemplos:
- señal verbal;
- presencia de una persona;
- puerta abierta;
- correa;
- comida visible;
- otro perro;
- postura del humano.
3.3 Respuesta
Conducta observable.
Ejemplo:
- sentarse;
- aproximarse;
- ladrar;
- tirar;
- mirar;
- tocar una mano;
- soltar un objeto.
3.4 Consecuencia
Evento que ocurre después de la respuesta.
Puede o no modificar la conducta futura.
3.5 Contingencia
Relación funcional:
si ocurre la conducta, ¿qué cambia en el ambiente?
Una contingencia operante puede representarse:
A → B → C
Antecedente → conducta → consecuencia.
Pero la consecuencia sólo es funcionalmente relevante si altera comportamiento futuro.
3.6 Refuerzo
Proceso mediante el cual una consecuencia aumenta o mantiene la probabilidad futura de una conducta.
No se define por:
- agradable;
- amable;
- comida;
- intención.
Se define por el efecto sobre la conducta.
3.7 Castigo
Proceso mediante el cual una consecuencia reduce la probabilidad futura de una conducta.
No implica automáticamente:
- dolor;
- violencia;
- abuso.
Pero numerosos procedimientos utilizados como castigo sí pueden involucrar estímulos aversivos y riesgos de bienestar.
3.8 Positivo y negativo
En esta terminología:
positivo (+)
algo se presenta.
negativo (−)
algo se retira, termina o evita.
No significan:
positivo = moralmente bueno
negativo = moralmente malo.
Éste es el mito central del artículo.
3.9 Refuerzo positivo (R+)
Estructura:
conducta
→ se presenta estímulo/consecuencia
→ conducta aumenta.
Ejemplo:
sentarse → alimento → sentarse aumenta.
Otros posibles reforzadores:
- juego;
- interacción;
- acceso a olfatear;
- apertura de puerta;
- persecución permitida;
- contacto social.
Regla
Si se da comida pero la conducta no aumenta:
no se ha demostrado R+ para esa conducta en esas condiciones.
3.10 Refuerzo negativo (R−)
Estructura:
conducta
→ se retira/reduce/evita un estímulo aversivo
→ conducta aumenta.
Ejemplo abstracto:
presión aparece
→ perro realiza respuesta
→ presión termina
→ respuesta aumenta.
El estímulo eliminado funciona como condición aversiva.
Escape
La conducta termina un estímulo ya presente.
Evitación
La conducta impide o retrasa un estímulo aversivo esperado.
Ambos pueden mantener conducta mediante R−.
Error común
“Refuerzo negativo es regañar.”
No.
Si el regaño se presenta después de una respuesta y la reduce, sería conceptualmente P+, no R−.
3.11 Castigo positivo (P+)
Estructura:
conducta
→ se presenta consecuencia
→ conducta disminuye.
Ejemplos pueden incluir:
- sobresalto;
- presión;
- reprimenda;
- estímulo eléctrico;
- ruido.
Pero sólo son técnicamente castigo si la conducta disminuye.
Importante
Que una conducta se suprima durante la presencia del entrenador no significa necesariamente:
- aprendizaje generalizado;
- cambio emocional saludable;
- ausencia de efectos colaterales.
3.12 Castigo negativo (P−)
Estructura:
conducta
→ se retira temporalmente estímulo apetitivo/acceso
→ conducta disminuye.
Ejemplos:
- se interrumpe juego;
- se retira atención;
- se pierde acceso temporal.
Procedimientos clásicos:
- response cost;
- time-out from positive reinforcement.
Riesgo conceptual
No toda retirada es P−.
La retirada debe:
- ser contingente a la conducta;
- reducir la conducta.
3.13 Recompensa
Término coloquial.
Puede describir:
- comida;
- juguete;
- elogio.
Pero “recompensa” no garantiza función reforzante.
Riemer et al. (2018) mostró que la calidad de la recompensa alimentaria podía influir en eficacia de respuesta, mientras que aumentar simplemente cantidad no producía necesariamente el mismo efecto.
3.14 Reforzador primario y condicionado
Primario / no condicionado
→ tiene valor sin condicionamiento específico dentro del entrenamiento.
Ejemplo típico:
comida.
Condicionado
→ adquiere valor mediante asociación.
Ejemplo:
clicker, marcador verbal, ficha.
En la práctica:
conducta → click → comida
combina procesos operantes y pavlovianos.
3.15 Refuerzo automático
Una conducta puede producir consecuencias reforzantes sin mediación humana.
Ejemplo:
perro rompe un objeto
→ obtiene estimulación sensorial.
o:
rasca una puerta
→ modifica sensaciones/ambiente.
Esto explica por qué algunas conductas persisten aunque nadie “las premie”.
3.16 Motivación y operaciones motivacionales
El valor de un reforzador cambia.
Variables:
- hambre;
- saciedad;
- acceso reciente;
- estrés;
- temperatura;
- contexto;
- competencia ambiental.
Por ello:
“mi perro ama el pollo” no significa que pollo tenga el mismo valor en todas las situaciones.
3.17 Timing
Una consecuencia demasiado tardía puede relacionarse con otra respuesta distinta.
Yamamoto et al. (2009) evaluó retrasos de acciones del propietario en 10 perros. A medida que aumentaban retrasos de 0.13 a 2 segundos, disminuían respuestas correctas y atención en varias condiciones.
La muestra es pequeña, pero refuerza un principio general bien establecido:
la proximidad temporal entre conducta y consecuencia facilita claridad contingencial.
3.18 Extinción operante
Procedimiento mediante el cual una conducta previamente reforzada deja de producir el reforzador que la mantenía.
Resultado esperado:
reducción gradual.
Pero pueden aparecer:
- aumento temporal;
- variabilidad;
- frustración;
- recuperación;
- persistencia.
Hall (2017) revisa persistencia y resistencia a extinción específicamente en perros.
3.19 Extinction burst
En uso aplicado se describe como:
- aumento temporal de frecuencia;
- intensidad;
- variabilidad;
al comenzar extinción.
Debe explicarse con cuidado:
no toda extinción produce un “burst” claro y no debe tratarse como ley inevitable.
3.20 Shaping
Construcción de una conducta mediante reforzamiento diferencial de aproximaciones sucesivas.
Ejemplo:
objetivo:
entrar en transportín.
Refuerzo:
- mirar transportín;
- acercarse;
- introducir cabeza;
- una pata;
- dos patas;
- entrar completamente.
No es simplemente “esperar y premiar”.
Exige:
- criterios;
- timing;
- progresión.
3.21 Capturing
Reforzar una conducta que el perro ofrece espontáneamente.
Ejemplo:
perro se tumba relajado
→ marcar/reforzar.
3.22 Luring
Utilizar un estímulo atractivo para guiar movimiento inicialmente.
Ejemplo:
comida cerca del hocico
→ movimiento.
Después conviene retirar gradualmente el señuelo para evitar dependencia.
3.23 Targeting
Enseñar contacto/orientación hacia un objetivo.
Puede convertirse en herramienta para:
- posicionamiento;
- cuidado cooperativo;
- movimiento.
3.24 Refuerzo diferencial
Refuerzo selectivo de ciertas respuestas.
Ejemplos:
DRA
→ conducta alternativa.
DRI
→ conducta incompatible.
DRO
→ ausencia de una conducta durante intervalo.
Debe diseñarse según función y contexto.
3.25 Control estimular
Una conducta está bajo control estimular cuando la probabilidad cambia sistemáticamente según estímulos antecedentes.
Ejemplo:
“sentado” produce alta probabilidad de sentarse.
Pero si el perro responde sólo cuando:
- persona inclina cuerpo;
- mano tiene comida;
- está en cocina;
el control real puede ser compuesto.
3.26 Señal discriminativa (SD)
En análisis operante, un SD señala que una respuesta tiene una historia de producir determinada consecuencia.
Simplificación práctica:
“En presencia de esta señal, esta respuesta suele funcionar.”
No significa que la palabra “ordene” causalmente el movimiento de manera automática.
3.27 Generalización
La respuesta se extiende a estímulos/contextos similares.
Discriminación
La respuesta se concentra en condiciones donde históricamente ha sido reforzada.
4. Evolución
4.1 Aprender de consecuencias es una capacidad adaptativa general
El condicionamiento operante no es exclusivo del perro.
Permite a un animal ajustar conducta según:
- recursos;
- peligros;
- competencia;
- refugio;
- interacción social.
4.2 Función adaptativa
Si una acción produce alimento:
→ repetirla puede ser útil.
Si produce daño:
→ reducirla puede ser útil.
El mecanismo permite flexibilidad sin depender exclusivamente de respuestas genéticamente fijadas.
4.3 Restricciones biológicas
No todas las respuestas son igualmente enseñables.
Influyen:
- anatomía;
- sistemas motivacionales;
- repertorio;
- predisposición;
- historia.
Por tanto:
el refuerzo selecciona dentro de un repertorio biológicamente posible.
4.4 Domesticación
La domesticación no creó el aprendizaje operante.
Pero convivir con humanos multiplicó contingencias relacionadas con:
- alimento;
- puertas;
- correas;
- atención;
- objetos;
- señales;
- espacios urbanos.
El perro doméstico vive en un ambiente extraordinariamente controlado por decisiones humanas.
5. Domesticación e historia
5.1 Thorndike y el ensayo y error
Edward Thorndike estudió animales en dispositivos conocidos como puzzle boxes.
El principio histórico central fue la ley del efecto:
respuestas seguidas de resultados satisfactorios tenderían a fortalecerse, mientras que respuestas seguidas de resultados insatisfactorios tenderían a debilitarse.
Thorndike (1898) ayudó a desplazar explicaciones anecdóticas hacia experimentos controlados.
5.2 De Thorndike a Skinner
Skinner desarrolló una metodología basada en:
- respuestas repetibles;
- tasa de respuesta;
- consecuencias;
- control experimental.
En 1937 distinguió dos tipos de reflejo condicionado y articuló la noción de operante.
En The Behavior of Organisms (1938) consolidó su análisis experimental.
5.3 Qué significa “operante”
La conducta “opera” sobre el ambiente.
No necesita un estímulo elicitador identificado como en el modelo pavloviano.
Su probabilidad se analiza según consecuencias.
5.4 Programas de reforzamiento
Ferster y Skinner (1957) estudiaron cómo diferentes reglas de entrega de reforzador producen patrones distintos de conducta.
Su investigación fue mayoritariamente con palomas.
Debe evitarse extrapolar mecánicamente todos los patrones a perros de compañía, pero los principios inspiraron gran parte del análisis operante contemporáneo.
5.5 Dog training moderno
La terminología R+/R−/P+/P− llegó ampliamente al entrenamiento canino a través de:
- análisis de conducta;
- psicología comparada;
- entrenamiento animal;
- medicina conductual.
Sin embargo, el sector profesional no utiliza las palabras con completa consistencia.
Por eso el artículo debe insistir:
describir contingencia concreta > etiquetar cuadrante.
6. Etología
6.1 El perro no es una caja vacía
El aprendizaje operante selecciona conducta dentro de un repertorio influido por:
- especie;
- genética;
- desarrollo;
- experiencia;
- motivación.
6.2 Tinbergen: causación
¿Por qué aparece la respuesta ahora?
- señal;
- estado motivacional;
- historia de refuerzo;
- valor del resultado;
- emoción.
6.3 Ontogenia
¿Cómo se desarrolló?
Una conducta puede adquirir una historia larga.
Ejemplo:
cachorro salta
→ personas ríen/tocan.
Meses después:
salto altamente persistente.
El problema no necesita explicación por “dominancia”.
Puede existir una historia de reforzamiento.
6.4 Función
En análisis conductual, función significa:
qué consecuencias ayudan a mantener el comportamiento.
Funciones comunes:
- acceso;
- atención;
- escape;
- estimulación.
No es idéntico a función adaptativa evolutiva.
6.5 Filogenia
Algunas respuestas son más probables por repertorio de especie.
Ejemplo:
olfatear, perseguir, masticar.
El entrenamiento puede:
- canalizar;
- poner bajo señal;
- reforzar alternativas.
No puede eliminar la biología del perro.
7. Cognición y aprendizaje
7.1 La unidad fundamental es relación, no objeto
No preguntar sólo:
“¿qué premio usas?”
Preguntar:
“¿qué conducta produce qué consecuencia y con qué consistencia?”
7.2 El reforzador se demuestra
Vicars et al. (2014) evaluó preferencia y eficacia de reforzadores en ocho perros.
Las preferencias medidas sistemáticamente podían predecir qué estímulos mantendrían mejor la respuesta.
Esto demuestra:
preferencia y reforzamiento están relacionados, pero el reforzador debe verificarse funcionalmente.
7.3 Calidad vs cantidad
Riemer et al. (2018) estudió valor de recompensas alimentarias.
La calidad de alimento afectó vigor de respuesta más claramente que simplemente aumentar cantidad en determinadas condiciones.
No significa:
“usa comida premium”.
Significa:
valor reforzante depende de propiedades del resultado, no sólo de número de piezas.
7.4 Contingencia
Si alimento aparece independientemente de conducta:
puede perderse claridad operante.
Pfaller-Sadovsky et al. (2022) estudió reforzamiento no contingente en perros de compañía y mostró que la entrega temporal de reforzadores puede alterar conducta incluso sin depender de la respuesta.
Esto demuestra que:
la comida puede modificar conducta aunque no esté funcionando como R+ contingente a la respuesta objetivo.
7.5 Refuerzo no contingente
NCR
Reforzador se entrega según tiempo, no respuesta.
Puede:
- reducir valor de conducta mantenida por ese reforzador;
- competir;
- producir efectos de abolición/saciedad;
- cambiar condiciones.
No es “reforzar nada”.
Es un procedimiento diferente.
7.6 Extinción y omisión
Bentosela et al. (2008) estudió mirada hacia humanos en una situación de solicitud de comida.
Encontraron cambios rápidos:
- aumento con reforzamiento diferencial;
- disminución con omisión;
- disminución con extinción.
Esto es evidencia directa de sensibilidad canina a contingencias operantes.
7.7 Timing
Yamamoto et al. (2009):
10 perros.
Retrasos:
0.13, 0.27, 0.5, 1 y 2 s.
Mayores retrasos redujeron respuestas apropiadas y atención.
La muestra es pequeña, pero ilustra:
una consecuencia mal temporizada puede seleccionar otra conducta distinta a la que el humano cree estar reforzando.
7.8 Programas de reforzamiento
Refuerzo continuo (CRF/FR1)
Cada respuesta objetivo produce reforzador.
Útil para:
- adquisición.
Refuerzo intermitente
Sólo algunas respuestas producen reforzador.
Puede utilizarse para:
- mantenimiento;
- persistencia.
7.9 Ratio vs intervalo
Ratio
→ depende de número de respuestas.
Interval
→ depende del paso del tiempo + respuesta.
Fixed
→ criterio constante.
Variable
→ criterio cambia alrededor de promedio.
Así:
- FR;
- VR;
- FI;
- VI.
Advertencia
La literatura aplicada específica en perros sobre comparación sistemática de estos programas es mucho menor que la literatura clásica en palomas/roedores.
Hall et al. (2021) señala precisamente la necesidad de estudios paramétricos en perros de trabajo.
7.10 Partial reinforcement extinction effect
En muchas especies, respuestas adquiridas bajo reforzamiento parcial pueden mostrar mayor persistencia durante extinción que respuestas continuamente reforzadas.
Pero:
no debe simplificarse como “haz premios aleatorios y será más fuerte”.
Cambios de programa demasiado rápidos pueden:
- reducir rendimiento;
- generar ratio strain;
- debilitar conducta.
7.11 Behavioral momentum
Hall (2017) revisa aplicaciones de teoría de momentum conductual en perros.
Idea simplificada:
una conducta en un contexto con historia rica de reforzamiento puede ser más resistente a disrupción.
Útil en perros de detección:
- trabajar ante distractores;
- mantener búsqueda cuando blancos son raros.
7.12 Cadenas conductuales
Muchos trabajos complejos implican secuencias:
buscar
→ localizar
→ indicar
→ recibir reforzador.
Thrailkill et al. (2016) estudió persistencia de cadenas heterogéneas en perros de detección y mostró que las condiciones de reforzamiento pueden alterar resistencia a extinción de la cadena.
7.13 Shaping y creatividad conductual
En shaping:
- definir objetivo;
- observar repertorio;
- seleccionar aproximación;
- reforzar;
- elevar criterio;
- dejar de reforzar aproximaciones antiguas.
Error común:
elevar criterio demasiado rápido.
Puede producir:
- caída de tasa;
- frustración;
- abandono.
7.14 Señuelo vs refuerzo
Un alimento puede cumplir distintas funciones:
antes de la conducta
→ señuelo.
después de conducta y contingente
→ potencial reforzador.
entregado por tiempo
→ NCR.
El objeto es el mismo.
La función cambia.
7.15 Señales y control estimular
Una conducta no está “bajo comando” porque el humano pronuncie una palabra.
Debe existir historia de:
señal → oportunidad de respuesta → consecuencia.
La señal gana control porque informa sobre contingencia.
8. Desarrollo
8.1 Cachorros aprenden consecuencias desde muy temprano
Antes de clases formales:
llorar
→ humano aparece.
morder
→ juego continúa.
sentarse
→ se abre puerta.
Estas contingencias construyen repertorio.
8.2 Educación accidental
Muchos “malos hábitos” fueron funcionalmente reforzados.
Ejemplo:
perro ladra en mesa
→ recibe comida.
Tres veces por semana durante meses.
Después:
familia pregunta por qué “no entiende que está mal”.
Desde análisis operante:
la conducta ha sido reforzada intermitentemente.
Eso puede producir alta persistencia.
8.3 Adolescencia
Cambios de:
- exploración;
- motivación;
- activación;
- competencia ambiental;
pueden modificar eficacia de reforzadores.
No implica que el perro “olvide”.
8.4 Senior
Puede seguir aprendiendo.
Pero deben considerarse:
- dolor;
- audición;
- visión;
- movilidad;
- cognición.
Una caída de respuesta no debe atribuirse automáticamente a motivación.
9. Análisis del comportamiento
9.1 ABC ampliado
Operación motivacional
+
Antecedente
→
Conducta
→
Consecuencia
→
cambio futuro de probabilidad
9.2 Caso: saltar sobre personas
A: persona llega.
B: perro salta.
C: persona toca y habla.
Si salto aumenta:
→ interacción funciona como R+.
Solución
Manejo:
evitar ensayo.
Refuerzo diferencial:
cuatro patas en suelo → atención.
9.3 Caso: tirar de correa
A: estímulo atractivo delante.
B: perro tira.
C: avanza hacia estímulo.
Si tirar aumenta:
→ avance puede reforzar tirar.
No hace falta que el humano entregue comida.
Lección
el ambiente refuerza.
9.4 Caso: ladrido para abrir puerta
B: ladra.
C: puerta se abre.
Si aumenta:
→ acceso funciona como R+.
9.5 Caso: presión y liberación
A: presión.
B: respuesta.
C: presión termina.
Si respuesta aumenta:
→ R−.
9.6 Caso: interrumpir juego
A: juego.
B: mordida fuerte.
C: juego termina.
Si mordida fuerte disminuye:
→ P−.
9.7 Caso: reprimenda
Perro roba objeto.
Humano grita.
¿P+?
Sólo si:
→ robar disminuye.
Si el perro interpreta grito como interacción y roba más:
la misma consecuencia podría estar funcionando como reforzador social.
Lección
la función la determina la conducta futura, no la intención humana.
9.8 Error de causalidad
Una conducta puede disminuir después de una intervención por:
- fatiga;
- saciedad;
- contexto;
- miedo;
- extinción;
- cambio ambiental.
Una sola observación no demuestra P+ o P−.
10. Bienestar
10.1 Eficacia operante no equivale a bienestar
Un estímulo aversivo puede funcionar operantemente.
Eso no resuelve:
- intensidad;
- miedo;
- dolor;
- generalización;
- asociación con humano;
- estrés;
- alternativas disponibles.
10.2 Métodos aversivos
Ziv (2017) revisó 17 estudios.
Conclusión general:
- riesgos para bienestar;
- no evidencia de superioridad general de castigo positivo frente a estrategias basadas en refuerzo.
Guilherme-Fernandes et al. (2017) también encontró asociación entre aversivos e indicadores de bienestar comprometido, aunque destacó limitaciones metodológicas.
10.3 Evidencia fisiológica y cognitiva
Vieira de Castro et al. (2020):
92 perros.
Grupos:
- reward;
- mixed;
- aversive.
Mayor uso de aversivos se asoció con:
- más conductas de estrés;
- mayores cambios de cortisol;
- sesgo cognitivo más pesimista.
Limitación:
no asignación aleatoria.
10.4 Eficacia y eficiencia
Vieira de Castro et al. (2021) comparó métodos reward vs mixed en perros entrenados en tareas.
En ese contexto, el grupo basado en recompensas mostró mejor o comparable eficacia/eficiencia en medidas estudiadas.
La literatura todavía es más limitada de lo deseable.
10.5 Evidencia que complica una narrativa absoluta
Johnson y Wynne (2024) encontró que en una tarea específica de inhibición de persecución un grupo con collar electrónico mostró mayor inhibición que condiciones no aversivas concretas.
Limitaciones:
- pequeña muestra final;
- tarea específica;
- diferencias de protocolo;
- dificultades para extrapolar.
Esto obliga a distinguir:
“puede modificar conducta”
de:
“es necesario, óptimo o preferible en términos de bienestar”.
10.6 Confrontación y agresión
Herron et al. (2009) estudió respuestas reportadas a intervenciones confrontativas en perros con problemas conductuales.
Varias técnicas aversivas/confrontativas provocaron respuestas agresivas en una proporción importante.
Esto no demuestra que todo P+ cause agresión.
Demuestra:
algunos procedimientos pueden aumentar riesgo en perros susceptibles.
10.7 La ética no está contenida en el cuadrante
R+, R−, P+ y P− describen relaciones funcionales.
No determinan automáticamente:
- aceptabilidad;
- intensidad;
- bienestar;
- proporcionalidad.
Por eso un artículo científico debe separar:
descripción operante
de
evaluación ética y de bienestar.
11. Adiestramiento y manejo
11.1 Secuencia recomendada para enseñar
1. definir conducta observable
“tumbado” mejor que “calmado”.
2. identificar reforzador
3. crear oportunidad
4. marcar respuesta
5. entregar consecuencia
6. repetir
7. elevar criterio
8. introducir señal
9. generalizar
10. pasar a mantenimiento
11.2 Adquisición
Durante adquisición:
- alta tasa de refuerzo;
- criterio alcanzable;
- pocas distracciones.
Error:
retirar reforzamiento demasiado pronto.
11.3 Shaping
Ideal cuando:
- no puede inducirse fácilmente;
- queremos iniciativa;
- conducta tiene etapas.
Riesgo:
criterios confusos.
11.4 Captura
Ideal para:
- calma;
- posturas naturales;
- conductas espontáneas.
11.5 Refuerzo diferencial
Para problemas:
perro salta
→ reforzar cuatro patas en suelo.
perro tira
→ reforzar correa floja / orientación.
Pero:
si la conducta problema continúa produciendo reforzadores potentes:
el plan puede fracasar.
11.6 Manejo
El manejo altera contingencias.
Ejemplo:
no dejar comida en mesa.
Evita:
robar → comida.
Esto reduce práctica y autorrefuerzo.
11.7 Refuerzo ambiental
Los mejores reforzadores no siempre están en la bolsa.
Ejemplos:
- olfatear;
- avanzar;
- saludar;
- acceder a puerta;
- subir al coche.
Puede utilizarse:
conducta deseada → acceso ambiental.
11.8 Programas de mantenimiento
Después de adquisición:
no es obligatorio alimentar cada respuesta de por vida.
Pero el cambio debe:
- ser gradual;
- mantener valor;
- incorporar reforzadores naturales.
No reducir a:
“pasa a variable ratio porque crea adicción”.
Esa frase es científicamente deficiente.
11.9 Ratio strain
Si exigencia aumenta demasiado:
- respuestas pueden deteriorarse;
- latencia aumenta;
- conducta desaparece.
Regla práctica:
adelgazar programa de refuerzo lentamente.
11.10 Extinción en problemas cotidianos
Ejemplo:
ladrido obtiene atención.
Extinción:
atención deja de seguir al ladrido.
Pero:
si ocasionalmente obtiene atención:
la conducta puede volverse altamente persistente.
11.11 Extinción no siempre es recomendable
Puede ser:
- peligrosa;
- frustrante;
- difícil.
Especialmente con:
- agresión;
- miedo;
- conductas de alto riesgo.
Preferir con frecuencia:
manejo + refuerzo de alternativa.
12. Aplicaciones prácticas
Esto significa que…
Antes de preguntar:
“¿Cómo corrijo esto?”
preguntar:
“¿Qué consecuencia está manteniendo la conducta?”
En la vida cotidiana…
Caso 1 — saltar
Perro salta
→ humano toca.
Si aumenta:
contacto es reforzador.
Solución:
atención para cuatro patas en suelo.
Caso 2 — tirar
Tira
→ llega al árbol.
Árbol/olfato puede reforzar.
Uso:
correa floja
→ acceso al olor.
Caso 3 — ladrar en puerta
Ladra
→ puerta se abre.
Entrenamiento accidental.
Cambiar:
silencio/orientación
→ puerta abre.
Caso 4 — robar calcetín
Roba
→ humano persigue.
Si el juego de persecución tiene valor:
robar puede aumentar.
Caso 5 — llamada
“ven”
→ perro llega
→ se termina diversión.
La llamada puede adquirir consecuencias poco competitivas.
Mejor:
llegar
→ premio + a veces volver a jugar.
Un responsable puede observar…
- frecuencia;
- latencia;
- duración;
- tasa;
- contexto;
- consecuencia;
- variabilidad;
- cambios después de intervención.
Conviene evitar…
- etiquetar una consecuencia sin comprobar efecto;
- llamar “R+” a cualquier premio;
- llamar “P+” a cualquier regaño;
- creer que negativo significa malo;
- retirar reforzadores demasiado rápido;
- usar programas variables sin conducta estable;
- ignorar refuerzos ambientales;
- aplicar extinción a conductas peligrosas sin plan;
- usar castigo sin valorar bienestar;
- atribuir persistencia a “terquedad”.
Podría ayudar…
- registrar 10–20 ensayos;
- calcular porcentaje;
- medir latencia;
- comparar contextos;
- identificar reforzadores competidores;
- entrenar alternativas;
- manejar ambiente.
13. Mitos y controversias
| Afirmación | Clasificación | Evaluación |
|---|---|---|
| “Positivo significa bueno.” | Contradicha | Significa añadir/presentar. |
| “Negativo significa malo.” | Contradicha | Significa retirar/reducir. |
| “Dar comida siempre es R+.” | Contradicha | Debe aumentar la conducta. |
| “Quitar algo siempre es castigo.” | Contradicha | Si aumenta conducta puede ser R−. |
| “Castigo significa pegar.” | Contradicha como definición técnica | Castigo es reducción funcional. |
| “Si regaño, estoy castigando.” | No necesariamente | Sólo si conducta disminuye. |
| “R− es malo y R+ es bueno por definición.” | Contradicha | Los términos no contienen evaluación moral. |
| “Los cuatro cuadrantes explican todo entrenamiento.” | Contradicha / incompleta | Faltan antecedentes, motivación, programas, emoción, Pavloviano, contexto. |
| “Extinción es P−.” | Contradicha como equivalencia | Son procedimientos funcionalmente distintos. |
| “Ignorar siempre elimina conductas.” | Contradicha | Sólo si atención es reforzador relevante y otras fuentes no mantienen conducta. |
| “Un perro hace cosas sólo para obtener premios.” | Contradicha | Existen múltiples reforzadores y aprendizaje pavloviano. |
| “Hay que dejar de premiar lo antes posible.” | Contradicha | Retirada prematura puede deteriorar conducta. |
| “Variable ratio es siempre el mejor programa.” | No respaldada como regla universal | Depende de tarea, adquisición, mantenimiento y bienestar. |
| “Los castigos nunca funcionan.” | Demasiado absoluta | Pueden reducir conducta; cuestión adicional es bienestar, necesidad y efectos secundarios. |
| “Si funciona, es buen método.” | Contradicha por evaluación de bienestar | Eficacia conductual no agota el análisis. |
| “Una conducta reforzada nunca se extingue.” | Contradicha | Depende de programa, contexto y nuevas contingencias. |
| “Si refuerzo mucho, el perro se vuelve dependiente de comida.” | Simplificación | Depende de diseño, transferencia a reforzadores naturales y control estimular. |
| “El perro sabe la orden pero elige desobedecer.” | No demostrado por el fallo de respuesta | Pueden intervenir motivación, contexto y generalización. |
Controversia 1 — ¿cuadrantes o análisis funcional?
Los cuadrantes ayudan a enseñar terminología.
Pero pueden fomentar errores:
- etiquetar sin medir;
- ignorar antecedentes;
- ignorar Pavloviano;
- ignorar bienestar.
Conclusión:
usar cuadrantes como mapa inicial, no como análisis completo.
Controversia 2 — ¿castigo puede ser eficaz?
Sí, por definición una consecuencia que reduce conducta es castigo.
La controversia relevante es:
- rapidez;
- necesidad;
- efectos secundarios;
- bienestar;
- alternativas.
Controversia 3 — ¿reward-only existe?
En la práctica, entrenamiento puede incluir:
- R+;
- P−;
- extinción;
- manejo.
Por eso términos populares como:
“positive-only”
pueden ser menos precisos que describir procedimientos concretos.
Controversia 4 — reforzar emoción
Una emoción no se maneja exactamente como una respuesta operante simple.
Dar comida en presencia de miedo no significa automáticamente “reforzar miedo”.
Puede participar en contracondicionamiento pavloviano.
Este tema conecta con el dossier 4.
14. Estado de la evidencia
14.1 Muy alta confianza
Principios básicos:
- refuerzo;
- castigo;
- contingencia;
- extinción;
- programas.
Respaldados por más de un siglo de investigación comparada.
14.2 Alta confianza específica en perros
Sensibilidad a contingencias
Bentosela et al. (2008).
Extinción/persistencia
Hall (2017).
Timing
Yamamoto et al. (2009), aunque muestra pequeña.
Valor del reforzador
Vicars et al. (2014);
Riemer et al. (2018).
14.3 Evidencia moderada-alta
Métodos aversivos y bienestar
Convergencia de:
- revisiones;
- encuestas;
- observación;
- cortisol;
- sesgo cognitivo.
Pero:
muchos estudios no son ensayos aleatorizados.
14.4 Áreas con evidencia canina limitada
- comparación sistemática FR/VR/FI/VI;
- ratio strain;
- programas concurrentes;
- matching law;
- operaciones motivacionales;
- shaping optimizado;
- NCR aplicado;
- behavioral momentum fuera de perros de trabajo.
Hall et al. (2021) señala múltiples oportunidades de investigación aplicada.
14.5 Evaluación de fuentes clave
| Fuente | Tipo | Población/muestra | Hallazgo | Limitaciones | Confianza | Uso |
|---|---|---|---|---|---|---|
| Thorndike (1898) | Monografía experimental | gatos y otros animales | Ensayo/error y ley del efecto | Histórica; conceptos revisados | Muy alta histórica | Origen |
| Skinner (1937) | Artículo teórico/experimental | literatura experimental | Distingue operante/respondiente | Terminología histórica | Muy alta histórica | Definición |
| Skinner (1938) | Monografía experimental | principalmente ratas | Análisis sistemático de conducta operante | No perros | Muy alta teórica | Fundamentos |
| Ferster & Skinner (1957) | Monografía experimental | principalmente palomas | Programas de refuerzo producen patrones sistemáticos | Extrapolación a perros requiere cautela | Muy alta general | Programas |
| Bentosela et al. (2008) | Experimentos caninos | perros domésticos | Mirada cambia rápidamente con refuerzo, omisión y extinción | Paradigma específico | Alta | Contingencia |
| Yamamoto et al. (2009) | Experimento | 10 perros | Retrasos empeoran respuesta/atención | Muestra pequeña | Moderada | Timing |
| Rooney & Cowan (2011) | Encuesta + tarea | 53 díadas | Métodos del dueño asociados con conducta/aprendizaje | Correlacional | Moderada | Aplicación |
| Vicars et al. (2014) | Experimento | 8 perros | Preferencia predice eficacia reforzante | Muestra pequeña | Moderada | Reforzador |
| Hall (2017) | Revisión | perros | Persistencia y resistencia a extinción | Campo canino limitado | Alta como síntesis | Extinción |
| Riemer et al. (2018) | Experimento | perros | Calidad de recompensa influye en eficacia | Tarea concreta | Moderada-alta | Magnitud |
| Vieira de Castro et al. (2020) | Estudio aplicado | 92 perros | Más aversivos, peores indicadores de bienestar | No aleatorizado | Moderada-alta | Bienestar |
| Vieira de Castro et al. (2021) | Estudio comparativo | perros de escuelas | Reward-based igual/mejor en medidas de eficacia/eficiencia | Contexto específico | Moderada | Métodos |
| Hall et al. (2021) | Revisión | perros de trabajo | Ciencia del aprendizaje puede optimizar entrenamiento | Varias recomendaciones aún no probadas | Alta como agenda | Aplicación |
| Pfaller-Sadovsky et al. (2022) | Experimento | perros de compañía | NCR y extinción alteran respuesta arbitraria | Área pequeña | Moderada | NCR |
| Johnson & Wynne (2024) | Ensayo aleatorizado | 30 reclutados; muestra final menor | E-collar superior en tarea específica de persecución | Muestra pequeña/protocolos distintos | Moderada para tarea, baja generalización | Controversia |
14.6 Conflictos entre fuentes
Conflicto 1 — métodos aversivos y eficacia
Algunos estudios:
reward-based comparable o mejor.
Johnson & Wynne (2024):
e-collar mejor en una tarea específica.
Interpretación:
eficacia depende de conducta, procedimiento, reforzadores, entrenadores y medida.
No convertir un estudio en regla universal.
Conflicto 2 — castigo como categoría vs aversivos
No todo castigo técnico es idéntico.
P− puede utilizar retirada de juego.
P+ puede variar enormemente.
Por ello:
“castigo” no debe utilizarse como sinónimo automático de “aversivo intenso”.
Conflicto 3 — programa variable siempre resistente
La literatura básica muestra efectos de reforzamiento parcial.
Pero entrenamiento aplicado es más complejo.
No asumir:
“VR produce siempre mejor conducta”.
15. Banco de evidencia
Evidencia 1
Afirmación:
La conducta puede modificarse según sus consecuencias.
Qué demuestra la investigación:
Thorndike y Skinner desarrollaron evidencia experimental sistemática de selección de respuestas por consecuencias.
Fuente:
Thorndike (1898); Skinner (1938).
Nivel de certeza:
Muy alto.
Matiz importante:
Las teorías modernas son más amplias que sus formulaciones históricas.
Dónde utilizarse:
Introducción.
Evidencia 2
Afirmación:
R+/R−/P+/P− se definen funcionalmente.
Qué demuestra la teoría:
Refuerzo/castigo requieren cambio posterior de conducta.
Fuente:
Skinner (1938, 1953); literatura de análisis de conducta.
Nivel de certeza:
Muy alto.
Matiz importante:
Una sola observación no basta siempre para demostrar función.
Dónde:
Cuatro contingencias.
Evidencia 3
Afirmación:
Los perros ajustan rápidamente respuestas a refuerzo, omisión y extinción.
Qué demuestra la investigación:
Bentosela et al. observó aumento y disminución rápida de mirada humana según contingencias.
Fuente:
Bentosela et al. (2008).
Nivel de certeza:
Alto para paradigma.
Matiz:
Mirada para comida no representa toda conducta canina.
Evidencia 4
Afirmación:
El timing humano importa.
Qué demuestra:
Retrasos de acciones del propietario redujeron respuesta correcta en perros entrenados.
Fuente:
Yamamoto et al. (2009).
Nivel de certeza:
Moderado.
Matiz:
n=10.
Evidencia 5
Afirmación:
Un estímulo preferido puede ser mejor reforzador.
Qué demuestra:
Evaluaciones de preferencia predijeron eficacia posterior.
Fuente:
Vicars et al. (2014).
Nivel:
Moderado.
Matiz:
n=8.
Evidencia 6
Afirmación:
La calidad del alimento puede importar más que simplemente aumentar cantidad.
Qué demuestra:
Riemer et al. encontró cambios en vigor relacionados con calidad.
Fuente:
Riemer et al. (2018).
Nivel:
Moderado-alto.
Matiz:
Tarea específica.
Evidencia 7
Afirmación:
Extinción y persistencia tienen relevancia aplicada en perros.
Qué demuestra:
Hall sintetiza trabajos sobre resistencia a extinción y momentum.
Fuente:
Hall (2017).
Nivel:
Alto como síntesis.
Evidencia 8
Afirmación:
Refuerzo no contingente puede modificar conducta sin depender de una respuesta objetivo.
Qué demuestra:
Pfaller-Sadovsky et al. comparó NCR con y sin extinción.
Fuente:
Pfaller-Sadovsky et al. (2022).
Nivel:
Moderado.
Evidencia 9
Afirmación:
La historia de refuerzo puede afectar persistencia de cadenas de trabajo.
Qué demuestra:
Estudios con perros de detección muestran que condiciones de refuerzo influyen en resistencia a disrupción/extinción.
Fuente:
Thrailkill et al. (2016); Hall (2017).
Nivel:
Moderado-alto.
Evidencia 10
Afirmación:
Métodos aversivos se asocian con indicadores de bienestar comprometido.
Qué demuestra:
Revisiones de 2017 y estudio de 2020 convergen en esa dirección.
Fuente:
Guilherme-Fernandes et al. (2017); Ziv (2017); Vieira de Castro et al. (2020).
Nivel:
Moderado-alto.
Matiz:
No todos los estudios son experimentales.
Evidencia 11
Afirmación:
Recompensa no implica automáticamente peor eficacia.
Qué demuestra:
Vieira de Castro et al. (2021) encontró reward-based comparable o superior en variables del estudio.
Fuente:
Vieira de Castro et al. (2021).
Nivel:
Moderado.
Evidencia 12
Afirmación:
No puede afirmarse que procedimientos aversivos nunca cambien conducta.
Qué demuestra:
Johnson y Wynne encontró mayor inhibición en una tarea concreta con e-collar.
Fuente:
Johnson & Wynne (2024).
Nivel:
Moderado para esa tarea.
Matiz:
No demuestra superioridad general ni resuelve bienestar.
Evidencia 13
Afirmación:
La ciencia del aprendizaje todavía está infrautilizada en entrenamiento de perros de trabajo.
Qué demuestra:
Hall et al. identifica oportunidades en schedules, discriminación, generalización, memoria y persistencia.
Fuente:
Hall et al. (2021).
Nivel:
Alto como revisión.
16. Propuesta de estructura del artículo
H1 — Condicionamiento operante en perros: cómo las consecuencias cambian la conducta
Objetivo:
Explicar mecanismo sin reducirlo a premios/castigos.
H2 — De Thorndike a Skinner
H3 — Ensayo y error
H3 — Ley del efecto
H3 — Qué significa “operante”
Fuentes:
Thorndike (1898); Skinner (1937, 1938).
H2 — La idea fundamental: conducta → consecuencia
Objetivo:
Presentar ABC y contingencia.
H2 — Qué significan realmente positivo y negativo
H3 — Añadir
H3 — Retirar
H3 — No significan bueno/malo
H2 — Las cuatro contingencias
H3 — R+
H3 — R−
H3 — P+
H3 — P−
Incluir tabla.
H2 — La regla que evita casi todos los errores
Una consecuencia se define por lo que hace a la conducta futura.
H3 — Recompensa vs reforzador
H3 — Reprimenda vs castigo
H2 — Refuerzo positivo
H3 — Comida
H3 — Juego
H3 — Atención
H3 — Acceso ambiental
Evidencia:
Vicars et al. (2014); Riemer et al. (2018).
H2 — Refuerzo negativo
H3 — Escape
H3 — Evitación
H3 — Por qué no significa “castigo negativo”
H2 — Castigo positivo y negativo
H3 — Definición funcional
H3 — Riesgos
H3 — Bienestar
Evidencia:
Ziv (2017); Vieira de Castro et al. (2020).
H2 — Timing
Evidencia:
Yamamoto et al. (2009).
H2 — Cómo se construye una conducta
H3 — Capturing
H3 — Luring
H3 — Shaping
H3 — Targeting
H2 — Refuerzo diferencial
H3 — alternativa
H3 — incompatible
H3 — ausencia
H2 — Señales y control estimular
H3 — SD
H3 — discriminación
H3 — generalización
H2 — Programas de reforzamiento
H3 — continuo
H3 — intermitente
H3 — ratio
H3 — intervalo
Advertencia:
no convertir “variable ratio” en mantra.
H2 — Extinción
H3 — qué significa
H3 — persistencia
H3 — por qué puede reaparecer
Evidencia:
Bentosela et al. (2008); Hall (2017).
H2 — Lo que tu perro puede estar entrenándote a ti
Ejemplos:
- ladrar → abrir puerta;
- saltar → atención;
- traer objeto → persecución.
H2 — Cuando el ambiente es el reforzador
H3 — olfato
H3 — acceso
H3 — movimiento
H3 — interacción
H2 — Eficacia no es la única pregunta
H3 — efectos secundarios
H3 — emoción
H3 — bienestar
H2 — Qué debería observar un responsable
- antecedente;
- conducta;
- consecuencia;
- cambio en frecuencia;
- contexto;
- valor del reforzador.
H2 — Idea final
Para saber qué está aprendiendo un perro, no basta mirar lo que hacemos nosotros: hay que observar qué consecuencia obtiene él y cómo cambia después su conducta.
17. Preguntas todavía abiertas
- ¿Qué programas de reforzamiento son óptimos para diferentes tareas caninas?
- ¿Cuánto difieren perros individuales en sensibilidad a ratio e intervalo?
- ¿Qué programas generan mayor persistencia sin frustración?
- ¿Cómo medir ratio strain en perros?
- ¿Qué papel tiene saciedad en rendimiento?
- ¿Cómo cambia valor de comida ante distractores?
- ¿Cómo comparar juego, alimento, elogio y acceso ambiental?
- ¿Qué reforzadores sociales funcionan de manera fiable?
- ¿Cómo cambia eficacia reforzante con edad?
- ¿Cómo afecta dolor?
- ¿Qué razas/clados muestran diferencias replicables?
- ¿Cómo separar genética de historia de entrenamiento?
- ¿Qué timing es óptimo según tarea?
- ¿Cómo afecta un marcador a retraso de reforzador?
- ¿Cuánto puede “puentear” un clicker la demora?
- ¿Qué combinaciones de shaping producen aprendizaje más rápido?
- ¿Cuándo shaping genera frustración?
- ¿Qué criterios de progresión son óptimos?
- ¿Cómo medir operaciones motivacionales en ambiente real?
- ¿Qué efectos tiene NCR en problemas de comportamiento?
- ¿Cuándo es preferible NCR frente a DRA?
- ¿Cómo interactúa extinción con Pavloviano?
- ¿Qué produce recuperación de conductas operantes?
- ¿Cómo influye contexto en extinción?
- ¿Cómo afectan programas variables a recaída?
- ¿Qué diferencia existe entre entrenamiento de compañía y trabajo?
- ¿Cómo optimizar perros de detección cuando blancos son raros?
- ¿Cómo reforzar cadenas largas?
- ¿Cómo influyen señales accidentales humanas?
- ¿Qué consecuencias ambientales refuerzan reactividad?
- ¿Cómo medir conducta sin depender de informes del dueño?
- ¿Cómo comparar eficacia y bienestar simultáneamente?
- ¿Qué efectos colaterales específicos produce cada procedimiento aversivo?
- ¿Qué intensidad convierte una contingencia en clínicamente problemática?
- ¿Qué papel tiene predictibilidad?
- ¿Qué papel tiene control?
- ¿Cómo afecta elección voluntaria?
- ¿Qué procedimientos reducen necesidad de castigo?
- ¿Cómo enseñar análisis funcional a responsables sin simplificarlo?
- ¿Qué términos deberían estandarizarse en entrenamiento canino?
18. Referencias
Bentosela, M., Barrera, G., Jakovcevic, A., Elgier, A. M., & Mustaca, A. E. (2008). Effect of reinforcement, reinforcer omission and extinction on a communicative response in domestic dogs (Canis familiaris). Behavioural Processes, 78(3), 464–469. https://doi.org/10.1016/j.beproc.2008.03.004
Ferster, C. B., & Skinner, B. F. (1957). Schedules of reinforcement. Appleton-Century-Crofts.
Guilherme-Fernandes, J., Olsson, I. A. S., & Vieira de Castro, A. C. (2017). Do aversive-based training methods actually compromise dog welfare? A literature review. Applied Animal Behaviour Science, 196, 1–12. https://doi.org/10.1016/j.applanim.2017.07.001
Hall, N. J. (2017). Persistence and resistance to extinction in the domestic dog: Basic research and applications to canine training. Behavioural Processes, 141(Part 1), 67–74. https://doi.org/10.1016/j.beproc.2017.04.001
Hall, N. J., Johnston, A. M., Bray, E. E., Otto, C. M., MacLean, E. L., Udell, M. A. R., & Wynne, C. D. L. (2021). Working dog training for the twenty-first century. Frontiers in Veterinary Science, 8, 646022. https://doi.org/10.3389/fvets.2021.646022
Herron, M. E., Shofer, F. S., & Reisner, I. R. (2009). Survey of the use and outcome of confrontational and non-confrontational training methods in client-owned dogs showing undesired behaviors. Applied Animal Behaviour Science, 117(1–2), 47–54. https://doi.org/10.1016/j.applanim.2008.12.011
Hiby, E. F., Rooney, N. J., & Bradshaw, J. W. S. (2004). Dog training methods: Their use, effectiveness and interaction with behaviour and welfare. Animal Welfare, 13(1), 63–69. https://doi.org/10.1017/S0962728600026683
Johnson, A. C., & Wynne, C. D. L. (2024). Comparison of the efficacy and welfare of different training methods in stopping chasing behavior in dogs. Animals, 14(18), 2632. https://doi.org/10.3390/ani14182632
Pfaller-Sadovsky, N., Arnott, G., & Hurtado-Parrado, C. (2022). The effects of noncontingent reinforcement on an arbitrary response in companion dogs. Journal of the Experimental Analysis of Behavior. https://pubmed.ncbi.nlm.nih.gov/36283576/
Reisner, I. (2017). The learning dog: A discussion of training methods. In J. Serpell (Ed.), The domestic dog: Its evolution, behavior and interactions with people (2nd ed., pp. 210–226). Cambridge University Press. https://doi.org/10.1017/9781139161800.011
Riemer, S., Ellis, S. L. H., Thompson, H., & Burman, O. H. P. (2018). Reinforcer effectiveness in dogs—The influence of quantity and quality. Applied Animal Behaviour Science, 206, 87–93. https://doi.org/10.1016/j.applanim.2018.05.016
Rooney, N. J., & Cowan, S. (2011). Training methods and owner–dog interactions: Links with dog behaviour and learning ability. Applied Animal Behaviour Science, 132(3–4), 169–177. https://doi.org/10.1016/j.applanim.2011.03.007
Skinner, B. F. (1937). Two types of conditioned reflex: A reply to Konorski and Miller. The Journal of General Psychology, 16(1), 272–279.
Skinner, B. F. (1938). The behavior of organisms: An experimental analysis. Appleton-Century.
Skinner, B. F. (1953). Science and human behavior. Macmillan.
Thorndike, E. L. (1898). Animal intelligence: An experimental study of the associative processes in animals. Psychological Review Monograph Supplements, 2(4). https://doi.org/10.1037/10780-000
Thrailkill, E. A., Kacelnik, A., Porritt, F., & Bouton, M. E. (2016). Increasing the persistence of a heterogeneous behavior chain: Studies of extinction in a rat model and a working dog model. Behavioural Processes, 129, 74–85. https://doi.org/10.1016/j.beproc.2016.06.006
Vicars, S. M., Miguel, C. F., & Sobie, J. L. (2014). Assessing preference and reinforcer effectiveness in dogs. Behavioural Processes, 103, 75–83. https://doi.org/10.1016/j.beproc.2013.11.006
Vieira de Castro, A. C., Araújo, Â., Fonseca, A., & Olsson, I. A. S. (2021). Improving dog training methods: Efficacy and efficiency of reward and mixed training methods. PLOS ONE, 16(2), e0247321. https://doi.org/10.1371/journal.pone.0247321
Vieira de Castro, A. C., Fuchs, D., Morello, G. M., Pastur, S., de Sousa, L., & Olsson, I. A. S. (2020). Does training method matter? Evidence for the negative impact of aversive-based methods on companion dog welfare. PLOS ONE, 15(12), e0225023. https://doi.org/10.1371/journal.pone.0225023
Yamamoto, M., Kikusui, T., & Ohta, M. (2009). Influence of delayed timing of owners’ actions on the behaviors of their dogs, Canis familiaris. Journal of Veterinary Behavior, 4(1), 11–18. https://doi.org/10.1016/j.jveb.2008.08.006
Ziv, G. (2017). The effects of using aversive training methods in dogs—A review. Journal of Veterinary Behavior, 19, 50–60. https://doi.org/10.1016/j.jveb.2017.02.004
Nota para el futuro redactor
El artículo debe evitar dos errores opuestos.
Error 1:
convertir condicionamiento operante en una tabla memorizada de cuatro cuadrantes.
Error 2:
hablar de “premios y correcciones” sin precisión funcional.
La progresión recomendada es:
conducta
↓
consecuencia
↓
¿la conducta aumenta o disminuye?
↓
¿la consecuencia se presentó o se retiró?
Entonces:
aumenta + se presenta
→ R+
aumenta + se retira
→ R−
disminuye + se presenta
→ P+
disminuye + se retira
→ P−.
Pero inmediatamente después debe añadirse:
La tabla sólo clasifica consecuencias. No explica por sí sola por qué el perro hace algo.
Para explicar una conducta real también necesitamos:
- antecedentes;
- contexto;
- motivación;
- emoción;
- historial;
- reforzadores competidores;
- programas;
- generalización;
- bienestar.
La idea final que debería conservar el lector es:
No entrenamos con “premios” o “castigos” como objetos. Entrenamos modificando contingencias: qué conducta tiene qué consecuencia, cuándo, con qué valor y en qué contexto.
