El diablo viste de Prada vista desde el conductismo
¿Por qué una recién licenciada en Periodismo, que se ríe de la moda el primer día, acaba anticipándose a cada deseo de su jefa, vistiendo de diseño y contestando el móvil a cualquier hora? El diablo viste de Prada (Frankel, 2006) suele verse como una comedia sobre moda y jefas imposibles. Si la miramos con las gafas del conductismo, es algo más: la historia de cómo los premios y los castigos transforman a una persona.
1. El condicionamiento en la película
Del punto de partida a la meta. Al comienzo, Andy llega a Runway con ropa sencilla, sin ningún interés por la moda, cuestionando las decisiones estéticas de Miranda y sin someterse a sus reglas. Ese es su nivel operante básico. Al final es otra: una asistente que se anticipa a las necesidades de Miranda, viste según los códigos de la revista y está disponible a cualquier hora. Esa es su conducta terminal. El cambio no nace de una motivación intrínseca, sino de la necesidad de evitar los estímulos aversivos de su jefa (reprimendas, desprecio en público, la amenaza sobre su futuro profesional) y de obtener sus escasos reforzadores (su aprobación, el viaje a París).
Moldeamiento. Miranda refuerza las respuestas de Andy que se parecen a la conducta terminal y le va encargando tareas cada vez más exigentes, hasta que Andy llega a asumir algunas de las que correspondían a Emily, la primera asistente.
Condicionamiento clásico: «¡Ya viene!». Al principio, la llamada que avisa de que Miranda está de camino era un estímulo neutro (EN). Sin embargo, precedía sistemáticamente a estímulos que funcionaban como incondicionados (EI): reproches, ataques verbales y exigencias desmesuradas, que provocaban una respuesta incondicionada (RI) de estrés, hipervigilancia y temor. Cuantas más veces se repite ese emparejamiento, más se afianza la asociación, en línea con la ley de la frecuencia de Watson (Universidad Internacional de La Rioja [UNIR], s. f.). Así, el aviso se convierte en un estímulo condicionado (EC): basta con oírlo para que la redacción entera reaccione con estrés (respuesta condicionada, RC), aunque Miranda aún no haya cruzado la puerta. Es el esquema de Pavlov en una oficina de Manhattan.
Condicionamiento operante: castigos.
• Positivos (se añade algo aversivo tras la conducta). Son los que más emplea Miranda cuando Andy hace algo que no le gusta: el escrutinio visual despectivo cuando viste de forma sencilla, la ridiculización pública de su desdén por la moda en el monólogo del jersey cerúleo o la dura reprimenda cuando no consigue sacarla de Miami en pleno huracán.
• Negativos (se retira algo agradable). Proceden del entorno de Andy: su novio, Nate, y sus amigos le van retirando afecto, compañía y apoyo ante su disponibilidad constante para Runway, hasta que Nate rompe con ella. Técnicamente, sin embargo, no llega a ser un castigo, porque no reduce su dedicación a la revista, y el castigo se define por su efecto sobre la conducta. Compite con las consecuencias que administra Runway: en ese momento, el valor de sobrevivir y triunfar en la revista supera al de perder a su pareja y a sus amigos, y Andy mantiene esa conducta hasta París.
Condicionamiento operante: reforzadores.
• Positivos (se añade algo agradable). Al principio, los aciertos de Andy no reciben ninguna consecuencia. Con el tiempo, Miranda empieza a administrar reforzadores: su aprobación o la elección de Andy para el viaje a París en lugar de Emily, después de que Andy la salve en una gala benéfica soplándole el nombre de un invitado. A ello se suman reforzadores de alto valor social y profesional por formar parte de Runway: ropa exclusiva, viajes, estatus y proyección profesional.
• Negativos (se retira o se evita algo aversivo). Los reproches, el sarcasmo y las humillaciones públicas de Miranda generan mucha ansiedad, y cualquier conducta que permita librarse de ellos queda reforzada negativamente.
El patrón de evitación. Cuando Andy hace las tareas de forma impecable, se libra del desprecio y de las reprimendas, y ese alivio fortalece su sumisión y su diligencia. La teoría bifactorial de Mowrer lo explica: el miedo se adquiere por condicionamiento clásico, y las conductas de evitación se mantienen porque lo reducen (Mowrer, citado en Krypotos et al., 2015).
Aprender mirando a Emily. No todo lo aprende Andy en carne propia. También interviene el aprendizaje observacional o vicario descrito por Albert Bandura (Rodríguez-Rey y Cantero-García, 2020). Emily actúa como modelo en un modelado in vivo y pasivo: Andy la observa en persona y después ejecuta la conducta (Ruiz et al., 2012, citado en UNIR, s. f.). Al ver las consecuencias que reciben las conductas de Emily (refuerzo vicario), aprende qué funciona sin tener que pasar por el ensayo y error (UNIR, s. f.).
2. ¿Qué busca Miranda?
Miranda persigue un objetivo muy claro: una asistente que se anticipe a sus necesidades, esté disponible a cualquier hora y no falle nunca. Para lograrlo recurre, sobre todo, al castigo. El efecto en Andy es enorme: se vuelve cada vez más rápida, más resolutiva y más parecida a su jefa. A mitad de la historia ya cumple encargos casi imposibles, como conseguir el manuscrito inédito de Harry Potter para las gemelas de Miranda, y termina alcanzando la conducta terminal.
Pero el desenlace muestra los límites del castigo, algo que el propio Thorndike acabó reconociendo al concluir que no era tan eficaz para debilitar respuestas como había supuesto (UNIR, s. f.). Cuando en París Andy toma conciencia de que está actuando contra sus valores, abandona Runway.
3. El programa de reforzamiento
Puede considerarse un programa de reforzamiento intermitente de razón variable: la mayoría de los aciertos de Andy no reciben ninguna consecuencia y solo algunos, tras un número imprevisible, obtienen la aprobación de Miranda. Pérez Álvarez (2021) señala que los programas variables vuelven ciertas conductas casi irresistibles, y eso ayuda a entender por qué Andy persiste en busca de aprobación y estatus aunque le sobren motivos para irse. A ello se suma un castigo prácticamente continuo, porque cada error se paga caro. Con ese programa se encuentran el moldeamiento, el castigo, el reforzamiento y el aprendizaje vicario.
4. ¿Y en la vida real?
Redes sociales. Cuando publicamos algo, no sabemos cuántos «me gusta» recibiremos, y esa incertidumbre nos mantiene publicando y revisando el móvil. Pérez Álvarez (2021) describe los «me gusta» como la versión digital de los reforzadores de la caja de Skinner. Lindström et al. (2021) lo pusieron a prueba con más de un millón de publicaciones de más de 4000 personas y comprobaron que la conducta en redes se ajusta a los principios del aprendizaje por recompensa.
Trabajo. Todavía hay jefes que solo señalan los errores y reconocen el esfuerzo de tarde en tarde. Esa aprobación imprevisible puede generar mucha implicación a corto plazo, pero, a la larga, desgaste. En otros casos, la empresa refuerza con beneficios y estatus hasta crear un vínculo que lleva a descuidar la vida personal, como le ocurre a Andy.
Educación y crianza. Cuando un niño o un alumno aprende algo nuevo, reforzar cada pequeño avance, es decir, moldear con un refuerzo positivo más continuo, facilita su progreso. Limitarse a castigar los fallos, en cambio, tiende a generar miedo a equivocarse y conductas de evitación, como predice la teoría bifactorial (Mowrer, citado en Krypotos et al., 2015).
La próxima vez que veas a Andy correr con un café en la mano, piensa en la caja de Skinner. Y la próxima vez que mires el móvil para ver cuántos «me gusta» tienes, también.
Referencias
Frankel, D. (Director). (2006). The devil wears Prada [El diablo viste de Prada] [Película]. Fox 2000 Pictures.
Krypotos, A.-M., Effting, M., Kindt, M. y Beckers, T. (2015). Avoidance learning: A review of theoretical models and recent developments. Frontiers in Behavioral Neuroscience, 9, Artículo 189. https://doi.org/10.3389/fnbeh.2015.00189
Lindström, B., Bellander, M., Schultner, D. T., Chang, A., Tobler, P. N. y Amodio, D. M. (2021). A computational reward learning account of social media engagement. Nature Communications, 12, Artículo 1311. https://doi.org/10.1038/s41467-020-19607-x
Pérez Álvarez, M. (2021). ¿Qué nos importa Skinner, treinta años después? Papeles del Psicólogo, 42(1), 10–20. https://doi.org/10.23923/pap.psicol2020.2940
Rodríguez-Rey, R. y Cantero-García, M. (2020). Albert Bandura: Impacto en la educación de la teoría cognitiva social del aprendizaje. Padres y Maestros / Journal of Parents and Teachers, (384), 72–76. https://doi.org/10.14422/pym.i384.y2020.011
Universidad Internacional de La Rioja. (s. f.). Tema 1. Aprendizaje y pensamiento [Material de la asignatura Aprendizaje Humano y Pensamiento]. UNIR.
