ArtículosMensajes

¿Cómo saber si un mensaje de texto es sarcástico?

Solo a partir de las palabras, por lo general no puedes saberlo. Frases irónicas y literales presentadas como texto sin contexto se calificaron de forma idéntica. El cerebro procesa un guiño emoji igual que una palabra irónica. Y nadie ha medido qué tan seguido la gente que agrega una etiqueta de sarcasmo en realidad estaba siendo sarcástica.

Por Samet Durgun · Cofundador de Subtext · 10 min de lectura

“Genial, gracias por eso.” Llevas un rato mirándolo, y podría ser un agradecimiento sincero o podría ser justo lo contrario, y la diferencia importa. Cofundé Subtext, y los mensajes que se pueden leer de las dos formas son la categoría más grande de lo que la gente nos manda.

La investigación al respecto es más contundente de lo que esperarías. Solo a partir de las palabras, sin contexto y sin marcadores, por lo general no puedes distinguirlo, y el experimento que lo demuestra tiene treinta años. Lo que restablece la diferencia es el contexto, la historia compartida y un pequeño conjunto de marcadores que la gente usa con una consistencia sorprendente. Saber cuál de esos elementos tienes frente a ti es la mayor parte de la respuesta.

El experimento que explica el problema

Bryant y Fox Tree tomaron enunciados de discurso espontáneo, algunos originalmente irónicos y otros no, y los presentaron solo como texto, sin audio y sin contexto1. Los lectores los calificaron como igual de irónicos. Agregar el audio, o agregar el contexto, restableció la distinción.

Ese es el mecanismo detrás de todos los demás hallazgos de este artículo. El sarcasmo en el habla lleva señales acústicas, sobre todo un tono promedio más bajo, menor variación de tono y cambios en la calidad de la voz2. El texto las elimina. Lo que queda tiene que venir de algún otro lado.

Debo apuntar que los mismos autores después argumentaron que no existe un único tono de voz irónico dedicado, y que las señales acústicas varían entre idiomas3. Así que incluso en el habla la señal es menos confiable de lo que sugiere la intuición.

Qué tan mal le va a la gente, con los números bien identificados

Kruger, Epley, Parker y Ng hicieron cinco experimentos sobre el tono en el correo electrónico, y la gente cita el artículo con cifras que casi nunca dicen de qué estudio vienen4.

En el primero, doce estudiantes en seis parejas mandaron frases serias y sarcásticas. Quienes las enviaron predijeron que sus lectores descifrarían correctamente el 97 por ciento; quienes las leyeron lograron 84. En el segundo, los lectores de correo detectaron el sarcasmo a una tasa que los autores describen como indistinguible del azar, mientras que las personas que escuchaban las frases de su pareja leídas en voz alta acertaron aproximadamente tres cuartas partes. Quienes enviaron esperaban que sus lectores descifraran alrededor del 78 por ciento de las frases, sin importar el canal que usaran, y quienes leyeron tenían una confianza de alrededor del 90 por ciento en haber entendido bien cada frase: 89 por ciento por correo y 91 por ciento por voz.

Vas a ver el segundo estudio citado como 78 por ciento predicho contra 56 logrado. Las dos cifras sí vienen impresas en la propia Figura 1 del artículo: quienes enviaron predijeron 78.0 por ciento y quienes leyeron los correos lograron 56.0. Pero salen de 29 parejas que juzgaban si frases cortas eran sarcásticas o serias, así que no son una tasa general para leer el tono y yo no las citaría como tales.

Dos cosas que vale la pena recordar. Las muestras son grupos pequeños de estudiantes universitarios de mediados de los 2000, y nadie ha replicado directamente el artículo con alto poder estadístico. Y el mecanismo es el egocentrismo. Quien envía el mensaje escucha el tono sarcástico en su cabeza mientras escribe y no logra quitárselo de la cabeza. Escribí sobre eso por separado en ¿este mensaje suena grosero?.

Y hay un vacío que, en mi opinión, nadie ha llenado. Ningún estudio publicado con personas da una cifra limpia de precisión para el sarcasmo escrito con contexto conversacional, comparable con la cifra a nivel de azar que existe sin él. En ese hueco la gente cita puntajes de clasificadores automáticos, y esos miden algo distinto, algo en lo que entro en lo que la IA puede y no puede decir sobre el tono de un mensaje.

Los marcadores que la gente usa

Thompson y Filik hicieron el estudio de referencia, y las cifras son más específicas de lo que sugiere la mayoría de los resúmenes5.

Los emoticones aparecieron en el 88 por ciento de los comentarios sarcásticos contra el 51 por ciento de los literales. El guiño y la carita con la lengua de fuera fueron los marcadores principales de intención sarcástica, reservados casi por completo para el uso no literal. La sonrisa simple mostró el patrón contrario: apareció en el 81 por ciento de los elogios literales y casi nunca en otro lado.

El hallazgo contraintuitivo tiene que ver con los puntos suspensivos, que se asociaron con la crítica, el sentimiento negativo y la pausa, no con el sarcasmo como tal. Si lees tres puntos como sarcasmo, el corpus dice que los estás malinterpretando.

No hubo ningún efecto de género en el uso de emoticones ni en cuáles elegía la gente, lo cual refuta una afirmación anterior según la cual los hombres los usan para marcar sarcasmo mientras las mujeres los usan para marcar emoción.

La evidencia neuronal es la parte más sorprendente. Weissman y Tanner encontraron que un emoji de guiño irónico producía las mismas firmas cerebrales que se encuentran para la ironía verbal, y el tamaño de la respuesta variaba según qué tanto cada participante trataba ese emoji como irónico6. El cerebro procesa un emoji irónico como una palabra irónica, no como decoración.

El efecto se replica entre laboratorios. Un estudio encontró que los lectores mayores usaban menos el guiño; uno posterior encontró que el emoji ayudaba por igual a ambos grupos de edad, y atribuyó la diferencia a si las frases base eran ambiguas78. Así que la historia sobre la edad depende de los materiales usados, y yo no me quedaría con un solo resultado.

El sarcasmo también le hace algo al mensaje que transmite. Filik y sus colegas encontraron que los participantes calificaron la crítica sarcástica como menos negativa que la crítica literal, y el elogio sarcástico como menos positivo que el elogio literal9. Amortigua en ambas direcciones, y un estudio complementario que midió la actividad de los músculos faciales encontró el mismo patrón a nivel fisiológico.

Esto es más o menos lo que revisa Subtext cuando lee un mensaje con doble lectura: si los marcadores están presentes, si las palabras sostienen las dos interpretaciones y qué tan alejadas están entre sí. Te va a decir que un mensaje es ambiguo. No te va a decir cuál interpretación quiso dar quien lo envió, porque nada puede saberlo solo a partir de las palabras, y la investigación de arriba explica por qué.

Por qué el contexto es la clave

Hay tres corrientes teóricas, y no coinciden entre sí. Una sostiene que la ironía hace eco de una expectativa previa y señala distancia respecto a ella, así que si no puedes identificar de qué hace eco, la lectura irónica se cae10. Otra sostiene que quien hace la ironía finge ser alguien poco sensato y se espera que la audiencia lo note. Una tercera pondera en paralelo el contenido literal, el contexto, lo que sabes sobre el autor y cualquier marcador presente, y predice que cuando el contexto es débil, los marcadores pesan de forma desproporcionada, razón por la cual un solo guiño puede voltear una frase neutral.

Mi lectura es que el respaldo empírico para la afirmación sobre el contexto es más débil de lo que sugiere el tono seguro de la mayoría de los artículos. La manipulación experimental directa del contexto compartido en la ironía escrita es escasa. Lo que sí existe es consistente. En un estudio pequeño, las personas no percibieron los enunciados como irónicos sin algo previo que citar, y el trabajo con corpus muestra que la gente usa menos ironía y la marca más cuando se dirige a audiencias desconocidas.

En la práctica, el sarcasmo es una apuesta a que quien lee comparte contigo lo suficiente como para ver la brecha entre lo que dijiste y lo que quisiste decir. En una conversación con alguien que conoces, esa apuesta suele salir bien, que es buena parte de lo que significa un mensaje desde un inicio. Con un desconocido, o cruzando una línea cultural, las palabras cargan con todo el peso solas, y por lo general no alcanza.

Quién lo lee de forma distinta

Los lectores autistas, con cuidado. Las diferencias grupales en la comprensión de la ironía son reales en algunos estudios, pequeñas o ausentes en otros, y se reducen sustancialmente una vez que los investigadores controlan la habilidad verbal y el formato de la tarea. Un metaanálisis reportó un efecto general de alrededor de g = -0.57, que se reducía o dejaba de ser significativo cuando los investigadores emparejaban a los grupos por habilidad lingüística básica11. Un estudio encontró tasas de error bajas y casi idénticas entre niños autistas y no autistas en tareas estructuradas, con una brecha que aparecía solo cuando la tarea exigía explicar de forma espontánea por qué alguien había sido sarcástico. Buena parte de la brecha aparente es un artefacto de cómo los investigadores plantean la pregunta.

Dos hallazgos más van por completo en contra del enfoque de déficit. La alexitimia, la dificultad para identificar las propias emociones, se presenta en alrededor del 50 por ciento de los grupos autistas contra el 5 por ciento de los no autistas, y predice mejor el desempeño en reconocimiento de emociones que el hecho de ser autista12. Y el trabajo sobre la doble empatía encontró que la información se degradaba más rápido en cadenas mixtas de personas autistas y no autistas que en cadenas de un solo tipo, lo cual replantea la pregunta de “¿pueden las personas autistas detectar el sarcasmo?” a “¿quién le está fallando a quién en la comunicación?”13.

Porque los artículos sobre este tema suelen asumir lo contrario, quiero agregar que para muchos adultos autistas el texto es el canal preferido. Una encuesta con 245 adultos autistas encontró que el correo electrónico y los mensajes de texto se calificaron muy bien en muchos escenarios, y que las llamadas telefónicas quedaron como la peor opción14.

Género. El estereotipo se sostiene, pero la diferencia en comprensión no. La gente califica los mismos comentarios como más sarcásticos cuando se atribuyen a un hombre, y juzga más probable que quien habla con sarcasmo sea hombre. Pero los estudios de comprensión con opción forzada no encontraron una diferencia de género confiable, y tampoco la encontró el estudio de emoticones.

Edad. Hay cierta disminución en la detección espontánea del sarcasmo entre adultos mayores, y los marcadores explícitos reducen esa brecha.

Cuándo sale mal

El marco de Byron propone dos sesgos en cómo las personas leen la emoción en un texto: leen los mensajes con intención positiva como planos, y los ambiguos como más negativos de lo que se pretendía15. Eso es un modelo teórico, no datos, pero su combinación explica una falla conocida. Un cumplido irónico que no se capta suele aterrizar como pasivo-agresivo en vez de como confusión neutral.

La reparación es posible y la gente la intenta seguido. En un corpus de 3,750 interacciones de Reddit, las iniciativas de reparación, es decir, alguien señalando que no captó la intención, ocurrieron en cerca del 58 por ciento de las interacciones16. Aproximadamente el 45 por ciento de esas iniciativas no obtuvo respuesta y quedó sin resolver. Cara a cara, la reparación casi siempre se logra. En línea se intenta y luego se abandona casi la mitad de las veces. Lo cual es un buen argumento para revisar antes de mandar en vez de reparar después, y es justo el argumento sobre el que construimos Subtext.

Así que me quedo con la respuesta aburrida, que es preguntar si no puedes saberlo y contestar si alguien te pregunta.

La etiqueta de sarcasmo

Aquí hay dos cuerpos de literatura distintos, y la gente los mezcla.

El computacional usa “/s” como etiqueta. Khodak, Saunshi y Vodrahalli construyeron así un corpus de 1.3 millones de enunciados17. Después, un grupo revisó manualmente 4,334 tuits y encontró que solo el 14.89 por ciento de los mensajes en la categoría etiquetada como sarcasmo eran en realidad sarcásticos18. La gente olvida la etiqueta, la usa de forma inconsistente o la usa de manera irónica. Un marcador no es una verdad de referencia limpia.

El humano está casi vacío. La gente agrega indicadores de tono como /s, /j y /gen para declarar la intención, y la popularización moderna de esos indicadores suele rastrearse hasta comunidades en línea neurodivergentes. Hay abundante material descriptivo y de activismo, y muy poco trabajo revisado por pares que ponga a prueba si de verdad mejoran la comprensión o si irritan a quien lee. El debate entre quienes dicen que las etiquetas evitan malas lecturas y quienes dicen que las etiquetas destruyen el sentido de la ironía es un debate, no un conjunto de hallazgos.

Qué hacer con el mensaje que tienes enfrente

Primero busca los marcadores, porque el guiño y la lengua de fuera son lo más parecido a una señal confiable que existe. Revisa cuánta historia tienes con quien te escribió, porque de eso depende la apuesta. Lee los tres puntos como pausa o crítica y no como sarcasmo, porque eso es lo que muestra el corpus.

Si todavía se puede leer de las dos formas, se puede leer de las dos formas, y quien lo escribió casi seguro no lo sabe. La evidencia dice que está mucho más seguro de que el mensaje llegó como quería de lo que debería estarlo.

Prueba Subtext en tu navegadorPrueba Subtext en tu navegador

Fuentes

Numeradas en el orden en que aparecen arriba. Cuando una cifra no se pudo verificar contra la fuente primaria, el texto lo indica.

  1. Bryant, G. A., and Fox Tree, J. E. (2002). Recognizing verbal irony in spontaneous speech. Metaphor and Symbol, 17(2), 99 a 119.
  2. Cheang, H. S., and Pell, M. D. (2008). The sound of sarcasm. Speech Communication, 50(5), 366 a 381.
  3. Bryant, G. A., and Fox Tree, J. E. (2005). Is there an ironic tone of voice? Language and Speech, 48(3), 257 a 277. Véase también Cheang and Pell (2009), Journal of the Acoustical Society of America, 126(3), sobre diferencias entre idiomas.
  4. Kruger, J., Epley, N., Parker, J., and Ng, Z.-W. (2005). Egocentrism over e-mail. Journal of Personality and Social Psychology, 89(6), 925 a 936. Estudio 1: seis parejas, 97 contra 84. Estudio 2: 29 parejas analizadas, nivel de azar contra aproximadamente tres cuartas partes. El par 78 contra 56 corresponde a la condición de correo, predicho contra logrado, tal como aparece impreso en la Figura 1 del artículo. Nunca se ha replicado directamente con alto poder estadístico.
  5. Thompson, D., and Filik, R. (2016). Sarcasm in Written Communication: Emoticons are Efficient Markers of Intention. Journal of Computer-Mediated Communication, 21(2), 105 a 120. Experimento 1, n = 51; experimento 2, n = 113; base de datos de participantes de Glasgow, sin restringirse a estudiantes. Financiado por la beca ESRC ES/L000121/1.
  6. Weissman, B., and Tanner, D. (2018). A strong wink between verbal and emoji-based irony. PLOS ONE, 13(8), e0201727. Tres experimentos de potenciales evocados (ERP).
  7. Howman, H. E., and Filik, R. (2020). The role of emoticons in sarcasm comprehension in younger and older adults. Quarterly Journal of Experimental Psychology. Seguimiento ocular (eye-tracking), lectores de 18 a 30 años y de 65 en adelante.
  8. Garcia, C., Turcan, A., Howman, H., and Filik, R. (2022). Emoji as a tool to aid the comprehension of written sarcasm. Computers in Human Behavior, 126, 106971.
  9. Filik, R., Turcan, A., Thompson, D., Harvey, N., Davies, H., and Turner, A. (2016). Sarcasm and emoticons: Comprehension and emotional impact. Quarterly Journal of Experimental Psychology, 69(11), 2130 a 2146. Estudio fisiológico complementario en Psychophysiology, PMC4999054.
  10. Sperber, D., and Wilson, D. (1981). Irony and the use-mention distinction. En Cole (ed.), Radical Pragmatics. Junto con Clark and Gerrig (1984) sobre el simulacro y Kreuz and Glucksberg (1989) sobre el recordatorio ecoico, todos en Journal of Experimental Psychology: General, 113 y 118.
  11. Kalandadze, T., and colleagues (2018). Figurative language comprehension in individuals with autism spectrum disorder: A meta-analytic review. Autism, 22(2), 99 a 117. Tamaño del efecto reportado en una fuente secundaria, no confirmado de forma independiente.
  12. Kinnaird, E., Stewart, C., and Tchanturia, K. (2019). Investigating alexithymia in autism: A systematic review and meta-analysis. European Psychiatry, 55, 80 a 89. Quince estudios; 49.93 por ciento contra 4.89 por ciento.
  13. Crompton, C. J., Ropar, D., Evans-Williams, C. V. M., Flynn, E. G., and Fletcher-Watson, S. (2020). Autistic peer-to-peer information transfer is highly effective. Autism, 24(7), 1704 a 1712. Setenta y dos participantes.
  14. Howard, P. L., and Sedgewick, F. (2021). Anything but the phone. Autism, 25(8), 2265 a 2278. Encuesta con 245 adultos autistas.
  15. Byron, K. (2008). Carrying too heavy a load? Academy of Management Review, 33(2), 309 a 327. Un marco teórico, no un estudio empírico.
  16. Goddard, S., and Gillespie, A. (2025). Conversational repairs on Reddit. PLOS ONE, 20(1), e0316618. Veinticinco subreddits, 3,750 interacciones.
  17. Khodak, M., Saunshi, N., and Vodrahalli, K. (2018). A Large Self-Annotated Corpus for Sarcasm. LREC 2018. Ponencia de congreso; las etiquetas son autoanotaciones.
  18. Sykora, M., Elayan, S., and Jackson, T. W. (2020). A qualitative analysis of sarcasm, irony and related #hashtags on Twitter. Big Data and Society, 7(2). 4,334 tuits anotados manualmente.