En un avance que potencialmente podría salvar matrimonios, amistades e innumerables malentendidos, los científicos dicen que han creado una herramienta de detección de sarcasmo impulsada por IA. Un grupo de investigadores de la Universidad de Groningen en los Países Bajos afirman haber desarrollado un sistema de IA que puede detectar ya sea que esté siendo sincero y serio, o desplegando un ingenio astuto y humorístico. Su trabajo fue presentado hoy en una reunión de la Sociedad de Acústica de América en Ottawa y combina análisis de texto y voz. El equipo está dirigido por la estudiante de posgrado Xiyuan Gao, quien ha estado «afrontando el desafío del lenguaje figurativo» como parte de su investigación académica. Gao no respondió de inmediato a una solicitud de comentarios de Decrypt. Un artículo de investigación describe el enfoque del equipo para Detección de sarcasmo. Primero, entrenaron una red neuronal con datos multimodales (clips de audio, texto transcrito y contenido emocional anotado) de escenas cargadas de sarcasmo en comedias como “Friends” y “The Big Bang Theory” obtenidas de la base de datos MUStARD. Luego desarrollaron un algoritmo para mapear señales emocionales del audio y el texto, y asignaron emoticones apropiados basándose en el análisis de sentimientos. Esto hizo que la IA fuera más poderosa para detectar sarcasmo basándose en un enfoque multifacético, superando a otras herramientas que se basan únicamente en cambios de tono de voz y texto. «Nuestra metodología aprovecha las fortalezas de cada modalidad: los algoritmos de reconocimiento de emociones analizan los datos de audio en busca de señales afectivas , mientras que el análisis de sentimientos procesa el texto», explica el artículo de investigación. «La integración de estas modalidades tiene como objetivo compensar las limitaciones en la percepción del tono». La IA detectó sarcasmo en nuevas escenas de comedias con alrededor del 75% de precisión. Los investigadores admiten, sin embargo, que los humanos todavía superan a las máquinas en esta prueba de percepción particular. «Cuando empiezas a estudiar el sarcasmo, te vuelves muy consciente de hasta qué punto lo utilizamos como parte de nuestro modo normal de comunicación», Matt Coler, Otro investigador que trabaja en el proyecto dijo a The Guardian: «Tenemos que hablar con nuestros dispositivos de una manera muy literal, como si estuviéramos hablando con un robot, porque lo somos». «, agregó. Esta herramienta de detección de sarcasmo es solo el último intento de encontrar el sentimiento o significado oculto en el lenguaje humano, y se está volviendo cada vez más importante a medida que la adopción explosiva de los chatbots de IA significa millones de conversaciones diarias con grandes modelos de lenguaje (LLM). Por ejemplo, Hume AI dice que desarrolló un sistema de inteligencia artificial para detectar diferentes inflexiones en la voz para identificar una variedad de emociones, no solo un cambio de tono o estado de ánimo.Hume está diseñado para comprender y responder a las emociones humanas de una manera más matizada y empática, haciendo que las interacciones con la IA sean más naturales y atractivas, explica la compañía. Mientras tanto, un equipo de la Universidad de Ciencias Aplicadas Haaga-Helia y la Universidad de Oulu en Finlandia publicó un artículo de investigación el mes pasado que explora técnicas sin contacto en el reconocimiento de emociones multimodal. El equipo descubrió de manera similar que la forma más precisa de analizar las emociones es fusionando señales visuales, de audio y de texto. Sin embargo, enfatizaron que este tipo de comprensión todavía está limitada por variables culturales, sesgos inherentes al modelo, malas interpretaciones y la falta de comprensión del contexto pasado.
Otros investigadores han intentado analizar el uso de emojis para detectar adecuadamente el estado emocional de las personas que los utilizan. Después de todo, un mensaje de texto seguido de un emoji de cara guiñando un ojo puede tener un significado muy diferente a uno sin la ilustración o con un emoji diferente.
Si bien la capacidad de adaptarse a matices más ricos en las conversaciones ayudará a los chatbots de IA a responder mejor a las indicaciones de los humanos, podría tener implicaciones de gran alcance para la sociedad en general. Además de detectar tonos negativos no escritos en el lenguaje o identificar discursos de odio, también podría suavizar las relaciones interpersonales, brindando mayor claridad en momentos de confusión, especialmente para personas que se comunican entre idiomas o con condiciones neurodivergentes. Editado por Ryan Ozawa.
Boletín Generalmente Inteligente
Un viaje semanal de IA narrado por Gen, un modelo de IA generativa.

















