
Un visema es cualquiera de varios sonidos del habla que se ven iguales, por ejemplo, cuando se lee de labios . [ 1 ]
Los visemas y los fonemas no tienen una correspondencia uno a uno. A menudo, varios fonemas corresponden a un solo visema, ya que varios fonemas se ven iguales en la cara al producirse, como /k, ɡ, ŋ/ ; así como /t, d, n, l/ y /p, b, m/ . Por lo tanto, palabras como pet, bell y men son difíciles de distinguir para quienes leen los labios, ya que todas se ven iguales. Según una teoría, los visemas ofrecen información (fonética) sobre el punto de articulación, mientras que el modo de articulación requiere información auditiva. [ 2 ]
Sin embargo, puede haber diferencias en el tiempo y la duración durante el habla natural en términos de la "firma" visual de un gesto dado que no se puede capturar simplemente concatenando imágenes (fijas) de cada uno de los patrones de la boca en secuencia. [ 3 ] Por el contrario, algunos sonidos que son difíciles de distinguir acústicamente se distinguen claramente por el rostro. Por ejemplo, en inglés hablado , /l/ y /r/ a menudo pueden sonar bastante similares (especialmente en grupos, como 'grass' vs. 'glass'), pero la información visual puede desambiguar. Algunos lingüistas han argumentado que el habla se entiende mejor como bimodal (auditiva y visual), y la comprensión puede verse comprometida si falta uno de estos dos dominios. [ 4 ]
Los visemas a menudo pueden ser humorísticos, como en la frase "jugo de elefante", que al leerse los labios parece idéntica a "Te amo".
Las aplicaciones del estudio de los visemas incluyen el procesamiento del habla , el reconocimiento del habla y la animación facial por ordenador .
Véase también
Referencias
- ↑ Fisher, Cletus G. (1 de diciembre de 1968). "Confusiones entre consonantes percibidas visualmente" . Journal of Speech and Hearing Research . 11 (4): 796– 804. doi : 10.1044/jshr.1104.796 . PMID 5719234 .
- ↑ Summerfield, Quentin (29 de enero de 1992). "Lectura de labios y percepción del habla audiovisual" . Philosophical Transactions of the Royal Society of London. Serie B: Ciencias Biológicas . 335 (1273): 71– 78. doi : 10.1098/rstb.1992.0009 . eISSN 1471-2970 . ISSN 0962-8436 . PMID 1348140 .
- ↑ Calvert, Gemma A.; Campbell, Ruth (1 de enero de 2003). "Lectura del habla a partir de rostros estáticos y en movimiento: los sustratos neuronales del habla visible". Journal of Cognitive Neuroscience . 15 (1): 57– 70. doi : 10.1162/089892903321107828 . PMID 12590843. S2CID 14153329 .
- ↑ McGurk, Harry ; MacDonald, John (23 de diciembre de 1976). "Oír labios y ver voces" . Nature . 264 (5588): 746–748 . Bibcode : 1976Natur.264..746M . doi : 10.1038/264746a0 . PMID 1012311 .
Lecturas adicionales
- Chen, Tsuhan; Rao, RR (31 de mayo de 1998). "Integración audiovisual en la comunicación multimodal" . Actas del IEEE . 86 (5). IEEE: 837–852 . Bibcode : 1998IEEEP..86..837T . doi : 10.1109/5.664274 . eISSN 1558-2256 . ISSN 0018-9219 .
- Chen, Tsuhan (31 de enero de 2001). "Procesamiento de voz audiovisual". IEEE Signal Processing Magazine . 18 (1). IEEE: 9– 21. Bibcode : 2001ISPM...18....9C . doi : 10.1109/79.911195 . eISSN 1558-0792 . ISSN 1053-5888 .
- Lucey, Patrick; Martin, Terrence; Sridharan, Sridha (8–10 de diciembre de 2004). Confusión de fonemas agrupados según sus clases de visemas en entornos ruidosos (PDF) . 10.ª Conferencia Internacional Australiana sobre Ciencia y Tecnología del Habla. Sídney: Universidad Macquarie. págs. 265–270 . Archivado del original (PDF) el 5 de julio de 2017.
- expresiones faciales
- Unidades lingüísticas
- Fonología
- Fragmentos de fonología