
La síntesis de modelado espectral ( SMS ) es un método de modelado acústico para el habla y otras señales. La SMS considera los sonidos como una combinación de contenido armónico y ruido . Los componentes armónicos se identifican a partir de los picos en el espectro de frecuencia de la señal, normalmente mediante la transformada de Fourier de corto tiempo . La señal que queda tras la eliminación de los componentes espectrales, a veces denominada residuo, se modela como ruido blanco filtrado con un filtro variable en el tiempo. El resultado del modelo son las frecuencias y los niveles de los componentes armónicos detectados, así como los coeficientes del filtro variable en el tiempo.
Intuitivamente, el modelo puede aplicarse a muchos tipos de señales de audio. Las señales de voz, por ejemplo, incluyen sonidos armónicos que cambian lentamente, producidos por la vibración de las cuerdas vocales , además de sonidos de banda ancha similares al ruido, generados por los labios y la boca. Los instrumentos musicales también producen sonidos que contienen componentes armónicos y sonidos percusivos similares al ruido cuando se pulsan o cambian las notas.
Véase también
- Codificación del habla
- CELP
- Modelo fuente-filtro de producción del habla
- síntesis FM
- Síntesis de sonido
- SPEAR - Análisis y resíntesis de edición parcial sinusoidal
Referencias
- Serra, Xavier (2003). "Síntesis de modelos espectrales: pasado y presente" (PDF) . pág. 20. Recuperado el 11 de mayo de 2010 .
- Serra, Xavier . "Herramientas de síntesis de modelado espectral" . Recuperado el 11 de mayo de 2010 .
- Smith III, Julius O. (28 de diciembre de 2005). "Modelado espectral" . Recuperado el 19 de abril de 2008 .
- Roads, Curtis (1996). «Figura 4.23: Descripción general de la síntesis de modelado de espectro...». The Computer Music Tutorial . MIT Press . pág. 153. ISBN 978-0-262-68082-0.
- Bonada, J.; Loscos, A.; Cano, P.; Serra, X .; Kenmochi, H. (2001). "Enfoque espectral para el modelado de la voz cantada". En Actas de la 111.ª Convención de la AES . CiteSeerX 10.1.1.75.2357 .
- Reconocimiento de voz
- Esbozos de software científico